{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2026:KXFO2X6R7C4GB5HE6QJGZXFKNN","short_pith_number":"pith:KXFO2X6R","canonical_record":{"source":{"id":"2608.09217","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-08-10T07:43:05Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"5e6fecf79fb61907ff1493b923fb00d9fda9fd163ac005070db15c1d5efb62b3","abstract_canon_sha256":"812f7eee2950604e5c509a3213ccf3536839d04cbe4eb22812d19456970ffc6f"},"schema_version":"1.0"},"canonical_sha256":"55caed5fd1f8b860f4e4f4126cdcaa6b783cdd943bbf897cdb446a7648cbcfa0","source":{"kind":"arxiv","id":"2608.09217","version":1},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2608.09217","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"arxiv_version","alias_value":"2608.09217v1","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2608.09217","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_12","alias_value":"KXFO2X6R7C4G","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_16","alias_value":"KXFO2X6R7C4GB5HE","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_8","alias_value":"KXFO2X6R","created_at":"2026-08-11T02:22:06Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2026:KXFO2X6R7C4GB5HE6QJGZXFKNN","target":"record","payload":{"canonical_record":{"source":{"id":"2608.09217","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-08-10T07:43:05Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"5e6fecf79fb61907ff1493b923fb00d9fda9fd163ac005070db15c1d5efb62b3","abstract_canon_sha256":"812f7eee2950604e5c509a3213ccf3536839d04cbe4eb22812d19456970ffc6f"},"schema_version":"1.0"},"canonical_sha256":"55caed5fd1f8b860f4e4f4126cdcaa6b783cdd943bbf897cdb446a7648cbcfa0","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-08-11T02:22:06.553500Z","signature_b64":"OB/UGfnJC+ed1/y7Z4e2S9/G7nv5f6313J2owBNYJHXyyiAX63XMQsuwS+0ZcTfocLNwHGzpJ/rY8uY4KVKpDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"55caed5fd1f8b860f4e4f4126cdcaa6b783cdd943bbf897cdb446a7648cbcfa0","last_reissued_at":"2026-08-11T02:22:06.551961Z","signature_status":"signed_v1","first_computed_at":"2026-08-11T02:22:06.551961Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2608.09217","source_version":1,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-08-11T02:22:06Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"cJVmdkUwdcuRyju+8ERZKxzPGYodAd5gbkq1Mx6onErx0z2pSprq70K+/+HfrfFDeUD+X0vCgXfzzZon1byNCQ==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-17T14:36:03.520430Z"},"content_sha256":"3eaad4d18d1fe1e6e2115d6038b5a4874764e2a75cedc3c014bd69a9ad5b840a","schema_version":"1.0","event_id":"sha256:3eaad4d18d1fe1e6e2115d6038b5a4874764e2a75cedc3c014bd69a9ad5b840a"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2026:KXFO2X6R7C4GB5HE6QJGZXFKNN","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.LG","authors_text":"Daoyuan Chen, Qianli Shen, Ting Zhou, Yaliang Li, Yilun Huang, Ying Shen, Zhenqing Ling","submitted_at":"2026-08-10T07:43:05Z","abstract_excerpt":"Reinforcement learning (RL) has become a central post-training paradigm for eliciting reasoning capabilities in large language models, yet uniform task sampling allocates compute without regard to differences in how tasks respond to optimization. Existing task-valuation methods mostly rely on snapshot-based signals such as current pass rate or reward, which estimate how solvable a task is under the current policy. However, tasks with similar current solvability can still differ substantially in how positively they respond to further training. We study this residual axis as task learnability: a"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2608.09217","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2608.09217/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-08-11T02:22:06Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"gYVv8hlsHm4RhaHfWnryHH0tnfIEJDaUsoFBL2xBJt6AeBrCWvaLR7ZraEbKxqon9LdsaYQrVnaunGlyGqviDw==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-17T14:36:03.529075Z"},"content_sha256":"73061f1ccaa66929897eef79315fac694b2540ea199e8adf3c9ccb22be796e69","schema_version":"1.0","event_id":"sha256:73061f1ccaa66929897eef79315fac694b2540ea199e8adf3c9ccb22be796e69"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/bundle.json","state_url":"https://pith.science/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-17T14:36:03Z","links":{"resolver":"https://pith.science/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN","bundle":"https://pith.science/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/bundle.json","state":"https://pith.science/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/state.json","well_known_bundle":"https://pith.science/.well-known/pith/KXFO2X6R7C4GB5HE6QJGZXFKNN/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2026:KXFO2X6R7C4GB5HE6QJGZXFKNN","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"812f7eee2950604e5c509a3213ccf3536839d04cbe4eb22812d19456970ffc6f","cross_cats_sorted":["cs.AI"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-08-10T07:43:05Z","title_canon_sha256":"5e6fecf79fb61907ff1493b923fb00d9fda9fd163ac005070db15c1d5efb62b3"},"schema_version":"1.0","source":{"id":"2608.09217","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2608.09217","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"arxiv_version","alias_value":"2608.09217v1","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2608.09217","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_12","alias_value":"KXFO2X6R7C4G","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_16","alias_value":"KXFO2X6R7C4GB5HE","created_at":"2026-08-11T02:22:06Z"},{"alias_kind":"pith_short_8","alias_value":"KXFO2X6R","created_at":"2026-08-11T02:22:06Z"}],"graph_snapshots":[{"event_id":"sha256:73061f1ccaa66929897eef79315fac694b2540ea199e8adf3c9ccb22be796e69","target":"graph","created_at":"2026-08-11T02:22:06Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2608.09217/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Reinforcement learning (RL) has become a central post-training paradigm for eliciting reasoning capabilities in large language models, yet uniform task sampling allocates compute without regard to differences in how tasks respond to optimization. Existing task-valuation methods mostly rely on snapshot-based signals such as current pass rate or reward, which estimate how solvable a task is under the current policy. However, tasks with similar current solvability can still differ substantially in how positively they respond to further training. We study this residual axis as task learnability: a","authors_text":"Daoyuan Chen, Qianli Shen, Ting Zhou, Yaliang Li, Yilun Huang, Ying Shen, Zhenqing Ling","cross_cats":["cs.AI"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2608.09217","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:3eaad4d18d1fe1e6e2115d6038b5a4874764e2a75cedc3c014bd69a9ad5b840a","target":"record","created_at":"2026-08-11T02:22:06Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"812f7eee2950604e5c509a3213ccf3536839d04cbe4eb22812d19456970ffc6f","cross_cats_sorted":["cs.AI"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-08-10T07:43:05Z","title_canon_sha256":"5e6fecf79fb61907ff1493b923fb00d9fda9fd163ac005070db15c1d5efb62b3"},"schema_version":"1.0","source":{"id":"2608.09217","kind":"arxiv","version":1}},"canonical_sha256":"55caed5fd1f8b860f4e4f4126cdcaa6b783cdd943bbf897cdb446a7648cbcfa0","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"55caed5fd1f8b860f4e4f4126cdcaa6b783cdd943bbf897cdb446a7648cbcfa0","first_computed_at":"2026-08-11T02:22:06.551961Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-08-11T02:22:06.551961Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"OB/UGfnJC+ed1/y7Z4e2S9/G7nv5f6313J2owBNYJHXyyiAX63XMQsuwS+0ZcTfocLNwHGzpJ/rY8uY4KVKpDQ==","signature_status":"signed_v1","signed_at":"2026-08-11T02:22:06.553500Z","signed_message":"canonical_sha256_bytes"},"source_id":"2608.09217","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:3eaad4d18d1fe1e6e2115d6038b5a4874764e2a75cedc3c014bd69a9ad5b840a","sha256:73061f1ccaa66929897eef79315fac694b2540ea199e8adf3c9ccb22be796e69"],"state_sha256":"26cd78056ea56fa7a60a246f1a4ab5712f11fe4a91620fd1c257c2f8aa6ed759"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"kCnyqHnDgisvArHz6QuMeBA/jyhj2K1A7VnHbAgvVcRcGfffoWSs1RpIgXlWnGm/3ESwvzULUvCOcGM7tqKeCg==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-17T14:36:03.600902Z","bundle_sha256":"e77c536af80879c02c3c786a6264b10b23d9b3045581bcca49ec86a664bf5ac0"}}