{"as_of":"2026-08-17T23:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54f7c3cb133d0052dbb03587024966ffd9ce7279a389023820f58cb1f5a5064a","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:30:37.427244Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09217/citation-record","integrity":"/paper/2608.09217/integrity","json":"/paper/2608.09217/citation-record.json","paper":"/paper/2608.09217"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-15T14:30:37.297238Z","title":"arXiv preprint arXiv:2503.14476 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.297238Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:24e12786cb3bc55f8e01ced105a92e2fcedb5619b36d07cc56ec0e40757030f9","observation_id":"76a17232-b8aa-4cf1-97ce-5e7dea2bd0e4","resolution":{"observed_at":"2026-08-15T14:30:37.297238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14965","last_updated":"2025-06-17T20:24:00Z","snapshot_observed_at":"2026-08-17T06:16:58.781932Z","submitted_at":"2025-06-17T20:24:00Z","title":"Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14965","snapshot_observed_at":"2026-08-15T14:30:37.303244Z","title":"arXiv preprint arXiv:2506.14965 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.303244Z"},"links":{"cited_paper":"/paper/2506.14965","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:f6e8403a0800f2027231a0075a27bc45659ee5e34558d2ec7c13de6f5d45bf32","observation_id":"1c49c445-67d3-44ac-b7ad-ebf7d888f3bb","resolution":{"observed_at":"2026-08-15T14:30:37.303244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04604","last_updated":"2025-01-08T05:24:50Z","snapshot_observed_at":"2026-08-16T13:00:34.704005Z","submitted_at":"2024-12-05T20:40:28Z","title":"ARC Prize 2024: Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04604","snapshot_observed_at":"2026-08-15T14:30:37.307376Z","title":"arXiv preprint arXiv:2412.04604 , year=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.307376Z"},"links":{"cited_paper":"/paper/2412.04604","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:04a9e72b747b649b4f87a485f36ce1515abb2cc7c77d0890f33f8c1596c6d640","observation_id":"62c09aed-239e-4cb7-a5ba-fd1dae9d2244","resolution":{"observed_at":"2026-08-15T14:30:37.307376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11831","last_updated":"2026-01-15T23:30:35Z","snapshot_observed_at":"2026-08-17T15:02:18.805323Z","submitted_at":"2025-05-17T04:34:48Z","title":"ARC-AGI-2: A New Challenge for Frontier AI Reasoning Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11831","snapshot_observed_at":"2026-08-15T14:30:37.311487Z","title":"arXiv preprint arXiv:2505.11831 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.311487Z"},"links":{"cited_paper":"/paper/2505.11831","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:da2e8fd6deb067a148b8590165657057f422ac81ab86ba7ad8916ae4ef25b456","observation_id":"e3533057-1b66-4018-81df-5053a51de561","resolution":{"observed_at":"2026-08-15T14:30:37.311487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02272","last_updated":"2024-12-02T12:36:30Z","snapshot_observed_at":"2026-08-17T01:30:59.894557Z","submitted_at":"2024-11-04T17:03:55Z","title":"Combining Induction and Transduction for Abstract Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02272","snapshot_observed_at":"2026-08-15T14:30:37.315592Z","title":"arXiv preprint arXiv:2411.02272 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.315592Z"},"links":{"cited_paper":"/paper/2411.02272","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:080c03d380416b6104536745c4414b524c49b4b765299358b4e67a45f66f2ece","observation_id":"dbe2dfd0-3084-4708-81e6-4c152bd848b8","resolution":{"observed_at":"2026-08-15T14:30:37.315592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-15T14:30:37.319594Z","title":"5-math technical report: Toward mathematical expert model via self-improvement , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.319594Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:3bffe2f8cc1d32bcaae6cfe504ca9743eef68180afe51b3b58c12684567a6f08","observation_id":"4a55943a-e851-43bf-95bf-b5cab0373cf6","resolution":{"observed_at":"2026-08-15T14:30:37.319594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-15T14:30:37.323436Z","title":"arXiv preprint arXiv:2103.03874 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.323436Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:26a8bce749e733ed4b55398cbbde10d51e9166371a7358a40e157091c9c12130","observation_id":"2246e74a-392d-4613-aa7d-c33d4670c84d","resolution":{"observed_at":"2026-08-15T14:30:37.323436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.327419Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.327419Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:c9c2bcd87b2671aed11b0ebd78aacaa15658c84a351e0eb4f59fba41e5dfc271","observation_id":"fda932df-d02f-4312-86d0-43cbc3735819","resolution":{"observed_at":"2026-08-15T14:30:37.327419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.331046Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.331046Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:aafe59a5f96a61e2191e1e67255f61f1042a3aaa6fe35de800faf61a3fdeb82f","observation_id":"0618166f-faab-4632-9ef1-acd3015316ec","resolution":{"observed_at":"2026-08-15T14:30:37.331046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.166418Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":"d69227e2-5606-4eae-8a08-40da729b6e8a","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.334934Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:a16bd3382f1959a1bbe1bf06386083e41fa29dccb395716ab5510efa05ca3e5a","observation_id":"991f03e7-5fb8-4ac7-a8f4-2894f0b8d8d8","resolution":{"observed_at":"2026-08-15T14:30:38.170046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.338493Z","title":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP) , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.338493Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:3259a7bedbfa0b022a6ec324b70b51a5f8c02f30ffb2d688fde2be2306ca77ef","observation_id":"009f1422-ea1f-446d-a2f6-05b96aa83289","resolution":{"observed_at":"2026-08-15T14:30:37.338493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.342012Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.342012Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:6f35ea1dba5c19a7159704daa0868f3dbf26a9822252781f12393d1ba92b4196","observation_id":"f1fc75b7-48f2-48c6-8844-e2792e692bce","resolution":{"observed_at":"2026-08-15T14:30:37.342012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17512","last_updated":"2025-07-23T13:51:04Z","snapshot_observed_at":"2026-08-09T23:40:29.433863Z","submitted_at":"2025-07-23T13:51:04Z","title":"Can One Domain Help Others? A Data-Centric Study on Multi-Domain Reasoning via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17512","snapshot_observed_at":"2026-08-15T14:30:37.345453Z","title":"arXiv preprint arXiv:2507.17512 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.345453Z"},"links":{"cited_paper":"/paper/2507.17512","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:0645bbcb3e2ab905728df8b22c1fc53c17a57bc3dc8bce15d0e8af05778ab643","observation_id":"8025b3f4-d303-4815-81a3-d6d8fd450357","resolution":{"observed_at":"2026-08-15T14:30:37.345453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.349144Z","title":"arXiv preprint arXiv:2505.17826 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.349144Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:93e2cd1faf558990b353663c1524b759a432161483f590fbc9f92c9cb9312769","observation_id":"fea3e417-3716-4964-afa1-9cba51d93acf","resolution":{"observed_at":"2026-08-15T14:30:37.349144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-08-15T14:30:37.352788Z","title":"arXiv preprint arXiv:2304.11277 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.352788Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:6ae564c1b6b592e27cdb16dbfa19e2acae9525e6089bff1efa38f6b182249f61","observation_id":"3d5939f3-4288-4634-b5c3-b0f5b102af80","resolution":{"observed_at":"2026-08-15T14:30:37.352788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.356377Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.356377Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:73a4dce3a7f1b473020af626a10193af1a19e638a3abc0da200fc1ee97134f3d","observation_id":"2727da9a-a471-4718-a744-5c4db3bc47fa","resolution":{"observed_at":"2026-08-15T14:30:37.356377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.359797Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.359797Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:5cd67873d3fc7d59fa874c8fcdee3575ac7e2012a7efb65ad6197ec78f6f4c52","observation_id":"ec872332-deea-4ad8-9842-3526c982b245","resolution":{"observed_at":"2026-08-15T14:30:37.359797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.363374Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.363374Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:80eece5cb5815447d56c325dd341b299f77b0d5fbdc1682f04c1df19579021fa","observation_id":"1c460ce9-35fc-4f91-973e-cc4275674c47","resolution":{"observed_at":"2026-08-15T14:30:37.363374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T14:30:37.366824Z","title":"arXiv preprint arXiv:2505.09388 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.366824Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:32cb51914107ecfbdb5a1f73c40a3e638998c2c2f451eaeb35216530cb65ed05","observation_id":"907ca041-f65b-473b-9542-1c27f0edfe4f","resolution":{"observed_at":"2026-08-15T14:30:37.366824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T14:30:37.370006Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.370006Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:52de43ae635ef202ba78fc2d0f60302b21d4cd7ffbf80e494d32cbd1ee94e048","observation_id":"4ee37fc3-d006-489a-87fc-227622783ad0","resolution":{"observed_at":"2026-08-15T14:30:37.370006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.373585Z","title":"arXiv preprint arXiv:2510.26374 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.373585Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:3328b522bfdafe94d877001f0c8b4f4f280a9f3fb2bdb76765d6cc253297dbc4","observation_id":"73f4409a-cdb9-48c8-82ca-78fa82aa5593","resolution":{"observed_at":"2026-08-15T14:30:37.373585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.116811Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":"3adf5ca3-eec5-437b-a3b5-d9db9ba8af36","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.376889Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:3ce7aaa3133744f7c51df8e88decb2d7674ed5c1af8885d95646d22180145b14","observation_id":"69ff63d9-27ec-4aaa-b982-5b1bbd774815","resolution":{"observed_at":"2026-08-15T14:30:38.120390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.105992Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":"a99b3394-91cd-4b79-afa0-a5ffeb96218e","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.380374Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:3b4b277ebb5e4456299bd0a353fb8920138f48c933cf39166e22cfd1c8f21403","observation_id":"5956579d-a756-47bc-9f46-e59aa3d735ba","resolution":{"observed_at":"2026-08-15T14:30:38.109810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.383734Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.383734Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:5a89dfc783f564360ce4019cc4689a41323a0744c141ffed3c7485dbf89c9656","observation_id":"dcc10dff-5db6-4e71-9277-a2e675d4956c","resolution":{"observed_at":"2026-08-15T14:30:37.383734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.089407Z","title":"Second Conference on Language Modeling , year=","venue":null,"work_id":"e1052c49-584d-4135-8408-e4714bc98f7d","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.387110Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:0737ab4fdcd867fa5f1981a8e18e48c84538de3291395ca8787e8d8e4d19449c","observation_id":"084a9637-3207-4b9d-a9f6-3cb06bbc2368","resolution":{"observed_at":"2026-08-15T14:30:38.093220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.390670Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.390670Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:8a19396ba7b67b6fe8910e5b5d60f727dadc8bafbb0af0923373c8fbce12a36c","observation_id":"3deeae9f-b0aa-490d-97da-11c988c83e33","resolution":{"observed_at":"2026-08-15T14:30:37.390670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11886","last_updated":"2025-02-17T15:13:29Z","snapshot_observed_at":"2026-08-17T13:27:14.855105Z","submitted_at":"2025-02-17T15:13:29Z","title":"LIMR: Less is More for RL Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11886","snapshot_observed_at":"2026-08-15T14:30:37.394264Z","title":"arXiv preprint arXiv:2502.11886 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.394264Z"},"links":{"cited_paper":"/paper/2502.11886","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:a68defee41510493787fe49e0e310e21736fc87a738162310f850ddc9e263a6c","observation_id":"2019c7f7-8f1d-424a-960b-4b1ca17e1729","resolution":{"observed_at":"2026-08-15T14:30:37.394264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T14:30:37.397860Z","title":"arXiv preprint arXiv:2501.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.397860Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:ac912d47ccd45eb6f4a6f446d3f21287005781b62c9dfe44c9e98eaeb00cfbc9","observation_id":"277e402a-5a40-4abd-9dfa-4abfda653420","resolution":{"observed_at":"2026-08-15T14:30:37.397860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T14:30:37.401651Z","title":"arXiv preprint arXiv:2412.16720 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.401651Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:99773bb4ea4bb3bf5d95ad0a93d4f9e66e6d4b7de5842e872bff7a93d35fd6f0","observation_id":"6004c633-bc38-40cd-944c-717553acb252","resolution":{"observed_at":"2026-08-15T14:30:37.401651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.405921Z","title":"arXiv preprint arXiv:2510.01135 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.405921Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:58c5044d92351457e442639c336cf024cbce1e95e9023c6c93d09217f7c2f771","observation_id":"d647a9b4-cf08-409f-baa7-6934ccfc016f","resolution":{"observed_at":"2026-08-15T14:30:37.405921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25184","last_updated":"2026-06-06T09:08:19Z","snapshot_observed_at":"2026-08-01T16:47:48.719478Z","submitted_at":"2026-03-26T08:52:35Z","title":"Train at Moving Edge: Online-Verified Prompt Selection for Efficient RL Training of Large Reasoning Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.25184","snapshot_observed_at":"2026-08-15T14:30:37.409375Z","title":"arXiv preprint arXiv:2603.25184 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.409375Z"},"links":{"cited_paper":"/paper/2603.25184","citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:8560e217e11aeebb461910b99ea645cb8872839d722024444acbb24f1188a0c3","observation_id":"f08eb949-2f93-4b53-9579-5b5c027a25d7","resolution":{"observed_at":"2026-08-15T14:30:37.409375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.069784Z","title":"Training , volume=","venue":null,"work_id":"4a96c5c7-323c-41bb-8199-3e527e07a7c3","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.413134Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:605d5321de6e906f9840e20107413dd1c0275f044748d7beff7259398c2ca3c3","observation_id":"823a17d9-38d5-4086-9161-1e1efb00ab95","resolution":{"observed_at":"2026-08-15T14:30:38.073786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.416554Z","title":"arXiv preprint arXiv:2506.06632 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.416554Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:db5849c85a00f4b9fd4f5871a202bfac400e43ad152e5b5e8ec8773d2e89359d","observation_id":"b1809ef7-6d32-4eec-abee-a0c70477acfa","resolution":{"observed_at":"2026-08-15T14:30:37.416554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:38.056144Z","title":"Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V","venue":null,"work_id":"1b657d75-72d0-44a4-aaf7-04948518be2e","year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.420249Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:8fcaa395f6333bba2ebc3a56aa48b50bd867a0e01b2d5c145ad69c842b21fb6f","observation_id":"d2396ca0-ea82-4fac-b967-1d3d1c953181","resolution":{"observed_at":"2026-08-15T14:30:38.061263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.423797Z","title":"arXiv preprint arXiv:2505.14970 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.423797Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:e8866059c460ba64e009bb5ec9fdc83a835581e61c6959a10ccae50dd03d49d0","observation_id":"c791ecaa-9d2a-46e9-b89c-3230d8284c5b","resolution":{"observed_at":"2026-08-15T14:30:37.423797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:30:37.427244Z","title":"arXiv preprint arXiv:2602.20532 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:30:37.427244Z"},"links":{"citing_paper":"/paper/2608.09217"},"observation_digest":"sha256:a7abb0185f21b094738df57b766895433a0b5999fd911e5d721e9c60d9917c6a","observation_id":"aef20110-6d47-4d10-ac24-c9a2e04cd6d0","resolution":{"observed_at":"2026-08-15T14:30:37.427244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09217","last_updated":"2026-08-10T07:43:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T11:36:51.779667Z","submitted_at":"2026-08-10T07:43:05Z","title":"Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2608.09217."}