{"as_of":"2026-08-16T19:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbd46ae398ada10f38a3e7992c21189cc29b6e827773b6491b6a4f6df9b8cdd9","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T02:43:38.526645Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.10014/citation-record","integrity":"/paper/2602.10014/integrity","json":"/paper/2602.10014/citation-record.json","paper":"/paper/2602.10014"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:33.314701Z","title":"Intrinsic dimensionality explains the effectiveness of language model fine-tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.314701Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:fe0272e5f1c276c770395937bfcc42c92ae99f400d243a0e6c57abb7e747d5ef","observation_id":"51242c2b-32fb-4315-9ba8-4a9e5f9a5f36","resolution":{"observed_at":"2026-08-03T02:43:33.314701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16737","last_updated":"2024-10-07T19:37:10Z","snapshot_observed_at":"2026-08-16T13:22:50.405013Z","submitted_at":"2024-08-29T17:32:35Z","title":"Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16737","snapshot_observed_at":"2026-08-03T02:43:33.445001Z","title":"Smaller, weaker, yet better: Training llm reasoners via compute-optimal sampling.arXiv preprint arXiv:2408.16737, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.445001Z"},"links":{"cited_paper":"/paper/2408.16737","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:d67ef3579b73595e45fb738bf6358580854401e9f87c158757687630a0e777f5","observation_id":"1246c825-e4ae-4c10-a5c6-f8e7e9dd842c","resolution":{"observed_at":"2026-08-03T02:43:33.445001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-03T02:43:33.551277Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.551277Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:4734b52669e949b190ec4ab60010f6d0e72df730a676237317bb786b11c7e817","observation_id":"baaa6c08-d736-4e3d-ba72-5e8491f35f24","resolution":{"observed_at":"2026-08-03T02:43:33.551277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:33.684760Z","title":"Understanding self-distillation in the presence of label noise","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.684760Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:c02a87973c6b10aa6d48be03845f9f5c5d4a1f4e46d36240b7e7070c75ae05d2","observation_id":"a70328de-abc2-4832-8a73-a421b67040fa","resolution":{"observed_at":"2026-08-03T02:43:33.684760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07515","last_updated":"2024-10-25T03:38:41Z","snapshot_observed_at":"2026-08-16T13:44:04.073397Z","submitted_at":"2024-06-11T17:46:16Z","title":"Beyond Model Collapse: Scaling Up with Synthesized Data Requires Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07515","snapshot_observed_at":"2026-08-03T02:43:33.780269Z","title":"Beyond model collapse: Scaling up with synthesized data requires verification.arXiv preprint arXiv:2406.07515, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.780269Z"},"links":{"cited_paper":"/paper/2406.07515","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:3c52734741103cfd06ec428eaaed5ba8f54c139d6dc4355fb637a98d9530b88a","observation_id":"68b96946-0003-4499-b0d7-c3341c91fb8c","resolution":{"observed_at":"2026-08-03T02:43:33.780269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09499","last_updated":"2024-06-12T21:28:28Z","snapshot_observed_at":"2026-08-16T13:43:34.240346Z","submitted_at":"2024-06-12T21:28:28Z","title":"Self-Consuming Generative Models with Curated Data Provably Optimize Human Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09499","snapshot_observed_at":"2026-08-03T02:43:33.964748Z","title":"Self-consuming generative models with curated data provably optimize human preferences.arXiv preprint arXiv:2407.09499, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:33.964748Z"},"links":{"cited_paper":"/paper/2407.09499","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:89f275b42ae46db66f239c86c09bec7798fb0e58f70674d8d294115829746d4a","observation_id":"2cbb0070-04db-4858-aea1-80b079085422","resolution":{"observed_at":"2026-08-03T02:43:33.964748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11778","last_updated":"2024-06-24T14:23:30Z","snapshot_observed_at":"2026-08-16T14:17:30.744744Z","submitted_at":"2024-02-19T02:08:09Z","title":"Towards Theoretical Understandings of Self-Consuming Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11778","snapshot_observed_at":"2026-08-03T02:43:34.066179Z","title":"Towards theoretical understandings of self-consuming generative models.arXiv preprint arXiv:2402.11778, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.066179Z"},"links":{"cited_paper":"/paper/2402.11778","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:c7b2a19c78ae9ddb496220a733b324a02a2c610520f2791569276a3426f58b30","observation_id":"871c7695-7369-4a87-a32b-6d309d392038","resolution":{"observed_at":"2026-08-03T02:43:34.066179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:34.174752Z","title":"Self-verification provably prevents model collapse in recursive synthetic training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.174752Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:03784ea190cf8408fcf57f2d4521c8151dd26cf3b08ff0c0f9b8f853d82148b9","observation_id":"fea1b8b6-cc38-4cb4-8a42-377033b77326","resolution":{"observed_at":"2026-08-03T02:43:34.174752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18865","last_updated":"2025-02-26T06:18:13Z","snapshot_observed_at":"2026-08-16T12:55:07.742509Z","submitted_at":"2025-02-26T06:18:13Z","title":"A Theoretical Perspective: How to Prevent Model Collapse in Self-consuming Training Loops","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18865","snapshot_observed_at":"2026-08-03T02:43:34.264756Z","title":"A theoretical perspective: Howtopreventmodelcollapseinself-consumingtrainingloops.arXiv preprint arXiv:2502.18865, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.264756Z"},"links":{"cited_paper":"/paper/2502.18865","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:8cd9d4f48fa6e8a63c50920e82c4f821539417132a5e4f34f04b42b3a533ac54","observation_id":"ee23ba26-3d4d-45b6-9289-8f71247c0d0f","resolution":{"observed_at":"2026-08-03T02:43:34.264756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:34.312806Z","title":"Cambridge university press, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.312806Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:9f3b13020e324f7c1de3b0486f2ea2bc7e47ac7c3c93ae8c57f4d65fc17eb67d","observation_id":"902ae028-2bfa-42e2-88aa-105ebf427232","resolution":{"observed_at":"2026-08-03T02:43:34.312806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01413","last_updated":"2024-04-29T23:13:42Z","snapshot_observed_at":"2026-08-16T14:04:32.950182Z","submitted_at":"2024-04-01T18:31:24Z","title":"Is Model Collapse Inevitable? Breaking the Curse of Recursion by Accumulating Real and Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01413","snapshot_observed_at":"2026-08-03T02:43:34.442154Z","title":"Is model collapse inevitable? breaking the curse of recursion by accumulating real and synthetic data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.442154Z"},"links":{"cited_paper":"/paper/2404.01413","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:cd29798963c70a67c2b5b987e859bfc0ebcf7ae4f8f4194627a8a739713dc7c4","observation_id":"7e847d73-d621-438f-83fa-1154dc2ffddb","resolution":{"observed_at":"2026-08-03T02:43:34.442154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07087","last_updated":"2024-06-10T14:22:45Z","snapshot_observed_at":"2026-08-16T14:19:37.011744Z","submitted_at":"2024-02-11T02:34:42Z","title":"Self-Correcting Self-Consuming Loops for Generative Model Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07087","snapshot_observed_at":"2026-08-03T02:43:34.544741Z","title":"Self-correcting self-consuming loops for generative model training.arXiv preprint arXiv:2402.07087, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.544741Z"},"links":{"cited_paper":"/paper/2402.07087","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:331a904b5f45a50be620e79a54ad9145bfc31d868bfc1d90b60fa2d313134a91","observation_id":"bb326200-a19a-47d3-b716-0d536753fb65","resolution":{"observed_at":"2026-08-03T02:43:34.544741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T02:43:34.644029Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.644029Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:da8175a66120b9850a44988c7625a23c5ec8d652abf04bccc46155e91b336180","observation_id":"69fa0049-0ba1-41dc-8cca-90e6212130fd","resolution":{"observed_at":"2026-08-03T02:43:34.644029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-14T00:11:28.443916Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-03T02:43:34.738415Z","title":"rstar-math: Small llms can master math reasoning with self-evolved deep thinking.arXiv preprint arXiv:2501.04519, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.738415Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:9bbd033ab87178a1706baf9891e1d70e8f7b6ff2ca02a2ac1276ce821dafbc1a","observation_id":"2a65ce3f-459f-4877-9f61-32c6531bc8d9","resolution":{"observed_at":"2026-08-03T02:43:34.738415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T02:43:34.983533Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:34.983533Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:6a6f1c23cdbcc53cef94ed9bc05ec915a61bff58b83448cfd0fc7a8e1ba0ca71","observation_id":"ca9bd427-7575-464f-abd9-784748578992","resolution":{"observed_at":"2026-08-03T02:43:34.983533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01951","last_updated":"2024-12-04T14:20:21Z","snapshot_observed_at":"2026-08-15T20:14:34.350336Z","submitted_at":"2024-12-02T20:24:17Z","title":"Self-Improvement in Language Models: The Sharpening Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01951","snapshot_observed_at":"2026-08-03T02:43:35.074111Z","title":"Self-improvement in language models: The sharpening mechanism.arXiv preprint arXiv:2412.01951, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:35.074111Z"},"links":{"cited_paper":"/paper/2412.01951","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:b1c65a75298cf8b92c13bf8cc30e68a0705d2d58d4cf9a60cbebee5c3f82ad9e","observation_id":"d9e3b4c8-2b19-4b7e-8c88-eaf2aad9f39a","resolution":{"observed_at":"2026-08-03T02:43:35.074111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:35.187626Z","title":"Adastar: Adaptive data sampling for training self-taught reasoners.arXiv preprint arXiv:2505.16322, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:35.187626Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:4138530775add28a85cf03888befe350cde869c077b8501ee1e1c339a3a8916e","observation_id":"a92164a4-cfe1-4d16-8170-e066dbd66c7f","resolution":{"observed_at":"2026-08-03T02:43:35.187626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01612","last_updated":"2025-02-13T05:32:54Z","snapshot_observed_at":"2026-08-15T08:57:38.014688Z","submitted_at":"2025-02-03T18:45:22Z","title":"Self-Improving Transformers Overcome Easy-to-Hard and Length Generalization Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01612","snapshot_observed_at":"2026-08-03T02:43:35.308208Z","title":"Self-improving transformers overcome easy-to-hard and length generalization challenges.arXiv preprint arXiv:2502.01612, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:35.308208Z"},"links":{"cited_paper":"/paper/2502.01612","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:ebf0cdc69dad6550aeb55b62eaa0ff3578db877071f26166c95f37fd557e3e51","observation_id":"999b486e-0963-44e2-9b85-109a71a815a3","resolution":{"observed_at":"2026-08-03T02:43:35.308208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-08-15T13:54:00.996017Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-03T02:43:35.409770Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving.arXiv preprint arXiv:2502.07640, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:35.409770Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:b60207d16819933c9f3f7e2ff8895331488bcc44b79d7e70ef4dbb2a188593f3","observation_id":"17243480-9c70-49c8-a8c3-274f04788f60","resolution":{"observed_at":"2026-08-03T02:43:35.409770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03613","last_updated":"2025-08-05T16:28:22Z","snapshot_observed_at":"2026-08-11T11:12:15.356883Z","submitted_at":"2025-08-05T16:28:22Z","title":"Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03613","snapshot_observed_at":"2026-08-03T02:43:35.496157Z","title":"Goedel-prover-v2: Scaling formal theorem proving with scaffolded data synthesis and self-correction.arXiv preprint arXiv:2508.03613, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:35.496157Z"},"links":{"cited_paper":"/paper/2508.03613","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:2ff7ea32d83721b74bbc8c521676b9d3b5751450a2d4828de748ec5ecc7da635","observation_id":"b9d2e9c4-25a8-4196-a655-764c20f43697","resolution":{"observed_at":"2026-08-03T02:43:35.496157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.035387Z","title":"Self-distillation amplifies regular- ization in hilbert space.Advances in Neural Information Processing Systems, 33:3351–3361, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.035387Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:a2245d5a3c7929f217f047910aba16226f4ad025e2d2626c4548657fbb685b81","observation_id":"5ab37e65-a95b-4d2c-b9c9-a76742e97a27","resolution":{"observed_at":"2026-08-03T02:43:36.035387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.185231Z","title":"Coherence mechanisms for provable self- improvement.arXiv preprint arXiv:2511.08440, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.185231Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:ccd540132e9fddda99b8f48ced1cc4d95ec779c4c3de50aa4592090d26fa04ce","observation_id":"0af07b42-b1e5-46ec-b42b-f12b08630805","resolution":{"observed_at":"2026-08-03T02:43:36.185231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.294740Z","title":"Understanding the gains from repeated self-distillation.Advances in Neural Information Processing Systems, 37:7759–7796, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.294740Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:95df7d82b1e7292d1cf8187285a5cebbd0f73706f631db24b2720c302d6251cd","observation_id":"162066db-64c5-4a1a-a34d-48d9c10abfab","resolution":{"observed_at":"2026-08-03T02:43:36.294740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-03T02:43:36.414740Z","title":"Deepseek-prover-v2: Advancing formal mathematical reasoning via reinforcement learning for subgoal decomposition.arXiv preprint arXiv:2504.21801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.414740Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:64dd65a5a521477c420a13da630801a7c530ef6f962c56d7e63eb47cec9781ed","observation_id":"e8e5813b-eb28-4e05-b35e-49d955d1df80","resolution":{"observed_at":"2026-08-03T02:43:36.414740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01557","last_updated":"2019-04-02T17:26:41Z","snapshot_observed_at":"2026-08-14T16:52:50.428130Z","submitted_at":"2019-04-02T17:26:41Z","title":"Analysing Mathematical Reasoning Abilities of Neural Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01557","snapshot_observed_at":"2026-08-03T02:43:36.501769Z","title":"Analysing mathematical reasoning abilities of neural models.arXiv preprint arXiv:1904.01557, 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.501769Z"},"links":{"cited_paper":"/paper/1904.01557","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:5ec95cd0e05cb0b82e3466ae17f9438fa77f90aa98ef964496644a24e6234381","observation_id":"d3c6978b-91e7-42ca-b492-24a4c81d0505","resolution":{"observed_at":"2026-08-03T02:43:36.501769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.581709Z","title":"A mathematical theory of communication.The Bell system technical journal, 27(3):379–423, 1948","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.581709Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:9aaa72041c3e735e495be5e65de05f75f669fe0cbfb737adb6c019bb884c65ed","observation_id":"33e0d071-2412-44e2-9a11-b8b011ebea37","resolution":{"observed_at":"2026-08-03T02:43:36.581709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-08-16T14:35:47.075840Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-03T02:43:36.662189Z","title":"Beyond human data: Scaling self-training for problem-solving with language models.arXiv preprint arXiv:2312.06585, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.662189Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:8d936e6630bdbfdb31d29b69c36fb63c6bf0615bc30ad696a21769138024e440","observation_id":"5f340510-3d13-47fd-b388-cdd51ecdeb84","resolution":{"observed_at":"2026-08-03T02:43:36.662189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-14T20:58:55.959220Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02674","snapshot_observed_at":"2026-08-03T02:43:36.764821Z","title":"Mind the gap: Examining the self-improvement capabilities of large language models.arXiv preprint arXiv:2412.02674, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.764821Z"},"links":{"cited_paper":"/paper/2412.02674","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:72d146a3f6c8b38713838a071257600317977ab7675081b11b75a9a4e0db2563","observation_id":"88fa9f2e-85a3-466f-8bbc-a2d61ed641f9","resolution":{"observed_at":"2026-08-03T02:43:36.764821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.832695Z","title":"Theoretical modeling of llm self- improvement training dynamics through solver-verifier gap.arXiv preprint arXiv:2507.00075, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.832695Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:24593b1afcaefa83881a573b66f4f301836f9042c4027d3304a57acba4614c8c","observation_id":"02bd9ddc-50c3-4902-8b80-ff068cdc6fa0","resolution":{"observed_at":"2026-08-03T02:43:36.832695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:36.903491Z","title":"Canlanguagemodelssolvegraphproblemsinnaturallanguage?Advances in Neural Information Processing Systems, 36:30840–30861, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:36.903491Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:685077c8e903989bc133d7f65025905cb216252a9683f9045cb83f44d67cce63","observation_id":"a8587e93-a18b-4602-b665-802c3ad1ecdb","resolution":{"observed_at":"2026-08-03T02:43:36.903491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:37.006568Z","title":"Huxley-gödel machine: Human-level coding agent development by an approximation of the optimal self-improving machine, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.006568Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:4e9835c762254a2aa9602de2682bb91bbef758b61a8e0851659978abb653a853","observation_id":"676c08f5-ff8e-46d0-b47b-4e2cea3bb481","resolution":{"observed_at":"2026-08-03T02:43:37.006568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:37.084920Z","title":"Propose, solve, verify: Self-play through formal verification.arXiv preprint arXiv:2512.18160, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.084920Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:4a6929b3094b35a04d1ca53ad541469400b4dc8e8318fc724c850ab08af48dbd","observation_id":"e00b3aec-fe22-4c45-bc02-c247ea87cf25","resolution":{"observed_at":"2026-08-03T02:43:37.084920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:37.203560Z","title":"Probability inequalities for likelihood ratios and convergence rates of sieve mles.The Annals of Statistics, pages 339–362, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.203560Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:40243a1d222a2836538d2ed2401c3cd18419a89bddbc040032d650340b37caa1","observation_id":"0dc1b3f4-a652-4e3b-b1d7-be5c7def22b5","resolution":{"observed_at":"2026-08-03T02:43:37.203560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14333","last_updated":"2024-05-23T09:03:42Z","snapshot_observed_at":"2026-08-16T13:50:18.721796Z","submitted_at":"2024-05-23T09:03:42Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14333","snapshot_observed_at":"2026-08-03T02:43:37.405053Z","title":"Deepseek-prover: Advancing theorem proving in llms through large-scale synthetic data.arXiv preprint arXiv:2405.14333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.405053Z"},"links":{"cited_paper":"/paper/2405.14333","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:77ee9574ee4c4e859f8f2001b616b8fe01f4e86e3401273d6d98b4befa434a7f","observation_id":"318dd6b9-3087-411e-8bd5-08c546a795ea","resolution":{"observed_at":"2026-08-03T02:43:37.405053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-08-16T13:26:15.351308Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-03T02:43:37.574813Z","title":"Deepseek-prover-v1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.574813Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:a5d5f893f7cc912501974ce51a4fddc4a0a3bc21fd9fff4bf2ae2ccb22eb3e7a","observation_id":"f95f7968-3759-442c-9096-7548cdb8b70c","resolution":{"observed_at":"2026-08-03T02:43:37.574813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-03T02:43:37.684535Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.684535Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:cb86f4325cee64bbda851220eff563912aa7873610c0a7cd2092d30b86c1d16b","observation_id":"97c7ebbf-986f-4ad1-9881-97eef9c48816","resolution":{"observed_at":"2026-08-03T02:43:37.684535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T02:43:37.854813Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.854813Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:0cee3b634e33a0166129ee0b81cefcabd9b5f2fe7b7ea2cfb2b7b26c128eb575","observation_id":"b9071e0e-7881-4e59-8c92-4803d3695144","resolution":{"observed_at":"2026-08-03T02:43:37.854813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:37.911309Z","title":"Spendwisely: Maximizing post-training gains in iterative synthetic data bootstrapping.arXiv preprint arXiv:2501.18962, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:37.911309Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:09272b56667bda985ada13ef9dafd7b9ed1b318962a08b71840c1f2d36eff0f1","observation_id":"5f732155-4010-4193-b5ff-ca448e3493bd","resolution":{"observed_at":"2026-08-03T02:43:37.911309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02391","last_updated":"2025-05-05T06:26:00Z","snapshot_observed_at":"2026-08-16T17:38:15.166599Z","submitted_at":"2025-05-05T06:26:00Z","title":"Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02391","snapshot_observed_at":"2026-08-03T02:43:38.039514Z","title":"Optimizing chain-of-thought reasoners via gradient variance minimization in rejection sampling and rl.arXiv preprint arXiv:2505.02391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:38.039514Z"},"links":{"cited_paper":"/paper/2505.02391","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:cfa20256113e7e9ab8768b63318bc673c92f81e74a537b8cd30ba97468b42693","observation_id":"c27f7bb9-1692-4506-9202-d39226132c92","resolution":{"observed_at":"2026-08-03T02:43:38.039514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:38.143324Z","title":"Star: Bootstrapping reasoning with reasoning.Advances in Neural Information Processing Systems, 35:15476–15488, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:38.143324Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:0c3b03cad2dd70163934d99e593c8ec3ece751d5b3b236caabd933e132a7524a","observation_id":"5d617e96-254c-45fe-97fc-31896e12c58e","resolution":{"observed_at":"2026-08-03T02:43:38.143324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17256","last_updated":"2025-03-04T06:29:50Z","snapshot_observed_at":"2026-08-14T05:57:08.449467Z","submitted_at":"2024-12-23T03:58:34Z","title":"B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17256","snapshot_observed_at":"2026-08-03T02:43:38.300114Z","title":"B-star: Monitoring and balancing exploration and exploitation in self-taught reasoners.arXiv preprint arXiv:2412.17256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:38.300114Z"},"links":{"cited_paper":"/paper/2412.17256","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:f184a429b28410467c9f757a6a0ba640e7e33b070ab131909f86aa910fc44a8d","observation_id":"95a82f25-5c48-47a9-b428-55d1ef7f0dd4","resolution":{"observed_at":"2026-08-03T02:43:38.300114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06122","last_updated":"2025-07-14T04:41:15Z","snapshot_observed_at":"2026-08-16T12:42:58.361121Z","submitted_at":"2025-04-08T15:15:26Z","title":"Leanabell-Prover: Posttraining Scaling in Formal Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06122","snapshot_observed_at":"2026-08-03T02:43:38.423003Z","title":"Leanabell-prover: Posttraining scaling in formal reasoning.arXiv preprint arXiv:2504.06122, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:38.423003Z"},"links":{"cited_paper":"/paper/2504.06122","citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:4eac4521d70d1361ed52195dd66898d5377fb91bba63745f1900cb1f3da03639","observation_id":"4981f9a3-4db2-4525-89a3-bdfec3acf38e","resolution":{"observed_at":"2026-08-03T02:43:38.423003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:43:38.526645Z","title":"question distribution","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T02:43:38.526645Z"},"links":{"citing_paper":"/paper/2602.10014"},"observation_digest":"sha256:6dd5530a9a4d9fddeaf2c90262764fa1e83404d7c893fb373c02381110231184","observation_id":"743d4d8b-b4bd-4634-b99b-3ef94e26d084","resolution":{"observed_at":"2026-08-03T02:43:38.526645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.10014","last_updated":"2026-05-31T19:13:22Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T17:40:06.025692Z","submitted_at":"2026-02-10T17:36:41Z","title":"A Task-Centric Theory for Iterative Self-Improvement with Easy-to-Hard Curricula"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2602.10014."}