{"as_of":"2026-08-22T16:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57bb4b7054a0e1700ecb64dbac20e4623aae3c2b9c1b2baa541969aaf1fd209f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:02:57.245849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-12T13:02:57.245849Z","title":"Progress or regress? self-improvement reversal in post-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-08-12T12:55:35.142701Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:02:57.245849Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2411.16579"},"observation_digest":"sha256:036114578ae9dfe1428340e66696366f92ce85a49595fbe927c94f267a7dda3d","observation_id":"34f8f316-6282-4d03-bfdf-25d850dbdcff","resolution":{"observed_at":"2026-08-12T13:02:57.245849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-11T11:40:52.592038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15151","last_updated":"2025-02-13T11:37:45Z","snapshot_observed_at":"2026-08-20T12:44:06.978556Z","submitted_at":"2024-12-19T18:28:41Z","title":"Language Models as Continuous Self-Evolving Data Engineers","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:40:52.592038Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2412.15151"},"observation_digest":"sha256:a685e46f0fef868d1ef72297441ea89b79c47918f66727c741d6d2aee0c3cab0","observation_id":"91ea850c-fccc-4650-9cbc-f4c345f9cf1d","resolution":{"observed_at":"2026-08-11T11:40:52.592038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-11T05:45:00.460966Z","title":"[Online; accessed 26- November-2024]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17256","last_updated":"2025-03-04T06:29:50Z","snapshot_observed_at":"2026-08-21T07:11:45.974138Z","submitted_at":"2024-12-23T03:58:34Z","title":"B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:45:00.460966Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2412.17256"},"observation_digest":"sha256:4a4401057c3dc699031236ba3feeab9b10cec7f89072a186a4c070bb4bfbfe32","observation_id":"312975e6-0706-4e03-9a73-5d4d1b5c4012","resolution":{"observed_at":"2026-08-11T05:45:00.460966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-11T05:32:38.992525Z","title":"Progress or regress? self-improvement reversal in post-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17451","last_updated":"2025-06-06T10:36:59Z","snapshot_observed_at":"2026-08-17T00:50:40.901836Z","submitted_at":"2024-12-23T10:18:41Z","title":"Diving into Self-Evolving Training for Multimodal Reasoning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:32:38.992525Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2412.17451"},"observation_digest":"sha256:b536ff5616b1531721aaf3987ee1569b269108be28d3a0fa45247e67ad9d9a67","observation_id":"d6acb88e-0c2e-47ab-92aa-d05159bdc3a0","resolution":{"observed_at":"2026-08-11T05:32:38.992525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-10T22:49:13.486952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00747","last_updated":"2025-01-01T06:33:45Z","snapshot_observed_at":"2026-08-17T06:08:28.919443Z","submitted_at":"2025-01-01T06:33:45Z","title":"DIVE: Diversified Iterative Self-Improvement","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T22:49:13.486952Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2501.00747"},"observation_digest":"sha256:4b3bbe11efb5573071b2239fb5b02325e229350e1b22883235363482dd972f7b","observation_id":"acfedb3c-4701-4912-813b-054b491d2dc2","resolution":{"observed_at":"2026-08-10T22:49:13.486952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":"2407.05013","doi":"10.48550/arxiv.2407.05013","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progress or regress? self-improvement reversal in post-training","venue":"arXiv (Cornell University)","work_id":"47bdc03d-001b-410a-9be9-edfa321c68f5","year":2024},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:2bbeed0b8cc7630e4b2cf286c6100d1430b7086e9c341a0898b0f472c85c6f0a","observation_id":"cc4bc989-576f-4c32-bc88-66e09e38d3d9","resolution":{"observed_at":"2026-05-17T02:11:37.216203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-06T15:50:37.978213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15892","last_updated":"2025-07-20T13:41:02Z","snapshot_observed_at":"2026-08-16T18:39:32.553024Z","submitted_at":"2025-07-20T13:41:02Z","title":"StaAgent: An Agentic Framework for Testing Static Analyzers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:37.978213Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2507.15892"},"observation_digest":"sha256:bc0d2a110c414211192516d4d4ed00256cc7f56bf4e0372a5b249000b8abd498","observation_id":"f789919d-ef23-4322-ae1e-da52ce545942","resolution":{"observed_at":"2026-08-06T15:50:37.978213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-05T15:38:55.192696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19689","last_updated":"2025-08-27T08:52:47Z","snapshot_observed_at":"2026-08-07T07:48:25.655053Z","submitted_at":"2025-08-27T08:52:47Z","title":"Building Task Bots with Self-learning for Enhanced Adaptability, Extensibility, and Factuality","version":1},"reference_index":195,"source":"arxiv_source","source_observed_at":"2026-08-05T15:38:55.192696Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2508.19689"},"observation_digest":"sha256:386200565123a3ada01bfb96a1cfaf4bd8220ba658daeee4ec00827853bab274","observation_id":"52c63fba-1bde-4339-ba93-47bd5b0acae7","resolution":{"observed_at":"2026-08-05T15:38:55.192696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":"2407.05013","doi":"10.48550/arxiv.2407.05013","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progress or regress? self-improvement reversal in post-training","venue":"arXiv (Cornell University)","work_id":"47bdc03d-001b-410a-9be9-edfa321c68f5","year":2024},"citing_paper":{"arxiv_id":"2605.11461","last_updated":"2026-05-18T07:36:31Z","snapshot_observed_at":"2026-08-14T22:16:49.341698Z","submitted_at":"2026-05-12T03:20:24Z","title":"Breaking $\\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T01:57:30.877915Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2605.11461"},"observation_digest":"sha256:fd25118ab26e116eee170c5c3cfea0a2908ae44bcebe3417940508ad5f05ae1d","observation_id":"05a0e44e-7ad6-4a14-9976-e456b1e75384","resolution":{"observed_at":"2026-05-13T02:07:09.091725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":"2407.05013","doi":"10.48550/arxiv.2407.05013","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progress or regress? self-improvement reversal in post-training","venue":"arXiv (Cornell University)","work_id":"47bdc03d-001b-410a-9be9-edfa321c68f5","year":2024},"citing_paper":{"arxiv_id":"2605.11461","last_updated":"2026-05-18T07:36:31Z","snapshot_observed_at":"2026-08-14T22:16:49.341698Z","submitted_at":"2026-05-12T03:20:24Z","title":"Breaking $\\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T22:45:56.857810Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2605.11461"},"observation_digest":"sha256:f0d7ca7bedcea963bf79188e7d16ac7dd679a6ebdb5614b0ae3d355f6529da9e","observation_id":"d470ffd1-8c8a-4988-b95b-259261b16831","resolution":{"observed_at":"2026-05-20T22:49:10.644947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training","version":1},"cited_work":{"arxiv_id":"2407.05013","doi":"10.48550/arxiv.2407.05013","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05013","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progress or regress? self-improvement reversal in post-training","venue":"arXiv (Cornell University)","work_id":"47bdc03d-001b-410a-9be9-edfa321c68f5","year":2024},"citing_paper":{"arxiv_id":"2606.21090","last_updated":"2026-06-17T18:03:06Z","snapshot_observed_at":"2026-07-30T06:23:05.041940Z","submitted_at":"2026-06-17T18:03:06Z","title":"Self-Improvement Can Self-Regress: The Rise-and-Collapse Failure Mode of LLM Self-Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T21:07:28.660119Z"},"links":{"cited_paper":"/paper/2407.05013","citing_paper":"/paper/2606.21090"},"observation_digest":"sha256:a6b4374d148fd404742ca6423d16e61bb80b13f4f7d2e0f857b7c94e8b1aa538","observation_id":"c982a08f-61d5-4676-9ba4-79f2c49dd8d7","resolution":{"observed_at":"2026-07-04T00:29:16.707901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.05013/citation-record","integrity":"/paper/2407.05013/integrity","json":"/paper/2407.05013/citation-record.json","paper":"/paper/2407.05013"},"outbound":[],"paper":{"arxiv_id":"2407.05013","last_updated":"2024-07-06T09:07:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T22:19:26.833859Z","submitted_at":"2024-07-06T09:07:11Z","title":"Progress or Regress? Self-Improvement Reversal in Post-training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2407.05013."}