{"as_of":"2026-08-19T16:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77ba09f769262d8f94fc6a372d7f0994f85f80530b59c5a12129bbbb9187a191","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:28:01.666620Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09447/citation-record","integrity":"/paper/2608.09447/integrity","json":"/paper/2608.09447/citation-record.json","paper":"/paper/2608.09447"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.13649","last_updated":"2024-01-17T03:23:23Z","snapshot_observed_at":"2026-08-16T15:21:35.471994Z","submitted_at":"2023-06-23T17:56:26Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13649","snapshot_observed_at":"2026-08-15T14:28:01.574777Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.574777Z"},"links":{"cited_paper":"/paper/2306.13649","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:3f3d5c7e1c37ad36f5a60a6684942815e2c468ff709477433a897fe95b46e849","observation_id":"0d97cdc8-b1b5-4402-9d18-3b56203cdccb","resolution":{"observed_at":"2026-08-15T14:28:01.574777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.981569Z","title":"2025 , note=","venue":null,"work_id":"43d67fca-f879-4efe-a7c8-5567ba38b059","year":2025},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.581362Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:3ef5da60a318607abb8db36364fb82089fd482b210f4e4cbf591970c2c693377","observation_id":"f5b7c631-67fb-4e6b-ab17-0ac1dac1cd06","resolution":{"observed_at":"2026-08-15T14:28:01.987350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-16T00:27:04.851196Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-15T14:28:01.587752Z","title":"arXiv preprint arXiv:2604.13016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.587752Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:8eebb05002938feef79c4876ce6cc344f30b352a7df3dd6c99039a2b1f15599c","observation_id":"c7d4c257-c140-422d-969a-6088d1182598","resolution":{"observed_at":"2026-08-15T14:28:01.587752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11739","last_updated":"2026-05-21T08:50:47Z","snapshot_observed_at":"2026-08-18T16:51:41.400204Z","submitted_at":"2026-05-12T08:19:15Z","title":"Learning to Foresee: Unveiling the Unlocking Efficiency of On-Policy Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11739","snapshot_observed_at":"2026-08-15T14:28:01.593529Z","title":"arXiv preprint arXiv:2605.11739 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.593529Z"},"links":{"cited_paper":"/paper/2605.11739","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:b03bd6444d5cb978892fa23eccb322b660678ee14b8a21ca98227d068409c7e4","observation_id":"092f4d52-9f73-4f8b-8e50-8d6c06b33dc7","resolution":{"observed_at":"2026-08-15T14:28:01.593529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15161","last_updated":"2026-07-16T16:07:19Z","snapshot_observed_at":"2026-08-19T00:15:19.875375Z","submitted_at":"2026-07-16T16:07:19Z","title":"On-Policy Delta Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15161","snapshot_observed_at":"2026-08-15T14:28:01.599144Z","title":"arXiv preprint arXiv:2607.15161 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.599144Z"},"links":{"cited_paper":"/paper/2607.15161","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:48b664cd4cbe40feaf979cc4b162c7f37a91037ad6216e5860a173c7b5ae13e2","observation_id":"021e44e9-3caa-4044-af46-dcca5b8d5cca","resolution":{"observed_at":"2026-08-15T14:28:01.599144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.26246","last_updated":"2026-07-28T20:31:48Z","snapshot_observed_at":"2026-08-12T12:03:15.179459Z","submitted_at":"2026-07-28T20:31:48Z","title":"Weak-to-Strong On-Policy Distillation","version":1},"cited_work":{"arxiv_id":"2607.26246","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.26246","snapshot_observed_at":"2026-08-15T14:28:01.760078Z","title":"Weak-to-Strong On-Policy Distillation","venue":"cs.LG","work_id":"d3e1112c-afc5-41cd-af32-84064fe6def9","year":2026},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.605540Z"},"links":{"cited_paper":"/paper/2607.26246","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:ef9d1f371275d2de23158bc479494380da7f58a297e0e63e2922bf5213f51c34","observation_id":"5ce7d0d3-b555-4097-bb76-272c080c0820","resolution":{"observed_at":"2026-08-15T14:28:01.767121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.965226Z","title":null,"venue":null,"work_id":"3591dfda-5a4c-476c-a1ff-8eac5cd80045","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.611194Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:efe5ff38c3ad539de9a51785be63a88d5444d02ff2ad5d22856437881c0f7872","observation_id":"beb0a04f-b133-40d1-a4e3-df762b982f71","resolution":{"observed_at":"2026-08-15T14:28:01.970243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.947985Z","title":null,"venue":null,"work_id":"30ed0cef-ec07-49d0-ad58-ff1e6599f55c","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.617840Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:2e6fc3a0f616f2c4a0ec61ad140ec3d7f3056ad3e2d2878967c927ee81ce0078","observation_id":"49fc2857-3a0d-4e4f-be69-7648e6a66943","resolution":{"observed_at":"2026-08-15T14:28:01.952760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.08222","snapshot_observed_at":"2026-08-15T14:28:01.622883Z","title":"arXiv preprint arXiv:2602.08222 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.622883Z"},"links":{"cited_paper":"/paper/2602.08222","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:dbe2d7b712e2607852545bdf4706a64fb22debff9346e7b4329f81edbd1a3604","observation_id":"88863e25-b0d0-4b71-ad14-d5c05ee34262","resolution":{"observed_at":"2026-08-15T14:28:01.622883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.932430Z","title":null,"venue":null,"work_id":"868a9713-8b7a-4371-a1f0-0b7e7a44f161","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.627944Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:862813b8dd1baba67ecb03afca8810c676e4541f97ba2cb367b0603c2ff2ad0e","observation_id":"8a7f1c92-b328-41c9-a6b3-86167eba2a69","resolution":{"observed_at":"2026-08-15T14:28:01.937053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T14:28:01.633151Z","title":"arXiv preprint arXiv:2110.14168 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.633151Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:d4dabe3a5e4df72e6b19d9d397562e72e3fe0e31af512d1768f7062204c11c9d","observation_id":"b91cb4c8-ccd5-41ea-b76f-3ed34776edda","resolution":{"observed_at":"2026-08-15T14:28:01.633151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.637985Z","title":"Measuring Mathematical Problem Solving With the","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.637985Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:37614967e22b50a42e12d862505dca73f078b16d3a0f792a207cc08abd64e29e","observation_id":"cbfd968c-48df-4523-86d1-04d61185ffc3","resolution":{"observed_at":"2026-08-15T14:28:01.637985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-15T14:28:01.642629Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.642629Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:6866e26789de5c401fe63029d08009698e26f612bb7e23d51c617ac1a2abee25","observation_id":"e6ec43e3-fd77-4c0c-9dd1-5e6b53df81ed","resolution":{"observed_at":"2026-08-15T14:28:01.642629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.905720Z","title":null,"venue":null,"work_id":"d642fc6d-58bc-4777-8d7d-2b4f9a6b573f","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.647514Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:7fda273c576ec74063b031bc2dbc8cda2e8ec37ed878a6b73a6a16d50ad7f496","observation_id":"1e65a57c-6e6b-414c-94dd-8a301faaf859","resolution":{"observed_at":"2026-08-15T14:28:01.911256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.889863Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":"05a3a883-828a-4b2d-b5e1-32d75f16fded","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.651979Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:973b51f1f5c5640f75aec2fc42b1c3aad0963c9868a7d50a7352e3506f6ef688","observation_id":"27b8e986-b9ce-4486-9df7-8c6943b309ac","resolution":{"observed_at":"2026-08-15T14:28:01.894473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.874111Z","title":"Is Your Code Generated by","venue":null,"work_id":"87a35d7f-0eea-4380-8c80-1c7c0209c1a0","year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.656510Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:2010437b661960a27ed3290134475df72096f8659028b0fb7bd41786272a74d4","observation_id":"83135059-8725-440f-b625-86df7a6e71ba","resolution":{"observed_at":"2026-08-15T14:28:01.878830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.857390Z","title":"2025 , eprint=","venue":null,"work_id":"621b9883-04b5-4a43-9670-893e0696ffc7","year":2025},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.661413Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:6959782674d584b5ad04693f92ec7f0b8a140093dd66adf8881a4fceaa555491","observation_id":"af49afad-c5ec-47d2-843b-caa73bfb44d8","resolution":{"observed_at":"2026-08-15T14:28:01.862547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:28:01.666620Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:28:01.666620Z"},"links":{"citing_paper":"/paper/2608.09447"},"observation_digest":"sha256:b4a64c97d70f74e94eea021b2a174729753adb37a8f981fe577cbe0f203f940b","observation_id":"214f1e90-f4aa-43e2-bb42-165cfec0d628","resolution":{"observed_at":"2026-08-15T14:28:01.666620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09447","last_updated":"2026-08-10T11:22:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T17:27:35.563101Z","submitted_at":"2026-08-10T11:22:53Z","title":"WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2608.09447."}