{"as_of":"2026-08-16T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e57abd8b8be22998821357f1efffafacdcbd47ca90eeb4b6d623457a069ed53c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:09:52.943988Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-07T13:09:52.943988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22517","last_updated":"2025-05-28T16:03:41Z","snapshot_observed_at":"2026-08-07T21:59:37.221673Z","submitted_at":"2025-05-28T16:03:41Z","title":"Multi-MLLM Knowledge Distillation for Out-of-Context News Detection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:09:52.943988Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2505.22517"},"observation_digest":"sha256:7b0657f47dd9d2fe8ebdfdfa92b7ac29fd965cff9750b8153fa396c5977473d7","observation_id":"b5d40556-8047-41ac-99e0-367bec02ec7e","resolution":{"observed_at":"2026-08-07T13:09:52.943988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-06T22:45:04.656219Z","title":", Wang, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00054","last_updated":"2025-06-25T20:07:47Z","snapshot_observed_at":"2026-08-16T00:49:04.578925Z","submitted_at":"2025-06-25T20:07:47Z","title":"Enhancing Reasoning Capabilities in SLMs with Reward Guided Dataset Distillation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T22:45:04.656219Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2507.00054"},"observation_digest":"sha256:8db03160efcbee5a287729a2ee9ec59e3d3bc2d029795a4e25a2953e877b9d2a","observation_id":"5dae83d3-89e7-4d02-807a-4b57195fbd38","resolution":{"observed_at":"2026-08-06T22:45:04.656219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-06T21:13:15.405997Z","title":"Distill not only data but also rewards: Can smaller language models surpass larger ones? arXiv preprint arXiv:2502.19557, 2025 c","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00726","last_updated":"2025-08-27T22:56:13Z","snapshot_observed_at":"2026-08-09T03:39:48.813789Z","submitted_at":"2025-07-01T13:16:34Z","title":"Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:13:15.405997Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2507.00726"},"observation_digest":"sha256:3c297dc6974776de0854f3492c118d8dcdbe3697064db11f060595f2f55990ce","observation_id":"2e6717eb-45a6-40a0-ab59-0e9be9669c13","resolution":{"observed_at":"2026-08-06T21:13:15.405997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-04T16:07:47.507472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-15T19:34:29.390362Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":243,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:47.507472Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:3d1b229e1ff0661ef683ff5d283a18b2dfdd5561ea5ccedc4fa37c8a262e3fb5","observation_id":"67dc3189-f9ee-4ec7-859b-fd560f71f211","resolution":{"observed_at":"2026-08-04T16:07:47.507472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":"2502.19557","doi":"10.48550/arxiv.2502.19557","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","venue":"ArXiv.org","work_id":"47f144ed-a239-4c00-bd03-eae23ad603db","year":2025},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-08-11T15:26:25.836864Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:99e4c69fdbd78db2b8e71518ee87d15ebae253463d0ef06d06657cdf89aa742c","observation_id":"f651e1aa-6c36-48e1-814f-38aa819bfc5e","resolution":{"observed_at":"2026-05-11T00:30:53.507222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":"2502.19557","doi":"10.48550/arxiv.2502.19557","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","venue":"ArXiv.org","work_id":"47f144ed-a239-4c00-bd03-eae23ad603db","year":2025},"citing_paper":{"arxiv_id":"2604.16706","last_updated":"2026-08-10T01:18:04Z","snapshot_observed_at":"2026-08-15T03:40:39.253330Z","submitted_at":"2026-04-17T21:15:35Z","title":"Auditing Automated Evaluation, Error Propagation, and Runtime Mitigation in Tool-Using Language Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T08:00:45.789649Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2604.16706"},"observation_digest":"sha256:0ab082215d22b6c30eca4c3d25a5c6f90c3903c8f611e8d77d8d2a8345add941","observation_id":"e4370c7d-19fe-45f6-bbb4-5d9bb82833a9","resolution":{"observed_at":"2026-05-10T08:02:24.351219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-07-12T19:18:49.672005Z","title":"URL https://openreview","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.16707","last_updated":"2026-06-21T14:58:53Z","snapshot_observed_at":"2026-08-14T15:22:14.408821Z","submitted_at":"2026-04-17T21:18:06Z","title":"Mixed response geometry and critical crossover in the Ising model","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T19:18:49.672005Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2604.16707"},"observation_digest":"sha256:5bb89c6579c1e85ae0beb0f305da9f6c62ecdb27713bd393d0e9cceddb519a9d","observation_id":"35523da7-5267-4219-a693-47d07a978105","resolution":{"observed_at":"2026-07-12T19:18:49.672005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":"2502.19557","doi":"10.48550/arxiv.2502.19557","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","venue":"ArXiv.org","work_id":"47f144ed-a239-4c00-bd03-eae23ad603db","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-08-12T03:28:30.781632Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":161,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:51596c1c45aa18f6032cd0449b4b1c6837334b9a1a767b43883c664b84d0c6d1","observation_id":"69301cc6-d2c3-418b-9d62-4730f77a2ca2","resolution":{"observed_at":"2026-07-01T20:56:13.473416Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","version":1},"cited_work":{"arxiv_id":"2502.19557","doi":"10.48550/arxiv.2502.19557","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19557","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?","venue":"ArXiv.org","work_id":"47f144ed-a239-4c00-bd03-eae23ad603db","year":2025},"citing_paper":{"arxiv_id":"2606.25319","last_updated":"2026-06-24T02:32:38Z","snapshot_observed_at":"2026-08-13T00:44:31.615672Z","submitted_at":"2026-06-24T02:32:38Z","title":"V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-25T21:23:10.051805Z"},"links":{"cited_paper":"/paper/2502.19557","citing_paper":"/paper/2606.25319"},"observation_digest":"sha256:6d5893b400c1c39763729065de435f460d88112a386be86a71e470e0e1408381","observation_id":"2ef3ffc6-4db8-4839-8333-476f4483f85e","resolution":{"observed_at":"2026-07-04T19:30:06.798413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.19557/citation-record","integrity":"/paper/2502.19557/integrity","json":"/paper/2502.19557/citation-record.json","paper":"/paper/2502.19557"},"outbound":[],"paper":{"arxiv_id":"2502.19557","last_updated":"2025-02-26T20:50:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T06:45:38.273472Z","submitted_at":"2025-02-26T20:50:11Z","title":"Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2502.19557."}