{"as_of":"2026-08-10T15:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85c57a08326437eb47bf5988f44eb9d7d4c8bfab89c0589cb684506ffb7be2e4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":43,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:13:38.311449Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":7,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-08-09T02:27:34.152063Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T17:00:48.167441Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2210.11610"},"observation_digest":"sha256:e71ddaca03126b914c70160ac03b2ef978ef0a15ff904164fd73141da4d28277","observation_id":"6315a156-3a7e-4e8f-8087-f5ed01a82869","resolution":{"observed_at":"2026-05-18T17:00:48.263694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2404.13208","last_updated":"2024-04-19T22:55:23Z","snapshot_observed_at":"2026-08-10T04:45:11.275468Z","submitted_at":"2024-04-19T22:55:23Z","title":"The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T10:59:30.728091Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2404.13208"},"observation_digest":"sha256:0066747d4910ff28c9fd3e45e3cc542ceba80fbf2abd19f4f699f9218bad2609","observation_id":"8a76589d-0a1a-49f6-b3ab-3bce8130e323","resolution":{"observed_at":"2026-05-12T10:59:30.789754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"reference_index":297,"source":"arxiv_source","source_observed_at":"2026-05-17T14:43:29.496457Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2406.10162"},"observation_digest":"sha256:95ba33a124b9cb26154d0b600c473774d7aef78b22d701bd37e4234c681817c5","observation_id":"7c63712a-c751-46c4-8876-d99ce7a1cfde","resolution":{"observed_at":"2026-05-17T14:43:29.847490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-08T14:13:38.311449Z","title":"Learning by distilling context, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06975","last_updated":"2025-02-10T19:14:51Z","snapshot_observed_at":"2026-08-08T23:51:33.892065Z","submitted_at":"2025-02-10T19:14:51Z","title":"Position: Episodic Memory is the Missing Piece for Long-Term LLM Agents","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-08T14:13:38.311449Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2502.06975"},"observation_digest":"sha256:138eca05847a5cc57cf13ee89c24835833f0baadcb76e36b6ff5667819fe1821","observation_id":"d0e9db7c-3374-4f60-b279-0a9bc212c816","resolution":{"observed_at":"2026-08-08T14:13:38.311449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-07T06:04:34.304670Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06266","last_updated":"2025-06-13T17:58:55Z","snapshot_observed_at":"2026-08-10T09:21:59.278086Z","submitted_at":"2025-06-06T17:48:23Z","title":"Cartridges: Lightweight and general-purpose long context representations via self-study","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T06:04:34.304670Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2506.06266"},"observation_digest":"sha256:b40678a33cc383edfc051234fd36563e3a6990617c281c1f9e11145767739bcc","observation_id":"9b8246c5-08e8-412e-bdcf-56627b82295c","resolution":{"observed_at":"2026-08-07T06:04:34.304670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-07T00:24:46.861099Z","title":"Learning by distilling context, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14111","last_updated":"2025-06-19T19:02:41Z","snapshot_observed_at":"2026-08-07T00:16:03.841117Z","submitted_at":"2025-06-17T02:03:36Z","title":"Essential-Web v1.0: 24T tokens of organized web data","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T00:24:46.861099Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2506.14111"},"observation_digest":"sha256:df279fc2d1bf2e172c46f109a76c76c64755f4f1ff7d673b455e372c4d38c1b3","observation_id":"c544393c-4aa6-4ab5-8fa6-30f90d333d8f","resolution":{"observed_at":"2026-08-07T00:24:46.861099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-07T00:13:38.518193Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14728","last_updated":"2025-06-17T17:08:32Z","snapshot_observed_at":"2026-08-07T14:16:24.457276Z","submitted_at":"2025-06-17T17:08:32Z","title":"AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:38.518193Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2506.14728"},"observation_digest":"sha256:87098ad16225bbb5baf28dd092af8090eac8f4d1191216d992c1c9f4fb9fc5fc","observation_id":"fda6bd76-14b3-4ca1-ba50-712198c84b62","resolution":{"observed_at":"2026-08-07T00:13:38.518193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.07894","last_updated":"2026-04-09T07:04:19Z","snapshot_observed_at":"2026-08-04T00:00:08.854253Z","submitted_at":"2026-04-09T07:04:19Z","title":"TSUBASA: Improving Long-Horizon Personalization via Evolving Memory and Self-Learning with Context Distillation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-10T16:48:53.092395Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.07894"},"observation_digest":"sha256:5637a0bed518f0db391a66a58839fb701ce31311cf1de7492d94957faeb92079","observation_id":"50903d1d-fcc2-4a71-87ca-4b368a71f632","resolution":{"observed_at":"2026-05-11T08:06:01.325654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-08-02T07:24:04.075021Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:b21ef83315f64ba2dc1bda5e3ef27bdabfc3ad62337a1199fff81b02aa798719","observation_id":"6b05a7e0-2cd5-41ea-9ae2-83ab31691c93","resolution":{"observed_at":"2026-05-11T00:30:53.811574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.09571","last_updated":"2026-02-20T13:35:43Z","snapshot_observed_at":"2026-08-06T13:37:26.923687Z","submitted_at":"2026-02-20T13:35:43Z","title":"Tuning Qwen2.5-VL to Improve Its Web Interaction Skills","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T20:51:00.660022Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.09571"},"observation_digest":"sha256:f509270e297ccadb020228a511ba8f18ce609a1c68fa2dc7eb2374ea27f47e8f","observation_id":"390f6538-ff00-4411-b80c-8a8ba392cbc8","resolution":{"observed_at":"2026-05-15T20:51:36.168174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.20733","last_updated":"2026-04-22T16:20:41Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:20:41Z","title":"Near-Future Policy Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T00:51:36.580600Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.20733"},"observation_digest":"sha256:ec812320bc304ce53a24ae075a3b51196f8eb862072b161ff3526b14acf1869c","observation_id":"bc112bd6-1564-4118-b3f7-1c480e323da7","resolution":{"observed_at":"2026-05-10T00:54:48.621807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:81f33f556ad101abc5b22ababe5d4c6ffd7a6a3cf82e1853039bb39da2f21efe","observation_id":"23e15da8-ae9f-4e89-a077-959b1c3a9c0f","resolution":{"observed_at":"2026-05-11T03:50:57.396716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.08873","last_updated":"2026-05-09T10:51:58Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T10:51:58Z","title":"CoDistill-GRPO: A Co-Distillation Recipe for Efficient Group Relative Policy Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T00:59:44.364491Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.08873"},"observation_digest":"sha256:9cb97b72556c9c0ed8508db2ff01de1c6e99c0c9b854ccf20470dc5cad32245e","observation_id":"0d3e8055-9993-4172-b246-d8d7ee956d9c","resolution":{"observed_at":"2026-05-12T08:31:26.461256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.10889","last_updated":"2026-05-11T17:33:28Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:33:28Z","title":"Unmasking On-Policy Distillation: Where It Helps, Where It Hurts, and Why","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T04:28:58.679078Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.10889"},"observation_digest":"sha256:b368a9bff1504f38f4a0a8070ad9b1bde5d8580dc324b382e4fa2bfa95ce4f02","observation_id":"2f30f395-0463-46f1-8409-6420710e6aed","resolution":{"observed_at":"2026-05-12T06:11:27.211928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.11613","last_updated":"2026-05-12T06:43:17Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:43:17Z","title":"From Generic Correlation to Input-Specific Credit in On-Policy Self Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T01:24:34.093541Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.11613"},"observation_digest":"sha256:f8dd9ac33e1faf0168e49148d595b8ce5958d9573d88bf3c2320e89b4ca45592","observation_id":"fe2f5de1-d1ce-4a95-88cd-496aadba5cd3","resolution":{"observed_at":"2026-05-13T01:27:02.004969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.15604","last_updated":"2026-05-15T04:31:06Z","snapshot_observed_at":"2026-07-06T23:26:51.110846Z","submitted_at":"2026-05-15T04:31:06Z","title":"VSPO: Vector-Steered Policy Optimization for Behavioral Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T19:39:55.294398Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.15604"},"observation_digest":"sha256:b2e557ce769239cadd2507fbc8bf14fbb6c0f4d2fb852d44538e67cd6b514369","observation_id":"8d283293-324b-431b-a553-37de5b1c0d88","resolution":{"observed_at":"2026-05-20T19:43:44.111000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.17497","last_updated":"2026-05-17T15:14:24Z","snapshot_observed_at":"2026-08-05T13:27:59.292796Z","submitted_at":"2026-05-17T15:14:24Z","title":"Self-Supervised On-Policy Distillation for Reasoning Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T14:42:55.368104Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.17497"},"observation_digest":"sha256:1d6bea18d7d8699e271cd43d1f74a76f683fc429720b2f50ac56b9cace63387a","observation_id":"f2e52020-fd83-41d3-9150-d734f9a25543","resolution":{"observed_at":"2026-05-20T14:43:21.837694Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.18226","last_updated":"2026-05-18T11:12:45Z","snapshot_observed_at":"2026-07-06T23:29:09.538843Z","submitted_at":"2026-05-18T11:12:45Z","title":"Context Memorization for Efficient Long Context Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T10:39:09.720412Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.18226"},"observation_digest":"sha256:0d288874b7cc4668f47b05445c72913cdc2ff4625fc72f59b50c21499dd2fd17","observation_id":"c684b1c3-bc07-4859-bff8-e44a0c0ec5e9","resolution":{"observed_at":"2026-05-20T10:43:12.621794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.20258","last_updated":"2026-05-18T13:57:44Z","snapshot_observed_at":"2026-08-08T21:22:17.871185Z","submitted_at":"2026-05-18T13:57:44Z","title":"It Takes Two: Complementary Self-Distillation for Contextual Integrity in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T08:05:44.358256Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.20258"},"observation_digest":"sha256:e202d6b2808b611dcd38a52fc79888fd88f6f1fb0630cf7f3a6e036033725a11","observation_id":"aead6aed-ce7e-46bc-9f79-d599385a5c80","resolution":{"observed_at":"2026-05-21T08:09:51.844225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.22263","last_updated":"2026-05-21T10:07:46Z","snapshot_observed_at":"2026-08-02T10:25:42.509450Z","submitted_at":"2026-05-21T10:07:46Z","title":"Tailoring Teaching to Aptitude: Direction-Adaptive Self-Distillation for LLM Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T08:06:30.862911Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.22263"},"observation_digest":"sha256:237dec2bc83d8f67f44566fa7a157da2eea608b4108dcdd955add5dba5454c12","observation_id":"c02f2b1f-98f7-48ae-a4be-57807067c3f1","resolution":{"observed_at":"2026-05-22T08:11:17.794411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.26099","last_updated":"2026-06-05T05:36:49Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:55:39Z","title":"Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T21:37:51.638904Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.26099"},"observation_digest":"sha256:42e86be18cfa2783ccd42993bb756ace3c11f287014b9748d5bc5e043973fea7","observation_id":"e0a87535-1268-4e94-a7ce-4f26e4217fc5","resolution":{"observed_at":"2026-06-29T21:43:59.454603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.01080","last_updated":"2026-05-31T07:57:45Z","snapshot_observed_at":"2026-08-03T19:26:59.405434Z","submitted_at":"2026-05-31T07:57:45Z","title":"ThinkSwitch: Context Distillation with LoRA and Weight Interpolation for Specific-Purpose Reasoning Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T17:52:59.979543Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.01080"},"observation_digest":"sha256:d0e93718faf53a21ed9129f39ea5eff43d2caa770103728f37b75a0c07e8eab3","observation_id":"9f489a76-dc34-4a8f-8804-8a86246c3e36","resolution":{"observed_at":"2026-06-28T18:02:27.323880Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.04703","last_updated":"2026-06-03T10:30:09Z","snapshot_observed_at":"2026-07-06T23:44:47.848374Z","submitted_at":"2026-06-03T10:30:09Z","title":"Rethinking Continual Experience Internalization for Self-Evolving LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T06:29:11.398007Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.04703"},"observation_digest":"sha256:7e46f8b8bd81748591e80842c7ba154a7bec968b63c54fecfc834e30c3d385cd","observation_id":"a27e4b2b-54bf-489c-97b7-9ffcc22ee17e","resolution":{"observed_at":"2026-07-02T07:56:47.807293Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.06154","last_updated":"2026-06-04T13:28:48Z","snapshot_observed_at":"2026-08-03T18:23:02.874306Z","submitted_at":"2026-06-04T13:28:48Z","title":"Amortizing Federated Adaptation: Hypernetwork Driven LoRA for Personalized Foundation Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T01:27:04.241484Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.06154"},"observation_digest":"sha256:2bd7c135020b5138d12fa2c232d814daf70e0db3979f4a5c162eb954cd8a7732","observation_id":"df9f27f8-938f-4796-91dc-a98b8b99672d","resolution":{"observed_at":"2026-07-02T13:16:58.682443Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.11853","last_updated":"2026-06-10T09:30:25Z","snapshot_observed_at":"2026-08-02T20:07:37.622537Z","submitted_at":"2026-06-10T09:30:25Z","title":"Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning","version":1},"reference_index":205,"source":"arxiv_source","source_observed_at":"2026-06-27T10:28:11.440915Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.11853"},"observation_digest":"sha256:404f676a68bd49aa278142ef11988bd0e093c41258eb7f3d5bb63399ebd3d56e","observation_id":"2a5df5e2-4795-432a-a14d-fe02e61050d1","resolution":{"observed_at":"2026-07-03T09:17:48.415598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.12400","last_updated":"2026-06-10T17:58:20Z","snapshot_observed_at":"2026-07-06T23:51:22.219590Z","submitted_at":"2026-06-10T17:58:20Z","title":"Doc-to-Atom: Learning to Compile and Compose Memory Atoms","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T09:53:35.191873Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.12400"},"observation_digest":"sha256:5e30db2a2f074fdee5856f58db1fd773890ddbcb09e764efec3ed8da6e4244c6","observation_id":"e8b6433a-3038-4a7e-a9f2-ffffa1b77373","resolution":{"observed_at":"2026-07-03T10:37:57.065542Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.12942","last_updated":"2026-06-11T06:09:51Z","snapshot_observed_at":"2026-08-02T20:26:56.141213Z","submitted_at":"2026-06-11T06:09:51Z","title":"PRISMR: Overcoming Parse Collapse in Multimodal Listwise Ranking via Parameterized Representation Internalization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T07:00:17.978103Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.12942"},"observation_digest":"sha256:f4549beac7b2d7e02d7518fbcf20b6200e14c946287dcda6e94d21b93adc5cfc","observation_id":"59ec0084-5f5e-4a98-b02b-9789f1e586ad","resolution":{"observed_at":"2026-07-03T14:38:29.012031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-12T13:53:50.979339Z","title":"Learning by Distilling Context","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16149","last_updated":"2026-07-09T08:06:50Z","snapshot_observed_at":"2026-08-08T20:09:27.886404Z","submitted_at":"2026-06-15T03:10:17Z","title":"LiteOdyssey: A Lightweight Reasoning AI Agent for Interpretable Rare-Disease Diagnosis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T13:53:50.979339Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.16149"},"observation_digest":"sha256:f6807e7168beacf78ded2d9622474507c288e664cf9fead84c060f057971fc99","observation_id":"1e7fea36-569e-4851-a290-89d780eaa74c","resolution":{"observed_at":"2026-07-12T13:53:50.979339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.28349","last_updated":"2026-06-03T07:15:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-03T07:15:11Z","title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T11:30:52.871762Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.28349"},"observation_digest":"sha256:7b7115b399ab6d2a4e6a714c08f5d8b9bac33cc1aebdad69043fae8783977571","observation_id":"5dd966a1-a03d-4b16-8ed1-aaccc18458a8","resolution":{"observed_at":"2026-06-30T11:34:37.890032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.30775","last_updated":"2026-06-29T18:06:43Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:43Z","title":"A Single Rewrite Suffices: Empirical Lessons from Production Skill Description Optimization","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-01T02:32:19.425550Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.30775"},"observation_digest":"sha256:9f29871019355b75edda17d43faec3190633de6d22b6b36a20fddba8f942d1ff","observation_id":"6ad6097b-b6b7-458b-870b-41f3ce6d15c3","resolution":{"observed_at":"2026-07-01T12:05:43.607060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.01208","last_updated":"2026-07-01T17:46:33Z","snapshot_observed_at":"2026-08-08T02:07:42.082234Z","submitted_at":"2026-07-01T17:46:33Z","title":"Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-02T12:27:59.332432Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.01208"},"observation_digest":"sha256:d03aa8b3ac0c6c9ce781d0cf71849c516d339c6eb0bb3c97b8053b9a5d922147","observation_id":"c08528f8-3569-4cad-b504-2a86a7fb4596","resolution":{"observed_at":"2026-07-02T12:36:56.170129Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.01690","last_updated":"2026-07-02T04:31:41Z","snapshot_observed_at":"2026-08-02T22:45:02.076056Z","submitted_at":"2026-07-02T04:31:41Z","title":"Epistemic Goggles: A Pretrained Module that Induces an Epistemic Frame via Gradient Editing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-03T14:25:39.401131Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.01690"},"observation_digest":"sha256:8d4f1b3b8651dd1217e4f4394971048aa357c6dea502649f8175bcc6ca89d254","observation_id":"ccca42a2-76c5-4d5d-b4ce-89280ded27cd","resolution":{"observed_at":"2026-07-03T14:28:31.104704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:d2daaaee3cf2d03df972a07bd119f6745b3c9ffa75c5d97c049a502247f16e03","observation_id":"705eea4c-835b-4c44-8dac-9d3fa8fca4d3","resolution":{"observed_at":"2026-07-10T01:36:44.163623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-08T18:22:25.527933Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:fda96ecc77b15e014beb047a4787d5261e3ed20d4cd195a336b9a01796fdf649","observation_id":"8f316d1a-e5dd-451f-915c-2364c8772c32","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-01T08:43:21.932131Z","title":"Charlie Snell, Dan Klein, and Ruiqi Zhong","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21051","last_updated":"2026-07-23T08:34:31Z","snapshot_observed_at":"2026-08-07T07:18:10.413674Z","submitted_at":"2026-07-23T08:34:31Z","title":"Sample-Efficient Learning from Agent Experience","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:43:21.932131Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21051"},"observation_digest":"sha256:8c2c47b7b34d1c2a1837d569c07cf82456b336dd853675aa103c1a1311d36888","observation_id":"7f4310bc-91e5-42bf-8c39-a8b170fc4602","resolution":{"observed_at":"2026-08-01T08:43:21.932131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-02T08:17:26.367813Z","title":"arXiv preprint arXiv:2209.15189 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21627","last_updated":"2026-07-07T22:31:23Z","snapshot_observed_at":"2026-08-09T10:49:25.762802Z","submitted_at":"2026-07-07T22:31:23Z","title":"Do Modules Stay in Their Lane? Role Drift in Compound LLM Systems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T08:17:26.367813Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21627"},"observation_digest":"sha256:bbe6c9d7da98a7d0f190d434d880dee9b76b8218d2695c566de3b6a2b8a384f0","observation_id":"b9d82d3a-535f-425f-8fd3-486c7f062d7e","resolution":{"observed_at":"2026-08-02T08:17:26.367813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-01T06:19:33.044773Z","title":"arXiv:2209.15189","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21943","last_updated":"2026-07-29T05:22:33Z","snapshot_observed_at":"2026-08-09T17:51:18.648914Z","submitted_at":"2026-07-24T03:39:34Z","title":"Listen, Do Not Copy: Internalizing Audio-Grounded Scaffold Context for Robust Omni-Model Speech Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.044773Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21943"},"observation_digest":"sha256:9530c1603032d3e49076ca4005c3eba9a5a55938ad8609ff88799e36568a1f56","observation_id":"e6c8895e-7140-4b0d-9c91-a653f644cb73","resolution":{"observed_at":"2026-08-01T06:19:33.044773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-02T10:49:24.977221Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22629","last_updated":"2026-06-18T21:19:38Z","snapshot_observed_at":"2026-08-09T23:42:49.028133Z","submitted_at":"2026-06-18T21:19:38Z","title":"Masked Distillation: Internalizing the Chain-of-Thought in Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T10:49:24.977221Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.22629"},"observation_digest":"sha256:2c264c57352a6f81bb3fc21ee9413ae06f4af9766d874fabddcdb6cf666e9b36","observation_id":"7bad19ac-b647-4b4c-ab95-a94ab1ce032d","resolution":{"observed_at":"2026-08-02T10:49:24.977221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-31T20:13:02.033825Z","title":"Learning by distilling context.CoRR, abs/2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28022","last_updated":"2026-07-30T11:11:32Z","snapshot_observed_at":"2026-08-08T02:25:57.385980Z","submitted_at":"2026-07-30T11:11:32Z","title":"Flux-OPD: On-Policy Distillation with Evolving Contexts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T20:13:02.033825Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.28022"},"observation_digest":"sha256:a2fd4041a2eeb12c0a0c79f34f91ea710c1fb4ca5488db855e338ad196f94a90","observation_id":"f34e8e4d-f88c-43da-a22c-1dd43c616bee","resolution":{"observed_at":"2026-07-31T20:13:02.033825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-04T23:14:10.159095Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01672","last_updated":"2026-08-03T04:06:06Z","snapshot_observed_at":"2026-08-06T23:32:54.480980Z","submitted_at":"2026-08-03T04:06:06Z","title":"Learning What to Remember: Test-Time Training via Context Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T23:14:10.159095Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.01672"},"observation_digest":"sha256:54abe25f5fbcd0d2d17a3dc21701640160ee241f422db86fb36de3a865d2e9b6","observation_id":"d702b95c-08f7-4a5f-ae0c-2adbb5ce5d7b","resolution":{"observed_at":"2026-08-04T23:14:10.159095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-07T00:15:16.462866Z","title":"Learning by","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02087","last_updated":"2026-08-05T10:09:59Z","snapshot_observed_at":"2026-08-09T10:48:15.589859Z","submitted_at":"2026-08-03T11:47:52Z","title":"Instruction-Conditioned Exploration for Reinforcement Learning with Self-Distillation to an Unconditioned Policy","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T00:15:16.462866Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.02087"},"observation_digest":"sha256:6f3d091c361f79c63573c59cdbcbcedd69d6b228a88bdf5674edb1ecbe3ce12f","observation_id":"d2d95894-4d46-4742-b75e-b27fa2000d45","resolution":{"observed_at":"2026-08-07T00:15:16.462866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T23:15:50.848819Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03223","last_updated":"2026-08-04T06:56:47Z","snapshot_observed_at":"2026-08-08T07:33:01.760880Z","submitted_at":"2026-08-04T06:56:47Z","title":"Agentic Reinforcement Learning with Self-Distilled Reward Shaping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:15:50.848819Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.03223"},"observation_digest":"sha256:e7a0f77eacb53585db8d7ec2262e28dd2d8aad0c2ac27ef0388b0c50c2c6ec41","observation_id":"ff8d01c5-2bd5-42d1-9e20-50c0d9be4d9a","resolution":{"observed_at":"2026-08-05T23:15:50.848819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-08T00:24:40.201293Z","title":"arXiv preprint arXiv:2209.15189 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05734","last_updated":"2026-08-06T08:18:13Z","snapshot_observed_at":"2026-08-09T23:11:26.748305Z","submitted_at":"2026-08-06T08:18:13Z","title":"Subliminal Learning is Non-Semantic Distillation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:24:40.201293Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.05734"},"observation_digest":"sha256:b7caa08972892a5efd00383ca966286fe76db6e5ac4ffc5c116b36ad3e71a3ac","observation_id":"d93ccb00-eaa5-42b8-b393-a84488cab151","resolution":{"observed_at":"2026-08-08T00:24:40.201293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2209.15189/citation-record","integrity":"/paper/2209.15189/integrity","json":"/paper/2209.15189/citation-record.json","paper":"/paper/2209.15189"},"outbound":[],"paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 43 inbound Pith citation observations for arXiv:2209.15189."}