{"as_of":"2026-08-23T19:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94c64dc0eb22a2dc3dfd7ce3fa5489576951a95ab8eff29c185cc58ec4ea87ba","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T10:30:11.309910Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T03:23:28.881458Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07711","snapshot_observed_at":"2026-08-01T05:09:55.790864Z","title":"Simct: Recovering lost supervision for cross-tokenizer on-policy distillation.arXiv preprint arXiv:2605.07711, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22334","last_updated":"2026-07-24T14:12:54Z","snapshot_observed_at":"2026-08-12T18:21:45.548920Z","submitted_at":"2026-07-24T14:12:54Z","title":"Cross-Tokenizer On-Policy Distillation via Byte-Prefix Marginalization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T05:09:55.790864Z"},"links":{"cited_paper":"/paper/2605.07711","citing_paper":"/paper/2607.22334"},"observation_digest":"sha256:58fbe21b0d6ace731ac7cfac8c1d95ac4d0481c851affb5ac24be2dfa42cec33","observation_id":"bb2ee1b5-0e33-4e06-b1bf-8d1bf51b2bc3","resolution":{"observed_at":"2026-08-01T05:09:55.790864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07711","snapshot_observed_at":"2026-07-31T18:36:16.782544Z","title":"arXiv preprint arXiv:2605.07711 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28076","last_updated":"2026-08-03T09:38:05Z","snapshot_observed_at":"2026-08-06T23:32:48.190844Z","submitted_at":"2026-07-30T11:49:46Z","title":"Group-Reflective Self-Distillation for Agentic Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T18:36:16.782544Z"},"links":{"cited_paper":"/paper/2605.07711","citing_paper":"/paper/2607.28076"},"observation_digest":"sha256:d884976e4b1afae646a34f5397733486a39fc4a33e4778a1258ada276558a55a","observation_id":"dca3f7a3-3a99-4865-9d75-5e546c4d2051","resolution":{"observed_at":"2026-07-31T18:36:16.782544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07711","snapshot_observed_at":"2026-08-04T03:23:28.881458Z","title":"arXiv preprint arXiv:2605.07711 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28076","last_updated":"2026-08-03T09:38:05Z","snapshot_observed_at":"2026-08-06T23:32:48.190844Z","submitted_at":"2026-07-30T11:49:46Z","title":"Group-Reflective Self-Distillation for Agentic Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T03:23:28.881458Z"},"links":{"cited_paper":"/paper/2605.07711","citing_paper":"/paper/2607.28076"},"observation_digest":"sha256:3666e31f0b05f3183670f62a7f3855ee8334ca349a162fe3949c02d3f36f321d","observation_id":"b6733b28-0330-44a9-a61d-f415abe92211","resolution":{"observed_at":"2026-08-04T03:23:28.881458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.07711/citation-record","integrity":"/paper/2605.07711/integrity","json":"/paper/2605.07711/citation-record.json","paper":"/paper/2605.07711"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:47aa95993bd42fe260665141092a5cc8f2db5bc5d41425432204f967cafff0e4","observation_id":"8549e758-dce9-4f57-bc5f-0fad715e6ca8","resolution":{"observed_at":"2026-05-22T10:31:25.066081Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on model compression for large language models.Transactions of the Association for Computational Linguistics (TACL)","venue":null,"work_id":"2b407aee-d05d-40b2-b5d2-66510fefc445","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:0d20ff15615ffb818d499910986fea0de3282eb5454e3c1ef4230182aca785d9","observation_id":"af48e5ab-6bb9-4fc0-ae8b-2ebaac8f7aee","resolution":{"observed_at":"2026-05-22T10:31:26.310696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-21T09:34:41.269688Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":"2402.13116","doi":"10.48550/arxiv.2402.13116","metadata_source":"pith","pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Knowledge Distillation of Large Language Models","venue":"cs.CL","work_id":"b1dcdadf-875e-4695-8fcf-0907c69302f3","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:28691d4c165e7be4b36be01bde944899d935fd227fe0edf0b5c03c933d714131","observation_id":"0a88ed71-00d5-4aa9-bc3d-ce2e04eaeb21","resolution":{"observed_at":"2026-05-22T10:31:25.075162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:49:12.049248+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:49:12.049248+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01885","last_updated":"2024-07-02T02:14:42Z","snapshot_observed_at":"2026-08-17T01:31:47.991489Z","submitted_at":"2024-07-02T02:14:42Z","title":"Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application","version":1},"cited_work":{"arxiv_id":"2407.01885","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01885","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Survey on knowledge distillation for large language models: Methods, evaluation, and application.arXiv preprint","venue":null,"work_id":"3dca9df5-1735-4c86-a532-d4f3da45a12d","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2407.01885","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:dcb6be35385e29fe209813bc474a04411957512983118ce73e6cf39b74a947c6","observation_id":"36443ef4-a44b-4948-93c6-41048c5118c6","resolution":{"observed_at":"2026-05-22T10:31:25.070537Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DistilBERT, a distilled version of BERT: Smaller, faster, cheaper and lighter","venue":null,"work_id":"f17616bb-ebcc-4614-a604-3d65b809f22a","year":2019},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:a21f74ab7e4dcba8d277ec5addf24532f1f7a3721fcd3b43de2e60e78a7e44a1","observation_id":"8d6d6954-e355-4cda-b9c2-fba48f35ae0e","resolution":{"observed_at":"2026-05-22T10:31:26.325482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TinyBERT: Distilling BERT for natural language understanding","venue":null,"work_id":"37dc26dc-5b20-4e95-bd0a-f4627612ca79","year":2020},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:fd9daaaeeac311553d39079c5bab413dcf8e6a5a7038071c30e2ae2dd9bc2908","observation_id":"96220fd9-8c58-419a-ba16-86ffb73350be","resolution":{"observed_at":"2026-05-22T10:31:26.313982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compact language models via pruning and knowledge distillation","venue":null,"work_id":"07018908-f8ab-416d-8100-06e4686514a4","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:93d3e43d61cacf6f2b56ecd44cb70e4a5330d2fb004605ea6d99c36ce61017e9","observation_id":"f238e125-5aab-468c-8b8b-1073e1edee93","resolution":{"observed_at":"2026-05-22T10:31:26.316756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scheduled sampling for sequence prediction with recurrent neural networks","venue":null,"work_id":"a3680b5f-4ae6-45f6-81d6-7d59980f3b5d","year":2015},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:c22abe6e46cb273d59608621d2474338e8a9bf8bc9bfc73692e0ef5318fbff94","observation_id":"2314dd3a-64a8-4d25-9d39-2756b23a5c98","resolution":{"observed_at":"2026-05-22T10:31:26.319207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging the gap between training and inference for neural machine translation","venue":null,"work_id":"5e12ea63-730b-45fa-9261-a25909ac5cd6","year":2019},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:b6a451873692256555d723c239a61d8257068ad86fb620b2bb3a633bec7075ae","observation_id":"10dd729b-74db-4cbb-9179-c1428f0b05e2","resolution":{"observed_at":"2026-05-22T10:31:26.321999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autoregressive knowledge distillation through imitation learning","venue":null,"work_id":"dd8f763f-128c-48bb-8b31-554e5e7d3d8a","year":2020},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:8e8ebfb1e3bb9e2ed06c86f9d47c8f72229bd0db299c0f0234e567908ca0b01c","observation_id":"1fa5dbc5-0c5f-4964-85fc-90c2f18fc486","resolution":{"observed_at":"2026-05-22T10:31:26.328760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SequenceMatch: Imitation learning for autoregressive sequence modelling with backtracking","venue":null,"work_id":"c68322e6-8424-46a1-b9ee-21888e80dc8f","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:6a95e2bdb4a481d7913a325e71e1216794d354ace7e50c99d2b22eb09967bcbe","observation_id":"686634e9-2fba-44ba-af95-44e892d9e807","resolution":{"observed_at":"2026-05-22T10:31:26.331373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gordon, and J","venue":null,"work_id":"7b6b06a9-c1ef-4039-92c1-1ec7c3e7bec9","year":2011},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:525905fc960dfc65db59d30c14bf6bf160e22e9196fae129e077ba42ac8edf75","observation_id":"466b4737-e24c-4c56-8072-b387906be992","resolution":{"observed_at":"2026-05-22T10:31:26.267046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":"d0363d8a-097b-4aa0-9498-e1d44e853f85","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:51a3bcc6f1015b008ec84b61a338418f9d9854f6205787173a6b8c95d40874cb","observation_id":"125aecf9-17ee-45ff-a818-6971c3c490b7","resolution":{"observed_at":"2026-05-22T10:31:26.256206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniLLM: On-policy distillation of large language models","venue":null,"work_id":"a2e395d3-54c4-44f5-9ca2-56059ec30f90","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:6e3011c80fb2a1b2e6f23758f78cebbf5b08523d8f59f20b3dbbb41faa20ef55","observation_id":"7cc398f4-1d2b-43f7-b469-24d5072b363f","resolution":{"observed_at":"2026-05-22T10:31:26.248703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DistiLLM: Towards streamlined distillation for large language models","venue":null,"work_id":"ea785b65-8e70-414a-a902-354495c4c612","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:63a32e25fa3a0442536d21d02c395960242f16c45d2bc46ad6ec0fa8a929de51","observation_id":"47ba3cce-fc5e-4be3-97ef-85f27579f7eb","resolution":{"observed_at":"2026-05-22T10:31:26.251123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DistiLLM-2: A contrastive approach boosts the distillation of LLMs","venue":null,"work_id":"6a38810f-2789-4267-b5fa-f0214dd167be","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:84bace8da4e36344eeeb59ee45d46e64f30c15c3f0044098902df6cfa581151e","observation_id":"c7830ddc-a084-40e0-87af-b06b006357e3","resolution":{"observed_at":"2026-05-22T10:31:26.245803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10643","doi":"10.48550/arxiv.2511.10643","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Black-box on-policy distillation of large language models.arXiv preprint","venue":"ArXiv.org","work_id":"1e58a1be-9294-4bd3-8040-3516dcebcd4a","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:ea15138b11397ce7df5adea5dc8fc02b84c6b39c297b931370ad29fb6268468d","observation_id":"66ad1212-8fe8-4e5e-95ec-2c95a7f4b1e1","resolution":{"observed_at":"2026-05-22T10:31:25.014689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13010","last_updated":"2026-05-08T06:38:25Z","snapshot_observed_at":"2026-08-21T18:25:43.414678Z","submitted_at":"2026-04-14T17:44:50Z","title":"Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation","version":2},"cited_work":{"arxiv_id":"2604.13010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13010","snapshot_observed_at":"2026-07-04T10:19:47.155186Z","title":"Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation","venue":"cs.LG","work_id":"7dae1a56-9dfd-4f59-a836-8c62d7da923d","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.13010","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:b487cd84314909368d15c39b3386cce87519016e6e9ea52cef9d415cf78a95c0","observation_id":"e142e345-4795-4a0c-a9f6-4bb9dfe67535","resolution":{"observed_at":"2026-05-22T10:31:24.948934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07155","last_updated":"2026-07-11T08:43:13Z","snapshot_observed_at":"2026-08-13T15:41:23.203009Z","submitted_at":"2026-01-12T02:57:39Z","title":"Stable On-Policy Distillation through Adaptive Target Reformulation","version":3},"cited_work":{"arxiv_id":"2601.07155","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.07155","snapshot_observed_at":"2026-07-09T00:35:48.734855Z","title":"Stable On-Policy Distillation through Adaptive Target Reformulation","venue":"cs.LG","work_id":"d26b1f29-c96d-46cf-bf68-688d16583c89","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2601.07155","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:bd0621d26afeb9e9475b785d9e5d2f07d61597bcc7d8e3e12e7066c8f3f5d4d1","observation_id":"399b0f2b-b924-40bf-8f0f-8ded6107bf2c","resolution":{"observed_at":"2026-05-22T10:31:24.924363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-16T00:27:04.851196Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":"2604.13016","doi":"10.48550/arxiv.2604.13016","metadata_source":"pith","pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","venue":"cs.LG","work_id":"42b43df0-4c82-493f-9d9b-1be8c116d9af","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:281f806ab406ed60fbf8d923cb2215c1271dd7de5c9817ce142a9efa3493d253","observation_id":"be246533-0e02-4166-bdcd-5519e6123a12","resolution":{"observed_at":"2026-05-22T10:31:25.057400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:24.605597+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:24.605597+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-08-13T16:28:18.700523Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":"2602.12275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-10T00:26:39.252472Z","title":"On-Policy Context Distillation for Language Models","venue":"cs.CL","work_id":"b56a7e15-d864-43f4-9212-59bc7ec70d21","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:b0ba40780054987d7b62aababba04eba6ca89685b713647b684496d2fb880a3d","observation_id":"a61bab5c-f4ff-4566-b708-8686eafd9bd0","resolution":{"observed_at":"2026-05-22T10:31:24.929036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00626","last_updated":"2026-06-18T17:00:51Z","snapshot_observed_at":"2026-08-15T00:53:33.148301Z","submitted_at":"2026-04-01T08:32:34Z","title":"A Survey of On-Policy Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2604.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00626","snapshot_observed_at":"2026-07-10T00:26:39.257599Z","title":"A Survey of On-Policy Distillation for Large Language Models","venue":"cs.LG","work_id":"f6aaea8e-1f0d-43e3-b28f-6066d3e0a66b","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.00626","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:a5b126bc58f36033a297a14e1343a0b5af60cdf049689b02f43f5ad6d2793c3b","observation_id":"7ebbc276-9519-486a-9d20-32380de130de","resolution":{"observed_at":"2026-05-22T10:31:24.872717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards cross- tokenizer distillation: The universal logit distillation loss for LLMs.Transactions on Machine Learning Research (TMLR)","venue":null,"work_id":"933cf418-4542-4aab-b364-69a914c5e122","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:24009da3d12b35ecb96f7e943ce93c0e762ebd99613bf362268a5a3dc46e3ef2","observation_id":"9ca60856-3bb1-4c96-8b45-efb57e7efff0","resolution":{"observed_at":"2026-05-22T10:31:26.259435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual-space knowledge distillation for large language models","venue":null,"work_id":"358cfd67-5364-4050-acb1-79cee094cabf","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:556edad73773d805b21c616abb75bc97144c9eae1ab91130c295138f723d0245","observation_id":"453ac5c3-d231-4f8f-a546-7560bdfbf53d","resolution":{"observed_at":"2026-05-22T10:31:26.261848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CTPD: Cross-tokenizer preference distillation","venue":null,"work_id":"f49ff596-6892-48ad-b100-97e3a58e860c","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:b85d35048b5d8681acc893c59c6af8ae5ae0a61b03ee07909cd98cd4a9153797","observation_id":"6c81ce92-bf38-46be-ad61-5e71250817ee","resolution":{"observed_at":"2026-05-22T10:31:26.240170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07466","last_updated":"2026-04-13T14:15:52Z","snapshot_observed_at":"2026-08-21T19:14:39.321132Z","submitted_at":"2026-04-08T18:05:38Z","title":"Cross-Tokenizer LLM Distillation through a Byte-Level Interface","version":2},"cited_work":{"arxiv_id":"2604.07466","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07466","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-Tokenizer LLM Distillation through a Byte-Level Interface","venue":"cs.CL","work_id":"650bebed-0df8-4b06-b6e2-e0bb1d240a85","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.07466","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:7daba19caa7e20ae79c172877127def9e1a0abaf337f048ef9a0fac12b8d307a","observation_id":"e94aa396-9efa-4454-87c9-3771530ca835","resolution":{"observed_at":"2026-05-22T10:31:24.919240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-tokenizer likelihood scoring algorithms for language model distillation","venue":null,"work_id":"09cac14b-b35d-4e68-8b87-17f398ee0869","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:47f6734d532e75142a071aaf5586139fafeb580467a8fbca4efa220976b0c343","observation_id":"bcf99f3e-8369-4d2d-a207-14dbf0dc20a6","resolution":{"observed_at":"2026-05-22T10:31:26.243307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-level optimal transport for universal cross-tokenizer knowledge distillation on language models","venue":null,"work_id":"8f8d8906-ffab-442b-a674-68bba6acd242","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f4751e5d3622b06078f1bb1b61becf64b073ea6e7cad2c88e3006c21fac95e33","observation_id":"8d700067-9a2e-4645-b2e8-2446ec94167b","resolution":{"observed_at":"2026-05-22T10:31:26.253850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unlocking on-policy distillation for any model family.Hugging Face Tech- nical Report","venue":null,"work_id":"4d092e7f-ee55-4c53-ab8d-321b986de450","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:13c3639433bec3c29f23edb2b087e24eebc259d0ba466997c95605dc25bfdec1","observation_id":"b21ac0a3-de0e-4dee-a910-61c60f6f448f","resolution":{"observed_at":"2026-05-22T10:31:26.264691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11426","last_updated":"2025-04-15T17:38:47Z","snapshot_observed_at":"2026-08-16T12:40:46.683239Z","submitted_at":"2025-04-15T17:38:47Z","title":"A Dual-Space Framework for General Knowledge Distillation of Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.11426","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.11426","snapshot_observed_at":"2026-07-04T10:19:47.106023Z","title":"A dual-space framework for general knowledge distillation of large language models","venue":null,"work_id":"8ae92514-24e2-42b9-8eca-447e86ebf1ee","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2504.11426","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:5b7ec01d1bc3c81a3f40ec74bb012795bbe94666cc7d1fb228d66a6fc2b5845f","observation_id":"553e9527-da29-4659-bb92-b03a68df5dfa","resolution":{"observed_at":"2026-05-22T10:31:25.009565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Universal cross-tokenizer distil- lation via approximate likelihood matching","venue":null,"work_id":"65fc3e98-73be-439f-9a9e-378be6419d3b","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f5a419199ed73d4cb2d7226b1e542fda29d53ea63e732b3a8c5a964de36b64bb","observation_id":"cfd8a466-b732-4546-8613-9e547430cc5d","resolution":{"observed_at":"2026-05-22T10:31:26.307634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enhancing cross-tokenizer knowledge distillation with contextual dynamical mapping","venue":null,"work_id":"cb9ef3a6-2509-469a-931e-1bddec139c0f","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:c506ff3d70d1a2821556756850257bfb8cbc503a89544f9784a080dfa4c1c8cd","observation_id":"0bd8cbca-a72e-478b-983c-c6eaee16a292","resolution":{"observed_at":"2026-05-22T10:31:26.300933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.07079","last_updated":"2026-05-22T17:34:18Z","snapshot_observed_at":"2026-08-14T14:46:28.605827Z","submitted_at":"2026-03-07T07:26:18Z","title":"Entropy-Aware On-Policy Distillation of Language Models","version":2},"cited_work":{"arxiv_id":"2603.07079","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.07079","snapshot_observed_at":"2026-07-09T21:06:34.837233Z","title":"Entropy-aware on-policy distillation of language models","venue":"cs.LG","work_id":"7dccbe12-e2aa-48d8-9b76-5521ccf02668","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2603.07079","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d7b606b4e584a28335d5b705c378083a22659c230071cf53a77d837dda24a227","observation_id":"7acfc3b5-85fc-4361-915b-dd915433c23f","resolution":{"observed_at":"2026-05-25T03:02:00.585154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.64434/tml.20251026","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.393084Z","title":"On-policy distillation.Thinking Machines Lab: Con- nectionism","venue":null,"work_id":"bb76b11f-d59b-421e-88c6-fa0920ed09c3","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d03c7b80a016b5875832f954781a7e236f2413bf3dbade41d86f7d783936a842","observation_id":"404e92e6-9f3e-482d-b176-9694138df48a","resolution":{"observed_at":"2026-05-22T10:31:24.604857Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.256871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.256871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking kullback- leibler divergence in knowledge distillation for large language models","venue":null,"work_id":"9dba5ad7-d39a-44df-a573-a122b1cbe0c2","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:28dedf0b272e5595bcb4b40d25ba1c3fb39389508640e4c2db3a2eb6d32c3604","observation_id":"8a737bd3-4106-44c6-8487-7e92377b2f4c","resolution":{"observed_at":"2026-05-22T10:31:26.298080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.00223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:42:50.047874Z","title":"Diversity-aware reverse kullback-leibler divergence for large language model distillation.arXiv preprint","venue":null,"work_id":"a701b107-ab54-4eca-ba28-47227bb93f8d","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d26161f744ba2bef262ff2c4d3bc83a38d970e3f845bc27077ed778253998e35","observation_id":"31d52e4e-afdd-4575-92af-cbb3d1bd6ff1","resolution":{"observed_at":"2026-05-22T10:31:24.893425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25837","last_updated":"2026-05-30T04:49:34Z","snapshot_observed_at":"2026-08-20T06:41:15.634661Z","submitted_at":"2025-09-30T06:21:28Z","title":"Distillation of Large Language Models via Concrete Score Matching","version":3},"cited_work":{"arxiv_id":"2509.25837","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.25837","snapshot_observed_at":"2026-06-28T23:42:50.055599Z","title":"Distillation of large language models via concrete score matching.arXiv preprint","venue":"cs.LG","work_id":"86fdb1fd-f99a-4639-8dce-cc0d3bc49071","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2509.25837","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:715135017a5c7de4751b0795a22a9396957a14c2cf907b1ec3044f060c79032c","observation_id":"249ffbe9-e50b-4394-af92-6af5f9c48a57","resolution":{"observed_at":"2026-06-02T02:03:33.414151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25562","last_updated":"2026-04-27T06:21:52Z","snapshot_observed_at":"2026-08-14T04:24:49.664082Z","submitted_at":"2026-03-26T15:35:59Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","version":2},"cited_work":{"arxiv_id":"2603.25562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.25562","snapshot_observed_at":"2026-07-07T12:33:45.227324Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","venue":"cs.LG","work_id":"8e059321-d6e4-4359-89eb-83ecbb93b657","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2603.25562","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:bf472c11a8fa66fa066090a84ff4a18bc27a4ca2014278c112e8825b73ff81b5","observation_id":"73bf2b2b-824b-4401-91ff-ae91195b2d85","resolution":{"observed_at":"2026-05-22T10:31:24.909338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:59:42.607722Z","title":"SelecTKD: Selective token- weighted knowledge distillation for LLMs.arXiv preprint arXiv:2510.24021","venue":null,"work_id":"652f5493-13ed-426e-87a3-0b720d03ad0d","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:10c0225971436f4466d246fb0aa93d59ef66baa342435a55c99c36d6a68ba69a","observation_id":"7fe0deee-7897-42be-933b-99cc0d00aab8","resolution":{"observed_at":"2026-05-22T10:31:24.968412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14084","last_updated":"2026-05-21T05:36:13Z","snapshot_observed_at":"2026-08-12T12:04:07.125000Z","submitted_at":"2026-04-15T16:58:24Z","title":"TIP: Token Importance in On-Policy Distillation","version":4},"cited_work":{"arxiv_id":"2604.14084","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14084","snapshot_observed_at":"2026-07-09T21:06:34.840057Z","title":"TIP: Token Importance in On-Policy Distillation","venue":"cs.LG","work_id":"6509a633-b810-4a8d-9de9-8a9b59a768d0","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.14084","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:ce5561e621e2bfc615690e0bd8cbc1e3b9de6b1607134c962b320528076de3ea","observation_id":"6c11ab24-9855-4558-ad37-27925e088f1f","resolution":{"observed_at":"2026-05-22T10:31:24.987784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16806","last_updated":"2025-03-01T15:17:50Z","snapshot_observed_at":"2026-08-16T12:55:52.620926Z","submitted_at":"2025-02-24T03:30:29Z","title":"CoT2Align: Cross-Chain of Thought Distillation via Optimal Transport Alignment for Language Models with Different Tokenizers","version":3},"cited_work":{"arxiv_id":"2502.16806","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.16806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoT2Align: Cross-chain of thought distillation via optimal transport alignment for language models with different tokenizers.arXiv preprint","venue":null,"work_id":"fa3f2712-5459-4ee2-b8e7-613c768e8304","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2502.16806","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:a07d52efb0f823c4afd4773931a28f75fda94a85a45d8358c5aa3967acc75044","observation_id":"4d8127ea-ec13-4f58-8c68-be3479703d51","resolution":{"observed_at":"2026-05-22T10:31:24.953607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual-space knowledge distillation with key-query matching for large language models with vocabulary mismatch","venue":null,"work_id":"13840ced-d203-4a6e-9ea1-937242e65837","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:c727b08a9635e2827a0665f876a8a541daccd3538c9bc6528635aa30bed06a1a","observation_id":"710f1158-0682-4a8c-9830-017415089391","resolution":{"observed_at":"2026-05-22T10:31:26.304143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19123","last_updated":"2025-03-24T20:19:31Z","snapshot_observed_at":"2026-08-18T21:37:15.867835Z","submitted_at":"2025-03-24T20:19:31Z","title":"Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling","version":1},"cited_work":{"arxiv_id":"2503.19123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19123","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overcoming vocabulary mismatch: V ocabulary- agnostic teacher guided language modeling.arXiv preprint","venue":null,"work_id":"fdb5321c-dc67-4c0e-aa7a-a7144313954c","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2503.19123","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:e5cb1dbd79408a0bca1273fba89dd54b6f25eb337d2df5eb598c1e1bc065dbc2","observation_id":"23f87d62-9081-46dd-b412-15cfef0d1ca4","resolution":{"observed_at":"2026-05-22T10:31:24.898822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MoL: Mixture of layers in cross- tokenizer embedding model distillation.Knowledge-Based Systems","venue":null,"work_id":"286be0ed-0898-4db7-b907-3d6fc8e4f127","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:db1d8c56468fa5c6bd0ea840693d36f08a743922fa3d55f4faad098bcf1f758b","observation_id":"bbed16a3-cd01-45b9-a0d2-27690b131f26","resolution":{"observed_at":"2026-05-22T10:31:26.295854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":"1609.08144","doi":"10.18653/v1/2021.eacl-main.163","metadata_source":"pith","pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","venue":"cs.CL","work_id":"e294e5a1-5dd2-44a0-b348-adbd62fe1916","year":2016},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:e693b6fc0c2dd2447e48027630b2728a242ebf5de953508acf6c98548fefb7b3","observation_id":"c9de98d9-5b9b-45c6-ac79-8859f7241f82","resolution":{"observed_at":"2026-05-22T10:31:24.903973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:a8402ffa668b8c187096fcf0ca58ce60b56a2c684f159f0a8e7d062601ab4004","observation_id":"d84de946-a0d9-48d2-9f41-cafef7bdfe26","resolution":{"observed_at":"2026-05-22T10:31:25.003761Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-15T22:57:45.773661Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":"2503.01743","doi":"10.18653/v1/2023.wmt-1.23","metadata_source":"pith","pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","venue":"cs.CL","work_id":"83956045-536a-41ff-af02-b80e2a614eab","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:7d917af8a8773badf7c363d42065d250a543645401f874399ddec94b549a7bc9","observation_id":"18d09668-4518-4b80-b812-32da377dc361","resolution":{"observed_at":"2026-05-22T10:31:24.938742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:add959ee8058907536570a5f8eaddfc3e4806a2c898911ce23883d43b38b7426","observation_id":"aa28bac4-94bc-4b2e-bc94-7efe0f204666","resolution":{"observed_at":"2026-05-22T10:31:24.957775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d79dff29349deccae88f1772b355182c68b75df1af01c4b3a31033e3eb133399","observation_id":"f143c7d4-8b97-4eec-8fae-7f2f904de02a","resolution":{"observed_at":"2026-05-22T10:31:24.882819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-16T14:17:49.494789Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":"2402.14830","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-07-02T21:17:24.055449Z","title":"Orca-math: Unlocking the potential of SLMs in grade school math.arXiv preprint","venue":null,"work_id":"f616c17b-34df-49f7-aafc-f05274aa8ac7","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:7e4246c0cc1c0a65c59d16a001d8bf8451c490746fb883d2b480a7c57043b489","observation_id":"89d3c712-0683-41c9-bb0d-164eb1299a2e","resolution":{"observed_at":"2026-05-22T10:31:24.877899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10176","last_updated":"2024-11-03T03:48:02Z","snapshot_observed_at":"2026-08-16T17:24:49.433939Z","submitted_at":"2024-02-15T18:26:11Z","title":"OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset","version":2},"cited_work":{"arxiv_id":"2402.10176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10176","snapshot_observed_at":"2026-07-10T18:17:33.884574Z","title":"Openmathinstruct-1: A 1.8 million math instruction tuning dataset.arXiv preprint arXiv: Arxiv-2402.10176","venue":"cs.CL","work_id":"9000f710-e68c-43ea-854e-4e984f57f380","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2402.10176","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:5c1ef72ee917c5c74b69cc94ed90953dc2e9608f5cbf970084905ccbc18b4e04","observation_id":"00fa99fc-893c-4635-b27f-721c2ea0447d","resolution":{"observed_at":"2026-05-22T10:31:24.888136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"89b73b39-1193-44df-9f1b-410484498492","year":2021},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:3d5757e34c8131a4fbbb406364b651fe1287a18e2b6183c5d6be98d4a66eb318","observation_id":"f3187a92-4d82-49da-a911-3613ea196931","resolution":{"observed_at":"2026-05-22T10:31:26.288577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04030","last_updated":"2025-08-07T23:16:09Z","snapshot_observed_at":"2026-08-18T09:54:47.079943Z","submitted_at":"2025-04-05T02:52:16Z","title":"OpenCodeInstruct: A Large-scale Instruction Tuning Dataset for Code LLMs","version":2},"cited_work":{"arxiv_id":"2504.04030","doi":"10.48550/arxiv.2504.04030","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04030","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenCodeInstruct: A large-scale instruction tuning dataset for code LLMs.arXiv preprint","venue":"ArXiv.org","work_id":"136700a7-11f6-48b3-8b28-1be2840954e9","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2504.04030","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:20f9b2ea37d554c1349d1cc2550e98dee71220ec7b04c9efac45d4fe1cb47432","observation_id":"50a37ed7-eed9-421c-861d-4b004b9c2bc6","resolution":{"observed_at":"2026-05-22T10:31:25.025236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02951","last_updated":"2025-07-12T02:08:21Z","snapshot_observed_at":"2026-08-16T12:53:05.855883Z","submitted_at":"2025-03-04T19:17:36Z","title":"KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding","version":2},"cited_work":{"arxiv_id":"2503.02951","doi":"10.48550/arxiv.2503.02951","metadata_source":"pith","pith_arxiv_id":"2503.02951","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"KodCode: A di- verse, challenging, and verifiable synthetic dataset for coding.arXiv preprint","venue":"cs.LG","work_id":"7a8a1722-94c4-4a65-9391-3ffde48c168a","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2503.02951","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f543675d97f5afce47a5ff5fec87d62c340fd4e36c02e32fcff8c5d98109fd5d","observation_id":"953d47c2-8f7f-47d5-9625-98c6e36cf3d1","resolution":{"observed_at":"2026-05-22T10:31:24.914644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14852","last_updated":"2023-12-27T10:09:18Z","snapshot_observed_at":"2026-08-18T07:56:10.424560Z","submitted_at":"2023-12-22T17:25:42Z","title":"TACO: Topics in Algorithmic COde generation dataset","version":3},"cited_work":{"arxiv_id":"2312.14852","doi":"10.48550/arxiv.2312.14852","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14852","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TACO: Topics in algorithmic COde generation dataset.arXiv preprint","venue":"arXiv (Cornell University)","work_id":"67740cc1-d973-4614-adf4-686babd14274","year":2023},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2312.14852","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:44750c479d9adfbf949aad00ef1e248187b078cab64d1309d56e908a0e973617","observation_id":"3fa173a6-78a0-4f7f-8aa9-77a3cff314a4","resolution":{"observed_at":"2026-05-22T10:31:25.030496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":"27e969c6-d672-461c-93c8-9d3d9d139a94","year":2022},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f4c15b5313e6fd11cff9d0ff9ea16385744e56e26ebe2123d72158bcc40e9a7c","observation_id":"8da825b1-4fc9-4cc4-be84-207ae85616cb","resolution":{"observed_at":"2026-05-22T10:31:26.282958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"a15d4e21-cff2-41a9-b75c-549bdcb924b4","year":2024},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:0187ce5f472f9fc52876e9576b31e13f8b83f26ff3185c06ed78db9b444b5f92","observation_id":"42deac3c-0e99-458e-9a09-15aa2528a8b4","resolution":{"observed_at":"2026-05-22T10:31:26.285657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:58db257ede3c0e600cdf44fa7b3799d27852fd3eeefc7ca1eb9e32262e5ae493","observation_id":"effc5120-8fa5-49d7-8ab0-8e9d51a4f24d","resolution":{"observed_at":"2026-05-22T10:31:24.983076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LiveCodeBench: Holistic and contamina- tion free evaluation of large language models for code","venue":null,"work_id":"a459b647-0c76-41db-9c04-e570645afd8c","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:6b1cb23b7bd03d136503267b5b64af12aa1a08abaf66bae332bfc8a92dc53d9d","observation_id":"f24958e5-e8bd-4dc4-8df7-7ee6e6f045e3","resolution":{"observed_at":"2026-05-22T10:31:26.291058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.01875","last_updated":"2026-07-17T06:31:09Z","snapshot_observed_at":"2026-08-19T20:36:26.457286Z","submitted_at":"2026-03-02T13:54:19Z","title":"KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models","version":3},"cited_work":{"arxiv_id":"2603.01875","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.01875","snapshot_observed_at":"2026-07-20T02:18:26.584736Z","title":"KDFlow: A user-friendly and efficient knowledge distillation framework for large language models.arXiv preprint","venue":null,"work_id":"28ae66c2-d2b1-4282-8afb-00141a556322","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2603.01875","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:566b21cbeb265064c5ccf26119ee5591111cbc7fa84b5fa3fec7794046ce921e","observation_id":"f9313a53-396e-47b7-99a6-774415001a3b","resolution":{"observed_at":"2026-07-20T02:18:26.584736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:29ca57ff7228d4885b336d585034a984f65c439ea4ac13a39ea22a90a9f8422b","observation_id":"566ae296-2c72-45bf-ad53-687a1f995064","resolution":{"observed_at":"2026-05-22T10:31:24.978298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-08-16T22:15:21.517617Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:969fc51a256b24e54e70565f4cf6dc054c97b05b45fe91ca5e23f2074a7595a3","observation_id":"11d440ab-8c10-4105-bf2a-f8cc43dba56a","resolution":{"observed_at":"2026-05-22T10:31:24.963224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limi: Less is more for agency.arXiv preprint","venue":null,"work_id":"466fb53d-0a3b-4e3f-8d8f-75f3bdd69960","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:7433d19bddb052f98ccaabd947c17223e4134a8d326c0ec184a12380690d939d","observation_id":"dafe7bab-2136-41e1-b0ba-bce6a75f03dd","resolution":{"observed_at":"2026-05-22T10:31:25.046731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.27598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:23:15.799022Z","title":"Innovatorbench: Evaluating agents’ ability to conduct innovative LLM research.arXiv preprint","venue":null,"work_id":"4d76ef73-0b3a-42cc-80bf-432d2ab28422","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d4fc8c310277382bc77472f72ce2ea3119935deff731559652eca6f9f0f92451","observation_id":"e398d7d2-159e-4e13-810a-92297cf278d1","resolution":{"observed_at":"2026-05-22T10:31:24.998718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.18418","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:58:43.799003Z","title":"davinci-dev: Agent-native mid-training for software engineering.arXiv preprint","venue":null,"work_id":"8ee3de3f-9eaa-46a3-bc0d-85c3ca15c13b","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f4e6c50450478577ae3caa981f94f2b24b01d604fcdb0d081c3cf38af8331ab3","observation_id":"3193cbd0-6254-4478-b465-c5d9c275ed49","resolution":{"observed_at":"2026-05-22T10:31:24.933866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.14337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:39:45.020025Z","title":"Longcli-bench: A preliminary benchmark and study for long-horizon agentic programming in command-line interfaces.arXiv preprint","venue":null,"work_id":"26854e0e-a148-4543-b0a4-f76b166691ca","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:ea3f3419089772f2013b895462394207a12fb72d7f7d530622f5d7b7fe4ed9b3","observation_id":"d67ebaee-5165-4ad2-9b6e-1a49cc54c929","resolution":{"observed_at":"2026-05-22T10:31:25.052265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13023","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:09:59.310571Z","title":"davinci-env: Open swe environment synthesis at scale.arXiv preprint","venue":null,"work_id":"9ba61d1b-dff5-4b07-850d-cb1ffbacadbd","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f54d538bf9816b86d33d200a03be84ca5c996d82d96122d2e654ac4c1f121afd","observation_id":"b111961e-db7b-43c3-baa5-c1943ecac06b","resolution":{"observed_at":"2026-05-22T10:31:25.041586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Argo: Asynchronous rollout with human guidance for research agent optimization.OpenReview preprint","venue":null,"work_id":"9f75f9a7-a352-4994-afc6-fd0fbef866f6","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:f4120dc04096b868a844d6e957c383d8538f12e5aef3a0279e8afe0e7154ceec","observation_id":"ccd73136-28dc-482d-bd3f-33d78582db62","resolution":{"observed_at":"2026-05-22T10:31:26.277689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07725","last_updated":"2026-08-18T09:21:07Z","snapshot_observed_at":"2026-08-21T23:10:27.731693Z","submitted_at":"2026-05-08T13:30:42Z","title":"SOD: Step-wise On-policy Distillation for Small Language Model Agents","version":3},"cited_work":{"arxiv_id":"2605.07725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.07725","snapshot_observed_at":"2026-07-09T00:35:48.710213Z","title":"SOD: Step-wise On-policy Distillation for Small Language Model Agents","venue":"cs.CL","work_id":"5919760d-bb63-46e0-9cbd-799eb53f2f45","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2605.07725","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:e837828affe803c9415df6353b7dbdb81d53d04fa4984d627735b77f0e56973f","observation_id":"2d033aab-3719-44d3-b4af-1b427e359efe","resolution":{"observed_at":"2026-05-22T10:31:25.020076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.02288","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T16:24:01.050266Z","title":"Unifying group-relative and self-distillation policy optimization via sample routing","venue":null,"work_id":"6dea6cb7-a4e5-478a-ab3c-eeeb335abd51","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:d8b04f1723b352d0281bbd814720c5522b4a6436b7d2a4c0b401700c83b33f0a","observation_id":"098fdcfe-07fe-4f87-90ca-4883bd96ca9d","resolution":{"observed_at":"2026-05-22T10:31:24.973244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust preference optimization via dynamic target margins","venue":null,"work_id":"93693e37-1cd5-4541-9f9f-92847643fc0f","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:e13de4834c9cf2ace51e0ec363ccae052468acf8f246f003276661111353d61e","observation_id":"1f973ef5-b0b6-4ec9-8a57-4e492e5060ca","resolution":{"observed_at":"2026-05-22T10:31:26.274799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lamp- val: Large language models empower personalized valuation in auction","venue":null,"work_id":"d31e8a8c-6f90-4817-823b-438aee65e30d","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:fab76bb1ad6d8a87fae9897d5e8cb61d38c612dac3131ad527247701d32139e2","observation_id":"1afe7701-4a14-4083-9a73-96b7b3367942","resolution":{"observed_at":"2026-05-22T10:31:26.280279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07737","last_updated":"2026-04-09T02:40:34Z","snapshot_observed_at":"2026-08-10T21:57:09.458163Z","submitted_at":"2026-04-09T02:40:34Z","title":"SepSeq: A Training-Free Framework for Long Numerical Sequence Processing in LLMs","version":1},"cited_work":{"arxiv_id":"2604.07737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SepSeq: A Training-Free Framework for Long Numerical Sequence Processing in LLMs","venue":"cs.CL","work_id":"d2cb963d-1db3-451e-8d1c-2432e6d0d4c9","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2604.07737","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:8f4f27df70c8d9d6ac8619c8ff7a201ed70deb33cf496f8ebe33dedc4655d0b2","observation_id":"0b05ab3e-22db-4a9e-b75c-79f437d8cdff","resolution":{"observed_at":"2026-05-22T10:31:24.993262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple data augmentation for graph classification: A perspective of equivariance and invariance.ACM Transactions on Knowledge Discovery from Data, 19(2): 1–24","venue":null,"work_id":"f9c5f3fb-b17a-4386-b139-b8dace21bc2d","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:c7c447d7cfbcd995544844ab13597c9b93f17c5204697c63870bc32c7681b484","observation_id":"2dfe962b-fa5a-40f9-bdf0-421e1a7f2f69","resolution":{"observed_at":"2026-05-22T10:31:26.293405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A unified invariant learning framework for graph classification","venue":null,"work_id":"ead16d86-23f9-4d86-8e8e-1b708f06f975","year":2025},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:20d389063bc0d6e105a9aa8628af7a373f5fec9d4775e4d1146f9b6f75c8485d","observation_id":"3dbca49b-d9fa-4874-9a8e-367e36a9a103","resolution":{"observed_at":"2026-05-22T10:31:26.269695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Since 10000 = 7×1428 + 4 , the remainder is 4","venue":null,"work_id":"85adca13-f7c1-4d42-8cee-1c155ddc2192","year":null},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:0e72401e7f5630ddcc0b05f1b2d9c3dc67e374edf790f6309c69974ea522961e","observation_id":"2b1d17f7-05eb-493b-bbe3-f90c5c401079","resolution":{"observed_at":"2026-05-22T10:31:26.272187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T10:28:04.584789Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":41,"verified_fuzzy":34},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 3 inbound Pith citation observations for arXiv:2605.07711."}