{"as_of":"2026-08-20T00:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e669071c7a6ede2cef471565d5bfd7a7c2d54640157f889dbd8f65c670b9f4d","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:34:57.198738Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:45:03.331296Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T22:45:05.037045Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"cited_work":{"arxiv_id":"2502.02671","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02671","snapshot_observed_at":"2026-08-06T22:45:05.037045Z","title":"On Teacher Hacking in Language Model Distillation","venue":"cs.LG","work_id":"3344ea39-4300-4d9b-b255-277c8360ac47","year":2025},"citing_paper":{"arxiv_id":"2507.00054","last_updated":"2025-06-25T20:07:47Z","snapshot_observed_at":"2026-08-16T00:49:04.578925Z","submitted_at":"2025-06-25T20:07:47Z","title":"Enhancing Reasoning Capabilities in SLMs with Reward Guided Dataset Distillation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T22:45:03.331296Z"},"links":{"cited_paper":"/paper/2502.02671","citing_paper":"/paper/2507.00054"},"observation_digest":"sha256:6c9f9efaa793c92f4237dbca3919bdd433d0ebb5b29cf1d3264b15d43544e2f4","observation_id":"8a34b152-2464-440c-a5d0-9a7c4e36895b","resolution":{"observed_at":"2026-08-06T22:45:05.113351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02671/citation-record","integrity":"/paper/2502.02671/integrity","json":"/paper/2502.02671/citation-record.json","paper":"/paper/2502.02671"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.600349Z","title":null,"venue":null,"work_id":"5955842b-f4de-4468-86ae-13962d9500cb","year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.198738Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:064c5611f19e0de6e54caf7676b4a8f6b353dd16feb63b092ce39a646b56ee46","observation_id":"2b76f6bd-3f57-457b-b833-4f55e15c42d3","resolution":{"observed_at":"2026-08-09T11:34:57.606640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13916","last_updated":"2022-06-16T21:12:42Z","snapshot_observed_at":"2026-07-06T11:52:19.105210Z","submitted_at":"2021-09-28T17:59:36Z","title":"Unsolved Problems in ML Safety","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13916","snapshot_observed_at":"2026-08-09T11:34:56.920640Z","title":"Hendrycks, D., Carlini, N., Schulman, J., and Steinhardt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.920640Z"},"links":{"cited_paper":"/paper/2109.13916","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:821311d3c8e9c460b99a6e8b53bfafab9205c4823dc0e27fa33383469820ce53","observation_id":"960a8d90-3a91-4eda-aa8c-1c3ba9f7958d","resolution":{"observed_at":"2026-08-09T11:34:56.920640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07947","last_updated":"2016-09-22T01:17:12Z","snapshot_observed_at":"2026-08-14T21:51:10.458695Z","submitted_at":"2016-06-25T18:16:39Z","title":"Sequence-Level Knowledge Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07947","snapshot_observed_at":"2026-08-09T11:34:56.942721Z","title":"and Rush, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.942721Z"},"links":{"cited_paper":"/paper/1606.07947","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:3afd6bcf59d9233814704373abfd82ff8dffb93ed8bee8164d04ed5208e7f3a6","observation_id":"9318d52b-f9ce-4aaf-9865-f47d734a62cd","resolution":{"observed_at":"2026-08-09T11:34:56.942721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07253","last_updated":"2020-10-29T00:40:45Z","snapshot_observed_at":"2026-08-18T15:18:10.468717Z","submitted_at":"2020-09-15T17:43:02Z","title":"Autoregressive Knowledge Distillation through Imitation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07253","snapshot_observed_at":"2026-08-09T11:34:56.975671Z","title":"Lin, A., Wohlwend, J., Chen, H., and Lei, T","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.975671Z"},"links":{"cited_paper":"/paper/2009.07253","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:cfc812b2f8bd2f7f47d5c55064c40048217479734d8328a3dfd19bd325123dc4","observation_id":"3d4cb55c-6109-4502-8d33-b59771de9ca1","resolution":{"observed_at":"2026-08-09T11:34:56.975671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-09T11:34:57.012110Z","title":"Deepseek- v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.012110Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:914bf811b1f6825f4e6fe9752e984294c0fba4f61381a0e292ee269d5eac0b24","observation_id":"380e2e34-d2b9-4b37-8a5c-2a7648de7c00","resolution":{"observed_at":"2026-08-09T11:34:57.012110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.636257Z","title":"B., and Lapata, M","venue":null,"work_id":"4a1d6b73-6daf-441b-8bb3-8701a1d60175","year":2018},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.042852Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:0e3ef69aaa0fc389f05226c8c65d46dc094261afcb9350bb3149fa0704e3f0ea","observation_id":"2ae105ab-7403-4dea-80d8-168ec22821ea","resolution":{"observed_at":"2026-08-09T11:34:57.640894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-08-16T03:45:29.671274Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-09T11:34:57.100873Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.100873Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:bbc5b88e65e3d256ad3fae307888756ec79a9e988abdadc66c8612b5292274de","observation_id":"a9d1e721-e2b8-4dc9-95e0-c08bbe5ec341","resolution":{"observed_at":"2026-08-09T11:34:57.100873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02900","last_updated":"2024-11-05T01:44:14Z","snapshot_observed_at":"2026-08-16T14:02:09.339561Z","submitted_at":"2024-06-05T03:41:37Z","title":"Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02900","snapshot_observed_at":"2026-08-09T11:34:57.128745Z","title":"Scaling laws for reward model overoptimization in direct alignment algo- rithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.128745Z"},"links":{"cited_paper":"/paper/2406.02900","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:2e19b24290fc6830f250406baf96387695bbf414bf95ac0aed09b4308a2de2e1","observation_id":"b8af2d07-08a3-4725-832d-7f275034c4bd","resolution":{"observed_at":"2026-08-09T11:34:57.128745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12187","last_updated":"2024-01-22T18:27:08Z","snapshot_observed_at":"2026-08-16T14:25:27.754821Z","submitted_at":"2024-01-22T18:27:08Z","title":"WARM: On the Benefits of Weight Averaged Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12187","snapshot_observed_at":"2026-08-09T11:34:57.150732Z","title":"Warm: On the bene- fits of weight averaged reward models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.150732Z"},"links":{"cited_paper":"/paper/2401.12187","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:51c40b65f50af1fe34e791feae446bdf71b83a740b558585e3477d1d3645d39b","observation_id":"a9917ce7-d6d8-45b9-a5cf-cfb28070d176","resolution":{"observed_at":"2026-08-09T11:34:57.150732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T11:34:57.156496Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.156496Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:7827f9d0d84d04474cb40733ae6e56e46f7db407e52d7671684af2af17c3198c","observation_id":"742b1719-657f-4cad-91f1-eb939d2eaeec","resolution":{"observed_at":"2026-08-09T11:34:57.156496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-08-16T17:10:11.301337Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-08-09T11:34:57.167515Z","title":"Sanh, V ., Debut, L., Chaumond, J., and Wolf, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.167515Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:9bd9aaf2d2f9f6042b5bbad84cff078bb100abb52b076372b9a50fff0832ef42","observation_id":"2ff5f2db-b2b4-4252-a7d6-66a689e57f8c","resolution":{"observed_at":"2026-08-09T11:34:57.167515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-09T11:34:57.172471Z","title":"Stiennon, N., Ouyang, L., Wu, J., Ziegler, D., Lowe, R., V oss, C., Radford, A., Amodei, D., and Christiano, P","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.172471Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:0c3388a9592a9464c1d031ae15d5a49809b5c5ec342d6d6fc0b3c16bcb31cb51","observation_id":"4841ee5f-8954-4e5f-94d9-926bbc1fbbe3","resolution":{"observed_at":"2026-08-09T11:34:57.172471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05010","last_updated":"2023-05-08T19:31:09Z","snapshot_observed_at":"2026-08-17T02:35:25.998693Z","submitted_at":"2023-05-08T19:31:09Z","title":"Do Not Blindly Imitate the Teacher: Using Perturbed Loss for Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05010","snapshot_observed_at":"2026-08-09T11:34:57.189016Z","title":"Zhang, R., Shen, J., Liu, T., Liu, J., Bendersky, M., Najork, M., and Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.189016Z"},"links":{"cited_paper":"/paper/2305.05010","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:bb74160fd1563df89ba9bd5868a534cb420d536971b9a63028c1f7f2caba32da","observation_id":"65b7cce2-5efb-4116-b854-1d57b5fe6d9a","resolution":{"observed_at":"2026-08-09T11:34:57.189016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.619321Z","title":null,"venue":null,"work_id":"3c9b457f-80f9-4ded-92c9-1d9c48f6c276","year":2022},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.194274Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:e136d0c299fe16b5a53b04788968bf61fc5c471f1be120570ea7a937ce5db501","observation_id":"175fecbf-e0a5-48ed-8931-99fe2d20241d","resolution":{"observed_at":"2026-08-09T11:34:57.624594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-08-18T22:05:54.705341Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-09T11:34:57.178509Z","title":"Zephyr: Direct distillation of lm alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.178509Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:245b91272c99976f585b6d94db7300ef620da498844c248fc47d3bb9c0fd3f9f","observation_id":"644c30ee-7652-440f-8220-041e2483eada","resolution":{"observed_at":"2026-08-09T11:34:57.178509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07319","last_updated":"2024-02-11T22:40:12Z","snapshot_observed_at":"2026-08-16T14:19:30.130925Z","submitted_at":"2024-02-11T22:40:12Z","title":"ODIN: Disentangled Reward Mitigates Hacking in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07319","snapshot_observed_at":"2026-08-09T11:34:56.907788Z","title":"Odin: Disentangled reward mitigates hacking in rlhf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.907788Z"},"links":{"cited_paper":"/paper/2402.07319","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:58b01c4203defd1be1e590a5814dc6cfc15136d866cfdcbb68a21e5debdce1cf","observation_id":"a2d964af-fd96-4424-8667-bbc72aba3a2b","resolution":{"observed_at":"2026-08-09T11:34:56.907788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:56.901841Z","title":"doi: 10.3115/v1/W14-3302","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.901841Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:e94ee2f945724ae75b94480ad07657682e559ffcaaf1e92065dc725942af6467","observation_id":"04bdcc2c-96f8-48f9-adb2-c35da20ea704","resolution":{"observed_at":"2026-08-09T11:34:56.901841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-18T10:30:56.052469Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-09T11:34:56.926817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.926817Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:a6e4c481356c1a6aa399b9ad040bf2fd192f2134274f2ce3acb72d525690c9c1","observation_id":"b2f779b1-5788-41e3-a593-46cebc98585b","resolution":{"observed_at":"2026-08-09T11:34:56.926817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T11:34:56.890311Z","title":"Training a helpful and harmless assistant with rein- forcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.890311Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:71386fcff556fdfff7772ae6a8df40f740e5736f77b26febe2dd8516a5592282","observation_id":"d2140783-1c12-4353-84c9-6e64a19afbdb","resolution":{"observed_at":"2026-08-09T11:34:56.890311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.071170Z","title":"doi: 10.18653/v1/D18-1206","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.071170Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:e344bf45010ca10c208a206da5f1f2960e307a43366ba94f16e3712f8a003903","observation_id":"a4c2bbc3-3adc-4e7f-b305-b9f914a969ac","resolution":{"observed_at":"2026-08-09T11:34:57.071170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-09T11:34:56.932470Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.932470Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:703bcc850220b8643c6e1e83d2b8238aa2b7610642285819dcce7386669ea404","observation_id":"e3446707-e7f7-4986-9c56-b33813e27238","resolution":{"observed_at":"2026-08-09T11:34:56.932470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12842","last_updated":"2024-09-27T06:25:33Z","snapshot_observed_at":"2026-08-16T14:17:01.229568Z","submitted_at":"2024-02-20T09:10:08Z","title":"PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12842","snapshot_observed_at":"2026-08-09T11:34:56.937688Z","title":"Promptkd: Distilling student-friendly knowledge for generative language mod- els via prompt tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.937688Z"},"links":{"cited_paper":"/paper/2402.12842","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:de6f0c81e8e903242654e95272e34b6f76c1e2c6e44c28153c1549c88e655432","observation_id":"5079aeb4-3010-4a7a-b30e-1bacc08cb956","resolution":{"observed_at":"2026-08-09T11:34:56.937688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12822","last_updated":"2024-12-08T04:06:53Z","snapshot_observed_at":"2026-08-17T15:42:49.103733Z","submitted_at":"2024-09-19T14:50:34Z","title":"Language Models Learn to Mislead Humans via RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12822","snapshot_observed_at":"2026-08-09T11:34:57.183913Z","title":"R., He, H., and Feng, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.183913Z"},"links":{"cited_paper":"/paper/2409.12822","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:20b3ff40009cc94db0a529930abb669baa6e25f41490dc8151377ab903857b52","observation_id":"bf2cbe1c-3a37-4d91-9527-518e6f543717","resolution":{"observed_at":"2026-08-09T11:34:57.183913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.652540Z","title":"Findings of the 2014 workshop on statistical machine translation","venue":null,"work_id":"2524c33a-113b-4051-9975-3ae71644133f","year":2014},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.896299Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:05788957b4eb6b57159e81af0c6a70b83d459cac5d79987a32914687b0155afc","observation_id":"e5037d20-7ab6-4d33-8ca2-542aea9cc5b3","resolution":{"observed_at":"2026-08-09T11:34:57.658851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-09T11:34:56.914050Z","title":"I., Burnell, R., Bai, L., Gulati, A., Tanzer, G., Vincent, D., Pan, Z., Wang, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.914050Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:531ac037419caf3d68e545932db2a017aead28a8b2eb72cb885809bfd53c2ad6","observation_id":"be93f680-b27a-4f21-985b-94a377288f4a","resolution":{"observed_at":"2026-08-09T11:34:56.914050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-09T11:34:56.883725Z","title":"net/forum?id=3zKtaqxLhW","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.883725Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:9b875cba693842ff27a698311a2454fd9210760beee21ed22cbec74194e55477","observation_id":"867258ab-a084-4776-b325-c25c5abea41e","resolution":{"observed_at":"2026-08-09T11:34:56.883725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T19:27:02.778679Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2502.02671."}