{"as_of":"2026-08-20T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10d9701e6076691ccfb5dcd5af77525f05d6215cc39bcde009071535e03d2e3f","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:49:14.772717Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20888/citation-record","integrity":"/paper/2505.20888/integrity","json":"/paper/2505.20888/citation-record.json","paper":"/paper/2505.20888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T13:49:10.576691Z","title":"Bowman, Zac Hatfield - Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.576691Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:8bd9d2e7e84a6f86d46cedde93f61d82c2bbd580acf1dfe5765fa4c3feb6187a","observation_id":"16700cb5-52df-48e3-b2e1-661b9bd6caa4","resolution":{"observed_at":"2026-08-07T13:49:10.576691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10937","last_updated":"2025-05-16T07:15:30Z","snapshot_observed_at":"2026-08-17T07:38:55.567225Z","submitted_at":"2025-05-16T07:15:30Z","title":"Reasoning with OmniThought: A Large CoT Dataset with Verbosity and Cognitive Difficulty Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10937","snapshot_observed_at":"2026-08-07T13:49:10.708258Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.708258Z"},"links":{"cited_paper":"/paper/2505.10937","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:96749e6480f3ab24e9b839d254b94d6533964510ffc5ab7f7e72bd7366c0be55","observation_id":"2ed727d5-12e6-49e6-92af-818187f58d14","resolution":{"observed_at":"2026-08-07T13:49:10.708258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:10.821117Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.821117Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:2dce2a5b61ed68880c1921186b139423c2f1aa29a1e35df08550ce2330a3c5af","observation_id":"f81d7848-dedd-4e5f-8d38-42c479cf090d","resolution":{"observed_at":"2026-08-07T13:49:10.821117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:49:10.936159Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.936159Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:6b126f24c1b11363fb6d65c0fc5cef5ceac45843eb0e3dec0c1514c4cc6e53e2","observation_id":"1a7806b3-32ad-4d55-96f3-a40792272954","resolution":{"observed_at":"2026-08-07T13:49:10.936159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.927466Z","title":null,"venue":null,"work_id":"e3204668-1742-4c1c-b3ec-73ef1d77d569","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.039656Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b326841797914258394fa2bbf37fd7c9bc7632b3a94eba551b7c7d7f4b9a103c","observation_id":"fa86540f-742b-46d2-95d0-43310a7c215d","resolution":{"observed_at":"2026-08-07T13:49:17.049312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:11.146637Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.146637Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:7927a1ff2054e6d750bb7d18e098347164299b29da34444faa8c3bccf6e89f48","observation_id":"118f8432-2c75-4acc-b9d3-9b08a70821b6","resolution":{"observed_at":"2026-08-07T13:49:11.146637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.718402Z","title":null,"venue":null,"work_id":"a5719e7e-38b3-4291-8710-3fd8c68b3801","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.336891Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:fd0c07d64ce6fbc7828c7082ee326e5ea837122fbe27a0c725e15fa98eaffde6","observation_id":"7f164466-d777-412c-8b34-6b4fa2a86cc0","resolution":{"observed_at":"2026-08-07T13:49:16.831464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-10T09:42:17.185681Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-07T13:49:11.506083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.506083Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:0203f3c721338ef60323f08b2e27e4dd36e5ff0af0941285894d372cdca8438e","observation_id":"e1ac570d-7d18-4e3d-a5fb-9e74697fee98","resolution":{"observed_at":"2026-08-07T13:49:11.506083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07503","last_updated":"2024-08-10T20:46:47Z","snapshot_observed_at":"2026-08-16T14:01:51.799198Z","submitted_at":"2024-04-11T06:34:17Z","title":"Best Practices and Lessons Learned on Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07503","snapshot_observed_at":"2026-08-07T13:49:11.631956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.631956Z"},"links":{"cited_paper":"/paper/2404.07503","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:89c030029f5b228115bae1218f6833bd6524e983f8d036be430561a365adf7e3","observation_id":"d84f3036-e691-4941-86c6-bafdc213e8b4","resolution":{"observed_at":"2026-08-07T13:49:11.631956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.550665Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"c5df924e-b15e-4eda-bc0f-603c7c6c93c7","year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.753762Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:2de0a5b2baf70569d27b8636190fd4c9dbdd4bec254ff6065771942c2fc1574b","observation_id":"1eb0f43c-616d-417b-a619-9c4b14516ea7","resolution":{"observed_at":"2026-08-07T13:49:16.639299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:11.919425Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.919425Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:029b5e64de36866640e400b5e80ffede2e86128fe6c4bf5f2680a457b32ba0f8","observation_id":"b236ef97-9d7c-40b8-a083-32f3b56c269b","resolution":{"observed_at":"2026-08-07T13:49:11.919425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:49:12.102333Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.102333Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:80a0ade40c7ce9c43dc33f01595b622db54b8083daf0ba6a39ca2ef7ce4cc774","observation_id":"976026f3-de9d-45e1-b810-f06952db3ba1","resolution":{"observed_at":"2026-08-07T13:49:12.102333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:49:12.273736Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.273736Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b43013787bb5b50b8997200e2185b0e109e8a0930809e3e88c2007a9eb60d90c","observation_id":"fffb7907-e84a-46d0-9175-a089dd5ad329","resolution":{"observed_at":"2026-08-07T13:49:12.273736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:12.414602Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.414602Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:2677a65d9ff475af3b53c7b8332c07de8ea17e63c39c7cdef0406998eba60540","observation_id":"2a308b24-902e-4d84-9660-d86d4831ed5e","resolution":{"observed_at":"2026-08-07T13:49:12.414602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-08-18T22:05:54.705341Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-07T13:49:12.573358Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.573358Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:193f81cb542da7f8c05757b2fc926076a3f7d460b6d088dba03eb3550bc9b16e","observation_id":"03dc10a3-6b99-4af4-88c5-0b6ff0967232","resolution":{"observed_at":"2026-08-07T13:49:12.573358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15027","last_updated":"2025-04-21T11:26:02Z","snapshot_observed_at":"2026-08-16T18:50:55.186442Z","submitted_at":"2025-04-21T11:26:02Z","title":"DistilQwen2.5: Industrial Practices of Training Distilled Open Lightweight Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15027","snapshot_observed_at":"2026-08-07T13:49:12.683332Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.683332Z"},"links":{"cited_paper":"/paper/2504.15027","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b850381581ed6678d3234469464a9c4b1ad57e74ac82d844f81276191670e22f","observation_id":"35b5faeb-9949-487f-a486-51f21beaea05","resolution":{"observed_at":"2026-08-07T13:49:12.683332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.417275Z","title":"Chi, Quoc V","venue":null,"work_id":"d2524da2-c425-480e-8017-66a6ce9a04ad","year":2022},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.836869Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:29d65ff86130a147f97e31660936b2539ec1c9dd86f089d321af37a09ff3db1a","observation_id":"b9739006-5b91-4e72-b1bc-506ed69cd7f9","resolution":{"observed_at":"2026-08-07T13:49:16.481426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.252374Z","title":null,"venue":null,"work_id":"8468a842-e5fa-4d6c-969f-b6456f07df67","year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.956291Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:c0264a34c56b8caff43858fbc8c45c2f9fd5a00f0baae725a3faca35bd6f8a22","observation_id":"674397f2-cf8d-4c36-a775-34275ff0d1a1","resolution":{"observed_at":"2026-08-07T13:49:16.357067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-10T17:26:33.432994Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-07T13:49:13.090649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.090649Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:95c5383cf871cb5a09536392debbb8696e99129d37145103f7a6cd1b0dcab9f9","observation_id":"54ff02cb-bbb5-474f-93c7-ff766aaa3c3b","resolution":{"observed_at":"2026-08-07T13:49:13.090649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:13.241749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.241749Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b5417f09131f24fd30e27ed9b56f66980b2d29f31f7928893f6229e1dbc9190f","observation_id":"27352e52-d305-4679-b675-35efd21778b1","resolution":{"observed_at":"2026-08-07T13:49:13.241749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T13:49:13.426600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.426600Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:cc85cfd6db914eda2684154e2c549997723bf22ff93376059413711df5cff6a5","observation_id":"f70c3008-71eb-4d6e-b1ba-fab0347f83c1","resolution":{"observed_at":"2026-08-07T13:49:13.426600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:49:13.553692Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.553692Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:a1cc8c4ab3071db0bf4df6241f2d33a6f1fce2b46a8955cd39772f7e764cd0e2","observation_id":"49ddbf71-4d46-4609-a95e-5e4759d5f5fd","resolution":{"observed_at":"2026-08-07T13:49:13.553692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01885","last_updated":"2024-07-02T02:14:42Z","snapshot_observed_at":"2026-08-17T01:31:47.991489Z","submitted_at":"2024-07-02T02:14:42Z","title":"Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01885","snapshot_observed_at":"2026-08-07T13:49:13.665992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.665992Z"},"links":{"cited_paper":"/paper/2407.01885","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:a7d5685c723a4fbc28f4959f2ef2bbccee00ae430b6a8b57ba2ef2005b809e64","observation_id":"db07e64c-29b4-46d0-a1af-2158d955cfe2","resolution":{"observed_at":"2026-08-07T13:49:13.665992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.071400Z","title":null,"venue":null,"work_id":"e5bc91e1-f46e-4714-beed-ba4b320b9cdd","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.836889Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:80761b3697e0ba3b22c3ccd56f742ad11f7c5cae500c93ba847b087f1c1540f3","observation_id":"580a2874-3e12-42f8-a6b0-3ef4c55fe26c","resolution":{"observed_at":"2026-08-07T13:49:16.169548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:13.973173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.973173Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:818898c1427ced9cb567a312e31503a25d70424f5d90e5a5355cbe86268bf83f","observation_id":"228b6563-f4f5-40bc-9200-a35b7d1767d1","resolution":{"observed_at":"2026-08-07T13:49:13.973173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04871","last_updated":"2024-12-06T09:04:12Z","snapshot_observed_at":"2026-08-15T11:31:04.285108Z","submitted_at":"2024-12-06T09:04:12Z","title":"Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the Cloud","version":1},"cited_work":{"arxiv_id":"2412.04871","doi":"10.48550/arxiv.2412.04871","metadata_source":"pith","pith_arxiv_id":"2412.04871","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the Cloud","venue":"cs.CL","work_id":"d263ea62-9986-4c92-8d08-1a202781a63e","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.094188Z"},"links":{"cited_paper":"/paper/2412.04871","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:24283ab7fd3da70b2f81eacada8a2ad9aa8c15accb2bba9e155b62f2b13d5529","observation_id":"1b274687-4f42-416a-b883-8476e822b0f9","resolution":{"observed_at":"2026-08-07T13:49:15.072251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:15.776333Z","title":null,"venue":null,"work_id":"a4fe14a0-7f2a-40b1-a501-7c49a014be02","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.300830Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:344930298e2cb90122eceeef37f7b1e2cf495485fa4a89d058db49abd863670b","observation_id":"c1262863-ead0-402f-b1a9-6565640fcc69","resolution":{"observed_at":"2026-08-07T13:49:15.882474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T13:49:14.435037Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.435037Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b8bc791b252d7dc9ca997def7cf56b799b6658d2af86bd9a97b76bce04310f47","observation_id":"045922c6-59f8-45f6-a405-8785e5df4693","resolution":{"observed_at":"2026-08-07T13:49:14.435037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:14.619474Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.619474Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:758112c992248a9ab9e1d6f9b6d03645774a9aa86c53cb1cebe7c1a3880db701","observation_id":"c3c5d5a9-bc1e-43d7-bcad-247e75da49d0","resolution":{"observed_at":"2026-08-07T13:49:14.619474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:14.772717Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.772717Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:341c5834ff15820a63b385a3b841aa3577f6f8d9512b916965ffc2769206f3cf","observation_id":"8fb392f9-069a-4b04-8839-66996858dcf0","resolution":{"observed_at":"2026-08-07T13:49:14.772717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T16:27:44.273154Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.20888."}