{"as_of":"2026-08-21T09:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3466739d51cfb8ee27584d3214291b11e19556e1c3e9fe6c47f48b25a01eeb7","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:58:05.780042Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.02390/citation-record","integrity":"/paper/2505.02390/integrity","json":"/paper/2505.02390/citation-record.json","paper":"/paper/2505.02390"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:58:05.714556Z","title":"Quantizing large language models for code generation: A differentiated replication.arXiv preprint arXiv:2503.07103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.714556Z"},"links":{"citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:2a6b77d0ab619e6ba016cd091001036dd29e5f712272114d398d338cf7a7fb23","observation_id":"5bbb9778-5baf-4105-9d73-fb0178f9957b","resolution":{"observed_at":"2026-08-16T00:58:05.714556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-16T00:58:05.721821Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.721821Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:d1e6851db0c107b1767781c55690a3e9c16e6c0347c71858d97ef314609c03eb","observation_id":"817875ce-71b9-4c13-aa02-673a7fcacbec","resolution":{"observed_at":"2026-08-16T00:58:05.721821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-16T00:58:05.729259Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson?arXiv preprint arXiv:2411.16489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.729259Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:cb027ee1f609c03339c63d27a6554b0b57290eeb4d771252f2f0a349ef6ee973","observation_id":"8dc6e9ce-ab5e-4226-9370-90e052f1ec01","resolution":{"observed_at":"2026-08-16T00:58:05.729259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-16T00:58:05.736682Z","title":"Cmmlu: Measuring massive multitask language understanding in chinese.arXiv preprint arXiv:2306.09212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.736682Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:07641f7d1b26960308a01caa6d1b2dde1144b7901401bfb525f5fa707ffde560","observation_id":"0269ec3b-d60a-4060-88d5-208ffb78bce8","resolution":{"observed_at":"2026-08-16T00:58:05.736682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03035","last_updated":"2025-02-24T14:34:37Z","snapshot_observed_at":"2026-08-18T04:44:57.480789Z","submitted_at":"2025-01-06T14:23:02Z","title":"Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03035","snapshot_observed_at":"2026-08-16T00:58:05.740680Z","title":"Quantization meets reasoning: Exploring llm low-bit quantization degradation for mathematical reasoning.arXiv preprint arXiv:2501.03035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.740680Z"},"links":{"cited_paper":"/paper/2501.03035","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:7a3ad8650f9231c32b3b6bc3540e28f8c300f68a57c17164a3135a5ca69531f4","observation_id":"bd96bf3e-0708-43b8-9bfb-51a365d30117","resolution":{"observed_at":"2026-08-16T00:58:05.740680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T00:58:05.744864Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.744864Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:c19876fa1aef32240ca585beb54ddd88102359bad15c623877454f4cde47994d","observation_id":"3a48e3be-ba1f-4652-becd-21ae3e52a2fd","resolution":{"observed_at":"2026-08-16T00:58:05.744864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04823","last_updated":"2025-08-18T16:06:09Z","snapshot_observed_at":"2026-08-19T06:13:34.941911Z","submitted_at":"2025-04-07T08:22:45Z","title":"Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04823","snapshot_observed_at":"2026-08-16T00:58:05.748773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.748773Z"},"links":{"cited_paper":"/paper/2504.04823","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:6057e9fcc43ea358ede0f05e30606185ce995697097f1cc99e7931ebc7601dae","observation_id":"19c9298d-af3a-45b3-a698-afa6518934fa","resolution":{"observed_at":"2026-08-16T00:58:05.748773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-16T15:28:47.324188Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-16T00:58:05.752504Z","title":"Llm-qat: Data-free quantization aware training for large language models.arXiv preprint arXiv:2305.17888, 2023b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.752504Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:ac6f757db32f20fee6871c9b4a23d6fd27565827c2221220f6368c4ece572a6b","observation_id":"0285cd2d-f9bc-4950-b769-19b5c6246a3b","resolution":{"observed_at":"2026-08-16T00:58:05.752504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09413","last_updated":"2024-12-22T10:44:13Z","snapshot_observed_at":"2026-08-16T16:04:15.848709Z","submitted_at":"2024-12-12T16:20:36Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09413","snapshot_observed_at":"2026-08-16T00:58:05.757411Z","title":"Yingqian Min, Zhipeng Chen, Jinhao Jiang, Jie Chen, Jia Deng, Yiwen Hu, Yiru Tang, Jiapeng Wang, Xiaoxue Cheng, Huatong Song, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.757411Z"},"links":{"cited_paper":"/paper/2412.09413","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:f473a53f136c99de889e4ace7a6baba6085b72259a087363f81c0536bc2234fc","observation_id":"e43177fc-723d-433d-ac4f-cf70e4076a88","resolution":{"observed_at":"2026-08-16T00:58:05.757411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14766","last_updated":"2024-10-18T15:50:59Z","snapshot_observed_at":"2026-08-19T14:34:44.640719Z","submitted_at":"2024-10-18T15:50:59Z","title":"Evaluating Quantized Large Language Models for Code Generation on Low-Resource Language Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14766","snapshot_observed_at":"2026-08-16T00:58:05.761744Z","title":"Evaluating quantized large language models for code generation on low-resource language benchmarks.arXiv preprint arXiv:2410.14766,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.761744Z"},"links":{"cited_paper":"/paper/2410.14766","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:090c0a8983f5e4e0ec0b8084850bc58bc6d789cf1289eaa64a38218dcb7104ad","observation_id":"ce4cbaa7-dad7-453b-92f3-522562202359","resolution":{"observed_at":"2026-08-16T00:58:05.761744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-16T00:58:05.765285Z","title":"O1 replication journey: A strategic progress report– part 1.arXiv preprint arXiv:2410.18982,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.765285Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:1da7f3ef260483e5df1860b5be5dc61fccb0b973930a5a2f93db3f3b6d7b5aaf","observation_id":"4d3d3a5a-e09c-4cc0-b5bb-a76acac8de03","resolution":{"observed_at":"2026-08-16T00:58:05.765285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-08-17T23:25:45.947983Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-16T00:58:05.769246Z","title":"Fitnets: Hints for thin deep nets.arXiv preprint arXiv:1412.6550,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.769246Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:cde9e59d6da7108502f2c50c3fd4f51c09a4d27ed9d7b3e2110fdb7f5680747e","observation_id":"b480bc40-1156-4de9-b011-5094d7e8f207","resolution":{"observed_at":"2026-08-16T00:58:05.769246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-10T17:26:33.432994Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-16T00:58:05.776176Z","title":"A survey on knowledge distillation of large language models.arXiv preprint arXiv:2402.13116,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.776176Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:a7297420910c6fa5e72515d58be5fd116e3aa35b45fbeb33b96a91f4fa0a56d8","observation_id":"b1b2299b-b61f-4954-9917-a43ba5954a6d","resolution":{"observed_at":"2026-08-16T00:58:05.776176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07191","last_updated":"2025-07-07T17:42:19Z","snapshot_observed_at":"2026-08-20T01:56:28.448609Z","submitted_at":"2024-11-11T18:05:48Z","title":"The Super Weight in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07191","snapshot_observed_at":"2026-08-16T00:58:05.780042Z","title":"The super weight in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.780042Z"},"links":{"cited_paper":"/paper/2411.07191","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:eb4882ce90fef64c30c4f06a87cad2c2d7e372b191093601a22144f588f283c0","observation_id":"29400ce5-6842-4e26-bf0d-eaea1c37eb0c","resolution":{"observed_at":"2026-08-16T00:58:05.780042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10787","last_updated":"2025-07-01T19:43:45Z","snapshot_observed_at":"2026-08-19T14:26:14.477337Z","submitted_at":"2024-02-16T16:10:38Z","title":"Squat: Quant Small Language Models on the Edge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10787","snapshot_observed_at":"2026-08-16T00:58:05.772644Z","title":"Edgeqat: Entropy and distribution guided quantization-aware training for the acceleration of lightweight llms on the edge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.772644Z"},"links":{"cited_paper":"/paper/2402.10787","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:f322923c2f8450558727aef76a2412966f99c7b2afd12d2e2c2951dd6ad0d83e","observation_id":"c0bddfc8-cc08-4428-8db2-e9aa81309639","resolution":{"observed_at":"2026-08-16T00:58:05.772644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-16T00:58:05.710709Z","title":"Technical Report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.710709Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:7cf8502b179e16a7463c462eaffacb71f98759f3b11c9f62d5959c9582ba548d","observation_id":"99880d46-17b4-4628-979c-aa9520697e65","resolution":{"observed_at":"2026-08-16T00:58:05.710709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T00:58:05.725610Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.725610Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:058f1716243e3aed5a1978c45afff8ca2aaf00b1b005d98cebbbabf2cd834aa5","observation_id":"4ac69644-a7d9-4c49-80fc-a99e04499971","resolution":{"observed_at":"2026-08-16T00:58:05.725610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-19T14:44:54.976757Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-16T00:58:05.702278Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression.arXiv preprint arXiv:2306.03078,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.702278Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:0cad1985dc5676bb594bf960a2b5ea71e46504012b46d6b496b22d9db7c5fec9","observation_id":"ffc80b7e-481d-41c5-86ac-cefe0ecd4444","resolution":{"observed_at":"2026-08-16T00:58:05.702278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-18T09:17:55.370547Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-16T00:58:05.706580Z","title":"Learned step size quantization.arXiv preprint arXiv:1902.08153,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.706580Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:aebfc7b6501416e601f2cbf59443eeb4c8f7db7f5c9b34b78dd3f7a003ddb860","observation_id":"491d907c-098e-48b1-ac26-32ef3eb75521","resolution":{"observed_at":"2026-08-16T00:58:05.706580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-16T00:58:05.733012Z","title":"Livecodebench: Holistic and contami- nation free evaluation of large language models for code.arXiv preprint arXiv:2403.07974,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.733012Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:3a748695075782389846665b05e1df534ad6ad410cef7bcbc8193a5cca29d4d0","observation_id":"99950d22-5eee-4fa9-b360-1945e5c81192","resolution":{"observed_at":"2026-08-16T00:58:05.733012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T00:58:05.718306Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.718306Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:fa956a7585dd676ee49c659f29325ebfc6ec6cc6a4f361d3a15455bc65022436","observation_id":"379d6965-b7e9-42e7-998a-783a449ae326","resolution":{"observed_at":"2026-08-16T00:58:05.718306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2505.02390."}