{"as_of":"2026-08-15T21:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d55e1e1062d6931d83ed4b439857d70a45da05964ad7becde3dde376e941f7aa","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:04:03.961067Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T23:28:12.790404Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:33:28.258102Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09104","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Unifying block-wise ptq and distillation-based qat for progressive quantization toward 2-bit instruction-tuned llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-14T22:25:11.633208Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2506.09104","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:e78bf82044e3cbd224720632250496e199ad589b5d242726b9bc6727bbf60c5f","observation_id":"a37eb065-df34-407a-ad1f-1c5b1d403cc9","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"cited_work":{"arxiv_id":"2506.09104","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09104","snapshot_observed_at":"2026-06-29T13:33:28.258102Z","title":"Liu, Z., Zhao, C., Iandola, F., Lai, C., Tian, Y ., Fedorov, I., Xiong, Y ., Chang, E., Shi, Y ., Krishnamoorthi, R., Lai, L., and Chandra, V","venue":null,"work_id":"057c7fa0-c600-40c3-ba46-e34b8a7c1e83","year":null},"citing_paper":{"arxiv_id":"2605.29128","last_updated":"2026-06-10T11:06:20Z","snapshot_observed_at":"2026-08-15T00:42:50.850751Z","submitted_at":"2026-05-27T21:40:10Z","title":"Apertus LLM Family Expansion via Distillation and Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T13:27:47.476242Z"},"links":{"cited_paper":"/paper/2506.09104","citing_paper":"/paper/2605.29128"},"observation_digest":"sha256:e50552bace1679a6bdb339b4c44ea2d19540d9166c138e35a8a97f8358aaa473","observation_id":"f89623b7-ee66-4c66-9230-e0a86ebf87bd","resolution":{"observed_at":"2026-06-29T13:33:28.259669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09104/citation-record","integrity":"/paper/2506.09104/integrity","json":"/paper/2506.09104/citation-record.json","paper":"/paper/2506.09104"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:02.768971Z","title":"Paretoq: Scaling laws in extremely low-bit llm quantization, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.768971Z"},"links":{"citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:e770fd67d0f9962f2b7d64c71d11945469cb097585d734fbf1f663e1a8222a04","observation_id":"21764a78-b4eb-47e1-b8d1-ce16dd3bed6c","resolution":{"observed_at":"2026-08-07T05:04:02.768971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-13T04:08:26.839552Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-07T05:04:02.889275Z","title":"Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, and Ping Luo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.889275Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:904c9a43c1e379bbb179e6384cb416acad01afeb07eb06df2d576b9857cb8be0","observation_id":"8c4cb3a6-46e1-4183-bac2-86cdaabd1031","resolution":{"observed_at":"2026-08-07T05:04:02.889275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-13T11:30:33.812255Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T05:04:03.029383Z","title":"Jianping Gou, Baosheng Yu, Stephen J Maybank, and Dacheng Tao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.029383Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:686ab8dcb68be19ffe2d2212fa66dd186a72adcf14674f4bc88151b1795cfc2e","observation_id":"87080d35-f0c3-421d-aa94-a84a33b5ce14","resolution":{"observed_at":"2026-08-07T05:04:03.029383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03898","last_updated":"2024-07-03T04:57:41Z","snapshot_observed_at":"2026-08-14T16:35:56.358724Z","submitted_at":"2024-02-06T11:10:35Z","title":"DistiLLM: Towards Streamlined Distillation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03898","snapshot_observed_at":"2026-08-07T05:04:03.157167Z","title":"Alexander Lin, Jeremy Wohlwend, Howard Chen, and Tao Lei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.157167Z"},"links":{"cited_paper":"/paper/2402.03898","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:6f156ac70e3a941e0e991fe85473a24d70d2d8fc15a1c4ff4e324dfbdaea06c9","observation_id":"8e479b64-4769-4745-8936-23e0b4357318","resolution":{"observed_at":"2026-08-07T05:04:03.157167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10631","last_updated":"2024-02-16T12:27:15Z","snapshot_observed_at":"2026-08-13T04:17:38.154945Z","submitted_at":"2024-02-16T12:27:15Z","title":"BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10631","snapshot_observed_at":"2026-08-07T05:04:03.290534Z","title":"Bitdistiller: Unleashing the potential of sub-4-bit llms via self-distillation.arXiv preprint arXiv:2402.10631,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.290534Z"},"links":{"cited_paper":"/paper/2402.10631","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:3d861b04a4e6e25fb59c65c36e25dbd70d29732ee1be6d6e11f10194b9ec4d3e","observation_id":"fd29aa23-4d4d-4923-ac68-3e36efdde6b6","resolution":{"observed_at":"2026-08-07T05:04:03.290534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05516","last_updated":"2024-10-08T02:02:35Z","snapshot_observed_at":"2026-08-14T07:24:19.123306Z","submitted_at":"2023-09-11T14:58:23Z","title":"Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05516","snapshot_observed_at":"2026-08-07T05:04:03.353964Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.353964Z"},"links":{"cited_paper":"/paper/2309.05516","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:86863ed86bf565f642b653c859ba02f820c30903770e1ce09737bbb4fae7c32f","observation_id":"ea7a7258-9f9b-4821-b58d-3b2a190050b8","resolution":{"observed_at":"2026-08-07T05:04:03.353964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:04:03.408635Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.408635Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:649851a967d234d4f100d08c41793626012442a2f34e179a32de6f3bc5738829","observation_id":"3a60f12e-39ee-4ef5-8bf1-2a97c447cfb6","resolution":{"observed_at":"2026-08-07T05:04:03.408635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-07T05:04:03.563789Z","title":"Anton Lozhkov, Loubna Ben Allal, Leandro von Werra, and Thomas Wolf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.563789Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:d704be5377ad628d765862e51f6561d59003bd394bbf37647b03f03af944f79a","observation_id":"d16d2e05-dc17-4e7e-afc3-1719d2005b6e","resolution":{"observed_at":"2026-08-07T05:04:03.563789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.737130Z","title":"Elias Frantar, Saleh Ashkboos, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.737130Z"},"links":{"citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:8bf374b18a4d2754561cf0420f989eead6e2a2d5aeae226b7ccc0563bbef35eb","observation_id":"07f79d10-4c5c-4fd6-9026-00fa5c75fbbf","resolution":{"observed_at":"2026-08-07T05:04:03.737130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05397","last_updated":"2023-02-10T17:47:54Z","snapshot_observed_at":"2026-08-14T17:37:46.130648Z","submitted_at":"2023-02-10T17:47:54Z","title":"A Practical Mixed Precision Algorithm for Post-Training Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05397","snapshot_observed_at":"2026-08-07T05:04:03.801268Z","title":"A practical mixed precision algorithm for post-training quantization.arXiv preprint arXiv:2302.05397,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.801268Z"},"links":{"cited_paper":"/paper/2302.05397","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:40861cf7e90f1102ece785b901f1c465907e1af0d75bd3f5aa0e1534da5287d8","observation_id":"4c4e4d04-5021-47de-b862-c01e66c963de","resolution":{"observed_at":"2026-08-07T05:04:03.801268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-07T05:04:03.858593Z","title":"AWQ: Activation-aware weight quantization for llm compression and acceleration.arXiv preprint arXiv:2306.00978,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.858593Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:ce0ce5f0b67b5776538dec2894d2b8b7fb94dd9140960cdca307446aeda34216","observation_id":"35e5ee0c-d156-4529-be51-ea568a4697ae","resolution":{"observed_at":"2026-08-07T05:04:03.858593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-13T11:24:04.469181Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-07T05:04:03.905843Z","title":"SpQR: A sparse-quantized representation for near-lossless llm weight compression.arXiv preprint arXiv:2306.03078, 2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.905843Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:0f8140f29080e7f9c694090f837189e244391414d5d9259a5eb21546a7c79dca","observation_id":"fea0784d-eb2d-47e7-b56c-067165aa9c26","resolution":{"observed_at":"2026-08-07T05:04:03.905843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:04.490982Z","title":null,"venue":null,"work_id":"59f56220-b5a6-4ee5-ad3f-1e0a10fcf9a0","year":2020},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.961067Z"},"links":{"citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:1119f21dc19381a26548f64a2c4b4051b23f97a90c1554b41d80b20611ffc2b8","observation_id":"fb904247-fbb2-49d0-99c1-9eaac1453974","resolution":{"observed_at":"2026-08-07T05:04:04.513967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T05:04:03.637756Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge.arXiv:1803.05457v1,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.637756Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:426232c5cd0f6e76cd7312f11c36227ccb26ddd6fa014ea99907eac0752891c5","observation_id":"e30bb9b0-cc2f-4e27-b647-e26ed7790c2b","resolution":{"observed_at":"2026-08-07T05:04:03.637756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-14T04:48:01.875703Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-07T05:04:03.689898Z","title":"Winogrande: An adversarial winograd schema challenge at scale.arXiv preprint arXiv:1907.10641,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.689898Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:56dae28098eb9b18dd98a59f65d615c54eab9504828e2caa5034e631e1ecd49b","observation_id":"9587349f-bf95-48ff-98dc-0462929cb415","resolution":{"observed_at":"2026-08-07T05:04:03.689898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.239711Z","title":"doi: 10.18653/v1/2020.emnlp-main.494","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.239711Z"},"links":{"citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:fc08cd36f8fdbd406e3068c3a8f582e0e340e42c0310fb8c5b5c247cb0fbc81c","observation_id":"e385ac98-30e5-4afb-b474-7c28198c8c49","resolution":{"observed_at":"2026-08-07T05:04:03.239711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12273","last_updated":"2023-03-21T10:31:46Z","snapshot_observed_at":"2026-08-15T18:44:56.565416Z","submitted_at":"2021-11-24T05:16:41Z","title":"Sharpness-aware Quantization for Deep Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12273","snapshot_observed_at":"2026-08-07T05:04:02.956190Z","title":"Sharpness-aware quantization for deep neural networks.arXiv preprint arXiv:2111.12273,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.956190Z"},"links":{"cited_paper":"/paper/2111.12273","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:743579dadd64ea26d930fa0230738e5223077df8c43acd8c20d2209107a87102","observation_id":"c180ca09-9f15-48a2-b7ec-15c3a2e27e4e","resolution":{"observed_at":"2026-08-07T05:04:02.956190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-08-14T16:16:21.567225Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-07T05:04:02.811644Z","title":"Erik Johannes Husom, Arda Goknil, Merve Astekin, Lwin Khin Shar, Andre Kåsen, Sagar Sen, Benedikt Andreas Mithassel, and Ahmet Soylu","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.811644Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:9d721175ca98ff0665389c973216f8ab5d714630a4d43cf81bd45bede574190a","observation_id":"05946ffe-d495-459e-abf9-48c568fa523b","resolution":{"observed_at":"2026-08-07T05:04:02.811644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13649","last_updated":"2024-01-17T03:23:23Z","snapshot_observed_at":"2026-08-14T23:15:54.149500Z","submitted_at":"2023-06-23T17:56:26Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13649","snapshot_observed_at":"2026-08-07T05:04:03.098057Z","title":"10 Jongwoo Ko, Sungnyun Kim, Tianyi Chen, and Se-Young Yun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.098057Z"},"links":{"cited_paper":"/paper/2306.13649","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:137d7a1f7bace1a7f5760e91717a231a32d5771c7f1951c7cb3bc98ce75f9d5d","observation_id":"ab2c83ec-7cc4-4bd6-b8aa-0fcee475aed7","resolution":{"observed_at":"2026-08-07T05:04:03.098057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-14T05:03:05.661970Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T05:04:03.467515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.467515Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:0a3b67a01dc5e7adf75de3a0ea7b7e6146fa2bc062aab8b0ee27ebc6c0610c1c","observation_id":"6b5bce84-5d51-42b6-9aa0-c786512bb809","resolution":{"observed_at":"2026-08-07T05:04:03.467515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T19:33:50.076518Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 2 inbound Pith citation observations for arXiv:2506.09104."}