{"as_of":"2026-08-14T14:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:588c72653bc7b2eb4c5db26ab430868cb59d5ebfb7739c90518a3531aee24943","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:35:26.848054Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.07902/citation-record","integrity":"/paper/2412.07902/integrity","json":"/paper/2412.07902/citation-record.json","paper":"/paper/2412.07902"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-11T18:35:26.772510Z","title":"Phi-3 technical re- port: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.772510Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:88f1c9c9c7bb41b2ef401c4e2ac7d08ca869eb072ccc3bfcb44b799e2ab28b09","observation_id":"72d33dfa-2a35-42bc-bf32-12f393fc2bad","resolution":{"observed_at":"2026-08-11T18:35:26.772510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06118","last_updated":"2024-09-11T07:48:26Z","snapshot_observed_at":"2026-08-13T04:44:21.410224Z","submitted_at":"2024-01-11T18:54:44Z","title":"Extreme Compression of Large Language Models via Additive Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06118","snapshot_observed_at":"2026-08-11T18:35:26.789525Z","title":"Extreme compression of large language models via additive quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.789525Z"},"links":{"cited_paper":"/paper/2401.06118","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:6a9f7340d6102935d1103282fe03c9a27e3a64a786a6adcd97b008095cb7b3f4","observation_id":"20f13938-82ce-4053-8cf0-3c3ab6c6a76f","resolution":{"observed_at":"2026-08-11T18:35:26.789525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-11T18:35:26.793415Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.793415Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:e15cd40fd5d0862a18e0a197b78249ea87aea44077063a2db0d06eba1915faa0","observation_id":"ef960fe3-a8a9-4a34-91b0-db14b621e80c","resolution":{"observed_at":"2026-08-11T18:35:26.793415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T18:35:26.797562Z","title":"Edward J Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.797562Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:e4ee3831ce622a0494f545bbe5e02b2fdc1efd4d37138c2796e8e0c36422c4a8","observation_id":"f90c99ab-dc88-489e-b902-cee0e0400f56","resolution":{"observed_at":"2026-08-11T18:35:26.797562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-13T07:43:17.158479Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-11T18:35:26.804829Z","title":"Gear: An efficient kv cache compression recipefor near-lossless generative inference of llm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.804829Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:69d98da4c4907ed1dba070487e0ff64040fea7e5a6b4af37e44b68d8557fdfc1","observation_id":"4bfc02b8-2457-4587-bdeb-4c0b0f90e1c1","resolution":{"observed_at":"2026-08-11T18:35:26.804829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-11T18:35:26.808479Z","title":"Spinquant–llm quantization with learned rotations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.808479Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:b66bcec56bb007d4a8114ed5d8c21aef3b188d9b69124d540d41c9a02cf48740","observation_id":"9ef47f3d-bd8d-427d-9d6b-35d7cf9600d0","resolution":{"observed_at":"2026-08-11T18:35:26.808479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18886","last_updated":"2024-11-03T20:25:29Z","snapshot_observed_at":"2026-08-12T23:55:24.099954Z","submitted_at":"2024-05-29T08:42:30Z","title":"Compressing Large Language Models using Low Rank and Low Precision Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18886","snapshot_observed_at":"2026-08-11T18:35:26.812498Z","title":"Compress- ing large language models using low rank and low precision decomposition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.812498Z"},"links":{"cited_paper":"/paper/2405.18886","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:ed9dab6da5b06093f66e5bdd7256b62d90c2e2467efd03995991bd07fb70f48c","observation_id":"72936bd6-9e74-44a5-a39e-41b7cd4c47e2","resolution":{"observed_at":"2026-08-11T18:35:26.812498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-13T10:27:58.003650Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-11T18:35:26.816591Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.816591Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:3feaeb9c064a9958c3a3499a80b8ffbd4682ffdd16ae3ec63a33b1a9020c429c","observation_id":"1b9592b8-aedb-4976-9e95-2f7937f4d389","resolution":{"observed_at":"2026-08-11T18:35:26.816591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-08-13T04:24:47.509375Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-11T18:35:26.820572Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.820572Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:482c3f66f1e94038e92b0b9333305d6bc405c340705c9c9cd0be952dbea56d40","observation_id":"ece6ac9f-a26a-4754-8d2f-c35e67c3dbb9","resolution":{"observed_at":"2026-08-11T18:35:26.820572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15319","last_updated":"2025-06-03T09:22:07Z","snapshot_observed_at":"2026-08-13T04:12:07.303824Z","submitted_at":"2024-02-23T13:39:16Z","title":"GPTVQ: The Blessing of Dimensionality for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15319","snapshot_observed_at":"2026-08-11T18:35:26.824394Z","title":"Gptvq: The blessing of dimensionality for llm quan- tization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.824394Z"},"links":{"cited_paper":"/paper/2402.15319","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:a1eed0c6a0f3c242fa38686c5ef86133529ac5c14de90e52af1b5e346fc21cc5","observation_id":"c644b77a-4827-4cdd-9444-e519385911c6","resolution":{"observed_at":"2026-08-11T18:35:26.824394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12017","last_updated":"2023-05-30T21:32:11Z","snapshot_observed_at":"2026-08-13T12:56:11.833859Z","submitted_at":"2023-01-27T22:44:18Z","title":"Understanding INT4 Quantization for Transformer Models: Latency Speedup, Composability, and Failure Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12017","snapshot_observed_at":"2026-08-11T18:35:26.828027Z","title":"Understanding int4 quantization for transformer models: Latency speedup, composability, and failure cases","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.828027Z"},"links":{"cited_paper":"/paper/2301.12017","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:d9af95a4282e0050d2c2ee96e58a87e1113fb3f6cd0a4904e1364888ccfa35fd","observation_id":"71fa8a05-7fc1-4b56-8aef-983fb2a79924","resolution":{"observed_at":"2026-08-11T18:35:26.828027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02446","last_updated":"2024-05-30T09:49:47Z","snapshot_observed_at":"2026-08-13T04:27:25.852604Z","submitted_at":"2024-02-04T10:59:52Z","title":"LQER: Low-Rank Quantization Error Reconstruction for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02446","snapshot_observed_at":"2026-08-11T18:35:26.831837Z","title":"Lqer: Low-rank quantiza- tion error reconstruction for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.831837Z"},"links":{"cited_paper":"/paper/2402.02446","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:d42be3bb06f3792dec6545f609911f5234a6d199c0082e0025ca8cb3cee53841","observation_id":"6a4966be-da35-4e5f-86cf-3b4b737d178f","resolution":{"observed_at":"2026-08-11T18:35:26.831837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:35:27.048782Z","title":"The GPTQ algorithm, introduced by Frantar et al","venue":null,"work_id":"c027e1f9-6434-48c6-a6c1-526d9bffa921","year":2022},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.836179Z"},"links":{"citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:dfdbf9fe72e31d5cb5958e2703ed2d349e715968e0fd1ef591656e46b8629ec7","observation_id":"fa21f0f8-c6db-4761-944a-c74f65c9f318","resolution":{"observed_at":"2026-08-11T18:35:27.053050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:35:27.036571Z","title":null,"venue":null,"work_id":"4b1fb77d-1be7-49a9-8f73-b314ae4df997","year":1989},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.840147Z"},"links":{"citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:447892b0b1b857b4d416c2ff3c254f0d706bcbe47297b51d944c4fbb45367597","observation_id":"9be4c095-a750-4da2-8d3b-ec1183f8c514","resolution":{"observed_at":"2026-08-11T18:35:27.040053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:35:27.026217Z","title":null,"venue":null,"work_id":"8fdcedd7-8cbc-48ae-a593-55dd028c2aa2","year":2022},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.844172Z"},"links":{"citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:89e4b017090e36a7edb7e69dac1e4ec48668f8b240e66fd4935773d324954fd6","observation_id":"ba60e19f-ebd9-438b-aec7-f243b13b8301","resolution":{"observed_at":"2026-08-11T18:35:27.029799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:35:27.014473Z","title":null,"venue":null,"work_id":"eda19bf1-ecf8-448a-862e-dfce05823091","year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.848054Z"},"links":{"citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:13c3843221e4270f481fb9be3c23ffaf7aab4733feca2a0bf3775ed8cd0b7e26","observation_id":"2855cfcf-ce45-41f0-aa98-9e6bf1709869","resolution":{"observed_at":"2026-08-11T18:35:27.018798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T18:35:26.801147Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.801147Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:23d81cb570eed7b4721a1bd8826c05beedaa1c0047151b0d6a0549694f8e397f","observation_id":"4de12c51-e102-447c-b99d-31ca80acb50b","resolution":{"observed_at":"2026-08-11T18:35:26.801147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-11T18:35:26.785601Z","title":"Qlora: efficient finetuning of quantized llms (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.785601Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:a9fd26e179697f9fbc0fa045d63a19e1fc28b2887d45a1917d5c79d5feeb8e3a","observation_id":"cda7acf4-402a-42f5-8874-0a0041ce6a45","resolution":{"observed_at":"2026-08-11T18:35:26.785601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-11T18:35:26.781280Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.781280Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:6b11001ecad3e16e5df757c3fa7f93df4ca554f469bba00d245d15869919a5d4","observation_id":"2673f3ab-f389-44f2-94db-4ca8ba7c61b6","resolution":{"observed_at":"2026-08-11T18:35:26.781280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09259","last_updated":"2023-11-02T14:26:57Z","snapshot_observed_at":"2026-08-13T05:49:41.188471Z","submitted_at":"2023-10-13T17:15:05Z","title":"QUIK: Towards End-to-End 4-Bit Inference on Generative Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09259","snapshot_observed_at":"2026-08-11T18:35:26.777094Z","title":"Towards end-to-end 4-bit inference on generative large language mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T18:35:26.777094Z"},"links":{"cited_paper":"/paper/2310.09259","citing_paper":"/paper/2412.07902"},"observation_digest":"sha256:5a0e5f2b3d23871845df4032c5eb4c3f533609d5685a4e04614bc070ec3f6438","observation_id":"245071c1-190e-4867-bc00-ea9f6481d4c4","resolution":{"observed_at":"2026-08-11T18:35:26.777094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.07902","last_updated":"2024-12-10T20:17:46Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-14T06:48:28.568891Z","submitted_at":"2024-12-10T20:17:46Z","title":"Low-Rank Correction for Quantized LLMs"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2412.07902."}