{"as_of":"2026-08-09T10:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:113f2b49750638f87945b82b7b169a9906cfe0a5b6001a2a3405093b11a4021e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":53,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:03:44.677581Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:2f6e1332660595d217d64c065da06def664f05e2badbdc9e14a2ee58ae80c370","observation_id":"28701e4b-a19a-4ee3-8cbf-e3743c6ad444","resolution":{"observed_at":"2026-05-17T20:11:43.597896Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":216,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:2d2d19b60699395cee9caa34def75db7eca4189fbd51eca7873b80fc28327bbf","observation_id":"a9f02f46-12f3-4abb-b454-9281721a0e04","resolution":{"observed_at":"2026-05-15T02:39:33.271712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T19:45:36.337956Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2407.08608"},"observation_digest":"sha256:2e8dd86f368602f81b5ba2ba5c8d3cd6a1944bec4b33fde9d159b857a526fb10","observation_id":"6952bc00-5e45-44c9-bd43-e9a65c78c65e","resolution":{"observed_at":"2026-05-20T19:45:36.456215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T23:03:44.677581Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-08T06:27:18.324531Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.677581Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:8e847e148c46550aa6465a0a2f8df6f08cbdc6abc9bdfd4169320e1652f3c1da","observation_id":"b18d4993-1044-44d9-a6ac-83d11e28ebb1","resolution":{"observed_at":"2026-08-07T23:03:44.677581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T13:30:40.665688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21670","last_updated":"2025-05-27T18:48:40Z","snapshot_observed_at":"2026-08-07T23:42:58.100393Z","submitted_at":"2025-05-27T18:48:40Z","title":"Rethinking the Outlier Distribution in Large Language Models: An In-depth Study","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:40.665688Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2505.21670"},"observation_digest":"sha256:518b4077a91126e7a6e7bbf4fb75a22ab3a91ce19b1155cb48f12473c42e44d7","observation_id":"8f1435f5-aada-4861-9453-291e952d78cf","resolution":{"observed_at":"2026-08-07T13:30:40.665688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T10:43:47.223987Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.223987Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:54e72a8512a4f144730f2a853110290a920b4ce0ea87a6bfcdd33864cfdf041b","observation_id":"abf25eb5-8f0d-4593-965a-6a9964b135d3","resolution":{"observed_at":"2026-08-07T10:43:47.223987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T10:42:41.017031Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05432","last_updated":"2025-06-26T06:17:49Z","snapshot_observed_at":"2026-08-07T10:30:44.169195Z","submitted_at":"2025-06-05T08:58:58Z","title":"PCDVQ: Enhancing Vector Quantization for Large Language Models via Polar Coordinate Decoupling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:42:41.017031Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.05432"},"observation_digest":"sha256:79fd547060c51315587a85c0e9aa7421e4c8fa6d4357d96a28bccb238118bed6","observation_id":"f9803ddb-fe65-4a43-a073-ffdc263e8117","resolution":{"observed_at":"2026-08-07T10:42:41.017031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T14:52:09.141264Z","title":"Mart van Baalen, Andrey Kuzmin, Markus Nagel, Pe- ter Couperus, Cedric Bastoul, Eric Mahurin, Tijmen Blankevoort, and Paul Whatmough","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12038","last_updated":"2025-05-23T03:28:24Z","snapshot_observed_at":"2026-08-07T14:45:04.578692Z","submitted_at":"2025-05-23T03:28:24Z","title":"LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:09.141264Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.12038"},"observation_digest":"sha256:13ab2c20c9a7644b589c3de391071104bb7ac866a7da68ee9f0fd257df45c497","observation_id":"653af550-633e-4c12-99bf-49198969a537","resolution":{"observed_at":"2026-08-07T14:52:09.141264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2506.12040","last_updated":"2026-04-09T06:22:06Z","snapshot_observed_at":"2026-08-02T23:24:15.663595Z","submitted_at":"2025-05-24T03:57:19Z","title":"BTC-LLM: Efficient Sub-1-Bit LLM Quantization via Learnable Transformation and Binary Codebook","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T14:03:35.214840Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.12040"},"observation_digest":"sha256:bd74dc285cb5a20411eeb471b7f795b9b1e0f6380889eca453b8c45dd6d1a405","observation_id":"fa5f84dc-5fa2-48b3-b38d-220288c5e4af","resolution":{"observed_at":"2026-05-19T14:07:20.504672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T14:06:24.880486Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15689","last_updated":"2025-08-29T12:03:45Z","snapshot_observed_at":"2026-08-07T23:43:39.612107Z","submitted_at":"2025-05-26T14:22:21Z","title":"BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:24.880486Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.15689"},"observation_digest":"sha256:12a329623d0552e8aa573b98c50b7f74f0906d6226160ba20cb8fcc852b56947","observation_id":"76718352-586f-4a20-830d-36091d474f31","resolution":{"observed_at":"2026-08-07T14:06:24.880486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-06T19:09:16.104514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07145","last_updated":"2025-07-09T06:04:14Z","snapshot_observed_at":"2026-08-08T02:29:03.615649Z","submitted_at":"2025-07-09T06:04:14Z","title":"CCQ: Convolutional Code for Extreme Low-bit Quantization in LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:09:16.104514Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2507.07145"},"observation_digest":"sha256:081cca88daf9a241532ff20bdd36815d55ee2534eada3cdbdbf0b269c5671d57","observation_id":"844df51a-8dcc-4883-97e2-cff04b4e25a6","resolution":{"observed_at":"2026-08-06T19:09:16.104514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2508.04853","last_updated":"2026-04-09T18:24:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-06T20:00:40Z","title":"Provable Post-Training Quantization: Theoretical Analysis of OPTQ and Qronos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T23:52:06.036879Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2508.04853"},"observation_digest":"sha256:ff7ab1dbda222bd0033f8ff88e5744bcccbbf0edfeb8b768c536194014454671","observation_id":"b468cf42-94a4-4060-b90c-7ff0b58c9d84","resolution":{"observed_at":"2026-05-18T23:52:53.059020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T18:28:19.977137Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice code- books.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05277","last_updated":"2026-06-02T23:07:19Z","snapshot_observed_at":"2026-08-07T00:48:11.221345Z","submitted_at":"2025-12-04T21:57:10Z","title":"From Segments to Scenes: Temporal Understanding for Agentic Autonomous Driving via Vision-Language Models","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T18:28:19.977137Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2512.05277"},"observation_digest":"sha256:c13a06d5d02bf489b0a21f7a1a13f6d6bc7193bec1ff39923d8108a8fe723747","observation_id":"bc2d4450-97ef-4fca-ad2c-fd26dad50cbd","resolution":{"observed_at":"2026-08-03T18:28:19.977137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2601.17187","last_updated":"2026-05-13T16:41:48Z","snapshot_observed_at":"2026-08-06T05:31:02.944877Z","submitted_at":"2026-01-23T21:32:44Z","title":"High-Rate Quantized Matrix Multiplication I","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T11:18:41.456313Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2601.17187"},"observation_digest":"sha256:f65ef2665a1477c20a0b6bcda22d3f62f9721456890fb1b1c2c607bcf4d00a67","observation_id":"334fd9c3-d10f-459a-86ea-b26c2e77af96","resolution":{"observed_at":"2026-05-16T11:20:53.235633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T06:01:15.959552Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00942","last_updated":"2026-05-28T22:25:40Z","snapshot_observed_at":"2026-08-06T17:02:26.888999Z","submitted_at":"2026-02-01T00:00:11Z","title":"SALAAD: Sparse And Low-Rank Adaptation via ADMM for Large Language Model Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T06:01:15.959552Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2602.00942"},"observation_digest":"sha256:40192725046b1f890cf7bf1bfd5cd315c32d402eb679d5fd4df803d07c8a338b","observation_id":"c4b4a7bf-04bf-43f8-9125-e543a17f50a8","resolution":{"observed_at":"2026-08-03T06:01:15.959552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T04:10:43.337679Z","title":"Quip\\#: Even better llm quantization with hadamard incoherence and lattice codebooks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05790","last_updated":"2026-06-15T20:50:08Z","snapshot_observed_at":"2026-08-03T04:10:38.797902Z","submitted_at":"2026-02-05T15:46:53Z","title":"Price of metric universality in vector quantization is at most 0.11 bit","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T04:10:43.337679Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2602.05790"},"observation_digest":"sha256:5b38c921e5338a3a34932f14fa44067898f3dac9a3e36435f3fce8e911c4ba44","observation_id":"29b21c0b-812c-4736-98e7-520c6166b220","resolution":{"observed_at":"2026-08-03T04:10:43.337679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-14T23:10:46.775151Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.11021","last_updated":"2026-07-07T12:10:29Z","snapshot_observed_at":"2026-08-06T14:26:15.552405Z","submitted_at":"2026-03-11T17:48:45Z","title":"Leech Lattice Vector Quantization for Efficient LLM Compression","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T23:10:46.775151Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2603.11021"},"observation_digest":"sha256:091f193dfee507a9f86b9f60ec9e1bf2db8cd35d8956a895b09f99720c166195","observation_id":"5850f303-8b23-4b49-8c14-9523306ebce5","resolution":{"observed_at":"2026-07-14T23:10:46.775151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.07955","last_updated":"2026-04-09T08:20:59Z","snapshot_observed_at":"2026-07-31T08:51:28.505317Z","submitted_at":"2026-04-09T08:20:59Z","title":"Rethinking Residual Errors in Compensation-based LLM Quantization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:10:54.439287Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.07955"},"observation_digest":"sha256:d285a0861f89e88e2296bdb4f2089bc3c53e3c32c1d6431c97c59cd226b04362","observation_id":"979a4726-743f-460c-995d-f138547b3c09","resolution":{"observed_at":"2026-05-11T05:21:01.232262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.17789","last_updated":"2026-04-21T07:37:48Z","snapshot_observed_at":"2026-08-06T01:13:13.579210Z","submitted_at":"2026-04-20T04:27:28Z","title":"DuQuant++: Fine-grained Rotation Enhances Microscaling FP4 Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T05:59:23.738476Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.17789"},"observation_digest":"sha256:b45e672bedc481916a1a346af112e155072967c6ac1616bbd36eb059b55b3415","observation_id":"a82fc49e-4cc3-4433-a214-14351a05f5a7","resolution":{"observed_at":"2026-05-10T06:01:13.345365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T05:29:51.182114Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:078bf7ec9570edee5b331e17b0a79dd6f58cdf282503026abaf46de3e6321108","observation_id":"1c84b740-b831-4017-9c08-7a1429a8d62b","resolution":{"observed_at":"2026-05-10T05:41:02.529038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T18:01:08.514022Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:a75e94a5c3c7ccf79a6a1bc4ee7b003f5e6b32181c882a5af06c9cba26dce2db","observation_id":"ded0d6f2-9429-4b4d-9d74-40da99bc914d","resolution":{"observed_at":"2026-05-19T18:02:42.158526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.19884","last_updated":"2026-04-21T18:03:38Z","snapshot_observed_at":"2026-08-02T02:23:56.450641Z","submitted_at":"2026-04-21T18:03:38Z","title":"From Signal Degradation to Computation Collapse: Uncovering the Two Failure Modes of LLM Quantization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T02:32:50.182859Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.19884"},"observation_digest":"sha256:5dd37270d8388a4ca290b0b0f4b7da6df95fa2f61de05988e3fcd9bef1b0aa0b","observation_id":"7faa9924-73d0-49a2-ab8e-b55ec9c3b411","resolution":{"observed_at":"2026-05-10T02:38:17.179684Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.20682","last_updated":"2026-04-22T15:31:46Z","snapshot_observed_at":"2026-07-06T23:07:14.243878Z","submitted_at":"2026-04-22T15:31:46Z","title":"Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T01:44:42.989053Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.20682"},"observation_digest":"sha256:206b5873f4784b96878768c6ad9c7ff9bf535b71a5b92da12444e4713fb97973","observation_id":"d90fc254-7403-4cc7-9e95-459904760672","resolution":{"observed_at":"2026-05-11T13:26:04.520977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.24273","last_updated":"2026-04-27T10:03:37Z","snapshot_observed_at":"2026-07-06T23:10:20.676482Z","submitted_at":"2026-04-27T10:03:37Z","title":"BitRL: Reinforcement Learning with 1-bit Quantized Language Models for Resource-Constrained Edge Deployment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T04:23:26.079298Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.24273"},"observation_digest":"sha256:6889ae9cc1fee81b0768d89536bc7f99fd6df4c14fd09defe7226a8cb9378074","observation_id":"65084898-a928-49f3-8b7d-d021bd7234ed","resolution":{"observed_at":"2026-05-11T21:46:43.051795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.05699","last_updated":"2026-05-07T05:44:39Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:44:39Z","title":"When Quantization Is Free: An int4 KV Cache That Outruns fp16 on Apple Silicon","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T03:16:00.868964Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.05699"},"observation_digest":"sha256:31f421a200dcb9a714d288700782c3d7c09aba490e5bcf09dc1ccc28e7cafa67","observation_id":"1277e456-2dab-422e-8fe1-41b5f467ee08","resolution":{"observed_at":"2026-05-11T22:11:14.373234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.12464","last_updated":"2026-05-12T17:50:08Z","snapshot_observed_at":"2026-08-02T04:50:55.914032Z","submitted_at":"2026-05-12T17:50:08Z","title":"Search Your Block Floating Point Scales!","version":1},"reference_index":157,"source":"arxiv_source","source_observed_at":"2026-05-13T05:52:26.558984Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.12464"},"observation_digest":"sha256:e15c2e98dfb50b1f48e04ce4c3bf2fffdf623226b9c921b316e057ad7a73c46b","observation_id":"e74c1b17-4971-445f-9e69-2044a2204c1e","resolution":{"observed_at":"2026-05-13T06:02:24.139246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.13768","last_updated":"2026-06-08T15:33:38Z","snapshot_observed_at":"2026-08-01T18:18:03.683548Z","submitted_at":"2026-05-13T16:47:25Z","title":"High-Rate Quantized Matrix Multiplication II","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T19:29:22.250363Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.13768"},"observation_digest":"sha256:f5121e0a0df1fe156090f5df3703c4f8d8c2b351ae41aa0ba1bd2134042d0ba9","observation_id":"fa5e0692-584d-4ebb-a1c8-c1a8e06a9df5","resolution":{"observed_at":"2026-05-14T19:32:52.654039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.13768","last_updated":"2026-06-08T15:33:38Z","snapshot_observed_at":"2026-08-01T18:18:03.683548Z","submitted_at":"2026-05-13T16:47:25Z","title":"High-Rate Quantized Matrix Multiplication II","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T21:25:26.862900Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.13768"},"observation_digest":"sha256:f85a30f241a08f09dabee0ba4f237e2b25b343a04f70510f6ed1abfae7a003d9","observation_id":"8e2d83e8-3f0b-4d30-a204-174f4a9231be","resolution":{"observed_at":"2026-06-30T21:35:04.991846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.14844","last_updated":"2026-05-14T13:52:31Z","snapshot_observed_at":"2026-08-06T09:00:02.069223Z","submitted_at":"2026-05-14T13:52:31Z","title":"XFP: Quality-Targeted Adaptive Codebook Quantization with Sparse Outlier Separation for LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-30T21:28:36.358474Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.14844"},"observation_digest":"sha256:1c11ccf88744ed9a8a975f7df0e937e5a28f1b964299c9bb36a6020351f3ec8e","observation_id":"69e0ff21-96d9-40f6-a763-1e2993afd757","resolution":{"observed_at":"2026-06-30T21:35:04.699300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.18475","last_updated":"2026-05-18T14:30:58Z","snapshot_observed_at":"2026-08-04T01:21:32.686727Z","submitted_at":"2026-05-18T14:30:58Z","title":"GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:39.417436Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.18475"},"observation_digest":"sha256:e37ace23d09afef6787ae375d7de8a26b16b8c91fe234b1f46b9eed792408570","observation_id":"7afb0a30-8a77-4ba0-ba68-76932eac5c88","resolution":{"observed_at":"2026-05-20T12:28:16.800354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.18800","last_updated":"2026-05-11T10:51:40Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-11T10:51:40Z","title":"Theory-optimal Quantization Based on Flatness","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T22:38:06.888665Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.18800"},"observation_digest":"sha256:76d25420d5f19b5c546caf391c1e526567cadbd4f318a7b7809e7c74157e0a11","observation_id":"5c711e35-6b5a-40c7-aeaa-e3055fc33baa","resolution":{"observed_at":"2026-05-20T22:39:10.010380Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.20706","last_updated":"2026-05-20T05:05:10Z","snapshot_observed_at":"2026-08-02T06:31:23.188753Z","submitted_at":"2026-05-20T05:05:10Z","title":"Llamas on the Web: Memory-Efficient, Performance-Portable, and Multi-Precision LLM Inference with WebGPU","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-21T02:52:40.923230Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.20706"},"observation_digest":"sha256:5c25457d90f855af23960410e6950c6574aa6f29229b44ad10019a9251b3ee5a","observation_id":"66a62db8-dd20-40f8-84a5-1e764908bff2","resolution":{"observed_at":"2026-05-21T02:53:55.288364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.23078","last_updated":"2026-05-21T22:23:38Z","snapshot_observed_at":"2026-08-02T10:30:48.658412Z","submitted_at":"2026-05-21T22:23:38Z","title":"GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T05:33:06.719954Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.23078"},"observation_digest":"sha256:cc3169c2d75c2b2b81076ded26969a371e250988343dc99d6a32e34541269ebd","observation_id":"9a056b76-2bae-4243-beaf-d2045c7cc745","resolution":{"observed_at":"2026-05-25T05:36:39.854470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.24019","last_updated":"2026-05-20T06:11:25Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-20T06:11:25Z","title":"MGVQ: Synergizing Multi-dimensional Sensitivity-Aware and Gradient-Hessian Fusion for Vector Quantization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T17:36:45.807397Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.24019"},"observation_digest":"sha256:35d712366530e5f40c4ecbf2b9f96d147b0f4fde936d818d3f9254944a6c696a","observation_id":"a922941e-80d6-4ce0-b902-4094c5e34ef0","resolution":{"observed_at":"2026-07-01T15:05:48.338378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.24144","last_updated":"2026-05-22T19:06:22Z","snapshot_observed_at":"2026-07-06T23:34:13.859813Z","submitted_at":"2026-05-22T19:06:22Z","title":"EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-30T14:35:02.484377Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.24144"},"observation_digest":"sha256:308a00c7e6eca2dc0f688cc892661613a58c82666aaa4757ffd7388d6b42c9e5","observation_id":"a829676f-80bb-44d5-9680-467e235be0fc","resolution":{"observed_at":"2026-06-30T14:44:45.610682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.25203","last_updated":"2026-05-24T18:05:37Z","snapshot_observed_at":"2026-08-04T10:11:25.132076Z","submitted_at":"2026-05-24T18:05:37Z","title":"Influence-Inspired Spectral Rotations for Extreme Low-Bit LLM Quantization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T12:13:18.805668Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.25203"},"observation_digest":"sha256:c54c567f2c4f00dc37a85535f253fa7c14e019852454aaccd08a5203ddd97a2a","observation_id":"c625abbc-a448-4950-a656-559e37105655","resolution":{"observed_at":"2026-06-30T12:14:39.052951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00206","last_updated":"2026-05-29T18:00:00Z","snapshot_observed_at":"2026-08-01T20:12:00.914542Z","submitted_at":"2026-05-29T18:00:00Z","title":"Quantized Reasoning Models Think They Need to Think Longer, but They Do Not","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T23:05:00.401365Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00206"},"observation_digest":"sha256:802c0adaace32f83b9ae65fad8225f37bca3c9713a32b87fb705a044bdcab236","observation_id":"66a62b39-59be-4d24-821d-bb8eb1562754","resolution":{"observed_at":"2026-07-01T19:16:00.108641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00535","last_updated":"2026-05-30T05:05:24Z","snapshot_observed_at":"2026-08-09T01:45:13.939348Z","submitted_at":"2026-05-30T05:05:24Z","title":"DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T18:55:51.474956Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00535"},"observation_digest":"sha256:e97e20dd1a150788110d56f474bd5a2113b95566bbf48a7bd9c3cc02abd215a2","observation_id":"c13b1c42-78a6-46b0-958b-7e8ed3a4b80c","resolution":{"observed_at":"2026-06-28T19:02:34.620068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00573","last_updated":"2026-05-30T06:53:23Z","snapshot_observed_at":"2026-08-08T01:36:01.912280Z","submitted_at":"2026-05-30T06:53:23Z","title":"LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T19:09:29.347284Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00573"},"observation_digest":"sha256:eadbb35b4dd00ecc6f2bf7f89940edc963b6c95fd9f0fbf9422d5419a83d13d4","observation_id":"c9ce07cf-3804-46ab-85a5-3a24dc1b8fa8","resolution":{"observed_at":"2026-06-28T19:12:34.668492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.02823","last_updated":"2026-06-01T19:40:32Z","snapshot_observed_at":"2026-08-09T00:50:19.069765Z","submitted_at":"2026-06-01T19:40:32Z","title":"Qift: Shift-Friendly No-Zero W2 Post-Training Quantization for Rotated W2A4/KV4 LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T15:49:41.836888Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.02823"},"observation_digest":"sha256:4ebbe06b8f12c79e285a238da1c0937674ff6d1f64f0a008d8efdc0d61d228d4","observation_id":"bde79f78-77dc-4e2e-b4b9-1ee44d2b52f9","resolution":{"observed_at":"2026-07-01T22:06:15.982040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-02T11:21:40.769275Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T11:14:03.535306Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:9511f83bf2c6274c9536148bd24084ff70e442b45ae5ea7dbd29e74b735bec9d","observation_id":"d3d7e18c-cfd3-49cb-8c9a-7aed78fa2441","resolution":{"observed_at":"2026-07-02T02:06:26.980422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-02T11:21:40.769275Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-30T11:17:53.736872Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:80b35f042317027fc72a321838741ebfdb0178a24a0271f490e7b545ab44c88b","observation_id":"d37ff3ed-95ea-4597-a431-61d0017580b9","resolution":{"observed_at":"2026-06-30T11:24:38.273775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.05429","last_updated":"2026-06-03T20:51:52Z","snapshot_observed_at":"2026-08-06T01:16:12.101022Z","submitted_at":"2026-06-03T20:51:52Z","title":"Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T06:09:42.838355Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.05429"},"observation_digest":"sha256:ef1f944a6904b572835ca8399ba6a7f5dd9e636e58b6e4e6dd4560be8a5a7239","observation_id":"24c04631-cb20-4438-892f-108233728ee6","resolution":{"observed_at":"2026-07-02T08:16:48.288085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-02T12:23:11.141699Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T02:35:00.563647Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:e1b5fa46ca419fe909461cd2b14cfaf86a24c74bae9d97f93c5e420b0435b2a3","observation_id":"93ff78ee-bb36-434a-b4af-36eaf89af560","resolution":{"observed_at":"2026-07-02T12:06:55.577768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T12:23:13.879878Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-02T12:23:11.141699Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T12:23:13.879878Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:47b6e546269fb35747892ca96af247b2ad45e664949565d056d4c63e642177f2","observation_id":"c0132601-3a29-4c84-96e1-d0977ae20abc","resolution":{"observed_at":"2026-08-02T12:23:13.879878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.23406","last_updated":"2026-06-22T14:30:47Z","snapshot_observed_at":"2026-08-07T08:16:17.853171Z","submitted_at":"2026-06-22T14:30:47Z","title":"HyperQuant: A Rate-Distortion-Optimal Quantization Pipeline for Large Language and Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T08:46:01.500880Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.23406"},"observation_digest":"sha256:e041c4d1b8bf133ed51a75e6217127b8eb9e9aa204c9aa20ec16487bcdc10791","observation_id":"70b88107-7b85-4d66-a397-62ab0c9862d1","resolution":{"observed_at":"2026-07-04T10:29:45.532847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.23419","last_updated":"2026-06-22T14:42:34Z","snapshot_observed_at":"2026-07-06T23:58:11.694332Z","submitted_at":"2026-06-22T14:42:34Z","title":"GRINQH: Graded Input-based Quantization Hierarchy for Efficient LLM Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T08:38:32.577228Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.23419"},"observation_digest":"sha256:920081da21b554767ea3d714521c38ddb591f9c0012d2648143d85b74f31c77a","observation_id":"2f57c8e7-0ff3-4570-96ce-312bc4869769","resolution":{"observed_at":"2026-07-04T10:39:45.441374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-06T03:10:18.618115Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:33c9093e730b06ee26046da5e29aec4fa8085351035c3545de419b3a1ed62107","observation_id":"75cbd6cf-71ce-45fd-bc84-c577b9e28297","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T01:35:43.851034Z","title":"Tseng, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14630","last_updated":"2026-07-16T06:47:52Z","snapshot_observed_at":"2026-08-08T01:00:35.370812Z","submitted_at":"2026-07-16T06:47:52Z","title":"Cross-Layer Error Compensation and Finite-Sample Feature-Statistics Matching for Extreme Low-Bit Quantization of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T01:35:43.851034Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.14630"},"observation_digest":"sha256:dd600749facd96f6ce0f3d5099ed067d089ae0de9b9e1535666997a92a876a23","observation_id":"6f7f2d25-95d6-4df6-a7d3-18d90b9d3ac6","resolution":{"observed_at":"2026-08-02T01:35:43.851034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T14:29:28.509827Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20434","last_updated":"2026-05-11T10:50:26Z","snapshot_observed_at":"2026-08-06T17:07:51.320317Z","submitted_at":"2026-05-11T10:50:26Z","title":"Break Through the Compression Bottleneck: From Theory to Practice","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T14:29:28.509827Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.20434"},"observation_digest":"sha256:5bc2150ef5bcb39dde39229dcf321a8f94929ed44ecf1c2bb6a693d28eca289c","observation_id":"0d47cdbc-5d5d-4238-836f-77290468ea3e","resolution":{"observed_at":"2026-08-02T14:29:28.509827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-31T22:36:29.341483Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24148","last_updated":"2026-07-27T08:29:05Z","snapshot_observed_at":"2026-08-07T04:57:17.871783Z","submitted_at":"2026-07-27T08:29:05Z","title":"A Motion-Aware Vector Quantization Framework with Centroid Reuse for Efficient VLA Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-31T22:36:29.341483Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.24148"},"observation_digest":"sha256:b75d31c8aa2807b6514575bc0b112c71b239ffd9d4d389461dd4b29f1990cf1d","observation_id":"829af20d-2a27-471e-a618-badf62ddb760","resolution":{"observed_at":"2026-07-31T22:36:29.341483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-01T03:16:46.931878Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27694","last_updated":"2026-07-30T05:26:20Z","snapshot_observed_at":"2026-08-08T17:55:34.075087Z","submitted_at":"2026-07-30T05:26:20Z","title":"GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T03:16:46.931878Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.27694"},"observation_digest":"sha256:2e939ab95e4c3cbf631ffe3a3664745c82522be44066072736cf449dce7af9f1","observation_id":"34d4b659-a33f-4912-8ed3-172af34aa219","resolution":{"observed_at":"2026-08-01T03:16:46.931878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T21:59:39.992784Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03276","last_updated":"2026-08-04T07:51:37Z","snapshot_observed_at":"2026-08-07T23:10:50.426171Z","submitted_at":"2026-08-04T07:51:37Z","title":"TaskPress: Query-Agnostic KV Cache Compression via Task-Guided Pruning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:59:39.992784Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2608.03276"},"observation_digest":"sha256:92d338e20dbb4cd3707c0835e26faaeee655291902bbdae9ab17aca622dce7d5","observation_id":"c2ee7334-ce78-4440-80e0-3553412fa3c8","resolution":{"observed_at":"2026-08-05T21:59:39.992784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.04396/citation-record","integrity":"/paper/2402.04396/integrity","json":"/paper/2402.04396/citation-record.json","paper":"/paper/2402.04396"},"outbound":[],"paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 53 inbound Pith citation observations for arXiv:2402.04396."}