{"as_of":"2026-08-10T19:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b517751c56f492357f11bef2b2c64163391b387c1f6ddb2dde42943d84a6b44","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:14:46.511215Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-10T16:14:46.511215Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13484","last_updated":"2025-03-11T06:49:47Z","snapshot_observed_at":"2026-08-10T15:51:43.152851Z","submitted_at":"2025-01-23T08:57:33Z","title":"MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T16:14:46.511215Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2501.13484"},"observation_digest":"sha256:f26debb9246099662634281059c4aa530ce7da23811e0fc312fe02a08bb8329d","observation_id":"90927be6-dc92-4287-aad6-e002203a5f00","resolution":{"observed_at":"2026-08-10T16:14:46.511215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-09T20:34:01.368235Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19392","last_updated":"2025-02-28T18:04:52Z","snapshot_observed_at":"2026-08-09T20:48:28.727060Z","submitted_at":"2025-01-31T18:47:42Z","title":"Cache Me If You Must: Adaptive Key-Value Quantization for Large Language Models","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T20:34:01.368235Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2501.19392"},"observation_digest":"sha256:c7cba2c80e36bf13c93d7b58d1ed8502df16c6f084e85f81027b45681a3bf0eb","observation_id":"7761c196-453c-4558-84f1-8e046a244107","resolution":{"observed_at":"2026-08-09T20:34:01.368235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-09T19:12:56.315307Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00425","last_updated":"2025-08-10T04:13:03Z","snapshot_observed_at":"2026-08-10T01:23:32.232654Z","submitted_at":"2025-02-01T13:08:02Z","title":"MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T19:12:56.315307Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2502.00425"},"observation_digest":"sha256:360f9fa102ea115a854fc696a7437b1592171167aa4d070d8ae96ac3ff07f84f","observation_id":"16fc40a5-c601-48e2-9250-23b0f845db06","resolution":{"observed_at":"2026-08-09T19:12:56.315307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-09T13:26:55.458763Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02617","last_updated":"2025-02-04T08:52:13Z","snapshot_observed_at":"2026-08-10T18:16:37.005924Z","submitted_at":"2025-02-04T08:52:13Z","title":"PolarQuant: Quantizing KV Caches with Polar Transformation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T13:26:55.458763Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2502.02617"},"observation_digest":"sha256:8d5ed773f37b19d7f455c193de9aabd2de1da1052c55979a704480ed14803aa4","observation_id":"9a149383-d99e-4dbf-a631-492662798daf","resolution":{"observed_at":"2026-08-09T13:26:55.458763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-08T14:13:38.457867Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06975","last_updated":"2025-02-10T19:14:51Z","snapshot_observed_at":"2026-08-08T23:51:33.892065Z","submitted_at":"2025-02-10T19:14:51Z","title":"Position: Episodic Memory is the Missing Piece for Long-Term LLM Agents","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-08T14:13:38.457867Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2502.06975"},"observation_digest":"sha256:61dd19c6d1496842de12183bb1f8b60edeaa5d880797a8d6a6b88bbfc09d961b","observation_id":"b4b0e042-85be-4feb-a2be-b6c1509ba365","resolution":{"observed_at":"2026-08-08T14:13:38.457867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2504.19874","last_updated":"2025-04-28T15:05:35Z","snapshot_observed_at":"2026-08-01T14:10:27.172555Z","submitted_at":"2025-04-28T15:05:35Z","title":"TurboQuant: Online Vector Quantization with Near-optimal Distortion Rate","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T08:09:22.226608Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2504.19874"},"observation_digest":"sha256:e38a43077a78763fb2577b177f28da8821e4b7a95fd1d86d391128b450ae1467","observation_id":"02cb7c13-5fe1-446d-8bab-00c05bb8e8dd","resolution":{"observed_at":"2026-05-20T08:09:22.393487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T14:34:27.199163Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18610","last_updated":"2026-07-11T08:07:07Z","snapshot_observed_at":"2026-08-08T05:25:08.061289Z","submitted_at":"2025-05-24T09:18:11Z","title":"PM-KVQ: Progressive Mixed-precision KV Cache Quantization for Long-CoT LLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:27.199163Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2505.18610"},"observation_digest":"sha256:a9911cf5337f6afd13c21721140ee12281ff4a4529fa9907e096407ba43ae12c","observation_id":"c81bd392-b7a7-49c4-974a-27b5949d74d5","resolution":{"observed_at":"2026-08-07T14:34:27.199163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T14:16:19.784103Z","title":"Wkvquant: Quan- tizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-08T23:51:09.753030Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.784103Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:90844000b10eb06de957e99d1f83f13c2e015147a4012f682ca3be51e0b97ce8","observation_id":"0e775c07-916f-4896-ae0c-6090247f3f33","resolution":{"observed_at":"2026-08-07T14:16:19.784103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T10:42:41.053905Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05432","last_updated":"2025-06-26T06:17:49Z","snapshot_observed_at":"2026-08-09T13:48:08.253333Z","submitted_at":"2025-06-05T08:58:58Z","title":"PCDVQ: Enhancing Vector Quantization for Large Language Models via Polar Coordinate Decoupling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:42:41.053905Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2506.05432"},"observation_digest":"sha256:aec712653af6150348ee921209f1d9370d3567632dfea6c65a133c0be0d29d0c","observation_id":"07300448-297a-413c-a67d-91aef5f612f8","resolution":{"observed_at":"2026-08-07T10:42:41.053905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-06T17:30:10.324505Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10849","last_updated":"2025-07-14T22:43:50Z","snapshot_observed_at":"2026-08-07T03:02:35.209367Z","submitted_at":"2025-07-14T22:43:50Z","title":"OpenGCRAM: An Open-Source Gain Cell Compiler Enabling Design-Space Exploration for AI Workloads","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:10.324505Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2507.10849"},"observation_digest":"sha256:b538dc3038788025a6f7ee7a6b054ccacd6516f4e69b8f9e9ebcfc4d220e415a","observation_id":"50122e54-e669-4aa5-b2b0-b6048149c522","resolution":{"observed_at":"2026-08-06T17:30:10.324505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-04T10:50:10.957901Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.08525","last_updated":"2026-05-27T17:54:39Z","snapshot_observed_at":"2026-08-04T10:50:07.221513Z","submitted_at":"2025-10-09T17:50:00Z","title":"Which Heads Matter for Reasoning? RL-Guided KV Cache Compression","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T10:50:10.957901Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2510.08525"},"observation_digest":"sha256:8f0cc7854c7e83196cccc4fa9f8b369b8959dfad4b190bd2dd07cc77f2e98187","observation_id":"595fb424-d5e9-4355-97ff-ad0f54ba2c4b","resolution":{"observed_at":"2026-08-04T10:50:10.957901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-03T04:37:29.030814Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04595","last_updated":"2026-07-22T11:57:18Z","snapshot_observed_at":"2026-08-08T03:30:31.466913Z","submitted_at":"2026-02-04T14:22:08Z","title":"Harmonia: Algorithm-Hardware Co-Design for Memory- and Compute-Efficient BFP-based LLM Inference","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T04:37:29.030814Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2602.04595"},"observation_digest":"sha256:cbc95afa3b45a8aebac446a3c4376e53d978798c050a100ee354ce478e1457bc","observation_id":"41c1dd36-b19d-45ca-b8da-e2768d717baf","resolution":{"observed_at":"2026-08-03T04:37:29.030814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2604.21072","last_updated":"2026-05-05T16:09:43Z","snapshot_observed_at":"2026-07-06T23:07:41.856444Z","submitted_at":"2026-04-22T20:36:47Z","title":"Distributed Generative Inference of LLM at Internet Scales with Multi-Dimensional Communication Optimization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-09T23:01:56.712670Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2604.21072"},"observation_digest":"sha256:416b07336df1b6d0a706d209707d973fa0bf0956f8d4db022e28ba9a3d4a576b","observation_id":"ec06f206-a996-4b6d-81e3-714dd2922dd0","resolution":{"observed_at":"2026-05-09T23:04:17.325023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T18:23:14.935801Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:2dcc457673b795e85f2b5f30ea5cc2176e4a99ec06aad08c1e2b52ec8b321c41","observation_id":"3fcf9aaf-ed29-432e-943b-9c150db5dcd2","resolution":{"observed_at":"2026-05-09T06:30:44.202534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T02:59:00.997742Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:82c1ecf9db7fdf8061147309f6a84634de4e8aa1b43a40bca5544ba6dfa09c53","observation_id":"2c33c427-3e9b-42fb-ba8d-d75426045cb6","resolution":{"observed_at":"2026-05-12T03:01:18.181638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2605.12464","last_updated":"2026-05-12T17:50:08Z","snapshot_observed_at":"2026-08-02T04:50:55.914032Z","submitted_at":"2026-05-12T17:50:08Z","title":"Search Your Block Floating Point Scales!","version":1},"reference_index":168,"source":"arxiv_source","source_observed_at":"2026-05-13T05:52:26.558984Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2605.12464"},"observation_digest":"sha256:7225707be1a3d6525d73d8bd33992e76ceb2e11cc4b7985963edbc4b4881a1aa","observation_id":"1a3f28e5-04e7-48ed-9f91-e573cb8ab6c3","resolution":{"observed_at":"2026-05-13T06:02:24.100491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2605.17757","last_updated":"2026-05-18T02:24:29Z","snapshot_observed_at":"2026-07-06T23:28:45.646975Z","submitted_at":"2026-05-18T02:24:29Z","title":"OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T12:16:07.797702Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2605.17757"},"observation_digest":"sha256:7e39341c2c4e779c199cb00240089377155191104b4b23fd063bbc483c7a1996","observation_id":"7ecb6e09-3a5c-405a-939e-25e31b5be9a4","resolution":{"observed_at":"2026-05-20T12:18:16.543015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":"2402.12065","doi":"10.48550/arxiv.2402.12065","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WKVQuant: Quantizing weight and key/value cache for large language models gains more","venue":"arXiv (Cornell University)","work_id":"41fac045-5486-40a1-b1e3-03860d47473d","year":2024},"citing_paper":{"arxiv_id":"2606.08302","last_updated":"2026-06-06T18:58:26Z","snapshot_observed_at":"2026-08-06T09:32:24.096311Z","submitted_at":"2026-06-06T18:58:26Z","title":"HACK++: Towards More Effective Head-Aware Key-Value Compression for Efficient Visual Autoregressive Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T19:46:43.514413Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2606.08302"},"observation_digest":"sha256:1c4a3c264aa70168ae1aa34246a617d5eb69f773a5fc3146b33362c1ef2edfac","observation_id":"28a54ca8-4bad-4e1d-b588-1e7a1e20bc1f","resolution":{"observed_at":"2026-07-02T21:27:24.336242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-01T14:12:00.997267Z","title":"Wkvquant: Quantizing weight and key/value cache for large language models gains more,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18859","last_updated":"2026-07-21T08:49:30Z","snapshot_observed_at":"2026-08-08T05:58:51.576912Z","submitted_at":"2026-07-21T08:49:30Z","title":"PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-01T14:12:00.997267Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2607.18859"},"observation_digest":"sha256:a3385d1a4c4e59f34e25ac58152a120218196d531a7c4fe21072d93dbb18441b","observation_id":"85915596-fc29-44b7-9cc9-dcaf28810ac3","resolution":{"observed_at":"2026-08-01T14:12:00.997267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-04T13:43:55.630826Z","title":"arXiv preprint arXiv:2402.12065 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T13:43:55.630826Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:18b97e14f2f4ccd79826fc6bb2f84a408e5cc41cf3b9e9aae4a88b75b0b88039","observation_id":"491d83c7-113f-450b-98cc-b1b3f55df3f2","resolution":{"observed_at":"2026-08-04T13:43:55.630826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T00:11:49.059203Z","title":"arXiv preprint arXiv:2402.12065 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T00:11:49.059203Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:a7c8bfbed33f21cea47146f5d230ac35f0eac7f10335e38c71e87d9e6d2a6569","observation_id":"dfa44a68-0b6e-43d8-bb37-b93d3f95749f","resolution":{"observed_at":"2026-08-07T00:11:49.059203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.12065/citation-record","integrity":"/paper/2402.12065/integrity","json":"/paper/2402.12065/citation-record.json","paper":"/paper/2402.12065"},"outbound":[],"paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:28:48.948771Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2402.12065."}