{"as_of":"2026-08-08T18:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:408d9edd88366ea034a1cfa43c9e01fc0f302f9badc338bee3c609453ce67037","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:00:04.960649Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:45:48.497849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.010890Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-05T17:55:08.361255Z","title":"Compresskv: Semantic retrieval heads know what tokens are not important before generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:08.361255Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:fbb055e808390e2956d2162e0fd65cebd63831c89bf6f4ac95c9dcbe26cffcde","observation_id":"74ef57b3-bd3a-4e58-9d51-25808beb877d","resolution":{"observed_at":"2026-08-05T17:55:08.361255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T00:59:58.150808Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:1756f4eb35dd0a546aed312124e51554e7b6826e57c3f0d0f0db471bd81a4c31","observation_id":"3a5817d4-406b-4e47-aac6-a9ec47d5c553","resolution":{"observed_at":"2026-07-02T13:46:59.563761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T05:07:15.772855Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:9c9a0857184faa6449ec19cb9d656d1234a84242a6fd0d922e8cdb09983b27cc","observation_id":"b6c4184e-7440-4a1e-8d3f-f2fc5b4e473b","resolution":{"observed_at":"2026-06-29T18:23:51.286192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-02T12:21:12.951114Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T12:21:12.951114Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:8797b40c8570ba13dfb6dddf36d2f5fa98f61e64e892fe716a931b4b435bf11d","observation_id":"73f9c723-cfc9-4014-964a-9d40153a4680","resolution":{"observed_at":"2026-08-02T12:21:12.951114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.24957","last_updated":"2026-06-23T08:51:20Z","snapshot_observed_at":"2026-08-06T21:01:25.213982Z","submitted_at":"2026-06-23T08:51:20Z","title":"Dustin: Draft-Augmented Sparse Verification for Efficient Long-Context Generation with Speculative Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:58.636939Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.24957"},"observation_digest":"sha256:1e59b66e5b6e07963814979d52aac208279994610b96b674b9f503a536cb1874","observation_id":"7bd4a058-0963-4f14-8896-5d35a218da9a","resolution":{"observed_at":"2026-07-04T16:49:58.012411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2607.01002","last_updated":"2026-07-01T14:41:07Z","snapshot_observed_at":"2026-08-07T10:03:34.325706Z","submitted_at":"2026-07-01T14:41:07Z","title":"Logit-Contribution Scoring Identifies Non-Literal Retrieval Heads","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-02T12:55:48.518068Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2607.01002"},"observation_digest":"sha256:2f5ea0cbf29d4133afb769a99e779d82df51a27c950501138c5ff7222dc017f5","observation_id":"cb7f3924-44fd-4157-b2f2-e6892b24057f","resolution":{"observed_at":"2026-07-02T12:56:56.481008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-02T05:58:47.023358Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13205","last_updated":"2026-07-14T18:55:20Z","snapshot_observed_at":"2026-08-07T14:57:47.896782Z","submitted_at":"2026-07-14T18:55:20Z","title":"Adaptive Filtering of the KV Cache: Diagnosing and Correcting Structural-Role Bias in LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T05:58:47.023358Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2607.13205"},"observation_digest":"sha256:2a4d7db390318b680d2d59179f982049d1a4153f42ea35abf5ea57ffd118d726","observation_id":"c4c6b158-d9d8-4ea5-a3db-76de214a1547","resolution":{"observed_at":"2026-08-02T05:58:47.023358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-07T00:45:48.497849Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T18:11:21.193237Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.497849Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:32b9c410116afbd6c1fac55376bfc02214168405e8362e3beb71479478536b53","observation_id":"5cbfbc9c-57d0-48b7-a240-4400d564416c","resolution":{"observed_at":"2026-08-07T00:45:48.497849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02401/citation-record","integrity":"/paper/2508.02401/integrity","json":"/paper/2508.02401/citation-record.json","paper":"/paper/2508.02401"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:04.779838Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.779838Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6234b0c5f695332012203003dc560f058ccd4e2bf3bdab60ad279078c506ba74","observation_id":"3a02f6cf-deb4-4025-aa64-a653838170ff","resolution":{"observed_at":"2026-08-06T05:00:04.779838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:04.786401Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.786401Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:0ff358d73599a84870762459ec935038701f5fc8c15d5a605015ea2018d1984a","observation_id":"27f24123-5625-4518-bb6d-ade1b4f74603","resolution":{"observed_at":"2026-08-06T05:00:04.786401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T05:00:04.793764Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.793764Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:db40fa42e1089211eac54646efabdbde26084092703c6e8271a88df325da93a0","observation_id":"d35d4ff9-9bcd-4f7c-9ba6-7225b7b00128","resolution":{"observed_at":"2026-08-06T05:00:04.793764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.568968Z","title":null,"venue":null,"work_id":"184e00df-bcfe-42bd-9b76-7691ef53a477","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.799587Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:1ee2522d2b125ed101b933d6008eb0e5442f9a61116fe419c2a4d23121fd51ce","observation_id":"29409de1-d8e0-4a14-9cb3-d8fe2c293499","resolution":{"observed_at":"2026-08-06T05:00:06.573417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.504457Z","title":null,"venue":null,"work_id":"e872db21-4c25-41f1-b495-152d3d825dc2","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.804998Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:0fc66e35ee1927cc2a2b0c194fd7101e39df63ba5f960dec85c248d1cd27ed09","observation_id":"a98a3025-0163-4f9f-889c-a1555ac9658a","resolution":{"observed_at":"2026-08-06T05:00:06.558665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.288057Z","title":null,"venue":null,"work_id":"e318e26f-1e99-43a9-a8ff-bea4eafc7c41","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.810924Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:2aa9be7dc1e9f87a49b11663b46ee65fd51eb2f2875f7d54dc644ad6d45aa005","observation_id":"184f0cd2-9907-46dc-b54d-70bb15275c2b","resolution":{"observed_at":"2026-08-06T05:00:06.392314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T05:00:04.815941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.815941Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:ee3ffacfc79d8250abec7592c1b116098f89ecf631d8a48ea18bc18e2cc36498","observation_id":"8c878f50-e796-4a0e-bff9-99634a5bdaa3","resolution":{"observed_at":"2026-08-06T05:00:04.815941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.139309Z","title":null,"venue":null,"work_id":"b63b6165-307c-42e0-986a-30c9d5826442","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.822374Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6b31f1a2ac777f6f4722e3bc275ab5b2b895fdaf0c2a43f77f36073f1829d511","observation_id":"84ed15f5-85b1-4afc-a7ef-2aa92570c212","resolution":{"observed_at":"2026-08-06T05:00:06.210840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T05:00:04.828588Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.828588Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6d4038eb78b1d8957e60bfa1904da8f4cc8c09c3fcd4c6895605b2d12b3906c7","observation_id":"26dc0eb0-c611-4196-b4b1-2e5f2e029558","resolution":{"observed_at":"2026-08-06T05:00:04.828588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.964379Z","title":null,"venue":null,"work_id":"f9a9c5ae-f9f6-4f80-9e25-61eff47ac5cc","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.834223Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6bab24a382b21ebe55330f1283aecb09161a227193c7dcdf62e47442b08b0d08","observation_id":"8f3a3bae-6a3c-45ec-b188-bf28b077236a","resolution":{"observed_at":"2026-08-06T05:00:06.029166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.813831Z","title":null,"venue":null,"work_id":"d36613d5-3ab4-45bd-9f2d-0721ef7a4d4f","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.839504Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:e02430048068724f923c1f8b194ba8ef54acc04d792dc7255bc24a8a39655bae","observation_id":"40aa3301-c05b-4827-ae76-844e2120e222","resolution":{"observed_at":"2026-08-06T05:00:05.870810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T05:00:04.844683Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.844683Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:33e28e4b56477baa77e9406a00a34bac7d878bd8f60573495c058b398999e1cd","observation_id":"d078d48f-b356-4f6f-88ad-62ae9762ad7a","resolution":{"observed_at":"2026-08-06T05:00:04.844683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08825","last_updated":"2024-03-08T02:49:12Z","snapshot_observed_at":"2026-08-07T23:37:32.488201Z","submitted_at":"2023-10-13T02:41:55Z","title":"From CLIP to DINO: Visual Encoders Shout in Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08825","snapshot_observed_at":"2026-08-06T05:00:04.849995Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.849995Z"},"links":{"cited_paper":"/paper/2310.08825","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:e3580d823cefbd08ac85edc68a482111b7f26191e36df77dd6495e0e7ee22588","observation_id":"6d5705cf-9e95-4c13-baa3-b7bdb6ecc9bd","resolution":{"observed_at":"2026-08-06T05:00:04.849995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.658588Z","title":null,"venue":null,"work_id":"608f7522-428a-44f0-82f1-bddbd77fe325","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.855134Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:fc6bcbc10d9323b9b781f248acce32cb7701ce2d4518f675290c70128cac33ee","observation_id":"1ced2924-ce9e-4a4f-9fc1-de6b2f1b1e86","resolution":{"observed_at":"2026-08-06T05:00:05.717892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-06T05:00:04.860070Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.860070Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:25f2bad86a522e4abe38e50d9ed4c4e833b1d214eb269e6180cbc2eaa21cde3f","observation_id":"8c0fae0e-b197-4574-816e-8b75130645d1","resolution":{"observed_at":"2026-08-06T05:00:04.860070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.569850Z","title":"W.; Hassoun, J.; Keutzer, K.; and Gholami, A","venue":null,"work_id":"df75ce26-f23b-4a7a-b935-8f43359d4690","year":2022},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.865352Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:c09d4def74ef55a522621e8e8ccf4a2de178108af6ab9a333565043225f46675","observation_id":"d879762a-4373-4993-a9cb-18c01300240e","resolution":{"observed_at":"2026-08-06T05:00:05.583593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.538010Z","title":null,"venue":null,"work_id":"26748359-e5e4-4e61-9d90-8f75eea36bcb","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.870062Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:522e4f400519cb4c5814d02344fe1878a67ac428677268d9c72c1f55de2b265d","observation_id":"7bcaff39-b696-41ee-b68a-2714272fe34c","resolution":{"observed_at":"2026-08-06T05:00:05.551971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.498752Z","title":null,"venue":null,"work_id":"d37abba5-651e-41bb-b0db-ab24a904cc84","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.875443Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:a36ed080fbedb8f330b61f0ce75be7878a5349bf9e5a53bb49ec7943eadb1d5b","observation_id":"3f2a0ce4-018a-4b16-807b-aa3d3c12c121","resolution":{"observed_at":"2026-08-06T05:00:05.518917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.451596Z","title":null,"venue":null,"work_id":"3fb8653f-64b5-4072-94ac-f27afcf4c039","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.882201Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:1b776bfd74a598ab14e40eddcc25ea81f5553c42f6ba6012d9ee38a70f4e5891","observation_id":"13c1d72a-dab8-4db1-8802-b93013336e6d","resolution":{"observed_at":"2026-08-06T05:00:05.474642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-06T05:00:04.888968Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.888968Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:a1455019930889d50455d238567a13d169075b8f44d03f3268e5a6ab867025a3","observation_id":"e77090e4-efae-4abd-a79c-1ab8e7b9dce8","resolution":{"observed_at":"2026-08-06T05:00:04.888968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.422158Z","title":null,"venue":null,"work_id":"ccfc6ea5-4209-4ab1-a693-d7d0ecc299e4","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.895117Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:ee1f07075d0f056dec137ed094e2a508ac2b6c74e62e4a948e31f44b1f48e724","observation_id":"deaabee4-fd31-4276-84ab-77e032f2bc63","resolution":{"observed_at":"2026-08-06T05:00:05.433406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.384089Z","title":null,"venue":null,"work_id":"e3e79a62-ce40-4157-b3be-46198c8dfba8","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.901167Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:f2a8c5657ea0f35b6fd87c13d810ddf29ea3feca31d73d8f836e809694af11c7","observation_id":"c15ab8df-5f20-4cc3-b2b8-aa06a8f67add","resolution":{"observed_at":"2026-08-06T05:00:05.394304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.357304Z","title":null,"venue":null,"work_id":"a9513f1c-9fd1-4f3d-bef6-a37bfbf6586d","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.906299Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:f711ab7396ad653a536ef2769f108c132c6bec663f161321c4f5a8e839aa2496","observation_id":"7a4c5a16-b72c-46d0-8de1-a9b4aeae8428","resolution":{"observed_at":"2026-08-06T05:00:05.368266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.328367Z","title":"S.; Mueller, A.; Wallace, B","venue":null,"work_id":"c0aa73cb-789f-4406-9666-e34feb527277","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.911260Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:5e04f8685743b7fdf9fb56a0aa76c2adb3f03433610fd412281658fa686e5d2e","observation_id":"8cd0f08a-073b-4a78-908e-d72ddbd2c551","resolution":{"observed_at":"2026-08-06T05:00:05.340020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.303873Z","title":null,"venue":null,"work_id":"58e52682-d036-4eef-82c1-ee860dc4e5d4","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.916770Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:5aaad833103e28e46a513f1ee6da91ec6f8824809eedf7fe43296fb8a39ea6c5","observation_id":"1dd5fdba-5518-44ba-b0b2-06ee75489207","resolution":{"observed_at":"2026-08-06T05:00:05.312877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.280147Z","title":null,"venue":null,"work_id":"9cff25ed-50ed-4b1b-acaa-a049e672997d","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.922227Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:8abcdd2a29738254f92de27719cae854066badc3b3461fe02930b97f415538a8","observation_id":"72e1750b-60d2-4b68-802d-972fcb93b502","resolution":{"observed_at":"2026-08-06T05:00:05.286136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.261105Z","title":null,"venue":null,"work_id":"83ae1203-acbb-44ed-a9f9-98bd639f15bd","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.927132Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:ab48076d5d561baff3840f8ccb7532bf2455523d481424d6b86ee1ca42beb2e9","observation_id":"796bbb22-98d9-44f4-b3b8-d8f223e9624d","resolution":{"observed_at":"2026-08-06T05:00:05.267210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.244394Z","title":null,"venue":null,"work_id":"a739665a-2e8e-4eeb-9271-6474ff317f5b","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.933197Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:cea4307442cd3d08302cf729af754b3c6c19f15a85ed200ba352c4c7629a557e","observation_id":"a1a835be-7f60-47f0-9cdb-b4fcfcaf23e8","resolution":{"observed_at":"2026-08-06T05:00:05.249883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.224530Z","title":null,"venue":null,"work_id":"e1c93de9-7544-49a6-b4f6-18a4fde53b4e","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.939407Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:357ba8296eb375e59c5db74a7066a7d89a8a1ab80929da4a6b7c03bd7f8f48ef","observation_id":"40396696-54d0-46ab-ac12-01f4f16c3c70","resolution":{"observed_at":"2026-08-06T05:00:05.230188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.205677Z","title":null,"venue":null,"work_id":"02afd7fd-aa24-4caa-a831-e5eb0353c881","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.945402Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:01c4d0289254ea536a5f71be974d3dc5f3cca259e26af09c37827e8b5d796ea6","observation_id":"02531ed0-ac6e-4216-b7b9-95e72124d791","resolution":{"observed_at":"2026-08-06T05:00:05.211749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-07T18:05:26.222660Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-06T05:00:04.950853Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.950853Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:222870238d1f05691b5429d92f1d0301d51c9c9faf0936e8cdb3a0544374ea74","observation_id":"559f2c11-27d4-4467-990f-fef5903a6315","resolution":{"observed_at":"2026-08-06T05:00:04.950853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.182639Z","title":null,"venue":null,"work_id":"f645cda6-5aab-4b48-898e-e89d9bea9ba9","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.955991Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:2a53884ab10cba823b4a87fa091c0c6b102c98010e2437f11e9eb6b741aac684","observation_id":"879b0e84-2314-4f70-8203-4ad5c9b152bf","resolution":{"observed_at":"2026-08-06T05:00:05.192752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-06T05:00:04.960649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.960649Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:8593c498cf78fe51e2c88c4b1c0dabae4eb2472d3d1c8f7589659e3419caa02a","observation_id":"f850a8c1-c2d6-4877-a7ec-11ac5ecdee6f","resolution":{"observed_at":"2026-08-06T05:00:04.960649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 8 inbound Pith citation observations for arXiv:2508.02401."}