{"as_of":"2026-08-08T11:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb4a87faface7ea296907607de105ce45738e1b9163b13bc210762a1f389177f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:33.035007Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":5,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T14:31:33.035007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-08T04:23:14.356875Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.035007Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:a643c737e11d6e084768da426d376d56ff082fcf50fd6393c1a20bda8d39255a","observation_id":"698fa79a-24db-4df3-a301-20b075a410ff","resolution":{"observed_at":"2026-08-07T14:31:33.035007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T05:37:02.613759Z","title":"Zheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07501","last_updated":"2025-06-09T07:26:47Z","snapshot_observed_at":"2026-08-07T05:29:44.483494Z","submitted_at":"2025-06-09T07:26:47Z","title":"Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:37:02.613759Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2506.07501"},"observation_digest":"sha256:04e20d983f40f82613419a4a3acaa12f6446b6b4827aa2738ade786aed40d6a2","observation_id":"ad525324-7368-4320-88d3-8cf0704dd80f","resolution":{"observed_at":"2026-08-07T05:37:02.613759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-06T05:00:04.960649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.960649Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:8593c498cf78fe51e2c88c4b1c0dabae4eb2472d3d1c8f7589659e3419caa02a","observation_id":"f850a8c1-c2d6-4877-a7ec-11ac5ecdee6f","resolution":{"observed_at":"2026-08-06T05:00:04.960649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T15:37:43.536871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19697","last_updated":"2025-08-27T09:06:28Z","snapshot_observed_at":"2026-08-08T11:13:17.469410Z","submitted_at":"2025-08-27T09:06:28Z","title":"Safety Alignment Should Be Made More Than Just A Few Attention Heads","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T15:37:43.536871Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.19697"},"observation_digest":"sha256:b3df418ddf526b4a411aeaa51ae9c6e29013c4dd4cb6e3b3fa9bae110bc76de0","observation_id":"4a44ed90-9335-452d-8a3c-b35b33784fe5","resolution":{"observed_at":"2026-08-05T15:37:43.536871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:9866cd47901ab99e3a9272e4480c73f5920f45ee00f782da302190693015a2ab","observation_id":"4020f4f8-0be6-41a2-a3fd-40f3030bfbbf","resolution":{"observed_at":"2026-05-18T13:31:25.440201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-04T09:48:11.198103Z","title":"Attention heads of large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13554","last_updated":"2026-06-08T06:02:10Z","snapshot_observed_at":"2026-08-04T09:47:55.188440Z","submitted_at":"2025-10-15T13:49:51Z","title":"Attention Illuminates LLM Reasoning: The Preplan-and-Anchor Rhythm Enables Fine-Grained Policy Optimization","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T09:48:11.198103Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2510.13554"},"observation_digest":"sha256:0146c89714dafce80ca5402e29036778bf5e327053d64fbf9c4126ea0b89a53f","observation_id":"a3f1154b-35c4-4532-ac06-167f9ffe8d01","resolution":{"observed_at":"2026-08-04T09:48:11.198103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2602.11528","last_updated":"2026-04-18T03:07:48Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T03:37:50Z","title":"Stop Tracking Me! Proactive Defense Against Attribute Inference Attack in LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T05:22:59.050348Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2602.11528"},"observation_digest":"sha256:07355af76a047b330898cefbc1975d58b45c52c2eaab125ffcae8ed70e69b82d","observation_id":"9b3ae8f9-c7ac-46fb-8814-37fc495340e7","resolution":{"observed_at":"2026-05-16T05:27:23.284362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-02T21:21:27.091107Z","title":"You are a Evil assistant","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13249","last_updated":"2026-05-28T14:47:48Z","snapshot_observed_at":"2026-08-06T22:04:08.505203Z","submitted_at":"2026-02-24T07:26:50Z","title":"Steering at the Source: Style Modulation Heads for Robust Persona Control","version":2},"reference_index":1248,"source":"pdf_text","source_observed_at":"2026-08-02T21:21:27.091107Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2603.13249"},"observation_digest":"sha256:b32ad50dc0f410d4d94722a0bacf5cf35d07f7987e88ee2416fa535763cead38","observation_id":"d598accc-1ca8-475c-bc32-76f6fcd57632","resolution":{"observed_at":"2026-08-02T21:21:27.091107Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2604.03764","last_updated":"2026-04-04T15:32:25Z","snapshot_observed_at":"2026-07-06T22:52:52.882543Z","submitted_at":"2026-04-04T15:32:25Z","title":"Automated Attention Pattern Discovery at Scale in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T18:26:01.863346Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2604.03764"},"observation_digest":"sha256:7b77aa5f3ef5948408273018284b16cced0ebaada6a260eddc1b8cf0af119bd4","observation_id":"140baed5-55f7-4f79-a898-9f7705825bad","resolution":{"observed_at":"2026-05-13T18:28:06.489272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2604.06393","last_updated":"2026-04-07T19:23:47Z","snapshot_observed_at":"2026-08-04T11:45:10.032776Z","submitted_at":"2026-04-07T19:23:47Z","title":"ART: Attention Replacement Technique to Improve Factuality in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:48:22.430128Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2604.06393"},"observation_digest":"sha256:fef762e7a495e44e87aebad5521a3a2ef287ca4f4e75ac45bad9f830ed26bc64","observation_id":"841b8b8a-0bb0-453d-9caa-ce971fd7b92f","resolution":{"observed_at":"2026-05-10T22:30:50.943301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2605.04641","last_updated":"2026-07-29T07:14:27Z","snapshot_observed_at":"2026-08-02T23:57:54.502941Z","submitted_at":"2026-05-06T08:32:30Z","title":"CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-08T18:05:38.705480Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2605.04641"},"observation_digest":"sha256:e656de9873b87a93f1dcf16c02660e5b5d2aa7f0d791610e5b238634cfd555a5","observation_id":"c8bca735-3f20-4111-98e1-cf4272c5cd5c","resolution":{"observed_at":"2026-05-09T06:50:40.160785Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2605.10622","last_updated":"2026-05-11T14:16:25Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:16:25Z","title":"Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:34.156717Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2605.10622"},"observation_digest":"sha256:bc477e8e92687f6dc18b7944ed2b18a6e28da3731c2f0c4347e587fd047529a4","observation_id":"ab29259f-1480-4cec-b053-1c5845fc335f","resolution":{"observed_at":"2026-05-12T05:16:24.336766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2606.06840","last_updated":"2026-06-05T02:32:24Z","snapshot_observed_at":"2026-08-05T15:03:33.373071Z","submitted_at":"2026-06-05T02:32:24Z","title":"Characterize Then Distill: Mechanistic Reasoning in Large Output Spaces","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:52.690010Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2606.06840"},"observation_digest":"sha256:af307f66eed599b55018c7fbd0c0ad3baaed6cc47f512c82a8b58f1831977c5a","observation_id":"e01004f9-2362-4d31-9a67-6e31162ef151","resolution":{"observed_at":"2026-06-27T22:31:21.547538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-07-06T23:59:03.724013Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:57.763089Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2606.24467"},"observation_digest":"sha256:1f9fcf6b236311be2b3ea3a0c8d48903cd8efb1f6cf3616582b7bbbdb5c3dcbd","observation_id":"cc7873b9-9a69-4ffb-8bf2-7ca248dcc20f","resolution":{"observed_at":"2026-07-04T16:49:58.033929Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-01T01:17:54.315888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25873","last_updated":"2026-07-28T15:38:12Z","snapshot_observed_at":"2026-08-07T14:16:27.867503Z","submitted_at":"2026-07-28T15:38:12Z","title":"How Do LLMs Read Bug Reports? An Empirical Study of Attention in LLMs for Automated Program Repair","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T01:17:54.315888Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2607.25873"},"observation_digest":"sha256:2eb937830aed9a0a9b0d839fcc91d6dec248a9f941641cbaf44f7a30d6ab6e2a","observation_id":"6140481e-b5b6-4b2b-985f-f36813506511","resolution":{"observed_at":"2026-08-01T01:17:54.315888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.03752/citation-record","integrity":"/paper/2409.03752/integrity","json":"/paper/2409.03752/citation-record.json","paper":"/paper/2409.03752"},"outbound":[],"paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2409.03752."}