{"as_of":"2026-08-21T19:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1d0e9d12073d42065529de8128bcb73e9ac4f11b1d9e6a3e9d36109f01d368d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:07:53.551197Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-11T22:10:23.055200Z","title":"Yin and J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.03782","last_updated":"2025-06-05T17:58:57Z","snapshot_observed_at":"2026-08-21T17:34:14.367963Z","submitted_at":"2024-12-05T00:05:11Z","title":"The broader spectrum of in-context learning","version":3},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-11T22:10:23.055200Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2412.03782"},"observation_digest":"sha256:f3933e7d50bd707f07a8f67d0d4bd36734f7561ba367372d5814e05e667526f6","observation_id":"b6463463-55d7-4be2-8ef9-945f69528613","resolution":{"observed_at":"2026-08-11T22:10:23.055200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-07T00:41:59.663314Z","title":"Which attention heads matter for in-context learning?arXiv preprint arXiv:2502.14010, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13253","last_updated":"2025-06-16T08:49:42Z","snapshot_observed_at":"2026-08-16T09:38:12.019754Z","submitted_at":"2025-06-16T08:49:42Z","title":"Distinct Computations Emerge From Compositional Curricula in In-Context Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.663314Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2506.13253"},"observation_digest":"sha256:4753c1a5d8d57b0d93b963fa76b8cfd6d3b69e0100c7d8ab10ebb22534838d57","observation_id":"fd7f5f44-fb68-4b82-9977-e6950c7382dd","resolution":{"observed_at":"2026-08-07T00:41:59.663314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-15T19:07:53.551197Z","title":"Which attention heads matter for in-context learning? arXiv preprint arXiv:2502.14010, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17859","last_updated":"2025-06-26T16:54:57Z","snapshot_observed_at":"2026-08-21T03:12:22.825230Z","submitted_at":"2025-06-21T23:49:08Z","title":"In-Context Learning Strategies Emerge Rationally","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:07:53.551197Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2506.17859"},"observation_digest":"sha256:8c5ca6f1dee689537efb4aac561f3ff2f2a33da2313aba96ec1f601225dbaadc","observation_id":"c73ad69b-f4bd-4f2a-bc6d-13fb8007afbb","resolution":{"observed_at":"2026-08-15T19:07:53.551197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-06T05:00:04.950853Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-13T07:44:07.312192Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.950853Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:74d6abcbad5b79159f8f5fd49f3b92dbd8b0ce438344d4d4eb934dae33cfde59","observation_id":"559f2c11-27d4-4467-990f-fef5903a6315","resolution":{"observed_at":"2026-08-06T05:00:04.950853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-08-11T18:18:04.570790Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:17f1440f1947d9b21281b5ce51a0f2cd84bd9aff6c6775d8b175b0ad1e789425","observation_id":"926e1f80-5ad7-4062-b523-88bd109d9233","resolution":{"observed_at":"2026-05-18T13:31:25.452593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-03T21:06:40.820193Z","title":"above random,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16893","last_updated":"2026-07-05T02:34:16Z","snapshot_observed_at":"2026-08-18T13:50:34.534646Z","submitted_at":"2025-11-21T02:17:01Z","title":"Predicting the Emergence of Induction Heads in Language Model Pretraining","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:06:40.820193Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2511.16893"},"observation_digest":"sha256:a76c2fb003f449425e89cb6a73b49250578d1224b7b898d6bc67679578cfd5cf","observation_id":"027fbc6e-dc89-4746-bcf1-e574d0b49cbf","resolution":{"observed_at":"2026-08-03T21:06:40.820193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2512.13751","last_updated":"2026-05-09T08:34:38Z","snapshot_observed_at":"2026-08-11T20:36:34.223497Z","submitted_at":"2025-12-15T05:50:45Z","title":"MIDUS: Memory-Infused Depth Up-Scaling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T22:02:42.297041Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2512.13751"},"observation_digest":"sha256:0d870230646086829dcbc21f17ebc47526953d7c4835917478eef645f4d9bf79","observation_id":"0cfbbeb3-fcd9-4dfd-8207-3ef371a7d86d","resolution":{"observed_at":"2026-05-16T22:03:36.145951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-03T01:00:44.265889Z","title":"URL https: //doi.org/10.24963/ijcai.2022/556","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.03335","last_updated":"2026-06-29T17:33:41Z","snapshot_observed_at":"2026-08-03T01:00:42.799874Z","submitted_at":"2026-02-11T16:06:59Z","title":"Compressed Sensing for Capability Localization in Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T01:00:44.265889Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2603.03335"},"observation_digest":"sha256:bcf14d1a7d5dde8e478c9c1d4903d188aee1b12e4e261981014c07c9444d456e","observation_id":"c562e1a4-b940-4fcc-9993-e97ba7558062","resolution":{"observed_at":"2026-08-03T01:00:44.265889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2604.23371","last_updated":"2026-04-25T16:35:25Z","snapshot_observed_at":"2026-07-06T23:09:38.799345Z","submitted_at":"2026-04-25T16:35:25Z","title":"When Context Sticks: Studying Interference in In-Context Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T08:31:14.231710Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2604.23371"},"observation_digest":"sha256:3fa52fa9fc00217c580e8a3ef4fc2f007d238971eff46ea35b3cedbd48bd9893","observation_id":"af989d11-bc32-491e-a231-28d5f18cdc2b","resolution":{"observed_at":"2026-05-11T20:36:09.515952Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2605.05115","last_updated":"2026-05-06T16:46:03Z","snapshot_observed_at":"2026-08-07T10:12:24.411121Z","submitted_at":"2026-05-06T16:46:03Z","title":"Manifold Steering Reveals the Shared Geometry of Neural Network Representation and Behavior","version":1},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-05-08T17:47:09.591001Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2605.05115"},"observation_digest":"sha256:976e914ca677cee7485dd7cdcb08efd57e98d0ffcd67902e67b0e96476549143","observation_id":"9a9112a7-f93c-4f42-8657-59c7aab3a662","resolution":{"observed_at":"2026-05-11T17:16:06.577442Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2605.20730","last_updated":"2026-05-20T05:26:38Z","snapshot_observed_at":"2026-08-17T00:54:33.947872Z","submitted_at":"2026-05-20T05:26:38Z","title":"Distributional Alignment as a Criterion for Designing Task Vectors in In-Context Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T05:32:01.059706Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2605.20730"},"observation_digest":"sha256:0042520f871a63f149fbcc19212de83a00b14b4fb0f5141cd78b7a59eaf77c81","observation_id":"f0849acc-6ddb-4948-a382-989a0e96e6ae","resolution":{"observed_at":"2026-05-21T05:33:58.583417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:bd24c9ceccba9d765d48d3ea7429fcaa20ebb94eeb696615f22eb935b2b286c7","observation_id":"081c2371-be90-4599-9a20-a7abffd78315","resolution":{"observed_at":"2026-06-28T23:32:46.694055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T20:46:01.403927Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:7f6cefcea78190069e2e0e33454ad18220d0bfb391b3b9a5afe537db746d8144","observation_id":"501bb876-5bfa-48af-bce6-6105dbbc89a6","resolution":{"observed_at":"2026-07-04T00:59:20.999931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T10:20:46.759958Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:00783d25fba5ecdafc604a8154981e73580db75f03a7ac2fc9ab0b5073a4f0ad","observation_id":"4dc3b032-f102-43d7-ab5f-642a70b5b295","resolution":{"observed_at":"2026-06-30T12:04:39.194166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-08-18T21:03:31.332486Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:57.763089Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.24467"},"observation_digest":"sha256:d7d89d0ab9f34e7bf5486beeec47b8511cef060465973fcb0462bd7b839a93de","observation_id":"2f9276c2-1721-4d88-bea3-3c653ebbe4fe","resolution":{"observed_at":"2026-07-04T16:49:58.030660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14010/citation-record","integrity":"/paper/2502.14010/integrity","json":"/paper/2502.14010/citation-record.json","paper":"/paper/2502.14010"},"outbound":[],"paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2502.14010."}