{"as_of":"2026-08-17T05:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7690542374dde705f8101f207ff2a217b8cbc08dee1f490e0be6bbb27edd123","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:33.577852Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18799/citation-record","integrity":"/paper/2505.18799/integrity","json":"/paper/2505.18799/citation-record.json","paper":"/paper/2505.18799"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T03:30:12.735656Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:31:27.593250Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.593250Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:497364d8e0aad1d2414f16cda71782925780a23bf6b60f5a4741607b3c151d21","observation_id":"0e50ab0c-0b80-4588-baef-44904e02fd6c","resolution":{"observed_at":"2026-08-07T14:31:27.593250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-08-15T06:28:09.529747Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-07T14:31:27.724255Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.724255Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:595ffc4bcf10bc1df2548bb4b70e09fd8c66da3dcec62e417d34c4340dbe93f0","observation_id":"109fe90c-179f-478a-aa74-12e82b054f5a","resolution":{"observed_at":"2026-08-07T14:31:27.724255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-08-14T21:19:18.245847Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-07T14:31:27.816937Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.816937Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:009fd9c9bf71e5acb66803b7b0f6e835f5b0fe5481fa8542c159905db399dd30","observation_id":"042da77b-9e69-40ed-a0b3-382a3e79f171","resolution":{"observed_at":"2026-08-07T14:31:27.816937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T14:31:27.926292Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.926292Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:4bab04ee3dcaa0c22a2011ee6f921fa9c981cdaf9fd6146691373809f77e5456","observation_id":"1d8d44ba-97b8-4dcd-91ab-526b961f2ad0","resolution":{"observed_at":"2026-08-07T14:31:27.926292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.030511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.030511Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:062df9ecb1fd397b563935d309a2fb0e394cc8e3e13d7c72c5dbb187f0d83cb0","observation_id":"2234a53e-7826-48f6-84ec-326eeb92412c","resolution":{"observed_at":"2026-08-07T14:31:28.030511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.161330Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.161330Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:35fb18b00583643ef3580113bfedba0aa9635c15252356af14cd9f4c0ed22f93","observation_id":"67647a33-1061-4691-a854-eec3bdbe8e2c","resolution":{"observed_at":"2026-08-07T14:31:28.161330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09246","last_updated":"2023-05-16T07:52:57Z","snapshot_observed_at":"2026-08-16T15:32:45.917375Z","submitted_at":"2023-05-16T07:52:57Z","title":"Maybe Only 0.5% Data is Needed: A Preliminary Exploration of Low Training Data Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09246","snapshot_observed_at":"2026-08-07T14:31:28.279489Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.279489Z"},"links":{"cited_paper":"/paper/2305.09246","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:11d9e3d88807a399bbdeb730548b1da88a558dadfde9a0c5493dccf10cb57c09","observation_id":"7fcd1e42-e9fc-4010-b60f-aae0e4afd8d4","resolution":{"observed_at":"2026-08-07T14:31:28.279489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.359608Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.359608Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:319585937c003e7e478c1877389bf46d714f8c7e5005b191caac36f04898ceaf","observation_id":"ae75715b-0f87-44c2-81fa-72c6318ddf03","resolution":{"observed_at":"2026-08-07T14:31:28.359608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-16T15:15:35.760076Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-07T14:31:28.500759Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.500759Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:40ac3491212abc1a10eb18c5a0ed4872687f932a92672278bce49c3df14216a6","observation_id":"f03e2262-da91-4a08-9a8e-24f5a53f15f3","resolution":{"observed_at":"2026-08-07T14:31:28.500759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:31:28.592253Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.592253Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:21e787067dabd3a414f0abfb92d32b488ce0e551a20913f2d618ef205b703437","observation_id":"cba8f17b-506f-4bac-a170-a40787f36ad1","resolution":{"observed_at":"2026-08-07T14:31:28.592253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04341","last_updated":"2019-06-11T01:31:41Z","snapshot_observed_at":"2026-08-16T14:00:03.452025Z","submitted_at":"2019-06-11T01:31:41Z","title":"What Does BERT Look At? An Analysis of BERT's Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04341","snapshot_observed_at":"2026-08-07T14:31:28.707442Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.707442Z"},"links":{"cited_paper":"/paper/1906.04341","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:c10c43e99a3855edccbba8fa7554a1854c94fcc3daba44b8171206dd8bf1b52b","observation_id":"c54b2d7e-63c3-4baa-854b-fce7cc2415ca","resolution":{"observed_at":"2026-08-07T14:31:28.707442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T14:31:28.838061Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.838061Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5fb4f5a6588f1ce89747ea0f192b62f5ccad04df0df596f60d1c4c368c79add8","observation_id":"e0931648-5682-4c23-a24c-86307ee0da96","resolution":{"observed_at":"2026-08-07T14:31:28.838061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:31:28.924946Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.924946Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:dbd78726c560025f88774c58fd2d94d056651a8f7f8e606b5c280b5048810593","observation_id":"60c08b52-5e69-4346-a441-45df0e39f1e5","resolution":{"observed_at":"2026-08-07T14:31:28.924946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-14T22:24:15.551461Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-07T14:31:29.022900Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.022900Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5a167b2d2c36bf5822661fda8456247319357903f433a3381e2b0baad90fc00d","observation_id":"4de72ca9-7fec-4e40-881c-8c20eb00bf67","resolution":{"observed_at":"2026-08-07T14:31:29.022900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.145234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.145234Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:eed1bcb029f4ba1e36f28762ca1439588ef8e4a6d46d89f3dde96e42bfee1a26","observation_id":"a2f1bbd3-8407-4215-ae50-943f05838ca2","resolution":{"observed_at":"2026-08-07T14:31:29.145234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.235071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.235071Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7027fd1c443d1af5f7fb6bec5d3482b410ceb7023dd500791b3890a53cb20265","observation_id":"b218fa22-ac13-4868-b794-6871a4081663","resolution":{"observed_at":"2026-08-07T14:31:29.235071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.350980Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.350980Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:8b0a6808805b6cc1e119eacd2aa89fbeb19eb2a4a9f3ba822c7a3c6b968d7abb","observation_id":"7524c893-8736-492b-b610-50b52f1b9e25","resolution":{"observed_at":"2026-08-07T14:31:29.350980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:31:29.480396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.480396Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:3838db68bc595477f2ff4ada68ddf303e21e0bcca8b7f0b53b1341f5ea5e931f","observation_id":"449f4f89-6271-44b4-842c-49fd262ae3ad","resolution":{"observed_at":"2026-08-07T14:31:29.480396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-07T14:31:29.562683Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.562683Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:93247d60631852acf83effc442de30d8a60aa094090135fea42f07959e60e1d8","observation_id":"eccb1d5c-7590-45dd-9ae0-a37558cba8e2","resolution":{"observed_at":"2026-08-07T14:31:29.562683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-17T05:06:29.353999Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-07T14:31:29.711577Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.711577Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b893c556de7059c71c7fd82ea6606cd548206dcfdd8dafcd90662127754d4bc5","observation_id":"6deba5fe-bdc3-4692-b2bc-1b2846e5a728","resolution":{"observed_at":"2026-08-07T14:31:29.711577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15786","last_updated":"2024-10-17T02:43:35Z","snapshot_observed_at":"2026-08-16T13:40:33.037759Z","submitted_at":"2024-06-22T08:41:48Z","title":"What Matters in Transformers? Not All Attention is Needed","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15786","snapshot_observed_at":"2026-08-07T14:31:29.831992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.831992Z"},"links":{"cited_paper":"/paper/2406.15786","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:8ddee056b0f3beae66c6ad074d87bf9240721a19db3f5ff4348e235b5757b3e7","observation_id":"918385e5-c8fd-438b-af29-be0863fa735a","resolution":{"observed_at":"2026-08-07T14:31:29.831992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T14:31:29.934219Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.934219Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:bdeeaa8692ff3972eb4c21270a9aaacdccbab8211a2c0ba5647eaeb7484e6203","observation_id":"590bb7f6-01dd-43f0-9581-0b2568848054","resolution":{"observed_at":"2026-08-07T14:31:29.934219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T14:31:30.037548Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.037548Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ed8e454eb0506ac820422e0cf9a23ba4176fd86340c1cc8922fe37a2d1012f45","observation_id":"e5ef0ee0-6a1c-447a-83e8-4be1ca203720","resolution":{"observed_at":"2026-08-07T14:31:30.037548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:31:30.157611Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.157611Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:3cef24233d5a1bad9f50f4d5822a452109210bcff1ab0f6a45b3b165513ceae3","observation_id":"8c379141-7c9d-4a13-98e6-83088b10b25f","resolution":{"observed_at":"2026-08-07T14:31:30.157611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T14:31:30.278340Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.278340Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:efbb45f410a562f7f8d1b173b396b48f9589a7fb1b5ad19221fbf48deb011ac7","observation_id":"81f3a25d-a88f-4abb-88a7-d0195b4e09a4","resolution":{"observed_at":"2026-08-07T14:31:30.278340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T14:31:30.406842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.406842Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7df5730aaf3d5222e96c9050f28d5b55cabd644b771acb5af0f2e89be8ff4f1b","observation_id":"2704a0b4-d1c1-4c73-ab66-799454279de7","resolution":{"observed_at":"2026-08-07T14:31:30.406842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.963571Z","title":null,"venue":null,"work_id":"d2010034-3482-48ba-98c1-a14795471a88","year":2018},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.510582Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ee64b29751f8b4fa5910f396cd9ee9f0e3fba1dab207cc77bd95da9db9e09c79","observation_id":"6c6689c1-ae77-4cb2-95f8-ec70cf1ab2d3","resolution":{"observed_at":"2026-08-07T14:31:35.001913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10102","last_updated":"2020-10-06T15:15:38Z","snapshot_observed_at":"2026-07-06T09:14:07.163697Z","submitted_at":"2020-04-21T15:22:27Z","title":"Attention is Not Only a Weight: Analyzing Transformers with Vector Norms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10102","snapshot_observed_at":"2026-08-07T14:31:30.642317Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.642317Z"},"links":{"cited_paper":"/paper/2004.10102","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:40bba4b854d3edeaf4e3ba6699f254b4f89185e516fa6146d9b0aefd25b367b3","observation_id":"4b2f79d3-b2cc-495a-8905-6f0a1a999fd0","resolution":{"observed_at":"2026-08-07T14:31:30.642317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:30.766556Z","title":null,"venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.766556Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:3c2d4a98e44569fbbc1b0dd9047d1860f8ac83890e4473915b76448f41bbf598","observation_id":"4afe106d-50bd-4688-a1e6-16cc076945c4","resolution":{"observed_at":"2026-08-07T14:31:30.766556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17760","last_updated":"2023-11-02T17:34:57Z","snapshot_observed_at":"2026-08-16T08:17:30.538734Z","submitted_at":"2023-03-31T01:09:00Z","title":"CAMEL: Communicative Agents for \"Mind\" Exploration of Large Language Model Society","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17760","snapshot_observed_at":"2026-08-07T14:31:30.854478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.854478Z"},"links":{"cited_paper":"/paper/2303.17760","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:2d67054ced84b408ee2b8b6165c5112e6159cc964805eef8c77044ab821defae","observation_id":"d687d74e-1276-4ac5-b3a6-f3b05d130900","resolution":{"observed_at":"2026-08-07T14:31:30.854478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-08-16T15:09:03.366337Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-07T14:31:30.967170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.967170Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:916317fced1aa53f2e7d74bc1b78bb670489c51a4ca8368cbe0658c73b984749","observation_id":"64a8319a-333e-491b-9423-ef1d4d148fef","resolution":{"observed_at":"2026-08-07T14:31:30.967170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05062","last_updated":"2023-11-03T15:11:02Z","snapshot_observed_at":"2026-08-16T16:02:50.557393Z","submitted_at":"2023-01-12T14:59:19Z","title":"Tracr: Compiled Transformers as a Laboratory for Interpretability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05062","snapshot_observed_at":"2026-08-07T14:31:31.067719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.067719Z"},"links":{"cited_paper":"/paper/2301.05062","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b27a8d54e4ec40ce5904ba1e9b0a86ce317f14d5411695fb8ec6903a50743b88","observation_id":"979f2315-7f74-4c7a-b4be-f9e0bbab45c0","resolution":{"observed_at":"2026-08-07T14:31:31.067719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T14:31:31.194951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.194951Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b02f8368b0e6bad69a65b3100d9a9311b71b58626422d7f18a6ba5a8c9706677","observation_id":"97bd01b6-1b85-48d2-9753-020294d717fa","resolution":{"observed_at":"2026-08-07T14:31:31.194951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.302083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.302083Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:f2aa833fbe3a0ce482a4e4f485f2d6dae7561972661deb0cdf45ce97fa16b650","observation_id":"0e6737d6-de1f-4fe7-a4fe-5d70f022f56d","resolution":{"observed_at":"2026-08-07T14:31:31.302083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:31:31.404139Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.404139Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:4d40cea05d5b7f93b550b5cb0e80ec637d189fd66d3820341ce24ed588848046","observation_id":"486d1769-54ed-4ed6-814e-148ce77bf323","resolution":{"observed_at":"2026-08-07T14:31:31.404139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.833623Z","title":null,"venue":null,"work_id":"9c82c745-508f-4b11-aaff-fb1dc5a7911d","year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.501559Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d83f39856daee85ffbcf1d3d6a5191a0c5fa4daa2ab1ff1a838d8b3eee2d7438","observation_id":"ad4c70ed-0f9d-4881-8530-01c739bcfa90","resolution":{"observed_at":"2026-08-07T14:31:34.866323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.595503Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.595503Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ebcac384521cc08e9223a1ba04ba666e1aa28f47d78db0262d435edc7d75f775","observation_id":"4f5a4533-f3d9-4977-952b-623bcea19b56","resolution":{"observed_at":"2026-08-07T14:31:31.595503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.666536Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.666536Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:03a28af10694df86a9876f44cdc65a55ace7e93cad6aa75b6460a1fe85083f3b","observation_id":"f4e31004-e61f-40c1-ba45-a31b184db5bf","resolution":{"observed_at":"2026-08-07T14:31:31.666536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-16T07:06:07.822225Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T14:31:31.761101Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.761101Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:892b4cd6519ca3d9c2cbe0b27b4ba4019b664ec794a2cf9496065ccb9a98bef0","observation_id":"8af8f3e5-bd33-4ce5-a54f-5072783ce989","resolution":{"observed_at":"2026-08-07T14:31:31.761101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T14:31:31.849387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.849387Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:e770492f0e9494d66b2ef98fcd768b8d5b783cd54d9fc6c5ec888c6253608730","observation_id":"e64c05be-3c0d-4cb6-af46-53873a7bc191","resolution":{"observed_at":"2026-08-07T14:31:31.849387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.679544Z","title":null,"venue":null,"work_id":"cdc9bb63-dbb1-4fe1-b514-045f6d32effa","year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.954501Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:98f0cd04aa864aedceaa9839b0ceb6913ef7822cd8de34aafb12c1056c85e8f2","observation_id":"b7d3b25c-f191-430c-ac8f-ed34f5a650f7","resolution":{"observed_at":"2026-08-07T14:31:34.735750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:31:32.052031Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.052031Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:1c2fe5d2716c3f4da48c8087218ce111f0fba006cb79c007d30c037f87d82daf","observation_id":"981ad702-cc8d-4d45-bd77-2154f2fa67ba","resolution":{"observed_at":"2026-08-07T14:31:32.052031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17875","last_updated":"2025-04-08T09:44:28Z","snapshot_observed_at":"2026-08-16T13:06:36.704680Z","submitted_at":"2024-10-23T13:47:05Z","title":"Understanding Layer Significance in LLM Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17875","snapshot_observed_at":"2026-08-07T14:31:32.111283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.111283Z"},"links":{"cited_paper":"/paper/2410.17875","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:935d995c8a3f229d6df44a08935b3464132123b40a6df6d30ce4e9945ff60b97","observation_id":"8dd4675c-195f-4605-bec4-b5cc7d9322ad","resolution":{"observed_at":"2026-08-07T14:31:32.111283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.153475Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.153475Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:9ab0c208522e0fe9657463cc329be8a5912ec949639a543921f06d8d8a01cee5","observation_id":"08d80dd0-3701-4fa8-9e2e-941934906b56","resolution":{"observed_at":"2026-08-07T14:31:32.153475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.197950Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.197950Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:c016f632f005ac4aa42f48a6a69fd1ace5ae9cf4f42b1504676b58cb816a70cf","observation_id":"bca95598-38e5-47ae-8c32-7f6f9d368cab","resolution":{"observed_at":"2026-08-07T14:31:32.197950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.265693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.265693Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:0b4d9467cedd6f9b79ba86da292f0032ee800f894af9603caecb73d9a06772c7","observation_id":"ca6c3d00-d951-4448-868e-786c362c07a0","resolution":{"observed_at":"2026-08-07T14:31:32.265693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15891","last_updated":"2024-07-22T01:12:23Z","snapshot_observed_at":"2026-08-16T13:32:18.250431Z","submitted_at":"2024-07-22T01:12:23Z","title":"RazorAttention: Efficient KV Cache Compression Through Retrieval Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15891","snapshot_observed_at":"2026-08-07T14:31:32.305566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.305566Z"},"links":{"cited_paper":"/paper/2407.15891","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5c8c1cdd7500827844033c32350ed364462912514f1f769552912b32a355fb1f","observation_id":"602385b1-1311-41ea-aaff-2b45caeb9329","resolution":{"observed_at":"2026-08-07T14:31:32.305566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.340173Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.340173Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5f1c982dfde15d9c7cfb37eebd34699f2a6ac48937a1b946534e67f66b14ed6b","observation_id":"c2ccc7ab-5162-428e-b9e7-c882c54a67d0","resolution":{"observed_at":"2026-08-07T14:31:32.340173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:31:32.380540Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.380540Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:e6cdc889d2e50d63ad0fb1e94a3d19bc034a2491e2b19c7e8aa980e3b705aef0","observation_id":"62ff896b-316e-4bae-bd48-54bc2cfc4364","resolution":{"observed_at":"2026-08-07T14:31:32.380540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.426928Z","title":null,"venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.426928Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:8fb3a5afe0a14c0f0320dae439b6fee9eb249f4e43e27c73d293514a5679c711","observation_id":"007b0abb-ea24-4321-b6f6-0491b3a7c4c4","resolution":{"observed_at":"2026-08-07T14:31:32.426928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09418","last_updated":"2019-06-07T14:00:58Z","snapshot_observed_at":"2026-08-14T16:28:06.194757Z","submitted_at":"2019-05-23T01:13:24Z","title":"Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09418","snapshot_observed_at":"2026-08-07T14:31:32.459562Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.459562Z"},"links":{"cited_paper":"/paper/1905.09418","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7b0f6634ca257b8827ee92279ebc6b75eef14e6dfb52d9e512e8aaeda09e7009","observation_id":"0347abd5-acf9-4974-b291-be8aaed9ab4e","resolution":{"observed_at":"2026-08-07T14:31:32.459562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-16T14:37:02.145931Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T14:31:32.512737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.512737Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:505bc2b31e50c29dc3a3495527fed8a4c083fa04394e8af9d35ea45e1932c475","observation_id":"3d0d45d0-175c-4d80-830d-6149eb3feeca","resolution":{"observed_at":"2026-08-07T14:31:32.512737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-15T15:06:42.719366Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T14:31:32.555070Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.555070Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b3d62f01e85236d8b637d22ebe25aaaefa749fec31b55af20624b62fda0db55b","observation_id":"e501691c-1645-4f2f-8dba-2eb2428502a2","resolution":{"observed_at":"2026-08-07T14:31:32.555070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-08-16T22:22:41.448725Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-07T14:31:32.600105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.600105Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:037aeeb1d29f46100909dbde29120231d7e3614a684fcc0dd4520b2d55b1e254","observation_id":"f4f0e6c6-28f6-4fdd-951a-3ef3c40320c6","resolution":{"observed_at":"2026-08-07T14:31:32.600105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15574","last_updated":"2024-04-24T00:24:03Z","snapshot_observed_at":"2026-08-16T13:58:20.510591Z","submitted_at":"2024-04-24T00:24:03Z","title":"Retrieval Head Mechanistically Explains Long-Context Factuality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15574","snapshot_observed_at":"2026-08-07T14:31:32.659055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.659055Z"},"links":{"cited_paper":"/paper/2404.15574","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:9e8b5b729495331897e4f094d011384461805d77cd4859012435f76860823166","observation_id":"06e312a4-ee12-416a-9d35-8c51fd801692","resolution":{"observed_at":"2026-08-07T14:31:32.659055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-07T14:31:32.737156Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.737156Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:eaa32820ee7cf202ded3be2673c9e2a9378248b7d5586137970a6726eafb5b11","observation_id":"67ea79f2-a1e4-4403-afe2-4ffb96e10d9f","resolution":{"observed_at":"2026-08-07T14:31:32.737156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:31:32.776824Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.776824Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:24527d570caa6604b729f6866fbccf3cf10c694bb115b5c1f00bca737c1e8756","observation_id":"50f67d49-6bb9-4674-89df-c916ae0d09e3","resolution":{"observed_at":"2026-08-07T14:31:32.776824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-14T16:00:41.902820Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T14:31:32.837071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.837071Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:1c1bcbb8d0a49112938fed39b251c1860256a37b84eee0b9f7782c2499d480ba","observation_id":"bd355200-13da-49af-9c8e-91d838aae586","resolution":{"observed_at":"2026-08-07T14:31:32.837071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-07T14:31:32.881126Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.881126Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:8b67ec3c38e50ad178187797352c3f4314f86383bb9ff638f58455317e541d6a","observation_id":"055e1336-85e1-4ffe-8fa6-302af0834c01","resolution":{"observed_at":"2026-08-07T14:31:32.881126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.925153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.925153Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d012c74d1b56ee42719aed8044de7eb03565e112e0892e1e94fecfe5f35c1cfc","observation_id":"a5f9e173-b3f6-45a3-bb56-2945050b15af","resolution":{"observed_at":"2026-08-07T14:31:32.925153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T14:31:32.962678Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.962678Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:092c6c9be844800196a36c07596a0a12ed4316b9495c6a56d1a0eee3abb7343e","observation_id":"d3d3c1e9-2f27-44b9-b215-65696141f1e7","resolution":{"observed_at":"2026-08-07T14:31:32.962678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-16T13:20:58.105083Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T14:31:33.035007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.035007Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:4bad7950155e1fd0fb6377209808fa02e83471e60e57153fcdfa753aa53f4eb7","observation_id":"698fa79a-24db-4df3-a301-20b075a410ff","resolution":{"observed_at":"2026-08-07T14:31:33.035007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.499679Z","title":null,"venue":null,"work_id":"0839370c-c520-490f-8b44-a3d41120beca","year":2022},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.075465Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:9f2fc73e3aea26f5d8c37dbfff5c1bf25e5133e377011eb897e23211563ce29e","observation_id":"35d71b34-931a-497d-afa2-bd2771374679","resolution":{"observed_at":"2026-08-07T14:31:34.560331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.117093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.117093Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:03b266e99877fc33dd159a6b68f8dc084a8a019a4462c597ea7acb0368b621c6","observation_id":"1422a35e-e4a2-479d-9136-1ef316589647","resolution":{"observed_at":"2026-08-07T14:31:33.117093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T14:31:33.160827Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.160827Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6cb58de75308ea094f98dd30bd2d84eb2edb78f9481db736fbe7ac47d67401b2","observation_id":"0d76108f-24e9-41f6-9e0b-36c2bfc2f040","resolution":{"observed_at":"2026-08-07T14:31:33.160827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13708","last_updated":"2025-02-24T13:31:08Z","snapshot_observed_at":"2026-08-16T13:08:20.800165Z","submitted_at":"2024-10-17T16:08:06Z","title":"On the Role of Attention Heads in Large Language Model Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13708","snapshot_observed_at":"2026-08-07T14:31:33.227557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.227557Z"},"links":{"cited_paper":"/paper/2410.13708","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d23d77833b722e3448a871b0473893e8a631ab23cd3b445501ac0f15e64b0dff","observation_id":"4a4f6db7-a64c-4f3a-ab37-4ce4e0fb6e08","resolution":{"observed_at":"2026-08-07T14:31:33.227557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T14:31:33.361615Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.361615Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:a4046dce13cd8aa08bd0989ad3ea8d515c77e017085279a6103f67bcf807c655","observation_id":"032b8859-a205-4604-9524-72f73f9d0da2","resolution":{"observed_at":"2026-08-07T14:31:33.361615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.464952Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.464952Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:701b186ae16578fca33a5a50cf09329933508ad27670968a45b5fd04c0e964cc","observation_id":"b20fdda5-bf19-437c-9b1e-c958a83cb0c8","resolution":{"observed_at":"2026-08-07T14:31:33.464952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.577852Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.577852Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:1ca0460c7abcdb3ca2c883831b7c77a3ab0afa36e923a14597fa00d08df4baf8","observation_id":"d1623b5a-688c-4ca2-b154-928c47276e75","resolution":{"observed_at":"2026-08-07T14:31:33.577852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T02:24:31.966526Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":69,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2505.18799."}