{"as_of":"2026-08-20T09:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d44e3f14d66396b02ee32f5c4e6d3c76b35d87d1759060f58d901bfcd8548901","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T12:56:46.806841Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28263/citation-record","integrity":"/paper/2607.28263/integrity","json":"/paper/2607.28263/citation-record.json","paper":"/paper/2607.28263"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-31T12:56:44.612278Z","title":"Geoffrey Hinton, Oriol Vinyals, and Jeff Dean","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.612278Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:3464fbc5b0190a16eb7fb5c1c7fe73910919806c09cf7c300683e203164be6ee","observation_id":"5b257e32-d26d-40ff-9450-4edbb1cfdd63","resolution":{"observed_at":"2026-07-31T12:56:44.612278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-18T14:33:16.365411Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-07-31T12:56:44.892297Z","title":"Edward J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.892297Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:2f6957feedbf9f3d843a3e41bfcc1d72d5c5763bcf0d6ae084e6eeb2f72b940e","observation_id":"c72022f2-797a-4c62-8851-a4c96ce608b8","resolution":{"observed_at":"2026-07-31T12:56:44.892297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-19T19:49:59.264961Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-07-31T12:56:44.993564Z","title":"Yuri Kuratov et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.993564Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:d4df808c59abe82f4ba95d5f44d0cad632d5ec61d33e594431c9b5794b17ad4d","observation_id":"14ff5225-b6c4-4a1c-948b-b7bfa0922871","resolution":{"observed_at":"2026-07-31T12:56:44.993564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19384","last_updated":"2025-06-16T10:21:00Z","snapshot_observed_at":"2026-08-16T13:38:58.512138Z","submitted_at":"2024-06-27T17:57:03Z","title":"The Remarkable Robustness of LLMs: Stages of Inference?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19384","snapshot_observed_at":"2026-07-31T12:56:45.090058Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.090058Z"},"links":{"cited_paper":"/paper/2406.19384","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:e81756d2db083d5e779c3196dcbf110347ef80dbff123bb7aa0d7832d38be1d0","observation_id":"bf6cf282-fc70-4d4e-94e3-7cd519c5a8df","resolution":{"observed_at":"2026-07-31T12:56:45.090058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-14T12:21:04.886717Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-07-31T12:56:45.197106Z","title":"Xiaolin Lin, Jingcun Wang, Olga Kondrateva, Yiyu Shi, Bing Li, and Grace Li Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.197106Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:cfd7de58ec2ed0ce2c6427a7aef43e545c43c9fcd4f08df93e3d5dcfc4825bdf","observation_id":"dd146709-5cf9-4f84-98d1-c9e0529c2a2f","resolution":{"observed_at":"2026-07-31T12:56:45.197106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-08-18T21:03:31.332486Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.24467","snapshot_observed_at":"2026-07-31T12:56:45.291959Z","title":"Akide Liu, Jing Liu, Zizheng Pan, Yefei He, Gholam- reza Haffari, and Bohan Zhuang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.291959Z"},"links":{"cited_paper":"/paper/2606.24467","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:f894decc268b88040da50d8d1161342719d88a786172a6a54084ac4f9e2affe0","observation_id":"22bdc162-20b6-4d40-8af9-6cef3be9f150","resolution":{"observed_at":"2026-07-31T12:56:45.291959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-08-17T18:26:41.317652Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-31T12:56:45.432364Z","title":"Amirkeivan Mohtashami and Martin Jaggi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.432364Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:e62dec0a3fc68c4a8faf77b076922555745b2cb26e0922b35b08ffd102d2cf4b","observation_id":"a10ddebc-b201-4562-84f4-d81c5d510e62","resolution":{"observed_at":"2026-07-31T12:56:45.432364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16300","last_updated":"2023-11-20T01:16:17Z","snapshot_observed_at":"2026-08-20T07:41:48.705387Z","submitted_at":"2023-05-25T17:53:42Z","title":"Landmark Attention: Random-Access Infinite Context Length for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16300","snapshot_observed_at":"2026-07-31T12:56:45.516458Z","title":"Bowen Peng, Jeffrey Quesnelle, Honglu Fan, and Enrico Shippole","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.516458Z"},"links":{"cited_paper":"/paper/2305.16300","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:fddcca54cab66f76256e73339d77b19a7499ce500b01f75ecd5e6c560d001f0d","observation_id":"d26e740b-b28b-4095-be6d-f5b487faa1c7","resolution":{"observed_at":"2026-07-31T12:56:45.516458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-18T09:44:25.224559Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-07-31T12:56:45.589864Z","title":"Kaleem Ullah Qasim, Jiashu Zhang, Muhammad Kafeel Shaheen, Razan Alharith, and Heying Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.589864Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:68ced723dfaa9ea3b0ef3afe05f6ad66b38c5efe6ca0a46df260452fc6fde610","observation_id":"77902c20-8678-4c2e-9a89-59e4d2e6e36d","resolution":{"observed_at":"2026-07-31T12:56:45.589864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:45.699653Z","title":"arXiv preprint arXiv:2603.19664","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.699653Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:dd9584f0853a09b89d348a3d633ea80f1d3c8c61e3c7c7962679521082441ff7","observation_id":"2166dd7d-26f5-4ead-8f8e-6888b228ecb0","resolution":{"observed_at":"2026-07-31T12:56:45.699653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05254","last_updated":"2024-05-09T14:12:45Z","snapshot_observed_at":"2026-08-20T04:11:40.633970Z","submitted_at":"2024-05-08T17:57:39Z","title":"You Only Cache Once: Decoder-Decoder Architectures for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05254","snapshot_observed_at":"2026-07-31T12:56:45.924478Z","title":"Jiaming Tang, Yilong Zhao, Kan Zhu, Guangxuan Xiao, Baris Kasikci, and Song Han","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.924478Z"},"links":{"cited_paper":"/paper/2405.05254","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:5d210d32f90f5f71f67c6e118f6d975a77e6948329ba0afe056d38111160dc79","observation_id":"eb06958c-9289-4e84-b333-3ac60a66a525","resolution":{"observed_at":"2026-07-31T12:56:45.924478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03170","last_updated":"2023-11-30T17:15:34Z","snapshot_observed_at":"2026-08-16T15:18:09.665820Z","submitted_at":"2023-07-06T17:52:10Z","title":"Focused Transformer: Contrastive Training for Context Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03170","snapshot_observed_at":"2026-07-31T12:56:45.996091Z","title":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.996091Z"},"links":{"cited_paper":"/paper/2307.03170","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:90358cd066ae3639c8dc56650481b5841c7fcd5f2f35a40188ca20e27a5d6d81","observation_id":"d377100a-6afc-4bf7-acc6-d42127968a84","resolution":{"observed_at":"2026-07-31T12:56:45.996091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04624","last_updated":"2024-05-26T23:06:32Z","snapshot_observed_at":"2026-08-19T21:39:52.844100Z","submitted_at":"2024-02-07T07:14:11Z","title":"MEMORYLLM: Towards Self-Updatable Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04624","snapshot_observed_at":"2026-07-31T12:56:46.177620Z","title":"Haoyi Wu and Kewei Tu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.177620Z"},"links":{"cited_paper":"/paper/2402.04624","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:290597ad1569f60418eae758d2e3bb0195eadf8b9c46b7a6ce25cd55b3d6de3b","observation_id":"7642a1f2-9aac-4553-8f54-cffc0e58b46e","resolution":{"observed_at":"2026-07-31T12:56:46.177620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10637","last_updated":"2024-06-04T00:08:10Z","snapshot_observed_at":"2026-08-19T16:34:01.744867Z","submitted_at":"2024-05-17T08:59:46Z","title":"Layer-Condensed KV Cache for Efficient Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10637","snapshot_observed_at":"2026-07-31T12:56:46.292098Z","title":"arXiv preprint arXiv:2405.10637","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.292098Z"},"links":{"cited_paper":"/paper/2405.10637","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:78a40c0304ae0c75df4d40df42ec3c14d7f7b8f48f1bfd1df56faf0e7faca847","observation_id":"dc2c4eee-5961-41b9-800a-1342369c9d8b","resolution":{"observed_at":"2026-07-31T12:56:46.292098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16444","last_updated":"2025-04-03T22:49:22Z","snapshot_observed_at":"2026-08-19T22:56:32.061881Z","submitted_at":"2024-05-26T06:00:17Z","title":"CacheBlend: Fast Large Language Model Serving for RAG with Cached Knowledge Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16444","snapshot_observed_at":"2026-07-31T12:56:46.484066Z","title":"Howard Yen, Tianyu Gao, and Danqi Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.484066Z"},"links":{"cited_paper":"/paper/2405.16444","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:8a314b5654a845d8e6f99b28715bd8949ba3cc0cde6ae62cd09bb92ba83f4d12","observation_id":"246bac0e-0583-4083-ae8d-d7f5e39f296f","resolution":{"observed_at":"2026-07-31T12:56:46.484066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03462","last_updated":"2024-10-11T02:18:24Z","snapshot_observed_at":"2026-08-16T14:29:20.388697Z","submitted_at":"2024-01-07T11:57:40Z","title":"Long Context Compression with Activation Beacon","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03462","snapshot_observed_at":"2026-07-31T12:56:46.586819Z","title":"Zhenyu Zhang et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.586819Z"},"links":{"cited_paper":"/paper/2401.03462","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:9c956aca73ed9fe16fb72e683951f23e3d57200f61e526ca5f4189b4a3d75eea","observation_id":"56a026ec-e8b0-4b30-ada3-51ce465eab2a","resolution":{"observed_at":"2026-07-31T12:56:46.586819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:46.698287Z","title":"InNeurIPS","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.698287Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:6c95e521fca3fe32a492ad62202dba02816ecfc16b77652facf6550ed7122673","observation_id":"56c6f3a7-c37f-45e0-ad71-8748f98dc2b8","resolution":{"observed_at":"2026-07-31T12:56:46.698287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T12:56:46.806841Z","title":"†MemoryLLM uses a different chat-tuned backbone","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.806841Z"},"links":{"citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:83e04a7b54fcebcd4cdf7a2a9f73270dae6931615e80332cec092c227a56ea82","observation_id":"2053ddf8-536e-4843-82b6-62932083f24e","resolution":{"observed_at":"2026-07-31T12:56:46.806841Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-07-31T12:56:44.764763Z","title":"Cheng-Ping Hsieh et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.764763Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:32bdd521323b23e168525930b1c54bfd40f3f59a483b2858dda7795724cb5239","observation_id":"ebebcc82-b04e-4bc9-b2d1-8c3f2fd00856","resolution":{"observed_at":"2026-07-31T12:56:44.764763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15022","last_updated":"2025-08-25T14:43:13Z","snapshot_observed_at":"2026-08-19T21:56:38.196331Z","submitted_at":"2023-08-29T04:59:53Z","title":"Recursively Summarizing Enables Long-Term Dialogue Memory in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15022","snapshot_observed_at":"2026-07-31T12:56:46.074813Z","title":"InAdvances in Neural Information Pro- cessing Systems, volume 30, pages 5998–6008","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.074813Z"},"links":{"cited_paper":"/paper/2308.15022","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:2f1646d11cc75c76757910b7498a41a71de7a67c6d53d07697c8a12a6d0c9460","observation_id":"5129d7ef-986f-49e1-9161-c36d44b6fc21","resolution":{"observed_at":"2026-07-31T12:56:46.074813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-10T02:15:37.272323Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-07-31T12:56:45.774990Z","title":"Stephen Robertson and Hugo Zaragoza","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.774990Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:91feaf5c711eaac50bb1429435597066d56fee01c74d41b4f75483de78fd309f","observation_id":"7fcdedf1-afc9-4a53-8d29-2ed1fc60cea6","resolution":{"observed_at":"2026-07-31T12:56:45.774990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-31T12:56:45.848263Z","title":"arXiv preprint arXiv:2104.09864","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:45.848263Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:7de9edb18ff1a1f55ad3e677e393c38dbe7ddc07959fffce9c524c3a867c25c7","observation_id":"9b9b10e7-af59-439b-84b4-5bccc4e2235c","resolution":{"observed_at":"2026-07-31T12:56:45.848263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-07-31T12:56:44.371714Z","title":"arXiv preprint arXiv:2308.14508","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.371714Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:d67fe57a3448f3d8c244114e7fdd3ed1f1eca70f06d47c922bb8047b572e7720","observation_id":"e3440b2f-b3f3-44d2-bf0a-e6d85d53dfda","resolution":{"observed_at":"2026-07-31T12:56:44.371714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-07-31T12:56:44.434623Z","title":"Shiwei Gao, Youmin Chen, and Jiwu Shu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.434623Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:0003bfa7387e010513ddd5d09e8a4650fa605858d77dc7617e0d4b8d779be13e","observation_id":"0f018553-5d42-4941-a98d-0fec93bc3a9b","resolution":{"observed_at":"2026-07-31T12:56:44.434623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-31T12:56:46.369683Z","title":"Jiayi Yao et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:46.369683Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:ff1776bc87a663df65d1c4f4b38e46623280b769340f6be9d0c1fd83305fba3e","observation_id":"1591ab30-e8f3-4e69-b554-2d5d89ca6e6a","resolution":{"observed_at":"2026-07-31T12:56:46.369683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05971","last_updated":"2026-05-12T06:42:09Z","snapshot_observed_at":"2026-08-15T03:37:56.193816Z","submitted_at":"2026-05-07T10:17:55Z","title":"Training Transformers for KV Cache Compressibility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05971","snapshot_observed_at":"2026-07-31T12:56:44.516747Z","title":"Aaron Grattafiori et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T12:56:44.516747Z"},"links":{"cited_paper":"/paper/2605.05971","citing_paper":"/paper/2607.28263"},"observation_digest":"sha256:986e7f09704c307107d510d4abbe9fc17d539ff541a15bee2b9cabbee165a590","observation_id":"910c87a8-5fa8-45c2-84b1-25cfb63079ee","resolution":{"observed_at":"2026-07-31T12:56:44.516747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28263","last_updated":"2026-07-30T14:19:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T23:38:03.048468Z","submitted_at":"2026-07-30T14:19:11Z","title":"Understanding Is Done Early: A Depth Division of Labor in Large Language Models and Its Use for Unbounded-Context Memory"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.28263."}