{"as_of":"2026-08-09T15:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08f710eac7ec9490692c408b5f3ee599fb05a527bec90f34ce7dd28023679096","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:28:43.759802Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:31:36.983054Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T10:43:12.641152Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05431","snapshot_observed_at":"2026-08-06T22:31:36.983054Z","title":"Ape: Faster and longer context-augmented generation via adaptive parallel encoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22518","last_updated":"2025-06-26T17:40:23Z","snapshot_observed_at":"2026-08-08T15:30:14.084678Z","submitted_at":"2025-06-26T17:40:23Z","title":"Weak-to-Strong GraphRAG: Aligning Weak Retrievers with Large Language Models for Graph-based Retrieval Augmented Generation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T22:31:36.983054Z"},"links":{"cited_paper":"/paper/2502.05431","citing_paper":"/paper/2506.22518"},"observation_digest":"sha256:73dfe5ee555404423351707b611ae9c3bd78ecdcb1d7b54a71fe570455fd6055","observation_id":"af58e0d0-8ce4-44b2-bf49-48ae2336df7b","resolution":{"observed_at":"2026-08-06T22:31:36.983054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"cited_work":{"arxiv_id":"2502.05431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05431","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ape: Faster and longer context-augmented genera- tion via adaptive parallel encoding","venue":null,"work_id":"e126faae-55be-4605-811a-a0be9e704e8b","year":2025},"citing_paper":{"arxiv_id":"2605.18226","last_updated":"2026-05-18T11:12:45Z","snapshot_observed_at":"2026-07-06T23:29:09.538843Z","submitted_at":"2026-05-18T11:12:45Z","title":"Context Memorization for Efficient Long Context Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T10:39:09.720412Z"},"links":{"cited_paper":"/paper/2502.05431","citing_paper":"/paper/2605.18226"},"observation_digest":"sha256:8f703726b85e26f63aef7b52e2c67fbdb89dcce938b28f0dfea1f7117cb85170","observation_id":"90369c9d-5bf3-4330-8ee0-e8d51e65541c","resolution":{"observed_at":"2026-05-20T10:43:12.642761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05431/citation-record","integrity":"/paper/2502.05431/integrity","json":"/paper/2502.05431/citation-record.json","paper":"/paper/2502.05431"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T19:28:43.306048Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.306048Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:ed734fd7eeae90e51f52630b02b013b2b5e5cc28bd439840f0e74f7ab4c38793","observation_id":"a0551778-4d7a-4fdf-be07-a7609cbc3cec","resolution":{"observed_at":"2026-08-08T19:28:43.306048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-08T19:28:43.322808Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.322808Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:d2e0dacdadad132d660ec110711410f5b2bb2c093c6b1bfc80348f2f536397df","observation_id":"902a225d-5e90-4a2d-bdd7-a26461ddc749","resolution":{"observed_at":"2026-08-08T19:28:43.322808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11527","last_updated":"2021-02-16T08:06:47Z","snapshot_observed_at":"2026-08-06T15:16:24.323857Z","submitted_at":"2020-06-20T09:06:27Z","title":"Memory Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11527","snapshot_observed_at":"2026-08-08T19:28:43.328174Z","title":"Memory transformer","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.328174Z"},"links":{"cited_paper":"/paper/2006.11527","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:ee9675ded2b39bfb92cea3df925e5ef6e6cdf5d1a709965d50aff7511f7aa99e","observation_id":"113438f2-eed1-4eae-998e-69c94f897aa6","resolution":{"observed_at":"2026-08-08T19:28:43.328174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T19:28:43.338271Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.338271Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:d67b530b1b4c6e96548595b341f5693322f5949edea52216892e3e7962d46942","observation_id":"474603cd-cc3e-4626-bf23-1319be869baf","resolution":{"observed_at":"2026-08-08T19:28:43.338271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06176","last_updated":"2022-04-19T18:33:22Z","snapshot_observed_at":"2026-08-01T06:55:19.645605Z","submitted_at":"2021-10-12T17:19:05Z","title":"Mention Memory: incorporating textual knowledge into Transformers through entity mention attention","version":2},"cited_work":{"arxiv_id":"2110.06176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.06176","snapshot_observed_at":"2026-08-08T19:28:44.301721Z","title":"Mention Memory: incorporating textual knowledge into Transformers through entity mention attention","venue":"cs.CL","work_id":"40bfb832-3d3e-4198-b3e0-f409693584ca","year":2021},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.343711Z"},"links":{"cited_paper":"/paper/2110.06176","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:f718ada1933ac83f51c123d5e3b379f8d9685431393a90a05bb9e4970824e1e6","observation_id":"3aad025f-6a2a-474a-aa6c-a7ccd4d0567e","resolution":{"observed_at":"2026-08-08T19:28:44.326383Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-08T19:28:43.364548Z","title":"The faiss library.arXiv preprint arXiv:2401.08281 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.364548Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:4196c354720603a08a59f264480753b6b889f502ee6035cb78dc2d190e045b92","observation_id":"2726cdda-454e-41ab-a5e3-d1a8d808215c","resolution":{"observed_at":"2026-08-08T19:28:43.364548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T19:28:43.394772Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.394772Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:685b1b390e4f96e26d366e5f5364d63e67aae5d14ffb9d2533c8b3103d07c187","observation_id":"75e7f1b8-3fa2-40d8-a19f-395173e4b988","resolution":{"observed_at":"2026-08-08T19:28:43.394772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01749","last_updated":"2019-06-19T20:26:03Z","snapshot_observed_at":"2026-08-08T10:48:35.193618Z","submitted_at":"2019-06-04T23:00:43Z","title":"Multi-News: a Large-Scale Multi-Document Summarization Dataset and Abstractive Hierarchical Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01749","snapshot_observed_at":"2026-08-08T19:28:43.420237Z","title":"Multi-news: A large-scale multi-document summarization dataset and abstractive hierarchical model","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.420237Z"},"links":{"cited_paper":"/paper/1906.01749","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:74af3bd360b1da2aed335d8c50f4cfc259fb9e69b8e10c9ee3584522e8cb60a5","observation_id":"056f7750-464e-44f8-bb30-fb714f4812d9","resolution":{"observed_at":"2026-08-08T19:28:43.420237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:28:43.431194Z","title":"Yunfan Gao, Yun Xiong, Xinyu Gao, Kangxiang Jia, Jinliu Pan, Yuxi Bi, Yi Dai, Jiawei Sun, and Haofen Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.431194Z"},"links":{"citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:22f219e321af43092ba75598b7029b5cbadc7995a0744a4886c9eab110ae2307","observation_id":"8fe56828-d11b-493f-8e9c-9c254f4da02f","resolution":{"observed_at":"2026-08-08T19:28:43.431194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08406","last_updated":"2024-01-30T13:55:34Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T14:44:47Z","title":"RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08406","snapshot_observed_at":"2026-08-08T19:28:43.436028Z","title":"Rag vs fine-tuning: Pipelines, tradeoffs, and a case study on agriculture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.436028Z"},"links":{"cited_paper":"/paper/2401.08406","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:07b28279a835b8731558c5d3dc19eb6f46ee889972497be326b15bc92df7c7b5","observation_id":"15e398b9-1767-4aad-a10d-23fb85fb751e","resolution":{"observed_at":"2026-08-08T19:28:43.436028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T19:28:43.440664Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.440664Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:3809fef2593fe8e5acefeb3c48d841b26bf59e777eb14adffebbf9f3fc3e5f2b","observation_id":"645247e7-a812-472a-b220-6f9b792e2cb3","resolution":{"observed_at":"2026-08-08T19:28:43.440664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T19:28:43.450475Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.450475Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:3950d6cb70e81cf6bd4ed537ede7ef810b1b40ae81ce9afaab225d89286c2c6e","observation_id":"83ebd8ad-f31d-47dd-876e-b09ce0f4d810","resolution":{"observed_at":"2026-08-08T19:28:43.450475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02490","last_updated":"2024-10-30T14:53:22Z","snapshot_observed_at":"2026-08-07T20:59:29.819833Z","submitted_at":"2024-07-02T17:59:56Z","title":"MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02490","snapshot_observed_at":"2026-08-08T19:28:43.455099Z","title":"Minference 1.0: Accelerating pre-filling for long-context llms via dynamic sparse attention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.455099Z"},"links":{"cited_paper":"/paper/2407.02490","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:4657ace8462756f089d9e0f85225968d6d43fa1d53a00a3dbce27aafe51f2962","observation_id":"869c4170-945e-4fed-824b-5686e7ea904b","resolution":{"observed_at":"2026-08-08T19:28:43.455099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-08T19:28:43.459763Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.459763Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:0153a1fd33f42e97cdaf95305472d7604ea33a17232f880ba1b5408167672dd7","observation_id":"64922e7d-6c64-4904-a360-28e1d92e09be","resolution":{"observed_at":"2026-08-08T19:28:43.459763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13121","last_updated":"2024-06-19T00:28:58Z","snapshot_observed_at":"2026-07-06T18:33:24.206083Z","submitted_at":"2024-06-19T00:28:58Z","title":"Can Long-Context Language Models Subsume Retrieval, RAG, SQL, and More?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13121","snapshot_observed_at":"2026-08-08T19:28:43.472132Z","title":"Can long-context language models subsume retrieval, rag, sql, and more? arXiv preprint arXiv:2406.13121 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.472132Z"},"links":{"cited_paper":"/paper/2406.13121","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:372d4671031311c15f675fb3376d0abba751f45e0bdc45aee78b97f0f0e18763","observation_id":"b961bae0-5992-4ce4-acbb-c474c54d87db","resolution":{"observed_at":"2026-08-08T19:28:43.472132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03281","last_updated":"2023-08-07T03:52:59Z","snapshot_observed_at":"2026-08-04T23:10:23.964516Z","submitted_at":"2023-08-07T03:52:59Z","title":"Towards General Text Embeddings with Multi-stage Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03281","snapshot_observed_at":"2026-08-08T19:28:43.517331Z","title":"Towards general text embeddings with multi-stage contrastive learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.517331Z"},"links":{"cited_paper":"/paper/2308.03281","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:ca19b26f5e837b77b037c352366d9c18caf63074eb3a5baf3aae52f670e6165e","observation_id":"0031ee46-c419-4e2f-a871-ac858000664f","resolution":{"observed_at":"2026-08-08T19:28:43.517331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11745","last_updated":"2024-12-23T15:36:32Z","snapshot_observed_at":"2026-07-06T19:04:09.389583Z","submitted_at":"2024-08-21T16:11:59Z","title":"FocusLLM: Precise Understanding of Long Context by Dynamic Condensing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11745","snapshot_observed_at":"2026-08-08T19:28:43.569455Z","title":"Focusllm: Scaling llm’s context by parallel decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.569455Z"},"links":{"cited_paper":"/paper/2408.11745","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:fc8e57290b26ac5bf1221117064db5c89b234c01d7abbcc83857baaf5d3fc48b","observation_id":"34fe0776-94ca-4ed2-ba5f-a712a68bc9fa","resolution":{"observed_at":"2026-08-08T19:28:43.569455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12968","last_updated":"2024-08-12T04:48:11Z","snapshot_observed_at":"2026-08-08T18:14:49.192773Z","submitted_at":"2024-03-19T17:59:56Z","title":"LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12968","snapshot_observed_at":"2026-08-08T19:28:43.581431Z","title":"Llmlingua-2: Data distillation for efficient and faithful task-agnostic prompt compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.581431Z"},"links":{"cited_paper":"/paper/2403.12968","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:f9c14fcfc03aed2c04ea8f471717056ce15c0c2c7a04002793de51406c6fe362","observation_id":"39a663c5-0200-42f1-856a-ae6d7ff071d7","resolution":{"observed_at":"2026-08-08T19:28:43.581431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-08T19:28:43.586788Z","title":"Train short, test long: Attention with linear biases enables input length extrapolation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.586788Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:c7e20afbf2838d7065e6b25d0bcfbebe822a06f9b7a4d608d722c97dd741e8f3","observation_id":"7aac8b85-0e6b-4fa0-a156-9f2ed6427d74","resolution":{"observed_at":"2026-08-08T19:28:43.586788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10947","last_updated":"2023-08-01T16:48:47Z","snapshot_observed_at":"2026-08-02T02:45:49.220555Z","submitted_at":"2022-12-21T11:38:51Z","title":"Parallel Context Windows for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10947","snapshot_observed_at":"2026-08-08T19:28:43.591899Z","title":"Parallel context windows for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.591899Z"},"links":{"cited_paper":"/paper/2212.10947","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:2378dead64bbe32c51d08dc962864b2b773313202b7767830674bcc89eccb4f5","observation_id":"ca803020-9500-4a76-be64-425cfb1eb168","resolution":{"observed_at":"2026-08-08T19:28:43.591899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15355","last_updated":"2025-04-13T14:02:47Z","snapshot_observed_at":"2026-08-02T02:55:00.804211Z","submitted_at":"2024-09-14T02:34:26Z","title":"Block-Attention for Efficient Prefilling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15355","snapshot_observed_at":"2026-08-08T19:28:43.596934Z","title":"Block-attention for efficient rag","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.596934Z"},"links":{"cited_paper":"/paper/2409.15355","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:bc90b25de2a2e72ec7db3c52c21c6e161fd645590ba2ea73dd84f074319f2784","observation_id":"6fdb970b-33dd-4543-bf71-6990a9779315","resolution":{"observed_at":"2026-08-08T19:28:43.596934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T19:28:43.601752Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.601752Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:e5b18eefd814f0f039d538e60b5120404ba37ebd62a5a107aeb1c1ce85c6cecc","observation_id":"f1464f1d-834b-42ec-84ee-843dc87b1a08","resolution":{"observed_at":"2026-08-08T19:28:43.601752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-08T19:28:43.612246Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.612246Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:d2495b6c96452172a205231a9b6f269b6acc355d004a9594e21027549da835c3","observation_id":"caf6f47e-ce7d-42bf-86a5-364f1ed8d147","resolution":{"observed_at":"2026-08-08T19:28:43.612246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04744","last_updated":"2024-11-01T05:30:17Z","snapshot_observed_at":"2026-08-03T17:59:39.795742Z","submitted_at":"2024-06-07T08:43:07Z","title":"CRAG -- Comprehensive RAG Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04744","snapshot_observed_at":"2026-08-08T19:28:43.617686Z","title":"Crag–comprehensive rag benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.617686Z"},"links":{"cited_paper":"/paper/2406.04744","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:e25caa129dea6dd69b887ab03f46b9cd40b83bc7e0b74a9d63611eeba293a220","observation_id":"b01b69e4-0a6b-49d4-833d-391e8b0a428a","resolution":{"observed_at":"2026-08-08T19:28:43.617686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-09T10:11:58.541007Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-08T19:28:43.651666Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.651666Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:2f584f3fdb80f3c62ac43e2478696d3f610c27becc816fa7a902e6eb0a73491b","observation_id":"6a74cab3-07f0-461e-aea1-95a742dfcdf5","resolution":{"observed_at":"2026-08-08T19:28:43.651666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16617","last_updated":"2024-06-11T18:54:13Z","snapshot_observed_at":"2026-08-06T05:28:31.850302Z","submitted_at":"2024-02-26T14:47:35Z","title":"Long-Context Language Modeling with Parallel Context Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16617","snapshot_observed_at":"2026-08-08T19:28:43.720166Z","title":"Long-context language modeling with parallel context encoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.720166Z"},"links":{"cited_paper":"/paper/2402.16617","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:2280c99c6d19b79e3c200eefa1268c0379a5191817cd6f1cd039a76a8ad9cce8","observation_id":"0888372b-f2a0-4b83-b354-c61d8b0fa1d6","resolution":{"observed_at":"2026-08-08T19:28:43.720166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:28:44.492994Z","title":"Qdrant, 2024.https://qdrant.tech/","venue":null,"work_id":"63a48da0-2f3a-4f5e-b4e7-d7f7dd78dacf","year":2024},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.747887Z"},"links":{"citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:2dcb23fbcd24548f10176053437681a2512d2236bbdc470b5a0ea1068821df00","observation_id":"a73a56d5-7680-4e47-af8e-d98de4528697","resolution":{"observed_at":"2026-08-08T19:28:44.497879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:28:44.477510Z","title":"(2017), and MMLU (Hendrycks et al., 2020b)","venue":null,"work_id":"186f20c0-758e-441a-b4c5-9504e0ff7ee3","year":2017},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.753881Z"},"links":{"citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:d6a8f12d377a57dc60a7c8e5e2fe809ff70f4fb780e7d7b294430cd461016af1","observation_id":"b3d416ec-ca69-43ad-abbf-c0a8d6f626e0","resolution":{"observed_at":"2026-08-08T19:28:44.482139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:28:44.460154Z","title":null,"venue":null,"work_id":"30cfa503-1adc-40d6-bd18-72815d069c7e","year":2024},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.759802Z"},"links":{"citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:4fc5a2da143e2a3b770d6126aedaee1f05b8601db086a58d75b1e6c5cf433422","observation_id":"e31b7ed3-fc7a-4017-b4c9-d55e500776be","resolution":{"observed_at":"2026-08-08T19:28:44.465521Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-08T19:28:43.606824Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.606824Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:31fbdc4b4efd91948f22603d91fa2441af8c70678c6b6611f493bc68cbeaba1d","observation_id":"11627c03-34dc-489f-9262-f71ecc3c307f","resolution":{"observed_at":"2026-08-08T19:28:43.606824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-08T19:28:43.353389Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.353389Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:d33ec44164be52fb523027cdda07a92cb2aeaec03fa72ec7f84f05ea1227f459","observation_id":"124afffb-51fa-4940-97fc-bc32e31eebbb","resolution":{"observed_at":"2026-08-08T19:28:43.353389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07202","last_updated":"2020-10-06T19:00:27Z","snapshot_observed_at":"2026-08-08T19:46:34.152150Z","submitted_at":"2020-04-15T17:00:05Z","title":"Entities as Experts: Sparse Memory Access with Entity Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07202","snapshot_observed_at":"2026-08-08T19:28:43.425662Z","title":"Entities as experts: Sparse memory access with entity supervision","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.425662Z"},"links":{"cited_paper":"/paper/2004.07202","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:b60f8e3ba96f9d76555aded4c77d9266c8f4193c5e425d81d5dc3e0a6cc09d7c","observation_id":"8763abe9-b4b2-4851-b077-692a257ca601","resolution":{"observed_at":"2026-08-08T19:28:43.425662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09118","last_updated":"2022-08-29T12:17:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-16T18:57:37Z","title":"Unsupervised Dense Information Retrieval with Contrastive Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09118","snapshot_observed_at":"2026-08-08T19:28:43.445641Z","title":"Unsupervised dense information retrieval with contrastive learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.445641Z"},"links":{"cited_paper":"/paper/2112.09118","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:4ce9a930063f3bb54278941b3fb987eb1e35523b46099e970778a70dfcc47057","observation_id":"5017cef2-2a3e-4be4-a74b-fcf3063ad37e","resolution":{"observed_at":"2026-08-08T19:28:43.445641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T19:28:43.348345Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.348345Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:aa0af20aab8dd45acf7be682c8c97d7dc45f829eefc79e29713b6a6698588f22","observation_id":"bae0c3c1-7a69-4e91-998e-f7c67bc63267","resolution":{"observed_at":"2026-08-08T19:28:43.348345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-08T19:28:43.333199Z","title":"Shouyuan Chen, Sherman Wong, Liangjian Chen, and Yuandong Tian","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.333199Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:fcd0e97c3e02fd886db964333216169ebf64f36036683e8d06fd5b093b0299bc","observation_id":"c7e440b4-8fcc-4f36-af4f-daa8441009f6","resolution":{"observed_at":"2026-08-08T19:28:43.333199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-08T19:28:43.311989Z","title":"Many-shot in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.311989Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:ad1353245d2c3424027543f9fb4901e03123a39f23b4f4023d13b32da5b4c39f","observation_id":"7c28b9c9-f8ff-4321-b2c4-bc0b18b67475","resolution":{"observed_at":"2026-08-08T19:28:43.311989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03187","last_updated":"2024-03-05T18:22:33Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:22:33Z","title":"Reliable, Adaptable, and Attributable Language Models with Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03187","snapshot_observed_at":"2026-08-08T19:28:43.317352Z","title":"Reliable, adaptable, and attributable language models with retrieval","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.317352Z"},"links":{"cited_paper":"/paper/2403.03187","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:bbb0f06496748aa4eac11f25581e274b2bcb90fe030b8af60a8b50cdc2a93e7c","observation_id":"4d8f61f1-50a2-41a9-9d63-d87e6fc236c7","resolution":{"observed_at":"2026-08-08T19:28:43.317352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T19:19:35.161573Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 2 inbound Pith citation observations for arXiv:2502.05431."}