{"as_of":"2026-08-17T06:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b2ea3b0c2f77088df605495e494ba12a22af23c52e9d3d4fc2f680b0fc54f01","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:36:41.350934Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:15:26.587682Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T20:58:45.186838Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-11T16:14:05.493385Z","title":"Star attention: Efficient llm inference over long sequences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10319","last_updated":"2025-03-11T14:02:04Z","snapshot_observed_at":"2026-08-13T16:34:08.378180Z","submitted_at":"2024-12-13T17:59:52Z","title":"SCBench: A KV Cache-Centric Analysis of Long-Context Methods","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:14:05.493385Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2412.10319"},"observation_digest":"sha256:29dd12feb700e6c7f5eef8b3431db06668fcbbd202a40bc966e4ee5cccfd0b5a","observation_id":"18bfbac8-1a26-4962-a053-34f6e6c8b3d8","resolution":{"observed_at":"2026-08-11T16:14:05.493385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-16T11:15:26.587682Z","title":"Star attention: Efficient llm inference over long sequences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16083","last_updated":"2025-05-23T10:09:51Z","snapshot_observed_at":"2026-08-17T01:49:49.640398Z","submitted_at":"2025-04-22T17:59:51Z","title":"MMInference: Accelerating Pre-filling for Long-Context VLMs via Modality-Aware Permutation Sparse Attention","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:15:26.587682Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2504.16083"},"observation_digest":"sha256:ea34e18d29ee98848a8607f4bd3732d8dbc3df90e393238fd4c09746b2d1692e","observation_id":"f9b35de8-bd10-4615-9827-3803d1ede451","resolution":{"observed_at":"2026-08-16T11:15:26.587682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-16T01:07:10.282629Z","title":"Star attention: Effi- cient llm inference over long sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02130","last_updated":"2025-05-04T14:40:31Z","snapshot_observed_at":"2026-08-16T00:58:11.002878Z","submitted_at":"2025-05-04T14:40:31Z","title":"Attention Mechanisms Perspective: Exploring LLM Processing of Graph-Structured Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T01:07:10.282629Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2505.02130"},"observation_digest":"sha256:d30abdec6bda4066646d81fd34fe9728653ea2f63abe95a6268158d4ada75a6c","observation_id":"38c6e429-e0e5-4138-951d-fbd762d539dd","resolution":{"observed_at":"2026-08-16T01:07:10.282629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":"2411.17116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Star attention: Efficient llm inference over long sequences","venue":null,"work_id":"2beb00a5-f75f-403c-9c9b-7ea93e2516ed","year":2024},"citing_paper":{"arxiv_id":"2507.13334","last_updated":"2025-07-21T17:48:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-17T17:50:36Z","title":"A Survey of Context Engineering for Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T20:58:45.060041Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2507.13334"},"observation_digest":"sha256:2a2fe554f90ac55ec4b68714b56995f026eddf2318f561ad14d0989cad7328f0","observation_id":"6a8cd906-a9f6-4fec-8372-60b7704116aa","resolution":{"observed_at":"2026-05-13T20:58:45.189007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-06T05:40:47.963422Z","title":"Liu and N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01506","last_updated":"2025-08-02T22:06:46Z","snapshot_observed_at":"2026-08-11T12:32:12.006795Z","submitted_at":"2025-08-02T22:06:46Z","title":"FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:47.963422Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2508.01506"},"observation_digest":"sha256:4cff42da1a2d3c8499f9406595b055ad65a218d095b247dbeb9ec9d9f7eb9027","observation_id":"1cfa2c0e-7705-4dd1-9ec3-16a67d9e115a","resolution":{"observed_at":"2026-08-06T05:40:47.963422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-15T16:19:43.546665Z","title":"Star attention: Efficient llm inference over long sequences.arXiv preprint arXiv:2411.17116,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.546665Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:b28e081d6e1e01cf84053cbf414f085f27693b1f1deb6e372f45265463ce343b","observation_id":"d2a5b67c-64f8-4def-9291-00163c139acd","resolution":{"observed_at":"2026-08-15T16:19:43.546665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":"2411.17116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Star attention: Efficient llm inference over long sequences","venue":null,"work_id":"2beb00a5-f75f-403c-9c9b-7ea93e2516ed","year":2024},"citing_paper":{"arxiv_id":"2605.12491","last_updated":"2026-05-12T17:59:26Z","snapshot_observed_at":"2026-08-11T07:31:36.341334Z","submitted_at":"2026-05-12T17:59:26Z","title":"Elastic Attention Cores for Scalable Vision Transformers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T06:02:40.158866Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2605.12491"},"observation_digest":"sha256:b338cfb602d4d5d5a1b580a325c0fe49fe6bde333070da910b0d529b397dd605","observation_id":"3843c861-26e9-4101-8fae-6ba88205790d","resolution":{"observed_at":"2026-05-13T06:07:22.867587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.17116/citation-record","integrity":"/paper/2411.17116/integrity","json":"/paper/2411.17116/citation-record.json","paper":"/paper/2411.17116"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-12T12:36:41.267658Z","title":"E., and Cohan, A","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.267658Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:7eaa72106d3f28539452f687e2a4cc9d52cff1a4e1e6954e3d3710c38135cab4","observation_id":"301f6a37-141f-4bc5-b4f6-c97a85f30ef6","resolution":{"observed_at":"2026-08-12T12:36:41.267658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-12T12:36:41.277456Z","title":"Gemini 1.5: Unlocking multimodal under- standing across millions of tokens of context.arXiv preprint arXiv:2403.05530,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.277456Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:9c7b5fe57529ec27ac14942900a0b3888358114ef04b2df0b8b591b197280de3","observation_id":"cd71722d-799d-43bd-b7e4-decb6ed1cdf0","resolution":{"observed_at":"2026-08-12T12:36:41.277456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:36:41.695508Z","title":"Han, C., Wang, Q., Peng, H., Xiong, W., Chen, Y ., Ji, H., and Wang, S","venue":null,"work_id":"66c11124-f095-4d52-932a-0600af8819b6","year":2024},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.282198Z"},"links":{"citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:a10726f1eff9e30d5ff53408d8f135a362f5fcd67c4f20a4ae1fc8bc6e596bc4","observation_id":"bf781c6d-c133-4af4-9fec-7deb74e88ab0","resolution":{"observed_at":"2026-08-12T12:36:41.701500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-16T13:42:53.753710Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-12T12:36:41.286575Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a- Haystack.arXiv preprint arXiv:2406.10149,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.286575Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:9daeb54265d8b1949abead5c9c227c9d8c9e011ceb0a52a94083960daff589fd","observation_id":"4dcd3aeb-e5c3-4068-a020-9f3e56f0dae4","resolution":{"observed_at":"2026-08-12T12:36:41.286575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.02867","last_updated":"2018-07-28T06:51:27Z","snapshot_observed_at":"2026-08-14T19:17:44.982420Z","submitted_at":"2018-05-08T07:34:17Z","title":"Online normalizer calculation for softmax","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.02867","snapshot_observed_at":"2026-08-12T12:36:41.302149Z","title":"Milakov, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.302149Z"},"links":{"cited_paper":"/paper/1805.02867","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:3633452ad5af23a56143a42b9ef0180fdf8d9ef69a4276e6df67cf9ec8654b26","observation_id":"46bd833c-382d-4288-b642-f030dae59106","resolution":{"observed_at":"2026-08-12T12:36:41.302149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04658","last_updated":"2024-01-15T14:57:29Z","snapshot_observed_at":"2026-08-16T14:28:45.901634Z","submitted_at":"2024-01-09T16:27:28Z","title":"Lightning Attention-2: A Free Lunch for Handling Unlimited Sequence Lengths in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04658","snapshot_observed_at":"2026-08-12T12:36:41.312148Z","title":"10 Star Attention Qin, Z., Sun, W., Li, D., Shen, X., Sun, W., and Zhong, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.312148Z"},"links":{"cited_paper":"/paper/2401.04658","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:4baf2b49eba70be5e45e8bd2342a697361f3eb1cd2032b5de5df4fcbdd94de6d","observation_id":"69d28db5-5bf0-469c-843c-c6b71a31694f","resolution":{"observed_at":"2026-08-12T12:36:41.312148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-12T12:36:41.317759Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.317759Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:cec5f38230ec45af1696875c07dfd5854baa3e2076c2f6fc7bb36db5705aa7e5","observation_id":"0a9b9bb7-b475-411a-b7e7-ff870ece27f8","resolution":{"observed_at":"2026-08-12T12:36:41.317759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-12T12:36:41.325530Z","title":"Megatron-LM: Training multi- billion parameter language models using model paral- lelism.arXiv preprint arXiv:1909.08053,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.325530Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:8c6cc7ee2908bfd28368025459d7690e06ccdae47cfa9d4351570c92bd8756ce","observation_id":"eb18a738-74ae-43ce-b22f-a3927428df7a","resolution":{"observed_at":"2026-08-12T12:36:41.325530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05254","last_updated":"2024-05-09T14:12:45Z","snapshot_observed_at":"2026-08-16T13:54:15.781198Z","submitted_at":"2024-05-08T17:57:39Z","title":"You Only Cache Once: Decoder-Decoder Architectures for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05254","snapshot_observed_at":"2026-08-12T12:36:41.334337Z","title":"You only cache once: Decoder-decoder architectures for language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.334337Z"},"links":{"cited_paper":"/paper/2405.05254","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:a4e292727d9e6fd603065569a8b2121818a492da06f8757c161b098c08171a67","observation_id":"5b7f8d72-611b-43a4-9635-6f890c34e254","resolution":{"observed_at":"2026-08-12T12:36:41.334337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:36:41.663396Z","title":"Transformers: State-of- the-art natural language processing","venue":null,"work_id":"a0f439ef-1594-4d57-b5d0-9b208915bcb3","year":2020},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.338270Z"},"links":{"citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:5f9926280c560eaf69f6003bdd9dc2f6715c6cd4e9215764f313c519e8cd1aee","observation_id":"903c8dad-2c6c-4a2d-a563-e28baf4019d2","resolution":{"observed_at":"2026-08-12T12:36:41.669401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13649","last_updated":"2025-06-03T01:55:18Z","snapshot_observed_at":"2026-08-15T23:26:06.263693Z","submitted_at":"2024-12-18T09:27:33Z","title":"SCOPE: Optimizing Key-Value Cache Compression in Long-context Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13649","snapshot_observed_at":"2026-08-12T12:36:41.342234Z","title":"Scope: Optimizing key-value cache compression in long- context generation.arXiv preprint arXiv:2412.13649,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.342234Z"},"links":{"cited_paper":"/paper/2412.13649","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:0da33a7782382085d8262c8af544147d791dd4641bbc38c5bdfaa889dc501ad0","observation_id":"c94eed87-a0f5-4e72-a50c-2b594d8acd4a","resolution":{"observed_at":"2026-08-12T12:36:41.342234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04617","last_updated":"2024-05-28T12:05:12Z","snapshot_observed_at":"2026-08-16T14:20:44.078187Z","submitted_at":"2024-02-07T06:50:42Z","title":"InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04617","snapshot_observed_at":"2026-08-12T12:36:41.346014Z","title":"Infllm: Training-free long-context extrapolation for llms with an efficient context memory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.346014Z"},"links":{"cited_paper":"/paper/2402.04617","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:9b4615d3fd5139c7b9d56784b0a09f2ee87ce79528cf8693e01b51aedc24f70c","observation_id":"4b6c21d5-17ad-4e62-9f47-74640ea7368b","resolution":{"observed_at":"2026-08-12T12:36:41.346014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:36:41.644718Z","title":"Vanilla autoregressive generation encounters out-of-memory (OOM) at 128K sequence length","venue":null,"work_id":"595597c6-4702-48a1-8761-645b1cacd161","year":2020},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.350934Z"},"links":{"citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:581508a84fe7ae19c4c732d3183bcc4607e38244f031db906310ead2d9cbd290","observation_id":"648563e6-e92e-4f43-afc1-c39e26a21738","resolution":{"observed_at":"2026-08-12T12:36:41.652437Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07143","last_updated":"2024-08-09T22:37:25Z","snapshot_observed_at":"2026-08-02T14:27:24.212588Z","submitted_at":"2024-04-10T16:18:42Z","title":"Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07143","snapshot_observed_at":"2026-08-12T12:36:41.306215Z","title":"Leave no con- text behind: Efficient infinite context Transformers with infini-attention.arXiv preprint arXiv:2404.07143,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.306215Z"},"links":{"cited_paper":"/paper/2404.07143","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:30650a17b45248e252f5243ef510c89515e02bd47249ec6d5dc1feb9063b9876","observation_id":"11b0b415-67f1-482f-9a5d-6836d72b1c69","resolution":{"observed_at":"2026-08-12T12:36:41.306215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04093","last_updated":"2025-02-09T16:06:53Z","snapshot_observed_at":"2026-08-16T13:27:50.806670Z","submitted_at":"2024-08-07T21:16:55Z","title":"Tree Attention: Topology-aware Decoding for Long-Context Attention on GPU clusters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04093","snapshot_observed_at":"2026-08-12T12:36:41.329878Z","title":"Tree attention: Topology-aware decoding for long-context attention on gpu clusters.arXiv preprint arXiv:2408.04093,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.329878Z"},"links":{"cited_paper":"/paper/2408.04093","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:34a3b3f0fcf9ff56264faeafcade17efa067368a418a788ca2937d5c8919720a","observation_id":"9aba7698-778a-497d-99a9-9a11d8d01e13","resolution":{"observed_at":"2026-08-12T12:36:41.329878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-12T12:36:41.272002Z","title":"Gen- erating long sequences with sparse transformers.arXiv preprint arXiv:1904.10509,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.272002Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:949ff3d800393e65dedacf1f90e35027f36c3f072a71292b83b2330080a2288a","observation_id":"8de72b6c-7c7e-4006-a997-4f562f9c9dbb","resolution":{"observed_at":"2026-08-12T12:36:41.272002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:36:41.677386Z","title":"fb.com/2021/07/15/open-source/fsdp/","venue":null,"work_id":"3d31bed3-dc35-4b90-8060-0847f86e91cc","year":2021},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.298298Z"},"links":{"citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:1479f63063009bd01c4d0fbe202df8dd164d16b442aace792120e0ea2c6e99ff","observation_id":"32ccf8b2-e46e-4f02-bd3c-6bd7de36715c","resolution":{"observed_at":"2026-08-12T12:36:41.685551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06679","last_updated":"2026-04-14T06:50:10Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:44:35Z","title":"E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06679","snapshot_observed_at":"2026-08-12T12:36:41.294074Z","title":"E2llm: Encoder elongated large language models for long-context understanding and reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.294074Z"},"links":{"cited_paper":"/paper/2409.06679","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:ea688990a0de2b5410e9f632d4061c72eb884bc60e6ab2300eb8ec619df9820f","observation_id":"b5052458-e772-4053-be1d-3c580fef9266","resolution":{"observed_at":"2026-08-12T12:36:41.294074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00663","last_updated":"2024-12-31T22:32:03Z","snapshot_observed_at":"2026-08-16T10:45:05.594811Z","submitted_at":"2024-12-31T22:32:03Z","title":"Titans: Learning to Memorize at Test Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00663","snapshot_observed_at":"2026-08-12T12:36:41.261501Z","title":"Behrouz, A., Zhong, P., and Mirrokni, V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.261501Z"},"links":{"cited_paper":"/paper/2501.00663","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:dab27ef57364d0c44090bd2b8ed3b4dd2422ac87f14b5d54e61fa8ace463addc","observation_id":"c3b5315a-6d1b-4f98-a07e-80b483d7d2c8","resolution":{"observed_at":"2026-08-12T12:36:41.261501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14906","last_updated":"2024-08-27T09:34:38Z","snapshot_observed_at":"2026-08-16T13:23:34.421131Z","submitted_at":"2024-08-27T09:34:38Z","title":"Writing in the Margins: Better Inference Pattern for Long Context Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14906","snapshot_observed_at":"2026-08-12T12:36:41.321647Z","title":"Writing in the margins: Better inference pattern for long context retrieval.arXiv preprint arXiv:2408.14906,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:41.321647Z"},"links":{"cited_paper":"/paper/2408.14906","citing_paper":"/paper/2411.17116"},"observation_digest":"sha256:1766f2d57dad0b978eae1a5403be8c00fc6235526ce472d8bb9240480893f8c3","observation_id":"bad9a822-c269-4bf7-9ff2-2381dd7717ec","resolution":{"observed_at":"2026-08-12T12:36:41.321647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 7 inbound Pith citation observations for arXiv:2411.17116."}