{"as_of":"2026-08-10T05:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af2d9f76f867028dc102facd87e7c908b8c9f11592bcbf9a419f5e0ec11f4076","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:15:02.874621Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01662/citation-record","integrity":"/paper/2608.01662/integrity","json":"/paper/2608.01662/citation-record.json","paper":"/paper/2608.01662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:59.740078Z","title":"Scaling embeddings outperforms scaling experts in language models.arXiv preprint arXiv:2601.21204,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.740078Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:0e4483d470b480f0c94905d55963d9a4d62c49a29379310aa7ad64f076c83f90","observation_id":"e1b16cfd-495f-47ae-8111-e925a19ad3bf","resolution":{"observed_at":"2026-08-07T00:14:59.740078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-07T00:14:59.821069Z","title":"Generating long sequences with sparse transformers.arXiv preprint arXiv:1904.10509,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.821069Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:34e3b8b9bfa18caf5a9faeba529424a3f014f7e3adfa7df1f720dc79c9ac1920","observation_id":"6f8f5671-8f20-460f-98a7-5b85b9dd86b4","resolution":{"observed_at":"2026-08-07T00:14:59.821069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:04.505023Z","title":"One of the special magic uuids for <key> is: <value>","venue":null,"work_id":"48c46c97-69de-40af-a893-afb7537ce4e1","year":2000},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.764834Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:72412d71ce5d5df0156118104c9bdf1fa6e2fccda52230020f7e8fd337339aa4","observation_id":"9f1fa715-f51c-46d8-86f0-3e8c51e1ed6a","resolution":{"observed_at":"2026-08-07T00:15:04.590583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-07T00:15:00.076452Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.076452Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:2202a0d8fda9254049295cfa4ee471b79d9a149b4413c1e1753ac105586f8bd0","observation_id":"702f69cd-b4d2-4895-a7fb-9a0f6c7b9e49","resolution":{"observed_at":"2026-08-07T00:15:00.076452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-07T00:15:00.118390Z","title":"Fast transformer decoding: One write-head is all you need.arXiv preprint arXiv:1911.02150,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.118390Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:ad3e7f593769d9e5e7da5eacb36d94465536a3bd9bc2e22d49a948e58fec9ec9","observation_id":"52174d3d-a955-4b17-a3e3-1002ef8862be","resolution":{"observed_at":"2026-08-07T00:15:00.118390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T00:15:00.222968Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model.arXiv preprint arXiv:2405.04434, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.222968Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:c9bdbe47d7f61bdf18bab4a165513de696fbb15e105427851d7c5b5f1cbcbcc4","observation_id":"53c7ab1a-1668-480a-bfff-c9e4380598e3","resolution":{"observed_at":"2026-08-07T00:15:00.222968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:00.328533Z","title":"Longcat-flash technical report.arXiv preprint arXiv:2509.01322,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.328533Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:71f7ca86c69fbae2b6169eb0618d3b93a056fa7305f45087177db2c262e97c09","observation_id":"7b91b98f-a8c3-4b7c-8d0c-8572c21d73d5","resolution":{"observed_at":"2026-08-07T00:15:00.328533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:00.418924Z","title":"Indexcache: Accelerating sparse attention via cross-layer index reuse.arXiv preprint arXiv:2603.12201,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.418924Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:48cc385da8d7e91ce5d264df5bf6df5925d2d2e48d156b6ca7536827abefc769","observation_id":"019db5bc-56a4-48fb-9fa3-b57f9cde2e96","resolution":{"observed_at":"2026-08-07T00:15:00.418924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-07T00:15:00.494998Z","title":"Helmet: How to evaluate long-context language models effectively and thoroughly.arXiv preprint arXiv:2410.02694,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.494998Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:6c2dcc4af7a604a8dbdc4c9ecd7e3f836f6a1c6c281c201bdc52b830117a98d6","observation_id":"45d857b8-dd7b-4310-abb1-374c8be88b12","resolution":{"observed_at":"2026-08-07T00:15:00.494998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-07T00:15:00.585567Z","title":"Ruler: What’s the real context size of your long-context language models?arXiv preprint arXiv:2404.06654,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.585567Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:7e8fc2a6695edcd809018b65d484ae276349a5a4ede3a67e10638eaff8cacc61","observation_id":"e15616c0-be7d-4e78-958d-11423f95cb42","resolution":{"observed_at":"2026-08-07T00:15:00.585567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:05.733096Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":"b5d788de-ba60-491a-b5d6-3e63f2b77ce8","year":2018},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.655639Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:e6006a47abac56bcce4256cea120d9db52be731ebeed70cf2148c7e68f016acf","observation_id":"116aabc7-a463-4806-b8cb-df4a68baae96","resolution":{"observed_at":"2026-08-07T00:15:05.768803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T00:15:00.919480Z","title":"Xinrong Zhang, Yingfa Chen, Shengding Hu, Zihang Xu, Junhao Chen, Moo Khai Hao, Xu Han, Zhen Leng Thai, Shuo Wang, Zhiyuan Liu, and Maosong Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.919480Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:dbf78ecf59cda5151f2304c7ba21c9ce17be44271d90f43c6a1f5118050b2901","observation_id":"034893be-4464-47b1-933e-19a3fabebe93","resolution":{"observed_at":"2026-08-07T00:15:00.919480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:05.521842Z","title":"Enabling large language models to generate text with citations","venue":null,"work_id":"26f3053f-7e7b-47b9-8d4a-1f8c91509a8b","year":2023},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.987295Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:1cb8cbec957239e90b450c90605e668ca5940bf6bcc47e41af46402016278f51","observation_id":"6bb453d7-773a-4300-8d67-f6e1d6d0323c","resolution":{"observed_at":"2026-08-07T00:15:05.633879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:05.298272Z","title":"ASQA: Factoid questions meet long-form answers","venue":null,"work_id":"47af384c-f6ab-431b-a690-1ae70963c369","year":2022},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.092372Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:06f70acc9cb0e1ca053fdcfc4573316017cecef491d911fae862f9142a89db4c","observation_id":"37de51b9-967c-436a-afda-c6f2fb7760ed","resolution":{"observed_at":"2026-08-07T00:15:05.385070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T00:15:01.342992Z","title":"Gonzalez, Ion Stoica, Xuezhe Ma, and Hao Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.342992Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:5fe1195de09bc3c25b3481b324980802dc4852f03eada8bbf950df11d295bd04","observation_id":"ad97260d-dd9f-40ee-909f-7c7ebfd7fc85","resolution":{"observed_at":"2026-08-07T00:15:01.342992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-07T00:15:01.418782Z","title":"Cmmlu: Measuring massive multitask language understanding in chinese.arXiv preprint arXiv:2306.09212, 2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.418782Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:89f2cad1491bb12447093943d9068cb97de17586332188d006c3d205fae8b8d2","observation_id":"6fb0e280-080f-4f24-91ae-fef0dd6292ac","resolution":{"observed_at":"2026-08-07T00:15:01.418782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T00:15:01.496864Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.496864Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:dca968fca83e89542abd36cd2694d16e33821bab23a84aa60a990422dab85452","observation_id":"9ae670a3-6f2b-498e-ba8e-fdf8b528eb38","resolution":{"observed_at":"2026-08-07T00:15:01.496864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:05.072872Z","title":"Measuring mathematical problem solving with the math dataset.Advances in Neural Information Processing Systems, 34, 2021b","venue":null,"work_id":"d26f0d21-a22c-4fb0-9e58-86f7e443793a","year":2024},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.584498Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:a7bc35dbd4e717ff8d6b6c629c9afacf919da59cfa9548ed3d8215fc3fc41b61","observation_id":"aab2b90d-3835-4ec9-afc4-15db884d2536","resolution":{"observed_at":"2026-08-07T00:15:05.208704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:04.782322Z","title":null,"venue":null,"work_id":"9a917aa5-2dbd-430e-ab4e-958ddbeb1124","year":2025},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.634284Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:90228153396794eff04adcc72c9a785c046675f8c4a3071e901e8b2e14a03d7e","observation_id":"d1ac78a3-4284-4036-a7a3-9121c2e7db91","resolution":{"observed_at":"2026-08-07T00:15:04.942080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:01.703012Z","title":"Naman Jain, King Han, Alex Gu, Wen-Ding Li, Fanjia Yan, Tianjun Zhang, Sida Wang, Armando Solar-Lezama, Koushik Sen, and Ion Stoica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.703012Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:f444acc529499d96147c2c3c890530ddc4d680e7cfeffa44545ce8ed47b61b5b","observation_id":"89ce7e4c-62bd-46d9-86ab-d0bc1bfe1dfb","resolution":{"observed_at":"2026-08-07T00:15:01.703012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07815","last_updated":"2026-04-09T05:15:16Z","snapshot_observed_at":"2026-07-06T22:57:05.146373Z","submitted_at":"2026-04-09T05:15:16Z","title":"AsyncTLS: Efficient Generative LLM Inference with Asynchronous Two-level Sparse Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07815","snapshot_observed_at":"2026-08-07T00:15:01.779702Z","title":"Asynctls: Efficient generative llm inference with asynchronous two-level sparse attention.arXiv preprint arXiv:2604.07815,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.779702Z"},"links":{"cited_paper":"/paper/2604.07815","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:5bd85d5622639e25d0636d714f17370898408b3783288b7a7a0994ead558faa3","observation_id":"a8724515-b994-4f3f-a9a1-6f2b7596e9a0","resolution":{"observed_at":"2026-08-07T00:15:01.779702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28458","last_updated":"2026-04-06T09:47:34Z","snapshot_observed_at":"2026-08-02T11:27:36.874895Z","submitted_at":"2026-03-30T13:59:51Z","title":"HISA: Efficient Hierarchical Indexing for Fine-Grained Sparse Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.28458","snapshot_observed_at":"2026-08-07T00:15:01.857982Z","title":"Hisa: Efficient hierarchical indexing for fine-grained sparse attention.arXiv preprint arXiv:2603.28458, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.857982Z"},"links":{"cited_paper":"/paper/2603.28458","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:ddd8d284947bc6c8c8a1146810b72a0e126eec2b34163304364551ac836bdfe6","observation_id":"d6c7b396-b7b6-4d76-8830-121b22e8f1e1","resolution":{"observed_at":"2026-08-07T00:15:01.857982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13121","last_updated":"2024-06-19T00:28:58Z","snapshot_observed_at":"2026-07-06T18:33:24.206083Z","submitted_at":"2024-06-19T00:28:58Z","title":"Can Long-Context Language Models Subsume Retrieval, RAG, SQL, and More?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13121","snapshot_observed_at":"2026-08-07T00:15:01.929996Z","title":"Graphwalks dataset, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.929996Z"},"links":{"cited_paper":"/paper/2406.13121","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:e09d6d9f704335e9181012dff054261ea50e989eded368572191d054dda36669","observation_id":"2ed5ceb0-acee-491e-9940-a6d3237859b4","resolution":{"observed_at":"2026-08-07T00:15:01.929996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:02.007202Z","title":"Cheng Jiayang, Dongyu Ru, Lin Qiu, Yiyang Li, Xuezhi Cao, Yangqiu Song, and Xunliang Cai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.007202Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:2819ffab4586088146bc12ec01f5c044f903ac5eb57a0aa4a09f6514be5fb502","observation_id":"bc8f1e5e-5aa6-4b3b-a87e-5cbc7e94edbd","resolution":{"observed_at":"2026-08-07T00:15:02.007202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-04T21:07:04.238345Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-07T00:15:02.090937Z","title":"Yushi Bai, Shangqing Tu, Jiajie Zhang, Hao Peng, Xiaozhi Wang, Xin Lv, Shulin Cao, Jiazheng Xu, Lei Hou, Yuxiao Dong, Jie Tang, and Juanzi Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.090937Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:2658ae652a9384832716ee5bcfe3fd4b24b7fed27d9b31637e7d9eddabef977f","observation_id":"427bbb7b-92a0-4ff2-bb27-bd2d1a2524a0","resolution":{"observed_at":"2026-08-07T00:15:02.090937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T00:15:02.128091Z","title":"Carlos E Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.128091Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:be85f69721efb99b17ec5147566caebc0f9714f4f7a34e2dbdf004d38fe1992b","observation_id":"e5d09d34-2f96-49dd-a02f-a9263fbbb5b8","resolution":{"observed_at":"2026-08-07T00:15:02.128091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-07T00:15:02.225669Z","title":"τ 2-bench: Evaluating conversational agents in a dual-control environment.arXiv preprint arXiv:2506.07982,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.225669Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:cb3a07a061f1dc78c0fd3d1f92ce2c7b7218b6d56055789758561d91b8c89d2b","observation_id":"7c01f29e-c24b-40ea-a17f-a42ef4a6ad91","resolution":{"observed_at":"2026-08-07T00:15:02.225669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:02.315050Z","title":"Vitabench: Benchmarking llm agents with versatile interactive tasks in real-world applications.arXiv preprint arXiv:2509.26490,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.315050Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:88e90751e04fb4b82282f3245d0f100cdc33f10041bb680139284bbe8068ff4b","observation_id":"014ed2bc-3ade-4a71-affb-af5bca762b91","resolution":{"observed_at":"2026-08-07T00:15:02.315050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-08-10T03:58:02.017407Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.00933","snapshot_observed_at":"2026-08-07T00:15:02.375041Z","title":"Mcp-atlas: A large-scale benchmark for tool-use competency with real mcp servers.arXiv preprint arXiv:2602.00933,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.375041Z"},"links":{"cited_paper":"/paper/2602.00933","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:170753636a0f86199dd7c8dbba54a80dd9d77405cb283fd250331a816d70a422","observation_id":"4fd26b7b-4fd4-490e-9d77-bc009b77875f","resolution":{"observed_at":"2026-08-07T00:15:02.375041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-07T00:15:02.431765Z","title":"Browsecomp: A simple yet challenging benchmark for browsing agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.431765Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:1c106fa69f30bfe100fc86ac3b2e331213fbdcc328ec0472eae04c5dc3ff2504","observation_id":"f46e8191-304f-4154-8c4a-13cca91cfb61","resolution":{"observed_at":"2026-08-07T00:15:02.431765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19314","last_updated":"2025-05-01T05:02:57Z","snapshot_observed_at":"2026-08-06T05:37:40.638404Z","submitted_at":"2025-04-27T17:32:43Z","title":"BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19314","snapshot_observed_at":"2026-08-07T00:15:02.528644Z","title":"Browsecomp-zh: Benchmarking web browsing ability of large language models in chinese.arXiv preprint arXiv:2504.19314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.528644Z"},"links":{"cited_paper":"/paper/2504.19314","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:3cdcb676bf50ed1d8485ea0f72fc764bb923445a1731fd6583fae9e1740b5438","observation_id":"d669be28-84fc-4462-a3aa-052568ebd904","resolution":{"observed_at":"2026-08-07T00:15:02.528644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00674","last_updated":"2026-05-15T17:10:37Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T13:56:34Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00674","snapshot_observed_at":"2026-08-07T00:15:02.576660Z","title":"Jasper Dekoninck, Nikola Jovanovi ´c, Tim Gehrunger, Kári Rögnvaldsson, Ivo Petrov, Chenhao Sun, and Martin Vechev","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.576660Z"},"links":{"cited_paper":"/paper/2605.00674","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:4bf9f2f9e8f7678cfeae826cbf22dbe2809eda6c72136af964dcf66a00fd51f0","observation_id":"9a0af43d-746a-40c8-beb3-10651fa3be50","resolution":{"observed_at":"2026-08-07T00:15:02.576660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:02.634076Z","title":"Thang Luong, Dawsen Hwang, Hoang H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.634076Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:fee9af033cb3fa2db81217cd2d6bedf82aef9c901ec8fc0e94b27f04daae156a","observation_id":"80e6a748-7ed9-4e3f-9a43-44d6fa8b8ae6","resolution":{"observed_at":"2026-08-07T00:15:02.634076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:02.707257Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence.arXiv preprint arXiv:2606.19348, 2026b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.707257Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:05f0b52b350ca35917f4b87a98e690fe51046454afa3274c5c01fc3a93c1ade4","observation_id":"8e8006e7-7c29-4490-af12-2a17a25342f9","resolution":{"observed_at":"2026-08-07T00:15:02.707257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:04.300078Z","title":"Red brackets above the panel mark the key spans of the task description, the target needle line, and the question","venue":null,"work_id":"ddbe80aa-470d-4a81-add9-2bd64a619f44","year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:02.874621Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:9bd50c760d102f5634a195f7b11787f926129bcff6c051461326ee6eb5d28854","observation_id":"19fdecd0-0e38-4f60-b8b4-a7ad35186fba","resolution":{"observed_at":"2026-08-07T00:15:04.366279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-07T00:14:59.459331Z","title":"Deepseek-v3.2-exp: Boosting long-context efficiency with deepseek sparse attention.Technical Report, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.459331Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:639ed3462766de1a7274a5b3ec55a53d0167e69c3f60824c8609bec77b63ec4e","observation_id":"fce5bcf1-6e49-4ab0-ad0a-908332969ef0","resolution":{"observed_at":"2026-08-07T00:14:59.459331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:15:00.729438Z","title":"Alex Mallen, Akari Asai, Victor Zhong, Rajarshi Das, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.729438Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:4db86ae505b2c366a7b7bc30c3ff058c78aad90e1e53ed085af0b698eafa6727","observation_id":"c3824aab-212a-482c-a549-0be5e1929db6","resolution":{"observed_at":"2026-08-07T00:15:00.729438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T00:14:59.924306Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.924306Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:ce55a28ce71b7cc225a3cc1de1d4ebe3fb33eb6fb2f65357be05a16ee7460ac9","observation_id":"e8e1752c-f6c3-410d-9468-9b32abe58f70","resolution":{"observed_at":"2026-08-07T00:14:59.924306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-07T09:13:28.333702Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-07T00:15:00.004201Z","title":"Retrievalattention: Accelerating long-context llm inference via vector retrieval.arXiv preprint arXiv:2409.10516, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.004201Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:8be4b609726d31d42682b62873a8ec7b71af4199e32855eaf39e3b3158a6613e","observation_id":"ff9eec77-1f0e-424b-9000-182e34b6c7e1","resolution":{"observed_at":"2026-08-07T00:15:00.004201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12665","last_updated":"2023-05-29T06:16:41Z","snapshot_observed_at":"2026-08-03T01:22:07.391444Z","submitted_at":"2022-05-25T11:21:30Z","title":"QAMPARI: An Open-domain Question Answering Benchmark for Questions with Many Answers from Multiple Paragraphs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12665","snapshot_observed_at":"2026-08-07T00:15:01.204848Z","title":"QAMPARI: An open-domain question answering benchmark for questions with many answers from multiple paragraphs.arXiv preprint arXiv:2205.12665,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.204848Z"},"links":{"cited_paper":"/paper/2205.12665","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:2e62aa6733478ac5c91c988ba06391d263fb562d3f383082f355a2747288aa9b","observation_id":"7a2944d4-1814-4f02-a2b4-eb33477158ee","resolution":{"observed_at":"2026-08-07T00:15:01.204848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-07T00:15:00.827604Z","title":"Payal Bajaj, Daniel Campos, Nick Craswell, Li Deng, Jianfeng Gao, Xiaodong Liu, Rangan Majumder, Andrew McNamara, Bhaskar Mitra, Tri Nguyen, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.827604Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:94543c7493bf2ecc3c4fc06dbd356fb229ef65e42e86ae645372de6f834becdc","observation_id":"0b53029e-a9eb-449b-b508-10b3b683e6de","resolution":{"observed_at":"2026-08-07T00:15:00.827604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:59.569127Z","title":"Kascade: A practical sparse attention method for long-context llm inference.arXiv preprint arXiv:2512.16391,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.569127Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:5b5485ab630df13238f4aa54786f7517273d9ea456fbcf321da677760f0f66b3","observation_id":"6b24c3ed-7829-4d9e-a88d-375cfbc9cf66","resolution":{"observed_at":"2026-08-07T00:14:59.569127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:59.656661Z","title":"Hysparse: A hybrid sparse attention architecture with oracle token selection and kv cache sharing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.656661Z"},"links":{"citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:7fc833a2b0bcd958d48d0a5b4c866716073341bbbb4d8e9639f74c2415b245ea","observation_id":"9ea74bb0-fcd8-4fca-9397-4a1c932b3050","resolution":{"observed_at":"2026-08-07T00:14:59.656661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10819","last_updated":"2024-10-14T17:59:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-14T17:59:58Z","title":"DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10819","snapshot_observed_at":"2026-08-07T00:14:59.516777Z","title":"Efficient streaming language models with attention sinks.International Conference on Learning Representations, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:59.516777Z"},"links":{"cited_paper":"/paper/2410.10819","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:ab2b18beb8542172c922d3ac5747de9ae0135690b25255b7af75f43d975aa6d3","observation_id":"7b393277-590e-4e98-87c1-1ddf4dbe816e","resolution":{"observed_at":"2026-08-07T00:14:59.516777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T14:51:00.229326Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2608.01662."}