{"as_of":"2026-08-18T20:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:423e81b439eeae2c185a12b788badd40d709676d144775b714ecce30ce46f0b9","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:43:05.950819Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.02361/citation-record","integrity":"/paper/2510.02361/integrity","json":"/paper/2510.02361/citation-record.json","paper":"/paper/2510.02361"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:59.614005Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T14:42:59.614005Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:a5647f240e43bed4901ce4029326c730b8a5191b46ade75fe8a91b41d33d1384","observation_id":"a8d18167-a913-4ac9-8e41-3ad25b30b9fc","resolution":{"observed_at":"2026-08-04T14:42:59.614005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:59.768694Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T14:42:59.768694Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:70c4fcf0b3f53d11f2326c53c7dc9234b9f074e5262037eb79c468be225f3a57","observation_id":"1b12ba76-acc2-47d8-acce-1d2451347a53","resolution":{"observed_at":"2026-08-04T14:42:59.768694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:59.893251Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T14:42:59.893251Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:818f202735f8ba0fcbcfb2c28abba4845784d60f0fac3973bb9c7f181177ee28","observation_id":"3ddfb705-3488-4297-90fb-a31656d009c8","resolution":{"observed_at":"2026-08-04T14:42:59.893251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.066367Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.066367Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:c65d6a53aed1036dc4aa11b2a81d0f10d83cd9ac2ab80769670d91cc3a2c79dd","observation_id":"104e38e2-3542-411b-83df-f7867d428aa5","resolution":{"observed_at":"2026-08-04T14:43:00.066367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.189486Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.189486Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:fc9a9e42a22096aaea045811e5542dfa970e92d8a0bc7a001f9e16baa716215d","observation_id":"fce07af1-9bac-48c6-81b5-1468dad88988","resolution":{"observed_at":"2026-08-04T14:43:00.189486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-04T14:43:00.368727Z","title":"Longformer: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.368727Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:a693de601ceee8a2571c27baee29fa604bffbf449a6548eb5cabfc4ac8bd7d1d","observation_id":"bd80f98a-0981-4b7d-8f6a-dd7684312707","resolution":{"observed_at":"2026-08-04T14:43:00.368727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.540648Z","title":"Transformers to ssms: Distilling quadratic knowledge to subquadratic models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.540648Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:219b490478be1e390c339edc1e3fcd9e959b5e2f40db4d5c5f0fd3e27dde9f63","observation_id":"dd5af0bb-12cc-4238-80e5-4125e1dd2577","resolution":{"observed_at":"2026-08-04T14:43:00.540648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.673999Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.673999Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:439331ac0e3800f625096a68d6734d315fa1766f2bcc0734b8d877eb0a2fe066","observation_id":"016852ee-4fae-4590-a967-73bee6d5cdc2","resolution":{"observed_at":"2026-08-04T14:43:00.673999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-04T14:43:00.828806Z","title":"Pyramidkv: Dynamic KV cache compression based on pyramidal information funneling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.828806Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:fccc63cec6ef7753d8206b2704ab7e6e71d32829241ebac2bee5d1aa1eaae7f7","observation_id":"8154630b-1f14-4887-8f2f-9687e91c15b0","resolution":{"observed_at":"2026-08-04T14:43:00.828806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-16T20:57:29.174467Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-04T14:43:00.999081Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.999081Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:48d84aefe9522dc2008d1766a9e4882c4153042673035412c8bc1a1c8e654210","observation_id":"97e2590e-7e60-4785-bac5-541b06db62e6","resolution":{"observed_at":"2026-08-04T14:43:00.999081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:01.105639Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90\\ See https://vicuna","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.105639Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:b6296cdc6b7747568ab3cc50b50f3d00cfc660050cf17bdeb974ed2b71998651","observation_id":"a67f7d59-ed6d-46f7-953b-5e800d5b977a","resolution":{"observed_at":"2026-08-04T14:43:01.105639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-04T14:43:01.240790Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.240790Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:7536a93e844b5f9c37c819e1d6fcda7e1125d290dbdb3d8f712ad2035684b758","observation_id":"cf8ad47e-48b9-4ba7-b266-9f84a9d0e709","resolution":{"observed_at":"2026-08-04T14:43:01.240790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-04T14:43:01.350545Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.350545Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:9cb290cc25c7ccf41e8d34723d868e7ea0b41f614c4c8669e018b6727070f1ff","observation_id":"1807d04c-ee86-40d6-83ab-575bb89913cd","resolution":{"observed_at":"2026-08-04T14:43:01.350545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:01.458419Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.458419Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:ed0131fefec22cc88635c73dd0f0ed4462ea098b32cda4183770d9d68f42fa82","observation_id":"2854c181-e0d5-4004-9549-182896572482","resolution":{"observed_at":"2026-08-04T14:43:01.458419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05525","last_updated":"2021-05-20T13:45:55Z","snapshot_observed_at":"2026-08-10T22:39:55.357269Z","submitted_at":"2020-06-09T21:47:17Z","title":"Knowledge Distillation: A Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05525","snapshot_observed_at":"2026-08-04T14:43:01.544923Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.544923Z"},"links":{"cited_paper":"/paper/2006.05525","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:c526b5fa753fb600baa306b0ca87ef19e245341c215dd3f96e741476823b2265","observation_id":"467f76a0-70ca-4e9f-b95a-9809793fafd2","resolution":{"observed_at":"2026-08-04T14:43:01.544923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:01.668092Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.668092Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:ce101d1cb328f3b84abc8f8e3bd1732b35e05b4580781ee1662f15a7ad733491","observation_id":"26dea23d-bc8e-4bf0-8e9e-80576bde32da","resolution":{"observed_at":"2026-08-04T14:43:01.668092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-04T14:43:01.774895Z","title":"Hinton, Oriol Vinyals, and Jeffrey Dean","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.774895Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:92f93758e138e17ef5be9f977928ab23d8889a81dae6da64c87d2c42c0ef7feb","observation_id":"0ef0cbf8-c6b6-4e6d-8e69-2abb581633a0","resolution":{"observed_at":"2026-08-04T14:43:01.774895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:01.955236Z","title":"Minference 1.0: Accelerating pre-filling for long-context llms via dynamic sparse attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:01.955236Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:c81ab56b8809a9cb9cd38c6031861db00fbdb73f340d97baab9d48425d4a827a","observation_id":"37af2e96-0f4c-4d2e-a8dc-53101bfb4ccc","resolution":{"observed_at":"2026-08-04T14:43:01.955236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:02.086066Z","title":"Wise: Weak-supervision-guided step-by-step explanations for multimodal llms in image classification","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.086066Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:a50778ed46609699332fb0eb002e7ca79bb064e7d3b111db533e9ea023cb4663","observation_id":"48e79267-803c-42cf-97bf-795be4731117","resolution":{"observed_at":"2026-08-04T14:43:02.086066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:02.248626Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.248626Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:304cdce028db6d92f4636651c7c27c09e7f3e4d80ea913712666aaf92d310663","observation_id":"58855a08-501a-41a4-915e-7e471fddf205","resolution":{"observed_at":"2026-08-04T14:43:02.248626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:02.402138Z","title":"Sequence-level knowledge distillation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.402138Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:7b930135c40e44fae63d8de03eac6898b5ef729dd1c63c1c356020e61a7a1ea8","observation_id":"8fcc620d-c2e4-4979-8758-ff28057a29d9","resolution":{"observed_at":"2026-08-04T14:43:02.402138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-08-13T08:34:05.764059Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08313","snapshot_observed_at":"2026-08-04T14:43:02.535332Z","title":"Minimax-01: Scaling foundation models with lightning attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.535332Z"},"links":{"cited_paper":"/paper/2501.08313","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:56f040a19d19dae4f56848277dc98b60ee4d6293b0a6c12cd399266a70f3388a","observation_id":"bd1c0ab8-89ca-4471-956a-5a7afbdc86fa","resolution":{"observed_at":"2026-08-04T14:43:02.535332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:02.642104Z","title":"Snapkv: LLM knows what you are looking for before generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.642104Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:e8779ef14a510e85e7874ab0473a7debb67ccb27b21d691e5931c4dee6f151c7","observation_id":"0598c0a0-a870-4d7f-ac25-43779cbf6c5d","resolution":{"observed_at":"2026-08-04T14:43:02.642104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-17T15:34:12.654681Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-04T14:43:02.786626Z","title":"Retrievalattention: Accelerating long-context llm inference via vector retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.786626Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:4044789c7532859dd1efde73be591443712b12a58fd720a2887bf3de9028859c","observation_id":"0f3ad922-f04f-4d20-8792-028b5c857272","resolution":{"observed_at":"2026-08-04T14:43:02.786626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:02.886560Z","title":"Fineweb-edu: the finest collection of educational content, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.886560Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:29eeea499545ddf2f3cd2d2a9c57a8616252152a2ce3d80dd5830cdb2d8e355f","observation_id":"ff01ec78-3682-4291-ab6f-743adea4f501","resolution":{"observed_at":"2026-08-04T14:43:02.886560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-08-12T19:30:23.025771Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13189","snapshot_observed_at":"2026-08-04T14:43:02.987885Z","title":"Zhang, Zhilin Yang, Xinyu Zhou, Mingxing Zhang, and Jiezhong Qiu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:02.987885Z"},"links":{"cited_paper":"/paper/2502.13189","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:55cedab4cbd79c9b3a0bf648f754c387c15a1a5d5bfe032733af24eee6f4ac7e","observation_id":"5ed79671-7dcb-4b84-950c-0656a590b46d","resolution":{"observed_at":"2026-08-04T14:43:02.987885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06640","last_updated":"2024-05-10T17:59:08Z","snapshot_observed_at":"2026-08-16T13:53:39.909033Z","submitted_at":"2024-05-10T17:59:08Z","title":"Linearizing Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06640","snapshot_observed_at":"2026-08-04T14:43:03.125292Z","title":"Linearizing large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.125292Z"},"links":{"cited_paper":"/paper/2405.06640","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:11aba97d98ee79bd51fa8d0713368d99623909244d0ffd9fac75dd10f0755ade","observation_id":"ef20dec0-da35-4c6a-8799-1313eea66e3e","resolution":{"observed_at":"2026-08-04T14:43:03.125292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:03.191713Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.191713Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:4a0a9730226ef3e9235da4c16869c9762fa63bbf4055f75d8d1c4c72b56184c1","observation_id":"91117444-c746-4609-94ff-a3eaca973aaa","resolution":{"observed_at":"2026-08-04T14:43:03.191713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:03.332107Z","title":"Can a suit of armor conduct electricity? A new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.332107Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:6c3df812be41e97b328cb028595ab8a9452c3124685eea222f54e71e2ba89f14","observation_id":"4377e9ba-f304-42bb-a6f4-dcda090b67a5","resolution":{"observed_at":"2026-08-04T14:43:03.332107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-08-16T13:26:40.822276Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-04T14:43:03.438399Z","title":"Instruction tuning with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.438399Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:a0f19ed97bffb3230ceaade538df0cc26945ae37b30a433952814fc0dd941053","observation_id":"4b7b5af8-f332-45fb-88f8-8611e640120e","resolution":{"observed_at":"2026-08-04T14:43:03.438399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-08-17T17:58:38.402665Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-04T14:43:03.509806Z","title":"Rwkv: Reinventing rnns for the transformer era","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.509806Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:3b4ed19e74d8ec3906d34f3e82e4d11c7978b89e2449372133556712d31be1b2","observation_id":"fbc559e8-3dd0-4421-a00d-f667281827dd","resolution":{"observed_at":"2026-08-04T14:43:03.509806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05892","last_updated":"2024-09-26T22:39:08Z","snapshot_observed_at":"2026-08-12T16:03:56.235250Z","submitted_at":"2024-04-08T22:20:59Z","title":"Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05892","snapshot_observed_at":"2026-08-04T14:43:03.587581Z","title":"Eagle and finch: Rwkv with matrix-valued states and dynamic recurrence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.587581Z"},"links":{"cited_paper":"/paper/2404.05892","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:b132fcb67232d529fbf1e65f84fe51169b97465ee4f97dfb791034bcc9d92818","observation_id":"54089480-e5a5-4bcd-878d-4df82f66fb35","resolution":{"observed_at":"2026-08-04T14:43:03.587581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-10T02:15:37.272323Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-04T14:43:03.696218Z","title":"Compressive transformers for long-range sequence modelling","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.696218Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:8a526b13f481db9248e982b2db0a9fac2d28b2c48620070d64ed600d644cafa4","observation_id":"c08777be-abd3-4ce6-bf49-45963a88d071","resolution":{"observed_at":"2026-08-04T14:43:03.696218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-18T00:03:21.764059Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-04T14:43:03.837743Z","title":"Rusu, Sergio Gomez Colmenarejo, C aglar G \\\" u l c ehre, Guillaume Desjardins, James Kirkpatrick, Razvan Pascanu, Volodymyr Mnih, Koray Kavukcuoglu, and Raia Hadsell","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.837743Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:29a78fed4f4c10b47e31e7251022f0996bc3a5f580c3574d6cf2f3dcc1ef50dc","observation_id":"71965019-297d-4cc7-a3e8-4b88bf4b4f8e","resolution":{"observed_at":"2026-08-04T14:43:03.837743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:03.965654Z","title":"P y SBD : Pragmatic sentence boundary disambiguation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:03.965654Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:351129d9f669aa257888270583f7336a22bf8235aefaccaad9b056eb9dc04e33","observation_id":"a5eaea05-fb50-4f36-a4d3-eb0384861fa3","resolution":{"observed_at":"2026-08-04T14:43:03.965654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:04.122792Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.122792Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:ae2c4961f56713cb2690b5e6b03e62426ada9bb3351fa634d7eea42f909e04f4","observation_id":"3f9ff6e1-1742-4186-ae24-e1e5f3ae8460","resolution":{"observed_at":"2026-08-04T14:43:04.122792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-04T14:43:04.255288Z","title":"Distilbert, a distilled version of BERT: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.255288Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:651df13a5b261bbdbaaaa94792cb568d5e6b6fb141a9372906fcf067e578f4f3","observation_id":"c621803b-ddf1-4a43-bee0-8915fb00f999","resolution":{"observed_at":"2026-08-04T14:43:04.255288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:04.369336Z","title":"Social iqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.369336Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:84f9c88d49bace93915f70f6645e501f4cc0dc3f2fb03094bdc767fa440d6d36","observation_id":"bcfcb007-c3dc-42b4-8492-5ab33576c729","resolution":{"observed_at":"2026-08-04T14:43:04.369336Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16377","last_updated":"2025-05-29T03:34:03Z","snapshot_observed_at":"2026-08-16T12:56:02.991825Z","submitted_at":"2025-02-22T22:38:16Z","title":"Instruction-Tuning LLMs for Event Extraction with Annotation Guidelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16377","snapshot_observed_at":"2026-08-04T14:43:04.514760Z","title":"Instruction-tuning llms for event extraction with annotation guidelines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.514760Z"},"links":{"cited_paper":"/paper/2502.16377","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:ad9223ebb874e428ae35e9ffb23d63e8168e53d6810f6bbb3e18b738cc356036","observation_id":"f969937e-b197-4c30-a92d-16ec3a3360e2","resolution":{"observed_at":"2026-08-04T14:43:04.514760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-04T14:43:04.645205Z","title":"Retentive network: A successor to transformer for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.645205Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:ead8eebf38062fa8eac6d39935bb7ac49876c53dcc4500327751721d3ad1e01f","observation_id":"20adb174-0089-4902-b1f2-e9c63581619a","resolution":{"observed_at":"2026-08-04T14:43:04.645205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:04.730271Z","title":"Commonsenseqa: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.730271Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:2a2057f07bf813e1b6facc58c860c06a408c5824d47295b92da37a854f1a1754","observation_id":"8e7a825f-9af7-4054-bda5-771f5493eae2","resolution":{"observed_at":"2026-08-04T14:43:04.730271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-08-14T18:53:06.624928Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-04T14:43:04.849425Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.849425Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:8697b3a9f3631f9f2d9a1a8ee85e214dbb3799a8733e826faacb0830fed49fc9","observation_id":"c9b34afe-ae15-4f3a-8d9a-79e59a02d169","resolution":{"observed_at":"2026-08-04T14:43:04.849425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:04.966387Z","title":"Stanford alpaca: An instruction-following llama model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:04.966387Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:8c76db08cee90990a51df7877ae49a32873a83aa9d2c376e84da06ceda9d2a86","observation_id":"4acb60d5-cb70-443f-81d8-02722dc0d81b","resolution":{"observed_at":"2026-08-04T14:43:04.966387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.023640Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.023640Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:635175a2894cccc4e882192c1114a27cddea8d541ed86d52b3ead3bb7da11880","observation_id":"e8ce3ebc-30e2-413a-b6ee-4b4359cf4d68","resolution":{"observed_at":"2026-08-04T14:43:05.023640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.115564Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.115564Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:5e58630aed96ea0659113e476f177a6af77df0ebdf96f0456a4f26f25b87d16c","observation_id":"85bb8371-85ae-436e-9948-b4c75b4e5cf5","resolution":{"observed_at":"2026-08-04T14:43:05.115564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14477","last_updated":"2025-02-20T11:52:36Z","snapshot_observed_at":"2026-08-16T12:56:42.361283Z","submitted_at":"2025-02-20T11:52:36Z","title":"Unshackling Context Length: An Efficient Selective Attention Approach through Query-Key Compression","version":1},"cited_work":{"arxiv_id":"2502.14477","doi":"10.48550/arxiv.2502.14477","metadata_source":"pith","pith_arxiv_id":"2502.14477","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Unshackling Context Length: An Efficient Selective Attention Approach through Query-Key Compression","venue":"cs.CL","work_id":"620cb55e-d6f8-4fd6-8646-07354b39b97b","year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.227833Z"},"links":{"cited_paper":"/paper/2502.14477","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:518c60c0c1a3485e2583ef24ccbffda06e068e972185deb67ae7c7041b1757b1","observation_id":"3147b43f-bfb3-45b2-9b87-4a2eeddd7343","resolution":{"observed_at":"2026-08-04T14:43:25.804741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.312199Z","title":"The mamba in the llama: Distilling and accelerating hybrid models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.312199Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:e44d6ad28ee3f113510357009c78d577d7e53e7627dedfd9a7e66262f6c00054","observation_id":"dd7f531a-c428-423f-8e94-936bd33ced52","resolution":{"observed_at":"2026-08-04T14:43:05.312199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.422514Z","title":"Liu, and Matt Gardner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.422514Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:78089743093c91c40ace81fce73cbd28048b6f9124bcc1ee49365f092c791033","observation_id":"fdc4b953-2b0c-4dcb-ad3c-a0beca44416d","resolution":{"observed_at":"2026-08-04T14:43:05.422514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.551726Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.551726Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:0ff6054e79bc268a0117eca9aaabe7cd5477b8902d5f5b869e2c29bec070ed68","observation_id":"e262e16b-7752-4a2a-817d-1a3ab3e0cc1f","resolution":{"observed_at":"2026-08-04T14:43:05.551726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.674264Z","title":"Pyramidinfer: Pyramid KV cache compression for high-throughput LLM inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.674264Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:0c58511a0c4acb93a5caca22853a68b8675c07d3c32568f7f7f07ccab5f951de","observation_id":"1a1b167d-f5a6-4487-9c26-bd4d168218c2","resolution":{"observed_at":"2026-08-04T14:43:05.674264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.742499Z","title":"Native sparse attention: Hardware-aligned and natively trainable sparse attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.742499Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:a70800544c648c18584cfae848096982a02b307307e6b6dec40d2506e1609328","observation_id":"75b48b7c-4374-4c56-bcaf-eb1b40817ffb","resolution":{"observed_at":"2026-08-04T14:43:05.742499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.810453Z","title":"Hellaswag: Can a machine really finish your sentence? In Anna Korhonen, David R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.810453Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:f0f323b8fc58141109c99b27713d6b626e657e9bb8aa25c0ecd9208db302b475","observation_id":"32d47e24-cf6a-4ab0-bf9e-96dcccc5e6b0","resolution":{"observed_at":"2026-08-04T14:43:05.810453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.888909Z","title":"Event temporal relation extraction based on retrieval-augmented on llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.888909Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:0ef7c341091edaed530b33b445c30d55134c0842be08e3b3291e4ee75494f2f4","observation_id":"1f0b6726-7019-4b05-92df-f50d6e2c8a91","resolution":{"observed_at":"2026-08-04T14:43:05.888909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:05.950819Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:05.950819Z"},"links":{"citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:97391b29641b51c8cc29c3b23e0fe5d6a0df7580f3b524e5f18e6290adef7174","observation_id":"5503ea8f-c7cd-4436-8c9e-7b7c4c89d781","resolution":{"observed_at":"2026-08-04T14:43:05.950819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T22:03:22.989743Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2510.02361."}