{"as_of":"2026-08-14T09:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24c855648971da950d5ad5f11bb18a71d34d0d6835ed17dc88e3b67380efc80f","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:25:06.182146Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:38:48.057219Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-11T00:38:48.057219Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-11T00:33:34.388194Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:48.057219Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:907aa19b4429e9211a7023eaac0db6c1dbec9cbbf80f0052acea5a35dd6e7a8d","observation_id":"71b2eebb-bf39-443f-b1bf-e96dcb0c4954","resolution":{"observed_at":"2026-08-11T00:38:48.057219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-16T23:46:29.975858Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2502.11089"},"observation_digest":"sha256:2f3a60e4f2e8ee460dc25c1e0d08d1d414af788ea4e1f1a3a3a499a65b774570","observation_id":"dc318184-6f14-4f85-aeb2-b1463aee789f","resolution":{"observed_at":"2026-05-16T23:46:30.212281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-07T10:50:51.014693Z","title":"SepLLM : Accelerate Large Language Models by Compressing One Segment into One Separator , December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04344","last_updated":"2025-06-04T18:02:07Z","snapshot_observed_at":"2026-08-14T09:15:48.480531Z","submitted_at":"2025-06-04T18:02:07Z","title":"GEM: Empowering LLM for both Embedding Generation and Language Understanding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:51.014693Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2506.04344"},"observation_digest":"sha256:d56113881d3fc8bd30aceab66d9d76965bb09f9e7f5c7fe7d84fe74b948c990f","observation_id":"a5f70ddc-f502-4087-85e2-06912880a329","resolution":{"observed_at":"2026-08-07T10:50:51.014693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-07T05:06:32.572234Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator.arXiv preprint arXiv:2412.12094, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08889","last_updated":"2025-06-10T15:17:26Z","snapshot_observed_at":"2026-08-13T09:28:54.701420Z","submitted_at":"2025-06-10T15:17:26Z","title":"SeerAttention-R: Sparse Attention Adaptation for Long Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:32.572234Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2506.08889"},"observation_digest":"sha256:7d0d4a76550d428eaa999db9f7b838766156ea326e0290b7338fd5db0b39bf1a","observation_id":"8f496848-d855-4471-8142-2c892c297b6b","resolution":{"observed_at":"2026-08-07T05:06:32.572234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T21:18:46.625475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-14T04:50:42.794210Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.625475Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:d0896b26b8608360859eeff2b279d4627fe0e889c89dbd8691a602560f2b34a9","observation_id":"1a8464b1-0285-4290-bf96-5dec339b3a40","resolution":{"observed_at":"2026-08-06T21:18:46.625475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T20:08:06.728594Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.728594Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:38424040608dd1d6e4e1943500d562b4930b6af58e430b04ccec1f5ee18daf13","observation_id":"7e3cbe33-ce91-4136-8db3-9c084ff0c855","resolution":{"observed_at":"2026-08-06T20:08:06.728594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T13:57:15.675892Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19906","last_updated":"2025-08-04T08:19:26Z","snapshot_observed_at":"2026-08-12T20:33:33.893453Z","submitted_at":"2025-07-26T10:34:53Z","title":"CaliDrop: KV Cache Compression with Calibration","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:57:15.675892Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.19906"},"observation_digest":"sha256:61ae788cd108b816062d8fc16ae019f842fce050cf3b036fb9a335f3998bd873","observation_id":"57454bc2-d061-44aa-ae76-7f3e17e17fe3","resolution":{"observed_at":"2026-08-06T13:57:15.675892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-04T14:43:00.999081Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-07T04:57:17.283392Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.999081Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:f3addae1829983ba40289261dfeb4e5060b94b24df396a58cfe001d7cb10acb9","observation_id":"97e2590e-7e60-4785-bac5-541b06db62e6","resolution":{"observed_at":"2026-08-04T14:43:00.999081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2604.03679","last_updated":"2026-04-04T10:46:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T10:46:09Z","title":"LightThinker++: From Reasoning Compression to Memory Management","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T17:25:28.432170Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2604.03679"},"observation_digest":"sha256:7b133946567debd5f0e1a69e0f1e6a32d92cfe61b20216283e7d5648cd2f7837","observation_id":"4761a781-8aaa-4876-8e24-731d6cab01ea","resolution":{"observed_at":"2026-05-13T17:28:01.786972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2604.15583","last_updated":"2026-04-24T15:54:27Z","snapshot_observed_at":"2026-08-10T21:44:14.791442Z","submitted_at":"2026-04-16T23:34:51Z","title":"SAGE: Selective Attention-Guided Extraction for Token-Efficient Document Indexing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T08:32:02.222528Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2604.15583"},"observation_digest":"sha256:58b6bb1272253ebb348a8202d65996a4d86223bab54b79200853869e2d536f3c","observation_id":"8ac373e4-d79f-4568-91fd-1f58389d87dd","resolution":{"observed_at":"2026-05-10T08:32:52.129872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:fd28b3f7b107b91f642df16f673df32024b61a5f5dbb6f2adda9d5144213b6a0","observation_id":"8d5cab32-d60d-4afa-8d74-00ed049ff9fc","resolution":{"observed_at":"2026-07-10T01:36:44.291190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T11:38:12.739444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-07-31T07:30:05.476997Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28434","last_updated":"2026-07-30T16:12:13Z","snapshot_observed_at":"2026-08-06T13:29:41.971510Z","submitted_at":"2026-07-30T16:12:13Z","title":"Metaphor Tracer: A Theory-Informed Analysis of Hidden States","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T07:30:05.476997Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2607.28434"},"observation_digest":"sha256:211b0776e84f2fb3e5ce623dafac793de70271b166c0feb93e2b5cf40a7eb979","observation_id":"ce8edf70-bd41-4f56-8b59-cb6c2af227a6","resolution":{"observed_at":"2026-07-31T07:30:05.476997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12094/citation-record","integrity":"/paper/2412.12094/integrity","json":"/paper/2412.12094/citation-record.json","paper":"/paper/2412.12094"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-11T14:25:06.023014Z","title":"The Falcon Series of Open Language Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.023014Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:74ba69c56d493c60600e7883ce38752fa1870aef5eb4d9856d27d0d33730502e","observation_id":"0f0ff43e-151c-41d4-92bb-2a5d8e419bca","resolution":{"observed_at":"2026-08-11T14:25:06.023014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.725965Z","title":"Additionally, feed-forward networks with ReLU activation can effectively represent any piecewise linear function","venue":null,"work_id":"40a17d3c-fbb8-4524-9158-ecc8a40ff72e","year":2020},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.158626Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:41f6569df77154f0c5b5bce2a5e986f42e7a71db44b07b3a22285ed5fcb661eb","observation_id":"2f865bea-b69d-4fb8-9556-181f5aa2d572","resolution":{"observed_at":"2026-08-11T14:25:06.732832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T14:25:06.063912Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.063912Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:b7c01736b215709f84ae74bda1980863d7b945decb0c6a790dfd2d078b52d874","observation_id":"5989b33f-4e24-40b9-a089-2a708f03521c","resolution":{"observed_at":"2026-08-11T14:25:06.063912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-11T14:25:06.085460Z","title":"X., Wang, L., Xiao, Z., Wang, Y ., Ruan, C., Zhang, M., Liang, W., and Zeng, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.085460Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:d950815602d38aabcefe821ee8767bcaf0ab4a8cc424b8e7b703eec42905ada7","observation_id":"61972174-c251-47d3-a52a-ab1ebddcfd21","resolution":{"observed_at":"2026-08-11T14:25:06.085460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.036755Z","title":"Chen, G., Xia, L., and Huang, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.036755Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:afac0397583b1ad7efa70649b9a4d60c0440830c1555dd2fe00c810217b5a864","observation_id":"a716a03f-1bf4-4da6-a402-865a87e69930","resolution":{"observed_at":"2026-08-11T14:25:06.036755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-11T14:25:06.100416Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.100416Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:ce31da4897bc159238e75df9ebce3a6885bddf20c653e8ebef5a051cad4aa75b","observation_id":"18a6fb13-35f6-4da5-8002-6a5fb40ffaa9","resolution":{"observed_at":"2026-08-11T14:25:06.100416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.846576Z","title":null,"venue":null,"work_id":"7e011e74-8002-4e46-af71-ce892cee0d95","year":2023},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.118633Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:b7b9011e26887939225740abaa1264d4d2a3023a64eacc11603495b88778bb10","observation_id":"40a2fefc-d6f1-4bee-b9a2-6e587108eace","resolution":{"observed_at":"2026-08-11T14:25:06.855705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.815087Z","title":null,"venue":null,"work_id":"2fa3fc13-a7e2-4a28-994c-098b4d616e38","year":2021},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.123921Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:e3c8c5e03212ffce022b7bd6b4f90c9f2306d5be0e0c22c9352c5cb01042bcec","observation_id":"788d97a0-b99e-46e8-9771-83c0ae06f2c4","resolution":{"observed_at":"2026-08-11T14:25:06.830308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.788692Z","title":"PyramidKV (Zhang et al., 2024)","venue":null,"work_id":"81df3d52-002e-4d05-ae12-c046cb206a47","year":2024},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.130816Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:78b4c8fc38cb1ccb94851825ea3adc8c66a801276025661abc661b0e78f041c7","observation_id":"79da381c-6552-44c3-b2ac-5d207f879b15","resolution":{"observed_at":"2026-08-11T14:25:06.798914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.769809Z","title":"” and “?","venue":null,"work_id":"a6345b79-3228-4cd8-93d2-43ad37d792fd","year":2024},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.137167Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:1b7c7dc03bd820440528cc1aacb2073385502e30322969c2ea17e33edf0b47e6","observation_id":"0407bef2-3476-4576-a892-bfd3b702f81d","resolution":{"observed_at":"2026-08-11T14:25:06.776540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.700151Z","title":"(n−1) d−1X i=0 δ−i :δ: (n−1) d−1X i=0 δ−i +δ −d+1 −δ # , u⊤Zk ∈","venue":null,"work_id":"7ab9739f-a187-4e0c-8d13-932602e8a245","year":2020},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.167887Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:4f8db95a90167ab069cfde9752d85a0142e0aecb150c1045033d37f141e032d2","observation_id":"eeb6ea4c-4082-4ae6-b4a7-3f7e7fa568a3","resolution":{"observed_at":"2026-08-11T14:25:06.708598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.660858Z","title":"4 initial tokens are kept","venue":null,"work_id":"60e71375-648f-4aec-83bd-2d19c4d697bc","year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.176673Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:2a13114daebec4eb1c54352f09b3f35d54ce542a1de1bb044c83373fcb1d7c83","observation_id":"4f79ad32-015f-4cf5-ad94-1a0d541c79ae","resolution":{"observed_at":"2026-08-11T14:25:06.674486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.634172Z","title":"32 initial tokens are kept","venue":null,"work_id":"415cfe0a-33c1-4810-a861-000db1c8f6c0","year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.182146Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:a096983450ad048bc397208bd73a782ceed624209a578784c56dfcebfae3f9fb","observation_id":"2ad808ad-71b5-426d-8d50-b350bd63c349","resolution":{"observed_at":"2026-08-11T14:25:06.641891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12532","last_updated":"2024-06-05T09:01:24Z","snapshot_observed_at":"2026-08-13T00:03:16.448539Z","submitted_at":"2024-05-21T06:46:37Z","title":"PyramidInfer: Pyramid KV Cache Compression for High-throughput LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12532","snapshot_observed_at":"2026-08-11T14:25:06.072675Z","title":"InfLLM: Training-Free Long- Context Extrapolation for LLMs with an Efficient Context Memory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.072675Z"},"links":{"cited_paper":"/paper/2405.12532","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:29fa0c71b00ad7795641ae1744eff3e841d936854104a38ec93e5e4738bbac1c","observation_id":"dcae64ab-e48c-4d7b-98f6-450c255989ef","resolution":{"observed_at":"2026-08-11T14:25:06.072675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T14:25:06.049120Z","title":"Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.049120Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:f0ffe9e224484773906aaec0ecc1c326b3242f502f8329efc49440b2ed0f8650","observation_id":"a1039abf-a3ff-4e7b-ace6-453cbbbb4998","resolution":{"observed_at":"2026-08-11T14:25:06.049120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T14:25:06.057530Z","title":"The Llama 3 Herd of Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.057530Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:6e2145d3a1c615689c793c80628f4ce83450be6bfa35df201d86f4905ac90dae","observation_id":"86b3e9f2-bd5e-4078-bcbe-a9110222a9d2","resolution":{"observed_at":"2026-08-11T14:25:06.057530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:25:06.749154Z","title":"The results in Table 17 show that FixLLM has a significant gap compared to SepLLM in both mathematical logical reasoning and knowledge-based reasoning capabili- ties","venue":null,"work_id":"3da0fc2b-faf2-41d8-8a42-c40bfd5e8690","year":2020},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.149825Z"},"links":{"citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:087f5a5860fb6da4ebbe519f4dd79685e6641e7ee4609026d016c683b097c1ad","observation_id":"fedc5b42-97d8-43f8-b498-74959d10411c","resolution":{"observed_at":"2026-08-11T14:25:06.755414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-11T14:25:06.029478Z","title":"Long- former: The Long-Document Transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.029478Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:c2f0859b0ee0b4e2ec0332dfedaf69758075b51d20000f2db5963d693e75b142","observation_id":"9a80c46f-697b-45df-bcf6-9d1a3f52d890","resolution":{"observed_at":"2026-08-11T14:25:06.029478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T14:25:06.042723Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Chal- lenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.042723Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:b89a99b460b250df8e9d9409149e26608e4489cfc5464df0653bac5f21f1adf7","observation_id":"b0727550-c477-4fe7-a605-2f220933b70f","resolution":{"observed_at":"2026-08-11T14:25:06.042723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15486","last_updated":"2025-09-03T02:11:32Z","snapshot_observed_at":"2026-08-12T23:41:14.037330Z","submitted_at":"2024-06-17T11:05:15Z","title":"SampleAttention: Near-Lossless Acceleration of Long Context LLM Inference with Adaptive Structured Sparse Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15486","snapshot_observed_at":"2026-08-11T14:25:06.112967Z","title":"SampleAttention: Near-Lossless Acceleration of Long Context LLM Infer- ence with Adaptive Structured Sparse Attention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T14:25:06.112967Z"},"links":{"cited_paper":"/paper/2406.15486","citing_paper":"/paper/2412.12094"},"observation_digest":"sha256:4d16eb1e3051d493fdb1c92f1c99d410585d2935c58e0ee345c7f58876a0981b","observation_id":"fe622c78-ea51-4154-a854-9c00766ff892","resolution":{"observed_at":"2026-08-11T14:25:06.112967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","latest_version":6,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 12 inbound Pith citation observations for arXiv:2412.12094."}