{"as_of":"2026-08-10T19:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf428c835fd0c8c5eea7432d714c247deb28b917afb12085fc24993a5b00a9f8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":59,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:27:03.120485Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.322096Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-05-13T02:46:26.957539Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2311.05232"},"observation_digest":"sha256:fd7b3318f2755a218d5cbfc711ff8a142359e31da41a11ef806e217c6254ceb2","observation_id":"f72dd5e3-3850-44c9-8af0-63c3c00b9f94","resolution":{"observed_at":"2026-05-13T02:46:27.647448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2409.01579","last_updated":"2026-04-26T03:57:54Z","snapshot_observed_at":"2026-08-02T14:47:38.459814Z","submitted_at":"2024-09-03T03:25:59Z","title":"AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-23T21:06:59.776841Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2409.01579"},"observation_digest":"sha256:a80de2883d346144e0b6111d757dca429cec6de6468627a88e0ef355568c644a","observation_id":"bec1097a-429a-4dc0-bea3-2c1bb52f6112","resolution":{"observed_at":"2026-05-23T21:08:26.041444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2409.06679","last_updated":"2026-04-14T06:50:10Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:44:35Z","title":"E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-23T20:36:55.159302Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2409.06679"},"observation_digest":"sha256:e4b0eaebad039806b4610649641822e35c8372d0e1b0c7537d141c4162ebc7b6","observation_id":"038d4429-156d-4e4e-89ce-8cdbf1905052","resolution":{"observed_at":"2026-05-23T20:38:24.967159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-08-09T18:44:01.140163Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T04:47:40.335477Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2412.13171"},"observation_digest":"sha256:363f001511659db7cb062e57ee5f1c1deb544c2ac4b2fdcbb0d54e1241d60e9d","observation_id":"6afb25e3-bfd5-40c4-a724-80806a27129d","resolution":{"observed_at":"2026-05-17T04:47:40.400393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-09T11:11:17.685933Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02789","last_updated":"2025-05-19T18:24:50Z","snapshot_observed_at":"2026-08-10T09:14:41.151670Z","submitted_at":"2025-02-05T00:22:06Z","title":"Speculative Prefill: Turbocharging TTFT with Lightweight and Training-Free Token Importance Estimation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T11:11:17.685933Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2502.02789"},"observation_digest":"sha256:33b132f555fe97e2b05e699c2ac15c0cc4413ab84f6b2bf4faf513695449d0a7","observation_id":"c0805d18-4818-4e42-8e52-cf6f52f50a36","resolution":{"observed_at":"2026-08-09T11:11:17.685933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-16T23:46:29.975858Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2502.11089"},"observation_digest":"sha256:941a245b69c449b9c6d1d4679c1a90a32d35b16b58d223bd7d294f3115795b6f","observation_id":"e48c0a43-7e26-48da-9d2d-4c97cf3dd3fa","resolution":{"observed_at":"2026-05-16T23:46:30.078718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-09T05:40:21.491572Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.15734","last_updated":"2025-02-05T14:12:33Z","snapshot_observed_at":"2026-08-09T08:05:40.503223Z","submitted_at":"2025-02-05T14:12:33Z","title":"Cache-Craft: Managing Chunk-Caches for Efficient Retrieval-Augmented Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T05:40:21.491572Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2502.15734"},"observation_digest":"sha256:d7103855085f67469fd0c452232b069b93f0b41b60d685eee558aa6ecb44ba81","observation_id":"6e2ceb50-3c8b-41dc-9d28-4039d3bc7f44","resolution":{"observed_at":"2026-08-09T05:40:21.491572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T14:40:52.446651Z","title":"Llmlingua: Com- pressing prompts for accelerated inference of large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18092","last_updated":"2025-05-27T09:42:25Z","snapshot_observed_at":"2026-08-10T17:45:42.245058Z","submitted_at":"2025-05-23T16:47:00Z","title":"QwenLong-CPRS: Towards $\\infty$-LLMs with Dynamic Context Optimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:52.446651Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2505.18092"},"observation_digest":"sha256:6bf90184d26037f2ceb61698da928803442306f5cb369561f6ebaffb3cd3c42a","observation_id":"445cf6ed-50af-4bb1-a32e-798ee654dd31","resolution":{"observed_at":"2026-08-07T14:40:52.446651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T14:33:13.213167Z","title":"Jiang, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":189,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.213167Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:3daa52475ad8b5fd723574487df9be131e00f14519e3600bd129434c3612e2d5","observation_id":"afafabaa-3390-46ed-81b2-6029bc351209","resolution":{"observed_at":"2026-08-07T14:33:13.213167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T12:39:05.729533Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-09T00:29:42.217756Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:05.729533Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:67994df6ebbd9a7d7952023896d6525f77fac2a4423fcedf082bb2f5ac335000","observation_id":"7fb1ec33-d153-40f9-9093-18fd3a040d60","resolution":{"observed_at":"2026-08-07T12:39:05.729533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T12:14:26.584176Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00307","last_updated":"2025-08-20T23:19:57Z","snapshot_observed_at":"2026-08-10T11:59:35.954198Z","submitted_at":"2025-05-30T23:32:57Z","title":"Lossless Token Sequence Compression via Meta-Tokens","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:14:26.584176Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2506.00307"},"observation_digest":"sha256:a0604846cb9756548e89e53b6f89a551eea233357606aa3faecf95fa22bd7101","observation_id":"0427e401-f35a-4281-b7c8-c7fb90d3b9e6","resolution":{"observed_at":"2026-08-07T12:14:26.584176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T06:04:31.063414Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06266","last_updated":"2025-06-13T17:58:55Z","snapshot_observed_at":"2026-08-10T09:21:59.278086Z","submitted_at":"2025-06-06T17:48:23Z","title":"Cartridges: Lightweight and general-purpose long context representations via self-study","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:04:31.063414Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2506.06266"},"observation_digest":"sha256:42ade0a020f7f9f918dbcef201bdc85c2dd01c5b1d071371dc8e6f7b68724abf","observation_id":"9fb66aae-c29f-4639-b5d7-2df33cc99457","resolution":{"observed_at":"2026-08-07T06:04:31.063414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T05:09:09.648283Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08686","last_updated":"2025-06-29T08:48:15Z","snapshot_observed_at":"2026-08-09T14:39:20.446366Z","submitted_at":"2025-06-10T10:52:04Z","title":"Brevity is the soul of sustainability: Characterizing LLM response lengths","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:09:09.648283Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2506.08686"},"observation_digest":"sha256:201762766fe33b9b47328be6e1d8a5e314739eecf289a727c63064a7f762dc89","observation_id":"b22fdf2f-2736-4930-a9f5-d6438f68cbe7","resolution":{"observed_at":"2026-08-07T05:09:09.648283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-07T04:09:24.837387Z","title":"Llmlingua: Compressing prompts for accelerated in- ference of large language models.arXiv preprint arXiv:2310.05736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11638","last_updated":"2025-06-13T10:11:01Z","snapshot_observed_at":"2026-08-09T06:20:14.015637Z","submitted_at":"2025-06-13T10:11:01Z","title":"LoRA-Gen: Specializing Large Language Model via Online LoRA Generation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T04:09:24.837387Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2506.11638"},"observation_digest":"sha256:07fd3a7e4707138a7dc2d2003c8692aa9e18d6863ff9449999707147856f6ef9","observation_id":"12d84b6d-e533-4cd1-aaac-86815c522721","resolution":{"observed_at":"2026-08-07T04:09:24.837387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T11:17:24.406028Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2507.02259"},"observation_digest":"sha256:6737fc9d60365422d3d5b3744bf98420fd7c3a58467210c601624402eb8aa4c0","observation_id":"ea12e6e0-b53f-4cc3-a8ce-11b12b42f102","resolution":{"observed_at":"2026-05-15T11:17:24.592535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-06T20:40:10.564649Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:40:10.564649Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2507.02259"},"observation_digest":"sha256:6902afdd01146d01bcd7f5ab2af7509c2237ae51b639a4363f80a93bb5b30404","observation_id":"d4cf843a-3838-4780-ac24-684bd888cb39","resolution":{"observed_at":"2026-08-06T20:40:10.564649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-05T12:52:01.641529Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-08T17:37:43.606906Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:01.641529Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:1ab6620cb8b5371631392ac503647cf71e00196dd97e64727b87099a8b879a4c","observation_id":"9c490a55-a641-41ed-979e-524003d7b96a","resolution":{"observed_at":"2026-08-05T12:52:01.641529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T10:36:37.392346Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.09801","last_updated":"2026-06-09T14:05:10Z","snapshot_observed_at":"2026-08-08T10:14:55.534670Z","submitted_at":"2025-10-10T19:04:28Z","title":"How can we assess human-agent interactions? Case studies in software agent design","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T10:36:37.392346Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.09801"},"observation_digest":"sha256:cbc8dbb4e5723afb564d7c02a95c57746fd58c8d6337172421c721940de8f640","observation_id":"cc7a1180-8b1d-4f7c-8378-d88f4f88a128","resolution":{"observed_at":"2026-08-04T10:36:37.392346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T08:28:49.536406Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.20535","last_updated":"2026-07-29T08:07:09Z","snapshot_observed_at":"2026-08-10T06:10:33.923122Z","submitted_at":"2025-10-23T13:20:57Z","title":"ARC-Encoder: learning compressed text representations for large language models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T08:28:49.536406Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.20535"},"observation_digest":"sha256:723eb69a80ebebd9b8e1afc72635cc035c246eb86c26dc2857acb9cc1dd81c76","observation_id":"9fd21ffa-571e-4863-abbb-a76960a04134","resolution":{"observed_at":"2026-08-04T08:28:49.536406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-04T08:06:11.078142Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.22963","last_updated":"2026-06-19T20:25:06Z","snapshot_observed_at":"2026-08-04T08:06:05.944327Z","submitted_at":"2025-10-27T03:37:41Z","title":"When Compression Becomes an Attack Surface: Black-Box Attacks on Prompt-Compressed LLM Agents","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T08:06:11.078142Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2510.22963"},"observation_digest":"sha256:84076d8248c808652776a37c73f036f3f5c9dedce0c56b72cdec4f68b3ce4c57","observation_id":"32c3b362-8b83-428a-a01d-689ab3ba003b","resolution":{"observed_at":"2026-08-04T08:06:11.078142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.08324","last_updated":"2026-05-25T15:41:17Z","snapshot_observed_at":"2026-08-03T03:25:21.079471Z","submitted_at":"2026-02-09T06:57:15Z","title":"Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T13:43:51.127429Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.08324"},"observation_digest":"sha256:d1afe2fe5f9769e4db993a8996102aca29ebc59b1dafefdbad74dc45adba56c8","observation_id":"1840f4d0-04f9-4b48-9270-0fabf218d965","resolution":{"observed_at":"2026-05-21T13:44:11.449562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-03T03:25:23.076743Z","title":"Llmlin- gua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08324","last_updated":"2026-05-25T15:41:17Z","snapshot_observed_at":"2026-08-03T03:25:21.079471Z","submitted_at":"2026-02-09T06:57:15Z","title":"Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:25:23.076743Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.08324"},"observation_digest":"sha256:d26a696bf9f5fe9e1d2dfba4bf7b5f78b312d2822151b4719e30c72ea4857b20","observation_id":"33b6f1fa-13fa-4b47-9045-1a7d96d29872","resolution":{"observed_at":"2026-08-03T03:25:23.076743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.11574","last_updated":"2026-05-21T03:54:07Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T04:45:44Z","title":"Learning to Configure Agentic AI Systems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T13:06:56.207692Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.11574"},"observation_digest":"sha256:ac164741d60fc64cdcdd6c095595d0da5933a20e10747f870fc60e9f038c6230","observation_id":"24041952-da97-4dc5-9b99-fdc3f1637114","resolution":{"observed_at":"2026-05-21T13:10:10.359193Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2602.11574","last_updated":"2026-05-21T03:54:07Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T04:45:44Z","title":"Learning to Configure Agentic AI Systems","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T11:29:45.134060Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2602.11574"},"observation_digest":"sha256:23ecb2219c54cecdbeaaf3381cf3efdf7245118b45824b547d4cc5536feb7eef","observation_id":"10c5e7c7-b318-48a3-8ac3-99ae685b5df0","resolution":{"observed_at":"2026-05-22T11:31:29.533983Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.09607","last_updated":"2026-03-11T07:04:01Z","snapshot_observed_at":"2026-07-06T22:58:25.877654Z","submitted_at":"2026-03-11T07:04:01Z","title":"LLM-assisted Agentic Edge Intelligence Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T13:56:03.688192Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.09607"},"observation_digest":"sha256:4fbbf6972feac4334bc76cd128144c7ad5d6253a71f03c0d55b1ab42d19d1754","observation_id":"b67fc6f0-ae67-4b8b-80ce-9d7915ae65f8","resolution":{"observed_at":"2026-05-15T14:00:03.440252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.13725","last_updated":"2026-04-15T11:00:17Z","snapshot_observed_at":"2026-08-05T11:32:59.124748Z","submitted_at":"2026-04-15T11:00:17Z","title":"On the Effectiveness of Context Compression for Repository-Level Tasks: An Empirical Investigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T13:00:56.512868Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.13725"},"observation_digest":"sha256:45a44c169c9951fd3f3531eaf568ee88bbd51d37ba2669727e030201201f2d30","observation_id":"f698696a-d1b7-4447-b945-3c592ab986b2","resolution":{"observed_at":"2026-05-10T13:40:27.553422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.14156","last_updated":"2026-03-22T14:27:24Z","snapshot_observed_at":"2026-08-02T12:56:00.032907Z","submitted_at":"2026-03-22T14:27:24Z","title":"Compressed-Sensing-Guided, Inference-Aware Structured Reduction for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T06:52:18.563146Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.14156"},"observation_digest":"sha256:6299099a6f8c2276df4063d10e07dcb8883fb0d1b5f4e5b690cb183f52e896b5","observation_id":"3dc12810-508d-4da3-ab4e-f63eee353003","resolution":{"observed_at":"2026-05-15T06:55:10.698328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.17512","last_updated":"2026-04-19T16:05:33Z","snapshot_observed_at":"2026-07-29T17:45:26.538909Z","submitted_at":"2026-04-19T16:05:33Z","title":"ONTO: A Token-Efficient Columnar Notation for LLM Input Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T05:21:56.826488Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.17512"},"observation_digest":"sha256:d8c655af6cfeaea8d6a3d9ece85d314a7c6b67ea0c8e72f697e2c8710d7d183f","observation_id":"d77242a0-5e09-4624-adee-921596b1bbc4","resolution":{"observed_at":"2026-05-10T09:23:37.788133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.20727","last_updated":"2026-04-22T16:12:36Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:12:36Z","title":"Supplement Generation Training for Enhancing Agentic Task Performance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T00:58:27.655909Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.20727"},"observation_digest":"sha256:1c527b6a0a2f379b4d828d469f72199ed8f694794616b626e0e96ee4b61d9456","observation_id":"ff9c3f20-8131-48f6-a877-a1e59cafc4cf","resolution":{"observed_at":"2026-05-10T00:59:49.528114Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.21231","last_updated":"2026-05-04T22:59:12Z","snapshot_observed_at":"2026-07-06T23:07:51.979267Z","submitted_at":"2026-04-23T02:55:31Z","title":"SparKV: Overhead-Aware KV Cache Loading for Efficient On-Device LLM Inference","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T14:09:30.821354Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.21231"},"observation_digest":"sha256:10b475860cf4df9432aa9e497ffe55a5d17cfe64315413cace8cc9c44d323f35","observation_id":"075c5251-e277-4d6d-aeec-c40261aeb228","resolution":{"observed_at":"2026-05-11T18:46:07.779041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2604.26622","last_updated":"2026-04-29T12:49:30Z","snapshot_observed_at":"2026-08-09T09:48:28.683521Z","submitted_at":"2026-04-29T12:49:30Z","title":"OCR-Memory: Optical Context Retrieval for Long-Horizon Agent Memory","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T10:45:48.976501Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2604.26622"},"observation_digest":"sha256:c476f06da07a5d0f05a06519c42272b01f9f6f2b82446adf6b27cf007c3dbf92","observation_id":"a234ca39-dfe8-4eb4-b367-d6070dd1cf0f","resolution":{"observed_at":"2026-05-12T09:31:25.537117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00336","last_updated":"2026-05-01T01:34:53Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T01:34:53Z","title":"Budget-Aware Routing for Long Clinical Text","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-09T19:59:00.888734Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00336"},"observation_digest":"sha256:5ca1a7aae6addd8a848af4d96d9ac3d4ea0c22b2aa9306e22c0589e3bd9a6b90","observation_id":"3726b935-c200-4b81-b842-0f3460351fb0","resolution":{"observed_at":"2026-05-11T15:26:10.192361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-09T18:54:06.144968Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:19c5c3629f1497e1a41b21729824eeadb6ef942dbaf5240adff65f9b704991f9","observation_id":"adc10e6b-b90c-4c19-b7d5-189f57fa8d6b","resolution":{"observed_at":"2026-05-11T16:01:19.749858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.00505","last_updated":"2026-05-17T17:18:53Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T08:30:52Z","title":"LLM-Oriented Information Retrieval: A Denoising-First Perspective","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-21T00:18:32.423103Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.00505"},"observation_digest":"sha256:9079ce260742336d198d9bfc14142d79080cb6f61a492dbe6e3c01154cc68d78","observation_id":"c2fec4e9-8772-4d5f-9473-5a56d9782452","resolution":{"observed_at":"2026-05-21T00:19:16.570350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.09611","last_updated":"2026-05-10T15:48:38Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T15:48:38Z","title":"Byte-Exact Deduplication in Retrieval-Augmented Generation: A Three-Regime Empirical Analysis Across Public Benchmarks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:18:11.836537Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.09611"},"observation_digest":"sha256:c4bb228669f24575d5d42833174a1706560513ed0e83d78f8f2c4ea49044907a","observation_id":"570d6085-1061-43d9-ba01-bf90ae8330e2","resolution":{"observed_at":"2026-05-12T06:26:24.196333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-07-31T10:30:03.841807Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:355738dd3a091ea43ae00f7025e46e4706233ac26063d00df7277d54f72a82b1","observation_id":"0ce26496-205a-4f76-9f79-39760693bd75","resolution":{"observed_at":"2026-06-30T15:34:48.513036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2605.26165","last_updated":"2026-05-24T20:52:54Z","snapshot_observed_at":"2026-08-02T00:37:55.747392Z","submitted_at":"2026-05-24T20:52:54Z","title":"Tool-Schema Compression Enables Agentic RAG Under Constrained Context Budgets","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T23:23:49.298204Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2605.26165"},"observation_digest":"sha256:9eb951ae3c3691a922bfc658843e6c666c07f89d43f2e9e53a03fa2b3afa5a07","observation_id":"7f1a60ae-bca1-40cc-b45f-89d97c3143b8","resolution":{"observed_at":"2026-06-29T23:24:01.270362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.03979","last_updated":"2026-07-10T17:52:03Z","snapshot_observed_at":"2026-07-15T23:18:25.559225Z","submitted_at":"2026-06-02T17:56:55Z","title":"Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T10:56:13.058872Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.03979"},"observation_digest":"sha256:60212167c17a6728ac2a9a389c11b0da7bc8574d76e5138f5aa04e8ba40b1459","observation_id":"94c48765-afd0-491c-8695-d7eb7ac9dc0e","resolution":{"observed_at":"2026-07-02T02:26:26.695917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-13T07:44:25.325808Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03979","last_updated":"2026-07-10T17:52:03Z","snapshot_observed_at":"2026-07-15T23:18:25.559225Z","submitted_at":"2026-06-02T17:56:55Z","title":"Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T07:44:25.325808Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.03979"},"observation_digest":"sha256:f938e31403416b15e49a7d5f2d1df014f7478b3e187547c4dc07746f348c6114","observation_id":"53d80952-6f94-4501-b0fa-8058eeabff75","resolution":{"observed_at":"2026-07-13T07:44:25.325808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.05875","last_updated":"2026-06-04T08:47:46Z","snapshot_observed_at":"2026-08-07T04:31:32.433154Z","submitted_at":"2026-06-04T08:47:46Z","title":"QCFuse: Query-Aware Cache Fusion via Compressed View for Efficient RAG Serving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T01:47:43.240850Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.05875"},"observation_digest":"sha256:a3ab1cbffac429aac31c74579d026d40bb46d0f7cb3b9c643550dc5b946122ac","observation_id":"ddddc700-5c17-4948-8aa4-b4d4e80ec9e8","resolution":{"observed_at":"2026-07-02T12:46:57.478212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.08151","last_updated":"2026-06-06T13:02:28Z","snapshot_observed_at":"2026-07-06T23:47:43.942733Z","submitted_at":"2026-06-06T13:02:28Z","title":"Decision-Aware Memory Cards: Counterfactual-Inspired Context Selection and Compression for Tool-Using LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T19:47:08.844690Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.08151"},"observation_digest":"sha256:e3671ab016a0146a819feea2c1eb903fc1328a8902d89e5d39f683c4622d3420","observation_id":"2736a578-a94a-418a-9eeb-13cec35d42d4","resolution":{"observed_at":"2026-07-02T21:17:25.260446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.09659","last_updated":"2026-06-08T15:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T15:43:16Z","title":"End-to-End Context Compression at Scale","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T16:36:54.699174Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.09659"},"observation_digest":"sha256:5375f18d7eb726f19ae7b73df4d340be9acbac6bbb2809d4d19651aca429b9ee","observation_id":"ca86e023-c913-4143-8476-247483c077a5","resolution":{"observed_at":"2026-07-03T01:17:31.616571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.10209","last_updated":"2026-06-08T22:01:28Z","snapshot_observed_at":"2026-08-09T13:33:34.978875Z","submitted_at":"2026-06-08T22:01:28Z","title":"Less Context, Better Agents: Efficient Context Engineering for Long-Horizon Tool-Using LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T16:10:25.191306Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.10209"},"observation_digest":"sha256:d1063de88341d79e7260ae67b7fb7a8a4e89604a2ac812242a36ce42470fd202","observation_id":"38dda257-2d76-4c89-a68f-c7290b5a80a0","resolution":{"observed_at":"2026-07-03T02:07:33.619433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-08-07T13:16:30.354063Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:d99efe46708604730dbfcf21429a3a6326b53e8f8d4b2228c9d74d1312169c74","observation_id":"4555f900-c28b-4ff1-b6fd-9311a2aa28a7","resolution":{"observed_at":"2026-07-04T02:19:23.905129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":1},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-06-26T16:15:22.543601Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:055c920ff38f7ed571b149ee073e492a40f29cd17521d69e21c811d8e72018a9","observation_id":"e1434e72-7500-43ac-98d2-1752019b4273","resolution":{"observed_at":"2026-07-04T05:09:36.936832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T10:49:13.256103Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20295","last_updated":"2026-07-24T07:54:17Z","snapshot_observed_at":"2026-08-02T10:48:55.986116Z","submitted_at":"2026-06-18T14:33:09Z","title":"Token-Operations-Oriented Inference Optimization Techniques for Large Models","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-02T10:49:13.256103Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.20295"},"observation_digest":"sha256:2df19a8ff9631c49a17eb3de84af59b883d118a00970c55995011bd688690684","observation_id":"a3c17276-531a-447f-b190-2fb8246f4ece","resolution":{"observed_at":"2026-08-02T10:49:13.256103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2606.28349","last_updated":"2026-06-03T07:15:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-03T07:15:11Z","title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T11:30:52.871762Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2606.28349"},"observation_digest":"sha256:af3ed72ff4df40bc296de55bdda5c54ec848a206cdf84a1cc4c0e1d1ba161688","observation_id":"06e93a9e-23a9-4284-a100-c4a53829084e","resolution":{"observed_at":"2026-06-30T11:34:37.884491Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.01241","last_updated":"2026-05-04T01:41:31Z","snapshot_observed_at":"2026-08-08T17:02:41.853193Z","submitted_at":"2026-05-04T01:41:31Z","title":"Mapping Text to Multiplex Graph: Prompt Compression as L\\'evy Walk-Guided Graph Pruning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-04T01:45:36.335508Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01241"},"observation_digest":"sha256:7fd89c488ad2fe3bb0ec620dca6f36c1a2f62ad54b23ff8b06e5ea7ea40f12c3","observation_id":"4404e395-a8a2-428c-8e87-7a2eed6babba","resolution":{"observed_at":"2026-07-04T01:49:21.550972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.01916","last_updated":"2026-07-09T01:58:28Z","snapshot_observed_at":"2026-08-10T10:35:48.348710Z","submitted_at":"2026-07-02T09:15:28Z","title":"ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T14:09:32.980488Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01916"},"observation_digest":"sha256:8aea6a1582d09a51291d029d485196e1a53f1de6a61eb6a87333901fc5bd6cd2","observation_id":"b4d2f544-20d4-495b-ae9b-7a7cbd752945","resolution":{"observed_at":"2026-07-03T14:18:22.569952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-12T08:32:14.868469Z","title":"LLMLingua: Compressing prompts for accelerated inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.01916","last_updated":"2026-07-09T01:58:28Z","snapshot_observed_at":"2026-08-10T10:35:48.348710Z","submitted_at":"2026-07-02T09:15:28Z","title":"ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T08:32:14.868469Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.01916"},"observation_digest":"sha256:bcc3c0f7a2464aaa214064fa5b1f9e3aa845d9528227b8400d07ac295cd91d9c","observation_id":"d4c13e6d-a18b-4ed4-bcea-7c1ee9e55a06","resolution":{"observed_at":"2026-07-12T08:32:14.868469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-12T05:14:41.315225Z","title":"In: Proceedings of 15 EMNLP (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03048","last_updated":"2026-07-03T07:37:57Z","snapshot_observed_at":"2026-08-07T16:10:51.966744Z","submitted_at":"2026-07-03T07:37:57Z","title":"Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T05:14:41.315225Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.03048"},"observation_digest":"sha256:f1a1961d3d668814f3b0a45b95c469a9d579c6aebc9a6b2d3bbad9716d1d695b","observation_id":"051587d5-d924-4796-a7b1-950773355e3a","resolution":{"observed_at":"2026-07-12T05:14:41.315225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.05736","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-10T01:36:44.322096Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":"cs.CL","work_id":"3e2bb4aa-fc83-449c-80b8-000b02d811a4","year":2023},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:6b724805231ea90ffd989a17d3df08024d2f708a3c081c4113b1c4965a5b6081","observation_id":"c0bd2724-36b3-4170-98b8-ba9ce4697d40","resolution":{"observed_at":"2026-07-10T01:36:44.323273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-13T03:29:34.486347Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09375","last_updated":"2026-07-10T12:57:08Z","snapshot_observed_at":"2026-08-07T07:07:24.560093Z","submitted_at":"2026-07-10T12:57:08Z","title":"Mach-Mind-4-Flash Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T03:29:34.486347Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.09375"},"observation_digest":"sha256:7e9e877394e8a6a2af53a67f9d0a3c3fd02ad0fe550e0dc0e48ab19cedcf223d","observation_id":"410403c7-29ae-4e64-a6a4-897774022f78","resolution":{"observed_at":"2026-07-13T03:29:34.486347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-07-14T17:40:33.397259Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models.Conference on Empirical Methods in Natural Language Processing (EMNLP), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09691","last_updated":"2026-06-19T04:22:17Z","snapshot_observed_at":"2026-08-06T23:49:57.114144Z","submitted_at":"2026-06-19T04:22:17Z","title":"What Context Does a Coding Agent Actually Need to Act?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T17:40:33.397259Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.09691"},"observation_digest":"sha256:af7f31a07d702115f046845140abd4dc5499cbc8752f90131d5c7c5cce09be10","observation_id":"3a5f3d21-5cf8-4a9d-800c-d8a8c972387b","resolution":{"observed_at":"2026-07-14T17:40:33.397259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-01T23:14:54.635607Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15516","last_updated":"2026-07-17T00:03:47Z","snapshot_observed_at":"2026-08-09T04:50:07.964882Z","submitted_at":"2026-07-17T00:03:47Z","title":"Cache-Aware Prompt Compression:A Two-Tier Cost Model for LLM API Caching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T23:14:54.635607Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.15516"},"observation_digest":"sha256:f686104df83e207d19ad96b8013a62dedd02068660046c320f3a7ed7454bb91b","observation_id":"fd748da0-4d6e-40ff-9f9d-b36300ca1cc9","resolution":{"observed_at":"2026-08-01T23:14:54.635607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T14:32:14.315923Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16209","last_updated":"2026-05-10T13:27:01Z","snapshot_observed_at":"2026-08-06T04:38:36.769964Z","submitted_at":"2026-05-10T13:27:01Z","title":"Shapley Context Pruning: A Cooperative Game Perspective for Context Reranking and Pruning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T14:32:14.315923Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.16209"},"observation_digest":"sha256:b57a7c21c050acf91304001accd497dde0821e8dbaec1f014b259485c50d5e4e","observation_id":"0a17e1cd-b03b-4492-a933-1c39358fb63b","resolution":{"observed_at":"2026-08-02T14:32:14.315923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-01T20:54:09.109669Z","title":"arXiv preprint arXiv:2310.05736 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16528","last_updated":"2026-07-17T22:09:01Z","snapshot_observed_at":"2026-08-07T07:19:10.753414Z","submitted_at":"2026-07-17T22:09:01Z","title":"Hierarchical Domain Generalization","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T20:54:09.109669Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.16528"},"observation_digest":"sha256:26e3c9bfcd9f1c00a75b2baf437fcce0fe18d9ff4e1b35eef73d02c794ba51e9","observation_id":"e27cbc51-3fc1-4a48-905d-fe59b0e9ded6","resolution":{"observed_at":"2026-08-01T20:54:09.109669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-02T11:37:06.990703Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models.arXiv preprint arXiv:2310.05736, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19368","last_updated":"2026-06-12T01:11:17Z","snapshot_observed_at":"2026-08-09T02:12:00.549509Z","submitted_at":"2026-06-12T01:11:17Z","title":"Spectral-LSH: Sub-Quadratic Prompt Compression via Krylov-Projected Locality-Sensitive Hashing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T11:37:06.990703Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2607.19368"},"observation_digest":"sha256:68a3e2767f277f43e6476e77b64d7bc008bea790739147a8e59a0402fd66aee4","observation_id":"b0406970-d688-4c57-a030-8dbe36cf166a","resolution":{"observed_at":"2026-08-02T11:37:06.990703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-10T15:27:03.120485Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-10T18:11:11.977898Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.120485Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:bfa474964206fe9eda2090901ef41e26ea0c0a9a7953714dad5969b24185eb12","observation_id":"f2c13c4a-5ffe-4121-8948-f0309e808f58","resolution":{"observed_at":"2026-08-10T15:27:03.120485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05736/citation-record","integrity":"/paper/2310.05736/integrity","json":"/paper/2310.05736/citation-record.json","paper":"/paper/2310.05736"},"outbound":[],"paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 59 inbound Pith citation observations for arXiv:2310.05736."}