{"as_of":"2026-08-20T13:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bdbc889153fb86ff8df8c2c42acdca95a908d7b8f447dca745ba554593d24de8","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:58:48.391076Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:17:20.819486Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11271","snapshot_observed_at":"2026-08-03T06:17:20.819486Z","title":"Semantic caching of contextual summaries for efficient question-answering with language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.23088","last_updated":"2026-06-30T05:19:59Z","snapshot_observed_at":"2026-08-16T05:07:15.707248Z","submitted_at":"2026-01-30T15:37:00Z","title":"From Similarity to Vulnerability: Key Collision Attack on LLM Semantic Caching","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-03T06:17:20.819486Z"},"links":{"cited_paper":"/paper/2505.11271","citing_paper":"/paper/2601.23088"},"observation_digest":"sha256:b043adae1b6131cd8b338b7a3f735ab73c68022bf92a3b222c1b69fa7e71d119","observation_id":"cb43a98a-3435-4722-a3fc-6519ed874057","resolution":{"observed_at":"2026-08-03T06:17:20.819486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11271","snapshot_observed_at":"2026-08-02T22:50:28.959689Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.16727","last_updated":"2026-07-13T19:29:16Z","snapshot_observed_at":"2026-08-16T11:15:10.590864Z","submitted_at":"2026-02-17T15:39:51Z","title":"Mobility-Aware Cache Framework for Scalable LLM-Based Human Mobility Simulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T22:50:28.959689Z"},"links":{"cited_paper":"/paper/2505.11271","citing_paper":"/paper/2602.16727"},"observation_digest":"sha256:61deb6bf431c541b7a755637e17cfea90d7c1aca4aff33f1025185e8de586e2b","observation_id":"0e1c964f-bce9-49cf-8f53-f2cd2127aa30","resolution":{"observed_at":"2026-08-02T22:50:28.959689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.11271/citation-record","integrity":"/paper/2505.11271/integrity","json":"/paper/2505.11271/citation-record.json","paper":"/paper/2505.11271"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.188953Z","title":"GPTCache: An open-source semantic cache for llm applications enabling faster answers and cost savings","venue":null,"work_id":"75dadcde-3306-46d0-af05-4ebcf5fe29f1","year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.825323Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:750fefbe8e474845e7c92203f2303f7c504ce56433db7c9802a1145e92c35a50","observation_id":"cd33428e-6458-444b-8ef3-9d97e679c23e","resolution":{"observed_at":"2026-08-15T20:58:49.197291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T20:58:47.861219Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.861219Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:209ffe787dabf6cce876e20afb9e341fc2e902107ebdbe9fbd1d8816e685db99","observation_id":"ffb6cf9f-2042-4823-a7cf-bdf5a7a8f4b3","resolution":{"observed_at":"2026-08-15T20:58:47.861219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15605","last_updated":"2025-02-23T19:48:12Z","snapshot_observed_at":"2026-08-18T08:02:27.077957Z","submitted_at":"2024-12-20T06:58:32Z","title":"Don't Do RAG: When Cache-Augmented Generation is All You Need for Knowledge Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15605","snapshot_observed_at":"2026-08-15T20:58:47.866645Z","title":"Chan, Chao-Ting Chen, Jui-Hung Cheng, and Hen-Hsen Huang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.866645Z"},"links":{"cited_paper":"/paper/2412.15605","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:ae2ec89a3aeaf4d67c6126245da5c94205bf6aba4d32b3801abe791c78e41bc5","observation_id":"c32646be-2548-44ff-8dd5-cd1c3132ae04","resolution":{"observed_at":"2026-08-15T20:58:47.866645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.174234Z","title":"codefuse-ai/ModelCache, June 2024","venue":null,"work_id":"80bb96c1-a480-43fa-9c92-8ae545831516","year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.873691Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:2263167a470221660cc21618e8c4dda2192c19e0baf3805aecf61b50a9f32442","observation_id":"fbf82a27-7d6f-4cd4-94ae-4aca67b539d4","resolution":{"observed_at":"2026-08-15T20:58:49.178625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.158289Z","title":"Langchain: Build applications with llms through composability","venue":null,"work_id":"6b598579-b278-491b-b401-955cb97a24d6","year":2022},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.880205Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:5dca9e0542334ec96895cfbcd76f5d1a953790ba823abab7cd5c158c6ff4471e","observation_id":"78cb19b7-9c97-46f6-bca4-c1048a37fb5a","resolution":{"observed_at":"2026-08-15T20:58:49.163241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.132318Z","title":"Model caches in LangChain","venue":null,"work_id":"7766f663-5bbc-4f4f-9a2d-80459a9d6f02","year":2025},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.884990Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:0a69ca1204e5888cda932ea5c79ae4c855f9fd2091c38c15fea5487892bfc4da","observation_id":"59ff05e7-bbc7-4d02-803d-dda275165778","resolution":{"observed_at":"2026-08-15T20:58:49.144289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.115105Z","title":"Semantic cache for RAG using FAISS","venue":null,"work_id":"d20ad599-516c-4d0c-a902-ed2cb7876a86","year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.893507Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:c1f337ad6e0da4bdd9da1b5a845a9be41a955a957e45d6356d6522acf827e425","observation_id":"18a497a0-47bb-44bd-9057-957e9eb4d3e6","resolution":{"observed_at":"2026-08-15T20:58:49.119966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02694","last_updated":"2025-03-07T14:49:07Z","snapshot_observed_at":"2026-08-18T16:21:07.302220Z","submitted_at":"2024-03-05T06:23:50Z","title":"MeanCache: User-Centric Semantic Caching for LLM Web Services","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02694","snapshot_observed_at":"2026-08-15T20:58:47.899143Z","title":"Privacy-aware semantic cache for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.899143Z"},"links":{"cited_paper":"/paper/2403.02694","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:bb7abd9c332b1c5e66b7689edc03fb4ef19ebccb6adf2ac27157c0eaef98fe67","observation_id":"be467206-ff87-4076-aaac-155e0bca71d9","resolution":{"observed_at":"2026-08-15T20:58:47.899143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04934","last_updated":"2024-04-25T15:45:19Z","snapshot_observed_at":"2026-08-18T21:38:48.895755Z","submitted_at":"2023-11-07T18:17:05Z","title":"Prompt Cache: Modular Attention Reuse for Low-Latency Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04934","snapshot_observed_at":"2026-08-15T20:58:47.904448Z","title":"Prompt cache: Modular attention reuse for low-latency inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.904448Z"},"links":{"cited_paper":"/paper/2311.04934","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:057b4d170807ed2884d3d14b61c50756c50debd8470116439ba5f1fd9e873135","observation_id":"16ed6f4d-bfae-4ca9-baa0-85949ef8450c","resolution":{"observed_at":"2026-08-15T20:58:47.904448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15332","last_updated":"2025-05-27T09:24:50Z","snapshot_observed_at":"2026-08-20T11:49:30.115804Z","submitted_at":"2024-10-20T08:42:29Z","title":"EPIC: Efficient Position-Independent Caching for Serving Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15332","snapshot_observed_at":"2026-08-15T20:58:47.910040Z","title":"EPIC: Efficient Position-Independent Context Caching for Serving Large Language Models, February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.910040Z"},"links":{"cited_paper":"/paper/2410.15332","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:55a80e817b0aa4333d8142182a74bce938b3e003a4d0c320119582c2d3131775","observation_id":"928ea50b-3914-431e-ae90-2c0002094ad7","resolution":{"observed_at":"2026-08-15T20:58:47.910040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-16T14:53:48.767514Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-15T20:58:47.983020Z","title":"LLMLingua: Compressing prompts for accelerated inference of large language models, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:47.983020Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:e914b2e80a8533e94f682cd9189fea2ffa0d1013fd313e68d14cdb860619e019","observation_id":"e4058a9f-2dcd-4658-b504-75b78e3cd4c5","resolution":{"observed_at":"2026-08-15T20:58:47.983020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06839","last_updated":"2024-08-12T03:53:35Z","snapshot_observed_at":"2026-08-16T14:53:21.033889Z","submitted_at":"2023-10-10T17:59:58Z","title":"LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06839","snapshot_observed_at":"2026-08-15T20:58:48.117812Z","title":"LongLLMLingua: Accelerating and enhancing llms in long context scenarios via prompt compression, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.117812Z"},"links":{"cited_paper":"/paper/2310.06839","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:880c553d083f7db12f944d23feb9815892b3728d8bd993c7dc6c8fb46e585d0d","observation_id":"7fc3b256-d5a7-4834-9354-f3de788b3547","resolution":{"observed_at":"2026-08-15T20:58:48.117812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-19T19:49:59.264961Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-08-15T20:58:48.148683Z","title":"RAGCache: Efficient knowledge caching for retrieval-augmented generation.arXiv preprint arXiv:2404.12457, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.148683Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:0cd251eb8079dc0d16c903fc366b680dc4df32abd1380579483e912e1295d705","observation_id":"cfbdc121-e183-4f81-82f4-38ea3c3899be","resolution":{"observed_at":"2026-08-15T20:58:48.148683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08734","last_updated":"2017-02-28T10:42:31Z","snapshot_observed_at":"2026-08-14T21:14:23.253253Z","submitted_at":"2017-02-28T10:42:31Z","title":"Billion-scale similarity search with GPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08734","snapshot_observed_at":"2026-08-15T20:58:48.154091Z","title":"Billion-scale similarity search with gpus","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.154091Z"},"links":{"cited_paper":"/paper/1702.08734","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:f5df5ea87429e90e0462545d824838a6825fb9f22244e5e0240ab72e59d8eda6","observation_id":"966519c4-0449-46dd-b5ef-6209bcdaa207","resolution":{"observed_at":"2026-08-15T20:58:48.154091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.098230Z","title":"Weld, and Luke Zettlemoyer","venue":null,"work_id":"28d6b9d2-f277-4208-9446-2e2be22ff1ab","year":2017},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.160403Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:a5a4080bcfbf99e4c8f500f27e8c2baf5765886e64cf4a842dde0d371e6fa82e","observation_id":"b0917477-83a9-4128-94c7-b98068c814a8","resolution":{"observed_at":"2026-08-15T20:58:49.103682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.079262Z","title":"Dai, Jakob Uszko- reit, Quoc Le, and Slav Petrov","venue":null,"work_id":"4d007753-b48b-461c-8d9a-06c233416998","year":2019},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.165768Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:8960c9ed56db1312e46a1baf57a11cf27601fbd74baa3f6c7320644a89b48309","observation_id":"f3a7dafd-539c-465e-a1ef-cc0917e7dab7","resolution":{"observed_at":"2026-08-15T20:58:49.085213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-15T20:58:48.174430Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.174430Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:37ea8511224c16080db76d39ee10b13e8bfbe911b0b755abec5db4502fe44845","observation_id":"9280a1d8-fcc1-40cd-a948-c95e244db4d4","resolution":{"observed_at":"2026-08-15T20:58:48.174430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00025","last_updated":"2024-05-24T08:16:22Z","snapshot_observed_at":"2026-08-18T16:22:20.663183Z","submitted_at":"2024-05-24T08:16:22Z","title":"SCALM: Towards Semantic Caching for Automated Chat Services with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00025","snapshot_observed_at":"2026-08-15T20:58:48.179534Z","title":"Scalm: Towards semantic caching for automated chat services with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.179534Z"},"links":{"cited_paper":"/paper/2406.00025","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:76937c6e2b9dc5a383b69516ac9132d0170715ca14d1e3c7d52d7a68d47bd2aa","observation_id":"fe4127fd-aa75-4f0f-bee7-023313c7d340","resolution":{"observed_at":"2026-08-15T20:58:48.179534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:49.062345Z","title":"Context-based Semantic Caching for LLM Applications","venue":null,"work_id":"21edb94d-9882-4cde-afd8-7b0892870bbf","year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.185101Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:1098bb43428ced0cb9fdab67e84afa6414a17bb99d0442207a8df723fa648f25","observation_id":"a0f4fc94-cbe1-44fe-a23a-4464b548cc8d","resolution":{"observed_at":"2026-08-15T20:58:49.067541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.989742Z","title":"Gpt-3.5 turbo model on OpenAI Platform","venue":null,"work_id":"9c16aebd-4a5c-40e0-8810-c7b8f7d7c8fb","year":2023},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.191441Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:d3a64eda09cd5b813e4e933fc039424fcae602fd230efc70e3bfa7ae20b95e97","observation_id":"df834436-ec53-4f93-a7ff-acac92568f97","resolution":{"observed_at":"2026-08-15T20:58:49.028196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12968","last_updated":"2024-08-12T04:48:11Z","snapshot_observed_at":"2026-08-19T21:51:24.710530Z","submitted_at":"2024-03-19T17:59:56Z","title":"LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12968","snapshot_observed_at":"2026-08-15T20:58:48.197690Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.197690Z"},"links":{"cited_paper":"/paper/2403.12968","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:255c1823ccdb0944e656dd1efa195b9382d82f3392145039e48a443a4dd792c3","observation_id":"e87241dd-17e3-4a1e-b6e6-87e2bc369140","resolution":{"observed_at":"2026-08-15T20:58:48.197690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.272255Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.272255Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:7ac808026805f720f8ba0de57717b990fdc3e9988ff381b5f6ed677190e08de2","observation_id":"6e52e12e-8b76-47aa-89de-addda9929c87","resolution":{"observed_at":"2026-08-15T20:58:48.272255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.908977Z","title":"Sentence-BERT: Sentence embeddings using siamese bert-networks","venue":null,"work_id":"aba931d7-4d9a-45b7-a2fa-78ed0b661236","year":2019},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.358604Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:873c2f5486174880f2aca247dd236d1e818682fb1b6416d44e51ca8a206d280c","observation_id":"4363324f-61ae-4bfa-9c18-a1785c12e6c2","resolution":{"observed_at":"2026-08-15T20:58:48.920842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.886826Z","title":"Hybrid-RACA: Hybrid retrieval-augmented composition assistance for real- time text prediction, 2024","venue":null,"work_id":"a42f7050-8d77-4c6b-bb53-dd9263e684a9","year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.365047Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:4da866cbcf7b0ba7da3110d4a2e25e4019c92c9ebe3ff67d381515b3fb430c84","observation_id":"83a41446-0680-4566-adff-4e1da676dc71","resolution":{"observed_at":"2026-08-15T20:58:48.892886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16444","last_updated":"2025-04-03T22:49:22Z","snapshot_observed_at":"2026-08-19T22:56:32.061881Z","submitted_at":"2024-05-26T06:00:17Z","title":"CacheBlend: Fast Large Language Model Serving for RAG with Cached Knowledge Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16444","snapshot_observed_at":"2026-08-15T20:58:48.371131Z","title":"CacheBlend: Fast large language model serving with cached knowledge fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.371131Z"},"links":{"cited_paper":"/paper/2405.16444","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:eaad2a764538a2f594d89d97f37b0b664f34f68a67e61a3859face1a507fc32e","observation_id":"e459a123-2da6-4993-b6c6-07d88dab5e34","resolution":{"observed_at":"2026-08-15T20:58:48.371131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11289","last_updated":"2024-06-17T07:52:32Z","snapshot_observed_at":"2026-08-18T16:21:40.542139Z","submitted_at":"2024-06-17T07:52:32Z","title":"A Systematic Survey of Text Summarization: From Statistical Methods to Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11289","snapshot_observed_at":"2026-08-15T20:58:48.376954Z","title":"Yu, and Jiawei Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.376954Z"},"links":{"cited_paper":"/paper/2406.11289","citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:55c9d1b00b82ae3085c245fad0b9e7300b80cfe8e862bcf3b46f774fb1421b40","observation_id":"5444d93a-259e-44d9-b226-bbb4f6e5743e","resolution":{"observed_at":"2026-08-15T20:58:48.376954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.866663Z","title":"Hammerla","venue":null,"work_id":"6906c547-b63f-4bb6-976e-3da7127b1104","year":2019},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.384443Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:b7903a783ef7a228b6a336b391d2a87be3e16b1c1a5c8d5c8188248f8c56f508","observation_id":"5d19d9de-cc62-49b4-8c6c-c4a9a08c03fd","resolution":{"observed_at":"2026-08-15T20:58:48.872405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:48.786283Z","title":"Instcache: A predictive cache for llm serving, 2024","venue":null,"work_id":"7003d09a-873b-471a-9002-f97c35e156ed","year":2024},"citing_paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:58:48.391076Z"},"links":{"citing_paper":"/paper/2505.11271"},"observation_digest":"sha256:58d0cb89e68aaac4af7dfb0fc8ca507ce8ebc8ca99c84177835a2de48ee69d88","observation_id":"24ac40a4-c5f4-4249-81ae-72b87d789cfd","resolution":{"observed_at":"2026-08-15T20:58:48.820906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.11271","last_updated":"2025-05-16T14:04:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T17:14:31.943828Z","submitted_at":"2025-05-16T14:04:31Z","title":"Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 2 inbound Pith citation observations for arXiv:2505.11271."}