{"as_of":"2026-08-22T21:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2b7abd189360fedefc099043706ded227295e4b3237350b0a1c1cda8f54f7a4","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:00:57.653001Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:39:51.029533Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-02T23:32:14.247088Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13692","last_updated":"2026-06-30T17:19:18Z","snapshot_observed_at":"2026-08-13T15:15:57.031830Z","submitted_at":"2026-02-14T09:26:41Z","title":"ThunderAgent: A Simple, Fast and Program-Aware Agentic Inference System","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T23:32:14.247088Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2602.13692"},"observation_digest":"sha256:6e7d5ea27577ad107ca16ff526f9e80bfa1ba5c9e2e641d0576bf28f3086e228","observation_id":"86f43106-2d83-458e-978a-8b9d942ada3f","resolution":{"observed_at":"2026-08-02T23:32:14.247088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-07-13T22:20:51.838309Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18897","last_updated":"2026-06-16T09:34:16Z","snapshot_observed_at":"2026-08-18T01:04:06.450202Z","submitted_at":"2026-03-19T13:36:50Z","title":"Parallelizing Tool Execution and LLM Generation for Low-Latency Agent Serving","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T22:20:51.838309Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2603.18897"},"observation_digest":"sha256:e50b7d5db2f5a4dfdc651c50694ab3d2191e1f1324ad32f205cd6729b02193b2","observation_id":"f0f091cc-6658-4be0-a16b-41d239073977","resolution":{"observed_at":"2026-07-13T22:20:51.838309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":"2508.18572","doi":"10.48550/arxiv.2508.18572","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":"arXiv (Cornell University)","work_id":"e016d7a1-4c20-4407-b18e-bd46cf9a9650","year":2025},"citing_paper":{"arxiv_id":"2604.06370","last_updated":"2026-04-07T18:52:25Z","snapshot_observed_at":"2026-08-21T01:12:40.280699Z","submitted_at":"2026-04-07T18:52:25Z","title":"ForkKV: Scaling Multi-LoRA Agent Serving via Copy-on-Write Disaggregated KV Cache","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T18:16:49.292491Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2604.06370"},"observation_digest":"sha256:1b72233be4d2dfe17af03283792d60c9d690caeb0637e8d13b905596009fee2c","observation_id":"6a2f86e7-d855-4f86-a30c-8bdc72d797ff","resolution":{"observed_at":"2026-05-10T18:20:42.770551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":"2508.18572","doi":"10.48550/arxiv.2508.18572","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":"arXiv (Cornell University)","work_id":"e016d7a1-4c20-4407-b18e-bd46cf9a9650","year":2025},"citing_paper":{"arxiv_id":"2604.24391","last_updated":"2026-04-27T12:20:53Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T12:20:53Z","title":"FreqCache: Accelerating Embodied VLN Models with Adaptive Frequency-Guided Token Caching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T03:10:29.477937Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2604.24391"},"observation_digest":"sha256:d9a269adc3f29697bb8a6bc4445aed05fe422d462c2187de10a5a0fb1fb5c463","observation_id":"ecd6d783-94cc-4669-8d34-6e5147a8d152","resolution":{"observed_at":"2026-05-11T22:16:13.676988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":"2508.18572","doi":"10.48550/arxiv.2508.18572","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":"arXiv (Cornell University)","work_id":"e016d7a1-4c20-4407-b18e-bd46cf9a9650","year":2025},"citing_paper":{"arxiv_id":"2605.03375","last_updated":"2026-05-05T05:33:11Z","snapshot_observed_at":"2026-08-14T04:30:49.919579Z","submitted_at":"2026-05-05T05:33:11Z","title":"Tutti: Making SSD-Backed KV Cache Practical for Long-Context LLM Serving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-09T16:19:33.613685Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2605.03375"},"observation_digest":"sha256:b78466cfb551b98e436b67d6dc5a20d1803c3880bae065c6ab3c1970caddb27f","observation_id":"870be5fa-bab8-4aea-a61e-37270727c093","resolution":{"observed_at":"2026-05-11T16:31:10.420876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":"2508.18572","doi":"10.48550/arxiv.2508.18572","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":"arXiv (Cornell University)","work_id":"e016d7a1-4c20-4407-b18e-bd46cf9a9650","year":2025},"citing_paper":{"arxiv_id":"2605.18071","last_updated":"2026-05-18T08:54:16Z","snapshot_observed_at":"2026-08-14T17:54:46.021672Z","submitted_at":"2026-05-18T08:54:16Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T11:13:46.098095Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2605.18071"},"observation_digest":"sha256:b5697d986e1d6ce3d42d2372ae06a5cf167dbb18764409709f3bf48b0870388d","observation_id":"c4e9f83a-6f42-4dae-9019-a22385b9ac07","resolution":{"observed_at":"2026-05-20T11:18:13.961843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":"2508.18572","doi":"10.48550/arxiv.2508.18572","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":"arXiv (Cornell University)","work_id":"e016d7a1-4c20-4407-b18e-bd46cf9a9650","year":2025},"citing_paper":{"arxiv_id":"2605.19932","last_updated":"2026-05-19T14:51:32Z","snapshot_observed_at":"2026-08-20T01:54:55.865038Z","submitted_at":"2026-05-19T14:51:32Z","title":"PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T05:50:14.266278Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2605.19932"},"observation_digest":"sha256:8ca5b26e442d5409cdfd6eb1f0d74e844fe2ad089553b0bd69f0eb42bb3a127d","observation_id":"f0f86a84-aa2e-4b9e-866c-582dce798d21","resolution":{"observed_at":"2026-05-20T05:53:04.709462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-15T14:57:57.598073Z","title":"Strata: Hierarchical context caching for long context language model serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03555","last_updated":"2026-08-04T12:25:45Z","snapshot_observed_at":"2026-08-19T01:15:55.357267Z","submitted_at":"2026-08-04T12:25:45Z","title":"Heterogeneous LLM Serving with General-Purpose Processing-Near-Memory for Retrieval-Based Sparse Attention","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T14:57:57.598073Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2608.03555"},"observation_digest":"sha256:f0a909bcd192388caf388451e643a70d89a4effcb1aaf001b10069319fa0000d","observation_id":"06aa777f-2162-43e5-90a6-415a16325328","resolution":{"observed_at":"2026-08-15T14:57:57.598073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-10T16:45:23.429982Z","title":"Strata: Hierarchical context caching for long context language model serving","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07009","last_updated":"2026-08-07T09:22:17Z","snapshot_observed_at":"2026-08-18T08:36:39.548295Z","submitted_at":"2026-08-07T09:22:17Z","title":"HiSparse: Scaling Sparse-Attention Decoding with Hierarchical KV Cache Management","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T16:45:23.429982Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2608.07009"},"observation_digest":"sha256:4a1439e24e9e8a71e157c7d2d09f51bb3b3da0faccccf52cbd915bac7f282658","observation_id":"cf222180-b25d-4802-9352-9aabc53fcfa9","resolution":{"observed_at":"2026-08-10T16:45:23.429982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-16T00:39:51.029533Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11668","last_updated":"2026-08-13T02:03:03Z","snapshot_observed_at":"2026-08-21T19:54:54.380991Z","submitted_at":"2026-08-12T05:25:38Z","title":"HBF Sucks! A Full-Stack Characterization of High-Bandwidth Flash for KV-Centric LLM Serving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:51.029533Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2608.11668"},"observation_digest":"sha256:74a99faba494d27f3ac51880a2fc9de02d8b351d38d8c7a2aa0fde89c1e6a329","observation_id":"935d7f9a-a559-43df-a097-0354e851487c","resolution":{"observed_at":"2026-08-16T00:39:51.029533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18572","snapshot_observed_at":"2026-08-14T15:11:04.607248Z","title":"arXiv:2508.18572 [cs.DC]https://arxiv.org/abs/ 2508.18572","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13263","last_updated":"2026-08-13T14:01:21Z","snapshot_observed_at":"2026-08-19T15:54:19.401871Z","submitted_at":"2026-08-13T14:01:21Z","title":"vToken: Token-Level Virtualization for Reclaimable KV Caches","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T15:11:04.607248Z"},"links":{"cited_paper":"/paper/2508.18572","citing_paper":"/paper/2608.13263"},"observation_digest":"sha256:4de7f6a656a9be39c4feda2c76c8960182e8eebcf85ec4efc7ab80a5817adb5e","observation_id":"aa7270b8-1987-42d2-bb86-d247cf0c9ab3","resolution":{"observed_at":"2026-08-14T15:11:04.607248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.18572/citation-record","integrity":"/paper/2508.18572/integrity","json":"/paper/2508.18572/citation-record.json","paper":"/paper/2508.18572"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.824301Z","title":null,"venue":null,"work_id":"47626f07-b009-4a46-a637-c9710edd14d4","year":null},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.424038Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:e6b3695c78287c9cbde8dccf711fb4c216eb6779954295aff8166ea69eaf1c8e","observation_id":"645f44cd-80ef-4d9c-a572-c4af63e516bb","resolution":{"observed_at":"2026-08-15T17:00:58.829362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.807693Z","title":null,"venue":null,"work_id":"20376970-86ba-4b12-b489-eb062a9f53ce","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.429381Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:6e4d83c71444ed981f3f8a2b98418ee3c0f3f36b80ef5b63b493bbd70381e471","observation_id":"967be3c3-5e1e-4d4c-9d2d-a23bd1776b1b","resolution":{"observed_at":"2026-08-15T17:00:58.813152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.791721Z","title":null,"venue":null,"work_id":"318c12fe-b917-44a0-873b-dd18131e9808","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.434683Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:8f0890ec1597100546d881b92437d3b7fa09ae91e1bf3f54097d2f99dd86f7a4","observation_id":"19e6b23d-3813-45b9-90f7-20f1ae789a8d","resolution":{"observed_at":"2026-08-15T17:00:58.796554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.776721Z","title":null,"venue":null,"work_id":"647282d5-1325-4134-9645-9aff1287acfc","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.439725Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:eb3ddeebf3d237aa3715a638243a0e902f424db863309744731461827e6da94c","observation_id":"b17afbf8-6f3f-490a-8d17-58b780a9dcdb","resolution":{"observed_at":"2026-08-15T17:00:58.781355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.444779Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.444779Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:74da0f63d99db1d6c006b6c9693c21deb5ba6c5662e9c49142b261383a04c9bb","observation_id":"1547d83c-fa56-4015-840e-2ec02dedc87d","resolution":{"observed_at":"2026-08-15T17:00:57.444779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.449559Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.449559Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5045efccb021fcf5b2b410709e8e62e3c4930f82b2da7db7c9f71d79ed0c97e5","observation_id":"6c87f1f9-2df8-4b6c-9621-c826e4dba9cf","resolution":{"observed_at":"2026-08-15T17:00:57.449559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.762563Z","title":null,"venue":null,"work_id":"97e0b991-b0b7-41e6-9631-501856cd11f3","year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.454570Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:64e73e57a827d698c6e832f29d5ab8d64040694414afb66ff45ba102ae782c47","observation_id":"4dcbd34a-8afd-4f56-bb83-6f987d387503","resolution":{"observed_at":"2026-08-15T17:00:58.766845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.747922Z","title":null,"venue":null,"work_id":"cbda3243-e8b0-4d15-a8d9-578b371a7770","year":null},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.460019Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:ed27d2a032c0f7bc97c21fc828f119f1553f4c1d407f9be6bd36caf383ae48d2","observation_id":"4bca676f-487d-458e-9f39-ffe334156374","resolution":{"observed_at":"2026-08-15T17:00:58.752578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T17:00:57.464795Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.464795Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:714effee3afaee9ac3b9737d17d202e4367a1e9c6d40a2202f156a812dd59bd5","observation_id":"381db59a-c2ac-44e5-8043-591b433494cb","resolution":{"observed_at":"2026-08-15T17:00:57.464795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.732503Z","title":null,"venue":null,"work_id":"300c508b-cd5e-4540-bf64-8bcd9478a4e9","year":2019},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.469923Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:38b0879be9b83dcc568d767fe16528d05e9a80c64cc01199ba49011269ec731e","observation_id":"b83d0cbb-3a00-48e6-b2de-5133d55b8b9f","resolution":{"observed_at":"2026-08-15T17:00:58.737687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.717726Z","title":null,"venue":null,"work_id":"f61930cb-974c-44a6-a90d-6fb8a48c5f9f","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.475207Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:1cf16979234289dc4764e234d8649bd5ea4d45ac46fbe98aab4feb340daf63b9","observation_id":"7d5755b4-3007-43bd-b113-b3ae8d365b63","resolution":{"observed_at":"2026-08-15T17:00:58.722334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-15T17:00:57.480064Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.480064Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:71cf81e8a8c1f60ecdfa68ac87c7a1b8c69520f1a304a0efa34f01ec12ed03db","observation_id":"dba10e46-33b1-4163-ace6-7da5653efca9","resolution":{"observed_at":"2026-08-15T17:00:57.480064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.702665Z","title":null,"venue":null,"work_id":"6fc461a9-3943-4c8b-9b72-0bcef1e2ede3","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.485113Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:6581f5567eb7a60b99f47422a32ab72182a35a0e13a8774463c75d31c3c67e10","observation_id":"80d8296a-1cfa-4910-9127-0db3808c5543","resolution":{"observed_at":"2026-08-15T17:00:58.707264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.688257Z","title":null,"venue":null,"work_id":"876865f5-8792-4388-b496-d1b7a27a1ac9","year":null},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.489679Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:ba2ef8cac845114f996e7532608c00afb094f629a6036a2b95afff4cb2ac5c46","observation_id":"080742a3-d52d-4fd6-83bc-30415e0c6b57","resolution":{"observed_at":"2026-08-15T17:00:58.692712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.671369Z","title":null,"venue":null,"work_id":"bef12a5e-1e38-40ff-b011-e829c02beef7","year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.494185Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5d049c97f97b85d9782141703a358c4e238d721dbca9dcbf5fa4cd5e28f88a5d","observation_id":"61ca67ed-716e-4fc7-b694-08dfae869266","resolution":{"observed_at":"2026-08-15T17:00:58.677174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-08-18T10:15:29.605221Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-15T17:00:57.498922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.498922Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:6f239f63d32409c1290b6bf758f5c0447d9ce4c08110877d6bd1a500d48a64ce","observation_id":"86f66e83-47d2-4a25-b6e2-11667170df6a","resolution":{"observed_at":"2026-08-15T17:00:57.498922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.656666Z","title":"2023.{ARK}:{GPU-driven} code execution for distributed deep learning","venue":null,"work_id":"babec5ef-d27b-407b-b590-93a95646b0c5","year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.503891Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:f4a4df1992da4ae13b3093c582175a8c1569d398d170313ce57e9559dedfcae9","observation_id":"85aa1725-f4bc-4733-a99c-faed425b5445","resolution":{"observed_at":"2026-08-15T17:00:58.661641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.508668Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.508668Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:290a4ffb71dcde01e17d780f1e1e9fcc8d89b53e2a47d28b8afa442093b7e0a6","observation_id":"0554fc76-43cc-411d-adb7-fc9917c89a20","resolution":{"observed_at":"2026-08-15T17:00:57.508668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-19T19:49:59.264961Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-08-15T17:00:57.513840Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.513840Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:3dbbebcb33e6d2fdc19666c1e830ccc888fbd0cf0614edb5752ed3a7f7e5569a","observation_id":"83b07101-490d-4a36-992d-6ab661ca4f03","resolution":{"observed_at":"2026-08-15T17:00:57.513840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.641532Z","title":null,"venue":null,"work_id":"0b449109-d35c-4fcf-a5b8-72e35d4d1a49","year":null},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.518971Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:ef2968ebeef44404821c2499513b616d37cb048e18b3f1ecf99000c19af2608d","observation_id":"4f44217b-fea6-4eff-8d59-e9edc3953f68","resolution":{"observed_at":"2026-08-15T17:00:58.646369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.625631Z","title":null,"venue":null,"work_id":"7d5dc747-ed23-4c2a-937d-32d320d907c6","year":2018},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.528735Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:562adc51dfdc46c6c7e140adc69043d6d1138404cc85bd1b9d8ec4eba4cce917","observation_id":"320a06d3-cd6e-449e-979e-434a161083b5","resolution":{"observed_at":"2026-08-15T17:00:58.631031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.533260Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.533260Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:721ee729d722caa4900bc4d7fb6e52e594927602908e48ec32fc6dc4de8cd0b4","observation_id":"f68e2dc0-1cc4-4b51-b503-2ea3a35683c3","resolution":{"observed_at":"2026-08-15T17:00:57.533260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04939","last_updated":"2024-09-06T05:06:51Z","snapshot_observed_at":"2026-08-16T14:45:06.045654Z","submitted_at":"2023-11-08T01:45:37Z","title":"LooGLE: Can Long-Context Language Models Understand Long Contexts?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04939","snapshot_observed_at":"2026-08-15T17:00:57.537937Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.537937Z"},"links":{"cited_paper":"/paper/2311.04939","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:8ab7bec3696c3791f8c97ef62c94d6a4c876a78af2582755b88f7176dcd94454","observation_id":"e3494433-d01f-4b6c-9f98-e5b9671266ea","resolution":{"observed_at":"2026-08-15T17:00:57.537937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.610366Z","title":null,"venue":null,"work_id":"e5781599-97c1-4297-bde7-a34552c99b98","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.542820Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:c3a5efb785e3c45acde646914835a726027f24880e4ccc3a8f7cf362487f3ecb","observation_id":"f83f7523-7d97-470c-a625-aba547fc5243","resolution":{"observed_at":"2026-08-15T17:00:58.615109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.594179Z","title":null,"venue":null,"work_id":"bc471fea-b241-4528-bb91-5a7a876c0cf5","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.547462Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:8fc2818a642871e807bbf2e11be59182fe9134231daf8784cd55237a0a6d9cf1","observation_id":"643672c3-5ed1-4a55-90cc-39ffb2131d86","resolution":{"observed_at":"2026-08-15T17:00:58.600046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.578480Z","title":null,"venue":null,"work_id":"f35f374d-7648-4b06-9d84-b73f0e0a194a","year":2020},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.552955Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:e8bab8090812232a69e766b8533800b76864d7c42abcaeda728c6a3a8f315560","observation_id":"3232bc0d-c5ea-4b46-a29f-2d33efae7bd6","resolution":{"observed_at":"2026-08-15T17:00:58.583509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.557826Z","title":"Berger, Nathan Beck- mann, and Gregory R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.557826Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:0745da86d5fe3c24ffdc1248b700b6ba3fa821acb9a002f20edad5027b4d3dfa","observation_id":"9cbbc7a7-cfcd-40ca-9f42-6c2cd86cb996","resolution":{"observed_at":"2026-08-15T17:00:57.557826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.563615Z","title":null,"venue":null,"work_id":"017cc49d-db1a-4dc3-9d46-1d9911e840d2","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.562444Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:11059b397f2613d6071befabac3626a55d3e2cd1e1f02b5e9c422c385541150d","observation_id":"fc0b5693-45c2-40bc-917e-eaf91cb4711c","resolution":{"observed_at":"2026-08-15T17:00:58.568132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.547925Z","title":null,"venue":null,"work_id":"8934ade7-0c30-4af4-b1bb-03db6504ae15","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.566845Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:78a284f0690ef0a1e5236c059093e6fce566ae1f4c842f0a5e13c30fd6a74c3d","observation_id":"d30914ed-2761-4ab7-a3f9-ea12c24ee51d","resolution":{"observed_at":"2026-08-15T17:00:58.553435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.571421Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.571421Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5eee0db0300cd9b9cd8799289aed69abd9777fb22e6f990ab61ca208a1266aa6","observation_id":"23c1e63a-c8f2-46a3-a952-8d2007edbf2e","resolution":{"observed_at":"2026-08-15T17:00:57.571421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.532725Z","title":null,"venue":null,"work_id":"d05a64f5-8955-4006-89a7-738f24eca1d8","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.576114Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:0204ada372e5666a945a7c9c2f4e124528a729340dda86d7c3c9e486731bf5ae","observation_id":"a1cfbafc-5e56-4d5b-a780-72415e45a16b","resolution":{"observed_at":"2026-08-15T17:00:58.537437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.516812Z","title":null,"venue":null,"work_id":"8993fd0f-8c7d-4d0c-9dde-eeba32e57385","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.580762Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:2488eae7a1dd06e992ab4432efa60484d089c776d1e37cdb3c452fa87bee6ae6","observation_id":"af56cb4f-e0ba-4b60-8f6b-c234dcb757d7","resolution":{"observed_at":"2026-08-15T17:00:58.521562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.501230Z","title":null,"venue":null,"work_id":"57205b0d-491e-414d-9097-1e9160ac0510","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.585253Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5e5844439b78b09701bbb2a208e6ae633cccd7d1f0f76b8c497ce502eeaf0f0c","observation_id":"4d4dc9ee-e69b-448a-9bae-91c5fc819e87","resolution":{"observed_at":"2026-08-15T17:00:58.506115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.486428Z","title":null,"venue":null,"work_id":"90fb69d0-4f83-4744-9617-64981f11e92c","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.589743Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:662d3782c9a7a83de0f721f54a233e5dfecfb27bae2a47e45474c8c4d8214989","observation_id":"34f5aba7-eee8-498a-8fc5-0816e1989fe8","resolution":{"observed_at":"2026-08-15T17:00:58.490999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.470703Z","title":null,"venue":null,"work_id":"f4bc6935-67fe-484a-95a3-e4bbc122835c","year":null},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.594717Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:64a80c6ab7f9c159bd74c13549fdf1ed79c95f1b4b698feacd674d203ab519af","observation_id":"133a2f5e-aac1-4338-a669-0e474c1a4841","resolution":{"observed_at":"2026-08-15T17:00:58.475878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.455057Z","title":null,"venue":null,"work_id":"fd9144dd-6e4b-4d3d-a94a-a181fae4b469","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.599454Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:f48fa32f949f3721db70bfc0024745d269c14aa59446677dddcfda862be6df97","observation_id":"735ad3ec-0b5f-4a36-ad30-e04658f786cd","resolution":{"observed_at":"2026-08-15T17:00:58.459983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.604189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.604189Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:6880787861600a62ea6cb872fe6a2bfa8685af0d0dc60e0a8c0e4761fbbf34b4","observation_id":"00ff3736-d0ee-4cea-8f5f-4a77cedbe2fd","resolution":{"observed_at":"2026-08-15T17:00:57.604189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05688","last_updated":"2024-06-09T08:24:17Z","snapshot_observed_at":"2026-08-19T12:38:06.879549Z","submitted_at":"2024-06-09T08:24:17Z","title":"Peer Review as A Multi-Turn and Long-Context Dialogue with Role-Based Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05688","snapshot_observed_at":"2026-08-15T17:00:57.609034Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.609034Z"},"links":{"cited_paper":"/paper/2406.05688","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5326f1e1d64d29eea9153210043925099500e7b6490e2787ed8b99e828ac2caf","observation_id":"62840e3d-f133-4477-9162-3f65c1fdcdc4","resolution":{"observed_at":"2026-08-15T17:00:57.609034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.614858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.614858Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:25f1d733bdbd24363bee3ea542218c1872fa7ce6692c75fa608c97dafb3aa4ca","observation_id":"f0d4554e-e09b-444f-89e8-5ba7c1d5cf58","resolution":{"observed_at":"2026-08-15T17:00:57.614858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.428186Z","title":null,"venue":null,"work_id":"d52099dc-b031-4a4a-9927-a302a608592f","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.619433Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:317bc5c68ed76a8b47be4d11cbb5f7357a0a09a241cc877b0c33f73c00d2cafb","observation_id":"e7f8fb07-af35-4578-9736-ee88f0d652a1","resolution":{"observed_at":"2026-08-15T17:00:58.433323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.411949Z","title":null,"venue":null,"work_id":"7d3206d8-fcdb-496b-a6fd-472324911767","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.623801Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:c0ed9cf4fa6ea4b81769bc28925834e4d67ceaa7c471294d4c549e5bb2f134cd","observation_id":"7d182254-5694-470f-8ad5-891150ee43d7","resolution":{"observed_at":"2026-08-15T17:00:58.416673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.396365Z","title":null,"venue":null,"work_id":"bef8d95d-c5be-4264-a911-3905de24fca1","year":2022},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.633327Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:ba4e1a9f762860dd72a1928df3ad838d57eefa694b8466d8fa27514ccfd1fdea","observation_id":"0a089474-3f62-413d-972c-fbb4c6f00ebc","resolution":{"observed_at":"2026-08-15T17:00:58.401520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:57.638600Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.638600Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:9b841b0460d656ebed8924055785d9750c9669923b6749dec14bbe0d012024cd","observation_id":"f7536102-fafe-4e2f-aafb-19a6cf3388a3","resolution":{"observed_at":"2026-08-15T17:00:57.638600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.381046Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":"a23b5532-d7c1-4edd-9f0a-475a5c8e97cc","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.643036Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:2b43eaf30cb84df0ff8b02112fd6353d5b8500b350f930550f3d5d041a571aca","observation_id":"9312ee23-d504-4619-81aa-5a23df6886c9","resolution":{"observed_at":"2026-08-15T17:00:58.385805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.365553Z","title":"2024.{DistServe}: Disaggregating prefill and decoding for goodput-optimized large language model serving","venue":null,"work_id":"4a1fb7c5-a8be-4754-b2d5-43c924ebe6e7","year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.647536Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:5ece6ba18aa3549209a67c50bc1b7a854da1721c3d542671bf4264f1a8da1578","observation_id":"4bb07b2e-d036-4da8-96a6-8df7c51db475","resolution":{"observed_at":"2026-08-15T17:00:58.370570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:00:58.347670Z","title":"2025.{NanoFlow}: Towards Optimal Large Language Model Serving Throughput","venue":null,"work_id":"a45f1bfe-c4fc-4028-ab4a-b75935232962","year":2025},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.653001Z"},"links":{"citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:b0199334b5cb8c70a86c6132fd2989417413e509e57cef08b2aa3e90ec6f1fd0","observation_id":"16abf596-9ab5-4b7b-bddb-589df34c7dad","resolution":{"observed_at":"2026-08-15T17:00:58.354294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03065","last_updated":"2025-02-20T23:28:01Z","snapshot_observed_at":"2026-08-18T10:16:17.240901Z","submitted_at":"2024-10-04T01:11:09Z","title":"Compute Or Load KV Cache? Why Not Both?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03065","snapshot_observed_at":"2026-08-15T17:00:57.523831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T17:00:57.523831Z"},"links":{"cited_paper":"/paper/2410.03065","citing_paper":"/paper/2508.18572"},"observation_digest":"sha256:4fda5ed67f36114d42706ea385ebb8270f0f074cbbb0fa3869a7c93603c65b44","observation_id":"b6bf9be3-6ad0-40d3-9227-000123066927","resolution":{"observed_at":"2026-08-15T17:00:57.523831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18572","last_updated":"2025-08-26T00:09:03Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-18T12:35:51.096042Z","submitted_at":"2025-08-26T00:09:03Z","title":"Strata: Hierarchical Context Caching for Long Context Language Model Serving"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 11 inbound Pith citation observations for arXiv:2508.18572."}