{"as_of":"2026-08-23T04:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d004e3a190656f23445385d49bfffa27f6a50955ebac97a1b2236ca6ce58f62e","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:21:09.423239Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.18736/citation-record","integrity":"/paper/2508.18736/integrity","json":"/paper/2508.18736/citation-record.json","paper":"/paper/2508.18736"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:08.967594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.967594Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:439c4ed3c6d7a523b07e88d07b322ef406f9307982c12835e9270801ce623605","observation_id":"c6919733-900e-40c9-a755-6eaa8fe6edfb","resolution":{"observed_at":"2026-08-05T16:21:08.967594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:08.973100Z","title":"Friedman, Thomas Williams, Ramesh K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.973100Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1dcb25155d2d269dad037478277e84d4c036ba089cb38e2322820733c2f6fa15","observation_id":"78d93f28-82a0-413b-8366-f54349e7937e","resolution":{"observed_at":"2026-08-05T16:21:08.973100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.206762Z","title":null,"venue":null,"work_id":"182eb270-29c6-468e-9432-5ae1ebf133d2","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.978284Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:013f73ed2b36048a28e676538565d823baff21355e909eaed9c42f3c75445a56","observation_id":"6cf8142c-8315-40bf-b5db-1a681bc9a22c","resolution":{"observed_at":"2026-08-05T16:21:11.212250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.187233Z","title":null,"venue":null,"work_id":"9f5af578-992c-48e0-a580-f19b240d8378","year":1999},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.983281Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:29494121e60b7712cb3a0131cf0e79992827353cb301ae601eade7289cbf84fa","observation_id":"c52d962d-5b0a-4596-87cf-6ad0eb4a85a2","resolution":{"observed_at":"2026-08-05T16:21:11.194673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.167054Z","title":"Diochnos, and György Turán","venue":null,"work_id":"c0e93dd8-95a8-413b-8af0-9895bc42ee61","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.988478Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d0346e094ade9b6f79f96f3fb07949e9ef991300a932a2e07a0dd69104582e39","observation_id":"d24b6b40-b210-4202-94bd-3cb5e61ea35b","resolution":{"observed_at":"2026-08-05T16:21:11.173770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.146690Z","title":null,"venue":null,"work_id":"19d21f9d-0b93-4473-9717-927811c689a1","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.993414Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:09b6581531aa31324a180fb2d0885ac9e280fb5e8e164fac23760a5fb618ae89","observation_id":"858fafc1-c44d-42ab-9f1a-9cfbaa1a41df","resolution":{"observed_at":"2026-08-05T16:21:11.153324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.124183Z","title":null,"venue":null,"work_id":"5ad73984-fe86-46d2-a638-626610aaf7a1","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:08.999121Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:8bda8cf3761fa3419858934971cca9224a871e9e09d054d1104a0e9236296757","observation_id":"dabc0472-4746-4d4f-93fc-0463681757fc","resolution":{"observed_at":"2026-08-05T16:21:11.130237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.106992Z","title":null,"venue":null,"work_id":"19b9903d-34d9-4956-9568-825f7027de45","year":2013},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.004112Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:5ca82f09444e0d241fcdb54f6174a355043807063d013ee8b2652cd1d46f1f8c","observation_id":"424a3847-d3d4-4b58-9a77-788707fb8b87","resolution":{"observed_at":"2026-08-05T16:21:11.112356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.090575Z","title":null,"venue":null,"work_id":"c4cb9a62-bb56-40b2-8eeb-750318662e9b","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.008942Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:33c28a1a87771c4f917aebadc5f0a73b3fb66ec2bd46f064fefd249559e15c99","observation_id":"d39d6c18-c2f3-4c12-91f1-765ce14436d0","resolution":{"observed_at":"2026-08-05T16:21:11.095229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.073792Z","title":null,"venue":null,"work_id":"9e3cec6b-99d8-413c-8c7f-c6b6fa353980","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.015714Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:78b2a1b29c757b10611ee152114017f94bf3550e3b6c837b48c1e989b6940ada","observation_id":"1e87b0fe-fbec-419c-a703-8c48562ff3fe","resolution":{"observed_at":"2026-08-05T16:21:11.078762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.057284Z","title":null,"venue":null,"work_id":"af19c938-0e00-460e-9cd8-28323693a5df","year":1994},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.021044Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:69c267ff2324e038a237919672b6eee049edfe59fd13580a6fb464cbbb5b6f72","observation_id":"d697c792-8196-43ff-a052-cd4431807435","resolution":{"observed_at":"2026-08-05T16:21:11.062376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.038305Z","title":null,"venue":null,"work_id":"1028db39-f00e-4de4-a0b7-773ff989b55f","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.026770Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:67f34328119320a504541a4b40bd6ea806ae5c67946623c4d33119b9bdd87864","observation_id":"98d3eebb-f1f6-462d-af13-92c41bde8ebd","resolution":{"observed_at":"2026-08-05T16:21:11.044148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.016683Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christoph er Ré","venue":null,"work_id":"d399320d-7486-4274-98b5-918b647aa485","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.031349Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0fe389238491168fe89dc81e4516f1d3678e83f6c953c8171e070a0e207ef64c","observation_id":"ed20cb44-9cf8-40ad-aca8-4c9eb935319d","resolution":{"observed_at":"2026-08-05T16:21:11.021657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:11.000281Z","title":"Franklin, Björn Þór Jónsson, Divesh Srivast ava, and Michael Tan","venue":null,"work_id":"ca9ffde0-6b50-49fa-9a6d-5eebb3b65528","year":1996},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.036453Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1cfc08277781f8b3284be89be8202557cef6b015b3c403012039340efbd2e1de","observation_id":"8d1aa310-3765-4b35-8515-9a150867dca3","resolution":{"observed_at":"2026-08-05T16:21:11.005739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.984251Z","title":null,"venue":null,"work_id":"c1deb3bc-1687-4949-86b4-6c05dd12f9ee","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.041255Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bcfec7e199477a22be66f3052fbff57fb93475d219c09098356874b77f8d40d3","observation_id":"f1568b58-0736-4354-a949-aff88f306996","resolution":{"observed_at":"2026-08-05T16:21:10.988991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.968044Z","title":null,"venue":null,"work_id":"d4e67505-bd72-44f6-a53f-dd264c862705","year":2005},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.046577Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:55ae4c1403e1b3d33ee63b3c008c9e8e105d6baa3db301e3595ae8cc18f6210c","observation_id":"c3c04eae-ff93-427a-972b-9bd43047d2c1","resolution":{"observed_at":"2026-08-05T16:21:10.973134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.950249Z","title":null,"venue":null,"work_id":"87f26e7a-5b69-4e74-843c-dc60f3ea029d","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.051348Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:8d846ece3081277b193a7ca679c2cd44b08d9aaca3b08c41b0c6211e3a05df65","observation_id":"e7bef831-e068-49b3-b57a-c831921aa8a4","resolution":{"observed_at":"2026-08-05T16:21:10.955802Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T16:21:09.056946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.056946Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3af937c6928c32d0dff0b1f49397a54f7c8299277d1c3bd6eee417fc5aa4a54c","observation_id":"ab63d14c-727e-4337-beb5-c39b60ccca8c","resolution":{"observed_at":"2026-08-05T16:21:09.056946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-05T16:21:09.063232Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.063232Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:54e598baea04cd09282a8e5e67e13f78f9dba8cf34da998af23bcd424e146963","observation_id":"05b381e6-b7d8-4916-b995-7dd8de9f97aa","resolution":{"observed_at":"2026-08-05T16:21:09.063232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.931723Z","title":null,"venue":null,"work_id":"cc862329-d6b0-4c6b-87c4-f0c346c347ad","year":1996},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.068768Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:40ab5d00a17947bb8fb59c07193d6f7e8b12563017d0456359ab575323783b69","observation_id":"4ad55ba6-b621-4db7-9911-1c4a24949c93","resolution":{"observed_at":"2026-08-05T16:21:10.937342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.914341Z","title":null,"venue":null,"work_id":"21158c48-ba38-485e-bdd7-b8ce04afb687","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.075098Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:6a8bce896bef01954fe1276392329f877bc05cc5442ec78aac438f9d6d284353","observation_id":"69b63203-c8d6-4f99-ae25-7d17f7b98a11","resolution":{"observed_at":"2026-08-05T16:21:10.919321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02694","last_updated":"2025-03-07T14:49:07Z","snapshot_observed_at":"2026-08-18T16:21:07.302220Z","submitted_at":"2024-03-05T06:23:50Z","title":"MeanCache: User-Centric Semantic Caching for LLM Web Services","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02694","snapshot_observed_at":"2026-08-05T16:21:09.080027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.080027Z"},"links":{"cited_paper":"/paper/2403.02694","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:801d20b424013aeffb84b2d99952732c9a39ddb90ae602aa7f9ec0da5adaea12","observation_id":"c5054ce4-24c9-4b66-845a-01721d0ddbe9","resolution":{"observed_at":"2026-08-05T16:21:09.080027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.896844Z","title":null,"venue":null,"work_id":"2973dfd9-f17b-4ecf-b1bb-0ca7d96bce95","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.085155Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4da3c7986f69d0b4b24dff4dd3a05ff484c2c430d300226e65e61eae8dd1ad79","observation_id":"941ffc24-8cd7-439c-acf9-2a8a1b248d64","resolution":{"observed_at":"2026-08-05T16:21:10.902435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.876391Z","title":null,"venue":null,"work_id":"9864499a-2913-4854-85dc-ab179be8ab8a","year":2017},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.090467Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:3a41ba4f58a1db54dfaba85824bae3c5dc7df11f14e8e5d3f82c64258da505c7","observation_id":"5c8a123f-0514-41a4-ad41-7b363bd16b09","resolution":{"observed_at":"2026-08-05T16:21:10.881636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.858816Z","title":null,"venue":null,"work_id":"283e1134-fcfd-4c62-9240-352b2a0f3adb","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.097010Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:a85a4e02b8d0b9fe8ed1d3df90021c4179bfeb4a7c1839c01b8bf3ac3f0b0624","observation_id":"d92789fe-cabf-4ec1-bfd1-3dd951288b53","resolution":{"observed_at":"2026-08-05T16:21:10.864701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08671","last_updated":"2024-01-09T06:49:40Z","snapshot_observed_at":"2026-08-16T14:47:07.109022Z","submitted_at":"2024-01-09T06:49:40Z","title":"DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08671","snapshot_observed_at":"2026-08-05T16:21:09.103693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.103693Z"},"links":{"cited_paper":"/paper/2401.08671","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4ad3961f1211ba7547801d275e81d945a5387f73b2b30bd5894aaac30751f7de","observation_id":"f846ec65-36d7-4250-8207-3cbfadd1c795","resolution":{"observed_at":"2026-08-05T16:21:09.103693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.840140Z","title":null,"venue":null,"work_id":"9e92169e-f9cb-4246-9556-8558b18f4edd","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.110862Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:9776ad80ac3b989b03ab8e00431d6e20a349822e1de6ca9946d5359d0a51abc0","observation_id":"843860fe-3f61-4436-ae99-f329249799c4","resolution":{"observed_at":"2026-08-05T16:21:10.846298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.822648Z","title":null,"venue":null,"work_id":"9dfed572-fc58-4046-aae1-53267cb1dca7","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.117131Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:108158d614419c0b269d9e73e8b2b34607572a357e1ca780a2fc07432abd6988","observation_id":"f1ae3ebd-4f17-474c-92f4-3c37b430e1fe","resolution":{"observed_at":"2026-08-05T16:21:10.827848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.803979Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"8531b5aa-43bb-4db7-bcc9-c3685bb3be8f","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.123173Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1023ca038c0b66f2f1445cbd91848fd60f4791e56e2eae91a3b707d452591a80","observation_id":"8993b5fd-8ef2-416d-80d9-c35d0730e9f6","resolution":{"observed_at":"2026-08-05T16:21:10.810191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.128203Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.128203Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d0068e5763a09b41d37f596177b72d5d797bae488172acfc93e81bfc8a208bff","observation_id":"91052a79-25e5-4150-ad23-def344ee98e2","resolution":{"observed_at":"2026-08-05T16:21:09.128203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14966","last_updated":"2025-06-12T01:39:50Z","snapshot_observed_at":"2026-08-20T16:23:29.314751Z","submitted_at":"2025-04-21T08:48:48Z","title":"SLO-Aware Scheduling for Large Language Model Inferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14966","snapshot_observed_at":"2026-08-05T16:21:09.138449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.138449Z"},"links":{"cited_paper":"/paper/2504.14966","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:87be6cb6e726c0290013d7c01ecbf0f67a699c3e87f4479de37a34a941bfa07c","observation_id":"9023d0cc-e6af-4fb3-8471-e632336756a3","resolution":{"observed_at":"2026-08-05T16:21:09.138449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.772270Z","title":null,"venue":null,"work_id":"6295e6b2-eccb-4ace-a637-87bdad4d8f34","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.145016Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:23509603693e58cdcbb5868f31f9763c07ce522f2838f9ad2f0b76dc64da5519","observation_id":"548772b9-8582-4a74-9677-78ec1450fcb3","resolution":{"observed_at":"2026-08-05T16:21:10.777691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.736683Z","title":null,"venue":null,"work_id":"30b8dbae-f1fc-49db-a518-582d777e6350","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.157714Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:fe98b1aa8bf3d60bd51f87876bd3c538069f71b065801152f1a44df871b30136","observation_id":"0dc1b74d-cbdd-4973-bac4-523907d2bde0","resolution":{"observed_at":"2026-08-05T16:21:10.742811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.718521Z","title":"Keller and J","venue":null,"work_id":"26de1436-e4b7-45a6-b8a0-7cadb244f303","year":1994},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.164092Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:14a53fec2a89265fbf12c13a8e008275ad638b4a867d65771c579b077818be8b","observation_id":"0f94cee0-4e17-43b9-8baa-301b7705ccf8","resolution":{"observed_at":"2026-08-05T16:21:10.724036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.699604Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":"1327da8f-a8c4-4ab8-9cc2-a0d2e11e3ecf","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.169295Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:a2a6ee73344475b2ee9c5a07980ab3502c94190c935197f7e39713b41bf08ef1","observation_id":"e706cb84-df1a-4035-b704-cfbe66d3acc6","resolution":{"observed_at":"2026-08-05T16:21:10.705134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.173911Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.173911Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e57dc7aaf32fe59def8214061f288a915c1768d5851f88899dd2c7141c9b18f2","observation_id":"30721561-cd4e-4256-b1dd-4ef242573086","resolution":{"observed_at":"2026-08-05T16:21:09.173911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.01792","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:09.888344Z","title":null,"venue":null,"work_id":"f2d08731-1b2d-4b81-936c-b4731112c1f1","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.188871Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e0b1b564f9c3d97d07a32c0b9453eb2e2ce0280ce32b1c0148bf2e79b032d939","observation_id":"809e895c-b432-46c3-85fd-aad2674f0039","resolution":{"observed_at":"2026-08-05T16:21:09.897655Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.654392Z","title":null,"venue":null,"work_id":"837b5920-c312-4e68-aeee-2ed388ee375b","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.193662Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1607510d3a3eadf2ec80b5002e5c90fd2ef47cb5d07cddcc710505ea676221a2","observation_id":"b1e353c8-9791-40db-9ef9-ebf54d58fc84","resolution":{"observed_at":"2026-08-05T16:21:10.659375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00025","last_updated":"2024-05-24T08:16:22Z","snapshot_observed_at":"2026-08-18T16:22:20.663183Z","submitted_at":"2024-05-24T08:16:22Z","title":"SCALM: Towards Semantic Caching for Automated Chat Services with Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.00025","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00025","snapshot_observed_at":"2026-08-05T16:21:09.714795Z","title":"SCALM: Towards Semantic Caching for Automated Chat Services with Large Language Models","venue":"cs.CL","work_id":"0c1fae36-6ab8-4148-979c-ee364bf28c8a","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.198859Z"},"links":{"cited_paper":"/paper/2406.00025","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:a966fe71ad0d9da7cd787357f00c28cd1fa63775af18e74924c30e585fceb0ac","observation_id":"fb45f469-4fe9-4896-8071-26ba282ff407","resolution":{"observed_at":"2026-08-05T16:21:09.723500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.636610Z","title":"Gonza- lez, and Ion Stoica","venue":null,"work_id":"409a348f-c46e-45cb-a63f-f351091384ce","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.204659Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:17d811ba598288441d73655605835f44dfec01eaafe26136bf6c08d2426e3443","observation_id":"33f3a0f6-ebee-449d-b5ee-e12b70fb293c","resolution":{"observed_at":"2026-08-05T16:21:10.642783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.617325Z","title":"Gonza- lez, and Ion Stoica","venue":null,"work_id":"72613e45-6b38-43b2-a9bf-d0b184db241e","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.209930Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:c7c31dbd2732e2003f8c481d435e0ce6d3d9ccedb7e9bb2b4354769c0cc9430f","observation_id":"a2e288ed-815e-41bb-8133-04ea3df53e1c","resolution":{"observed_at":"2026-08-05T16:21:10.622493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.600962Z","title":null,"venue":null,"work_id":"916069ff-6948-41d4-bd4e-5b43651972a9","year":1967},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.215171Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:597bd53798a636ff7611f09dfa588146bad0b3ceae7e6c8f07dd39866e8469aa","observation_id":"cf76bc90-910f-41c2-b5fa-ca53b53bc8e4","resolution":{"observed_at":"2026-08-05T16:21:10.605791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.585165Z","title":"Malkov and D","venue":null,"work_id":"cba855b0-5f0f-4ea0-aeb7-a7081740f246","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.220161Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:56ba8b9e12d8d0062c4f13977533160011a41d5a0998624aab417e270e780355","observation_id":"ebb2e859-9449-4f03-ad87-4ef3c35da9fe","resolution":{"observed_at":"2026-08-05T16:21:10.590105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.568848Z","title":null,"venue":null,"work_id":"4eae6e8a-a87b-42da-aa97-aaf8c26215be","year":2020},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.225585Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:40343c7c3816a9c1811fbffe08d937d2c3e0f6c4e77e5875959de987a0e4e182","observation_id":"50de1bc4-33e6-4e44-9f7c-3214d039437c","resolution":{"observed_at":"2026-08-05T16:21:10.573853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.550826Z","title":null,"venue":null,"work_id":"f3862924-4e0a-4c6c-9172-3d629702bbf7","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.230565Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:31adb5a289c7d232c62701133cba194715ed42ea69de6ea0f7820ae294bf51c0","observation_id":"08528559-690a-4823-9962-d9af11592ab6","resolution":{"observed_at":"2026-08-05T16:21:10.556522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.530029Z","title":null,"venue":null,"work_id":"139cfb8b-8ab2-4507-9129-4f04ba1b3496","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.235440Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1fe9443c856af9a9164d5d6769b4fd7853eea7045f56be4a6c95893d930055e0","observation_id":"65e7e229-1d21-4d2d-a5df-d9a5b90b870a","resolution":{"observed_at":"2026-08-05T16:21:10.536276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-05T16:21:09.240683Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.240683Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:22611566449de9ba01072a6becc829ff8830e9b150d936dc6b52e9c562ce1b4d","observation_id":"f7db5e7e-297f-4cb1-8781-7d70db603bd1","resolution":{"observed_at":"2026-08-05T16:21:09.240683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06856","last_updated":"2024-05-11T00:00:23Z","snapshot_observed_at":"2026-08-18T13:43:37.657055Z","submitted_at":"2024-05-11T00:00:23Z","title":"Aladdin: Joint Placement and Scaling for SLO-Aware LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06856","snapshot_observed_at":"2026-08-05T16:21:09.246158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.246158Z"},"links":{"cited_paper":"/paper/2405.06856","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:60d18717de77935049ff68880152bf12b1335d4fcfd28423a88d9ad53697b6f4","observation_id":"bb85f735-5cd7-433c-8523-843499596bbd","resolution":{"observed_at":"2026-08-05T16:21:09.246158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.511617Z","title":"Li, Ryan McElroy, Mike Paleczny, Daniel Peek, Paul Saab, David Staﬀord, Tony Tung, and Venkateshwaran Venkatara- mani","venue":null,"work_id":"a76c7666-5db4-4373-bbb0-7136dde9a624","year":2013},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.252250Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:14099c94f54f70f53f83204e3d06efcde03c35f62960237286fbb56f8f9346fa","observation_id":"ab04e361-d65f-4e2c-aee0-9246b33488b3","resolution":{"observed_at":"2026-08-05T16:21:10.517001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.495430Z","title":null,"venue":null,"work_id":"162dda60-4e8f-400a-9c02-ec4fdd652bb2","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.257750Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:45ab3bc5cc54f5af152da6ae7331f8ab9fb98e220f06108ff60cc37bcb85398d","observation_id":"a15bd645-d68f-44f2-8a9b-4b2cd0aa6930","resolution":{"observed_at":"2026-08-05T16:21:10.500703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.476930Z","title":null,"venue":null,"work_id":"b1662479-c983-4067-bafc-da56a8d0113f","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.262757Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:9fbe59ad0f69e9d805b712035564a708fa89f56780a1ff003f47c9d9ffe11871","observation_id":"787cb3ac-176d-4594-a319-c059f9cb9f7f","resolution":{"observed_at":"2026-08-05T16:21:10.483331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.458703Z","title":null,"venue":null,"work_id":"f24cf219-eba4-4632-936f-cfaa8770868d","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.269055Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:7748e07aca4abe221960087f329209ffa038a267e39e2a5052594626016cda41","observation_id":"abb4f7b7-6f2c-4f23-b64f-44b614e804ea","resolution":{"observed_at":"2026-08-05T16:21:10.465128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.440999Z","title":null,"venue":null,"work_id":"83f5ec5d-e567-4602-99a6-a48920d3cb99","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.274137Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d4a5117492182f3636e7c78dd4ec0481c9bf0533fc97ddad2a03fffab0dddc4a","observation_id":"f8e19c4f-0826-428b-a2b3-ce090d85c25a","resolution":{"observed_at":"2026-08-05T16:21:10.446545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.424374Z","title":null,"venue":null,"work_id":"52800593-6ff9-4861-90f3-56f8e9d0384f","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.280136Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:b0333cde25079a46d2f34af0075ccab7f15e408bcd9b9f336fb05da419aed176","observation_id":"4b7cc5cd-d30e-4fcd-959e-cc2923a3983d","resolution":{"observed_at":"2026-08-05T16:21:10.429408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.408345Z","title":null,"venue":null,"work_id":"8490a4b6-56da-4067-9eda-feef17ccd132","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.285632Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:8fb0fcb1034b72e6e562c1cb76799cd1220b2e7279701309432a1e938c966233","observation_id":"884fa414-ae66-4c3f-966a-7d45b295d531","resolution":{"observed_at":"2026-08-05T16:21:10.413316Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.392431Z","title":null,"venue":null,"work_id":"23efa50f-087f-4152-8c47-2879e58670cc","year":2018},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.290873Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:0076ab7dfe0633a1314c3942eacc4f7d773b38c797a453ccd9cbb65fc0bedf3f","observation_id":"c707dc79-687d-4b18-ad7a-f0feb3733c58","resolution":{"observed_at":"2026-08-05T16:21:10.397088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.376265Z","title":null,"venue":null,"work_id":"82545821-d140-4030-8e93-c6cc21833614","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.297167Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:2a7986705f8596a8545d15cb9b39f1a7e55c4fb15f6a425260a2ffdb23e11e2d","observation_id":"bce12e52-d28b-432b-9ae4-2560c989b838","resolution":{"observed_at":"2026-08-05T16:21:10.381252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.359580Z","title":null,"venue":null,"work_id":"c1838556-a859-41d2-9b88-4106ee63a921","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.302230Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:11c2c22d9aac53d35fbbb225eb212eb6e4d8060c7451b9781de7949ee0dcd176","observation_id":"419f8545-e046-494c-a059-174570235ff8","resolution":{"observed_at":"2026-08-05T16:21:10.365141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.342893Z","title":null,"venue":null,"work_id":"d8d5c40a-a9e8-4db2-ba9f-cf928a57775a","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.308640Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:b91cafdb79ae273d183a8dd68e4452804e646efa16ccf66bd780101d3ca6c010","observation_id":"cbff29ce-a53e-472f-916e-f4f0097ac196","resolution":{"observed_at":"2026-08-05T16:21:10.348066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.324752Z","title":null,"venue":null,"work_id":"ed66c8d0-da71-4bc2-a119-44f3667e0a64","year":2021},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.313933Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:bc0533dfa5f4e6110893d54ccd717c61b769357246c1abefd45a11d64f5054b6","observation_id":"563d8a5c-1628-44bc-b128-6e42dffcad0e","resolution":{"observed_at":"2026-08-05T16:21:10.330817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.308105Z","title":null,"venue":null,"work_id":"2ffece35-3d66-4707-b5cd-e81dd8009f76","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.319215Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:768a94fa163a74ab9b48bc6debc9bacd04686cdbb0bb3ef55accaf223fdef415","observation_id":"5a9a7728-b671-4314-821c-813cad5fc6f4","resolution":{"observed_at":"2026-08-05T16:21:10.313738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.291251Z","title":null,"venue":null,"work_id":"2734f503-7a4b-4958-a349-b10bbb8ab3e0","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.324671Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d9d8a6abacf9eeebee7c18d9cf7a0a603ba3a531be61d97d2644fd43c3419e63","observation_id":"c1265cfe-dc78-4a28-8011-b9db93548c71","resolution":{"observed_at":"2026-08-05T16:21:10.297087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.275543Z","title":null,"venue":null,"work_id":"230b8a82-bc89-40ad-bc67-d4e154e22958","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.330590Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:d99ca24572b548292043b663b2bc583ed186903c62cb7d922c894693a0587c42","observation_id":"4fc9da3f-a3e4-4ef9-8541-8bd5edf9938c","resolution":{"observed_at":"2026-08-05T16:21:10.280509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.257492Z","title":null,"venue":null,"work_id":"f9a71b70-cba5-40f6-a3f4-f359641dc303","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.336887Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e5034176c76228315bf17ee36ee987228b39d9003a8ed2199c5003a1e5da6cc8","observation_id":"52b4e011-3fba-4752-9556-a88657827f8f","resolution":{"observed_at":"2026-08-05T16:21:10.263219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.226466Z","title":null,"venue":null,"work_id":"f3caef4e-12af-480b-a7cc-41fde0a2f309","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.349587Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e15b342e72e02cda0dd624667c2ab62bacd68783b5b58e7bd9e46f520d1b1aa3","observation_id":"2e24ba91-68a4-49f0-bf68-df4efc7b28e9","resolution":{"observed_at":"2026-08-05T16:21:10.231566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.208462Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"4fe03367-577e-4982-a38e-e3b190a411ba","year":2017},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.354859Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:1ea5aa14f4dfc0f316e62745f2be0c58d426cf93db3957df77fda743268954df","observation_id":"a53b6413-e3d0-41c5-994d-a80c3663be81","resolution":{"observed_at":"2026-08-05T16:21:10.214582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.192578Z","title":null,"venue":null,"work_id":"2c3b6df6-04f2-4bc6-a685-22709da5b1e4","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.360102Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:c3509d1276cc82e4b12d471183fac99bce18a13757560aec0d6064d9dacae7c4","observation_id":"390f9e4a-3751-4094-a3d1-e1f43a6a69b1","resolution":{"observed_at":"2026-08-05T16:21:10.197327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.242126Z","title":"Ma- chine Intelligence Research (2024)","venue":null,"work_id":"ed727e7a-7663-449c-aa5e-3278336cf665","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.343904Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:13e49a6a2df1a0f41360352e6681ba1759a4e800d6ccaaa2abef4ab307542377","observation_id":"98affff9-56a9-45e6-bc16-41e70b2997ce","resolution":{"observed_at":"2026-08-05T16:21:10.246931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17644","last_updated":"2025-05-26T16:16:43Z","snapshot_observed_at":"2026-08-19T22:51:33.680855Z","submitted_at":"2024-01-31T07:52:48Z","title":"BurstGPT: A Real-world Workload Dataset to Optimize LLM Serving Systems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17644","snapshot_observed_at":"2026-08-05T16:21:09.370531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.370531Z"},"links":{"cited_paper":"/paper/2401.17644","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:36a3b8d9afdc79f1c168338e8f8782f4164bc04aa2b6477a3d259513ef25b9a6","observation_id":"c132c0cb-e3cd-44e3-8c06-33ebda30f0fa","resolution":{"observed_at":"2026-08-05T16:21:09.370531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.159026Z","title":null,"venue":null,"work_id":"22946070-88ea-4f6f-813c-f29bdd5b16b9","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.376275Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:4457abd0aabba0b22003147848a35b2a65558f1aa5f6896ae9acae48fa324af4","observation_id":"b2c13c4c-1f27-4077-aae1-005df32ab4eb","resolution":{"observed_at":"2026-08-05T16:21:10.164038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.140475Z","title":null,"venue":null,"work_id":"b1ef7032-90cb-4b15-819e-6c64f403c559","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.382885Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:dd7b8cc104f32dba87886a6f24103c5a25990cab6866cdaa9aac664f895a5b5c","observation_id":"dea5fae5-a24a-4771-9174-65cc0b545f0a","resolution":{"observed_at":"2026-08-05T16:21:10.146045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.175154Z","title":null,"venue":null,"work_id":"4ca9d962-6606-423a-8664-df15fdb49b86","year":2023},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.365077Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:277dd651c153bf088a935623ed24037a2d90be502b2e8e0bec6ef6062e7cb234","observation_id":"70cea444-94c6-4f8f-a5c2-842c947796d3","resolution":{"observed_at":"2026-08-05T16:21:10.181195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.098374Z","title":null,"venue":null,"work_id":"5c831cc6-c7a1-481f-9738-25c8c5e38ac0","year":2022},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.394868Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e3c0443536cabd27e71596afc9e7f8b02ecb15089ae855cc45a36d4a2da27939","observation_id":"beec0a8b-0396-43d9-b630-dd47d7a2ab98","resolution":{"observed_at":"2026-08-05T16:21:10.103985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04021","last_updated":"2026-06-10T23:04:53Z","snapshot_observed_at":"2026-08-19T19:56:05.689621Z","submitted_at":"2025-05-06T23:38:33Z","title":"Prism: Cost-Efficient Multi-LLM Serving via GPU Memory Ballooning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04021","snapshot_observed_at":"2026-08-05T16:21:09.400403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.400403Z"},"links":{"cited_paper":"/paper/2505.04021","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e77ff057d5b454043acd7fc47af5cfc59c1e1bbe0d9bbacbbd4ff6d5d4dfed18","observation_id":"1c356270-700d-40cc-84ad-f2816662e4a4","resolution":{"observed_at":"2026-08-05T16:21:09.400403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01470","last_updated":"2024-05-02T17:00:02Z","snapshot_observed_at":"2026-08-17T00:12:52.305769Z","submitted_at":"2024-05-02T17:00:02Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01470","snapshot_observed_at":"2026-08-05T16:21:09.407392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.407392Z"},"links":{"cited_paper":"/paper/2405.01470","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:a5d65582af2ebdbd19d8b3dd59388a4dc2bc84329fc4a354a63e8106028e297a","observation_id":"73f7f60e-1790-4364-a6e3-fe8f68ee72d8","resolution":{"observed_at":"2026-08-05T16:21:09.407392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.120343Z","title":null,"venue":null,"work_id":"86c2f004-f5f3-4a81-9cd3-fe92f1d577cc","year":2019},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.389391Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e1ba5d4ad08dd14762c282fba9158c4b018a8adb5d25216fcc8c2da890dfdf40","observation_id":"6cb44975-2f9b-482e-9848-53e122e49588","resolution":{"observed_at":"2026-08-05T16:21:10.126153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.055508Z","title":null,"venue":null,"work_id":"c02f32ad-cebd-4a09-9399-55f7cdc5ef25","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.417516Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:35c611f5ab0933182fcc9bd0084e79cfbd204687745529bc976b9ec7ce988925","observation_id":"f172d1db-6f20-460e-8b11-eaeef9c40a98","resolution":{"observed_at":"2026-08-05T16:21:10.061292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.033983Z","title":null,"venue":null,"work_id":"9ae370b0-fcc1-4305-be90-c93c6f0db930","year":2025},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.423239Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:853ff5c71a63dc1c451f0dddf025a90589ec3bee9320cb2dec5d7746eb323e6b","observation_id":"e1fe9667-7b09-47f9-9e75-d4e6a3e4c40d","resolution":{"observed_at":"2026-08-05T16:21:10.040349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.076536Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":"48cab0f3-7d22-4212-a913-1896c07efaf5","year":2024},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.412712Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:e8ffc6ca1e1b3b202a51e50ea099dda0990f3b3511a8306c0fd0c624180bf9fc","observation_id":"619d160c-e013-416a-8cba-239af1d8a28c","resolution":{"observed_at":"2026-08-05T16:21:10.081746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.755059Z","title":"h/t_tps://www.quora.com/q/quoradata/First-/Q_uora-Dataset-Release-/Q_uestion-Pairs","venue":null,"work_id":"4a5eef06-6b3c-40e9-8139-23dbf652a8be","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.152177Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:5441c7608ad9732040149ec75ba88c5287879160a0b20063e7308cb89c8f2092","observation_id":"89fb8be1-e82c-46ec-ad40-631c3b91b81c","resolution":{"observed_at":"2026-08-05T16:21:10.760220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:10.671014Z","title":"In Proceedings of the Symposium on Operat- ing Systems Principles","venue":null,"work_id":"138714a7-5187-48da-a682-e9ce9ddfd145","year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.183131Z"},"links":{"citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:85624af6713cc57aeac8b87c4fea4b15dca15dadf5cf4c938de5e35673d591bd","observation_id":"95c35d69-799e-4c75-a098-4174eb9da609","resolution":{"observed_at":"2026-08-05T16:21:10.676486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-08-18T10:15:29.605221Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-05T16:21:09.133223Z","title":"arXiv:2406.17565","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:09.133223Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2508.18736"},"observation_digest":"sha256:67bf4acbff8eb1fe69cc33d077b399ee4a6d9cddc6471d3e89ade4a4e72c9a7b","observation_id":"cb7ffe8d-b83e-4d3b-9d8f-7859cb9a33bf","resolution":{"observed_at":"2026-08-05T16:21:09.133223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18736","last_updated":"2025-08-26T07:09:09Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-18T01:05:38.509949Z","submitted_at":"2025-08-26T07:09:09Z","title":"Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 0 inbound Pith citation observations for arXiv:2508.18736."}