{"as_of":"2026-08-09T10:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6114b071526b369e625ee33e6f881d9e95c9c205bb11a6916b50939d44b5566b","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:23:00.475610Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20495/citation-record","integrity":"/paper/2607.20495/integrity","json":"/paper/2607.20495/citation-record.json","paper":"/paper/2607.20495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.244902Z","title":"SWE-bench: Can language models resolve real- world github issues?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.244902Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:5c0140b602c9d980433df92b80ee65eef94ba69fae3e82327bb8f31d8dd18f54","observation_id":"929236fa-a99b-4695-9162-c38c21a8de79","resolution":{"observed_at":"2026-08-02T11:22:56.244902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.323738Z","title":"Aiopslab: A holistic framework for evaluating ai agents for enabling autonomous cloud,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.323738Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:004ce90ac167dfcf9e7519c081e9ad3aaab3a4470d09b86c99241a52137deb5a","observation_id":"7d4107bf-4e3e-48a7-8c5b-39d3d9c2eece","resolution":{"observed_at":"2026-08-02T11:22:56.323738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-02T11:22:56.388148Z","title":"The AI scientist: Towards fully automated open-ended scientific discovery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.388148Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:b6c2307393f7383908cff60bc140c38f71fbd6aa2adc0df936d5efd48c507263","observation_id":"5def4b6b-1ca8-4ebe-ab25-d1e3d5cc24f7","resolution":{"observed_at":"2026-08-02T11:22:56.388148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-01T14:58:15.255937Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-02T11:22:56.497764Z","title":"The AI scientist-v2: Workshop-level automated scientific discovery via agentic tree search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.497764Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:5fdffdc1327ebbb4f8c8786e7a0f1f0e3fcab5747704fd711329641af4a07bf8","observation_id":"50d6676c-1960-47a3-a93b-3a5d5c23f305","resolution":{"observed_at":"2026-08-02T11:22:56.497764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.575077Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.575077Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:877c30c82fce6a3d42e0e337affdc33a0d647ce687dd72b593e20c9e3c5f27c3","observation_id":"8a747cde-1bdf-4960-8215-318906cf4cd9","resolution":{"observed_at":"2026-08-02T11:22:56.575077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.675764Z","title":"A survey on large language model based autonomous agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.675764Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:ad79cf1a1ab3c605bbd98f7d6136802d01f30be6e3423210b4382cdd75067040","observation_id":"90061d91-f8a1-4ad9-b68b-4397ec455986","resolution":{"observed_at":"2026-08-02T11:22:56.675764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23077","last_updated":"2025-08-13T15:48:46Z","snapshot_observed_at":"2026-08-07T16:28:35.345205Z","submitted_at":"2025-03-29T13:27:46Z","title":"Efficient Inference for Large Reasoning Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23077","snapshot_observed_at":"2026-08-02T11:22:56.753787Z","title":"Efficient inference for large reasoning models: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.753787Z"},"links":{"cited_paper":"/paper/2503.23077","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:dd37e658a345de167ae54f3313f43a71d38a137dcf33413ab27a6baaa43c0a21","observation_id":"85b5b12b-36e8-4b0b-ab69-02ab238a07b0","resolution":{"observed_at":"2026-08-02T11:22:56.753787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.818911Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.818911Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:dd846451acc9cd28f3b03278b94abc63b8da680819f2c90e00fc06aacd972646","observation_id":"3405c3e0-4a79-4b3d-9bf2-ad2f27e3fbb3","resolution":{"observed_at":"2026-08-02T11:22:56.818911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.880620Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.880620Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:da4482427d296e9b730ab309121cfa348e9c0073b536ba2efcb3ded73fd291d6","observation_id":"f7a1abed-baae-4dc3-bca2-14da69c7c662","resolution":{"observed_at":"2026-08-02T11:22:56.880620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:56.950669Z","title":"SGLang: Efficient execution of structured language model programs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:56.950669Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:fec017daa0b5bd6788b7b7ae601f5a279b85403f66f2c43e11412288762db80f","observation_id":"49f31b2d-98e7-4fac-9407-2043cfe631bd","resolution":{"observed_at":"2026-08-02T11:22:56.950669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-09T01:40:20.468391Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-02T11:22:57.020958Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.020958Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:0a215049c6d819fb88b1699bde9e7d8610e6a13e4f2d71f09d5a1f95eb015b98","observation_id":"bd742d16-48fb-4143-9404-57f04d3397a2","resolution":{"observed_at":"2026-08-02T11:22:57.020958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.090168Z","title":"KVCOMM: Online cross-context KV-cache communication for efficient LLM-based multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.090168Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:dac4708fec03c2b474b00be2f1b4546b54d01d3bbdb90ec200b3e03199eab76a","observation_id":"2051d56d-0e40-4490-bb31-e527fbc1032e","resolution":{"observed_at":"2026-08-02T11:22:57.090168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.161637Z","title":"GPTCache: An open-source semantic cache for LLM applications enabling faster answers and cost savings,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.161637Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:03aec9a9214383a97dac70a1dcf27349950e56a6453a5fd445e06e9b17f88fc9","observation_id":"4cea82c2-b216-4db5-9c8a-7d1847b8794e","resolution":{"observed_at":"2026-08-02T11:22:57.161637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.219423Z","title":"Billion-scale similarity search with GPUs,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.219423Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c384d40083899c20447bd07d618a63c9f05d0a3aac65f46a03fb4185b8497615","observation_id":"7aa66d5f-b2f7-4a5a-9352-8a7667b76e68","resolution":{"observed_at":"2026-08-02T11:22:57.219423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.381659Z","title":"Cortex: Achieving low-latency, cost-efficient remote data access for llm via semantic-aware knowledge caching,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.381659Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:28219c5dd4649e62c767e7657422391a5ac8d5777cf9b30881a051eef3af39c8","observation_id":"32ac36b4-b2b6-40ba-8ce0-2473484ad29f","resolution":{"observed_at":"2026-08-02T11:22:57.381659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.453149Z","title":"Agentic plan caching: Test- time memory for fast and cost-efficient LLM agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.453149Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:14ba9f0d04eb60cc6b5487e4589582aed9ed0dd3d7258638f14c55cb967484e6","observation_id":"0d6c4385-9bf7-473c-9e70-4ea0ff94bb21","resolution":{"observed_at":"2026-08-02T11:22:57.453149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.523453Z","title":"Semanticalli: Caching reasoning, not just responses, in agentic systems,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.523453Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:5769b479c82ab7552f1ab38747d0123053dd689d7c89e9047979eba5f9ebfc4f","observation_id":"1e81c84c-8d48-4e90-b085-c25c0b521bbc","resolution":{"observed_at":"2026-08-02T11:22:57.523453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.708196Z","title":"Lrc: Dependency-aware cache management for data analytics clusters,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.708196Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:227f4d9740046176e8140c1b91dfab772b8bdb0a72a3513728e1b3044ffb27de","observation_id":"fbbfc3a4-a13a-485c-8f27-5ed4be2e024b","resolution":{"observed_at":"2026-08-02T11:22:57.708196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.823282Z","title":"Resilient distributed datasets: A {fault-tolerant}abstraction for{in-memory}cluster computing,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.823282Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:4403ffe783fa6f8cb2a5ff6d0dd23b11ec64078a01bafcfedc8ae5f8eaa4e861","observation_id":"ea4c7af5-5500-4db9-aaa6-7002102504cb","resolution":{"observed_at":"2026-08-02T11:22:57.823282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:57.938531Z","title":"Lerc: Coordinated cache management for data-parallel systems,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.938531Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:46d0619e57de1fcf2ffd9ec96a1dd523539a93f864845f54236d2b0b6951a34a","observation_id":"33598cc5-f8d4-4797-9b12-33ea4034a3aa","resolution":{"observed_at":"2026-08-02T11:22:57.938531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.063849Z","title":"S/c: Speeding up data materialization with bounded memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.063849Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c13a4b99fbc2d0c69fc5416358c0973f777e5b693168beaea67295df4f19ccf9","observation_id":"4cfa7766-1f1a-45b0-988d-61df84c25e52","resolution":{"observed_at":"2026-08-02T11:22:58.063849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08018","last_updated":"2023-07-16T12:06:00Z","snapshot_observed_at":"2026-07-06T15:54:32.519590Z","submitted_at":"2023-07-16T12:06:00Z","title":"Real-Time Analytics by Coordinating Reuse and Work Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08018","snapshot_observed_at":"2026-08-02T11:22:58.148809Z","title":"Real-time analytics by coordinating reuse and work sharing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.148809Z"},"links":{"cited_paper":"/paper/2307.08018","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:f9aafd5731090658926f30df4478da58bc109243220f958db340e2afe1d1d18d","observation_id":"6aaff067-d55c-4781-a05b-0c954a1bd20b","resolution":{"observed_at":"2026-08-02T11:22:58.148809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.262762Z","title":"S-dag: A subject-based directed acyclic graph for multi-agent heterogeneous reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.262762Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:2f1548028c861d9497563276595db3362469adbc8ae0094b98acb9868a8e3598","observation_id":"eedabd05-de26-4cd0-b203-b0ade40d9974","resolution":{"observed_at":"2026-08-02T11:22:58.262762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.365011Z","title":"Agentnet: Decentralized evolutionary coordination for LLM-based multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.365011Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:44bf523f7b073c9e68a26fb902af5e9c3a9d13c2fd9b0ab7cff444a320ff4935","observation_id":"b3ece365-7ef1-4941-a231-0b5975135091","resolution":{"observed_at":"2026-08-02T11:22:58.365011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.483202Z","title":"Benchmarking agentic workflow generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.483202Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:b53080684f9a356833db68d8904e2dc56d7336e9efbb70e2ff41d075fe20bb33","observation_id":"74e5828f-e0d4-4f34-ac9b-336eb4aa8105","resolution":{"observed_at":"2026-08-02T11:22:58.483202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.628928Z","title":"Kairos: Low-latency multi-agent serving with shared llms and excessive loads in the public cloud,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.628928Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:6172658b169f114920f1611e9dc1e08f62bd4ef546a44b7f748aff520997e70d","observation_id":"3509fcfa-6633-41b4-9230-22a4839a9883","resolution":{"observed_at":"2026-08-02T11:22:58.628928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.843180Z","title":"Towards end-to-end optimization of llm-based applications with ayo,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.843180Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:aaeffacd6b0a955b22a404bc4b005d9f491d4d2f6e888a84bd38e6407318b566","observation_id":"00ed3a32-6ad2-4bc9-ac69-e528b27ada66","resolution":{"observed_at":"2026-08-02T11:22:58.843180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:58.949619Z","title":"AFlow: Automating agentic workflow generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.949619Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c14959746b79aebe555f5180b760d8102fb7bec102a1314f39d808f1b47be8c0","observation_id":"26115895-48f4-4560-b761-93f7312ff447","resolution":{"observed_at":"2026-08-02T11:22:58.949619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.010703Z","title":"Automated design of agentic systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.010703Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:609aca5a7efcc7026b7cb4170e40a1bec235984213dbcd6822dc2983653ba7ba","observation_id":"0a3e0a95-cba2-42ff-9729-71f81d33eff5","resolution":{"observed_at":"2026-08-02T11:22:59.010703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01747","last_updated":"2025-09-04T16:22:32Z","snapshot_observed_at":"2026-07-06T19:44:34.642049Z","submitted_at":"2024-11-04T02:08:59Z","title":"DynaSaur: Large Language Agents Beyond Predefined Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01747","snapshot_observed_at":"2026-08-02T11:22:59.122377Z","title":"Dynasaur: Large language agents beyond predefined actions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.122377Z"},"links":{"cited_paper":"/paper/2411.01747","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:de142b02ecf5e8fc9e748eff25ec64ed416ec58efb75c7b6ffc57f9244aa7cbb","observation_id":"14e41f65-5d2b-4709-8cfc-bdcb8e92980e","resolution":{"observed_at":"2026-08-02T11:22:59.122377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.288250Z","title":"Slidevqa: A dataset for document visual question answering on multiple images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.288250Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:4a55dad8d66ab2ea4cfcc57f0869aa4499c9f2b021d8debb6beab5814c95d895","observation_id":"81d7bae8-3ac3-4930-894c-15833ee89db3","resolution":{"observed_at":"2026-08-02T11:22:59.288250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05935","last_updated":"2023-04-01T10:00:35Z","snapshot_observed_at":"2026-08-07T11:26:39.139402Z","submitted_at":"2022-12-07T10:09:49Z","title":"Hierarchical multimodal transformers for Multi-Page DocVQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05935","snapshot_observed_at":"2026-08-02T11:22:59.426670Z","title":"Hierarchical multimodal transformers for multi-page docvqa,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.426670Z"},"links":{"cited_paper":"/paper/2212.05935","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:f5f5457aa59edf141958552fba45bdae5f0eda977000ec4ad9e4fcd42e960da7","observation_id":"a5c121cd-a98d-42da-bb1a-c495f9e5f330","resolution":{"observed_at":"2026-08-02T11:22:59.426670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.590150Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.590150Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:05e7aad88fc3899ab42539ed202d4ccf5cfdb74ea9508269ee5e0ed15daaf225","observation_id":"6e0dcf2b-9b32-46d8-873c-7bc6fb172c8b","resolution":{"observed_at":"2026-08-02T11:22:59.590150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.700138Z","title":"Plan-and-act: Improving planning of agents for long-horizon tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.700138Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:7f5743d6db1cdc8691c53b43a723cbd0df2e7d21e440725f0457466e29864197","observation_id":"5c62be42-8fd7-41a9-a95d-88abb906aec5","resolution":{"observed_at":"2026-08-02T11:22:59.700138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.809932Z","title":"ARC: A Self-Tuning, low overhead replacement cache,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.809932Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:ac7681cd27780b6feb9c299813135cdf4c7641ef439d88bdc6fd40ebda29bf65","observation_id":"ada20323-bc55-4679-aec6-8b0e0b1a5360","resolution":{"observed_at":"2026-08-02T11:22:59.809932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:22:59.966611Z","title":"An llm compiler for parallel function calling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:59.966611Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:1e36a05a11ecd7f6c6669cf6978c58e2511620c4884e00007a9a7e583c9febe8","observation_id":"319da7b0-28c4-4b75-956f-6677510b5675","resolution":{"observed_at":"2026-08-02T11:22:59.966611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-02T11:23:00.070441Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.070441Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:d677d86b28402160069a5ad85220172fdeb2f1839e4a15a5c7437de19c5defb9","observation_id":"262c7428-b251-4ebb-8c8a-ca3f8047d0fb","resolution":{"observed_at":"2026-08-02T11:23:00.070441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:23:00.195827Z","title":"Ollama: Run AI models locally,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.195827Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:189533d108883ba0669720a6267a83f0d4bb84f7aa2a15b98499bcf586de0c57","observation_id":"aeeb0b4c-e08d-4d81-9138-afe8f276eee5","resolution":{"observed_at":"2026-08-02T11:23:00.195827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16219","last_updated":"2024-11-15T22:37:48Z","snapshot_observed_at":"2026-08-06T10:58:17.028489Z","submitted_at":"2024-04-24T21:35:12Z","title":"Can Increasing the Hit Ratio Hurt Cache Throughput? (Long Version)","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16219","snapshot_observed_at":"2026-08-02T11:23:00.299874Z","title":"Can increasing the hit ratio hurt cache throughput? (long version),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.299874Z"},"links":{"cited_paper":"/paper/2404.16219","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:3456415d48d1da6fe18315d5f82de1f2f10913c3bec34ef2a971936bc238f461","observation_id":"5aad65d3-e372-4ba7-b045-4e4fdebed334","resolution":{"observed_at":"2026-08-02T11:23:00.299874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:23:00.475610Z","title":"Mistral Small 3.2,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T11:23:00.475610Z"},"links":{"citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:c3acc2bacce74359a42a24c6aa2690a414868ddd55793cf5962faca9b1b67cd5","observation_id":"413ff1bb-9d1c-4b29-9fc2-1c85d56c5a60","resolution":{"observed_at":"2026-08-02T11:23:00.475610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06948","last_updated":"2025-08-09T11:45:57Z","snapshot_observed_at":"2026-08-05T22:27:31.581238Z","submitted_at":"2025-08-09T11:45:57Z","title":"Kairos: Low-latency Multi-Agent Serving with Shared LLMs and Excessive Loads in the Public Cloud","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06948","snapshot_observed_at":"2026-08-02T11:22:58.727229Z","title":"Available: https://arxiv.org/abs/2508.06948","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:58.727229Z"},"links":{"cited_paper":"/paper/2508.06948","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:1de8870350a21075191cdf8cd442319dd80920d0ba925577a981d5a354ff2b0e","observation_id":"f7ab6e29-14f5-4dec-a243-44f72d744e44","resolution":{"observed_at":"2026-08-02T11:22:58.727229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T11:26:57.920707Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2607.20495."}