{"as_of":"2026-08-18T09:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:160a745c98f76ee6321f02b835fb5875b5dff0d8c79138d972320bc22eb30cd9","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:45:42.411640Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:58:39.204380Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-07-13T22:20:51.838309Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18897","last_updated":"2026-06-16T09:34:16Z","snapshot_observed_at":"2026-08-18T01:04:06.450202Z","submitted_at":"2026-03-19T13:36:50Z","title":"Parallelizing Tool Execution and LLM Generation for Low-Latency Agent Serving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T22:20:51.838309Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2603.18897"},"observation_digest":"sha256:ea8800de733084c6da2dfab7cb5d77d39907433da5f4c582855304ef59e09296","observation_id":"26d3d1de-fff5-4a5c-9e1a-38e9331db713","resolution":{"observed_at":"2026-07-13T22:20:51.838309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.06370","last_updated":"2026-04-07T18:52:25Z","snapshot_observed_at":"2026-08-15T13:00:48.586034Z","submitted_at":"2026-04-07T18:52:25Z","title":"ForkKV: Scaling Multi-LoRA Agent Serving via Copy-on-Write Disaggregated KV Cache","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T18:16:49.292491Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.06370"},"observation_digest":"sha256:15c76a0e00054c56120484eccf020e05163b14c844d1e69cde4810ff32290536","observation_id":"8504fea4-ac1a-4c6f-ad49-df4739e91feb","resolution":{"observed_at":"2026-05-10T20:25:46.907699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.17353","last_updated":"2026-04-19T09:59:35Z","snapshot_observed_at":"2026-08-15T15:03:11.648426Z","submitted_at":"2026-04-19T09:59:35Z","title":"Hive: A Multi-Agent Infrastructure for Algorithm- and Task-Level Scaling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T06:31:36.776819Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.17353"},"observation_digest":"sha256:df7c49ca7fac7618b3eedec877e89b97b2035b8b4cd7a6f0ee48d50438407b03","observation_id":"9bd72f02-e53d-4bdd-a705-6e85b90aa4a2","resolution":{"observed_at":"2026-05-10T06:36:36.686395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.24971","last_updated":"2026-04-27T20:10:21Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:10:21Z","title":"PolyKV: A Shared Asymmetrically-Compressed KV Cache Pool for Multi-Agent LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T03:55:32.585495Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.24971"},"observation_digest":"sha256:6098ca50a30813afe32bb58d1928af5443087709bbc148552bec417d63e0ee2d","observation_id":"ed36350b-6157-449b-bb3f-bb64896b7591","resolution":{"observed_at":"2026-05-11T21:51:34.256580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2604.26103","last_updated":"2026-04-30T09:10:31Z","snapshot_observed_at":"2026-08-15T09:19:00.888874Z","submitted_at":"2026-04-28T20:36:50Z","title":"AMMA: A Multi-Chiplet Memory-Centric Architecture for Low-Latency 1M Context Attention Serving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T14:16:46.241126Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2604.26103"},"observation_digest":"sha256:af69441745dd2f2fa7536ee0e85169909edb529aeb44e313e82363dc429386e7","observation_id":"d380eb5e-e830-48b5-bdc7-32b31d024ce3","resolution":{"observed_at":"2026-05-12T00:46:13.127977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.08581","last_updated":"2026-05-09T00:48:25Z","snapshot_observed_at":"2026-08-16T07:24:41.835026Z","submitted_at":"2026-05-09T00:48:25Z","title":"PRISM: Fast Online LLM Serving via Scheduling-Memory Co-design","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T00:53:50.578344Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.08581"},"observation_digest":"sha256:25644e7517a146e67b38cc9aa86b415c4845b0932e6f497b1ce5cbdc6d168b2a","observation_id":"903503ab-0c69-45a8-bbe7-430b6ddc9c2a","resolution":{"observed_at":"2026-05-12T08:36:26.474892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.17613","last_updated":"2026-05-17T19:18:39Z","snapshot_observed_at":"2026-08-15T04:55:37.718485Z","submitted_at":"2026-05-17T19:18:39Z","title":"VeriCache: Turning Lossy KV Cache into Lossless LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T22:09:15.782104Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.17613"},"observation_digest":"sha256:d3d597eb448a724376c47bbb561e6cf36e02c101697b5eabc515b3f6ac29e983","observation_id":"3d13b212-72be-4504-8766-0d483000950c","resolution":{"observed_at":"2026-05-19T22:12:51.215622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.18825","last_updated":"2026-05-12T18:38:24Z","snapshot_observed_at":"2026-08-16T07:25:24.358690Z","submitted_at":"2026-05-12T18:38:24Z","title":"Not All Tokens Are Worth Caching: Learning Semantic-Aware Eviction for LLM Prefix Caches","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T22:08:45.016196Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.18825"},"observation_digest":"sha256:83c114940372dc3ce35ca727fb82bbbf680acaf02883d8be8009d5313f2ed336","observation_id":"d7ec5bef-2697-4fe9-be9a-fa4b5f8e50a3","resolution":{"observed_at":"2026-05-20T22:09:07.016867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-07-12T23:56:22.405561Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows.arXiv preprint arXiv:2507.07400, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.23914","last_updated":"2026-04-09T15:31:22Z","snapshot_observed_at":"2026-08-15T05:54:04.604125Z","submitted_at":"2026-04-09T15:31:22Z","title":"VineLM: Trie-Based Fine-Grained Control for Agentic Workflows","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T23:56:22.405561Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.23914"},"observation_digest":"sha256:af2e79888e3ba9cf9c091147724e864754b126e8526af3bc9427d73e8bd3d5a0","observation_id":"061ca800-78f4-4b34-b6dd-832b565c2b15","resolution":{"observed_at":"2026-07-12T23:56:22.405561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.24259","last_updated":"2026-05-22T22:25:31Z","snapshot_observed_at":"2026-08-02T20:07:37.055832Z","submitted_at":"2026-05-22T22:25:31Z","title":"Resident KV Claims: A Conformance Contract for Future Reuse under Active KV Pressure","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T14:18:35.209571Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.24259"},"observation_digest":"sha256:8e86568dc6f9bccc98c4bce1cea1020e81874e0f17412a353791497431317a48","observation_id":"22dab550-d3c8-4bb7-9865-251ed0bc1eaf","resolution":{"observed_at":"2026-06-30T14:24:45.202521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2605.29640","last_updated":"2026-05-29T02:43:30Z","snapshot_observed_at":"2026-08-12T14:13:25.051382Z","submitted_at":"2026-05-28T09:07:42Z","title":"VikingMem: A Memory Base Management System for Stateful LLM-based Applications","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T07:30:42.104455Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2605.29640"},"observation_digest":"sha256:9e596097bd881ea5b192aa67ea6299944e37b9c1b09a97297a97fc22de3ac7be","observation_id":"57a31b54-9b25-48a8-92a6-c6e5d950bfc7","resolution":{"observed_at":"2026-06-29T07:33:13.635254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2606.05158","last_updated":"2026-08-01T06:36:12Z","snapshot_observed_at":"2026-08-16T08:39:20.419971Z","submitted_at":"2026-06-03T17:57:04Z","title":"Streaming Communication in Multi-Agent Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T06:24:07.052856Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2606.05158"},"observation_digest":"sha256:eb87c164dbd1b11cb544b4b57cc5fbdcf66deb3f84a9477b6c539ef467dc7f8c","observation_id":"aec54df1-77a5-4946-b6ae-20d28c31d373","resolution":{"observed_at":"2026-07-02T08:06:47.918375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-04T04:58:39.204380Z","title":"InInternational Conference on Learning Representations, volume 2024, pages 39578–39601","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05158","last_updated":"2026-08-01T06:36:12Z","snapshot_observed_at":"2026-08-16T08:39:20.419971Z","submitted_at":"2026-06-03T17:57:04Z","title":"Streaming Communication in Multi-Agent Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T04:58:39.204380Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2606.05158"},"observation_digest":"sha256:1775faeb405d7fd990f3972c1789153d4bfed4f6d028e2d8516eec4d4acca2e3","observation_id":"4ae630f1-8f27-4dba-8663-26525168fd5d","resolution":{"observed_at":"2026-08-04T04:58:39.204380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":"2507.07400","doi":"10.48550/arxiv.2507.07400","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows, 2025 b","venue":"ArXiv.org","work_id":"bebb74f0-0026-4dbc-b12f-9cf357437882","year":2025},"citing_paper":{"arxiv_id":"2607.00151","last_updated":"2026-06-30T20:27:49Z","snapshot_observed_at":"2026-08-03T01:59:44.957724Z","submitted_at":"2026-06-30T20:27:49Z","title":"SmoothAgent: Efficient Long-Horizon LLM-Based Agent Serving with Lookahead Context Engineering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-02T17:19:53.560039Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.00151"},"observation_digest":"sha256:e3ef61d8cc40d545ee90628c0297b587bd0775b0ec4f028a560910d9e4f065ab","observation_id":"4e8cb190-cd0a-4d88-8fe9-f9124eebd6a0","resolution":{"observed_at":"2026-07-02T17:27:14.694422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-02T11:22:57.020958Z","title":"Kvflow: Efficient prefix caching for accelerating llm-based multi-agent workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20495","last_updated":"2026-06-14T02:13:27Z","snapshot_observed_at":"2026-08-17T18:17:38.496212Z","submitted_at":"2026-06-14T02:13:27Z","title":"Workload-Aware Caching for Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:22:57.020958Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.20495"},"observation_digest":"sha256:6e8b0bfa1d4648dedd8cb00d5900803bbb89ba18347fe2132ffae2c59783fd66","observation_id":"bd742d16-48fb-4143-9404-57f04d3397a2","resolution":{"observed_at":"2026-08-02T11:22:57.020958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07400","snapshot_observed_at":"2026-08-03T14:14:12.063684Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29069","last_updated":"2026-07-31T06:44:06Z","snapshot_observed_at":"2026-08-07T03:44:55.840492Z","submitted_at":"2026-07-31T06:44:06Z","title":"Rethinking AI Cloud Infrastructure for Agentic Serving Systems with the Aries Experimentation Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T14:14:12.063684Z"},"links":{"cited_paper":"/paper/2507.07400","citing_paper":"/paper/2607.29069"},"observation_digest":"sha256:870007eb638ea84417dcba1b95678490df6e317b2a09d31d261899c97118927e","observation_id":"0a65ee2b-195e-4223-ba1d-95c47b4382bf","resolution":{"observed_at":"2026-08-03T14:14:12.063684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07400/citation-record","integrity":"/paper/2507.07400/integrity","json":"/paper/2507.07400/citation-record.json","paper":"/paper/2507.07400"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.222956Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.222956Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:f87036d5f0881036c7928aec3f44a71e43ad6b8fc12f299cea67f870e1077433","observation_id":"ddc67721-7ff7-45d2-a005-486c7bc7f317","resolution":{"observed_at":"2026-08-06T18:45:42.222956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.227937Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36:8634–8652, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.227937Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:4400bc42d53054251605b89078ef7247e7ea6e6dc66e386e0fe70fe0aeb2eee8","observation_id":"a60f3c9d-5f10-40f5-95ac-be25f82fab4d","resolution":{"observed_at":"2026-08-06T18:45:42.227937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-08-12T16:02:21.969968Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-06T18:45:42.233314Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.233314Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:c99543a39123e8ad99be246071ace0b8d67f86338088bc1fe192fe9d655d3906","observation_id":"55921259-8778-4990-a660-09036a7a2743","resolution":{"observed_at":"2026-08-06T18:45:42.233314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.238391Z","title":"Camel: Communicative agents for\" mind\" exploration of large language model society","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.238391Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:aa51fafd6595f989c8b0658755608dbb033fe9732f450ae774a6262f64dc1226","observation_id":"7914f024-1158-4497-b3e8-1fb12c7a18a9","resolution":{"observed_at":"2026-08-06T18:45:42.238391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06985","last_updated":"2024-08-30T06:27:58Z","snapshot_observed_at":"2026-08-16T13:35:43.549513Z","submitted_at":"2024-07-09T15:59:28Z","title":"PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods","version":4},"cited_work":{"arxiv_id":"2407.06985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06985","snapshot_observed_at":"2026-08-06T18:45:42.765422Z","title":"PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods","venue":"cs.AI","work_id":"55d8ebb1-45a5-42b8-a7dd-3360f7b11c23","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.243742Z"},"links":{"cited_paper":"/paper/2407.06985","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:559c205b8174132da54de132c3db39c8e914fbf231ae4f1741856c5106beec1b","observation_id":"d96f7d36-be33-47db-9b86-ca3418007a30","resolution":{"observed_at":"2026-08-06T18:45:42.772387Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-06T18:45:42.248910Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.248910Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:c88a5d585a8dd4831a9eba43faf3778785755fcb8ac0d6f3c43656b979a07829","observation_id":"90d6b685-6b40-4beb-9549-a1b1c9b8e75f","resolution":{"observed_at":"2026-08-06T18:45:42.248910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:43.018547Z","title":"Gptswarm: Language agents as optimizable graphs","venue":null,"work_id":"24569918-0ae1-4922-954a-d1ef37e87d2b","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.255938Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:e400015073d1af5f4ed8499c7453164b0e082a36c30514cc32e269db7f948825","observation_id":"f7eb983f-f5fe-46e0-b19b-ab1d3674e4a6","resolution":{"observed_at":"2026-08-06T18:45:43.022975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-08-06T18:45:42.261460Z","title":"Aflow: Automating agentic workflow generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.261460Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d77686058cc671be1cbde262576941d25b6c1e8e4bab7fc1cfbddc4ce74fdaa2","observation_id":"bc9def31-20cf-4e04-a077-65e5c6cd55e1","resolution":{"observed_at":"2026-08-06T18:45:42.261460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17789","last_updated":"2024-10-28T13:19:38Z","snapshot_observed_at":"2026-08-16T13:31:13.150986Z","submitted_at":"2024-07-25T05:50:46Z","title":"Very Large-Scale Multi-Agent Simulation in AgentScope","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17789","snapshot_observed_at":"2026-08-06T18:45:42.266656Z","title":"Very large-scale multi-agent simulation in agentscope","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.266656Z"},"links":{"cited_paper":"/paper/2407.17789","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:4bc51109bd607d579ce1bff8aa56ed551871d3b6ca1e0e39a4f9a247bcdbb454","observation_id":"7c2ce70a-94c3-4c42-affe-fe97b883e641","resolution":{"observed_at":"2026-08-06T18:45:42.266656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08056","last_updated":"2025-02-12T01:36:27Z","snapshot_observed_at":"2026-08-15T08:59:30.629164Z","submitted_at":"2025-02-12T01:36:27Z","title":"Cognify: Supercharging Gen-AI Workflows With Hierarchical Autotuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08056","snapshot_observed_at":"2026-08-06T18:45:42.272015Z","title":"Cognify: Supercharging gen-ai workflows with hierarchical autotuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.272015Z"},"links":{"cited_paper":"/paper/2502.08056","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:135b51b75e0f906df82f1ba148a29d707b45d0cf121f493767b3d031028bdd2d","observation_id":"ce19083b-5ba9-4f51-b18a-a88d0bb19648","resolution":{"observed_at":"2026-08-06T18:45:42.272015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.276704Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.276704Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:a8a698e066963aefde3bf1527f836665191a38c3ff32f8ada292a2b72b0e3f98","observation_id":"96a5f89f-c5d8-4ad5-abee-3a93b3096963","resolution":{"observed_at":"2026-08-06T18:45:42.276704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.992539Z","title":"Gonzalez, Clark W","venue":null,"work_id":"a4ca0d07-dde8-4e59-88be-c1a869339a69","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.281347Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d295c67018de9734aeb61f1cc430d19718ab038213bf2e21ecac970946c7fabf","observation_id":"bda1cd92-185a-472c-9c29-957d9edb573a","resolution":{"observed_at":"2026-08-06T18:45:42.996931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.977458Z","title":"TensorRT-LLM","venue":null,"work_id":"e9cbe961-b719-459c-a732-5b4c7e5b81f1","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.286228Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:2d4ce5eef698b7c9db8776a4f546761af4c814dde213aa4bf2feb434473bc9ff","observation_id":"c7c4aa97-e930-41cd-bf27-9bdc2e4bce7c","resolution":{"observed_at":"2026-08-06T18:45:42.982123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.962186Z","title":"Automatic Prefix Caching","venue":null,"work_id":"b549e96a-ea1b-427a-9019-fe7aa8a38e39","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.290936Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:5cf5b5bc9a96f3cdded8c300e42bfb92f7301f6df07b738eec2adb925eaf0446","observation_id":"687a0462-43bb-40c4-8c89-d89cf734eba8","resolution":{"observed_at":"2026-08-06T18:45:42.966950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12457","last_updated":"2024-04-25T06:47:57Z","snapshot_observed_at":"2026-08-18T08:35:06.332399Z","submitted_at":"2024-04-18T18:32:30Z","title":"RAGCache: Efficient Knowledge Caching for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12457","snapshot_observed_at":"2026-08-06T18:45:42.296114Z","title":"Ragcache: Efficient knowledge caching for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.296114Z"},"links":{"cited_paper":"/paper/2404.12457","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:357866985a21f72a006864d01034801505bcb60a39aa37697822ed34292f1646","observation_id":"74408f15-ecf0-4635-b034-f7e1da15f41e","resolution":{"observed_at":"2026-08-06T18:45:42.296114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.947027Z","title":"{Cost-Efficient} large language model serving for multi- turn conversations with {CachedAttention}","venue":null,"work_id":"9ea43160-97a3-4684-b082-f1b17604c49d","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.302064Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d6909f67049e7394a6b9a484a3a391915025a27d15e426088adc74ea02db83c2","observation_id":"fb353792-c84a-45fa-98b5-ff09cd5c5a15","resolution":{"observed_at":"2026-08-06T18:45:42.951768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.306995Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.306995Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:972459aaafd2247e55c9452c8029f32c6cb696eeb40a7047efa7ad033def357b","observation_id":"6426a51c-213d-4d06-b5d7-2c56a4c8a539","resolution":{"observed_at":"2026-08-06T18:45:42.306995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.311794Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.311794Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:276229cd90c639640b1e6847fac28ddb27a0ca8c1497d6c38964e34643988ca6","observation_id":"96815315-538e-4beb-b77a-fa09f0deda9a","resolution":{"observed_at":"2026-08-06T18:45:42.311794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T18:45:42.316209Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.316209Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:7076e2c79fa23c1b7716741be06aed492f1e0023bba5c4e84b85a4b9d752f257","observation_id":"8cf33364-7348-4f83-9dcf-2c133442380a","resolution":{"observed_at":"2026-08-06T18:45:42.316209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08500","last_updated":"2024-01-16T17:00:36Z","snapshot_observed_at":"2026-08-17T15:38:45.204670Z","submitted_at":"2024-01-16T17:00:36Z","title":"Code Generation with AlphaCodium: From Prompt Engineering to Flow Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08500","snapshot_observed_at":"2026-08-06T18:45:42.320701Z","title":"Code generation with alphacodium: From prompt engineering to flow engineering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.320701Z"},"links":{"cited_paper":"/paper/2401.08500","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:bb13e357042343d0dd2d351560722e3d6c1a5400326f3c9b8b7345c4fd27a51d","observation_id":"6ec7bd6f-7b16-49e6-be9b-08466e82c288","resolution":{"observed_at":"2026-08-06T18:45:42.320701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05300","last_updated":"2024-03-26T14:32:33Z","snapshot_observed_at":"2026-08-17T08:58:00.366226Z","submitted_at":"2023-07-11T14:45:19Z","title":"Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05300","snapshot_observed_at":"2026-08-06T18:45:42.325909Z","title":"Unleashing the emergent cognitive synergy in large language models: A task-solving agent through multi- persona self-collaboration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.325909Z"},"links":{"cited_paper":"/paper/2307.05300","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:40bdda2d264a2083840e2eef52e47735daf24e6f1fb2823262555a8d5499b01b","observation_id":"007a7681-db51-4dd4-9127-da403a12d622","resolution":{"observed_at":"2026-08-06T18:45:42.325909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07822","last_updated":"2024-12-10T21:53:55Z","snapshot_observed_at":"2026-08-14T12:51:34.096973Z","submitted_at":"2024-12-10T21:53:55Z","title":"MAGE: A Multi-Agent Engine for Automated RTL Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07822","snapshot_observed_at":"2026-08-06T18:45:42.330477Z","title":"Mage: A multi- agent engine for automated rtl code generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.330477Z"},"links":{"cited_paper":"/paper/2412.07822","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:9ad695c3778b73571e41d983b0438fe540b6cb0bc3d8794ba003c25994daa4da","observation_id":"efa75a61-7f40-4e16-8f3e-6bc7ec6816df","resolution":{"observed_at":"2026-08-06T18:45:42.330477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-08-16T00:37:44.307785Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-06T18:45:42.334764Z","title":"Chatdev: Communicative agents for software development","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.334764Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:d4de392d7c0565eb5553e12191f50faaee079eb109889b1095ee3729d6b1f36d","observation_id":"0af19f0d-9703-4ccb-8a29-fe0a9137a7e4","resolution":{"observed_at":"2026-08-06T18:45:42.334764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.339249Z","title":"Improv- ing factuality and reasoning in language models through multiagent debate","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.339249Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:a121dda766035a61f4af766af19ce23aee5ac530a1bb41b030b27f47de17e859","observation_id":"071ae83c-0559-41d4-9882-9ab8bc5e9250","resolution":{"observed_at":"2026-08-06T18:45:42.339249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T18:45:42.344014Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.344014Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:470c8e0461831630bb709887b4ad21b3d73126c16a27dada7d8e102badea2b23","observation_id":"c39ff46b-ee40-459a-8bda-3d5cb2e53ba3","resolution":{"observed_at":"2026-08-06T18:45:42.344014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.348481Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.348481Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ae7c89326c3bf30b88d7adf7cb700e0bd10d34baaa51c08b62c1eca0a69d30a5","observation_id":"5a0484f4-020a-4727-8d2e-9342846f4c11","resolution":{"observed_at":"2026-08-06T18:45:42.348481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.890301Z","title":"Prompt lookup decoding, November 2023","venue":null,"work_id":"c6f1af01-44fe-4614-9a64-92a4e1e6f5eb","year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.352902Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ec419b40156634e512e01c1d34e92d9c06119ac4beff723173691164025fcdc1","observation_id":"3ba568b7-6fb8-4c60-afe1-3312768270a2","resolution":{"observed_at":"2026-08-06T18:45:42.894668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.874661Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"d2afc668-dc27-4dde-bbdb-e5495e062f6a","year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.357195Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:178b3d09775cecb47680fb514316c8f7afefbaa50d767219358fd22ef98836f5","observation_id":"ef4c5fae-3d8f-48b2-a03c-032fc212b8eb","resolution":{"observed_at":"2026-08-06T18:45:42.879053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-12T17:14:32.746931Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T18:45:42.361717Z","title":"Efficiently serving llm reasoning programs with certaindex","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.361717Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:56f07f20176a75017e964f7e7ec4ecaddbf6b5fc008baed1e889cc42f60bf55b","observation_id":"cf829135-f430-4acc-8754-43b503bed880","resolution":{"observed_at":"2026-08-06T18:45:42.361717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.366575Z","title":"Orca: A distributed serving system for {Transformer-Based} generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.366575Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:01a298e29cfe778f5825ef2dd47398c8c9a0b67e057f2159a7d1ddb92a317a0b","observation_id":"218cb1c7-c682-42ad-a1f2-aa2bae8309cc","resolution":{"observed_at":"2026-08-06T18:45:42.366575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05920","last_updated":"2024-09-25T05:57:51Z","snapshot_observed_at":"2026-08-16T21:53:57.298060Z","submitted_at":"2023-05-10T06:17:50Z","title":"Fast Distributed Inference Serving for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05920","snapshot_observed_at":"2026-08-06T18:45:42.370910Z","title":"Fast distributed inference serving for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.370910Z"},"links":{"cited_paper":"/paper/2305.05920","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:8c948e1725ff7ccc2a0c3d8cab9b17fbec652a804ca13cd04664806fcbdbb89b","observation_id":"8fc98626-c13a-466f-aff9-12bf892ad6e8","resolution":{"observed_at":"2026-08-06T18:45:42.370910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16283","last_updated":"2024-12-13T07:01:16Z","snapshot_observed_at":"2026-08-16T13:58:02.684989Z","submitted_at":"2024-04-25T01:56:00Z","title":"Andes: Defining and Enhancing Quality-of-Experience in LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16283","snapshot_observed_at":"2026-08-06T18:45:42.375175Z","title":"Andes: Defining and enhancing quality-of-experience in llm-based text streaming services","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.375175Z"},"links":{"cited_paper":"/paper/2404.16283","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:16c9e9ff67af3ca85c8a1ee42e35200520e21e56421f6c99577cdb7055f3785e","observation_id":"66d38722-36b3-4010-bb3f-fde70f928c6d","resolution":{"observed_at":"2026-08-06T18:45:42.375175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.849179Z","title":"Stateful large language model serving with pensieve","venue":null,"work_id":"edd5744c-ca98-4c06-b781-abb7dfeb7396","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.379599Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:5a2ba9280db0cff1cb7b47d02c1fbd441c1f9d38ed66d35ca53ad293d937262d","observation_id":"39572001-5ffb-47af-b551-e1bd8474c506","resolution":{"observed_at":"2026-08-06T18:45:42.853980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01869","last_updated":"2024-05-30T04:18:03Z","snapshot_observed_at":"2026-08-16T14:22:01.054215Z","submitted_at":"2024-02-02T19:47:57Z","title":"InferCept: Efficient Intercept Support for Augmented Large Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01869","snapshot_observed_at":"2026-08-06T18:45:42.384225Z","title":"Infercept: Efficient intercept support for augmented large language model inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.384225Z"},"links":{"cited_paper":"/paper/2402.01869","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ac5887de4d456c3c592c52de0a4bec826c671348e63a013d5804263afaf2f665","observation_id":"519ae05f-2cce-46bd-92ab-866c62479560","resolution":{"observed_at":"2026-08-06T18:45:42.384225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13965","last_updated":"2025-02-19T18:59:30Z","snapshot_observed_at":"2026-08-16T20:52:07.705600Z","submitted_at":"2025-02-19T18:59:30Z","title":"Autellix: An Efficient Serving Engine for LLM Agents as General Programs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13965","snapshot_observed_at":"2026-08-06T18:45:42.388683Z","title":"Autellix: An efficient serving engine for llm agents as general programs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.388683Z"},"links":{"cited_paper":"/paper/2502.13965","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:e2a7f4ce8aaeefa8e283f929d550249f7bf991cfb96b19c53d7059d83ee256ef","observation_id":"f300aba2-02cf-48da-a93b-cbe612a86f26","resolution":{"observed_at":"2026-08-06T18:45:42.388683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.832833Z","title":"Parrot: Efficient serving of {LLM-based} applications with semantic variable","venue":null,"work_id":"a59769e2-eb68-431a-9b6b-1b04ae377d5f","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.393131Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:ec5112d8ad0f114138cca144e92a14d2a504a21f22e93ef8e27872545dbeb7d6","observation_id":"99c684cf-6b44-4846-b990-b15ee6860f83","resolution":{"observed_at":"2026-08-06T18:45:42.837952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.816644Z","title":"LangGraph","venue":null,"work_id":"8c3e22e0-16b2-4814-9b32-633cf3d182cb","year":2025},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.397557Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:b37a55e1329abc366fdb7630691d3fb3170184c2d3ff9c5cc300ecbbb9344193","observation_id":"72716aa1-a196-4ab0-9289-d329a85fc8d1","resolution":{"observed_at":"2026-08-06T18:45:42.821121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:42.801462Z","title":"Building effective agents","venue":null,"work_id":"c4fe69d7-3162-4298-8d60-17f1527c7882","year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.402250Z"},"links":{"citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:e7f8187534a176014c0fd100fa18613e50b3fdefae60552d0ed8786f89807614","observation_id":"9e15dc4e-6d66-4013-92a9-70b26b4662fe","resolution":{"observed_at":"2026-08-06T18:45:42.805802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14034","last_updated":"2024-05-20T04:01:08Z","snapshot_observed_at":"2026-08-16T14:16:44.366665Z","submitted_at":"2024-02-21T04:11:28Z","title":"AgentScope: A Flexible yet Robust Multi-Agent Platform","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14034","snapshot_observed_at":"2026-08-06T18:45:42.406791Z","title":"Agentscope: A flexible yet robust multi-agent platform","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.406791Z"},"links":{"cited_paper":"/paper/2402.14034","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:e5c5bf54d655ff4fb691b6420a1cfac301d1e209ad894f7df7d312266cfb4f69","observation_id":"13f354ff-166e-4bb5-ace0-ee2b53f11b46","resolution":{"observed_at":"2026-08-06T18:45:42.406791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02506","last_updated":"2024-10-03T14:14:31Z","snapshot_observed_at":"2026-08-16T13:12:57.732074Z","submitted_at":"2024-10-03T14:14:31Z","title":"Cut the Crap: An Economical Communication Pipeline for LLM-based Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02506","snapshot_observed_at":"2026-08-06T18:45:42.411640Z","title":"Cut the crap: An economical communication pipeline for llm-based multi-agent systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:42.411640Z"},"links":{"cited_paper":"/paper/2410.02506","citing_paper":"/paper/2507.07400"},"observation_digest":"sha256:443b9478c15d2b5f145a7e0c727b023166d965fce64b964b060f56820619aa42","observation_id":"887322ec-44c8-4927-a54c-ed5fc257900b","resolution":{"observed_at":"2026-08-06T18:45:42.411640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07400","last_updated":"2025-07-10T03:39:23Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-17T18:16:55.545349Z","submitted_at":"2025-07-10T03:39:23Z","title":"KVFlow: Efficient Prefix Caching for Accelerating LLM-Based Multi-Agent Workflows"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 16 inbound Pith citation observations for arXiv:2507.07400."}