{"as_of":"2026-08-06T11:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37409922485534ad0b0e604c4b128e92521143c604c9d11365e4c28aa684b55d","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:29:36.610491Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T05:14:41.315225Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12301","snapshot_observed_at":"2026-07-12T05:14:41.315225Z","title":"arXiv:2604.12301 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03048","last_updated":"2026-07-03T07:37:57Z","snapshot_observed_at":"2026-08-03T07:15:27.897135Z","submitted_at":"2026-07-03T07:37:57Z","title":"Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T05:14:41.315225Z"},"links":{"cited_paper":"/paper/2604.12301","citing_paper":"/paper/2607.03048"},"observation_digest":"sha256:7e1efd4b996fe932454372d2f913243ff7a64f8d8dc04739d8234858b44ec7ad","observation_id":"5a5b3af6-60d5-48f3-8d56-c485a1573f83","resolution":{"observed_at":"2026-07-12T05:14:41.315225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.12301/citation-record","integrity":"/paper/2604.12301/integrity","json":"/paper/2604.12301/citation-record.json","paper":"/paper/2604.12301"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:e0bced863f4608e08f3619c49fd287e67fcb10930852dc5c86a8128784ae5d52","observation_id":"dcb36fcd-88bf-4f8c-9349-98a38ceae22a","resolution":{"observed_at":"2026-05-11T10:26:01.815954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt caching with Claude","venue":null,"work_id":"6b82fd07-ad5d-4d70-989d-24034240472c","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:27ca8abab811fc985acb87315124ecd776fc64998b44d06fa684225cb9365728","observation_id":"356e53bb-114d-4a33-8461-593375aef084","resolution":{"observed_at":"2026-05-17T23:22:14.376381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model context protocol specification","venue":null,"work_id":"2d1db823-255d-4c81-a725-55cefc83aaa4","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:7ed38b5da51b30267a909ab0647733f0f4341aed51550d45b9cf04bd2a0937cf","observation_id":"8862d6fc-3b64-491e-bc66-a5a933206425","resolution":{"observed_at":"2026-05-17T23:22:14.343062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LongBench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"27d1e3e3-82d9-4f71-8110-1f31868e4c19","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:0ecc20df3fd4b0a01359aa58ca854e1da1a3c65f9d8bfc4d4c76b7086b97f581","observation_id":"4f03e472-b328-47d4-8d00-4120b95a7337","resolution":{"observed_at":"2026-05-17T23:22:14.350061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.nlposs-1.24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTCache: An open-source semantic cache for LLM applications enabling faster answers and cost savings","venue":null,"work_id":"9937a60a-5262-4391-8e6e-2a78b97f6fcd","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:b45d908356b62ad50155d1fe905b4c1f8ba3077d476d7436e3ad82eaf70c9f6e","observation_id":"83f38bb9-3509-429d-a940-c7fb04edf6ed","resolution":{"observed_at":"2026-05-10T15:30:32.436098Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T14:19:47.509907+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T14:19:47.509907+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"3fcce73e-10e2-4ebf-81cb-50bc57e3af00","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:cb6ea6c6189579d1097b170c2cd549e3f036f2873dc4f569a6505c808f7d0dd2","observation_id":"30ee5364-978c-40da-95eb-15874edea48d","resolution":{"observed_at":"2026-05-17T23:22:14.373560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T12:44:53.961440Z","title":"FrugalGPT: How to use large language models while reducing cost and improving performance.Transactions on Machine Learning Research","venue":null,"work_id":"de624289-5bde-416c-8f47-66ab9db0eefa","year":null},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:722a286900ce93fc12ebddd0f800c3bc5d0fcef5b88e228064567f7c05ac7303","observation_id":"972bd370-8d43-49fa-97de-235fce4148cb","resolution":{"observed_at":"2026-05-17T23:22:14.363753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:48bebcf385fbc59d26ca057f56dc24ff8ae5eac3be5af8a37b271575a60d7c1a","observation_id":"c96bbce6-4324-4413-8cf3-1be9bbf4d288","resolution":{"observed_at":"2026-05-11T19:56:45.568475Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:466fdb461a72b4bc0c779d8f1896b2f082816f61db7ad6930421149991dfcb55","observation_id":"1afc6054-208e-4d7d-ae9f-7584c496d4a0","resolution":{"observed_at":"2026-05-11T10:26:01.811647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:ce7fa061d619774d5969c76d01c09bb0bc81443f373fd32b05d8c402d8bf2942","observation_id":"9f86ba6f-52f6-4b8a-943c-59307cf49861","resolution":{"observed_at":"2026-05-11T10:26:01.764284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.825","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models","venue":null,"work_id":"629b9d0e-ed05-4694-ba5a-e81b8d5751dc","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:8184a20accab41b30434834befcaa21d1c3aaf8fa902765b68af5e70a464df20","observation_id":"7587500b-1108-4ddf-af3a-e3e104fad664","resolution":{"observed_at":"2026-05-10T15:30:32.438379Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":"17230511-5582-4a6a-97a2-8ec666c2ee49","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:ee5e49410771681c2cf2e1636a064d0301ca89cfdee28512d9841524b1b6ed45","observation_id":"8cca1ce9-1868-4b7e-8533-448adab09c79","resolution":{"observed_at":"2026-05-17T23:22:14.370702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"cbf873d1-9e68-4418-9528-8c2262119995","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:71c23865da8a2bc6e286d4405e9e905cc1006f0bb0d3259314e967416953d5c2","observation_id":"a850a32a-c7be-4ad1-bdd2-aa197ea472fb","resolution":{"observed_at":"2026-05-17T23:22:14.335881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:23:47.523732Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks","venue":null,"work_id":"7ffcee25-2c3f-4ae8-85c5-eeb5ad07b87b","year":2020},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:bdf406048bb51a277d5fc396c61c47dfdfe1c417a4aeb447971df986228d9e0b","observation_id":"29f15dab-1af0-462c-b820-66479b6988c3","resolution":{"observed_at":"2026-05-17T23:22:14.353363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02977","last_updated":"2025-12-03T03:33:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:59:41Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","version":2},"cited_work":{"arxiv_id":"2409.02977","doi":"10.48550/arxiv.2409.02977","metadata_source":"pith","pith_arxiv_id":"2409.02977","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Model-Based Agents for Software Engineering: A Survey","venue":"cs.SE","work_id":"65bf4f26-a45c-4639-841f-9f865ef1030e","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2409.02977","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:081c63e03541eac3206f0bb6c7bc0fd8439c43cc425920735af77f54ddb17397","observation_id":"aa709e96-19b6-459a-b076-09cd16aed5e1","resolution":{"observed_at":"2026-05-17T12:35:49.024248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15790","last_updated":"2025-02-26T06:34:55Z","snapshot_observed_at":"2026-08-04T07:43:40.230682Z","submitted_at":"2024-09-24T06:36:56Z","title":"Small Language Models: Survey, Measurements, and Insights","version":3},"cited_work":{"arxiv_id":"2409.15790","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.15790","snapshot_observed_at":"2026-07-04T18:40:02.350725Z","title":"Small language models: Survey, measurements, and insights","venue":null,"work_id":"d47b62d8-fbc2-4285-8e86-9845f68619e3","year":2025},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2409.15790","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:d51d5f7b563269249df4259b2e577206ed365fabc863733859e5220ce09b3bfe","observation_id":"fda3e460-b468-4d0a-b8f4-abe6a7ab3b69","resolution":{"observed_at":"2026-05-11T10:26:01.780655Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ollama: Get up and running with large language models locally","venue":null,"work_id":"cef6da24-00a8-4938-8b1a-ea47c02cfc50","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:5c9c2ae12fb5f352eaf57af3c01457f84d09e55836fc85be941737559ddf848f","observation_id":"984fa1eb-ce55-47d3-aada-3a175e816e2b","resolution":{"observed_at":"2026-05-17T23:22:14.356704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-07-30T15:06:18.011623Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:f65b54e3164fa6a703426f956b995473bb450c33f0bd373a0618f3da99847ea4","observation_id":"019e1d40-c81d-471d-9520-e1c42cf61e2d","resolution":{"observed_at":"2026-05-11T23:27:40.993552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt caching in the API","venue":null,"work_id":"78185dea-faf5-461f-ba8c-3f1704df5f64","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:3db5f428910c7140030ddebaa1398ac679c011da5ad58b07f63560759e596481","observation_id":"4b397e49-6698-4093-8187-41235307d4d4","resolution":{"observed_at":"2026-05-17T23:22:14.359698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":"79e365ca-1b35-4f3d-8b2d-4f5da5c7fbe2","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:cf1b3067b765d71235d25ccfc299d94e7539dc1a8d1cbd8bd83a74864f606854","observation_id":"6d3d14a4-c924-4bcf-88b3-4f48dae1e55c","resolution":{"observed_at":"2026-05-17T23:22:14.367377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:df382572d39385b8b4ea918147d266f369cc3780afd3209453f5d57617be808f","observation_id":"3003816e-9886-43ac-94ee-e4ddd2fce904","resolution":{"observed_at":"2026-05-11T10:26:01.760000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sentence-BERT: Sentence embeddings using siamese BERT- networks","venue":null,"work_id":"72ca4ec1-ee33-4688-a725-99fc72157d1e","year":2019},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:e9f189357b1069a30eb695cacf9ea23fb37b475080ee24edc956f8e001e91300","observation_id":"1763e294-50f1-4fcd-86ab-444a0b459e82","resolution":{"observed_at":"2026-05-17T23:22:14.339772Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09702","last_updated":"2023-08-19T21:27:51Z","snapshot_observed_at":"2026-07-06T15:55:41.294452Z","submitted_at":"2023-07-19T01:14:49Z","title":"Efficient Guided Generation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2307.09702","doi":"10.48550/arxiv.2307.09702","metadata_source":"pith","pith_arxiv_id":"2307.09702","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Guided Generation for Large Language Models","venue":"cs.CL","work_id":"eed83982-64d7-41e1-b7ec-21167ca473d5","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"cited_paper":"/paper/2307.09702","citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:6e3f3897dcd48d21f51c1febb7c3c69666303c67ec69bce47f3d9f6d4ed3bddd","observation_id":"0da7e975-147b-42f8-8a0e-deaa309cb627","resolution":{"observed_at":"2026-05-13T15:07:13.961671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:23:27.209789+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:23:27.209789+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"674e2e98-a41d-4133-9576-b7970802c58e","year":2023},"citing_paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:36.610491Z"},"links":{"citing_paper":"/paper/2604.12301"},"observation_digest":"sha256:4d981f15a6686d4ec24f5260665907d5ffcf3b3fe6045d2e3ade8f2ce5f50676","observation_id":"0120b1c7-6ea1-478a-bf51-182ebc17cbdb","resolution":{"observed_at":"2026-05-17T23:22:14.346565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.12301","last_updated":"2026-04-14T05:19:33Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T05:19:33Z","title":"Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":12},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2604.12301."}