{"as_of":"2026-08-09T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb984d2ff8448268670016aa09fb9609f9cdbe7e6a97385af8921ea174e5fc0d","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:36:51.584458Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00685/citation-record","integrity":"/paper/2608.00685/integrity","json":"/paper/2608.00685/citation-record.json","paper":"/paper/2608.00685"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11432-025-4665-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards reasoning era: a survey of long chain-of-thought for reasoning large language models.Science China Information Sciences, 69(6):161101, May 2026b","venue":"Science China Information Sciences","work_id":"5b736c02-e01f-4a2b-9e83-88da12e9bd4e","year":1919},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.538635Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:67f82535eb22603c7cf6ca5e53deda1f34af3931ca0992917b0f4e5243f483b1","observation_id":"e97b5b1e-667a-4e86-9d97-1887e8fc79da","resolution":{"observed_at":"2026-08-05T00:36:51.642542Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T22:38:06.614254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T22:38:06.614254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5881.37559","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:52.019578Z","title":"ISBN 979-8-4007-1926-4","venue":null,"work_id":"84e14439-0588-41a0-80b7-0b82ab1cc799","year":1926},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.542292Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:a16e8c7c3f6f9c2ba06ab775d236bac8228b7cb05bc2265ca30e3cdf5b76416c","observation_id":"6faf6e14-da02-4a82-b125-ae09aafd60be","resolution":{"observed_at":"2026-08-05T00:36:52.024269Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1300.42926","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:51.742072Z","title":"pgn\": SAN in standard algebraic notation **without any annotation symbols** (no ’+’ for check, no ’##’ for checkmate). Use uppercase letters for pieces. Example:","venue":null,"work_id":"bddfaca3-3d7b-47d5-b5e7-82ecd935c3ba","year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.584458Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:2672ac301cd05f9e99f1f8f6751d893505ec28e5d7271e2ff053596c70c635e8","observation_id":"56823672-9e9d-4af1-83a7-9e917b313744","resolution":{"observed_at":"2026-08-05T00:36:51.747082Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05722","last_updated":"2026-06-03T04:35:07Z","snapshot_observed_at":"2026-08-03T23:27:34.692491Z","submitted_at":"2025-11-07T21:29:41Z","title":"OckBench: Measuring the Efficiency of LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.05722","snapshot_observed_at":"2026-08-05T00:36:51.549437Z","title":"Zheng Du, Hao Kang, Song Han, Tushar Krishna, and Ligeng Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.549437Z"},"links":{"cited_paper":"/paper/2511.05722","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:627b6e6b70817058727665422039fadeeefe87ac1f890e03bb1445e0c2b2d8f5","observation_id":"15a76664-0ca0-4ddf-81c1-9f23fc8aa58c","resolution":{"observed_at":"2026-08-05T00:36:51.549437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07407","last_updated":"2025-08-31T14:55:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-10T16:07:32Z","title":"A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07407","snapshot_observed_at":"2026-08-05T00:36:51.552675Z","title":"arXiv:2508.07407 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.552675Z"},"links":{"cited_paper":"/paper/2508.07407","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:129fcc015ecadfafae56da3cd686b925649f88aa1cb93a52c96de47a981f0596","observation_id":"c156dfc5-9448-4670-82f3-4014516eabdc","resolution":{"observed_at":"2026-08-05T00:36:51.552675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:51.555932Z","title":"arXiv:2511.01633 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.555932Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:2dffcbf3ba25e2e36b6d227cdb1a617878ff45a8ab94e27367104d884cbe5100","observation_id":"fd8bd640-66f2-4014-bd91-6516d7c7d17d","resolution":{"observed_at":"2026-08-05T00:36:51.555932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s42256-026-01268-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:51.622079Z","title":"doi: 10.1038/s42256-026-01268-y","venue":null,"work_id":"a2913fe7-b1ac-4f6f-887d-3b7d31d29ad6","year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.559398Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:5e3fcc1a95dec63045a11326229563a739501c5309add7a4e8bd29aaeee09186","observation_id":"1ebcbd7d-f6bf-4016-b4c9-2421af7bfcdd","resolution":{"observed_at":"2026-08-05T00:36:51.625114Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T22:38:06.676345+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T22:38:06.676345+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:52.096834Z","title":"12 Isaac Ong, Amjad Almahairi, Vincent Wu, Wei-Lin Chiang, Tianhao Wu, Joseph E Gonzalez, M Kadous, and Ion Stoica","venue":null,"work_id":"a5e175fb-d345-4e93-a0d5-07e9eb4298a6","year":2025},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.565616Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:db8f08c73205c0e2aec13f24e23106303112553268a0616416070de13496cf82","observation_id":"9c8679bc-9784-46cf-b2d9-9f4c4b70af0a","resolution":{"observed_at":"2026-08-05T00:36:52.099964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:52.087147Z","title":"Andries Smit, Nathan Grinsztajn, Paul Duckworth, Thomas D","venue":null,"work_id":"687c15d8-49b7-41ce-9c84-cd744e416fb7","year":2025},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.568664Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:8433b3917a2f9e0d783fe5e3da65cb92e83e6f47b25fadd2d3956e15a13725f4","observation_id":"040158b0-c344-4ec1-b42d-dfdfc777750b","resolution":{"observed_at":"2026-08-05T00:36:52.090242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:52.077205Z","title":"Jinwei Su, Qizhen Lan, Yinghui Xia, Lifan Sun, Weiyou Tian, Tianyu Shi, and Lewei He","venue":null,"work_id":"0145f59e-7972-4260-b549-6b806d1ebf43","year":2026},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.571911Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:7110fa78938e64977015b3b7c1831318dba3d3c42aa8206ce1e9b05a8a2ce9be","observation_id":"1de149db-2c16-47ab-816e-1ebee00562ba","resolution":{"observed_at":"2026-08-05T00:36:52.080618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4904.37922","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:51.829489Z","title":"ISBN 979-8-4007-2307-0","venue":null,"work_id":"60aaa5b2-4d68-49c7-9e81-73902c1e7f57","year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.574931Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:d41f635736be9d038f16c9fd11b686b3859a980f2531c2e562102784cc30cf6c","observation_id":"58910524-1645-4ff3-b7c4-bc68e7e4b339","resolution":{"observed_at":"2026-08-05T00:36:51.834140Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02460","last_updated":"2026-04-11T23:40:49Z","snapshot_observed_at":"2026-07-06T22:51:48.992363Z","submitted_at":"2026-04-02T18:47:48Z","title":"Single-Agent LLMs Outperform Multi-Agent Systems on Multi-Hop Reasoning Under Equal Thinking Token Budgets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02460","snapshot_observed_at":"2026-08-05T00:36:51.578178Z","title":"arXiv:2604.02460 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.578178Z"},"links":{"cited_paper":"/paper/2604.02460","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:35db1c24f2a3054b3f2641594ef6a4b4a1e9d8f94fa3bff755bb0a4574343b72","observation_id":"5d490b22-8431-4b19-b5ba-61c3aa285a9f","resolution":{"observed_at":"2026-08-05T00:36:51.578178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:52.066820Z","title":"net/forum?id=YrycTjllL0","venue":null,"work_id":"1b69956a-014f-4e56-8702-f3c71656afff","year":2026},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.581340Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:1eb50d6f34bccf459beaec4cdba10d8e8dbe7f09e011641b1636aa2b60217f95","observation_id":"2718083e-6941-4cc7-907f-0317309aeb28","resolution":{"observed_at":"2026-08-05T00:36:52.071032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/068431-1613","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://proceedings.neurips.cc/paper_files/paper/ 2022/file/8bb0d291acd4acf06ef112099c16f326-Paper-Conference.pdf","venue":null,"work_id":"2567704d-5fe9-43c9-b591-0530581681aa","year":2022},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.562387Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:6c6b5feeeff725b70a95fa85375c621ea11e3bb8f574fa564152efdc09b39c1f","observation_id":"d9eb118e-d500-4204-b2dc-09666eeb3025","resolution":{"observed_at":"2026-08-05T00:36:51.615086Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T22:38:06.732834+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T22:38:06.732834+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11511","last_updated":"2024-10-15T02:09:04Z","snapshot_observed_at":"2026-07-06T17:04:50.608413Z","submitted_at":"2023-12-12T05:38:55Z","title":"ComplexityNet: Increasing LLM Inference Efficiency by Learning Task Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11511","snapshot_observed_at":"2026-08-05T00:36:51.526770Z","title":"arXiv:2312.11511 [cs] version:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.526770Z"},"links":{"cited_paper":"/paper/2312.11511","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:23e3eb9ffa85f6b7609dc8b1b21e638dae667eaf9f0076e240eb7d1475be1c21","observation_id":"3157bd3e-ba94-457e-b85a-e179d197338b","resolution":{"observed_at":"2026-08-05T00:36:51.526770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:36:51.545517Z","title":"Shangheng Du, Jiabao Zhao, Jinxin Shi, Zhentao Xie, Xin Jiang, Yanhong Bai, and Liang He","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.545517Z"},"links":{"citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:77722f7a0a7f812a4dbb6e8d445fd5e7d58a67b2070649a1d7ed90abf11a9685","observation_id":"f3ad080a-6702-4ca5-af59-5fe62095b3dc","resolution":{"observed_at":"2026-08-05T00:36:51.545517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.23971","last_updated":"2026-05-28T01:52:03Z","snapshot_observed_at":"2026-07-13T19:12:02.676502Z","submitted_at":"2026-03-25T06:07:39Z","title":"The Price Reversal Phenomenon: When Cheaper Reasoning Models Cost More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.23971","snapshot_observed_at":"2026-08-05T00:36:51.534496Z","title":"Lingjiao Chen, Chi Zhang, Yeye He, Ion Stoica, Matei Zaharia, and James Zou","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.534496Z"},"links":{"cited_paper":"/paper/2603.23971","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:bc7e99eeaadff5f12701ac7426bcceee1b65bc1f5b76936671c4e82e7687b870","observation_id":"acbbac15-9a46-4fd5-abdb-8885dcaa562f","resolution":{"observed_at":"2026-08-05T00:36:51.534496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23664","last_updated":"2026-06-22T17:48:40Z","snapshot_observed_at":"2026-08-02T17:24:52.002758Z","submitted_at":"2026-06-22T17:48:40Z","title":"MAS-PromptBench: When Does Prompt Optimization Improve Multi-Agent LLM Systems?","version":1},"cited_work":{"arxiv_id":"2606.23664","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.23664","snapshot_observed_at":"2026-08-05T00:36:52.046611Z","title":"MAS-PromptBench: When Does Prompt Optimization Improve Multi-Agent LLM Systems?","venue":"cs.LG","work_id":"9165f319-ea2f-484b-8d0f-27b134558719","year":2026},"citing_paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:51.530650Z"},"links":{"cited_paper":"/paper/2606.23664","citing_paper":"/paper/2608.00685"},"observation_digest":"sha256:169bd1a10485906850573758c2867c9e4956f95ec38ffaf0c449f4c98f28be30","observation_id":"9faa2bda-5f36-4b73-be0c-208f8d9fdf24","resolution":{"observed_at":"2026-08-05T00:36:52.050154Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00685","last_updated":"2026-08-01T14:14:12Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:17:57.459224Z","submitted_at":"2026-08-01T14:14:12Z","title":"When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":4},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2608.00685."}