{"as_of":"2026-08-10T01:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e113a5f18292c763963cac5c68c76f98714441e486efa14118804170081f64e1","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:35:01.615574Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05466/citation-record","integrity":"/paper/2608.05466/integrity","json":"/paper/2608.05466/citation-record.json","paper":"/paper/2608.05466"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-08T12:35:01.302551Z","title":"Self-play fine-tuning converts weak language models to strong language models.arXiv preprint arXiv:2401.01335, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.302551Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:024ba2bf9ccf4f886f2404f5f37c8f596242e1d3d39583c3154047030c4678ca","observation_id":"4751f222-a25a-4775-b46b-4ee03e3588fc","resolution":{"observed_at":"2026-08-08T12:35:01.302551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.472786Z","title":"From language to action: a review of large language models as autonomous agents and tool users.Artificial Intelligence Review, 59(2):71, 2026","venue":null,"work_id":"3451f309-8f90-46d1-8c47-e554e92da64c","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.308995Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c3fd48925a66b36fa08bc9b919e9f67039a6f6ca2bf890878c0f3b089868b903","observation_id":"a15515dc-8c1d-4801-8211-13d99d0058d8","resolution":{"observed_at":"2026-08-08T12:35:03.477520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22535","last_updated":"2026-05-21T14:24:43Z","snapshot_observed_at":"2026-08-01T23:33:43.370851Z","submitted_at":"2026-05-21T14:24:43Z","title":"TerminalWorld: Benchmarking Agents on Real-World Terminal Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22535","snapshot_observed_at":"2026-08-08T12:35:01.313844Z","title":"Barr, Mark Harman, Federica Sarro, and He Ye","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.313844Z"},"links":{"cited_paper":"/paper/2605.22535","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:036242af126b52c72294e07b2a75fb863e28f105fe4db5691b7ebd49efff9659","observation_id":"1f10b2bb-9552-4332-8ac2-e153443340b3","resolution":{"observed_at":"2026-08-08T12:35:01.313844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.319160Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.319160Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c0ef6cabcd04fb468d08f325e7ef725ef5e9114e4811c4a81b2420b9cc379450","observation_id":"69728056-387a-4e4b-ac2a-689ae3c85b8b","resolution":{"observed_at":"2026-08-08T12:35:01.319160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07682","last_updated":"2026-06-05T00:39:44Z","snapshot_observed_at":"2026-07-06T23:47:19.773490Z","submitted_at":"2026-06-05T00:39:44Z","title":"SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07682","snapshot_observed_at":"2026-08-08T12:35:01.324108Z","title":"SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?https://arxiv.org/abs/2606.07682,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.324108Z"},"links":{"cited_paper":"/paper/2606.07682","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:ad05cd63f2ca317c5681feb44fba53ffb4449dc96e73821734f52cd6e7f2df38","observation_id":"329d895a-373f-43b2-bc37-e951ac911eee","resolution":{"observed_at":"2026-08-08T12:35:01.324108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.444050Z","title":"A survey on the optimization of large language model-based agents.ACM Computing Surveys, 58(9):1–37, 2026","venue":null,"work_id":"4ac38062-affd-4d82-8c1c-678aa24fb7a1","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.334134Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b68a9d9514ada90d7cec4fe0aa6139dcaa60ab0732c0049f55c52ba7d9bb8b7d","observation_id":"cca10a6e-b833-4eab-afb1-e89759fd8640","resolution":{"observed_at":"2026-08-08T12:35:03.448752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.338853Z","title":"Webevolver: Enhancing web agent self-improvement with coevolving world model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.338853Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5eed0082501540aaab2d7c664e7ff413d2148caee00a1323b85c3cb22fb644b7","observation_id":"884f2c83-9d4e-42a0-88c4-4096f87d5cca","resolution":{"observed_at":"2026-08-08T12:35:01.338853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.419471Z","title":"Self-Verification Provably Prevents Model Collapse in Recursive Synthetic Training","venue":null,"work_id":"ed15119b-7720-4c7d-82a0-3e0e954493d3","year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.344029Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:4e6cc54250dba4a35d7c53b69b1b5b2fcb52bf53ec70ccfcd033aefc3eabc130","observation_id":"f9a59c73-280f-4920-b034-b8f13c837c20","resolution":{"observed_at":"2026-08-08T12:35:03.424792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.348930Z","title":"Goodman, and Dimitris Papailiopoulos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.348930Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:416b0d7ba8a34c242b114c0036afd6724caed71f7da3d7994c9f606f4f9e6606","observation_id":"d14b23df-9113-4bde-b778-ec6e21c9a1a5","resolution":{"observed_at":"2026-08-08T12:35:01.348930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.353745Z","title":"Fung, Kun Wang, Linfeng Zhang, and Jing Shao","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.353745Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:f53cdbd85af5e17521e23eb774ae4d667dc5fcfafa55a302696daf0c9b7507b2","observation_id":"1955cd5c-6f20-423d-b1c3-8a0ef0f599f9","resolution":{"observed_at":"2026-08-08T12:35:01.353745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.358317Z","title":"Harbor: A framework for evaluating and optimizing agents and models in container environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.358317Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1d541eac9b71d2e37551030fe0f9edf92f2988634fd941aa1f5d7e18791d66e1","observation_id":"8d8e5b0c-886c-478a-893e-65510f9a7e02","resolution":{"observed_at":"2026-08-08T12:35:01.358317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.363192Z","title":"Visplay: Self-evolving vision- language models from images.arXiv preprint arXiv:2511.15661, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.363192Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:a2d20430a8176789456d4d7df200736699ef8d4654f24ca375d67d7af05c0cfd","observation_id":"9db325c0-eb7f-493b-9c51-cc4702847e13","resolution":{"observed_at":"2026-08-08T12:35:01.363192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-08T12:35:01.368031Z","title":"V-star: Training verifiers for self-taught reasoners.arXiv preprint arXiv:2402.06457, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.368031Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:8aa85d20adf8ff581d1fa0dec12a4f4c2ab87b0b6ccd57c3e1dc29ef8da26e67","observation_id":"4aec1f12-e28b-4ee8-bbee-b2ee62967581","resolution":{"observed_at":"2026-08-08T12:35:01.368031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22883","last_updated":"2026-06-22T05:50:23Z","snapshot_observed_at":"2026-08-07T14:57:03.822714Z","submitted_at":"2026-06-22T05:50:23Z","title":"CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22883","snapshot_observed_at":"2026-08-08T12:35:01.373257Z","title":"Cli-universe: Towards verifiable task synthesis engine for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.373257Z"},"links":{"cited_paper":"/paper/2606.22883","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:61a23177f81830f00b96ccacccbd68744a502b31c6487f3f152bfa3354b80ba5","observation_id":"f74f5342-4b66-46b2-b99f-d67ac79e12a3","resolution":{"observed_at":"2026-08-08T12:35:01.373257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-08-08T12:35:01.378303Z","title":"R-zero: Self-evolving reasoning llm from zero data, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.378303Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:d51ddc15e4b0ba115039651061a5326300fffe225f06b6cad0e8775f97eb1f18","observation_id":"af4ea242-212d-44d3-9029-a59d4d8b53e5","resolution":{"observed_at":"2026-08-08T12:35:01.378303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23321","last_updated":"2026-06-22T13:32:52Z","snapshot_observed_at":"2026-08-09T21:27:21.918204Z","submitted_at":"2026-06-22T13:32:52Z","title":"Tmax: A simple recipe for terminal agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23321","snapshot_observed_at":"2026-08-08T12:35:01.383123Z","title":"Tmax: A simple recipe for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.383123Z"},"links":{"cited_paper":"/paper/2606.23321","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:0764b5cfbe78c800659e98a52302a55bad2c6c9fa5530315605e548f114e9389","observation_id":"aa3a79ee-4f6f-4370-a4d9-5e8d187c5a6b","resolution":{"observed_at":"2026-08-08T12:35:01.383123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.404295Z","title":"Swe-bench: Can language models resolve real-world github issues? In B","venue":null,"work_id":"7099f216-d969-4530-8436-d07a9693417a","year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.388157Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:98e5396406327ee9363230411ba3dd90fa9c8496d1a3285a2bac63a390ea96a1","observation_id":"23b7dc0e-0a83-43ea-bd7f-8a97e0d40442","resolution":{"observed_at":"2026-08-08T12:35:03.409195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-07T16:54:09.525403Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-08T12:35:01.393285Z","title":"Ziegler, Elizabeth Barnes, and Lawrence Chan","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.393285Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:155837a969f41e3e3d10ebbe052df776abfc2257816669628f2a9ade3fbd6eb6","observation_id":"fdbb748b-6bad-4e35-833c-65bb425646de","resolution":{"observed_at":"2026-08-08T12:35:01.393285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19652","last_updated":"2026-04-27T16:28:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-27T08:01:03Z","title":"Self-Rewarding Vision-Language Model via Reasoning Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19652","snapshot_observed_at":"2026-08-08T12:35:01.398285Z","title":"Self-rewarding vision-language model via reasoning decomposition.arXiv preprint arXiv:2508.19652, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.398285Z"},"links":{"cited_paper":"/paper/2508.19652","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:ef5b273e09b68697c7183e5c8e20d82d98a4543a2cbd37e825081fc6b30eaba9","observation_id":"070ea0a5-1f76-4730-a143-e1040b2e3955","resolution":{"observed_at":"2026-08-08T12:35:01.398285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.403381Z","title":"Mm-zero: Self-evolving multi-model vision language models from zero data","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.403381Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:80fe85ce3909661081246575a3c3a18da1f23a8b1be67c9a778cc735af7a294e","observation_id":"b1a70485-2250-434e-9bf7-99f0fa4a63ad","resolution":{"observed_at":"2026-08-08T12:35:01.403381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.08964","last_updated":"2026-07-13T06:00:47Z","snapshot_observed_at":"2026-08-07T13:50:01.305675Z","submitted_at":"2026-07-09T21:56:37Z","title":"Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08964","snapshot_observed_at":"2026-08-08T12:35:01.407591Z","title":"Long-horizon-terminal-bench: Testing the limits of agents on long-horizon terminal tasks with dense reward-based grading, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.407591Z"},"links":{"cited_paper":"/paper/2607.08964","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:320e693a8bf1feaa686ad558c9428dac09f796d7122df60edd7b2fbaba8f1cd1","observation_id":"f1b89008-24a9-40b4-bcdf-70106faf04c8","resolution":{"observed_at":"2026-08-08T12:35:01.407591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.389194Z","title":"Agentbench: Evaluating llms as agents,","venue":null,"work_id":"ae97ac29-08fb-4947-a7da-82b44630c892","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.412016Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:60721617d4a133a16ba5f63080cdeb3ffeb0ce4169b879bd00bd88ba96bb33b3","observation_id":"93372bca-a708-461a-baa1-fee350f67689","resolution":{"observed_at":"2026-08-08T12:35:03.394024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-08T12:35:01.420886Z","title":"Merrill, Alexander G","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.420886Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:521662b919f01c89a729e03f46468677ec6726d82b0409f2467ce2fbbf2a81fc","observation_id":"e3dca9b8-f0a3-480e-b867-c2049c20edd0","resolution":{"observed_at":"2026-08-08T12:35:01.420886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-08T12:35:01.425569Z","title":"Gaia: a benchmark for general ai assistants, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.425569Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:648c5b91a0556c1f861dac813e79981bd3b8e60848c6c880be968820162f12bb","observation_id":"3a062bd9-f771-4714-abd8-d610024726b7","resolution":{"observed_at":"2026-08-08T12:35:01.425569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21139","snapshot_observed_at":"2026-08-08T12:35:01.430355Z","title":"Training software engineering agents and verifiers with swe-gym, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.430355Z"},"links":{"cited_paper":"/paper/2412.21139","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1170983115ef8bcf82331104d368679440d0056641490ab273a1ae8a923341ae","observation_id":"81f022bb-9ae9-45ea-860f-4044c6fe7478","resolution":{"observed_at":"2026-08-08T12:35:01.430355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29559","last_updated":"2026-05-28T08:11:57Z","snapshot_observed_at":"2026-08-06T04:57:04.668756Z","submitted_at":"2026-05-28T08:11:57Z","title":"LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents","version":1},"cited_work":{"arxiv_id":"2605.29559","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.29559","snapshot_observed_at":"2026-08-08T12:35:02.589780Z","title":"LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents","venue":"cs.CL","work_id":"8e7b172f-de6a-45e4-b1ab-9d6bd716f101","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.435238Z"},"links":{"cited_paper":"/paper/2605.29559","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:20b89174527887d151ec21a6cc74e9c063204e9a7af4bdcd1908c7a60b5b0686","observation_id":"9bcd7778-c3ac-4d83-8b5f-e5b63395d5ea","resolution":{"observed_at":"2026-08-08T12:35:02.595199Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.440348Z","title":"On data engineering for scaling llm terminal capabilities, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.440348Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:431a50df3ddfdec79be33dc53af74941ba5d1caa7ff8179f301ac66019782c93","observation_id":"26531a17-9801-4f31-95a4-df28cdd8236a","resolution":{"observed_at":"2026-08-08T12:35:01.440348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04109","last_updated":"2025-07-06T18:16:47Z","snapshot_observed_at":"2026-07-06T19:46:15.364468Z","submitted_at":"2024-11-06T18:36:22Z","title":"Self-Consistency Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04109","snapshot_observed_at":"2026-08-08T12:35:01.444948Z","title":"Self-consistency preference optimization.arXiv preprint arXiv:2411.04109, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.444948Z"},"links":{"cited_paper":"/paper/2411.04109","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:fc6875d8611c32b803861295e8a936b2f0c0e0bf2dce6d2d4be8700a0bf2c92f","observation_id":"818058ae-800e-4e9e-b1d8-8a1fc22eb194","resolution":{"observed_at":"2026-08-08T12:35:01.444948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24855","last_updated":"2026-06-23T17:34:29Z","snapshot_observed_at":"2026-07-06T23:59:23.407216Z","submitted_at":"2026-06-23T17:34:29Z","title":"OpenThoughts-Agent: Data Recipes for Agentic Models","version":1},"cited_work":{"arxiv_id":"2606.24855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24855","snapshot_observed_at":"2026-08-08T12:35:02.464497Z","title":"OpenThoughts-Agent: Data Recipes for Agentic Models","venue":"cs.AI","work_id":"375e7474-9020-4cb2-a42a-f0898f4231a8","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.449971Z"},"links":{"cited_paper":"/paper/2606.24855","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:887f7552c69e6dc29ce33286623b18fcd7558ecd62f9b1810697d445a67b8ad8","observation_id":"f7e921a1-b99a-40a7-9c36-ba29a007f1c0","resolution":{"observed_at":"2026-08-08T12:35:02.471780Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.10891","last_updated":"2026-07-12T19:40:27Z","snapshot_observed_at":"2026-08-02T15:45:32.411241Z","submitted_at":"2026-07-12T19:40:27Z","title":"SETA: Scaling Environments for Terminal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10891","snapshot_observed_at":"2026-08-08T12:35:01.454584Z","title":"Seta: Scaling environments for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.454584Z"},"links":{"cited_paper":"/paper/2607.10891","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:45362f0a884b70b2fad3a5ee58ac876877ac5a047f046e817aa19171c1e78294","observation_id":"7b06f98d-147b-4eea-9a8e-a5f2c6131680","resolution":{"observed_at":"2026-08-08T12:35:01.454584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-08-08T12:03:18.710098Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-08T12:35:01.459919Z","title":"Co-Reyes, Rishabh Agarwal, Ankesh Anand, Piyush Patil, Xavier Garcia, Peter J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.459919Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:f724fb5d19492449f8eba89ffca7c3e9fe5ea823c14b1b0a1a131a05ff0c9ac8","observation_id":"c2689870-d8ac-4522-a585-d2f1e16e5a9b","resolution":{"observed_at":"2026-08-08T12:35:01.459919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05808","last_updated":"2026-04-17T17:24:06Z","snapshot_observed_at":"2026-08-02T19:53:18.484273Z","submitted_at":"2026-01-09T14:32:06Z","title":"EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05808","snapshot_observed_at":"2026-08-08T12:35:01.465550Z","title":"Envscaler: Scaling tool-interactive environments for llm agent via programmatic synthesis.arXiv preprint arXiv:2601.05808, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.465550Z"},"links":{"cited_paper":"/paper/2601.05808","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:0629e948f0472602f723a4b5ff265366570ac74e8cec432aec02c2eb0140ea10","observation_id":"dd7ade03-c98e-42fe-b544-e3b639fd4214","resolution":{"observed_at":"2026-08-08T12:35:01.465550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.471490Z","title":"Scaleenv: Scaling environment synthesis from scratch for generalist interactive tool-use agent training, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.471490Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7bee7a012711f68c361431a898b6f6780002a745a35dcbd95b8fc44b42a4a46a","observation_id":"391e5d70-936a-475f-8192-a738308d438b","resolution":{"observed_at":"2026-08-08T12:35:01.471490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.475984Z","title":"Apex-agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.475984Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:04fcc8794360d16bdc4a69af654fab0bc00e8cf55de824821754cb6c5557de2e","observation_id":"f75fe1db-c6c7-42d2-b504-d3ab03f32073","resolution":{"observed_at":"2026-08-08T12:35:01.475984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.481690Z","title":"Swe-bench++: A framework for the scalable generation of software engineering benchmarks from open-source repositories, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.481690Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7c6000580f23bc8133b5a2cf9142e623819243a2b484209c6f4b7ae2c31da389","observation_id":"59ac1581-8dd3-4cbe-bbdb-b6f08ad8e71c","resolution":{"observed_at":"2026-08-08T12:35:01.481690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-08T12:35:01.486636Z","title":"Xu, Xiangru Tang, Mingchen Zhuge, Jiayi Pan, Yueqi Song, Bowen Li, Jaskirat Singh, Hoang H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.486636Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b84aa947298e151e06bf8480d815b36d0873f04186a3316f037fcb0e8316ea3c","observation_id":"b73eb0ae-1e24-46a0-acdd-9a924a810255","resolution":{"observed_at":"2026-08-08T12:35:01.486636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.491438Z","title":"Llms as scalable, general-purpose simulators for evolving digital agent training,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.491438Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:74be1f490dca55ea3fa5b9275aa2a6ccb5aab0386bacf0c33db527b97ad72774","observation_id":"e3d7f8c9-ef03-4028-bcd5-ea8e4b3244fb","resolution":{"observed_at":"2026-08-08T12:35:01.491438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01286","last_updated":"2026-05-31T15:12:16Z","snapshot_observed_at":"2026-08-03T00:41:34.020605Z","submitted_at":"2026-05-31T15:12:16Z","title":"BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01286","snapshot_observed_at":"2026-08-08T12:35:01.501875Z","title":"Li, Wenjie Ma, Li Cao, Ziheng Zhou, Mert Cemri, Shu Liu, Yuran Xiu, Chenxiao Yan, Haikun Zhao, Bin Yu, Ion Stoica, and Dawn Song","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.501875Z"},"links":{"cited_paper":"/paper/2606.01286","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:dee5b6d76e631117fad3c8570c7c7c92ecfb8f5221e6bc36ccb68c08444030b6","observation_id":"762ab5bd-7461-4c05-bec4-bd2578a0d662","resolution":{"observed_at":"2026-08-08T12:35:01.501875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.506696Z","title":"Autowebworld: Synthesizing infinite verifiable web environments via finite state machines, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.506696Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:97e629b2668481ebf390ed0e8f2a65b0fa8b8591fa07eae895ada10457938537","observation_id":"6e201482-5bee-4e4a-9bb7-a9d12a250cc1","resolution":{"observed_at":"2026-08-08T12:35:01.506696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.496200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.496200Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:0de77ec3d88bff6ab2840c18eee2f50ffed27ca6b52e5414f1f5d0a99fb8e852","observation_id":"f0ec4313-9275-4087-a681-702e7034aa58","resolution":{"observed_at":"2026-08-08T12:35:01.496200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-09T01:39:11.956106Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-08T12:35:01.516490Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.516490Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e7ad484c922dedf5b3c93589152b5c3064db153049e36b49ee6fc44ebd5834e9","observation_id":"abd49d4b-6f43-44d2-8f0d-ffa3be579ecc","resolution":{"observed_at":"2026-08-08T12:35:01.516490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.364612Z","title":"Wizardlm: Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"721ac073-ea07-4fe1-8871-f1707e8c5ea8","year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.521513Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:eb5e05706574025080c75e6d82886f6426a6c235e4cb66d925531e14b7cc3687","observation_id":"38d9527c-56c1-4ec5-8657-19b07ab3dfeb","resolution":{"observed_at":"2026-08-08T12:35:03.369349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.511524Z","title":"Agent0: Unleashing self-evolving agents from zero data via tool-integrated reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.511524Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:fac12bc3e98f420d9bf3610014f69256e5f75e5ffacffdee4d015a09a326c0b1","observation_id":"729330c6-6025-42dc-83e1-522d60a49f1b","resolution":{"observed_at":"2026-08-08T12:35:01.511524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-08T12:35:01.531330Z","title":"Self-rewarding language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.531330Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:192bfe8802b8eb8d731c0d014ac21faa8bdccf9fa31f83a6736ee013931e59da","observation_id":"9109421e-0c42-406c-98eb-dd6d0bba6352","resolution":{"observed_at":"2026-08-08T12:35:01.531330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-08-09T23:51:45.534260Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-08T12:35:01.535689Z","title":"Multi-swe-bench: A multilingual benchmark for issue resolving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.535689Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:42e62fd4c468b396fd16523e128918cd31efedef574388bf2e795d25afaea27b","observation_id":"cc1409e5-004c-4d77-988e-33d9195d8939","resolution":{"observed_at":"2026-08-08T12:35:01.535689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-08T12:35:01.526085Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.526085Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c06a279be035c07017e4e95984cbd5b336ba654ab23c6b21f474c7cb7034b6f5","observation_id":"4aaa81d3-0dd6-42cd-820f-18f95f0264c9","resolution":{"observed_at":"2026-08-08T12:35:01.526085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.07317","last_updated":"2026-06-06T19:45:56Z","snapshot_observed_at":"2026-08-03T23:08:02.092548Z","submitted_at":"2025-11-10T17:18:35Z","title":"RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07317","snapshot_observed_at":"2026-08-08T12:35:01.545456Z","title":"Rlve: Scaling up reinforcement learning for language models with adaptive verifiable environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.545456Z"},"links":{"cited_paper":"/paper/2511.07317","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:2547f31047813d0f04fe75fe2b4ef09b0ce6ae50ac0e980771b2b35b531b3b69","observation_id":"086199cf-c30f-4789-adfc-39e11916fa3d","resolution":{"observed_at":"2026-08-08T12:35:01.545456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04126","last_updated":"2026-06-30T13:54:32Z","snapshot_observed_at":"2026-08-03T12:10:23.636506Z","submitted_at":"2026-01-07T17:40:08Z","title":"InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.04126","snapshot_observed_at":"2026-08-08T12:35:01.549784Z","title":"Infiniteweb: Scalable web environment synthesis for gui agent training, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.549784Z"},"links":{"cited_paper":"/paper/2601.04126","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:941fd4590b8a15b6e9a605756f3f7d10552dacba83ff563fbff9cacf53bb1205","observation_id":"fa4a0800-592c-458a-bb7d-a8380d0c1fbd","resolution":{"observed_at":"2026-08-08T12:35:01.549784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.540492Z","title":"Star: Bootstrapping reasoning with reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.540492Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b6323af1062e054d3f631327087594bef69271d7a15ece71cfffb148adae5c73","observation_id":"b1944726-6aad-4fc8-b534-cb506d1cd2e2","resolution":{"observed_at":"2026-08-08T12:35:01.540492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-08T12:35:01.558740Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.558740Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:811e555bab15dbd2d96f638719ad818ca98feeb97a427014180f7602f77fbd54","observation_id":"8698f68a-6fc2-4622-a271-3aa74f7735bf","resolution":{"observed_at":"2026-08-08T12:35:01.558740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.339865Z","title":"Self-challenging lan- guage model agents","venue":null,"work_id":"e00486e1-64aa-4fca-8fdc-de003a4321fa","year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.563424Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:9ea3b9875bf1f2d13402891af25ac912379de59dd217e7c141c75b370296457d","observation_id":"2e90da6b-1b81-43de-bc45-cbe34f63e5c0","resolution":{"observed_at":"2026-08-08T12:35:03.344626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03335","last_updated":"2025-10-16T08:23:36Z","snapshot_observed_at":"2026-07-06T21:19:34.329442Z","submitted_at":"2025-05-06T09:08:00Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03335","snapshot_observed_at":"2026-08-08T12:35:01.553746Z","title":"Absolute zero: Reinforced self-play reasoning with zero data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.553746Z"},"links":{"cited_paper":"/paper/2505.03335","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:53fffe8f4250523ac7f99e033dfecd26e751585021bc3f298db59a53742aeb6e","observation_id":"2e6ed6e5-ba9a-4b21-a66f-3db5c4a8ae99","resolution":{"observed_at":"2026-08-08T12:35:01.553746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.572361Z","title":"fix this bug","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.572361Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:385d401c45ed6717db8073ac9f29024f93e397f43955bf085b61889c97482477","observation_id":"b7ff8250-9818-4272-839f-3f0875a1336f","resolution":{"observed_at":"2026-08-08T12:35:01.572361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.568019Z","title":"Termigen: High-fidelity environment and robust trajectory synthesis for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.568019Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:09e618bf12b6512fb694c8faa911e3654081e9d34cb354499be7d15630f1c914","observation_id":"eac52f9b-f66f-41ea-ad23-52aecb70d653","resolution":{"observed_at":"2026-08-08T12:35:01.568019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.325610Z","title":null,"venue":null,"work_id":"e2fa4a8d-1adc-43a8-abbc-3f4bc1509795","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.578764Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:621d5281906147902299e7b2450d3005975489edb04f7d8f1d34fb9cf2382f07","observation_id":"65d712c6-8fd3-43e3-9b10-218b501f55c8","resolution":{"observed_at":"2026-08-08T12:35:03.330156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.311023Z","title":null,"venue":null,"work_id":"86056706-6610-4f6e-b54e-daa73d44d52a","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.583427Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:21d3baa1a63004416c287180cece5ac64233bc000432e96bd3101817924dacf5","observation_id":"7945c93a-e1b9-4e3d-8d89-b39a7815200f","resolution":{"observed_at":"2026-08-08T12:35:03.315673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.296127Z","title":null,"venue":null,"work_id":"2203b136-4a5e-440a-a486-3626cf4ea236","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.587964Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:3caf36fd310f69d22edea10a6b7694202e222dc802478f98a0c2be83f2a368d9","observation_id":"5e41e0c0-5d1b-4bbf-ac40-64942545073d","resolution":{"observed_at":"2026-08-08T12:35:03.300959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.279850Z","title":null,"venue":null,"work_id":"93bccb8a-5ab6-49ed-8a79-d1f5b190a264","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.592376Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:abf7f3faa483cee185284fd818ef36e47e59f189858d818852eb921a40dc6a81","observation_id":"be9f50aa-88a0-45d5-8f78-c13f1fcab05d","resolution":{"observed_at":"2026-08-08T12:35:03.284962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.264128Z","title":null,"venue":null,"work_id":"967e29c2-c594-49c2-aeda-0dae7683463e","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.597325Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5d548f7e4a243256500ceaa4dfb6dc241865bd8e5cdf42a2fe85687191936267","observation_id":"fdd1eb42-3b5a-4b8b-9bc2-755602fabd3b","resolution":{"observed_at":"2026-08-08T12:35:03.268785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.250200Z","title":null,"venue":null,"work_id":"0a34282d-dbdc-4af3-bace-5743c3786799","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.601936Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:307694954a254a0e8c11a859577bfc0a06139ac4e6e0c91fb4d4149d80415147","observation_id":"e6b5e406-e6e5-43f9-909a-3c9612176c37","resolution":{"observed_at":"2026-08-08T12:35:03.254594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.234983Z","title":null,"venue":null,"work_id":"c98d4356-d951-407c-8d5a-ad2d2691f6c7","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.606600Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c23d43b5b4dbbab31eb833d5419b4b1a8edbdc5dcbc44339cf3e50f270a80d48","observation_id":"3440699a-1c81-49ba-8a15-b7d892117e93","resolution":{"observed_at":"2026-08-08T12:35:03.239621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.220253Z","title":null,"venue":null,"work_id":"4d5f034c-6f80-4c38-ad76-5c759381fe24","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.611257Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:979408e0960b004da8b907a179a6d237005e1bf0bf6e6f894293cdaaf938ecad","observation_id":"eb565eab-b642-413e-9647-dbc85a94026c","resolution":{"observed_at":"2026-08-08T12:35:03.224772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.205401Z","title":"until tests pass","venue":null,"work_id":"3447add5-658a-425e-a116-0541e3acdfad","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.615574Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:65dffbe95995dc6e73c8497029fc0bfc5b46e5938cb23058f3ecde715afcfdde","observation_id":"499ebf7c-6274-4ee3-bd1a-68d3c740cef9","resolution":{"observed_at":"2026-08-08T12:35:03.210164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-08T12:35:01.416279Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.416279Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5046d6aef18960d34a61c0113074d2f123c027ecfd9cfbda6a577c504f25ca8d","observation_id":"83c979f1-9a6d-4b75-85fc-9a87086c735c","resolution":{"observed_at":"2026-08-08T12:35:01.416279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.458545Z","title":null,"venue":null,"work_id":"66b6f6f2-4197-4bdb-9435-34dd617cd78a","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.329215Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:04f3cb91d996310ee59f9c5fadef72e5ba8e67af9b69d04cda70eb8cd5bf37af","observation_id":"3804f896-5336-4003-9f00-41dcb5ef1009","resolution":{"observed_at":"2026-08-08T12:35:03.463141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T23:10:53.131144Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":55,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2608.05466."}