{"as_of":"2026-08-09T21:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd6023d113468f6e8d7c39d05e1d9a8f4f3415f803f42d71650c4c7c76b79a41","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:38:41.021030Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05013/citation-record","integrity":"/paper/2608.05013/integrity","json":"/paper/2608.05013/citation-record.json","paper":"/paper/2608.05013"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19678","snapshot_observed_at":"2026-08-08T00:38:39.536928Z","title":"From llm reasoning to autonomous ai agents: A comprehensive review, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.536928Z"},"links":{"cited_paper":"/paper/2504.19678","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b6871f73ef395ee01a19a5b1c562ea9397e52c1ab621c3932e53d1aff0680cab","observation_id":"04750b3e-8eaf-4a96-b53c-c54dcba0a03d","resolution":{"observed_at":"2026-08-08T00:38:39.536928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.541971Z","title":"Llm-based agentic systems for software engineering: Challenges and opportunities,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.541971Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a3a27e7c17f3dcbf0133f6d1b410d8a169970ef91740b5dc2dfb39b514036005","observation_id":"80ff8988-6419-4476-aa75-3b2ef2e30d5f","resolution":{"observed_at":"2026-08-08T00:38:39.541971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.549630Z","title":"Sager, Benjamin Meyer, Peng Yan, Rebekka Von Wartburg-Kottler, Layan Etaiwi, Aref Enayati, Gabriel Nobel, Ahmed Abdulkadir, Benjamin F","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.549630Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fdada84567e55830b6f4f07bcdf241bb0ae6cb551779170a7b1718f3a3839ad3","observation_id":"c1eed431-8eb6-445e-ac82-cd179c3cbb67","resolution":{"observed_at":"2026-08-08T00:38:39.549630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.553376Z","title":"Deep research of deep research: From transformer to agent, from ai to ai for science, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.553376Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8773d3b274e87ddb95c6e001ad40da206265e5140c7b6697bbc96efea727489c","observation_id":"6786f0a2-c3e8-4b42-aa98-aa7e6bf135fc","resolution":{"observed_at":"2026-08-08T00:38:39.553376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.556875Z","title":"URLhttps://arxiv.org/abs/2602.22680","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.556875Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ff08940a97fa302690751089be0967bdfc6d21896b3c0692ac49cc14e1c5a6e6","observation_id":"07e3de04-58b5-475d-81e3-57bed148998d","resolution":{"observed_at":"2026-08-08T00:38:39.556875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20613","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:43.951270Z","title":"Agentif-oneday: A task-level instruction-following benchmark for general ai agents in daily scenarios, 2026","venue":null,"work_id":"67b83992-4fcf-49bc-b789-d121f0fc88ac","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.560065Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:04e6ffc648e1cc89bc09dfc5b4d61e21e4e4c5aeecbe0f6923c677cc354fe7ca","observation_id":"7b5098e6-d1dd-462f-a5d5-b405226c0a21","resolution":{"observed_at":"2026-08-08T00:38:43.955952Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-08T00:38:39.563986Z","title":"Glm-5: from vibe coding to agentic engineering, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.563986Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fc69cecb27801912611b6effd3aafcdddb2f4d254435a083e5e1a1ab98f8f08a","observation_id":"f0cc3073-345b-4686-83e6-347f3511a02f","resolution":{"observed_at":"2026-08-08T00:38:39.563986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-08T00:38:39.567649Z","title":"React: Synergizing reasoning and acting in language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.567649Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:350d332aa925bc4b5ab1b91432d17b07ae09570adbb5a518e4bf89b2d79a5eb6","observation_id":"586d9ffe-7791-49cc-8e90-c7daa9ab1019","resolution":{"observed_at":"2026-08-08T00:38:39.567649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.571781Z","title":"A subgoal-driven framework for improving long-horizon llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.571781Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:9cc2575f7e8f35c387e061e108c32f3b66fd1ab159ac8939e19e3f4ec7bdf764","observation_id":"a081deff-7e38-4f1f-a40f-fd0a42363cd2","resolution":{"observed_at":"2026-08-08T00:38:39.571781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10507","last_updated":"2026-06-09T07:35:14Z","snapshot_observed_at":"2026-08-05T06:17:13.116592Z","submitted_at":"2026-06-09T07:35:14Z","title":"HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning","version":1},"cited_work":{"arxiv_id":"2606.10507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10507","snapshot_observed_at":"2026-08-08T00:38:43.771411Z","title":"HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning","venue":"cs.AI","work_id":"cd53a461-9c83-42fb-916c-005819aa349c","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.575007Z"},"links":{"cited_paper":"/paper/2606.10507","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fa2b33ca571e757d684d8ff235ff27aee9cfcd0146b305f94c26fa7af1e53083","observation_id":"7865ef8b-e6c9-4079-bc8f-3d07ee43ea5b","resolution":{"observed_at":"2026-08-08T00:38:43.775372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-08T00:38:39.578497Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.578497Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6921bb41461a0897db23dcb5142f04e498c0ec3a2d8be4e791d021bdc4e3734b","observation_id":"56a9fc33-7c88-422a-81f2-076fc2d4b9f2","resolution":{"observed_at":"2026-08-08T00:38:39.578497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-08T00:38:39.581950Z","title":"Reflexion: Language agents with verbal reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.581950Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8d1c344fbda09e3c854289337008b5b78ce7c5204306c0bd9a07c62c44145e1e","observation_id":"90c52209-8ed0-4d56-ad42-0c7427ddd1f1","resolution":{"observed_at":"2026-08-08T00:38:39.581950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-08T00:38:39.585957Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.585957Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:edd6b5e91f2febf038ea5e1bd55e9f02a2447285e9c0da96fbf16e1e6f7a1f87","observation_id":"548169e2-7067-4f58-8056-f913f434e35f","resolution":{"observed_at":"2026-08-08T00:38:39.585957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.589131Z","title":"Marco deepresearch: Unlocking efficient deep research agents via verification-centric design, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.589131Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:03e88434eff59661c01bb15845f9a44e48139bf5e31032556b6c08baa291e484","observation_id":"67a3885a-0382-4be0-ae7d-eac8adf5520c","resolution":{"observed_at":"2026-08-08T00:38:39.589131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.29848","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:43.565041Z","title":"Agentfixer: From failure detection to fix recommendations in llm agentic systems, 2026","venue":null,"work_id":"20c34d82-10cf-4757-a91e-2a62f40330b3","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.622820Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:66801a7b35193940d9c0633d50e2c39db1807f4e28755536beca4fdf886e76e6","observation_id":"2bfa67fa-d844-4a64-a515-74c59ad2e739","resolution":{"observed_at":"2026-08-08T00:38:43.667311Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06448","last_updated":"2026-06-04T17:44:18Z","snapshot_observed_at":"2026-08-02T14:46:30.773077Z","submitted_at":"2026-06-04T17:44:18Z","title":"Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06448","snapshot_observed_at":"2026-08-08T00:38:39.657823Z","title":"Agent memory: Characterization and system implications of stateful long-horizon workloads, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.657823Z"},"links":{"cited_paper":"/paper/2606.06448","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:46d51fb44e3ed851bc757d21e826813601eebcef9a913e3fb592bff5b4a76d7a","observation_id":"a379ab37-ac25-439a-8cb4-c8ade73a4d99","resolution":{"observed_at":"2026-08-08T00:38:39.657823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20833","last_updated":"2026-05-20T07:25:33Z","snapshot_observed_at":"2026-08-08T02:04:54.204252Z","submitted_at":"2026-05-20T07:25:33Z","title":"MemGym: a Long-Horizon Memory Environment for LLM Agents","version":1},"cited_work":{"arxiv_id":"2605.20833","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20833","snapshot_observed_at":"2026-08-08T00:38:43.200561Z","title":"MemGym: a Long-Horizon Memory Environment for LLM Agents","venue":"cs.CL","work_id":"8b8166c7-2ff6-4b0a-9e31-fac0cee26c35","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.716514Z"},"links":{"cited_paper":"/paper/2605.20833","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:733aba678acad23ec184f702a44becbbad476c8f18ce87d7d95f884f5d73b36c","observation_id":"61081a05-0526-4da6-aa28-f67be0aff174","resolution":{"observed_at":"2026-08-08T00:38:43.350593Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.772726Z","title":"Lightmem: Lightweight and efficient memory-augmented generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.772726Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:62a49160546906d1ec0405b54e6dfcc516dc0f89f4d06fd71993ec4c63cc5b87","observation_id":"c29a7ead-71b4-4644-8503-143fa7760e8b","resolution":{"observed_at":"2026-08-08T00:38:39.772726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.828429Z","title":"Gemini 3.1 pro model card, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.828429Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:dc20a93085e9c37968d414cb93a0f2840ccaacfaea0c88df0f7a182f879d43cd","observation_id":"76acd607-ca3d-483a-adc6-c31871de1600","resolution":{"observed_at":"2026-08-08T00:38:39.828429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.832622Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.832622Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:64dbe0daaaf2bedbd0c6d157070a44c2404e947097d5a77f72fe88b569bb4b3c","observation_id":"8a437970-00e0-4c66-b933-e06f617160db","resolution":{"observed_at":"2026-08-08T00:38:39.832622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.836836Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.836836Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:cb677fc6e15d47a66bb8c4e0c81ca29907c8a2e2d56a4e87c2691968f037beaa","observation_id":"1c88161f-59ff-457c-9b9d-cad6054130f2","resolution":{"observed_at":"2026-08-08T00:38:39.836836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.840071Z","title":"Gpt-5.5 system card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.840071Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6d1115aaa6c9e922555f28ab54fc13a1a891f406b074f7a23e83966862d0f929","observation_id":"0f456013-8aa8-4aec-96fe-5a837d5686bf","resolution":{"observed_at":"2026-08-08T00:38:39.840071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.843355Z","title":"Gemini 3 pro model card, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.843355Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bd2c4ef7712c87c69f507560b143e67eb3f5cd828c7f48a0808a01ddb8c48c0e","observation_id":"c2a64f32-2968-4c42-bf21-42d56604222f","resolution":{"observed_at":"2026-08-08T00:38:39.843355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.846865Z","title":"Towards a standard, enterprise-relevant agentic ai benchmark: Lessons from 5.5 billion tokens’ worth of agentic ai evaluations, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.846865Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:159f5fe15e636af5decf62f70febe37b3d30d1baba3befb0b29277da4dc8dda1","observation_id":"b18454b0-3a85-4d93-b67d-a32adae0107e","resolution":{"observed_at":"2026-08-08T00:38:39.846865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16944","last_updated":"2025-05-22T17:31:10Z","snapshot_observed_at":"2026-08-07T20:49:20.049385Z","submitted_at":"2025-05-22T17:31:10Z","title":"AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16944","snapshot_observed_at":"2026-08-08T00:38:39.850531Z","title":"Agentif: Benchmarking instruction following of large language models in agentic scenarios, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.850531Z"},"links":{"cited_paper":"/paper/2505.16944","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:56859f6aba13fc2f9266937c49e07db6ce0f0e7e56e5960dd7754748ab1a6602","observation_id":"d5a82a04-907a-47fe-8923-de43d3b06e60","resolution":{"observed_at":"2026-08-08T00:38:39.850531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-08T00:38:39.853869Z","title":"Yu, and Ming Zhang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.853869Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:391fb3b0684eae4a2a1a3dfb03b1cd22bbae7631046b7b3dbbc6cff94408212c","observation_id":"c17779f0-e8b1-429b-b25c-d8a8748db55e","resolution":{"observed_at":"2026-08-08T00:38:39.853869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.857768Z","title":"Agentic large language models, a survey.Journal of Artificial Intelligence Research, 84, December 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.857768Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:764fa0ae66cf5cf57e093f6d5629aaacebc53f593cbc5467c2ce594dc2e586e1","observation_id":"af763340-8fdc-49c6-bc49-f9b398ef3b1b","resolution":{"observed_at":"2026-08-08T00:38:39.857768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.860692Z","title":"R., and Rajkumar Buyya","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.860692Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a01d3a1c6e433e1fae47c5ccc80c9f3ae6816a968ad3f7f5a17b8600c14f6149","observation_id":"a9a88cba-395c-40b6-bfda-b602e675250c","resolution":{"observed_at":"2026-08-08T00:38:39.860692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00835","last_updated":"2026-06-29T05:50:41Z","snapshot_observed_at":"2026-07-13T14:49:11.842114Z","submitted_at":"2026-04-01T12:46:51Z","title":"Agentic Tool Use in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.00835","snapshot_observed_at":"2026-08-08T00:38:39.863622Z","title":"Agentic tool use in large language models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.863622Z"},"links":{"cited_paper":"/paper/2604.00835","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:f9740d42772555fe279d3398d2015ac1261d779343848615c0299b9785080692","observation_id":"5ca62c7e-fade-44bd-af5e-a226af6e2507","resolution":{"observed_at":"2026-08-08T00:38:39.863622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.16330","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:42.956338Z","title":"Generalizability of large language model-based agents: A comprehensive survey, 2025","venue":null,"work_id":"cb8d58b0-870f-4e61-bbf9-bc7dbeb0d93d","year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.867530Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0dab377c18e4cbdb1c1c569e4dc662c7cd40d6dc6c1d28001d433e1c6c05082c","observation_id":"29f91669-f9f5-4973-8c39-286e5700e3cc","resolution":{"observed_at":"2026-08-08T00:38:43.020563Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-08T00:38:39.870399Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.870399Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:619b704f728d5455d4dce13c8b8475ac68fb496e48e8a94df50230febf34301a","observation_id":"5cffe755-aa90-45f8-bfb2-640b479be9a4","resolution":{"observed_at":"2026-08-08T00:38:39.870399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.902009Z","title":"Websailor- v2: Bridging the chasm to proprietary agents via synthetic data and scalable reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.902009Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:55b18290aaac2f0d9596b3e069724a25ce2db489d6c3022aafc5d660c671cc3d","observation_id":"3f073bc2-7c5e-45f0-9218-5d2ffd6d73f0","resolution":{"observed_at":"2026-08-08T00:38:39.902009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-08T00:38:39.938534Z","title":"Agent s2: A compositional generalist- specialist framework for computer use agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.938534Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:06748f4f112b206fba473e19b447b9a9c7eb0d0bef83f1750ba3a039f9d9301f","observation_id":"cf24886b-61fe-460d-a943-9432a6f366ca","resolution":{"observed_at":"2026-08-08T00:38:39.938534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-07T04:21:43.190472Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-08T00:38:40.047564Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.047564Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6837776b138352d3d59b62146d6d2e875992707fdaa3da1f824e8e3f1599736f","observation_id":"865fa3e2-22a1-493c-855b-afa97c994680","resolution":{"observed_at":"2026-08-08T00:38:40.047564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00822","last_updated":"2026-05-04T08:55:15Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-02-28T21:56:47Z","title":"ContextCov: Deriving and Enforcing Executable Constraints from Agent Instruction Files","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.00822","snapshot_observed_at":"2026-08-08T00:38:40.080419Z","title":"Contextcov: Deriving and enforcing executable constraints from agent instruction files, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.080419Z"},"links":{"cited_paper":"/paper/2603.00822","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:d8a1059355af8139966b3160171cb370092256c6c195d6d67b2485497c10207e","observation_id":"3d043e16-85dd-4da7-8293-2c9eaf78dd2c","resolution":{"observed_at":"2026-08-08T00:38:40.080419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.084781Z","title":"Richard Yu","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.084781Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8fd68448de1bd3534e096eed6e7b0291bf6c28629775560fc0a2b22465ac2c2a","observation_id":"81bd62d8-305c-4706-a15b-1c60c5f130a2","resolution":{"observed_at":"2026-08-08T00:38:40.084781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.088570Z","title":"Webresearcher: Unleashing unbounded reasoning capability in long-horizon agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.088570Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bba4fea5cf2d2a1348c2960731da47df942c0c914d0df5f94ed0598067923654","observation_id":"655f9331-19ef-43f9-b9d8-03656c02768f","resolution":{"observed_at":"2026-08-08T00:38:40.088570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.092093Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.092093Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c1edae5b256ed49c8958249b7281b053833213a9f9c347e5623abb1da59da7fd","observation_id":"6b0b7028-c3f7-4d49-86a0-25f0313d3a54","resolution":{"observed_at":"2026-08-08T00:38:40.092093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05930","last_updated":"2026-04-07T04:58:28Z","snapshot_observed_at":"2026-08-02T11:04:20.320561Z","submitted_at":"2026-01-09T16:44:17Z","title":"Can We Predict Before Executing Machine Learning Agents?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05930","snapshot_observed_at":"2026-08-08T00:38:40.097114Z","title":"Can we predict before executing machine learning agents?, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.097114Z"},"links":{"cited_paper":"/paper/2601.05930","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:d71fdc18a2eb638278899c1073cb94d08f42c9254f7c56274d930083d6895dc0","observation_id":"b298db28-2665-4ae2-a5b2-edf5ab7292b1","resolution":{"observed_at":"2026-08-08T00:38:40.097114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.100134Z","title":"Agentrl: Scaling agentic reinforcement learning with a multi-turn, multi-task framework, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.100134Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bc0dd9dc7a265ea9978609ab61f5797ea2c8ba6022cbf54d7d130f1e5a927836","observation_id":"387257a8-40de-4fa1-9bd2-a68d9170518b","resolution":{"observed_at":"2026-08-08T00:38:40.100134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18296","last_updated":"2026-04-21T06:22:33Z","snapshot_observed_at":"2026-07-06T22:43:02.453697Z","submitted_at":"2026-01-26T09:23:53Z","title":"Temp-R1: A Unified Autonomous Agent for Complex Temporal KGQA via Reverse Curriculum Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18296","snapshot_observed_at":"2026-08-08T00:38:40.103638Z","title":"Temp-r1: A unified autonomous agent for complex temporal kgqa via reverse curriculum reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.103638Z"},"links":{"cited_paper":"/paper/2601.18296","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1881036486aba8e0010874da7175af43052b963eeb2aa24ef34496b91b3bc9d0","observation_id":"bfeea1bf-f86d-4a35-8203-4b5a8f5fd69a","resolution":{"observed_at":"2026-08-08T00:38:40.103638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01952","last_updated":"2025-06-02T17:59:45Z","snapshot_observed_at":"2026-08-09T15:10:01.833506Z","submitted_at":"2025-06-02T17:59:45Z","title":"WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01952","snapshot_observed_at":"2026-08-08T00:38:40.106880Z","title":"Webchorearena: Evaluating web browsing agents on realistic tedious web tasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.106880Z"},"links":{"cited_paper":"/paper/2506.01952","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7ecb20eac25f274cd8514b4ad5a656ff0db85cca132fd710537854ef9a6a908d","observation_id":"7b4217aa-847f-446c-a9c1-e742a0132ef7","resolution":{"observed_at":"2026-08-08T00:38:40.106880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.29537","snapshot_observed_at":"2026-08-08T00:38:40.109954Z","title":"Osworld2.0: Benchmarkingcomputeruseagentsonlong-horizonreal-worldtasks,2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.109954Z"},"links":{"cited_paper":"/paper/2606.29537","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:dd8228e26a67aefed97033acfb31fc66de29b07412d04519a72372e96295ab72","observation_id":"2802c639-c1df-453e-ac9e-2422b95b71eb","resolution":{"observed_at":"2026-08-08T00:38:40.109954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27776","last_updated":"2026-04-30T12:13:27Z","snapshot_observed_at":"2026-08-02T19:49:15.389325Z","submitted_at":"2026-04-30T12:13:27Z","title":"WindowsWorld: A Process-Centric Benchmark of Autonomous GUI Agents in Professional Cross-Application Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27776","snapshot_observed_at":"2026-08-08T00:38:40.113594Z","title":"Windowsworld: A process-centric benchmark of autonomous gui agents in professional cross-application environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.113594Z"},"links":{"cited_paper":"/paper/2604.27776","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3f7773726eaf69d1b80dad79b69c77da555bcda2251e55f442457401f6d08e2a","observation_id":"3a38da17-07b0-4e86-b54e-449b0bd38431","resolution":{"observed_at":"2026-08-08T00:38:40.113594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.117606Z","title":"Mobileworld: Benchmarking autonomous mobile agents in agent-user interactive and mcp-augmented environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.117606Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8b99870a8ef5103be65ba8897fbd548c2e68ee7a514cbfec26816d20f9c4bd4b","observation_id":"68f7092e-8cb3-49aa-b477-833ea3b15112","resolution":{"observed_at":"2026-08-08T00:38:40.117606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-08-06T21:34:46.041153Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-08-08T00:38:40.120729Z","title":"Swe-bench pro: Can ai agents solve long-horizon software engineering tasks?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.120729Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7a1e61c42ae646b3f7a834c473b274f5f908d1dc1724a8002d524682d200dc5f","observation_id":"0a31e3bf-61bd-491d-9f4e-46bf795551a7","resolution":{"observed_at":"2026-08-08T00:38:40.120729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.124583Z","title":"Deepswe v1.1: a cleaner, more reproducible benchmark for frontier coding agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.124583Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:191dcb1d61a755c4186ce39fb465116a0fa3f918ea50326736ab7ef5aad1306b","observation_id":"7d0f4a85-2cfa-41ce-b7e0-7730f6bb9fd0","resolution":{"observed_at":"2026-08-08T00:38:40.124583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-08T00:38:40.149028Z","title":"Browsecomp: A simple yet challenging benchmark for browsing agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.149028Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:13bb2145764a21db0d72edfc1c660b8604be4b22c50ded026035e6b4a6546aef","observation_id":"8aa09c77-9568-4fdf-af64-39614a15442a","resolution":{"observed_at":"2026-08-08T00:38:40.149028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11763","last_updated":"2025-06-13T13:17:32Z","snapshot_observed_at":"2026-08-07T14:15:18.269910Z","submitted_at":"2025-06-13T13:17:32Z","title":"DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11763","snapshot_observed_at":"2026-08-08T00:38:40.206505Z","title":"Deepresearch bench: A comprehensive benchmark for deep research agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.206505Z"},"links":{"cited_paper":"/paper/2506.11763","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:76ff1b05ae93418616897817d6c74db266c15fb253ce7433943b33686126995a","observation_id":"d66e2163-c5ef-42b6-bed2-5b6a669c5d2a","resolution":{"observed_at":"2026-08-08T00:38:40.206505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-08T00:38:40.219981Z","title":"URLhttps://arxiv.org/abs/2506.07982","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.219981Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6af9e3715652eb9fca4519ec37b891673d887982ba5a0e241ad509f93175ea04","observation_id":"c34d5790-b6ef-4557-919b-873328926908","resolution":{"observed_at":"2026-08-08T00:38:40.219981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.335311Z","title":"A benchmark of expert-level academic questions to assess ai capabilities","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.335311Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:63296b4e504cdcd33d4125dff2230407dca34119687a6a7ba08139cb5b96abad","observation_id":"a3e02029-5731-4636-910e-9bc8e3957e25","resolution":{"observed_at":"2026-08-08T00:38:40.335311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.340122Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.340122Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1b6519aec8fb229bbe50e7361060865dec6a8af597c5321db2c60f72f233a9d0","observation_id":"268b08bc-8b4b-4a9a-b142-51a3f9a85af7","resolution":{"observed_at":"2026-08-08T00:38:40.340122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.20683","last_updated":"2026-06-14T05:40:16Z","snapshot_observed_at":"2026-08-09T13:51:27.423274Z","submitted_at":"2026-06-14T05:40:16Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","version":1},"cited_work":{"arxiv_id":"2606.20683","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.20683","snapshot_observed_at":"2026-08-08T00:38:42.092078Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","venue":"cs.AI","work_id":"e9c46fad-a365-4b55-bb6c-95eb025c6990","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.348996Z"},"links":{"cited_paper":"/paper/2606.20683","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0b66e4cddc71462cb68e6c4e761d21406a2a1d84d56d5c6b53f06ea0d52c4b52","observation_id":"203d08d0-d374-473f-8865-ba247b5e68cf","resolution":{"observed_at":"2026-08-08T00:38:42.189338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.353053Z","title":"The tool decathlon: Benchmarking language agents for diverse, realistic, and long-horizon task execution, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.353053Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:25011fc8403406ec12392cf9899342b5dd9d2c59192ef48ed5669fe2ad7352f7","observation_id":"3c849c9f-a401-4be6-aa88-f4039a8a1463","resolution":{"observed_at":"2026-08-08T00:38:40.353053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.356344Z","title":"Lifesim: Long-horizon user life simulator for personalized assistant evaluation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.356344Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3937a09672a0519c0b7d97919eb4969afc7f62889fdbad3819c12294ca56c6ed","observation_id":"d98deaf1-c3c4-4a53-b4f5-5e39660c9e74","resolution":{"observed_at":"2026-08-08T00:38:40.356344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-08-08T00:38:40.359888Z","title":"Agencybench: Benchmarking the frontiers of autonomous agents in 1m-token real-world contexts, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.359888Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b9e13ec05635ea4e877be6a07e2fe75a6b0dbf998a65e9156e60379a0e082e31","observation_id":"53dcfb93-67d9-4538-a10e-0d52a4499229","resolution":{"observed_at":"2026-08-08T00:38:40.359888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.05843","last_updated":"2026-06-04T17:59:52Z","snapshot_observed_at":"2026-08-08T09:55:42.108474Z","submitted_at":"2026-02-05T16:31:43Z","title":"OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.05843","snapshot_observed_at":"2026-08-08T00:38:40.363598Z","title":"Odysseyarena: Benchmarking large language models for long-horizon, active and inductive interactions, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.363598Z"},"links":{"cited_paper":"/paper/2602.05843","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:095fa38e1c1b599e55ab16f128f90619070e1bc0b7912fa0b4903d77087a254d","observation_id":"7ec780ab-da57-4e1c-ae97-bc8fa791f9dd","resolution":{"observed_at":"2026-08-08T00:38:40.363598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09426","last_updated":"2026-07-06T14:25:02Z","snapshot_observed_at":"2026-08-07T06:06:28.992628Z","submitted_at":"2026-06-08T12:39:23Z","title":"WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces","version":3},"cited_work":{"arxiv_id":"2606.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09426","snapshot_observed_at":"2026-08-08T00:38:41.902147Z","title":"WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces","venue":"cs.AI","work_id":"843f97fc-5ec4-462b-ab23-8a365de0fb3c","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.399733Z"},"links":{"cited_paper":"/paper/2606.09426","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7484ac0de9fe8c4225092c080337759becc77b553d975f0d28f137c713368bd9","observation_id":"4a6e44f2-f6d7-41ec-bee7-50322da1912c","resolution":{"observed_at":"2026-08-08T00:38:41.905661Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03596","last_updated":"2026-05-14T13:14:02Z","snapshot_observed_at":"2026-07-06T23:16:30.147006Z","submitted_at":"2026-05-05T10:17:06Z","title":"Workspace-Bench 1.0: Benchmarking AI Agents on Workspace Tasks with Large-Scale File Dependencies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03596","snapshot_observed_at":"2026-08-08T00:38:40.470942Z","title":"Workspace-bench 1.0: Benchmarking ai agents on workspace tasks with large-scale file dependencies, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.470942Z"},"links":{"cited_paper":"/paper/2605.03596","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b41ee386b321d9becc2b17e00284241a6ad21774cf01b085877941c3291b7efe","observation_id":"c1fc6ddc-1c45-450d-9aa5-19ec2e4f7f80","resolution":{"observed_at":"2026-08-08T00:38:40.470942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-08T00:38:40.592157Z","title":"Merrill et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.592157Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8235bc0e4e30395a61c272649935402071b5763342690fb22cf2e5e65e978fb0","observation_id":"9901becd-2d3f-41ec-8637-a99890d60e5e","resolution":{"observed_at":"2026-08-08T00:38:40.592157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.669198Z","title":"Deepplanning: Benchmarking long-horizon agentic planning with verifiable constraints, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.669198Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:f06a10b147d8a6686894e15151a8118c169c1aa7c941e2cba035097dee4baf71","observation_id":"f24011ba-da24-470b-8e67-90a258c4af05","resolution":{"observed_at":"2026-08-08T00:38:40.669198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.697620Z","title":"Trip-bench: A benchmark for long-horizon interactive agents in real-world scenarios, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.697620Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:2602be027b3a4dfbeac83b5a6a9d1a1e8535a08e7f6bc1dc33d68a258c1eddc6","observation_id":"df25f9c8-ea83-4a70-90e9-78f5d73ccddc","resolution":{"observed_at":"2026-08-08T00:38:40.697620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22388","last_updated":"2026-06-21T08:29:12Z","snapshot_observed_at":"2026-08-06T12:43:52.203315Z","submitted_at":"2026-06-21T08:29:12Z","title":"PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems","version":1},"cited_work":{"arxiv_id":"2606.22388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.22388","snapshot_observed_at":"2026-08-08T00:38:41.542251Z","title":"PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems","venue":"cs.AI","work_id":"87c21b6b-61bd-4d19-8df9-088f9562ede8","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.700661Z"},"links":{"cited_paper":"/paper/2606.22388","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c6432b6cdb52ff1dc5a2b6394a3ec7d0a3bcf621245cbf38871cc75eff971a89","observation_id":"47a96727-012b-4672-81f0-684fa8ca325a","resolution":{"observed_at":"2026-08-08T00:38:41.635861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-08-09T05:33:23.673561Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06008","snapshot_observed_at":"2026-08-08T00:38:40.704777Z","title":"Polyworkbench: Benchmarking multilingual long-horizon llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.704777Z"},"links":{"cited_paper":"/paper/2607.06008","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ee5877bc06eec0f9bae5e4e14e62a73201204099d4dbc7ec3a9bcd652afcf725","observation_id":"0ad937e0-79f6-4eb7-8300-9d6e28168236","resolution":{"observed_at":"2026-08-08T00:38:40.704777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.707865Z","title":"Retailbench: Evaluating long-horizon autonomous decision- making and strategy stability of llm agents in realistic retail environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.707865Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:288a98321008b9e94ff12f69002a413fc20302409dbb4e39c58d40c2ce1ae8d6","observation_id":"08dbc045-5f56-4fe4-b789-f952dc0ef365","resolution":{"observed_at":"2026-08-08T00:38:40.707865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13357","last_updated":"2026-05-13T11:14:59Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:14:59Z","title":"AI Harness Engineering: A Runtime Substrate for Foundation-Model Software Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13357","snapshot_observed_at":"2026-08-08T00:38:40.711155Z","title":"Ai harness engineering: A runtime substrate for foundation-model software agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.711155Z"},"links":{"cited_paper":"/paper/2605.13357","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ce4ce4429a4ddb42168e076c97c5add12d900479e4fdc56fea7030d3dbfe02b9","observation_id":"47343d4c-28c5-40e3-acf3-d780218c9821","resolution":{"observed_at":"2026-08-08T00:38:40.711155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11224","last_updated":"2026-04-28T16:08:25Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T13:31:18Z","title":"Agent-Diff: Benchmarking LLM Agents on Enterprise API Tasks via Code Execution with State-Diff-Based Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.11224","snapshot_observed_at":"2026-08-08T00:38:40.714960Z","title":"Pysklo, Artem Zhuravel, and Patrick D","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.714960Z"},"links":{"cited_paper":"/paper/2602.11224","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3d6c38f440fbac21040cfe9f0a7f90e1a01c3f3f58fdc915189a16ea79dd4715","observation_id":"c0cf8fa8-f6e9-4792-b390-95e0772e0ed0","resolution":{"observed_at":"2026-08-08T00:38:40.714960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-08T00:38:40.718865Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.718865Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:daa8402b3e3cf89a00698504594be24b8def980a7df1c7747e38031128449a7b","observation_id":"d6a105ae-591f-4c60-945c-7ad33238ce47","resolution":{"observed_at":"2026-08-08T00:38:40.718865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.722833Z","title":"Scaling long-horizon llm agent via context-folding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.722833Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3391feb299f0bf22ff9367e352c689f8fb80cd9696596fa7044c8394e819128b","observation_id":"5cb48ad3-3556-4615-b42d-d3559220687d","resolution":{"observed_at":"2026-08-08T00:38:40.722833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.727147Z","title":"Dynamiclongcontextreasoningovercompressed memory via end-to-end reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.727147Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:39d1c567c523c716f86ef522f72bd682c03ff92ab5a4ac27860ef7d4d9b53a0d","observation_id":"bd3c1f6c-4d0d-4175-ac9e-c532af2c40b0","resolution":{"observed_at":"2026-08-08T00:38:40.727147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.730159Z","title":"A-mem: Agentic memory for llm agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.730159Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:037168b45167dfa503eaa9100551942a5670c7172420aa462bfcf915eaca8948","observation_id":"c89d41b4-58da-4db5-97fa-f9eb262147b0","resolution":{"observed_at":"2026-08-08T00:38:40.730159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.738178Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.738178Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ebec73476c0f32121f53c015696b4618f9680fef170806dcf050721fb9145aa2","observation_id":"db1b0779-bc4e-489f-b65a-be78e132329b","resolution":{"observed_at":"2026-08-08T00:38:40.738178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12635","last_updated":"2026-05-07T13:18:53Z","snapshot_observed_at":"2026-08-06T02:47:17.802553Z","submitted_at":"2025-10-14T15:29:57Z","title":"Memory as Action: Autonomous Context Curation for Long-Horizon Agentic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.12635","snapshot_observed_at":"2026-08-08T00:38:40.741477Z","title":"Memory as action: Autonomous context curation for long-horizon agentic tasks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.741477Z"},"links":{"cited_paper":"/paper/2510.12635","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:efd6985dbddb26c05c2a611a8c405a798def8e5ec576780ec4ac1536e1d96625","observation_id":"5e3d4889-c979-4009-beec-b25eb7c71a62","resolution":{"observed_at":"2026-08-08T00:38:40.741477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.745249Z","title":"Context collapse in long-horizon agents: Benchmarking hierarchical memory against rag and summarization","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.745249Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7a6ddfd75ecea579d42cf55bec68123dffe783e3e1144ae1f2d32d2583d1d23b","observation_id":"ef6ecf67-9e13-43a0-8123-48e7ec1d674b","resolution":{"observed_at":"2026-08-08T00:38:40.745249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.748731Z","title":"Infiagent: An infinite-horizon framework for general-purpose autonomous agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.748731Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0a49215a0f37ff5a4448d3100fbac9cb61b5acb56ae6588533663033f626326b","observation_id":"6da74ca4-9f3a-4be0-afc6-0177fe3afadf","resolution":{"observed_at":"2026-08-08T00:38:40.748731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11978","last_updated":"2026-04-13T19:11:42Z","snapshot_observed_at":"2026-08-02T21:24:34.902135Z","submitted_at":"2026-04-13T19:11:42Z","title":"The Long-Horizon Task Mirage? Diagnosing Where and Why Agentic Systems Break","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11978","snapshot_observed_at":"2026-08-08T00:38:40.752080Z","title":"The long-horizon task mirage? diagnosing where and why agentic systems break, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.752080Z"},"links":{"cited_paper":"/paper/2604.11978","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:9a64257dea5598521aab78c0c25a1f061047d76b4092fccdef5c2ace81c714ef","observation_id":"a17159c5-4f31-4c8a-a0a3-7781af5cb799","resolution":{"observed_at":"2026-08-08T00:38:40.752080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.755570Z","title":"Agentlab: Benchmarking llm agents against long-horizon attacks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.755570Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:4b633d7b6bcd8066d2fefd5aab36889bbc1e8c8aecdd7b4a2d166d5fde99f112","observation_id":"aacf0d7f-8610-4d6a-aa59-8e74e3747ef4","resolution":{"observed_at":"2026-08-08T00:38:40.755570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.00933","snapshot_observed_at":"2026-08-08T00:38:40.759145Z","title":"Mcp-atlas: A large-scale benchmark for tool-use competency with real mcp servers, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.759145Z"},"links":{"cited_paper":"/paper/2602.00933","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:09842113823e4797354c79962bd62f0ccdcac0cae75ab062a7020983830f06b0","observation_id":"10687782-3d25-408d-b62f-cff958cddc20","resolution":{"observed_at":"2026-08-08T00:38:40.759145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.763793Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.763793Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:03b33f0d3d843e43c4c189a02574ef4cb1ce5905d4dd04b0db4b04c7b01d5901","observation_id":"52a31bb2-1512-40b2-bea9-ebf41f2f21d1","resolution":{"observed_at":"2026-08-08T00:38:40.763793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-08T00:38:40.767183Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.767183Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bd9adc4e00b8b965ab654741b90276ba5d22b75b06c88801f5219e4fcb0538a5","observation_id":"1fbee9de-cea8-4740-9111-7e09ecb3135d","resolution":{"observed_at":"2026-08-08T00:38:40.767183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-08T00:38:40.782453Z","title":"name\": \"search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.782453Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c7a7dfe82c032455b028100446f9ba93c6345bbcc2766f73be62286673d9bf92","observation_id":"310dea28-b87d-4994-b95e-8ae03a7fa0f3","resolution":{"observed_at":"2026-08-08T00:38:40.782453Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.851366Z","title":"If the task can be completed in one step, output 1 subtask","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.851366Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fe7fd4c90d67d13e8cea989c4e61879d2ddacc225ad0235b14eb47e9390d6299","observation_id":"e6fc1301-ad31-4cb9-b757-64395354fb34","resolution":{"observed_at":"2026-08-08T00:38:40.851366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.928825Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.928825Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:86f3b03b30f4a65ed8469f3d20ed526139cf3edbe9f7443478c73f6ea7e77ef0","observation_id":"6e9cfcfc-f7d5-4ec6-b543-6eaf8a40296a","resolution":{"observed_at":"2026-08-08T00:38:40.928825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.992393Z","title":"subtasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.992393Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:f8ab440b4f217deff31b48bc845e6d8ed58e06ed588d1c41a373ccbe8976b368","observation_id":"281175f3-e06d-4790-975a-512a729dc441","resolution":{"observed_at":"2026-08-08T00:38:40.992393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.523757Z","title":null,"venue":null,"work_id":"c5aaacc3-7985-4078-b2de-989d2ad943fd","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.995934Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:dc4ee43a52bd3da6b926c4dbfc1062fe88ca260900257196211097ad9e8c2601","observation_id":"059ff350-e17a-483f-b527-49561e055522","resolution":{"observed_at":"2026-08-08T00:38:44.526473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.401053Z","title":null,"venue":null,"work_id":"98dce1d7-3206-4f2d-b3af-4f6fe5e91b89","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.000052Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c061ed87242fd2b8332c68f64a399ab626eb73f0f0652b3b20e325b91f791521","observation_id":"51764e41-2616-4617-a3db-8f38403728ef","resolution":{"observed_at":"2026-08-08T00:38:44.516914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.203556Z","title":null,"venue":null,"work_id":"c0b457fc-5732-4bb3-9ccb-976a386df052","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.004395Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:e43726df75a4b216674f33b082375e4db3ecd39c63a78639a41dfd09766b36c8","observation_id":"3b3e0d80-42ec-4576-9b59-d57e5b5b01bb","resolution":{"observed_at":"2026-08-08T00:38:44.298154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.164375Z","title":null,"venue":null,"work_id":"44cb9482-4701-45d6-ae1c-660c1fb7d54d","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.007928Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:9e70fe38f97c1fe38e3c804cf935ba83b747bc7257b9deb4c8ed5fb7f409769e","observation_id":"83cc229e-32bf-4b5d-b9ed-76fdafc9dc57","resolution":{"observed_at":"2026-08-08T00:38:44.167351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.154070Z","title":null,"venue":null,"work_id":"34adb79a-d10e-4117-82df-ca60bbcddeca","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.010610Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b7e10af7cc1ecd56d01976f8ccef8d36af0a5b09bbbed02516cd3e54844d48d3","observation_id":"b0b40ca6-51d6-449d-b64c-685fb90e87d9","resolution":{"observed_at":"2026-08-08T00:38:44.157646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.143983Z","title":null,"venue":null,"work_id":"f4bcd9ad-e1ae-428c-8dd1-ecba339f838d","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.014754Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:75498b0a456e82788b5068b29476d34017b3c1cbb6db119216f8fcf411fbd11c","observation_id":"e13a73bf-961f-4ead-a9b4-a05578089dc5","resolution":{"observed_at":"2026-08-08T00:38:44.147112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.134077Z","title":null,"venue":null,"work_id":"cd7a72b7-89a2-4c0c-a508-9fd91634c256","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.018197Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:2e4584d9778473a4c5c7767c1f2527bd9a82eb311c78eacfa785fdb28a452b57","observation_id":"218a2744-5a95-460a-8cbf-fefeb43e1492","resolution":{"observed_at":"2026-08-08T00:38:44.137661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.123261Z","title":"completed","venue":null,"work_id":"553a4668-3770-4a2e-8fde-fbf5b4637855","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.021030Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:408dbfb4b4da19207976d6fe18bbc394462785062c9c13614f3394e5e09fbf0b","observation_id":"5b084cb2-12b0-4522-8213-cc8de69e7d78","resolution":{"observed_at":"2026-08-08T00:38:44.127434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T00:38:40.343961Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.343961Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:edf6dea0fedc135a4458124378fb24092e1d0433027f88d15d48c1ecece7685e","observation_id":"91d19464-b7d6-4f6b-af82-eb04fb1b96d8","resolution":{"observed_at":"2026-08-08T00:38:40.343961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-08T00:38:40.733515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.733515Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ac7b2baaefda6b18266a49e7fbf834a98a27942f1e91fe7be3310601df960856","observation_id":"94202e51-c293-48ff-a251-74c4118bea79","resolution":{"observed_at":"2026-08-08T00:38:40.733515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.09822","last_updated":"2026-01-19T19:10:53Z","snapshot_observed_at":"2026-08-07T09:19:36.604857Z","submitted_at":"2026-01-14T19:28:30Z","title":"LLM-Based Agentic Systems for Software Engineering: Challenges and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.09822","snapshot_observed_at":"2026-08-08T00:38:39.545367Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.545367Z"},"links":{"cited_paper":"/paper/2601.09822","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1c1ce993dd8fee5fb9429db59574ee00f3612244749426b6bd407f3b9e3e8b13","observation_id":"1cd68544-b06e-4784-8e3e-bd694f19e3cd","resolution":{"observed_at":"2026-08-08T00:38:39.545367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T09:37:11.292475Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":85,"verified_exact":8,"verified_fuzzy":1},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:2608.05013."}