{"as_of":"2026-08-19T19:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:725158539e203ac408dd87d60d0dfd7116939fbd255b0125c0399769f1708121","coverage":[{"denominator":142,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:01:35.758160Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06663/citation-record","integrity":"/paper/2608.06663/integrity","json":"/paper/2608.06663/citation-record.json","paper":"/paper/2608.06663"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-16T12:48:53.169158Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-10T23:01:35.467237Z","title":"Ziegler, Elizabeth Barnes, and Lawrence Chan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.467237Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:a074109b3ee5e58d49d126a1734565b205d8fe892d95b48c7e1d43dade140036","observation_id":"4d91c039-ad49-4de0-8523-8e0ec040dd6f","resolution":{"observed_at":"2026-08-10T23:01:35.467237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-08-13T03:11:04.678829Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-10T23:01:35.471245Z","title":"Large language models cannot self-correct reasoning yet, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.471245Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:714764e190c4cde10061ea374f741cb625033a1610dd7a2602a0a817450e622c","observation_id":"09b0131f-8e67-4138-8ced-bd0416dd7465","resolution":{"observed_at":"2026-08-10T23:01:35.471245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15223","last_updated":"2025-09-09T02:59:54Z","snapshot_observed_at":"2026-08-16T15:12:02.468501Z","submitted_at":"2025-03-19T14:02:21Z","title":"Are \"Solved Issues\" in SWE-bench Really Solved Correctly? An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15223","snapshot_observed_at":"2026-08-10T23:01:35.474552Z","title":"Are ”solved issues” in SWE-bench really solved correctly? an empirical study, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.474552Z"},"links":{"cited_paper":"/paper/2503.15223","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0175738bac45a482ae014734ccd9cc5b015946928d4143a4ba6364366dc58475","observation_id":"9a2f02d2-5ee1-4303-83f9-b10ec55959bb","resolution":{"observed_at":"2026-08-10T23:01:35.474552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.477854Z","title":"The SWE-bench illusion: When state-of-the-art LLMs remember instead of reason, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.477854Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2d0bbfc54eaf9251d9cb0e509c1703c40c051312d48f06e3c999cb6bba177f5d","observation_id":"c637a348-385d-4bdf-9277-48b0c9453c64","resolution":{"observed_at":"2026-08-10T23:01:35.477854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02825","last_updated":"2025-08-07T06:58:08Z","snapshot_observed_at":"2026-08-17T22:49:53.742436Z","submitted_at":"2025-07-03T17:35:31Z","title":"Establishing Best Practices for Building Rigorous Agentic Benchmarks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02825","snapshot_observed_at":"2026-08-10T23:01:35.480747Z","title":"Establishing best practices for building rigorous agentic benchmarks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.480747Z"},"links":{"cited_paper":"/paper/2507.02825","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9a1c4fe9b2efffb29111b2257c0a5bf46d59578e3c26657b523ea084d7b7f1e7","observation_id":"0cf16eda-132d-4502-aa08-c8cad43c3488","resolution":{"observed_at":"2026-08-10T23:01:35.480747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-08-15T04:53:46.192738Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-10T23:01:35.483951Z","title":"Understanding the planning of LLM agents: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.483951Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:03f2ca01b62e24747808c459faeb93184790bfd859f53b626bd8686bbc43ea27","observation_id":"79e13dfe-c8ed-4052-a90e-8d56c9c6b9c3","resolution":{"observed_at":"2026-08-10T23:01:35.483951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.487410Z","title":"LLMs as planning formalizers: A survey for leveraging large language models to construct automated planning models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.487410Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:32958aebe8d51a09aad178ad7456899eda7141f49cf7fb0ace9cac188f9635b1","observation_id":"9b045725-a423-42aa-9b11-3b0314362d1d","resolution":{"observed_at":"2026-08-10T23:01:35.487410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13501","snapshot_observed_at":"2026-08-10T23:01:35.490120Z","title":"A survey on the memory mechanism of large language model based agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.490120Z"},"links":{"cited_paper":"/paper/2404.13501","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b9218b17c398554f2852663505f792f243fc39395b834768dcb761e14fce46b9","observation_id":"49569b95-0a7b-4b37-888f-b7de3ab610f8","resolution":{"observed_at":"2026-08-10T23:01:35.490120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.493279Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.493279Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:a9e2a3ce5aec34007193fdf6386242694be83713f5216e83d492ca0c0261137c","observation_id":"5d276526-6a02-481d-8c49-59bec7991584","resolution":{"observed_at":"2026-08-10T23:01:35.493279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-08-17T10:40:45.253009Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18279","snapshot_observed_at":"2026-08-10T23:01:35.495876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.495876Z"},"links":{"cited_paper":"/paper/2411.18279","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c3d644cc21a5771fc53e4c3f7b398a74aff4d98d88999c4555082a274e74560f","observation_id":"05fff376-c46b-40a1-ac08-6742aabd3304","resolution":{"observed_at":"2026-08-10T23:01:35.495876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.498394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.498394Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:16505455fe31dd90e821e76148a11417350906fb8aa14a995f4742f9904a0add","observation_id":"e3c4aaa9-5303-41b1-9df1-04d0f9fb8a74","resolution":{"observed_at":"2026-08-10T23:01:35.498394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13865","last_updated":"2025-06-04T17:29:13Z","snapshot_observed_at":"2026-08-16T12:46:11.727073Z","submitted_at":"2025-03-27T17:58:31Z","title":"A Survey on (M)LLM-Based GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13865","snapshot_observed_at":"2026-08-10T23:01:35.501038Z","title":"A survey on (m)LLM-based GUI agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.501038Z"},"links":{"cited_paper":"/paper/2504.13865","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:be39f0acecbba39b24d4c987deaf4ed475a062027614c0b139f4a3a19e953546","observation_id":"5aa6c2f5-88bd-4b5d-8583-c74358440bb0","resolution":{"observed_at":"2026-08-10T23:01:35.501038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.503946Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.503946Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:cdba8534e148dc09a9f58fcc09eefa06cacf429a10093622483d158e084c95bf","observation_id":"79898d1e-c85f-4e7c-ac4c-01028f7fb264","resolution":{"observed_at":"2026-08-10T23:01:35.503946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01297","last_updated":"2024-12-03T19:14:06Z","snapshot_observed_at":"2026-08-18T10:44:14.134406Z","submitted_at":"2024-06-03T13:05:46Z","title":"When Can LLMs Actually Correct Their Own Mistakes? A Critical Survey of Self-Correction of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01297","snapshot_observed_at":"2026-08-10T23:01:35.506528Z","title":"When can LLMs actually correct their own mistakes? a critical survey of self-correction of LLMs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.506528Z"},"links":{"cited_paper":"/paper/2406.01297","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2bbe05e92f2710d8ad6d62e1df7595356c418b06b90691079835ffdd3294dc29","observation_id":"416228f4-611e-4317-816d-b6627376714b","resolution":{"observed_at":"2026-08-10T23:01:35.506528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-08-12T14:05:29.940431Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.07663","snapshot_observed_at":"2026-08-10T23:01:35.509270Z","title":"Recursive self-improvement in ai: From bounded self-refinement to autonomous research loops, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.509270Z"},"links":{"cited_paper":"/paper/2607.07663","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d9a7abdce67c8b4882feb1e278e7bba39d8c0166c98b700a80a8fa617b379ba7","observation_id":"495abdf0-ba25-461b-9bfa-39dccef6eade","resolution":{"observed_at":"2026-08-10T23:01:35.509270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.512030Z","title":"Sutton, Doina Precup, and Satinder Singh","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.512030Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ad329cfa8d4da827a3a1ec8c0c9ca625c1dc95f99cb53634627aa7a3b2be2193","observation_id":"7611fd6d-329b-4548-a39b-882f21ab0d74","resolution":{"observed_at":"2026-08-10T23:01:35.512030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.514691Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.514691Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:682043e3db1328cf5037b77588e95a34e2010eca169a1143d5e4547aaac04ef2","observation_id":"c59fb5cb-4685-4af3-ad59-040a0e204946","resolution":{"observed_at":"2026-08-10T23:01:35.514691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11477","last_updated":"2023-09-27T07:29:44Z","snapshot_observed_at":"2026-08-12T21:21:48.006892Z","submitted_at":"2023-04-22T20:34:03Z","title":"LLM+P: Empowering Large Language Models with Optimal Planning Proficiency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11477","snapshot_observed_at":"2026-08-10T23:01:35.517185Z","title":"LLM+P: Empowering large language models with optimal planning proficiency, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.517185Z"},"links":{"cited_paper":"/paper/2304.11477","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:05c59547f86ef78895b58e0efe4b62dee47de04dd7176e7c36fa11a1ff4c3bfc","observation_id":"8f23b146-909e-479d-ab6b-2f57f65a232f","resolution":{"observed_at":"2026-08-10T23:01:35.517185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-10T23:01:35.520046Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.520046Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:652b1ca3a211736dd9242a3335d54fa8f1fd5091287a357511ee3f6122349fff","observation_id":"0bc5a8c1-5005-47b7-a175-aabf23646121","resolution":{"observed_at":"2026-08-10T23:01:35.520046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04272","last_updated":"2026-04-13T04:41:02Z","snapshot_observed_at":"2026-08-14T03:34:15.370681Z","submitted_at":"2024-12-05T15:54:16Z","title":"PoTable: Towards Systematic Thinking via Plan-then-Execute Stage Reasoning on Tables","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04272","snapshot_observed_at":"2026-08-10T23:01:35.522839Z","title":"PoTable: Towards systematic thinking via plan-then-execute stage reasoning on tables, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.522839Z"},"links":{"cited_paper":"/paper/2412.04272","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:cb2cf1e02e4739ac16677b2888342671ca6c0d866e5b32a6ab0bdd19da879bbd","observation_id":"805e7fd4-dd42-47f6-b2ea-372260a6d7cd","resolution":{"observed_at":"2026-08-10T23:01:35.522839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14212","last_updated":"2024-12-18T08:47:17Z","snapshot_observed_at":"2026-08-19T12:43:58.108116Z","submitted_at":"2024-12-18T08:47:17Z","title":"Tree-of-Code: A Hybrid Approach for Robust Complex Task Planning and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14212","snapshot_observed_at":"2026-08-10T23:01:35.525639Z","title":"Tree-of-code: A hybrid approach for robust complex task planning and execution, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.525639Z"},"links":{"cited_paper":"/paper/2412.14212","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:39d21dcd95c2f60160a8c44b73475a5234ac80921a9b6dd83cdd1e897cedd849","observation_id":"1debe8c0-46e5-41b1-90a9-54954f4e4cb5","resolution":{"observed_at":"2026-08-10T23:01:35.525639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09572","last_updated":"2025-04-22T17:56:22Z","snapshot_observed_at":"2026-08-14T20:53:01.569151Z","submitted_at":"2025-03-12T17:40:52Z","title":"Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09572","snapshot_observed_at":"2026-08-10T23:01:35.528245Z","title":"Furuta, Gopala K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.528245Z"},"links":{"cited_paper":"/paper/2503.09572","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0697f674e0bdd08acc88a43b6f9b4431a198c4eeb569d29be2b3d60fdde0ec5d","observation_id":"09e9ca7e-7693-4537-99a7-81361682208e","resolution":{"observed_at":"2026-08-10T23:01:35.528245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11225","last_updated":"2026-05-11T20:43:20Z","snapshot_observed_at":"2026-08-14T15:02:43.663801Z","submitted_at":"2026-05-11T20:43:20Z","title":"PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11225","snapshot_observed_at":"2026-08-10T23:01:35.531161Z","title":"PIVOT: Bridging planning and execution in LLM agents via trajectory refinement, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.531161Z"},"links":{"cited_paper":"/paper/2605.11225","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4801339c1ed0a2556d10a9f861ff2c5659ee7cb31fb91ca4702ed8bec24284f7","observation_id":"0e3d99fc-a984-40f2-af62-86f7a7d69fcc","resolution":{"observed_at":"2026-08-10T23:01:35.531161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21516","last_updated":"2026-05-15T12:47:13Z","snapshot_observed_at":"2026-08-17T06:55:41.301663Z","submitted_at":"2026-05-15T12:47:13Z","title":"Harnesses for Inference-Time Alignment over Execution Trajectories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21516","snapshot_observed_at":"2026-08-10T23:01:35.533892Z","title":"Harnesses for inference-time alignment over execution trajectories, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.533892Z"},"links":{"cited_paper":"/paper/2605.21516","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:fb04169b0ba8cc5270e30fc476108da54e9f4d2f7a290b703db8ed81185b4cf1","observation_id":"80a59d1c-9c40-4e89-9904-6c726f451504","resolution":{"observed_at":"2026-08-10T23:01:35.533892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08702","last_updated":"2024-10-03T16:11:43Z","snapshot_observed_at":"2026-08-16T14:18:55.368710Z","submitted_at":"2024-02-13T16:38:01Z","title":"PRompt Optimization in Multi-Step Tasks (PROMST): Integrating Human Feedback and Heuristic-based Sampling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08702","snapshot_observed_at":"2026-08-10T23:01:35.536440Z","title":"PRompt optimization in multi-step tasks (PROMST): Integrating human feedback and heuristic-based sampling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.536440Z"},"links":{"cited_paper":"/paper/2402.08702","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:af049a27a4fd5569d796b41a3d2c6dfc7f65df9a81d040b6bd229a2d54ccf0c9","observation_id":"e5b00e30-16ae-4bab-9c74-c69743b834ed","resolution":{"observed_at":"2026-08-10T23:01:35.536440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06951","last_updated":"2025-05-29T17:37:26Z","snapshot_observed_at":"2026-08-17T00:41:55.843348Z","submitted_at":"2025-03-10T05:56:46Z","title":"ReAgent: Reversible Multi-Agent Reasoning for Knowledge-Enhanced Multi-Hop QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06951","snapshot_observed_at":"2026-08-10T23:01:35.539470Z","title":"ReAgent: Reversible multi-agent reasoning for knowledge-enhanced multi-hop QA, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.539470Z"},"links":{"cited_paper":"/paper/2503.06951","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:261a1801fa4d4fb0a62be85991274464ab0b01b57621edf9d2e95f6fbd1959ad","observation_id":"d32cb368-2985-4bdb-ba00-13b110e59b19","resolution":{"observed_at":"2026-08-10T23:01:35.539470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08477","last_updated":"2026-05-08T20:51:42Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T20:51:42Z","title":"Do Agents Need to Plan Step-by-Step? Rethinking Planning Horizon in Data-Centric Tool Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08477","snapshot_observed_at":"2026-08-10T23:01:35.542342Z","title":"Do agents need to plan step-by-step? rethinking planning horizon in data-centric tool calling, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.542342Z"},"links":{"cited_paper":"/paper/2605.08477","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:71e1422a9d27deffc8c6b7c5df125d0c1fd6d37f68c3294d9f2f07d480a2431e","observation_id":"58ba2e0e-129a-4325-9afb-b97ab8098bce","resolution":{"observed_at":"2026-08-10T23:01:35.542342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.545080Z","title":"The cognitive bandwidth bottleneck: Shifting long-horizon agent from plan- ning with actions to planning with schemas, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.545080Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d0ae2b0246fd7c510a23d41d4378566ed7f41da24f6297fa7ac25bc0b74bd51c","observation_id":"e2076d76-067d-49b0-b556-169498d713be","resolution":{"observed_at":"2026-08-10T23:01:35.545080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-10T23:01:35.547554Z","title":"Griﬀiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.547554Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4d388615906a8953d29edc153d06abd01bf0084a0da63d1e7ec15d30b5152aef","observation_id":"4d9aaf94-2e8c-48c3-9c7b-37f5cb63231d","resolution":{"observed_at":"2026-08-10T23:01:35.547554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07551","last_updated":"2025-06-12T07:30:27Z","snapshot_observed_at":"2026-08-15T23:45:42.136940Z","submitted_at":"2025-06-09T08:41:39Z","title":"CheMatAgent: Enhancing LLMs for Chemistry and Materials Science through Tree-Search Based Tool Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07551","snapshot_observed_at":"2026-08-10T23:01:35.550199Z","title":"An, Yuwei Wan, Wenliang Chen, Binbin Lin, Yuqiang Li, Tong Xie, and Dongzhan Zhou","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.550199Z"},"links":{"cited_paper":"/paper/2506.07551","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:047cb6c3a16040b580af7996517ad08e0d3660a89c3b1f062d5c3ed7c8083284","observation_id":"9b1e3e64-304b-4287-bd15-f678d3f508d2","resolution":{"observed_at":"2026-08-10T23:01:35.550199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07557","last_updated":"2025-06-09T08:52:27Z","snapshot_observed_at":"2026-08-18T15:16:53.915917Z","submitted_at":"2025-06-09T08:52:27Z","title":"SELT: Self-Evaluation Tree Search for LLMs with Task Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07557","snapshot_observed_at":"2026-08-10T23:01:35.553083Z","title":"SELT: Self- evaluation tree search for LLMs with task decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.553083Z"},"links":{"cited_paper":"/paper/2506.07557","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4770be9692b19fe815181461992a45a67cfda108dd26dac1ae736c4189ab6e61","observation_id":"b223cb23-1271-4f9b-a6a2-139b36034026","resolution":{"observed_at":"2026-08-10T23:01:35.553083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.555658Z","title":"W ALL-e: World alignment by rule learning improves world model-based LLM agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.555658Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2b92ac13dcec51cdf3b8b46a1579b8a395d90925a2163c9b853bc3ed3356515f","observation_id":"f3ed3bc5-cb75-4177-b4a5-89dd8e52bbe8","resolution":{"observed_at":"2026-08-10T23:01:35.555658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.561984Z","title":"Laird and Corey Clark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.561984Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:582e1b721d313ad76e26526fd2e7e36cc3a32b9c3e12813269485c02245fde09","observation_id":"33743249-9f5b-4ae8-bcc4-d377b3b30ab2","resolution":{"observed_at":"2026-08-10T23:01:35.561984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.564416Z","title":"MobileDreamer: Generative sketch world model for GUI agent, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.564416Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c77d8e35ab12a9fbc47fba6995e5fc3c3843c7f41ba087487891ef77fefb5c34","observation_id":"dd8b4f10-3641-48e2-acb3-f6ea52dcf7db","resolution":{"observed_at":"2026-08-10T23:01:35.564416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15660","last_updated":"2026-07-17T06:12:04Z","snapshot_observed_at":"2026-08-18T22:24:39.729076Z","submitted_at":"2026-07-17T06:12:04Z","title":"ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15660","snapshot_observed_at":"2026-08-10T23:01:35.567093Z","title":"ToolVerse: Unlocking massive environments and long-horizon tasks for agentic reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.567093Z"},"links":{"cited_paper":"/paper/2607.15660","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:cc930f168674e41b30838837177f27b6a9bb564d8c7a54fba03fccf2a8d012b8","observation_id":"0fdff7de-756d-46cb-b1a5-3f3f35638a9b","resolution":{"observed_at":"2026-08-10T23:01:35.567093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.570037Z","title":"AgentEvolver: Towards eﬀicient self-evolving agent system, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.570037Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5d67c65e6585019db6fffd3b1a0b52386ad6e6db89e7cca904115c4854ff1941","observation_id":"304c4095-52cc-4303-8b03-781ba31759b7","resolution":{"observed_at":"2026-08-10T23:01:35.570037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02556","last_updated":"2026-04-24T18:39:50Z","snapshot_observed_at":"2026-08-12T16:40:34.491193Z","submitted_at":"2026-01-30T13:15:13Z","title":"Beyond Experience Retrieval: Learning to Generate Utility-Optimized Structured Experience for Frozen LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02556","snapshot_observed_at":"2026-08-10T23:01:35.572747Z","title":"Beyond experience re- trieval: Learning to generate utility-optimized structured experience for frozen LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.572747Z"},"links":{"cited_paper":"/paper/2602.02556","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:025217f6eca3f31662ba16fdcfecf680b1457a6e985e5980c3fc7b51bdcc577c","observation_id":"a2ae34fd-a085-46a5-9538-a4e50a4f620d","resolution":{"observed_at":"2026-08-10T23:01:35.572747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-10T23:01:35.575978Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.575978Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1b34134f8456b46e902beca2976793a6dd2b269cad21a5750c0ec36ee588376c","observation_id":"af5c6012-b77a-43f6-98a7-b8f0140b360f","resolution":{"observed_at":"2026-08-10T23:01:35.575978Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13171","last_updated":"2025-08-08T16:32:47Z","snapshot_observed_at":"2026-08-18T16:31:09.997309Z","submitted_at":"2025-08-08T16:32:47Z","title":"Cognitive Workspace: Active Memory Management for LLMs -- An Empirical Study of Functional Infinite Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13171","snapshot_observed_at":"2026-08-10T23:01:35.578943Z","title":"Cognitive workspace: Active memory management for LLMs – an empirical study of functional infinite context, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.578943Z"},"links":{"cited_paper":"/paper/2508.13171","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9f04f9164175b9d79ff450ef48cf57c69344fe1634dfb474b5584b24a523f4f5","observation_id":"42ccb7fc-bc1a-44fa-9e25-e720b5f6ca86","resolution":{"observed_at":"2026-08-10T23:01:35.578943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00031","last_updated":"2026-07-24T20:05:06Z","snapshot_observed_at":"2026-08-06T11:42:24.722042Z","submitted_at":"2025-07-30T08:01:45Z","title":"Git Context Controller: Manage the Context of LLM-based Agents like Git","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00031","snapshot_observed_at":"2026-08-10T23:01:35.581794Z","title":"Git context controller: Manage the context of LLM-based agents like git, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.581794Z"},"links":{"cited_paper":"/paper/2508.00031","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6076b789c141f586b58735e8936320f6e28ac93b8f9d273b4dd7a2c6a120aaf6","observation_id":"028e1dcd-ab43-4f06-921e-e162afc1fea9","resolution":{"observed_at":"2026-08-10T23:01:35.581794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.584602Z","title":"Scaling long-horizon LLM agent via context-folding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.584602Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2ccb2cec42f4fbc93e80a8d250c15b52fbfe2f6084a7214a6dcb6d3d6f00f5f8","observation_id":"21703a96-ef58-4aba-924f-ca12aa1fea38","resolution":{"observed_at":"2026-08-10T23:01:35.584602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.00615","last_updated":"2026-06-01T07:41:52Z","snapshot_observed_at":"2026-08-16T10:42:00.044537Z","submitted_at":"2025-10-01T07:43:49Z","title":"ACON: Optimizing Context Compression for Long-horizon LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.00615","snapshot_observed_at":"2026-08-10T23:01:35.587099Z","title":"Inan, Lukas Wutschitz, Yanzhi Chen, Robert B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.587099Z"},"links":{"cited_paper":"/paper/2510.00615","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8bc58278a76bb17ba82d54dabd1a5d4eedcc28563202277871cac6a047c23d6a","observation_id":"27a8c101-fa00-4eed-94a8-fa0f4fb79d25","resolution":{"observed_at":"2026-08-10T23:01:35.587099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29718","last_updated":"2026-08-04T16:37:54Z","snapshot_observed_at":"2026-08-17T03:22:01.068759Z","submitted_at":"2026-06-29T02:53:28Z","title":"Diagnosing and Mitigating Context Rot in Long-horizon Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.29718","snapshot_observed_at":"2026-08-10T23:01:35.589850Z","title":"Diagnosing and mitigating context rot in long-horizon search, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.589850Z"},"links":{"cited_paper":"/paper/2606.29718","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e27fbc65a12b42cffd310df6e71b1284f768d23fa6ffedbaf9ee212d83939bcf","observation_id":"b5c86055-aa32-468c-95fe-eb38d94e9afe","resolution":{"observed_at":"2026-08-10T23:01:35.589850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22953","last_updated":"2026-06-22T07:30:47Z","snapshot_observed_at":"2026-08-16T02:15:13.589760Z","submitted_at":"2026-06-22T07:30:47Z","title":"Plans Don't Persist: Why Context Management Is Load Bearing for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22953","snapshot_observed_at":"2026-08-10T23:01:35.592719Z","title":"Plans don’t persist: Why context management is load bearing for LLM agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.592719Z"},"links":{"cited_paper":"/paper/2606.22953","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d6efb216e9398181c0938e7864d86613dfacc9f31d18850da7c31a3e0df37f79","observation_id":"8bc86b62-d07b-43a3-9b2b-15d3a3ad1905","resolution":{"observed_at":"2026-08-10T23:01:35.592719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-19T03:45:55.054912Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-10T23:01:35.595485Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.595485Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e4a2dae1af6cc7251330cb6825af8a62303b2cb35c154430e767068888a047c2","observation_id":"416faf43-b239-422d-952c-75b229eb1b1b","resolution":{"observed_at":"2026-08-10T23:01:35.595485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.598199Z","title":"O’Brien, Carrie J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.598199Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e91c0d1c78f36fd467bd1f434bc6b1a34c1bcc88a5a998f3418a944cfb820afd","observation_id":"c9386a00-719c-4362-9d2b-47e1ba67ab20","resolution":{"observed_at":"2026-08-10T23:01:35.598199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-10T23:01:35.600632Z","title":"A-MEM: Agentic memory for LLM agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.600632Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b2537f97002c8d6ddb8956899064aec3dcbb4b3f47144e698462b28120951e0e","observation_id":"70f1a38c-65e0-4521-ae94-a5d7bf04b98e","resolution":{"observed_at":"2026-08-10T23:01:35.600632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.05665","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.191897Z","title":"Graph-based agent memory: Taxonomy, techniques, and applications","venue":null,"work_id":"df2771f1-a407-4d81-a85d-a3bf54de5a81","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.603257Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0397aa684f8a69b1e597cfed1c710facc3b58067b8331936218c3d1322c41fb5","observation_id":"edd121b7-034a-4807-bff7-c0f3132f3d96","resolution":{"observed_at":"2026-08-10T23:01:36.195059Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.12997","last_updated":"2026-07-22T21:19:00Z","snapshot_observed_at":"2026-08-07T17:40:47.895215Z","submitted_at":"2025-11-17T05:38:50Z","title":"WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.12997","snapshot_observed_at":"2026-08-10T23:01:35.605771Z","title":"WebCoach: Self-evolving web agents with cross-session memory guidance, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.605771Z"},"links":{"cited_paper":"/paper/2511.12997","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e60aa14a9b6a90ed8b12c810d1b32d156f320d2dd5919b5a04cb64bcd44ce1c3","observation_id":"a691d46d-79fa-4b54-aa69-31ff878f77e2","resolution":{"observed_at":"2026-08-10T23:01:35.605771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07313","last_updated":"2026-05-08T06:22:31Z","snapshot_observed_at":"2026-08-12T21:35:04.878254Z","submitted_at":"2026-05-08T06:22:31Z","title":"When Stored Evidence Stops Being Usable: Scale-Conditioned Evaluation of Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07313","snapshot_observed_at":"2026-08-10T23:01:35.608319Z","title":"When stored evidence stops being usable: Scale-conditioned evaluation of agent memory, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.608319Z"},"links":{"cited_paper":"/paper/2605.07313","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:76e7fe5733b7b97b08de1893e016ba8ba179772decedaef1bb4ba0c73a4c90c8","observation_id":"3ad3c7ab-96a1-4af4-b83f-cfbd3fa8e789","resolution":{"observed_at":"2026-08-10T23:01:35.608319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18565","last_updated":"2026-05-19T16:05:55Z","snapshot_observed_at":"2026-08-15T02:33:14.405523Z","submitted_at":"2026-05-18T15:43:35Z","title":"MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18565","snapshot_observed_at":"2026-08-10T23:01:35.610938Z","title":"MINTEval: Evaluating memory under multi-target interference in long-horizon agent systems, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.610938Z"},"links":{"cited_paper":"/paper/2605.18565","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:31c41e291c4f92bdb62ee8ad9f4db113321f6edcabc4d23ac9f4cf9bc0405f9d","observation_id":"5a0df324-3392-4164-9585-507b372a872e","resolution":{"observed_at":"2026-08-10T23:01:35.610938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2601.18642","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.131008Z","title":"FadeMem: Biologically-inspired forgetting for eﬀicient agent memory","venue":null,"work_id":"343f6b8c-2efa-4683-b85f-0f83b296fc3e","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.613747Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:96d83d15b1e5d98dde2d2815e10d30878a663f42f23de660460fa8b9cdeac5ae","observation_id":"c9a1bb9a-942a-4db0-8214-6ed790172bda","resolution":{"observed_at":"2026-08-10T23:01:36.134245Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00680","last_updated":"2026-04-09T06:51:56Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-02-28T14:43:02Z","title":"MemPO: Self-Memory Policy Optimization for Long-Horizon Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.00680","snapshot_observed_at":"2026-08-10T23:01:35.616146Z","title":"MemPO: Self-memory policy optimization for long-horizon agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.616146Z"},"links":{"cited_paper":"/paper/2603.00680","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6ddea6ee9ca9c080b3773d3bfafdcb93e66d5a302cd68568d2d8ff47cb95a4b7","observation_id":"f72a3db0-9a42-4860-b3e8-e028ae15a2fa","resolution":{"observed_at":"2026-08-10T23:01:35.616146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20987","last_updated":"2026-04-22T18:17:17Z","snapshot_observed_at":"2026-08-15T12:42:21.923447Z","submitted_at":"2026-04-22T18:17:17Z","title":"Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20987","snapshot_observed_at":"2026-08-10T23:01:35.619058Z","title":"Co-evolving LLM decision and skill bank agents for long-horizon tasks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.619058Z"},"links":{"cited_paper":"/paper/2604.20987","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:391f820180dcbd724f773e0e1f55d80829df22d7d77456c2abdab886f4d51418","observation_id":"1c123bf1-e8e8-47e0-a896-32a2a2db64e0","resolution":{"observed_at":"2026-08-10T23:01:35.619058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29960","last_updated":"2026-05-28T14:02:00Z","snapshot_observed_at":"2026-08-18T00:12:48.519369Z","submitted_at":"2026-05-28T14:02:00Z","title":"Hijacking Agent Memory: Stealthy Trojan Attacks Through Conversational Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29960","snapshot_observed_at":"2026-08-10T23:01:35.621794Z","title":"Hijacking agent memory: Stealthy trojan attacks through conversational interaction, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.621794Z"},"links":{"cited_paper":"/paper/2605.29960","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:3b492799131df532c74226da569894c5e5729b7fc5c5b15676270df4a0a9bea0","observation_id":"f03b548b-bc5a-4e8c-9968-3d6b5dfc9262","resolution":{"observed_at":"2026-08-10T23:01:35.621794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30566","last_updated":"2026-07-21T04:24:11Z","snapshot_observed_at":"2026-08-13T04:05:12.678039Z","submitted_at":"2026-06-29T17:09:03Z","title":"Forensic Trajectory Signatures for Agent Memory Poisoning Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30566","snapshot_observed_at":"2026-08-10T23:01:35.624528Z","title":"Forensic trajectory signatures for agent memory poisoning detection, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.624528Z"},"links":{"cited_paper":"/paper/2606.30566","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:bd995401638cb9e1785ea3983e8c3e54f21c1c8d6f5cdfbcd0ebffd432b15c5b","observation_id":"78ed0683-b93e-444e-9d7e-ff74ac0c4d53","resolution":{"observed_at":"2026-08-10T23:01:35.624528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-10T23:01:35.627306Z","title":"ReAct: Synergizing reasoning and acting in language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.627306Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8e5dbd80661b62d6a7c7b24e9e453441fc3b9a72a1b291b5204ad51c00469280","observation_id":"fc37d485-bad3-4b9f-be01-ba609ce4a7be","resolution":{"observed_at":"2026-08-10T23:01:35.627306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08646","last_updated":"2025-09-10T14:41:07Z","snapshot_observed_at":"2026-08-15T15:58:51.495382Z","submitted_at":"2025-09-10T14:41:07Z","title":"Architecting Resilient LLM Agents: A Guide to Secure Plan-then-Execute Implementations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08646","snapshot_observed_at":"2026-08-10T23:01:35.630273Z","title":"Del Rosario, Klaudia Krawiecka, and Christian Schroeder de Witt","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.630273Z"},"links":{"cited_paper":"/paper/2509.08646","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:dc51a1873859941642a3068c9640e23aebda273afd74b6f2d7880c7efa00d2d3","observation_id":"1a45079d-5852-4f74-bab1-0229a88e15c3","resolution":{"observed_at":"2026-08-10T23:01:35.630273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-10T23:01:35.633179Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.633179Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ea9b0756f0b08a6de484a393cd7b1a910f2495a0de41deef9506f83e72b35453","observation_id":"1f63ca0e-1696-4977-8787-6c7a4866e897","resolution":{"observed_at":"2026-08-10T23:01:35.633179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.636179Z","title":"HuggingGPT: Solving AI tasks with ChatGPT and its friends in hugging face","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.636179Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:bef89e31f4868706df350c4f919f77821da854b852582cb460ca207298e650c7","observation_id":"3287544e-72b4-4d57-b3ce-b2c028532371","resolution":{"observed_at":"2026-08-10T23:01:35.636179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13081","last_updated":"2025-07-17T12:51:07Z","snapshot_observed_at":"2026-08-13T06:47:35.496730Z","submitted_at":"2025-07-17T12:51:07Z","title":"iReDev: A Knowledge-Driven Multi-Agent Framework for Intelligent Requirements Development","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13081","snapshot_observed_at":"2026-08-10T23:01:35.638736Z","title":"iReDev: A knowledge-driven multi-agent framework for intelligent requirements development, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.638736Z"},"links":{"cited_paper":"/paper/2507.13081","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c187b3fde7c44d886827961cb03147b6e3454c6358b8a16e8bf56ce0647bdacb","observation_id":"ec066b2d-7c9e-4b88-8e65-06046c159ad4","resolution":{"observed_at":"2026-08-10T23:01:35.638736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.641693Z","title":"SentiMM: A multimodal multi-agent framework for sentiment analysis in social media,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.641693Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:86c2b11bd9fa72fd5282f369a05fd227eaea7e82f96ed8066c031cb9456e1c6c","observation_id":"45abc842-3186-4af0-bd7e-a95067b0d78f","resolution":{"observed_at":"2026-08-10T23:01:35.641693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.13021","last_updated":"2026-04-27T11:42:26Z","snapshot_observed_at":"2026-08-14T03:18:31.434407Z","submitted_at":"2025-09-16T12:45:45Z","title":"xOffense: An Autonomous Multi-Agent Framework for Penetration Testing with Domain-Adapted Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.13021","snapshot_observed_at":"2026-08-10T23:01:35.647556Z","title":"xoffense: An autonomous multi- agent framework for penetration testing with domain-adapted large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.647556Z"},"links":{"cited_paper":"/paper/2509.13021","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:cb987626c49f249a30aea257f1e3acce7c2bc7743e1daaa550571f963edf6615","observation_id":"901dfc73-dfa5-4c2d-843c-eef1836d35ea","resolution":{"observed_at":"2026-08-10T23:01:35.647556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.651564Z","title":"Lin, Eliot Krzysztof Jones, Donovan Julian Jasper, Ethan Ho, Anna H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.651564Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:02b82b38c9a96acd5bbab79629bbf2c11f74a501b77c00f6b4eef635f85cd0a6","observation_id":"84dea266-5519-4e0f-8279-6bd3287d25fb","resolution":{"observed_at":"2026-08-10T23:01:35.651564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.654095Z","title":"Generative AI-driven hierarchical multi-agent framework for zero-touch optical networks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.654095Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9ec6ca795eac02b882767a0a9d97d91b680be4af036f0fb6e16adeeae88b8227","observation_id":"691c522d-49e5-43a6-b8d7-ccb8cc017c5f","resolution":{"observed_at":"2026-08-10T23:01:35.654095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.656554Z","title":"Multi-agent LLM orchestration achieves deterministic, high-quality decision support for incident response, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.656554Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:38d701ed51a9cfa81cdedb7514470de53b7546a73e78e425249aa5be686122cf","observation_id":"7dd39556-31b6-416e-919d-70fc6550e6e3","resolution":{"observed_at":"2026-08-10T23:01:35.656554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-08-19T02:39:49.248595Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-10T23:01:35.659062Z","title":"Agent s2: A compositional generalist-specialist framework for computer use agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.659062Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:37ff87e21c8efbf5e311d6914e9a10dc7c6a7c01fd4be0d6053f3449215ed537","observation_id":"adb5527c-b2b1-417e-8002-2ce9847da674","resolution":{"observed_at":"2026-08-10T23:01:35.659062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2601.20380","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.044228Z","title":"OmegaUse: Building a general-purpose GUI agent for autonomous task execution","venue":null,"work_id":"2a53e876-5546-4c7e-bcb6-755fdeab4a35","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.662924Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:3f4ae2db8b81e6f438d76082fb16868f43ebfa22d4c9f5a1435c619075a004e3","observation_id":"63528579-e520-4bbe-a426-ccf7c5517246","resolution":{"observed_at":"2026-08-10T23:01:36.047704Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.19185","last_updated":"2026-04-02T22:22:56Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T16:02:09Z","title":"An Empirical Study of Testing Practices in Open Source AI Agent Frameworks and Agentic Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.19185","snapshot_observed_at":"2026-08-10T23:01:35.665805Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.665805Z"},"links":{"cited_paper":"/paper/2509.19185","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:132a64d9915fd269116f2180b03a421544dcb1ecc5a7f6baa35b6c66f7080a17","observation_id":"f3c0ffee-606a-4584-97cb-e4cd47405017","resolution":{"observed_at":"2026-08-10T23:01:35.665805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13850","last_updated":"2026-05-24T10:19:18Z","snapshot_observed_at":"2026-08-08T07:41:39.543362Z","submitted_at":"2026-03-16T04:01:01Z","title":"A Two-Dimensional Framework for AI Agent Design Patterns: Cognitive Function and Execution Topology","version":2},"cited_work":{"arxiv_id":"2605.13850","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13850","snapshot_observed_at":"2026-08-10T23:01:37.872833Z","title":"A Two-Dimensional Framework for AI Agent Design Patterns: Cognitive Function and Execution Topology","venue":"cs.AI","work_id":"e1c9a8e9-ccca-408f-864c-abd69f2d2ead","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.668706Z"},"links":{"cited_paper":"/paper/2605.13850","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0320046c1451afe055a1c4aa4006c3a388afbf755bf566279fa0e6f41ea01293","observation_id":"42aa1d8f-1201-41e9-9a3e-02e021fd7c3e","resolution":{"observed_at":"2026-08-10T23:01:37.875866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07913","last_updated":"2025-02-11T14:30:44Z","snapshot_observed_at":"2026-08-16T21:12:20.846465Z","submitted_at":"2025-01-14T07:55:18Z","title":"Governing AI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07913","snapshot_observed_at":"2026-08-10T23:01:35.671459Z","title":"Governing AI agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.671459Z"},"links":{"cited_paper":"/paper/2501.07913","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2454ee5f310254766f8d5494df596a8a7bcebb37e01ba9a9f3cd615051aead93","observation_id":"add4d526-bcf5-4272-b7cf-7238890e9cf5","resolution":{"observed_at":"2026-08-10T23:01:35.671459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01635","last_updated":"2025-02-03T18:59:13Z","snapshot_observed_at":"2026-08-17T18:29:46.642427Z","submitted_at":"2025-02-03T18:59:13Z","title":"The AI Agent Index","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01635","snapshot_observed_at":"2026-08-10T23:01:35.674505Z","title":"Hunter, Carson Ezell, Emma Cabalé, Michael Gerovitch, Stewart Slocum, Kevin Wei, Nikola Jurkovic, Ariba Khan, Phillip J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.674505Z"},"links":{"cited_paper":"/paper/2502.01635","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:20b22d8fe581d59fbd5af08a9372889d1c3e07aa9cdda0f18be9af4995b01660","observation_id":"c9ea7510-3b8c-49a0-852c-a570ba15ded3","resolution":{"observed_at":"2026-08-10T23:01:35.674505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.677546Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.677546Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9f0f2db044f39244371b6dbeb487a15d9ec8c7c4e086f0559e07ba18bc80b69c","observation_id":"5a9985a9-5b84-4abf-861f-88c391b0aa02","resolution":{"observed_at":"2026-08-10T23:01:35.677546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"cited_work":{"arxiv_id":"2506.15894","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.15894","snapshot_observed_at":"2026-08-10T23:01:37.846397Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","venue":"cs.CL","work_id":"6efc19b6-d8fb-4ad3-9130-718ae2a19cc6","year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.680054Z"},"links":{"cited_paper":"/paper/2506.15894","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1f61281cd8456ee1432546e481332271868db79529e4245023c83e73151cccf2","observation_id":"db5d97df-474b-4f8f-b5c5-96f76572501f","resolution":{"observed_at":"2026-08-10T23:01:37.849405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14092","last_updated":"2024-10-03T02:00:53Z","snapshot_observed_at":"2026-08-16T13:50:25.355093Z","submitted_at":"2024-05-23T01:43:45Z","title":"Large Language Models Can Self-Correct with Key Condition Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14092","snapshot_observed_at":"2026-08-10T23:01:35.682869Z","title":"Large language models can self-correct with key condition verification, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.682869Z"},"links":{"cited_paper":"/paper/2405.14092","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4f818fcaa30c25122c2a23f41e987a3ce1ed5506fe22a693220195e1194c0c0b","observation_id":"5753611a-4298-44c7-bd09-4acea5a5c805","resolution":{"observed_at":"2026-08-10T23:01:35.682869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.685622Z","title":"Decomposing LLM self-correction: The accuracy-correction paradox and error depth hypothesis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.685622Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:96e9efa7fe01bf397d70c2fdfa69ee0636c80d5286b9a04e86d38ea6feace6c0","observation_id":"307c0cdc-04a0-48be-a362-52d169bf18da","resolution":{"observed_at":"2026-08-10T23:01:35.685622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13271","last_updated":"2025-06-30T11:12:31Z","snapshot_observed_at":"2026-08-17T19:35:48.405277Z","submitted_at":"2025-05-19T15:52:19Z","title":"CSC-SQL: Corrective Self-Consistency in Text-to-SQL via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13271","snapshot_observed_at":"2026-08-10T23:01:35.688258Z","title":"CSC-SQL: Corrective self-consistency in text-to-SQL via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.688258Z"},"links":{"cited_paper":"/paper/2505.13271","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:bc09548a004193ac24e2d567579ec00cde75e7e284e5f6b178cb182396e2ea6f","observation_id":"24a7b499-63cf-473e-8a30-198ba7f86666","resolution":{"observed_at":"2026-08-10T23:01:35.688258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07935","last_updated":"2025-08-11T12:50:46Z","snapshot_observed_at":"2026-08-18T21:43:31.190035Z","submitted_at":"2025-08-11T12:50:46Z","title":"SHIELDA: Structured Handling of Exceptions in LLM-Driven Agentic Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07935","snapshot_observed_at":"2026-08-10T23:01:35.691627Z","title":"SHIELDA: Structured handling of exceptions in LLM-driven agentic workflows, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.691627Z"},"links":{"cited_paper":"/paper/2508.07935","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ae1b60cba85e95bea569b380d95bbdc79c3711476bc826f8d2fcfad4e5f66bb5","observation_id":"ac8685f8-54ae-4ee3-9784-32b8027f87f0","resolution":{"observed_at":"2026-08-10T23:01:35.691627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.694532Z","title":"Beyond entangled planning: Task-decoupled planning for long-horizon agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.694532Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e68e770fb1aeb924aafc17cedafabf713d404d9ea8967faba1fdc2d59c5a5662","observation_id":"69cfafb1-596d-403e-bda3-fd2f5f9a17cb","resolution":{"observed_at":"2026-08-10T23:01:35.694532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-10T23:01:35.697245Z","title":"Voyager: An open-ended embodied agent with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.697245Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:f8a523df7dbc457d2a26080c9bb0d366f04bb5a5d7c4c9afa64719f4520feb39","observation_id":"a1ee9040-cad6-44c8-914d-f865b460ce2f","resolution":{"observed_at":"2026-08-10T23:01:35.697245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.701005Z","title":"ViReSkill: Vision-grounded replanning with skill memory for LLM-based planning in lifelong robot learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.701005Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8ef4f0b7d38a0b6aa1ad887d9e04947ebedd53f300ef003526b974b383172a10","observation_id":"0011074b-293d-4309-a6bf-df0031a71baa","resolution":{"observed_at":"2026-08-10T23:01:35.701005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04700","last_updated":"2025-08-12T15:11:53Z","snapshot_observed_at":"2026-08-16T20:02:22.367841Z","submitted_at":"2025-08-06T17:58:46Z","title":"SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04700","snapshot_observed_at":"2026-08-10T23:01:35.703441Z","title":"SEAgent: Self-evolving computer use agent with autonomous learning from experience, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.703441Z"},"links":{"cited_paper":"/paper/2508.04700","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2f9fd4690a5dae5ab7432555ac5dfd0469bd800563e4ca2f63f9f09a0854ccf5","observation_id":"e3fd0de4-9bc6-48f0-84fa-fad8f6ca66fb","resolution":{"observed_at":"2026-08-10T23:01:35.703441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.706348Z","title":"Segment policy optimization: Effective segment-level credit assignment in RL for large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.706348Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:044ec2bc6f7c0d56857dca920d31dc69ad1f07380f3aa4ff03d3a2d8924a4b56","observation_id":"5b467a41-9e0c-4344-bb23-a87414d2db54","resolution":{"observed_at":"2026-08-10T23:01:35.706348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26684","last_updated":"2026-06-01T06:20:12Z","snapshot_observed_at":"2026-08-03T17:58:37.045292Z","submitted_at":"2026-05-26T08:23:34Z","title":"Beyond Trajectory-Level Attribution: Graph-Based Credit Assignment for Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26684","snapshot_observed_at":"2026-08-10T23:01:35.708864Z","title":"Beyond trajectory-level attribution: Graph-based credit assignment for agentic reinforcement learn- ing, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.708864Z"},"links":{"cited_paper":"/paper/2605.26684","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8ee538dd004c637c00588faf7a358bbeaf9b6b4a713977839faebd97fa83c466","observation_id":"341cc47c-06cd-4f9e-9f2f-7efe851364ed","resolution":{"observed_at":"2026-08-10T23:01:35.708864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05965","last_updated":"2026-05-07T10:11:51Z","snapshot_observed_at":"2026-08-13T12:51:35.018968Z","submitted_at":"2026-05-07T10:11:51Z","title":"Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR","version":1},"cited_work":{"arxiv_id":"2605.05965","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05965","snapshot_observed_at":"2026-08-10T23:01:37.554932Z","title":"Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR","venue":"cs.LG","work_id":"fcff61b0-1ed8-43f7-83eb-8e62ee758170","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.712150Z"},"links":{"cited_paper":"/paper/2605.05965","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ccca199015248d38ce5bb8ef7fa6551e4f03e8fa8d577924c83cf7a86380cc47","observation_id":"c6470f50-8445-4a83-8d26-7cb5846d6b56","resolution":{"observed_at":"2026-08-10T23:01:37.558636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06194","last_updated":"2026-07-29T06:55:29Z","snapshot_observed_at":"2026-08-03T09:13:12.714748Z","submitted_at":"2026-03-06T12:06:57Z","title":"MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue","version":3},"cited_work":{"arxiv_id":"2603.06194","doi":"10.48550/arxiv.2603.06194","metadata_source":"pith","pith_arxiv_id":"2603.06194","snapshot_observed_at":"2026-08-11T00:16:15.729268Z","title":"MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue","venue":"cs.CL","work_id":"9a4489d7-d836-4e88-a2bc-a36c3a78efeb","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.714955Z"},"links":{"cited_paper":"/paper/2603.06194","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6b2f3cd4c4266cb33ac7b599c43f733409cdf4c56c8916b5fee2fb10ceb97a77","observation_id":"18100c34-618d-4f6f-a317-ab6985c78114","resolution":{"observed_at":"2026-08-10T23:01:35.979608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21768","last_updated":"2026-05-20T22:02:00Z","snapshot_observed_at":"2026-08-18T03:02:54.764429Z","submitted_at":"2026-05-20T22:02:00Z","title":"Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21768","snapshot_observed_at":"2026-08-10T23:01:35.718280Z","title":"Memory-r2: Fair credit assignment for long-horizon memory- augmented LLM agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.718280Z"},"links":{"cited_paper":"/paper/2605.21768","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2a33429839c78a5904d8e3fddf565b8e0a28c593e8b1e8bb12b6de733393105c","observation_id":"67b78875-b23f-4f73-99ed-7715ecf8436c","resolution":{"observed_at":"2026-08-10T23:01:35.718280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.721043Z","title":"Demystifying reinforcement learning for long-horizon tool-using agents: A comprehensive recipe, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.721043Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:196df0eecbd8242e880c15e8a5f7cd5e08d7cb423d74db174d489f117bb4bf51","observation_id":"6f24c853-84c5-4563-a314-5993871c2b10","resolution":{"observed_at":"2026-08-10T23:01:35.721043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T23:01:35.723496Z","title":"Let’s verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.723496Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b77803063360689c934b27b108b47e474e2f7fe5cfd34e92b23accebdfb100c3","observation_id":"1a06d184-2b6d-4231-b3cf-177e3d10968f","resolution":{"observed_at":"2026-08-10T23:01:35.723496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.726497Z","title":"Entropy-regularized process reward model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.726497Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c35556606590c5fb52bfc7086625b9e08820ab0352cc4df3b259184583b8c022","observation_id":"d12b5d82-c357-4464-89c1-dcb0d289388e","resolution":{"observed_at":"2026-08-10T23:01:35.726497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.728986Z","title":"GroundedPRM: Tree-guided and fidelity-aware process reward mod- eling for step-level reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.728986Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1a02723ff54e81633a1fb45be90189d344e9dd69f7d0c95315ac877f0b279a74","observation_id":"f48e0268-e156-475a-ab03-ac7aadb5c4f9","resolution":{"observed_at":"2026-08-10T23:01:35.728986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.21154","last_updated":"2026-05-28T14:21:47Z","snapshot_observed_at":"2026-08-17T10:01:54.676927Z","submitted_at":"2025-09-25T13:40:36Z","title":"GRPO is Secretly a Process Reward Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.21154","snapshot_observed_at":"2026-08-10T23:01:35.731504Z","title":"GRPO is secretly a process reward model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.731504Z"},"links":{"cited_paper":"/paper/2509.21154","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:11f94ebcd965c9d421d1ff6c592c19101fa3aa53a49c03f03060f8dea88aade1","observation_id":"f4d8f352-658f-4f61-951f-23098439453f","resolution":{"observed_at":"2026-08-10T23:01:35.731504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16265","last_updated":"2025-05-22T05:56:11Z","snapshot_observed_at":"2026-08-17T04:02:43.572927Z","submitted_at":"2025-05-22T05:56:11Z","title":"Think-RM: Enabling Long-Horizon Reasoning in Generative Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16265","snapshot_observed_at":"2026-08-10T23:01:35.734381Z","title":"Think-RM: Enabling long-horizon reasoning in generative reward models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.734381Z"},"links":{"cited_paper":"/paper/2505.16265","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7538f2e3c3efa0b7780578fe5412de6a8ca72b577a91c917f19bbdccb7c1d6bb","observation_id":"abcf2ec5-4a78-4c06-90b6-c33f2e7f18b6","resolution":{"observed_at":"2026-08-10T23:01:35.734381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.737168Z","title":"AgentPRM: Process reward models for LLM agents via step-wise promise and progress, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.737168Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:41dbbc13957d5bac912e46ce298683a63efbc5dad7081d5074a3d3a8b316a5ea","observation_id":"f6761413-445d-484c-8e28-5896ccde7a29","resolution":{"observed_at":"2026-08-10T23:01:35.737168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14820","last_updated":"2026-04-16T09:41:47Z","snapshot_observed_at":"2026-08-14T23:47:10.510896Z","submitted_at":"2026-04-16T09:41:47Z","title":"SWE-TRACE: Optimizing Long-Horizon SWE Agents Through Rubric Process Reward Models and Heuristic Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14820","snapshot_observed_at":"2026-08-10T23:01:35.739622Z","title":"SWE-TRACE: Optimizing long-horizon SWE agents through rubric process reward models and heuristic test-time scaling, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.739622Z"},"links":{"cited_paper":"/paper/2604.14820","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ea6200d1d715ba722aeb2eda6d3795a6951dfdbe6bcfdc1c5d90e838b839e07d","observation_id":"f5be3098-e6dc-41b4-a776-5bec79c7e34c","resolution":{"observed_at":"2026-08-10T23:01:35.739622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17431","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:37.229852Z","title":"Agentic rein- forcement learning for search misaligns instruction-tuning, 2025","venue":null,"work_id":"28d9aafb-6020-4faa-a2cc-d98433f8a3e3","year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.742845Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4a6ac5e14761f57e7a39c90d7bd34590f74360fa259705d75f15c3ba25741ef2","observation_id":"5d856c48-6af7-4ea0-9cb8-12146571136b","resolution":{"observed_at":"2026-08-10T23:01:37.234083Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07367","last_updated":"2026-06-05T15:09:52Z","snapshot_observed_at":"2026-08-14T13:26:52.495860Z","submitted_at":"2026-06-05T15:09:52Z","title":"Self-evolving LLM agents with in-distribution Optimization","version":1},"cited_work":{"arxiv_id":"2606.07367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.07367","snapshot_observed_at":"2026-08-10T23:01:37.164083Z","title":"Self-evolving LLM agents with in-distribution Optimization","venue":"cs.LG","work_id":"a1df86f1-4bb9-4c85-a8ac-34bdb0310a14","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.745579Z"},"links":{"cited_paper":"/paper/2606.07367","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:011fd104ad61550c83494cb25f2842385ed40167e115f6c11de1f5b46c4897a5","observation_id":"2169a623-151b-4748-b08f-1e94f0cacc5f","resolution":{"observed_at":"2026-08-10T23:01:37.167467Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.749355Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.749355Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:014d7fd942163c26afdbf30376706f8e87dc4eb5ba30adc7dedd1a3e09acad98","observation_id":"1b0478b4-4a35-464f-a68a-9a73bf9eea4b","resolution":{"observed_at":"2026-08-10T23:01:35.749355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14354","last_updated":"2024-08-26T15:30:05Z","snapshot_observed_at":"2026-08-18T09:54:44.431558Z","submitted_at":"2024-08-26T15:30:05Z","title":"SWE-bench-java: A GitHub Issue Resolving Benchmark for Java","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14354","snapshot_observed_at":"2026-08-10T23:01:35.755009Z","title":"Qi, Hao Yu, Lei Yu, Dezhi Ran, Muhan Zeng, Bo Shen, Pan Bian, Guangtai Liang, Bei Guan, Pengjie Huang, Tao Xie, Yongji Wang, and Qianxiang Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.755009Z"},"links":{"cited_paper":"/paper/2408.14354","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:be965b7c0b406134b873ea106e6a6d8e017d3022357f7ef864e17778830d3a81","observation_id":"c40f7a68-d53b-4b54-92b5-d969088ad129","resolution":{"observed_at":"2026-08-10T23:01:35.755009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-08-09T23:51:45.534260Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-10T23:01:35.758160Z","title":"Multi-SWE-bench: A multilingual benchmark for issue resolving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.758160Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:82eff7919bee43ecba84789ab5cba7992a5a2be149ca5b7cd15eeed07bb5faac","observation_id":"eabd52b4-b678-4be2-8d51-d1687327794f","resolution":{"observed_at":"2026-08-10T23:01:35.758160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T07:59:30.675858Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":90,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":142},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 142 outbound references and 0 inbound Pith citation observations for arXiv:2608.06663."}