{"as_of":"2026-08-09T02:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fbb6d45abd2050109ba0557de230bde060b34ae2155f2fde7dba63b1c827f7a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:57:48.516122Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-05-15T21:20:59.128986Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2501.09686"},"observation_digest":"sha256:53243552931ca2e43e15d5fe11f7308ae10983b42e1b29a4154060f869f037f7","observation_id":"45c31990-362d-4cfc-a117-e735ae0d5ab2","resolution":{"observed_at":"2026-05-15T21:20:59.285843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T20:57:48.516122Z","title":"Fahim Tajwar, Anikait Singh, Archit Sharma, Rafael Rafailov, Jeff Schneider, Tengyang Xie, Stefano Ermon, Chelsea Finn, and Aviral Kumar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.15760","last_updated":"2025-02-13T18:55:14Z","snapshot_observed_at":"2026-08-07T22:34:53.289352Z","submitted_at":"2025-02-13T18:55:14Z","title":"Digi-Q: Learning Q-Value Functions for Training Device-Control Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T20:57:48.516122Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2502.15760"},"observation_digest":"sha256:ecf04ea067d77c7f486367fafe5c3df572982f3ea7fac9cbb9013b12e1abf76b","observation_id":"89c972ec-f841-49fd-9d76-448051e020bc","resolution":{"observed_at":"2026-08-07T20:57:48.516122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T14:12:05.686704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19683","last_updated":"2025-05-26T08:44:53Z","snapshot_observed_at":"2026-08-08T09:25:43.689145Z","submitted_at":"2025-05-26T08:44:53Z","title":"Large Language Models for Planning: A Comprehensive and Systematic Survey","version":1},"reference_index":218,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:05.686704Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2505.19683"},"observation_digest":"sha256:2dbe7e6dfc60c6a16e09d013c22fb44ccca962f14e3c3eabfb9ad845d678b03c","observation_id":"b558bc67-6710-4b5a-8f0b-9704f1cbf36f","resolution":{"observed_at":"2026-08-07T14:12:05.686704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T14:06:56.135534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.135534Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:2572ae338f4ad6bd55ea765ff19ed3b2aabe838e217489305d1743c6fbab2b24","observation_id":"4221ee65-8241-4637-aca8-a09a0be48bff","resolution":{"observed_at":"2026-08-07T14:06:56.135534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T13:53:59.697480Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20726","last_updated":"2025-07-29T02:51:37Z","snapshot_observed_at":"2026-08-07T22:45:15.753079Z","submitted_at":"2025-05-27T05:14:50Z","title":"ManiTaskGen: A Comprehensive Task Generator for Benchmarking and Improving Vision-Language Agents on Embodied Decision-Making","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:59.697480Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2505.20726"},"observation_digest":"sha256:b9800cbfddcd14b90f7a2f85e75d002fea83871d906e0d4dbb017cdccab77ab6","observation_id":"e8dd4e21-f13b-468b-b1b5-90ce35bf3098","resolution":{"observed_at":"2026-08-07T13:53:59.697480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T13:22:24.912504Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22050","last_updated":"2025-07-13T09:27:37Z","snapshot_observed_at":"2026-08-07T13:13:59.147933Z","submitted_at":"2025-05-28T07:21:37Z","title":"Reinforced Reasoning for Embodied Planning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:22:24.912504Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2505.22050"},"observation_digest":"sha256:4892b4fb51467f121f3c2000778f9d1eca595084b3bf1e7d259d3f7bc120c031","observation_id":"5083a2e4-4759-4062-869c-bc31d46e0826","resolution":{"observed_at":"2026-08-07T13:22:24.912504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T12:09:00.264859Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents.arXiv preprint arXiv:2403.02502, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00539","last_updated":"2025-06-04T13:39:54Z","snapshot_observed_at":"2026-08-08T09:04:37.435563Z","submitted_at":"2025-05-31T12:54:49Z","title":"ARIA: Training Language Agents with Intention-Driven Reward Aggregation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:00.264859Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.00539"},"observation_digest":"sha256:b23a7a15eb4aab8a895bed234c033be7269fafa086ff5896e96a53b45c14c6aa","observation_id":"4a26fead-1325-49cd-8a15-53c0823dec83","resolution":{"observed_at":"2026-08-07T12:09:00.264859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T11:30:56.040940Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02298","last_updated":"2025-06-02T22:36:02Z","snapshot_observed_at":"2026-08-08T17:41:53.481929Z","submitted_at":"2025-06-02T22:36:02Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:56.040940Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.02298"},"observation_digest":"sha256:027c545baa7e03ce54cadb7d0a305c9edaa65990933a231130cef0ec080e6fb9","observation_id":"19867723-796a-4262-b848-43cf24b3e5e8","resolution":{"observed_at":"2026-08-07T11:30:56.040940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T11:19:15.745703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02827","last_updated":"2025-06-03T12:58:07Z","snapshot_observed_at":"2026-08-07T22:42:58.660249Z","submitted_at":"2025-06-03T12:58:07Z","title":"TO-GATE: Clarifying Questions and Summarizing Responses with Trajectory Optimization for Eliciting Human Preference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:19:15.745703Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.02827"},"observation_digest":"sha256:9fb3b9a434f4ac4e47cc54525f79f07ecc19e9138e77f7db95eb4005d0163f71","observation_id":"ded4a3aa-8da1-4039-b8bd-8f75dbee4a2b","resolution":{"observed_at":"2026-08-07T11:19:15.745703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T05:36:38.519062Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07551","last_updated":"2025-06-12T07:30:27Z","snapshot_observed_at":"2026-08-07T22:38:32.445079Z","submitted_at":"2025-06-09T08:41:39Z","title":"CheMatAgent: Enhancing LLMs for Chemistry and Materials Science through Tree-Search Based Tool Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:36:38.519062Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.07551"},"observation_digest":"sha256:cc54f92b5c5cf78c6ec006c41a6014101fdf1be60a5a874defddac464402e97e","observation_id":"b1d07fc9-dfce-45c5-b05b-89e707818a25","resolution":{"observed_at":"2026-08-07T05:36:38.519062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-06T22:36:43.969795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21252","last_updated":"2025-06-26T13:36:12Z","snapshot_observed_at":"2026-08-07T12:39:14.206067Z","submitted_at":"2025-06-26T13:36:12Z","title":"Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T22:36:43.969795Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.21252"},"observation_digest":"sha256:e63ae265923c8f40161406efaeb24ea22f1c395f16f52dbd80b143ad7d51ec07","observation_id":"de0dac99-505e-4fda-9f2a-d93267561f42","resolution":{"observed_at":"2026-08-06T22:36:43.969795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-06T21:55:03.345545Z","title":"Trial and error: Exploration-based trajectory optimization for LLM agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23127","last_updated":"2025-06-29T07:31:24Z","snapshot_observed_at":"2026-08-07T10:28:04.865350Z","submitted_at":"2025-06-29T07:31:24Z","title":"Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:55:03.345545Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.23127"},"observation_digest":"sha256:ef8f2e92ecd33a2a26b6feb7cf1d11a4798793c28533514ab1f137ac1b3aa63e","observation_id":"30ea569b-757d-4043-b333-015c580c87eb","resolution":{"observed_at":"2026-08-06T21:55:03.345545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2506.23978","last_updated":"2026-05-16T17:29:09Z","snapshot_observed_at":"2026-08-04T08:40:19.416980Z","submitted_at":"2025-06-30T15:45:17Z","title":"LLM Agents Are the Antidote to Walled Gardens","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T00:41:19.750928Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2506.23978"},"observation_digest":"sha256:8b2fe3d780bad7c88f5c9af38802a610686764ba37397c9db76ed15441226714","observation_id":"b60306bd-6d8a-499b-a9cb-8c15f2fe02c3","resolution":{"observed_at":"2026-05-22T00:44:29.334526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-06T12:18:38.403343Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21924","last_updated":"2025-07-29T15:39:14Z","snapshot_observed_at":"2026-08-07T11:15:49.597365Z","submitted_at":"2025-07-29T15:39:14Z","title":"MMAT-1M: A Large Reasoning Dataset for Multimodal Agent Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T12:18:38.403343Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2507.21924"},"observation_digest":"sha256:3a6cf8f1609983d9d5abab87b93ac91b916e6ee25accdedc487b20ce872a0566","observation_id":"957c6707-7fcb-4195-84a1-e72f0b84820a","resolution":{"observed_at":"2026-08-06T12:18:38.403343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-06T11:21:26.783454Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22844","last_updated":"2025-07-30T17:00:48Z","snapshot_observed_at":"2026-08-07T22:42:41.639384Z","submitted_at":"2025-07-30T17:00:48Z","title":"RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T11:21:26.783454Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2507.22844"},"observation_digest":"sha256:eb8482346e2a61f35064481b775c75d0e4f8ca7028cf31389199a53bbfd7e71d","observation_id":"2a88c7ea-1fe7-4db2-a16c-6ba094467c5d","resolution":{"observed_at":"2026-08-06T11:21:26.783454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T14:22:46.685290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21456","last_updated":"2025-08-29T09:39:00Z","snapshot_observed_at":"2026-08-07T14:15:36.132963Z","submitted_at":"2025-08-29T09:39:00Z","title":"Morae: Proactively Pausing UI Agents for User Choices","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:46.685290Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2508.21456"},"observation_digest":"sha256:dc7ec7bdae7204ca24dd0387df1dd8e2d3b3fa5a3435ac43e79a4695038a59a9","observation_id":"5f4bc58d-d935-4fc3-a9bc-4aeb5ac374f0","resolution":{"observed_at":"2026-08-05T14:22:46.685290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2603.29908","last_updated":"2026-03-31T15:53:29Z","snapshot_observed_at":"2026-08-06T01:33:29.158513Z","submitted_at":"2026-03-31T15:53:29Z","title":"C-TRAIL: A Commonsense World Framework for Trajectory Planning in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T23:27:31.054348Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2603.29908"},"observation_digest":"sha256:843cefe27141bff3188e1aec174202438d2025615b24c9482461cd1332f0c9d4","observation_id":"12da300c-43b1-44f2-98bc-522a405c6a9b","resolution":{"observed_at":"2026-05-13T23:28:26.147204Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2604.08178","last_updated":"2026-05-11T07:26:22Z","snapshot_observed_at":"2026-08-02T16:02:49.097271Z","submitted_at":"2026-04-09T12:35:06Z","title":"Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:12:21.813803Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2604.08178"},"observation_digest":"sha256:8db331c5a0055f553a7a8235cdf3a72ea6bd99d0d986c3cae834c70f45d4e2d7","observation_id":"b8590005-2a87-4ab2-9c57-800e77e5cf8d","resolution":{"observed_at":"2026-05-11T07:21:00.765636Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2604.08178","last_updated":"2026-05-11T07:26:22Z","snapshot_observed_at":"2026-08-02T16:02:49.097271Z","submitted_at":"2026-04-09T12:35:06Z","title":"Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T02:59:19.674646Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2604.08178"},"observation_digest":"sha256:3d1925a0e59a064db48a673fd03f85565340d813db42c0d2e0a6b51fc7d4f736","observation_id":"0cfeddd9-b98e-4306-a053-a6e73a32ab6b","resolution":{"observed_at":"2026-05-12T03:01:18.099969Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2604.23194","last_updated":"2026-04-25T07:54:23Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T07:54:23Z","title":"From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-08T08:10:36.579810Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2604.23194"},"observation_digest":"sha256:37ede8f1c1b12cedbeeb81c55be816a5cbc89097fe0ec260fec865fea10ffbe5","observation_id":"d3140644-00be-4e5f-8aca-39e20086c8f1","resolution":{"observed_at":"2026-05-11T20:46:10.341474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2605.10500","last_updated":"2026-05-11T12:58:25Z","snapshot_observed_at":"2026-08-05T13:34:21.296589Z","submitted_at":"2026-05-11T12:58:25Z","title":"SkillEvolver: Skill Learning as a Meta-Skill","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T04:56:14.360454Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2605.10500"},"observation_digest":"sha256:7096032c0bb8f33cd8b723330ef7db70f9ca02025ee3a517c8d2787b7f2c59a9","observation_id":"3c960811-bc23-4655-8161-f73b79095dc4","resolution":{"observed_at":"2026-05-12T05:46:30.933210Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2605.24828","last_updated":"2026-05-31T15:58:08Z","snapshot_observed_at":"2026-08-03T07:25:06.734747Z","submitted_at":"2026-05-24T02:41:44Z","title":"Test-Time Deep Thinking to Explore Implicit Rules","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:15.163893Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2605.24828"},"observation_digest":"sha256:cba635ae21437d44db2b93c1e8e65df4c6f0f11c59bb32959c561a36e9e3823e","observation_id":"d1c0b134-c71e-4b73-90ff-762b459da0c9","resolution":{"observed_at":"2026-06-30T11:54:38.217679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2605.27209","last_updated":"2026-05-26T16:02:00Z","snapshot_observed_at":"2026-08-03T11:00:10.339186Z","submitted_at":"2026-05-26T16:02:00Z","title":"Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T16:51:36.524194Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2605.27209"},"observation_digest":"sha256:7d9403302f62f1eeb7dd6a65c26cbdd44909490ab72a32f41d312e609b0956a0","observation_id":"c280ebd1-32be-4256-a36c-38317269654f","resolution":{"observed_at":"2026-06-29T16:53:40.485548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2605.28775","last_updated":"2026-05-27T17:37:00Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:37:00Z","title":"Learn from Weaknesses: Automated Domain Specialization for Small Computer-Use Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T14:15:55.180284Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2605.28775"},"observation_digest":"sha256:9dbefc0ce1ba23505e404a63be240f849b01acb4995aa5d0558ff3221140484d","observation_id":"465c0c7f-110c-41a7-8dd9-56c9b0b2ffa3","resolution":{"observed_at":"2026-06-29T14:23:30.930994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.01581","last_updated":"2026-06-01T02:26:39Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T02:26:39Z","title":"Agent System Operations: Categorization, Challenges, and Future Directions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T12:14:21.322860Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.01581"},"observation_digest":"sha256:6a58b2e1b780681f9b0372fa8a86dc8ed20852a0af55215873d0dfd39c7271cf","observation_id":"0255e5ca-c9ab-478c-997a-1620b4704b82","resolution":{"observed_at":"2026-07-02T01:16:24.960638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.10507","last_updated":"2026-06-09T07:35:14Z","snapshot_observed_at":"2026-08-05T06:17:13.116592Z","submitted_at":"2026-06-09T07:35:14Z","title":"HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T13:04:28.758614Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.10507"},"observation_digest":"sha256:c1847ec3f6e97ff145f4ab7c67db2accf3c8842f34021ee4ef8a74b4b34afff8","observation_id":"df35d8ce-acec-4f5e-9f04-c505f631a1b5","resolution":{"observed_at":"2026-07-03T05:47:41.660750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":285,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:67e5314f217ad567ccb1dfe8e138fe12e53b4446074477d5748b30dc579e0974","observation_id":"e8c4f43d-36dc-4651-a696-660148e50156","resolution":{"observed_at":"2026-06-27T09:50:48.540036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.17628","last_updated":"2026-06-16T07:33:53Z","snapshot_observed_at":"2026-08-05T17:08:33.405254Z","submitted_at":"2026-06-16T07:33:53Z","title":"OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation","version":1},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-06-27T01:07:49.603969Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.17628"},"observation_digest":"sha256:d0f20028851a7e075d07c5b8a0f44ae8c3f1dc6983003ba09e55b32953bb238d","observation_id":"4b8f4369-4b4a-45bf-a075-4a9fb3033cb8","resolution":{"observed_at":"2026-07-03T20:48:56.469629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.21740","last_updated":"2026-06-19T20:53:10Z","snapshot_observed_at":"2026-08-01T23:24:43.869329Z","submitted_at":"2026-06-19T20:53:10Z","title":"Training the Orchestrator: A Supervised Approach to End-to-End PDDL Planning with LLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-26T13:56:51.914966Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.21740"},"observation_digest":"sha256:7884be98ce7d99fe4ba7e07fe56448f788361f05c40798dc8fd158ddb124919b","observation_id":"a7b3a7f0-21cc-44b3-bd62-fe69125b1956","resolution":{"observed_at":"2026-07-04T06:59:38.168063Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":"2403.02502","doi":"10.48550/arxiv.2403.02502","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents","venue":"arXiv (Cornell University)","work_id":"e9f4e923-14da-4180-9f84-15011e539433","year":2024},"citing_paper":{"arxiv_id":"2606.22385","last_updated":"2026-06-21T08:22:23Z","snapshot_observed_at":"2026-08-01T18:23:09.613202Z","submitted_at":"2026-06-21T08:22:23Z","title":"MetaPS: Adaptive Programmatic Strategy Selection for Market Agents","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-26T11:06:28.690956Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2606.22385"},"observation_digest":"sha256:54e16a3de2dbd43e93b3328ce57c1d4712f8476f63aae2c29ec11ef7df36c807","observation_id":"b3c80fb3-719f-4334-8921-b1545b440c14","resolution":{"observed_at":"2026-07-04T08:39:42.730106Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-07-14T10:33:54.851493Z","title":"Trial and error: Exploration-based trajectory optimization for LLM agents.arXiv preprint arXiv:2403.02502, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10601","last_updated":"2026-07-12T06:38:55Z","snapshot_observed_at":"2026-08-06T23:48:50.589215Z","submitted_at":"2026-07-12T06:38:55Z","title":"Agentic-DPO: From Imitation to Agentic Policy Optimization on Expert Trajectories","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T10:33:54.851493Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2607.10601"},"observation_digest":"sha256:7af7d939747877afdf321918543cb0c1bfcb5ed43a49b9437f937a77df181dec","observation_id":"9e11918f-c40e-4fcf-9e2c-4f56c9e8a377","resolution":{"observed_at":"2026-07-14T10:33:54.851493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-07-31T00:46:11.219569Z","title":"Trial and error: Exploration-based trajectory optimization for llm agents.arXiv preprint arXiv:2403.02502, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27443","last_updated":"2026-07-29T20:14:43Z","snapshot_observed_at":"2026-08-06T07:25:46.863771Z","submitted_at":"2026-07-29T20:14:43Z","title":"Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T00:46:11.219569Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2607.27443"},"observation_digest":"sha256:75a27eb62aafed5e87a801a225b3a235d5769d9025c5edf9fdfe1427bf0d6bf5","observation_id":"e4d25527-dbe6-4bf0-8e64-2cf2c4db6b9d","resolution":{"observed_at":"2026-07-31T00:46:11.219569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.02502/citation-record","integrity":"/paper/2403.02502/integrity","json":"/paper/2403.02502/citation-record.json","paper":"/paper/2403.02502"},"outbound":[],"paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2403.02502."}