{"as_of":"2026-08-10T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1331bef184606c9d0c16316bae3888422eefab120e2123ba72998aa547b32f7a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":74,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:56:00.193783Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":6,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"reference_index":247,"source":"pdf_text","source_observed_at":"2026-05-17T00:57:26.303195Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2401.05459"},"observation_digest":"sha256:c0b31d9d1e14a8669a36b48291587992b6deb86f662c8458f7c68205c898f4d0","observation_id":"b87ab206-5067-4d51-9903-e4393ce36fea","resolution":{"observed_at":"2026-05-17T00:57:26.697334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2502.00955","last_updated":"2026-04-24T08:45:39Z","snapshot_observed_at":"2026-07-06T20:29:55.352526Z","submitted_at":"2025-02-02T23:20:16Z","title":"Efficient Multi-Agent System Training with Data Influence-Oriented Tree Search","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T04:06:23.521344Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.00955"},"observation_digest":"sha256:c8f3899b5bb5cdfc7143703ca31f9a22aba3ad00c961d72e206ec730f0babea1","observation_id":"646dde47-932f-4ed0-aa43-f7185d9a3607","resolution":{"observed_at":"2026-05-23T04:07:30.575127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-09T14:56:00.193783Z","title":"FireAct : Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01600","last_updated":"2025-03-08T05:23:57Z","snapshot_observed_at":"2026-08-09T14:48:44.975426Z","submitted_at":"2025-02-03T18:35:42Z","title":"Reinforcement Learning for Long-Horizon Interactive LLM Agents","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T14:56:00.193783Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.01600"},"observation_digest":"sha256:6d28e2513b7ca23e8cdcb98a62e70ef225247d8ba297b7842fbd25b5d0ebd84e","observation_id":"e48f99d2-9cf3-4d39-a050-74ea028dfc96","resolution":{"observed_at":"2026-08-09T14:56:00.193783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-09T11:47:31.226178Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02584","last_updated":"2025-02-04T18:58:31Z","snapshot_observed_at":"2026-08-09T11:38:31.414567Z","submitted_at":"2025-02-04T18:58:31Z","title":"QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T11:47:31.226178Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.02584"},"observation_digest":"sha256:16f2b6e73bf2757b20eec81087d9de41d6cb5b1043478053d34b39bdf150a963","observation_id":"6c105d71-7338-46c5-8849-cc86c692f7be","resolution":{"observed_at":"2026-08-09T11:47:31.226178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-08T21:58:39.413359Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04686","last_updated":"2025-06-18T03:24:18Z","snapshot_observed_at":"2026-08-08T21:49:25.291616Z","submitted_at":"2025-02-07T06:19:55Z","title":"Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T21:58:39.413359Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.04686"},"observation_digest":"sha256:82d64be0942a6b48920f19da749de00e1bea1b291418c52e8b7215f9294672ed","observation_id":"44a6eb19-835b-4422-8264-9a3c50ab297f","resolution":{"observed_at":"2026-08-08T21:58:39.413359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-08T15:01:44.601401Z","title":"In Interna- tional Conference on Learning Representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06589","last_updated":"2025-02-10T15:54:34Z","snapshot_observed_at":"2026-08-08T14:54:47.144621Z","submitted_at":"2025-02-10T15:54:34Z","title":"Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T15:01:44.601401Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.06589"},"observation_digest":"sha256:3a39d5fcff82e9084ddbcb7eb094ca963acddaad767483f9b8e22de0b3761845","observation_id":"47799336-aff9-4f60-b8de-51c448c20082","resolution":{"observed_at":"2026-08-08T15:01:44.601401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-08T14:24:50.313595Z","title":"Fireact: Toward language agent fine-tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.313595Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a9fea9f0a803ebf9b63cb2cbce6ba5b471c49dd764575f259bd9b0463bbd9ce5","observation_id":"f718996a-ad8b-406c-8ffd-65ecf8b4eb47","resolution":{"observed_at":"2026-08-08T14:24:50.313595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T20:57:48.380397Z","title":"William Chen, Oier Mees, Aviral Kumar, and Sergey Levine","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.15760","last_updated":"2025-02-13T18:55:14Z","snapshot_observed_at":"2026-08-07T22:34:53.289352Z","submitted_at":"2025-02-13T18:55:14Z","title":"Digi-Q: Learning Q-Value Functions for Training Device-Control Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T20:57:48.380397Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.15760"},"observation_digest":"sha256:91344c310f81f60450e18f0f444130b9de9b84888fcff827144af901b574f93e","observation_id":"22b0482f-0f63-45dc-9219-3a0fb7b7248f","resolution":{"observed_at":"2026-08-07T20:57:48.380397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T14:56:15.384955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17218","last_updated":"2025-05-22T18:48:09Z","snapshot_observed_at":"2026-08-07T22:35:14.747287Z","submitted_at":"2025-05-22T18:48:09Z","title":"Effective Reinforcement Learning for Reasoning in Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:56:15.384955Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.17218"},"observation_digest":"sha256:de8c53a5cbc8f0bcc511c14fcff13d40ae293f091f918ab1a8f1dd245c2a45f4","observation_id":"3a52da57-1d21-4abd-889f-50538f316495","resolution":{"observed_at":"2026-08-07T14:56:15.384955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T14:11:51.825888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19683","last_updated":"2025-05-26T08:44:53Z","snapshot_observed_at":"2026-08-08T09:25:43.689145Z","submitted_at":"2025-05-26T08:44:53Z","title":"Large Language Models for Planning: A Comprehensive and Systematic Survey","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:11:51.825888Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.19683"},"observation_digest":"sha256:b6ace3e96ac8f3418e722b75bbdad5ce51e0ae462265b1e0f40fc86f7ed8cfb8","observation_id":"9d59dde0-aa66-4377-b779-ff008ad7da81","resolution":{"observed_at":"2026-08-07T14:11:51.825888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T14:10:02.785697Z","title":"FireAct : Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19761","last_updated":"2025-05-26T09:43:40Z","snapshot_observed_at":"2026-08-08T14:44:28.492358Z","submitted_at":"2025-05-26T09:43:40Z","title":"Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:10:02.785697Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.19761"},"observation_digest":"sha256:a1e575299fa867aa463a059aa5357bb1daa300e55695332d82c0eccc8573de56","observation_id":"4e07b629-aa8e-4ecc-a5f4-db57fc4ab08d","resolution":{"observed_at":"2026-08-07T14:10:02.785697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T14:06:53.740452Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.740452Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:e2057712362296205e16855500f5b0f33b32226ced008800ee5f3b6e643467e0","observation_id":"24ba30b1-3a1a-4744-9b32-ffb030550847","resolution":{"observed_at":"2026-08-07T14:06:53.740452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T13:53:02.795247Z","title":"Fireact: Toward language agent fine-tuning.arXiv preprint arXiv:2310.05915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20732","last_updated":"2025-05-27T05:21:04Z","snapshot_observed_at":"2026-08-07T13:45:29.055916Z","submitted_at":"2025-05-27T05:21:04Z","title":"SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:02.795247Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.20732"},"observation_digest":"sha256:036757c2a0962ca35234b1e28a3ed8ade2ab319a1aeda47736dcd8a3b93bd0f7","observation_id":"acce814c-6101-497e-8130-b2be289ae051","resolution":{"observed_at":"2026-08-07T13:53:02.795247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T13:51:41.263415Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20737","last_updated":"2025-05-27T05:27:54Z","snapshot_observed_at":"2026-08-09T16:02:11.744109Z","submitted_at":"2025-05-27T05:27:54Z","title":"RRO: LLM Agent Optimization Through Rising Reward Trajectories","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:41.263415Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.20737"},"observation_digest":"sha256:87056dc985a8d8f4daa550204179d1318db92f86a3c63eb058a30c20d7ed832f","observation_id":"34e23431-e069-445d-90ab-5951361985e9","resolution":{"observed_at":"2026-08-07T13:51:41.263415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T13:45:30.856512Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21055","last_updated":"2025-05-27T11:44:50Z","snapshot_observed_at":"2026-08-08T14:22:29.419644Z","submitted_at":"2025-05-27T11:44:50Z","title":"Agent-Environment Alignment via Automated Interface Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:30.856512Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.21055"},"observation_digest":"sha256:98593f6bbb8041a607690d62c7271eb83cccaba6afcf501a86d4e06c7af8d96c","observation_id":"e42a0d3b-5c02-40f9-8b20-fe1b05831de5","resolution":{"observed_at":"2026-08-07T13:45:30.856512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T13:08:59.724999Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22648","last_updated":"2025-08-10T06:05:46Z","snapshot_observed_at":"2026-08-07T13:00:07.473210Z","submitted_at":"2025-05-28T17:57:07Z","title":"WebDancer: Towards Autonomous Information Seeking Agency","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:08:59.724999Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.22648"},"observation_digest":"sha256:fd6b06e26cf6f71ceb7392afa4888d7d179176ffd21bd50684f46cdf761bb0c4","observation_id":"05a885bf-085a-4741-89e4-742cb11aae9e","resolution":{"observed_at":"2026-08-07T13:08:59.724999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T12:42:31.904774Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23885","last_updated":"2025-06-11T01:42:53Z","snapshot_observed_at":"2026-08-07T22:31:50.319614Z","submitted_at":"2025-05-29T17:51:58Z","title":"OWL: Optimized Workforce Learning for General Multi-Agent Assistance in Real-World Task Automation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:31.904774Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.23885"},"observation_digest":"sha256:14bf3bed42c3f81942fe78869b8a3fab418fb12363fbae23771478b02453edfd","observation_id":"da351dd0-93da-4672-b144-ced5533be68a","resolution":{"observed_at":"2026-08-07T12:42:31.904774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T11:47:00.567143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-09T08:52:49.525081Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.567143Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:f665546937325f70e85c0ac39b1437003f4ed5cfe2ea5a26d4bc9569ad1b9e79","observation_id":"622a48e0-de72-472a-a0c6-f43cbd5a0d5a","resolution":{"observed_at":"2026-08-07T11:47:00.567143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T11:30:54.902423Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02298","last_updated":"2025-06-02T22:36:02Z","snapshot_observed_at":"2026-08-08T17:41:53.481929Z","submitted_at":"2025-06-02T22:36:02Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:54.902423Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.02298"},"observation_digest":"sha256:b394463c6773770a225d7c460ea2033d09db1d372935304019d12b7a9d2c7c66","observation_id":"7722ca1e-4be8-49b1-b8d0-65aaa2cb1e06","resolution":{"observed_at":"2026-08-07T11:30:54.902423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2506.03610","last_updated":"2026-04-14T22:54:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-04T06:40:33Z","title":"Orak: A Foundational Benchmark for Training and Evaluating LLM Agents on Diverse Video Games","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T12:01:42.681135Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.03610"},"observation_digest":"sha256:f8a654d35943f5d8eb46883621f25f1501194c1f4c85e60f42653f993f24bbe9","observation_id":"5753f9fc-d847-4e26-a0c5-593e07aa9abe","resolution":{"observed_at":"2026-05-19T12:02:16.630032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T11:03:25.898272Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:25.898272Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:a1865c41e211d582a4cfa02ec6dea0059df6f16e48153c4b8e2553c76bde66be","observation_id":"1ac41ca7-a31c-4ac2-885e-2f056241fcbe","resolution":{"observed_at":"2026-08-07T11:03:25.898272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T22:36:42.146724Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21252","last_updated":"2025-06-26T13:36:12Z","snapshot_observed_at":"2026-08-09T23:15:45.208022Z","submitted_at":"2025-06-26T13:36:12Z","title":"Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T22:36:42.146724Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.21252"},"observation_digest":"sha256:61abc23cfc711f2e18c9502cc48215f5ebc18b12865317f7dbdb27b92371240c","observation_id":"cfbb0d56-e472-4344-ab30-6a7a09779e7c","resolution":{"observed_at":"2026-08-06T22:36:42.146724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T21:59:59.720213Z","title":"Fireact: Toward language agent fine- tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22852","last_updated":"2025-06-28T11:26:31Z","snapshot_observed_at":"2026-08-08T06:43:28.096284Z","submitted_at":"2025-06-28T11:26:31Z","title":"Knowledge Augmented Finetuning Matters in both RAG and Agent Based Dialog Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:59.720213Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.22852"},"observation_digest":"sha256:7fdc4881a1df9342b6ff3465a768b9b49c8c1d4146d8311f331218a7528a73b9","observation_id":"57d5bf82-b0ed-40e6-a1f0-041237f1d47e","resolution":{"observed_at":"2026-08-06T21:59:59.720213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T21:55:00.459541Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23127","last_updated":"2025-06-29T07:31:24Z","snapshot_observed_at":"2026-08-09T05:53:21.859449Z","submitted_at":"2025-06-29T07:31:24Z","title":"Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:55:00.459541Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.23127"},"observation_digest":"sha256:cf8fb02167e012baac46a0f746e0bceaa3190681f137da62881c830044525bfc","observation_id":"92f03b00-374b-4a14-9c7c-068dcff9429b","resolution":{"observed_at":"2026-08-06T21:55:00.459541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-08-09T01:03:55.193390Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T15:37:09.572241Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2507.02592"},"observation_digest":"sha256:4a657dc480d1cba8ef671447ee8219949bced36f99381ec89219b24422ba5032","observation_id":"dfcb3673-566d-4a51-bd5f-6caf64e3b635","resolution":{"observed_at":"2026-05-17T15:37:09.609424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T18:47:19.417248Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07441","last_updated":"2025-08-20T22:10:48Z","snapshot_observed_at":"2026-08-09T10:40:54.885700Z","submitted_at":"2025-07-10T05:38:15Z","title":"SAND: Boosting LLM Agents with Self-Taught Action Deliberation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:47:19.417248Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2507.07441"},"observation_digest":"sha256:0eb2c1fa8d34283c06791249a99a6d13e2ea0b36daa854c50d8d7b3404efabbd","observation_id":"4ece5b4b-0d92-46bc-a299-ae61de169c11","resolution":{"observed_at":"2026-08-06T18:47:19.417248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T14:33:53.491820Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18775","last_updated":"2025-07-24T19:57:18Z","snapshot_observed_at":"2026-08-08T23:42:02.495411Z","submitted_at":"2025-07-24T19:57:18Z","title":"Initial Steps in Integrating Large Reasoning and Action Models for Service Composition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:33:53.491820Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2507.18775"},"observation_digest":"sha256:f321eccfd3cc76654c4216b504a1809b031af8f6d60561c1b98f4c41c6710c68","observation_id":"a6f50084-356e-42ed-b398-20cf7978c4cf","resolution":{"observed_at":"2026-08-06T14:33:53.491820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-06T12:18:31.887391Z","title":"Fireact: Toward lan- guage agent fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21924","last_updated":"2025-07-29T15:39:14Z","snapshot_observed_at":"2026-08-09T07:14:16.143343Z","submitted_at":"2025-07-29T15:39:14Z","title":"MMAT-1M: A Large Reasoning Dataset for Multimodal Agent Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:18:31.887391Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2507.21924"},"observation_digest":"sha256:f6f2acc99d1a4b5cafc1a5b53f9ca95954fbc1e276d5f042e938ac3d2acc3e51","observation_id":"3baeeb8c-e4ef-4928-8cff-4e32bae54d62","resolution":{"observed_at":"2026-08-06T12:18:31.887391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:1a432e52be442d0d7ff1e1038b916c21019705df96e99f1597c88fd53a87bb57","observation_id":"7d149853-178e-4757-a71c-fdf5f94f7ea8","resolution":{"observed_at":"2026-05-18T19:21:48.752794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-04T18:50:10.443190Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09629","last_updated":"2025-09-11T17:15:45Z","snapshot_observed_at":"2026-08-08T13:47:15.540980Z","submitted_at":"2025-09-11T17:15:45Z","title":"Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T18:50:10.443190Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2509.09629"},"observation_digest":"sha256:f20edcafb4e8e4c9faa7c94ff2b9c83078d9f980ad8f4a64005f6d437e518177","observation_id":"233947b3-af51-43fb-aa22-d60d4dd230e7","resolution":{"observed_at":"2026-08-04T18:50:10.443190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2511.11362","last_updated":"2026-05-05T10:40:45Z","snapshot_observed_at":"2026-07-06T22:35:51.341917Z","submitted_at":"2025-11-14T14:46:29Z","title":"On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T22:03:53.594703Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2511.11362"},"observation_digest":"sha256:9657305f5d72acafda558b5ffbed529c557f34c3fc660a3a863a5583eb23b19c","observation_id":"c363136c-8b56-418e-a591-d3f89be6daf9","resolution":{"observed_at":"2026-05-17T22:05:21.475359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-03T18:48:57.657515Z","title":"Fireact: Toward lan- guage agent fine-tuning.arXiv preprint arXiv:2310.05915,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.03627","last_updated":"2026-06-02T03:13:58Z","snapshot_observed_at":"2026-08-03T18:48:56.892789Z","submitted_at":"2025-12-03T10:06:14Z","title":"MemVerse: Multimodal Memory for Lifelong Learning Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T18:48:57.657515Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2512.03627"},"observation_digest":"sha256:51cbc9567bde0df4ea9e4c7accee1960427820e90dc4b651043cb1aaad0f920f","observation_id":"a703daeb-00fa-40df-9da0-698878cdb6e4","resolution":{"observed_at":"2026-08-03T18:48:57.657515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-03T11:44:05.540078Z","title":"Nuo Chen, Zinan Zheng, Ning Wu, Ming Gong, Dong- mei Zhang, and Jia Li","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.05366","last_updated":"2026-06-28T19:14:17Z","snapshot_observed_at":"2026-08-08T02:37:22.393269Z","submitted_at":"2026-01-08T20:44:28Z","title":"Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T11:44:05.540078Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2601.05366"},"observation_digest":"sha256:e49ba5c2b1e7beb73e847cb3af344041147abd5a4624264aca2000d695d81186","observation_id":"701c787b-a889-4547-acf4-0b55d6b846b8","resolution":{"observed_at":"2026-08-03T11:44:05.540078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2602.20867","last_updated":"2026-02-24T13:11:38Z","snapshot_observed_at":"2026-08-07T21:03:43.270322Z","submitted_at":"2026-02-24T13:11:38Z","title":"SoK: Agentic Skills -- Beyond Tool Use in LLM Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-14T23:19:31.024268Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2602.20867"},"observation_digest":"sha256:4575f1d619c1060489fab2e4ea8948ee3fc0a357796ca12f8f0c032e8c21257d","observation_id":"215a4d4b-b014-49a7-b769-75b812a26f03","resolution":{"observed_at":"2026-05-14T23:19:31.175043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.06370","last_updated":"2026-04-07T18:52:25Z","snapshot_observed_at":"2026-08-08T21:24:58.736715Z","submitted_at":"2026-04-07T18:52:25Z","title":"ForkKV: Scaling Multi-LoRA Agent Serving via Copy-on-Write Disaggregated KV Cache","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:16:49.292491Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.06370"},"observation_digest":"sha256:4a73f0f9c5a975e87e0d0032f054f92db664f6b0aa97365b5e21107c6139e3c3","observation_id":"a2334525-f988-410c-bc05-b0a5cb16df15","resolution":{"observed_at":"2026-05-11T05:10:54.920774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.08000","last_updated":"2026-04-09T09:06:13Z","snapshot_observed_at":"2026-07-06T22:57:13.745326Z","submitted_at":"2026-04-09T09:06:13Z","title":"PASK: Toward Intent-Aware Proactive Agents with Long-Term Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:05:40.242925Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.08000"},"observation_digest":"sha256:5d4ae53473561dd712d118538f3401f5c4038b1719342c4e9f283a5981e44459","observation_id":"ebdc028a-c5d4-46cc-9c4e-61c78c258e34","resolution":{"observed_at":"2026-05-11T05:30:59.754002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.23194","last_updated":"2026-04-25T07:54:23Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T07:54:23Z","title":"From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-08T08:10:36.579810Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.23194"},"observation_digest":"sha256:af348506862c2beaf392e76482c7fda981a2e0649374c6900b9ab87a0533314f","observation_id":"b0613023-41f0-471c-990b-2b4ecff093f3","resolution":{"observed_at":"2026-05-11T20:46:10.623340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T06:30:09.945371Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:b5b978f54fa6d3e9ce7960f6a8eb285e21e0910882d49826a7e712212eded494","observation_id":"d76db5ba-0679-41f7-aad1-bd04ba976c6a","resolution":{"observed_at":"2026-05-12T10:21:29.906759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T03:12:19.414358Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:c51579d1ae7e93d401f0b2ff1745372b20b3e92d568e8c367c739021ded512ed","observation_id":"0cfc38ba-4da7-40ec-b7a5-cd2a40a62e60","resolution":{"observed_at":"2026-05-11T22:11:17.132850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T16:58:41.558250Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:9f65e7d864f94a2373c6fd875b80a532520d041820df7326df7c4998c1f4771a","observation_id":"2816bf74-7e82-4ed4-bfc5-c5539c5ab24a","resolution":{"observed_at":"2026-05-19T17:02:40.660252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.07725","last_updated":"2026-08-03T03:33:59Z","snapshot_observed_at":"2026-08-09T22:35:00.024991Z","submitted_at":"2026-05-08T13:30:42Z","title":"SOD: Step-wise On-policy Distillation for Small Language Model Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T02:25:59.056181Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.07725"},"observation_digest":"sha256:e981a5d6abb5a16d1cb5be0b67220fff5ef5229c98056d46895cdf1646e66127","observation_id":"414876f4-f394-4d5f-ae80-fb49c6d560d0","resolution":{"observed_at":"2026-05-11T03:40:54.506607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-04T05:20:45.134981Z","title":"Fireact: Toward language agent fine-tuning.arXiv preprint arXiv:2310.05915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.07725","last_updated":"2026-08-03T03:33:59Z","snapshot_observed_at":"2026-08-09T22:35:00.024991Z","submitted_at":"2026-05-08T13:30:42Z","title":"SOD: Step-wise On-policy Distillation for Small Language Model Agents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T05:20:45.134981Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.07725"},"observation_digest":"sha256:da5fc9429899a9928b14997d9157160e081198a3bf3e7bdd45d607f418acfe4b","observation_id":"a76083b1-83e4-42ea-9057-87b5a5a12829","resolution":{"observed_at":"2026-08-04T05:20:45.134981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.08013","last_updated":"2026-05-08T17:02:31Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:02:31Z","title":"Learning CLI Agents with Structured Action Credit under Selective Observation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T02:59:26.100818Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.08013"},"observation_digest":"sha256:865a8df2abe9caf75bab9993851f4d16ca6aa6169a693fbfbe3e090cf65223d3","observation_id":"c713480d-1da4-4114-941f-bc60dfa7ca11","resolution":{"observed_at":"2026-05-11T03:00:56.420074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.10118","last_updated":"2026-05-11T07:34:30Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:34:30Z","title":"Plan in Sandbox, Navigate in Open Worlds: Learning Physics-Grounded Abstracted Experience for Embodied Navigation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-12T03:36:24.941205Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.10118"},"observation_digest":"sha256:2f16004cf5ec2f3b728630bbcf72f487dc34dc344c0af2aad828fadb6e6c24fe","observation_id":"e71c9f61-b55d-40a9-ad30-20bcc08b828b","resolution":{"observed_at":"2026-05-12T07:11:27.660465Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.10325","last_updated":"2026-05-27T13:12:06Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:30:53Z","title":"Verifiable Process Rewards for Agentic Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:59:44.082011Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.10325"},"observation_digest":"sha256:dd1b5eb73c658fa6b20d6afb421d9fb3e5bc6c9b2a9edd95c6c38cdc9b6d2a07","observation_id":"3701cabe-b463-4441-948b-0692179f4b81","resolution":{"observed_at":"2026-05-12T05:46:27.390166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.10325","last_updated":"2026-05-27T13:12:06Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:30:53Z","title":"Verifiable Process Rewards for Agentic Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T22:43:50.317854Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.10325"},"observation_digest":"sha256:cf59beb2f48d7622609933ac6371d821738f4fa5d1f6299df57281aac322dcf3","observation_id":"972a20b1-7617-496f-a8cf-7bf7c87c0396","resolution":{"observed_at":"2026-06-30T22:45:07.256818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.10999","last_updated":"2026-05-09T19:24:11Z","snapshot_observed_at":"2026-08-03T03:14:48.667015Z","submitted_at":"2026-05-09T19:24:11Z","title":"SkillGen: Verified Inference-Time Agent Skill Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T06:14:28.614825Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.10999"},"observation_digest":"sha256:d738e327018d5557c3cda8ad99883c8e1e148046400f3fd3bab2893acd837769","observation_id":"50bf99b1-d234-4603-9715-a2fd78b34f04","resolution":{"observed_at":"2026-05-13T06:17:23.043506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.14133","last_updated":"2026-05-18T05:36:27Z","snapshot_observed_at":"2026-07-06T23:25:34.835136Z","submitted_at":"2026-05-13T21:34:08Z","title":"ClawForge: Generating Executable Interactive Benchmarks for Command-Line Agents","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-15T05:08:15.750558Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.14133"},"observation_digest":"sha256:4f99a18e3139241cc9396d0abe444bdbe686c90594683cce077c1d7699d66fb8","observation_id":"d945513a-b9ff-4c3d-8ce0-3cf7ca4ee900","resolution":{"observed_at":"2026-05-15T05:09:45.136629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.14133","last_updated":"2026-05-18T05:36:27Z","snapshot_observed_at":"2026-07-06T23:25:34.835136Z","submitted_at":"2026-05-13T21:34:08Z","title":"ClawForge: Generating Executable Interactive Benchmarks for Command-Line Agents","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-20T20:19:21.824216Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.14133"},"observation_digest":"sha256:93f6c817ef4063870a915d571c61a0a289645ea81c4f40825a066bc532a3be2a","observation_id":"03da1012-3696-4a93-90a2-e6fa14d1f4d9","resolution":{"observed_at":"2026-05-20T20:23:43.246128Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.15207","last_updated":"2026-07-08T14:36:15Z","snapshot_observed_at":"2026-07-12T17:52:34.996306Z","submitted_at":"2026-05-01T23:42:57Z","title":"TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-19T18:01:06.649723Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.15207"},"observation_digest":"sha256:b7e61efc6f4d934285a70a4059695cf482ee51f44fd98d0c66a2ff2557d8dff6","observation_id":"7c719705-040b-4d02-826f-e8d9c0595458","resolution":{"observed_at":"2026-05-19T18:02:42.288078Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.17352","last_updated":"2026-05-17T09:45:24Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:45:24Z","title":"AMATA: Adaptive Multi-Agent Trajectory Alignment for Knowledge-Intensive Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T13:43:42.097447Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.17352"},"observation_digest":"sha256:5be87dbf0877f0a3fd00cf8a4fb69a3c1eacbdd6b0f55a243ab8c28cbb813d8e","observation_id":"37d965ed-ee2c-4c4d-87e8-d9aac2c260eb","resolution":{"observed_at":"2026-05-20T13:48:19.927143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.22502","last_updated":"2026-05-21T13:54:11Z","snapshot_observed_at":"2026-07-06T23:32:49.530788Z","submitted_at":"2026-05-21T13:54:11Z","title":"Compiling Agentic Workflows into LLM Weights: Near-Frontier Quality at Two Orders of Magnitude Less Cost","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-22T06:26:31.841138Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.22502"},"observation_digest":"sha256:659f141a9efb23cab515815f8646f847935579352493511558f95776229cf294","observation_id":"bf1dca57-c7ec-4bf1-a977-a4b09a47e521","resolution":{"observed_at":"2026-05-22T06:31:10.437580Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.24828","last_updated":"2026-05-31T15:58:08Z","snapshot_observed_at":"2026-08-03T07:25:06.734747Z","submitted_at":"2026-05-24T02:41:44Z","title":"Test-Time Deep Thinking to Explore Implicit Rules","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:15.163893Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.24828"},"observation_digest":"sha256:f696721b401b7b3d4a1554e010356cd93fd14e8aeecc82cd06742a3bbe27e303","observation_id":"87fd8886-651e-4c1b-9b21-1a64611edfbf","resolution":{"observed_at":"2026-06-30T11:54:38.220238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2605.28774","last_updated":"2026-05-27T17:36:39Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:36:39Z","title":"Agent Explorative Policy Optimization for Multimodal Agentic Reasoning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-29T12:22:39.655615Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2605.28774"},"observation_digest":"sha256:56e6c8795a47b0aead2f0ec7ce153c1148a2f393deccebc709854e3ac039aa7d","observation_id":"38045e09-7dbd-448d-89d7-bdbc8e7d98c3","resolution":{"observed_at":"2026-06-29T12:23:23.735371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-08-06T05:25:08.076791Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:bfe75f9080b05f18f6d7de6c444e0db3f88c19fa8ceed83ec4fc6dd9e86612c4","observation_id":"64d64355-8c2a-4094-8ea1-bf6143d4dfe2","resolution":{"observed_at":"2026-07-01T23:16:24.848399Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.04120","last_updated":"2026-06-02T18:31:50Z","snapshot_observed_at":"2026-08-07T09:03:44.555899Z","submitted_at":"2026-06-02T18:31:50Z","title":"SaliMory: Orchestrating Cognitive Memory for Conversational Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:09:26.995556Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.04120"},"observation_digest":"sha256:b9e5dc14dae9dc52f19d10b4ab36e8789d98b4f32e9ebffcc3e4e79e48fea46f","observation_id":"71ae13f4-84af-4eac-86d7-6e31862d9f7f","resolution":{"observed_at":"2026-07-02T03:16:31.723007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.07367","last_updated":"2026-06-05T15:09:52Z","snapshot_observed_at":"2026-08-04T14:57:01.386223Z","submitted_at":"2026-06-05T15:09:52Z","title":"Self-evolving LLM agents with in-distribution Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T22:18:27.021136Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.07367"},"observation_digest":"sha256:4a003e238d25a191eca3b5c4508de67e9d96b2738f8873491039a730c949375e","observation_id":"ee620fc9-0804-4521-bc91-bd3ab31fbd65","resolution":{"observed_at":"2026-07-02T16:57:09.540367Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.12674","last_updated":"2026-06-10T21:01:06Z","snapshot_observed_at":"2026-08-07T16:47:48.814296Z","submitted_at":"2026-06-10T21:01:06Z","title":"Evoflux: Inference-Time Evolution of Executable Tool Workflows for Compact Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T09:46:59.954720Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.12674"},"observation_digest":"sha256:7d64abf6fefef2e7a2fbede9f16fbf59fc875ca97abac5aa05613906fa356f1f","observation_id":"93edcb76-e681-48db-94cb-a54fbdee09f9","resolution":{"observed_at":"2026-06-27T09:50:48.183424Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.21740","last_updated":"2026-06-19T20:53:10Z","snapshot_observed_at":"2026-08-01T23:24:43.869329Z","submitted_at":"2026-06-19T20:53:10Z","title":"Training the Orchestrator: A Supervised Approach to End-to-End PDDL Planning with LLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T13:56:51.914966Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.21740"},"observation_digest":"sha256:a20fd04e96774a016b4ddec1f532d1376ee7bc25822cdf717e72e5c491ce5685","observation_id":"d2f72c89-7104-4a4b-a26a-624139ce3b11","resolution":{"observed_at":"2026-07-04T06:59:38.128661Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.24893","last_updated":"2026-05-29T22:40:51Z","snapshot_observed_at":"2026-08-06T12:10:12.860370Z","submitted_at":"2026-05-29T22:40:51Z","title":"AgentOdyssey: Open-Ended Long-Horizon Text Game Generation for Test-Time Continual Learning Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T21:59:25.449570Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.24893"},"observation_digest":"sha256:17c077eda0ede9796da8b0950e315d109608d1645e5b6d88e963d4e2571c5c71","observation_id":"698a2d61-ed51-475a-b800-89780383ac57","resolution":{"observed_at":"2026-07-01T19:46:11.465290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.27147","last_updated":"2026-06-25T15:18:31Z","snapshot_observed_at":"2026-07-07T00:01:24.919835Z","submitted_at":"2026-06-25T15:18:31Z","title":"Safe Autoregressive Image Generation with Iterative Self-Improving Codebooks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T05:51:01.446139Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.27147"},"observation_digest":"sha256:75ce6e72b71203209aa74167046658da8a225ab819cac24e823ea17cda00923c","observation_id":"b5074fd1-6551-4c79-8f50-a25b58c0258c","resolution":{"observed_at":"2026-07-04T12:49:52.879268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.31229","last_updated":"2026-06-30T07:07:51Z","snapshot_observed_at":"2026-08-07T02:12:41.079426Z","submitted_at":"2026-06-30T07:07:51Z","title":"Agentic-Ideation: Sample Efficient Agentic Trajectories Synthesis for Scientific Ideation Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T05:49:52.979376Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.31229"},"observation_digest":"sha256:1e2e90dcb7f7e9104c4795fce7fc2027187b5c38fdd1482b07de72f084131177","observation_id":"8096747b-5fb9-4f05-8ddc-2319995977ba","resolution":{"observed_at":"2026-07-01T10:05:41.381986Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2607.01942","last_updated":"2026-07-02T09:34:20Z","snapshot_observed_at":"2026-07-07T00:07:28.231599Z","submitted_at":"2026-07-02T09:34:20Z","title":"Atomic Task Graph: A Unified Framework for Agentic Planning and Execution","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-03T13:59:31.697155Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.01942"},"observation_digest":"sha256:9124670b3e13fbd76ce14d5d0c592e07bb4c49ee48cf76069f8741b5dd64f489","observation_id":"2444a382-c0b1-40c2-900f-f5c24b58fa44","resolution":{"observed_at":"2026-07-03T14:08:21.353187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-11T10:50:54.419477Z","title":"arXiv preprint arXiv:2310.05915 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04963","last_updated":"2026-07-06T11:50:06Z","snapshot_observed_at":"2026-08-03T04:57:20.508738Z","submitted_at":"2026-07-06T11:50:06Z","title":"STAPO: Selective Trajectory-Aware Policy Optimization for LLM Agent Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-11T10:50:54.419477Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.04963"},"observation_digest":"sha256:ca0465ff6ae9e316d55b3e09871df9828c0fc4442017c77965608adfaeae58ab","observation_id":"56cecc91-1805-4e49-912f-9797b1ea6101","resolution":{"observed_at":"2026-07-11T10:50:54.419477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-13T05:30:10.497783Z","title":"Luyu Gao, Aman Madaan, Shuyan Zhou, Uri Alon, Pengfei Liu, Yiming Yang, Jamie Callan, and Gra- ham Neubig","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08960","last_updated":"2026-07-09T21:51:39Z","snapshot_observed_at":"2026-08-06T13:35:29.038744Z","submitted_at":"2026-07-09T21:51:39Z","title":"Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T05:30:10.497783Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.08960"},"observation_digest":"sha256:50b5312bc4691b4125b23634f31f2f67144979eb08dce3f3b01b1ebdbdf31069","observation_id":"0d8d235e-bea8-4cda-88cc-f30d8bc5c0a4","resolution":{"observed_at":"2026-07-13T05:30:10.497783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-14T10:33:54.851493Z","title":"Fireact: Toward language agent fine-tuning.arXiv preprint arXiv:2310.05915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10601","last_updated":"2026-07-12T06:38:55Z","snapshot_observed_at":"2026-08-06T23:48:50.589215Z","submitted_at":"2026-07-12T06:38:55Z","title":"Agentic-DPO: From Imitation to Agentic Policy Optimization on Expert Trajectories","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T10:33:54.851493Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.10601"},"observation_digest":"sha256:7157ff8bcd82dea76ffb9206f94ec925e0722b80681cad60229b9b52bf43ba14","observation_id":"fadb3a24-6dea-449d-8890-a67f0292a037","resolution":{"observed_at":"2026-07-14T10:33:54.851493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-02T09:45:49.534257Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16257","last_updated":"2026-06-28T08:35:47Z","snapshot_observed_at":"2026-08-09T16:36:39.554256Z","submitted_at":"2026-06-28T08:35:47Z","title":"From Outcomes to Actions: Leveraging Hindsight for Long-Horizon Language Agent Training","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T09:45:49.534257Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.16257"},"observation_digest":"sha256:ad8f8e1d6d34c769460900e0bd3a2383066905efbe1f9e6eed1eab859bbf61e7","observation_id":"0812fa76-c88c-4290-9848-71d20c002f2b","resolution":{"observed_at":"2026-08-02T09:45:49.534257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-02T13:17:10.198084Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21612","last_updated":"2026-05-23T17:06:02Z","snapshot_observed_at":"2026-08-06T07:32:33.105894Z","submitted_at":"2026-05-23T17:06:02Z","title":"Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T13:17:10.198084Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.21612"},"observation_digest":"sha256:57cd91ea5099e28a581f762b44afe86bac3dd5809a4091913440f6a0262446a5","observation_id":"8650e116-c765-4a9c-bdf2-a1b5bc534758","resolution":{"observed_at":"2026-08-02T13:17:10.198084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-02T10:20:56.153236Z","title":"arXiv preprint arXiv:2310.05915 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22643","last_updated":"2026-06-24T02:40:49Z","snapshot_observed_at":"2026-08-08T03:20:50.943223Z","submitted_at":"2026-06-24T02:40:49Z","title":"Reason Before You Retrieve: Agentic Planning for Multi-modal RAG","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-08-02T10:20:56.153236Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.22643"},"observation_digest":"sha256:b9747724b14d5ca3a30b4e7ba3c6761f5ac8934ad421567b8776960b6b36a93f","observation_id":"7bda8c0e-88b7-4aa2-b1f1-f9856096f671","resolution":{"observed_at":"2026-08-02T10:20:56.153236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-01T02:44:29.355941Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25369","last_updated":"2026-07-28T07:25:04Z","snapshot_observed_at":"2026-08-09T19:01:47.867945Z","submitted_at":"2026-07-28T07:25:04Z","title":"ODYSSE: Episode-wise Policy Optimization for Personalized Agentic Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T02:44:29.355941Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.25369"},"observation_digest":"sha256:fbe586c7c7e338781e4054a4dfd1febfc383cb7d9848efdc5d8b4fe32adc17f7","observation_id":"212faca4-28ac-4214-93c4-009490a9726b","resolution":{"observed_at":"2026-08-01T02:44:29.355941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-30T14:30:12.562879Z","title":"arXiv preprint arXiv:2310.05915 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26998","last_updated":"2026-08-04T11:03:49Z","snapshot_observed_at":"2026-08-07T23:11:43.920022Z","submitted_at":"2026-07-29T14:56:31Z","title":"AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-30T14:30:12.562879Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.26998"},"observation_digest":"sha256:6051f0d3b30765de0b4de19e806b3a0132e60f2ce0699844281f42e6d8b14262","observation_id":"5d4c95c5-497b-4e2b-9371-b8e6e72dd8c4","resolution":{"observed_at":"2026-07-30T14:30:12.562879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T04:29:02.267081Z","title":"arXiv preprint arXiv:2310.05915 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26998","last_updated":"2026-08-04T11:03:49Z","snapshot_observed_at":"2026-08-07T23:11:43.920022Z","submitted_at":"2026-07-29T14:56:31Z","title":"AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T04:29:02.267081Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.26998"},"observation_digest":"sha256:910441edb3127be41a94d669bc2c591e4461f3ed88d9e51eb7f55c4286fb179c","observation_id":"5191ba9d-6e22-40fb-8c00-8ee41facf7f3","resolution":{"observed_at":"2026-08-05T04:29:02.267081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-31T00:46:08.879772Z","title":"Fireact: Toward language agent fine-tuning.arXiv preprint arXiv:2310.05915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27443","last_updated":"2026-07-29T20:14:43Z","snapshot_observed_at":"2026-08-06T07:25:46.863771Z","submitted_at":"2026-07-29T20:14:43Z","title":"Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T00:46:08.879772Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.27443"},"observation_digest":"sha256:b9a137c7568456c014e7112aa52286ff27903611a49ac65cff86014adf268ed6","observation_id":"b35807e4-fae5-419d-a086-825e7bb85ae3","resolution":{"observed_at":"2026-07-31T00:46:08.879772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-07-31T12:39:14.155269Z","title":"Fireact: Toward language agent fine-tuning.arXiv preprint arXiv:2310.05915, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28272","last_updated":"2026-07-30T14:25:49Z","snapshot_observed_at":"2026-08-03T00:08:22.361131Z","submitted_at":"2026-07-30T14:25:49Z","title":"MemHarness: Memory Is Reconstructed, Not Replayed","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T12:39:14.155269Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2607.28272"},"observation_digest":"sha256:51233f1b710678f1ec7031812fc668655668d364bce1b698a49f5373bcbc7595","observation_id":"6f20d570-efd7-4c93-ab90-7707693ad3a7","resolution":{"observed_at":"2026-07-31T12:39:14.155269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05915/citation-record","integrity":"/paper/2310.05915/integrity","json":"/paper/2310.05915/citation-record.json","paper":"/paper/2310.05915"},"outbound":[],"paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 74 inbound Pith citation observations for arXiv:2310.05915."}