{"as_of":"2026-08-08T19:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ea0a7aaecfa2a5d65a8076ce54fe090f97418f92258b87d3b46029e4d8169aa","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:32:31.241598Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":8,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-07T10:10:50.201348Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T01:19:32.406859Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2404.07972"},"observation_digest":"sha256:b81dd7e4715546459f68809c7839a3a71cde666195e5a3886ecdfb27d0f074fe","observation_id":"f76ff87a-3d72-4686-8967-5ffdc37f8e4c","resolution":{"observed_at":"2026-05-13T01:19:32.581967Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-13T09:29:27.173784Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2410.23218"},"observation_digest":"sha256:e51ef3e1fb31fba76a1613bf10f423cc9d1eb1e1bcf9d309fd0b02c3643e1e10","observation_id":"8fb94b4b-3c84-4b6a-85c1-06bcb76127a7","resolution":{"observed_at":"2026-05-13T09:29:27.515329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-15T21:20:59.128986Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2501.09686"},"observation_digest":"sha256:0be7bb6706c99c4f8244613e62ca4c256c82c20348b48f8b1d802bc9d5d56c42","observation_id":"f6202b31-7864-4934-af61-b7d2544c0570","resolution":{"observed_at":"2026-05-15T21:20:59.416304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-07T13:32:31.241598Z","title":"Agentboard: An analytical evaluation board of multi-turn LLM agents.CoRR, abs/2401.13178, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21674","last_updated":"2025-05-27T18:51:06Z","snapshot_observed_at":"2026-08-07T23:39:33.909297Z","submitted_at":"2025-05-27T18:51:06Z","title":"Make Planning Research Rigorous Again!","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.241598Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2505.21674"},"observation_digest":"sha256:753d6fc1a25f544d28e43afb3d7f26e127d6714e8f84d435e5d393ecf1024b56","observation_id":"78642a46-cfb1-4bda-b33f-2afb0c9e06cf","resolution":{"observed_at":"2026-08-07T13:32:31.241598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-07T11:30:55.654047Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02298","last_updated":"2025-06-02T22:36:02Z","snapshot_observed_at":"2026-08-08T17:41:53.481929Z","submitted_at":"2025-06-02T22:36:02Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:55.654047Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2506.02298"},"observation_digest":"sha256:b5dd6daecc1237cbe77fff5a3d2b6b7007cdd17b958c1743be87add93a8a65d2","observation_id":"07df1bbd-0184-437d-ac61-5330f2269e25","resolution":{"observed_at":"2026-08-07T11:30:55.654047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2506.04565","last_updated":"2026-05-08T15:50:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T02:34:43Z","title":"From Standalone LLMs to Integrated Intelligence: A Survey of Compound Al Systems","version":2},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-05-19T11:49:36.574471Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2506.04565"},"observation_digest":"sha256:9be5b9cba9941e6c5cbbd606e6bccdd7c2e28d5ddf6d7cb2d6283cd7e5b8a4c6","observation_id":"bc6f3ffc-5f94-4b77-aaed-b64b99c6b270","resolution":{"observed_at":"2026-05-19T11:52:16.228552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-07T05:39:59.063879Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07398","last_updated":"2025-06-16T08:45:10Z","snapshot_observed_at":"2026-08-07T05:32:29.009208Z","submitted_at":"2025-06-09T03:43:46Z","title":"G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:59.063879Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2506.07398"},"observation_digest":"sha256:e181b23ac4cc43821ade7f49edfadbef8d353d2487449d7ae2ce5dcb96c74f03","observation_id":"581b98ec-4edd-4610-96ee-2b871f2fa734","resolution":{"observed_at":"2026-08-07T05:39:59.063879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-07T10:17:47.104695Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-08T16:55:23.964977Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":241,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:47.104695Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:6c20709c86b668a0840cc12aadce2eaeafe0d22338f4d177550db3aeab4573b5","observation_id":"3a1d57a7-a4b6-40c4-a890-fc0c4be9b11a","resolution":{"observed_at":"2026-08-07T10:17:47.104695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T17:11:33.905361Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11527","last_updated":"2025-07-15T17:56:04Z","snapshot_observed_at":"2026-08-07T07:31:40.303264Z","submitted_at":"2025-07-15T17:56:04Z","title":"DrafterBench: Benchmarking Large Language Models for Tasks Automation in Civil Engineering","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T17:11:33.905361Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2507.11527"},"observation_digest":"sha256:9bab835836a34c6329826945c15bd74fad3faf942957400a1a9e6c61dd62a480","observation_id":"d775f98c-79ce-4fda-ab4b-d2fc7398bc4f","resolution":{"observed_at":"2026-08-06T17:11:33.905361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T16:46:00.781635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-08T15:45:26.915616Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.781635Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:c7530a1855b9d3a92bd2dc1960f19d3ff176f28986bb6fded099cf1140e0030a","observation_id":"59d6be4b-64f8-49cf-977e-956a9ec79f4d","resolution":{"observed_at":"2026-08-06T16:46:00.781635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T12:44:21.699335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21504","last_updated":"2025-07-29T04:57:02Z","snapshot_observed_at":"2026-08-06T15:35:42.279155Z","submitted_at":"2025-07-29T04:57:02Z","title":"Evaluation and Benchmarking of LLM Agents: A Survey","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T12:44:21.699335Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2507.21504"},"observation_digest":"sha256:9d50a652633fe83e6099c5de1629dfa9c39d88645790cccd3275a0bbdd89d943","observation_id":"ff4c10d5-7239-4858-9037-39477c88bd91","resolution":{"observed_at":"2026-08-06T12:44:21.699335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T01:01:38.735705Z","title":"arXiv:2401.13178","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03991","last_updated":"2025-08-06T00:46:38Z","snapshot_observed_at":"2026-08-08T12:27:57.476825Z","submitted_at":"2025-08-06T00:46:38Z","title":"Galaxy: A Cognition-Centered Framework for Proactive, Privacy-Preserving, and Self-Evolving LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T01:01:38.735705Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2508.03991"},"observation_digest":"sha256:7eed115f9e1696f8a98e57d8500ca1455c23787ee84d05b52fe9ee52b80ecab4","observation_id":"f1ba59cb-94fc-4e95-8896-a3cff2265162","resolution":{"observed_at":"2026-08-06T01:01:38.735705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:b4556dd0ac6488bb56749416820b64956079be14e0bbd16c11cade1cd567b79f","observation_id":"14eba690-db7b-4d04-92b7-fd4fb6d5f73e","resolution":{"observed_at":"2026-05-14T23:13:16.243421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2512.13564","last_updated":"2026-01-13T09:33:57Z","snapshot_observed_at":"2026-08-06T08:27:07.254588Z","submitted_at":"2025-12-15T17:22:34Z","title":"Memory in the Age of AI Agents","version":2},"reference_index":278,"source":"arxiv_source","source_observed_at":"2026-05-11T18:18:19.911342Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2512.13564"},"observation_digest":"sha256:cb5fb7cd2ea3002f6067fb8ffb1f0e18e030d9ae5239ee4302de93416f846e05","observation_id":"e9607fd6-e224-478a-ba99-489caa8123e5","resolution":{"observed_at":"2026-05-11T18:18:20.359761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2602.09514","last_updated":"2026-05-09T05:05:58Z","snapshot_observed_at":"2026-08-07T18:15:27.312882Z","submitted_at":"2026-02-10T08:12:23Z","title":"EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T05:53:29.860037Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2602.09514"},"observation_digest":"sha256:dbffd5fa7f40b2b69737bcc1c7cd7f2721ff4adfa6be414ee11a05eec9a2877c","observation_id":"9a1aa186-e393-40e7-ac4f-7548b4f78508","resolution":{"observed_at":"2026-05-16T05:57:24.553918Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2604.07054","last_updated":"2026-04-09T07:49:38Z","snapshot_observed_at":"2026-08-02T09:08:32.703047Z","submitted_at":"2026-04-08T13:06:37Z","title":"Sell More, Play Less: Benchmarking LLM Realistic Selling Skill","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T17:36:10.725278Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2604.07054"},"observation_digest":"sha256:10d0389153d39b4a500147036d9d623875870202119a274b6637816d486654e2","observation_id":"aa8b3b2f-1d2b-428a-8fa9-a65bb2bb6c90","resolution":{"observed_at":"2026-05-11T06:31:02.516415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2605.14865","last_updated":"2026-05-14T14:12:39Z","snapshot_observed_at":"2026-08-07T15:03:13.693118Z","submitted_at":"2026-05-14T14:12:39Z","title":"Holistic Evaluation and Failure Diagnosis of AI Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T03:17:28.794622Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2605.14865"},"observation_digest":"sha256:83f8faf6ca3c3fa931e33c71a27360e6fc5e209d507fcc248178a8243c77213b","observation_id":"6045f6b9-eb30-42c8-a7bb-07f156e290bd","resolution":{"observed_at":"2026-05-15T03:19:43.221202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2605.19743","last_updated":"2026-05-27T12:23:43Z","snapshot_observed_at":"2026-07-06T23:30:25.609722Z","submitted_at":"2026-05-19T12:12:09Z","title":"EngiAI: A Multi-Agent Framework and Benchmark Suite for LLM-Driven Engineering Design","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T05:22:40.544305Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2605.19743"},"observation_digest":"sha256:81211b8e645725cd334e7256b18969c8dc025e45e96066ac26f51d5776cb2fc5","observation_id":"2aa9f43d-5d04-4293-b1fc-66dad36290ca","resolution":{"observed_at":"2026-05-20T05:23:03.208096Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2605.19743","last_updated":"2026-05-27T12:23:43Z","snapshot_observed_at":"2026-07-06T23:30:25.609722Z","submitted_at":"2026-05-19T12:12:09Z","title":"EngiAI: A Multi-Agent Framework and Benchmark Suite for LLM-Driven Engineering Design","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T18:24:57.376385Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2605.19743"},"observation_digest":"sha256:a1873fce21a76040eef26d139480bf34e4cbd64a3f8811e3e7510862898be675","observation_id":"ddced076-1a45-4ff7-b2d4-29f0fe116742","resolution":{"observed_at":"2026-06-30T18:34:59.702391Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2605.20530","last_updated":"2026-05-26T15:53:21Z","snapshot_observed_at":"2026-08-06T21:16:26.077088Z","submitted_at":"2026-05-19T22:05:12Z","title":"AgentAtlas: Beyond Outcome Leaderboards for LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T06:34:43.686189Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2605.20530"},"observation_digest":"sha256:f95973e31fd3e3319a5f988287fc4b606bf83e7c2ed37f1cc9d4e58aacac388a","observation_id":"ba622d8f-9203-4871-876f-a11f9308063c","resolution":{"observed_at":"2026-05-21T06:39:44.106800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2605.20530","last_updated":"2026-05-26T15:53:21Z","snapshot_observed_at":"2026-08-06T21:16:26.077088Z","submitted_at":"2026-05-19T22:05:12Z","title":"AgentAtlas: Beyond Outcome Leaderboards for LLM Agents","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T17:52:14.944875Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2605.20530"},"observation_digest":"sha256:7ad684c7a78b380ddef8827a12d8b61d5faf1d704832235e1c6e415651e55a28","observation_id":"1508867e-de20-4be9-b4e3-fbfadd577f49","resolution":{"observed_at":"2026-06-30T17:54:57.825258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b40c23a09d55d420fcfd8dcd4fddb3babd0ce4aff1a7ee15e52191096eba308b","observation_id":"6de4b676-0d25-434b-804d-9b7c2be9a0eb","resolution":{"observed_at":"2026-07-01T23:06:21.094083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2606.05670","last_updated":"2026-06-04T03:50:47Z","snapshot_observed_at":"2026-08-08T07:50:21.891568Z","submitted_at":"2026-06-04T03:50:47Z","title":"Do More Agents Help? Controlled and Protocol-Aligned Evaluation of LLM Agent Workflows","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-28T01:42:20.527063Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2606.05670"},"observation_digest":"sha256:d513d3ac97b213c0df56fc49a162631e6a079bacf736b76860b73a42cd5b4432","observation_id":"702924c7-5ae9-4c68-8ece-9d8b6d499abe","resolution":{"observed_at":"2026-07-02T12:56:57.284768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2606.10315","last_updated":"2026-06-09T02:11:01Z","snapshot_observed_at":"2026-07-06T23:49:32.647742Z","submitted_at":"2026-06-09T02:11:01Z","title":"Catching One in Five: LLM-as-Judge Blind Spots in Production Multi-Turn Transaction Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T13:28:08.382201Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2606.10315"},"observation_digest":"sha256:10cefc8c2f110d5fd15bc89e81f78d44b4212613151d460d598ede0b716e6e9b","observation_id":"aefd2fa4-d369-4759-95c5-8aa39d835a58","resolution":{"observed_at":"2026-07-03T05:07:38.634908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2606.11686","last_updated":"2026-06-10T05:55:13Z","snapshot_observed_at":"2026-07-06T23:50:44.713490Z","submitted_at":"2026-06-10T05:55:13Z","title":"Layer-Isolated Evaluation: Gating the Deterministic Scaffold of a Production LLM Agent with a No-LLM, Regression-Locked Test Harness","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T10:04:29.791558Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2606.11686"},"observation_digest":"sha256:b0eb367bede867d7d7296227b8084f624bf67eafcfdd23e701750995b1ac1774","observation_id":"929c8d43-2632-4205-9d91-610cbc9c1482","resolution":{"observed_at":"2026-07-03T10:27:56.015798Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-01T14:41:32.038494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18696","last_updated":"2026-07-21T04:34:35Z","snapshot_observed_at":"2026-08-08T15:57:50.894206Z","submitted_at":"2026-07-21T04:34:35Z","title":"Do AI-Native Biotechs Need Departments? Benchmarking Company World Models for AI-Driven Drug Development","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:41:32.038494Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2607.18696"},"observation_digest":"sha256:24356db67ec757551e1d58af3f0243eea52bab5bfc17bb9df9a5f1a94a808cf1","observation_id":"a38e9815-8bdd-43b8-be5b-62b0e1aa79ac","resolution":{"observed_at":"2026-08-01T14:41:32.038494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-01T03:35:43.053786Z","title":"AgentBoard: An analytical evaluation board of multi-turn LLM agents.arXiv preprint arXiv:2401.13178, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23123","last_updated":"2026-07-25T09:55:31Z","snapshot_observed_at":"2026-08-07T08:46:33.575663Z","submitted_at":"2026-07-25T09:55:31Z","title":"SQBench: A Benchmark for Evaluating Task Delivery by Language-Model Agents in Production-Oriented Workflows","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T03:35:43.053786Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2607.23123"},"observation_digest":"sha256:ee3768b18482cdc05ae79dd506aafbeeae7a0bb40801ef6188b1d3e533a2e8dc","observation_id":"285ed43e-09ab-44c5-bc7e-271c70d3b5ce","resolution":{"observed_at":"2026-08-01T03:35:43.053786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-07-30T16:10:44.381736Z","title":"arXiv preprint arXiv:2401.13178 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23678","last_updated":"2026-07-26T14:23:33Z","snapshot_observed_at":"2026-08-06T03:16:57.922308Z","submitted_at":"2026-07-26T14:23:33Z","title":"Focus Is All You Need: Adaptive Goal-aware Attention Orchestration for Multi-Agent Graph Systems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-30T16:10:44.381736Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2607.23678"},"observation_digest":"sha256:d2f8e5b239a4a5c0ce3cf59d2dcbe3a4183fdaf9d4f653c0112286196860ddf8","observation_id":"078adbd5-018a-4b12-9862-500131aaa417","resolution":{"observed_at":"2026-07-30T16:10:44.381736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-01T01:35:09.674463Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25765","last_updated":"2026-07-28T14:19:59Z","snapshot_observed_at":"2026-08-07T20:49:33.648776Z","submitted_at":"2026-07-28T14:19:59Z","title":"WorkSurface-Bench: Benchmarking Enterprise Agents on Multi-Surface Knowledge Routing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:35:09.674463Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2607.25765"},"observation_digest":"sha256:20244a7ea53aba8f83882c691eee5aae8d3f42339c1311bc00eae70c7cb0ba2d","observation_id":"b53841d8-7de1-4d38-8c00-2d2f42968e7d","resolution":{"observed_at":"2026-08-01T01:35:09.674463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-03T07:41:24.314016Z","title":"2401.13178 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29405","last_updated":"2026-07-31T13:24:34Z","snapshot_observed_at":"2026-08-06T13:48:14.374759Z","submitted_at":"2026-07-31T13:24:34Z","title":"Beyond Component Testing: Validating Agentic AI Systems","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-03T07:41:24.314016Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2607.29405"},"observation_digest":"sha256:9158ae0c5845642aab47606b449b6c77702d01bf883df0bb34341f7696c786fe","observation_id":"ecde07a1-275c-4b25-ba4d-c7856806209c","resolution":{"observed_at":"2026-08-03T07:41:24.314016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T04:16:44.867963Z","title":"arXiv preprint arXiv:2401.13178 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05144","last_updated":"2026-08-05T17:58:58Z","snapshot_observed_at":"2026-08-08T19:14:13.375708Z","submitted_at":"2026-08-05T17:58:58Z","title":"Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T04:16:44.867963Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2608.05144"},"observation_digest":"sha256:35eb76bd83f27bc45c4650513a5258c305fee0ad4497830a54f7f8a30b0327f5","observation_id":"b9eb8009-1da9-4cfd-b2d0-f72eff0b0898","resolution":{"observed_at":"2026-08-06T04:16:44.867963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2401.13178/citation-record","integrity":"/paper/2401.13178/integrity","json":"/paper/2401.13178/citation-record.json","paper":"/paper/2401.13178"},"outbound":[],"paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2401.13178."}