{"as_of":"2026-08-15T13:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae65bae9c14272157df7c7d81b106fa863c354553b4ff008cd8adef02e88c751","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:46:02.635196Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T15:10:04.253250Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T15:10:16.398252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"cited_work":{"arxiv_id":"2507.12806","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu et al","venue":null,"work_id":"9beeabc2-0c54-484b-8552-f289e1d4da58","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-08-13T12:20:20.135004Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T08:28:16.904091Z"},"links":{"cited_paper":"/paper/2507.12806","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:da6b6445b2164af0474a4706d3dbfe70bd65e160237f3ba988a066dd0a0e693a","observation_id":"f50b43b1-2286-4179-9d51-536a3c89175b","resolution":{"observed_at":"2026-05-16T08:30:45.621785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"cited_work":{"arxiv_id":"2507.12806","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu et al","venue":null,"work_id":"9beeabc2-0c54-484b-8552-f289e1d4da58","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-08-13T12:20:20.135004Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T15:10:04.253250Z"},"links":{"cited_paper":"/paper/2507.12806","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:548fcf4bd21e3fb2a2c234aa41adac8b1c7fc5efa80ad9007e35e0604b1dd8dd","observation_id":"639cab6f-2318-46d1-b552-f2ad2c5d1ae4","resolution":{"observed_at":"2026-05-21T15:10:16.401136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12806/citation-record","integrity":"/paper/2507.12806/integrity","json":"/paper/2507.12806/citation-record.json","paper":"/paper/2507.12806"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.805851Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.805851Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:e63ec051a2505c79d9b3b1d32df647808a2d8137cadb39ab0ca70e263cb74919","observation_id":"965e8d88-5920-4fa0-997d-18671108562e","resolution":{"observed_at":"2026-08-06T16:45:58.805851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.871577Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.871577Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:0321a6571da2f86ced63ccf8c66b6c78b08235999f93f936f7fae22aecf10e3e","observation_id":"f48c8dec-5f67-4714-8de1-2e2eb14d62c1","resolution":{"observed_at":"2026-08-06T16:45:58.871577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.378764Z","title":null,"venue":null,"work_id":"7d846a89-b8b7-47ca-9c5f-d99d434db040","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.971979Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:075dd66661d463bd1a3c473eda3e1393ba0cf7ebd6c30745c63b47cd12ed3e23","observation_id":"54a68f72-8b63-4ba7-9b90-4afa6c213840","resolution":{"observed_at":"2026-08-06T16:46:06.424251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.287735Z","title":null,"venue":null,"work_id":"71101a82-96fc-4541-b988-940642d84f1f","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.050121Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:dcc5c4c7f43050dfd66bc045ba3876ea67335e946571b73e0890818d7b6da2ab","observation_id":"0ac6f1bd-aad2-4886-b45b-2511928efe4b","resolution":{"observed_at":"2026-08-06T16:46:06.326853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07303","last_updated":"2024-01-14T14:35:09Z","snapshot_observed_at":"2026-08-13T04:43:12.319881Z","submitted_at":"2024-01-14T14:35:09Z","title":"On extensions of the Jacobson-Morozov theorem to even characteristic","version":1},"cited_work":{"arxiv_id":"2401.07303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07303","snapshot_observed_at":"2026-08-06T16:46:04.392231Z","title":"On extensions of the Jacobson-Morozov theorem to even characteristic","venue":"math.RT","work_id":"d34baad3-6bf2-4e38-b204-8c55f108061e","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.124683Z"},"links":{"cited_paper":"/paper/2401.07303","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:c0911b90717420616f0fbc6d39bb102d8338ca5fe41a3a23c779cd27bfa01141","observation_id":"7f2ccccd-f0fe-44b7-975a-a4917b8daabc","resolution":{"observed_at":"2026-08-06T16:46:04.463822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.191336Z","title":null,"venue":null,"work_id":"fc47e508-8c58-4a55-bb9a-e31cad937bc5","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.215761Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:6c1022eb76da7989a0bb380cb4e78c18096c6db94f2153f5b2597032d72009f2","observation_id":"6ddcdea5-a3c5-4978-b407-ccd568d67cb5","resolution":{"observed_at":"2026-08-06T16:46:06.218192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.049696Z","title":null,"venue":null,"work_id":"666a0db1-d6ac-4a86-b588-f3980c96132f","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.308374Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:8511b767f506ce23b5dff8aafe3c3fe7aa2abad17036a0a40eae165fcea2cc29","observation_id":"ff70678c-e4b2-44c1-80ea-76173553b1ad","resolution":{"observed_at":"2026-08-06T16:46:06.117258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04337","last_updated":"2024-02-06T19:20:50Z","snapshot_observed_at":"2026-08-13T20:19:58.703087Z","submitted_at":"2024-02-06T19:20:50Z","title":"High-temperature oxidation and nitridation of substoichiometric zirconium carbide in isothermal air","version":1},"cited_work":{"arxiv_id":"2402.04337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.04337","snapshot_observed_at":"2026-08-06T16:46:04.208156Z","title":"High-temperature oxidation and nitridation of substoichiometric zirconium carbide in isothermal air","venue":"cond-mat.mtrl-sci","work_id":"92370a19-f9ff-46bd-b89d-2f38124842b6","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.402697Z"},"links":{"cited_paper":"/paper/2402.04337","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:af0df4e403da696f6d6911ffe015a565b76d8b76bde78fcfd0111885f6f9766a","observation_id":"382aea7f-4f3e-4d31-8b83-8ccda811beb7","resolution":{"observed_at":"2026-08-06T16:46:04.280548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.503158Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.503158Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:3d319d99d089f783980e8e06947dd757930d16387893771835f463a37af716f5","observation_id":"9963f502-26c4-4230-be21-15f6fc5160b3","resolution":{"observed_at":"2026-08-06T16:45:59.503158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18836","last_updated":"2025-08-05T17:22:49Z","snapshot_observed_at":"2026-08-07T18:44:19.906571Z","submitted_at":"2025-02-26T05:24:22Z","title":"REALM-Bench: A Benchmark for Evaluating Multi-Agent Systems on Real-world, Dynamic Planning and Scheduling Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18836","snapshot_observed_at":"2026-08-06T16:45:59.600438Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.600438Z"},"links":{"cited_paper":"/paper/2502.18836","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:6f8279add7dd07a72e6fb4097993116c3864d1a48fb4bd9055cfa05579421de6","observation_id":"8a58901e-2fd1-4e76-b9f1-3f512b7b46ab","resolution":{"observed_at":"2026-08-06T16:45:59.600438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T16:45:59.689261Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.689261Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:a5986b05f632fe81813a963f752cd2d44ad857de06dcdddf04c911748363c0dd","observation_id":"52fde6de-9293-4f89-9276-73de583e86ea","resolution":{"observed_at":"2026-08-06T16:45:59.689261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02298","last_updated":"2025-06-02T22:36:02Z","snapshot_observed_at":"2026-08-08T17:41:53.481929Z","submitted_at":"2025-06-02T22:36:02Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","version":1},"cited_work":{"arxiv_id":"2506.02298","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02298","snapshot_observed_at":"2026-08-06T16:46:03.964361Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","venue":"cs.CL","work_id":"1c672310-9bab-42fb-9e5f-619d6a94d01c","year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.767986Z"},"links":{"cited_paper":"/paper/2506.02298","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f840e1f7b1785e637d279d06dc2ea169818d944e87adc1af2b25628606c651e7","observation_id":"a05bf665-2307-4f98-84fe-e0c110d1fff4","resolution":{"observed_at":"2026-08-06T16:46:04.002763Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03456","last_updated":"2025-06-05T09:50:10Z","snapshot_observed_at":"2026-08-15T08:14:14.405008Z","submitted_at":"2024-06-05T17:00:16Z","title":"Recurrent neural chemical reaction networks that approximate arbitrary dynamics","version":2},"cited_work":{"arxiv_id":"2406.03456","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03456","snapshot_observed_at":"2026-08-06T16:46:03.846910Z","title":"Recurrent neural chemical reaction networks that approximate arbitrary dynamics","venue":"q-bio.MN","work_id":"12a04534-46a9-4999-95cd-35b077fc18f5","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.835670Z"},"links":{"cited_paper":"/paper/2406.03456","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:418d944b2e4d72c7d41205555b6c86cf17725370e8b801e0c8a289b28fa69028","observation_id":"b413d103-a494-4f61-978e-3a676697e357","resolution":{"observed_at":"2026-08-06T16:46:03.888765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.925959Z","title":null,"venue":null,"work_id":"d75bb813-3edd-4dbb-ace6-377befe83c49","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.913761Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:7cf6139ca78106c8c6fa9fd45e61357496ce8246a51ca3a06d03dd8fa6b0dece","observation_id":"0c2a0c8e-840a-49e8-a759-c6788b9e8af9","resolution":{"observed_at":"2026-08-06T16:46:05.972064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-06T16:46:00.003696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.003696Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:8cf62e4cff8ce2265d1dd8648037d30f12f9d94110224df45fcb5ec166ee9613","observation_id":"d5e270d4-5040-4774-9917-b0b1f1891b6b","resolution":{"observed_at":"2026-08-06T16:46:00.003696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-15T00:56:43.641640Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-06T16:46:00.105921Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.105921Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:54c4a3e0481bc0da65d926135c837745aa9c02009eb72c3d5200e13d8fcdd8d5","observation_id":"da1ec4f5-2cea-4d02-9714-852c90562a85","resolution":{"observed_at":"2026-08-06T16:46:00.105921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13547","last_updated":"2025-06-26T01:05:54Z","snapshot_observed_at":"2026-08-12T16:00:24.249013Z","submitted_at":"2024-11-20T18:56:22Z","title":"ToolScan: A Benchmark for Characterizing Errors in Tool-Use LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13547","snapshot_observed_at":"2026-08-06T16:46:00.165311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.165311Z"},"links":{"cited_paper":"/paper/2411.13547","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ae3c9b50c96928b14936fb5ae354822a02bb289f2f445e8e85de0761680cf340","observation_id":"0e3145b2-54c9-4e9e-b271-36a5d95ca7b4","resolution":{"observed_at":"2026-08-06T16:46:00.165311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.763349Z","title":null,"venue":null,"work_id":"d09e9b80-5717-473f-bc5e-4437810dc4a3","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.236217Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:89f4a937acea08f17d65003c1d16c7fad2f145d05ef1869a1c834a64a808092f","observation_id":"f16da7f4-79b5-4715-9121-e8d03a7cfd06","resolution":{"observed_at":"2026-08-06T16:46:05.829666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-13T14:09:17.964744Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-06T16:46:00.317956Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.317956Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:80631b5abfe09b833e250ab8f28ba1817e20be81283dcd3b54fc6ae01cb68d89","observation_id":"39716159-e2c8-490a-8800-1e82ea79b651","resolution":{"observed_at":"2026-08-06T16:46:00.317956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18528","last_updated":"2024-10-24T08:21:51Z","snapshot_observed_at":"2026-08-12T22:16:07.410627Z","submitted_at":"2024-10-24T08:21:51Z","title":"PRACT: Optimizing Principled Reasoning and Acting of LLM Agent","version":1},"cited_work":{"arxiv_id":"2410.18528","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18528","snapshot_observed_at":"2026-08-06T16:46:03.662816Z","title":"PRACT: Optimizing Principled Reasoning and Acting of LLM Agent","venue":"cs.AI","work_id":"394fb708-2fdb-4c37-a01e-9499cc086039","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.387306Z"},"links":{"cited_paper":"/paper/2410.18528","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:0e4ca4573feb35a853aa7c5d95d9af1964fc584f756d7da6fa891ea1ca2dfe2b","observation_id":"10d30c61-c805-483a-aca3-821be6d5c8e2","resolution":{"observed_at":"2026-08-06T16:46:03.694873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05960","last_updated":"2023-08-11T06:37:54Z","snapshot_observed_at":"2026-08-13T10:36:50.990685Z","submitted_at":"2023-08-11T06:37:54Z","title":"BOLAA: Benchmarking and Orchestrating LLM-augmented Autonomous Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05960","snapshot_observed_at":"2026-08-06T16:46:00.503290Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.503290Z"},"links":{"cited_paper":"/paper/2308.05960","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:2cce2dadb818eea47603616cd19046f5f2a85db35a3dbc97581d0a91ae48fe74","observation_id":"f1500648-c6dc-4fb5-bec1-bc9d37bc47dd","resolution":{"observed_at":"2026-08-06T16:46:00.503290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15538","last_updated":"2024-02-23T06:25:20Z","snapshot_observed_at":"2026-08-14T22:40:35.611424Z","submitted_at":"2024-02-23T06:25:20Z","title":"AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15538","snapshot_observed_at":"2026-08-06T16:46:00.571687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.571687Z"},"links":{"cited_paper":"/paper/2402.15538","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ac89a4b9406c09535ff4aae94f0dca124030801654c39afb65a766176e5e3f05","observation_id":"3b85cbb9-9ee2-4265-8954-2dbfe0457389","resolution":{"observed_at":"2026-08-06T16:46:00.571687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.590767Z","title":null,"venue":null,"work_id":"f817cb8d-744a-4b3a-9a37-5aae215c01a4","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.643162Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:a2c5426af495732be7dd9c799131bac498a69c0c98e75c98d4778ee30b286dc1","observation_id":"3533abeb-e1d2-4a2d-a2b4-fe04b0e9cc98","resolution":{"observed_at":"2026-08-06T16:46:05.691587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06416","last_updated":"2025-05-09T20:30:37Z","snapshot_observed_at":"2026-08-07T15:48:19.425532Z","submitted_at":"2025-05-09T20:30:37Z","title":"ScaleMCP: Dynamic and Auto-Synchronizing Model Context Protocol Tools for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06416","snapshot_observed_at":"2026-08-06T16:46:00.702329Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.702329Z"},"links":{"cited_paper":"/paper/2505.06416","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:74fe066fd56d81ee07665b9bcca576f7d47c9d0f747befac9d95c069de6491c0","observation_id":"5bacc67b-035f-41f7-9ede-cda04be96e11","resolution":{"observed_at":"2026-08-06T16:46:00.702329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-08-13T07:41:55.930150Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T16:46:00.781635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.781635Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f63e4a678d3adfadce906e2bddee73542d342a926c2a79a645cee13a8b0f2568","observation_id":"59d6be4b-64f8-49cf-977e-956a9ec79f4d","resolution":{"observed_at":"2026-08-06T16:46:00.781635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:00.878106Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.878106Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f10e11ad58254ce699fd4f21e96806b4cd038b3f85c2bbb6d3ac478f81a7eae4","observation_id":"601a5aac-4ffb-4790-836f-c4219bfdb3fc","resolution":{"observed_at":"2026-08-06T16:46:00.878106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:46:00.956599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.956599Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:b150f5ed6c59c5f833a0ff05608beed29431fa18c5128e75c2129f5f05f7bbe0","observation_id":"4b9de82d-5851-4695-a7c3-af6f7b0f7fc1","resolution":{"observed_at":"2026-08-06T16:46:00.956599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.393818Z","title":null,"venue":null,"work_id":"21ad04dc-7e91-4b62-8ced-43d1dcf4cdb1","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.032125Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ff0f49edfe90030534cd5a71372e3622b9b8f05d6da7fdfd9817a0d4310ae226","observation_id":"1f61e1be-832c-47c5-ab38-ffe3057f52e3","resolution":{"observed_at":"2026-08-06T16:46:05.487334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-06T16:46:01.118506Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.118506Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:6b55b9dd16e00cd99cee70f85d825b6892a0d672da9ac884e4abe72faf9f4776","observation_id":"afb76a43-b3a7-42b7-aa5e-5c8f1f69623b","resolution":{"observed_at":"2026-08-06T16:46:01.118506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.232428Z","title":null,"venue":null,"work_id":"6147db2d-9f77-40f0-a71e-1bb1b8695b1f","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.176261Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:d9b1d72f573668e9d1f5c78cd767b02928cc496a84ce301ab24b03683f80d99d","observation_id":"98a46a96-655c-4937-a520-f84420cf7735","resolution":{"observed_at":"2026-08-06T16:46:05.319496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.084693Z","title":null,"venue":null,"work_id":"8052eaf2-1708-426d-a105-0c63c7c6b1de","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.251698Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:09682afbde5fd9753e401031385904bb661d980af5e8af52d8b8e4d7b1074d08","observation_id":"277c3b40-f282-435e-8481-dc53cbe330fc","resolution":{"observed_at":"2026-08-06T16:46:05.147837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20616","last_updated":"2025-08-20T18:44:21Z","snapshot_observed_at":"2026-08-13T15:12:22.930175Z","submitted_at":"2025-02-28T00:43:35Z","title":"PersonaBench: Evaluating AI Models on Understanding Personal Information through Accessing (Synthetic) Private User Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20616","snapshot_observed_at":"2026-08-06T16:46:01.340983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.340983Z"},"links":{"cited_paper":"/paper/2502.20616","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:2718e038855afd50982b0912e5daa6b4c62050be0c1818a5a162acada83a8606","observation_id":"cea0ddfc-24f6-4de2-b2ae-41327a4f6009","resolution":{"observed_at":"2026-08-06T16:46:01.340983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02705","last_updated":"2024-05-04T16:25:23Z","snapshot_observed_at":"2026-08-14T08:26:21.475104Z","submitted_at":"2024-05-04T16:25:23Z","title":"Peak Age of Information under Tandem of Queues","version":1},"cited_work":{"arxiv_id":"2405.02705","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.02705","snapshot_observed_at":"2026-08-06T16:46:03.276254Z","title":"Peak Age of Information under Tandem of Queues","venue":"cs.IT","work_id":"2cd0a92a-bd81-46a3-bc78-85f711d8bfd4","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.420089Z"},"links":{"cited_paper":"/paper/2405.02705","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4c251d9993891f7c0bd543421caf6fce0c8cb587201a113b54cb5c18f5fcbdde","observation_id":"c31e5581-2880-462d-af0b-097ac6237e88","resolution":{"observed_at":"2026-08-06T16:46:03.339657Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.967296Z","title":null,"venue":null,"work_id":"979c9f22-2c65-4938-8378-440641f2e824","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.505456Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:40d8289b064d0d039cf2da176675859549e2574f485822750d81eacf84b9c8be","observation_id":"91de0b95-21ad-4e1d-ad2b-f137266aff4e","resolution":{"observed_at":"2026-08-06T16:46:05.019555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.854029Z","title":null,"venue":null,"work_id":"35a31b5f-4a7a-42f2-89c3-dcaadd2fd8a2","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.570593Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ed12f0967d9b50fc415791b4b67b559f01316c80aeab523bcb9b62d4a1827555","observation_id":"f13d3aeb-25cb-4548-b755-eafdb31c03dd","resolution":{"observed_at":"2026-08-06T16:46:04.909834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-06T16:46:01.623365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.623365Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:024eda43e9f775634bef5afc6d876be45559ab3e72fcf4ccd1dc3be41572c3ec","observation_id":"0fe92b4f-1fe3-41e0-8586-4fe378d8f71b","resolution":{"observed_at":"2026-08-06T16:46:01.623365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.691488Z","title":null,"venue":null,"work_id":"58eae20c-5ae1-4199-9143-6d5c7830a6b8","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.676364Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4e865710b63bd73fb87d7fcfd994a36c85ecc8f0c8242816f4420af83d352ac3","observation_id":"b196f587-3af0-4831-97d9-a95dceff3733","resolution":{"observed_at":"2026-08-06T16:46:04.750655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-14T22:26:00.902198Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-06T16:46:01.738182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.738182Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:60db613493366a8eba67528a5579b394424e56b3b87475e9899b5adf820be61b","observation_id":"6aaf830b-3ec9-4809-b1b8-55ab9db3030f","resolution":{"observed_at":"2026-08-06T16:46:01.738182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-06T16:46:01.826594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.826594Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:486cc6af88ba6f0009d6a1b2e3043cff63b0f25f53d2855f5f89bb402b7228c3","observation_id":"24645806-899e-471a-9159-5064ce9a8a91","resolution":{"observed_at":"2026-08-06T16:46:01.826594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07672","last_updated":"2025-06-09T11:50:33Z","snapshot_observed_at":"2026-08-12T21:32:53.600136Z","submitted_at":"2025-06-09T11:50:33Z","title":"MCPWorld: A Unified Benchmarking Testbed for API, GUI, and Hybrid Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07672","snapshot_observed_at":"2026-08-06T16:46:01.921739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.921739Z"},"links":{"cited_paper":"/paper/2506.07672","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f7ba61689b804482c973621c1a978d60edf4050d6ed10d166b3d9c48565b0668","observation_id":"1eb775e8-6a66-43bf-8819-92406bbd28fe","resolution":{"observed_at":"2026-08-06T16:46:01.921739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.543544Z","title":null,"venue":null,"work_id":"0727227a-8176-4e9c-9e85-7263739030c8","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.974886Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:5edc475fa7e07db31ec0ed3e69af2e35be9c57181a48fbcf0399a0f0672fe7b6","observation_id":"8cdc92fc-d07f-4d04-9a2a-05d6c3adb33f","resolution":{"observed_at":"2026-08-06T16:46:04.613287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11432","last_updated":"2025-03-02T04:04:03Z","snapshot_observed_at":"2026-08-13T04:09:15.664842Z","submitted_at":"2023-08-22T13:30:37Z","title":"A Survey on Large Language Model based Autonomous Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11432","snapshot_observed_at":"2026-08-06T16:46:02.056791Z","title":"Yu, Li-Rong Sun, and 1 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.056791Z"},"links":{"cited_paper":"/paper/2308.11432","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:c35bbf98f48b0e09d745095037ad4dfa917d3307f68b27bccc6170f9e25c6a09","observation_id":"a3b0ae8a-5fc8-465d-bbed-990c8b4dfcc3","resolution":{"observed_at":"2026-08-06T16:46:02.056791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-06T16:46:02.127936Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.127936Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:0afbbb740d74008c099517455cdbde418c4f84f73926628b1208f53bb6f3993d","observation_id":"a242dc43-64ca-404a-a3e3-fadb42c1a74e","resolution":{"observed_at":"2026-08-06T16:46:02.127936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22673","last_updated":"2025-07-17T01:19:22Z","snapshot_observed_at":"2026-08-07T16:29:27.838930Z","submitted_at":"2025-03-28T17:58:33Z","title":"ActionStudio: A Lightweight Framework for Data and Training of Large Action Models","version":3},"cited_work":{"arxiv_id":"2503.22673","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.22673","snapshot_observed_at":"2026-08-06T16:46:03.048121Z","title":"ActionStudio: A Lightweight Framework for Data and Training of Large Action Models","venue":"cs.AI","work_id":"c6bba2a7-2afc-414e-b7bf-5545fab949ff","year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.199468Z"},"links":{"cited_paper":"/paper/2503.22673","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:618912cc095c06ed0c316fdfe8ec1162de9f531fdbe9c51ec959d33ea4758c2c","observation_id":"c607c54f-dc16-4cb5-bf78-d021f4fff877","resolution":{"observed_at":"2026-08-06T16:46:03.088040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03215","last_updated":"2024-09-05T03:22:22Z","snapshot_observed_at":"2026-08-12T22:51:03.916431Z","submitted_at":"2024-09-05T03:22:22Z","title":"xLAM: A Family of Large Action Models to Empower AI Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03215","snapshot_observed_at":"2026-08-06T16:46:02.276368Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.276368Z"},"links":{"cited_paper":"/paper/2409.03215","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:03d60fac4172024d24c8007373cad1ba45d1fe3a96383d23f603681abbfac5cd","observation_id":"380140d5-000a-4b40-ba1e-8f10e9c4d317","resolution":{"observed_at":"2026-08-06T16:46:02.276368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10172","last_updated":"2024-02-05T08:10:52Z","snapshot_observed_at":"2026-08-13T10:52:24.962131Z","submitted_at":"2023-07-19T17:57:53Z","title":"DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI","version":3},"cited_work":{"arxiv_id":"2307.10172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.10172","snapshot_observed_at":"2026-08-06T16:46:02.895404Z","title":"DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI","venue":"cs.CL","work_id":"19af067d-338d-444b-9455-2f9e40f4c976","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.333562Z"},"links":{"cited_paper":"/paper/2307.10172","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:52f3a6ac82e7be74e7e89db6d21de23d414148bef3d5959c951b4809d38dd868","observation_id":"dbf4f137-366a-4b92-904e-d90b7f7e9806","resolution":{"observed_at":"2026-08-06T16:46:02.956374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09340","last_updated":"2024-09-27T17:43:31Z","snapshot_observed_at":"2026-08-13T00:07:12.830561Z","submitted_at":"2024-05-15T13:43:57Z","title":"Laser Printing of Silver and Silver Oxide","version":4},"cited_work":{"arxiv_id":"2405.09340","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.09340","snapshot_observed_at":"2026-08-06T16:46:02.783021Z","title":"Laser Printing of Silver and Silver Oxide","venue":"physics.optics","work_id":"1872bd8b-02f0-46e1-b30d-be8f6e176fee","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.418806Z"},"links":{"cited_paper":"/paper/2405.09340","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ad17c9270a61320275c87f7dcfc382c475d3a6891a10ab5c7844b64f6c31f511","observation_id":"247dbebb-307f-41a6-a3ad-76cf635dbe64","resolution":{"observed_at":"2026-08-06T16:46:02.814754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-06T16:46:02.488733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.488733Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:85112d39fd8df1d0751976360321c57492442349fed55884d4d48f9073aabbc7","observation_id":"bdbe1501-a723-46ee-a294-bc95b9e765c1","resolution":{"observed_at":"2026-08-06T16:46:02.488733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T16:46:02.574065Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.574065Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:aee02652cf1d3aa939538a459d74beb30c8684368dd8fb7eab5044ee9355a627","observation_id":"ccbb6752-8574-4506-9e62-d15cdad40e39","resolution":{"observed_at":"2026-08-06T16:46:02.574065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09844","last_updated":"2024-06-14T08:51:31Z","snapshot_observed_at":"2026-08-12T23:42:53.233083Z","submitted_at":"2024-06-14T08:51:31Z","title":"Vec-Tok-VC+: Residual-enhanced Robust Zero-shot Voice Conversion with Progressive Constraints in a Dual-mode Training Strategy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09844","snapshot_observed_at":"2026-08-06T16:46:02.635196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.635196Z"},"links":{"cited_paper":"/paper/2406.09844","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:659305ac18046dc8ed5286e81c47e599b429ed908d60de1cef61eafe6f45d627","observation_id":"f51c148d-fa70-4e16-babb-41243255782c","resolution":{"observed_at":"2026-08-06T16:46:02.635196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T01:25:07.357969Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2507.12806."}