{"as_of":"2026-08-17T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f5f444f0df0dcfaea4589a43028d0353e25fa4317976e4ff059ab8fe82ec124","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:52:52.515047Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":49,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:46:05.668170Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T11:24:54.802233Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-08-16T06:37:17.259416Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:16d67ac8c5afa9187bffa3b4798fc5d83e09a2ceb3a48beb62c7d5e5b5f70ae4","observation_id":"3d8cb982-91c4-47b9-a72c-c8dbaaee7738","resolution":{"observed_at":"2026-05-12T05:42:58.410764Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-15T23:46:05.668170Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03973","last_updated":"2025-05-06T20:50:27Z","snapshot_observed_at":"2026-08-17T07:57:00.250631Z","submitted_at":"2025-05-06T20:50:27Z","title":"Divide, Optimize, Merge: Fine-Grained LLM Agent Optimization at Scale","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T23:46:05.668170Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2505.03973"},"observation_digest":"sha256:fef594443243da0c8b4dedfd7596a90d7746f242a1d8287e11b58af563539dc5","observation_id":"eb8fb925-58c7-4aed-840a-5c3e0cb7fcf2","resolution":{"observed_at":"2026-08-15T23:46:05.668170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-07T14:38:05.109462Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18286","last_updated":"2025-05-23T18:30:24Z","snapshot_observed_at":"2026-08-15T05:21:21.523380Z","submitted_at":"2025-05-23T18:30:24Z","title":"Single-agent or Multi-agent Systems? Why Not Both?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:38:05.109462Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2505.18286"},"observation_digest":"sha256:f0f8dfd05fcffa3d28acf8aca1e6550df514321ced2e18d2007dcefa8811a5f5","observation_id":"e14e2a30-71dd-469b-ad7a-be5ae7bc46c1","resolution":{"observed_at":"2026-08-07T14:38:05.109462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-07T13:00:09.849760Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22967","last_updated":"2025-05-29T01:08:36Z","snapshot_observed_at":"2026-08-16T13:55:34.491384Z","submitted_at":"2025-05-29T01:08:36Z","title":"MermaidFlow: Redefining Agentic Workflow Generation via Safety-Constrained Evolutionary Programming","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:09.849760Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2505.22967"},"observation_digest":"sha256:07c53e6e66de501f2cc94b7dd897ca5d608919c245ad0086fcf2ae14ad4d5959","observation_id":"b910eb31-f4f4-4c9a-bbb4-11084b0e3987","resolution":{"observed_at":"2026-08-07T13:00:09.849760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-07T11:21:49.544808Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02739","last_updated":"2025-06-03T10:53:29Z","snapshot_observed_at":"2026-08-09T13:20:41.424260Z","submitted_at":"2025-06-03T10:53:29Z","title":"Why do AI agents communicate in human language?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:49.544808Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2506.02739"},"observation_digest":"sha256:5919d998c46813ac3299ab02b6ad0d233cf12677c5e3f13bbd8ecad5fbaef8e2","observation_id":"f065c39b-f19b-499f-91e6-fe61124a1dbd","resolution":{"observed_at":"2026-08-07T11:21:49.544808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-07T11:05:22.392106Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03546","last_updated":"2025-06-04T04:05:38Z","snapshot_observed_at":"2026-08-17T03:36:10.463617Z","submitted_at":"2025-06-04T04:05:38Z","title":"From Virtual Agents to Robot Teams: A Multi-Robot Framework Evaluation in High-Stakes Healthcare Context","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:05:22.392106Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2506.03546"},"observation_digest":"sha256:23eeb97676fb75dba65c2162e12b40a84855fe12dbc9a0ba8cd64a62b16c6702","observation_id":"bf08a241-c5e3-4f44-959d-52709e8348d3","resolution":{"observed_at":"2026-08-07T11:05:22.392106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-04T14:42:36.139157Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24088","last_updated":"2026-06-08T21:46:49Z","snapshot_observed_at":"2026-08-14T02:38:10.521409Z","submitted_at":"2025-09-28T21:47:20Z","title":"CORRECT: COndensed eRror RECognition via knowledge Transfer in multi-agent systems","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T14:42:36.139157Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2509.24088"},"observation_digest":"sha256:4b6f948d0f9417a32f7510635adbee72425afc8cefb21167d357e1367b420a6e","observation_id":"4f8666fa-1932-439f-8757-23d98e7b827b","resolution":{"observed_at":"2026-08-04T14:42:36.139157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2510.02837","last_updated":"2026-05-25T02:56:44Z","snapshot_observed_at":"2026-08-12T10:11:19.597552Z","submitted_at":"2025-10-03T09:19:15Z","title":"Beyond the Final Answer: Evaluating the Reasoning Trajectories of Tool-Augmented Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T11:02:55.529271Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2510.02837"},"observation_digest":"sha256:f87aa2de08573555bd91970a73710ab85a7dfe9266272b663f948572681e1046","observation_id":"a7f712c4-12aa-415c-b9a9-875897882311","resolution":{"observed_at":"2026-05-18T11:06:17.780496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-04T12:44:13.174346Z","title":"Which agent causes task failures and when? on auto- mated failure attribution of llm multi-agent systems.arXiv preprint arXiv:2505.00212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02837","last_updated":"2026-05-25T02:56:44Z","snapshot_observed_at":"2026-08-12T10:11:19.597552Z","submitted_at":"2025-10-03T09:19:15Z","title":"Beyond the Final Answer: Evaluating the Reasoning Trajectories of Tool-Augmented Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T12:44:13.174346Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2510.02837"},"observation_digest":"sha256:57aa3f6de1b69a6b7afc0be5433c4c6c5ea89778337882b0e8222bf5e92de410","observation_id":"0af9bf48-d95d-45eb-9b86-0e2ea41017a1","resolution":{"observed_at":"2026-08-04T12:44:13.174346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-03T05:31:41.146745Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02138","last_updated":"2026-07-20T12:26:35Z","snapshot_observed_at":"2026-08-07T23:32:01.524612Z","submitted_at":"2026-02-02T14:19:08Z","title":"CAM: A Causality-based Analysis Framework for Multi-Agent Code Generation Systems","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T05:31:41.146745Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2602.02138"},"observation_digest":"sha256:0ad02fe078249415eca051801c0bb81b18f1aebe27b319af0bdf2fb11d8bed5a","observation_id":"5c2dbfb6-b98f-4d43-b06a-937a33b0ad92","resolution":{"observed_at":"2026-08-03T05:31:41.146745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-02T23:18:01.253850Z","title":"Which agent causes task failures and when? on auto- mated failure attribution of llm multi-agent sys- tems.arXiv preprint arXiv:2505.00212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14345","last_updated":"2026-06-20T15:35:41Z","snapshot_observed_at":"2026-08-15T16:31:54.035953Z","submitted_at":"2026-02-15T23:25:14Z","title":"AXE: Grey-Box Exploitability Confirmation for Localized Vulnerability Reports","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T23:18:01.253850Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2602.14345"},"observation_digest":"sha256:def5075a339afff7b39b90128a8c1e1f4e8213e7966a3e64980925954838fb22","observation_id":"f9d11f55-f1a9-4122-ae70-370c5ce14490","resolution":{"observed_at":"2026-08-02T23:18:01.253850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2603.04474","last_updated":"2026-05-11T15:41:00Z","snapshot_observed_at":"2026-08-15T10:48:03.192446Z","submitted_at":"2026-03-04T11:45:27Z","title":"From Spark to Fire: Modeling and Mitigating Error Cascades in LLM-Based Multi-Agent Collaboration","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T16:36:43.330447Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2603.04474"},"observation_digest":"sha256:327215f3b4e18ba8553fe743a5c7a6417409c6289f59e005b47db616c0e5711e","observation_id":"e7c5c23e-e7f1-4887-9288-f5711a0115de","resolution":{"observed_at":"2026-05-15T16:40:10.646859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2603.06847","last_updated":"2026-05-07T16:46:46Z","snapshot_observed_at":"2026-08-12T19:29:28.939078Z","submitted_at":"2026-03-06T20:12:29Z","title":"Characterizing Faults in Agentic AI: A Taxonomy of Types, Symptoms, and Root Causes","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T14:42:40.925632Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2603.06847"},"observation_digest":"sha256:88381fba8e317a15a704211a6f86b971a0f020ae69b6e38d594864c46fa41fe4","observation_id":"896e7db2-07d7-4352-afcb-4447582ebb29","resolution":{"observed_at":"2026-05-15T14:46:08.225092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2604.27586","last_updated":"2026-04-30T08:39:42Z","snapshot_observed_at":"2026-08-15T08:19:39.127248Z","submitted_at":"2026-04-30T08:39:42Z","title":"Trace-Level Analysis of Information Contamination in Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T09:41:15.185578Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2604.27586"},"observation_digest":"sha256:fd6c3ae30de2f423fa73b23bd80d52f4113544e70d931bb1402f0834a7c43e8b","observation_id":"e8cb84db-0ff8-42c0-9fc8-df116f2c05b8","resolution":{"observed_at":"2026-05-12T09:41:27.091767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.08518","last_updated":"2026-05-08T22:00:58Z","snapshot_observed_at":"2026-08-17T14:02:02.113477Z","submitted_at":"2026-05-08T22:00:58Z","title":"Results and Retrospective Analysis of the CODS 2025 AssetOpsBench Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T01:47:30.987626Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.08518"},"observation_digest":"sha256:0bb1ed76fb4f789183f2bd84069004cca1ca4863f83f01c6b8c82589d76a389c","observation_id":"25e214e2-46f2-4a84-95f0-a99b7c877398","resolution":{"observed_at":"2026-05-12T07:51:41.638609Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.08715","last_updated":"2026-05-13T23:06:48Z","snapshot_observed_at":"2026-08-13T11:33:12.034864Z","submitted_at":"2026-05-09T05:55:19Z","title":"AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-12T01:19:49.062330Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.08715"},"observation_digest":"sha256:76dacdbed25dcd3536b82ffcd01bfc35fac269751da588ebb27f668eddcf5b7d","observation_id":"9a3a72c5-bcde-4688-9590-5a720aaf206a","resolution":{"observed_at":"2026-05-12T08:06:27.629042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.08715","last_updated":"2026-05-13T23:06:48Z","snapshot_observed_at":"2026-08-13T11:33:12.034864Z","submitted_at":"2026-05-09T05:55:19Z","title":"AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-15T05:24:54.265411Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.08715"},"observation_digest":"sha256:fc8ca753566eb01e3233dcaa3dfcff808336ffb5365c0eb6f72d188e7d7ff50f","observation_id":"5717c6b2-33fb-4f61-852b-41c93bc36cd3","resolution":{"observed_at":"2026-05-15T05:25:03.791076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.11225","last_updated":"2026-05-11T20:43:20Z","snapshot_observed_at":"2026-08-14T15:02:43.663801Z","submitted_at":"2026-05-11T20:43:20Z","title":"PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T02:22:04.669760Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.11225"},"observation_digest":"sha256:84bf992b091099731b93968c642a064022cb24aced7980ffd918f33bd90f4103","observation_id":"e2f4fe93-550e-41bc-a68a-928bbdba5c73","resolution":{"observed_at":"2026-05-13T02:22:06.193495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.14859","last_updated":"2026-05-15T03:53:20Z","snapshot_observed_at":"2026-08-16T16:39:04.165278Z","submitted_at":"2026-05-14T14:05:58Z","title":"Do Coding Agents Understand Least-Privilege Authorization?","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-19T16:34:14.379419Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.14859"},"observation_digest":"sha256:19189638b1697f6aadec0946522e586b2ab146f48068851aae321c97cbb03f7e","observation_id":"e069b85e-9e4f-4e97-b71d-99d68955af95","resolution":{"observed_at":"2026-05-19T16:37:40.010720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.15581","last_updated":"2026-05-15T03:44:39Z","snapshot_observed_at":"2026-08-15T05:52:22.628123Z","submitted_at":"2026-05-15T03:44:39Z","title":"STAR: A Stage-attributed Triage and Repair framework for RCA Agents in Microservices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T19:23:19.135749Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.15581"},"observation_digest":"sha256:1a2c7e770236c4fe8c63c01821e3fe790835f05fbbc186e19f616791122786c1","observation_id":"73fb5a1f-9f6e-4b2f-bc9f-3f4736e37d6e","resolution":{"observed_at":"2026-05-20T19:23:40.788771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.17352","last_updated":"2026-05-17T09:45:24Z","snapshot_observed_at":"2026-08-17T11:23:58.561752Z","submitted_at":"2026-05-17T09:45:24Z","title":"AMATA: Adaptive Multi-Agent Trajectory Alignment for Knowledge-Intensive Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T13:43:42.097447Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.17352"},"observation_digest":"sha256:c431f79a178dd81be6d020dc9dfc9934917b0e0109d745b2bedee4138de205aa","observation_id":"046f5e26-b0ee-420c-8490-095aef43beb1","resolution":{"observed_at":"2026-05-20T13:48:19.921035Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.19240","last_updated":"2026-05-19T01:16:27Z","snapshot_observed_at":"2026-08-16T08:39:25.270460Z","submitted_at":"2026-05-19T01:16:27Z","title":"CASPIAN: Online Detection and Attribution of Cascade Attacks in LLM Multi-Agent Systems via Cross-Channel Causal Monitoring","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T03:11:36.534055Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.19240"},"observation_digest":"sha256:5043f5516f06d99b284ec47c438abaf1fd66f47e7903dcc3489c89691da4fb22","observation_id":"69456704-5e79-432c-9be2-0dd4d4800e62","resolution":{"observed_at":"2026-05-20T03:13:00.421602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.21347","last_updated":"2026-06-04T23:27:42Z","snapshot_observed_at":"2026-08-15T09:54:00.935882Z","submitted_at":"2026-05-20T16:13:53Z","title":"Insights Generator: Systematic Corpus-Level Trace Diagnostics for LLM Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T04:20:43.780849Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.21347"},"observation_digest":"sha256:0d6f5df568a58c3eafe30b9807caab434ad91fc42ca27223f6281f228b6c2316","observation_id":"ca20721f-d306-474e-9568-73a7c654c5fd","resolution":{"observed_at":"2026-05-21T04:23:57.550468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.21347","last_updated":"2026-06-04T23:27:42Z","snapshot_observed_at":"2026-08-15T09:54:00.935882Z","submitted_at":"2026-05-20T16:13:53Z","title":"Insights Generator: Systematic Corpus-Level Trace Diagnostics for LLM Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T09:46:26.124683Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.21347"},"observation_digest":"sha256:65d1c842b990d1b8a4570e4e6d9e1386bfa513aaa53746ca3b324e4eb3ca3af7","observation_id":"9a0b3bf1-ac63-4c48-9802-8d833da036b0","resolution":{"observed_at":"2026-05-22T09:51:21.867557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.21347","last_updated":"2026-06-04T23:27:42Z","snapshot_observed_at":"2026-08-15T09:54:00.935882Z","submitted_at":"2026-05-20T16:13:53Z","title":"Insights Generator: Systematic Corpus-Level Trace Diagnostics for LLM Agents","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T17:31:25.538977Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.21347"},"observation_digest":"sha256:269e9815eb6b79fa917ae6bd43350d15a592f1b1f518385b41c63610e105671f","observation_id":"19200b64-ac8b-4aaa-8dc5-ab7da96f0200","resolution":{"observed_at":"2026-06-30T17:34:57.667709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.23414","last_updated":"2026-05-22T09:24:12Z","snapshot_observed_at":"2026-07-06T23:33:39.204744Z","submitted_at":"2026-05-22T09:24:12Z","title":"When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent Systems","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-25T04:25:26.710488Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.23414"},"observation_digest":"sha256:58fdf531fff6292618ba62ba61435043a509e4a8e04d784d3861579b8a630244","observation_id":"229681f8-3d11-4643-9978-952c05f7d6ac","resolution":{"observed_at":"2026-05-25T04:26:37.914057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2605.26302","last_updated":"2026-05-25T19:55:12Z","snapshot_observed_at":"2026-08-15T15:12:31.912423Z","submitted_at":"2026-05-25T19:55:12Z","title":"Your Agents Are Aging Too: Agent Lifespan Engineering for Deployed Systems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T21:13:03.346422Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2605.26302"},"observation_digest":"sha256:0072edbdcdcbd63b8b83549c544da9306ccc058e6bdeaba4834422ed919cf4ec","observation_id":"c595fe95-14a9-49cc-a60e-a884ca192363","resolution":{"observed_at":"2026-06-29T21:13:59.460712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.00765","last_updated":"2026-05-30T15:11:35Z","snapshot_observed_at":"2026-08-16T11:59:37.344693Z","submitted_at":"2026-05-30T15:11:35Z","title":"FALAT: Tracing Failures in LLM Agent Trajectories via Dependency-Guided Search","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-28T18:38:56.787942Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.00765"},"observation_digest":"sha256:8ce12d082a53190adf3cacb33d453d865a63be5be1e1f6c38f7279f78c5f3957","observation_id":"3bc51b50-d00e-4825-97d5-c7d9535c231d","resolution":{"observed_at":"2026-06-28T18:42:29.585718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-13T15:14:40.884744Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:88f7a1e2e1600eb297f0ee8c5577ab95612e87e606d33ea0a47c108c368b5200","observation_id":"962780bd-e35e-4e07-b705-746c026de1e3","resolution":{"observed_at":"2026-07-01T23:06:19.973490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.03467","last_updated":"2026-06-02T10:45:49Z","snapshot_observed_at":"2026-08-13T23:15:06.264531Z","submitted_at":"2026-06-02T10:45:49Z","title":"StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T10:12:35.956616Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.03467"},"observation_digest":"sha256:8f3a6c549bf912e86ccc02170b3950140008aa2da7d32279c29bf995ed7ace69","observation_id":"99b43385-5d72-4512-b4b7-b088278826c5","resolution":{"observed_at":"2026-07-02T03:16:33.986357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.07889","last_updated":"2026-06-05T22:52:16Z","snapshot_observed_at":"2026-08-12T20:03:47.330047Z","submitted_at":"2026-06-05T22:52:16Z","title":"Strained Coherence: A Pre-Failure Signal in Coding Agent Execution Trajectories","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T22:16:45.910467Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.07889"},"observation_digest":"sha256:7b4dda9e13c70e909b03b9d17905bb266daf8967defbdd49fa588eff98c3f452","observation_id":"c0e26903-a502-42c2-ae6c-c7b4c3ce95a0","resolution":{"observed_at":"2026-07-02T16:57:09.805473Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.08275","last_updated":"2026-06-06T17:44:23Z","snapshot_observed_at":"2026-08-02T09:23:56.807604Z","submitted_at":"2026-06-06T17:44:23Z","title":"Causal Agent Replay: Counterfactual Attribution for LLM-Agent Failures","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T19:54:26.300961Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.08275"},"observation_digest":"sha256:d2a179b7c65428a936b5074b762df7dd4d1273a53d3e27031ef7740fc474e4a4","observation_id":"8a1eb7ce-983f-44ea-9e18-291f8fce76a7","resolution":{"observed_at":"2026-07-02T21:07:24.302055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.22741","last_updated":"2026-06-22T01:03:21Z","snapshot_observed_at":"2026-08-02T09:44:06.503397Z","submitted_at":"2026-06-22T01:03:21Z","title":"GRADE: Graph Representation of LLM Agent Dependency and Execution","version":1},"reference_index":144,"source":"arxiv_source","source_observed_at":"2026-06-26T09:44:37.914985Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.22741"},"observation_digest":"sha256:6d40dafa91a8d7d4a5f6552cdf43fde7c141069a4680d8c86117fc9c5c5e9de4","observation_id":"67700a4a-a9b7-43bd-adf5-f899e65c50f4","resolution":{"observed_at":"2026-07-04T09:39:46.499687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.23664","last_updated":"2026-06-22T17:48:40Z","snapshot_observed_at":"2026-08-11T07:23:29.810451Z","submitted_at":"2026-06-22T17:48:40Z","title":"MAS-PromptBench: When Does Prompt Optimization Improve Multi-Agent LLM Systems?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-26T09:15:50.722199Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.23664"},"observation_digest":"sha256:816b2368dcda5e03d4b40c48982e8928927846502755dca11f4867fa83b73aae","observation_id":"85b6f485-41a9-4589-890d-3b317fe7a7b6","resolution":{"observed_at":"2026-07-04T09:59:45.584925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.27409","last_updated":"2026-06-25T10:52:54Z","snapshot_observed_at":"2026-08-12T13:41:43.679174Z","submitted_at":"2026-06-25T10:52:54Z","title":"Delayed Verification Destabilizes Multi-Agent LLM Belief: Instability Thresholds and Optimal Corrector Placement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T01:25:53.612641Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.27409"},"observation_digest":"sha256:2dba9d9ac6b2604071e51dd67cdf23107b5be7b04cfe956550ba60275505616d","observation_id":"313f4da9-cd96-4e70-90a6-4caa787e36fe","resolution":{"observed_at":"2026-07-01T18:55:58.656482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-12T06:24:52.086585Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02882","last_updated":"2026-07-03T02:28:32Z","snapshot_observed_at":"2026-08-17T08:34:20.993782Z","submitted_at":"2026-07-03T02:28:32Z","title":"Diagnosis-Driven Automatic Repair for Agentic Workflow via Symbolic Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T06:24:52.086585Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.02882"},"observation_digest":"sha256:ae4f8e90febc537cdd5ba75b91b1a6b4116f00c6c9ecb69a8a27cc72165f07c6","observation_id":"b8b77c80-58ac-4253-b5c9-004d533d1da4","resolution":{"observed_at":"2026-07-12T06:24:52.086585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2607.06273","last_updated":"2026-07-07T13:40:31Z","snapshot_observed_at":"2026-08-13T07:12:19.345496Z","submitted_at":"2026-07-07T13:40:31Z","title":"AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T11:24:43.002769Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.06273"},"observation_digest":"sha256:08b65b90f970743bae6e7657d561a8ace5838694f5cee0a88e6cdad8ee1d4e46","observation_id":"df89a4a6-4360-450e-9096-25d5a752cd14","resolution":{"observed_at":"2026-07-08T11:24:54.805914Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-02T04:32:36.973681Z","title":"International Conference on Machine Learning (ICML) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13683","last_updated":"2026-07-15T10:26:26Z","snapshot_observed_at":"2026-08-17T02:01:40.814108Z","submitted_at":"2026-07-15T10:26:26Z","title":"Self-Evolving Agent Harnesses via Gated Semantic Quality-Diversity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T04:32:36.973681Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.13683"},"observation_digest":"sha256:cb785ee91e1ca997389d5c24f444d160a51ebf5dcef8777a306b81ddb52efc10","observation_id":"a6b426ec-ee9e-40f7-943e-5c125a4e55af","resolution":{"observed_at":"2026-08-02T04:32:36.973681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-02T06:30:56.999697Z","title":"Which agent causes task failures and when? on automated failure attribution of LLM multi-agent systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14147","last_updated":"2026-07-14T09:30:34Z","snapshot_observed_at":"2026-08-13T14:08:04.409272Z","submitted_at":"2026-07-14T09:30:34Z","title":"Breaking Refusal in the First Half: A Mechanistic Study of the Prefill Jailbreak","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T06:30:56.999697Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.14147"},"observation_digest":"sha256:c04cb019b01f9512166ad19a9a5d054233145a67c270914878a173dc21d43ae0","observation_id":"01477f78-7530-4dde-b7eb-922974ec845e","resolution":{"observed_at":"2026-08-02T06:30:56.999697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-01T21:14:43.971973Z","title":"Zhang, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16387","last_updated":"2026-07-29T10:57:37Z","snapshot_observed_at":"2026-08-09T22:19:02.973109Z","submitted_at":"2026-07-17T17:41:16Z","title":"Fantastic Adaptive Taxonomies and How to Use Them","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T21:14:43.971973Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.16387"},"observation_digest":"sha256:79dbd8fe0e8c2af6eccac0bdddafb3bf301499fde4ea837ba2312fde9a113174","observation_id":"ab51730b-cf8f-44f8-970a-998dc40932a5","resolution":{"observed_at":"2026-08-01T21:14:43.971973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-03T00:25:05.394072Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28802","last_updated":"2026-07-30T19:55:14Z","snapshot_observed_at":"2026-08-08T06:19:07.682563Z","submitted_at":"2026-07-30T19:55:14Z","title":"Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T00:25:05.394072Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.28802"},"observation_digest":"sha256:f4deec0cbdc33c64a35596b5630d3bf1bbaec09a5350bc741c9a5fec95eb06d8","observation_id":"67f04fec-d243-4f66-b1aa-d54894df2bb3","resolution":{"observed_at":"2026-08-03T00:25:05.394072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-15T15:27:21.493741Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29422","last_updated":"2026-07-31T13:42:51Z","snapshot_observed_at":"2026-08-16T08:06:37.338533Z","submitted_at":"2026-07-31T13:42:51Z","title":"AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:27:21.493741Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2607.29422"},"observation_digest":"sha256:f89730df6ce2b23efa557c9367b6300af18c7e5936bbe224602662c3ceaa5e86","observation_id":"fc8b0c28-f92c-4da6-97cf-44accdd097b3","resolution":{"observed_at":"2026-08-15T15:27:21.493741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-15T15:23:28.627046Z","title":"Which agent causes task failures and when? on automated failure attribution of llm multi-agent systems.arXiv preprint arXiv:2505.00212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00711","last_updated":"2026-08-01T15:19:10Z","snapshot_observed_at":"2026-08-16T19:57:41.328227Z","submitted_at":"2026-08-01T15:19:10Z","title":"Tracing the Cascade: A Topology-Aware Evaluation Framework for Scientific Agent Hallucinations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:23:28.627046Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.00711"},"observation_digest":"sha256:f13eb89a9ff819434cfcdfbe1c82807445166f8667cd64d0d0060965194d4fd9","observation_id":"66dc7322-7689-4529-a48b-97425fc0ecc7","resolution":{"observed_at":"2026-08-15T15:23:28.627046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-04T06:54:58.850261Z","title":"Which agent causes task failures and when? on automated failure attribution of LLM multi-agent systems.arXiv preprint arXiv:2505.00212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02464","last_updated":"2026-08-03T16:34:46Z","snapshot_observed_at":"2026-08-15T08:44:57.329660Z","submitted_at":"2026-08-03T16:34:46Z","title":"Real-Time Detection and Repair of LLM Agent Failures","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T06:54:58.850261Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.02464"},"observation_digest":"sha256:961af5ca5196c72452f784fe23386b1337a069276b3ccd1925b49a0580899e19","observation_id":"ddc7c400-5ab8-470a-b18a-c945d00cd642","resolution":{"observed_at":"2026-08-04T06:54:58.850261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-08T16:55:25.086245Z","title":"InProceedings of the 42nd International Conference on Machine Learning (ICML), Spotlight","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-14T23:19:46.768400Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.086245Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:e13db56978d4ebe2276115e3efd7023d4efc5c96159107ef656dcef677ad9e6c","observation_id":"3f7cdcfb-68ca-4dbf-9693-bebea510f99b","resolution":{"observed_at":"2026-08-08T16:55:25.086245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-10T23:09:11.176776Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06657","last_updated":"2026-08-07T00:03:55Z","snapshot_observed_at":"2026-08-15T16:24:54.389099Z","submitted_at":"2026-08-07T00:03:55Z","title":"TRACE: A Multi-Layer Benchmark for Human AI Controller Coordination Under Drift and Failure","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:09:11.176776Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.06657"},"observation_digest":"sha256:924202d01f779f62b668fb7bca7ed63d11775b0bb3363845a7371c7dcb0c0917","observation_id":"4c0b8961-d3e1-400c-97f1-ef60d7ad02dc","resolution":{"observed_at":"2026-08-10T23:09:11.176776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-11T00:37:48.064617Z","title":"Which agent causes task failures and when? on automated failure attribution of LLM multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07583","last_updated":"2026-08-05T05:01:26Z","snapshot_observed_at":"2026-08-17T15:11:14.903484Z","submitted_at":"2026-08-05T05:01:26Z","title":"RouteGuard: Certifying Routing Gain in LLM Multi-Agent Systems When Complementarity Is Not Enough","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:37:48.064617Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.07583"},"observation_digest":"sha256:0f652382b0f5f8851fd296b697f27f27d6f0552e6fe0b3eb8257b04dd5fe8ed3","observation_id":"77fceb62-7aef-4cec-8979-e48bd6b371ae","resolution":{"observed_at":"2026-08-11T00:37:48.064617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-14T04:39:16.661890Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08413","last_updated":"2026-08-09T02:08:34Z","snapshot_observed_at":"2026-08-17T05:03:10.212586Z","submitted_at":"2026-08-09T02:08:34Z","title":"Tangent: An Empirical Study of Testing Practices for LLM-Based Agent Applications","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-14T04:39:16.661890Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.08413"},"observation_digest":"sha256:3f032da38e25e7da13934edde2669aa6fded1ac2d9b3a6c6e257d7df7272f729","observation_id":"0e58611c-65fe-4701-84f4-5c94e6ca5366","resolution":{"observed_at":"2026-08-14T04:39:16.661890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-15T14:19:01.368996Z","title":"Zhang et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11323","last_updated":"2026-08-11T18:16:51Z","snapshot_observed_at":"2026-08-17T10:50:43.521413Z","submitted_at":"2026-08-11T18:16:51Z","title":"Deployment Decision Reliability: A Generalizability-Theory Framework for Sizing Long-Horizon Agent Evaluations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:19:01.368996Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.11323"},"observation_digest":"sha256:a4b7f7087780c5acc29b704ad5597aa853215168ca1825ff303a12e0434bce29","observation_id":"c22278dd-6d74-44fc-994c-fc5b120df8f0","resolution":{"observed_at":"2026-08-15T14:19:01.368996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.00212/citation-record","integrity":"/paper/2505.00212/integrity","json":"/paper/2505.00212/citation-record.json","paper":"/paper/2505.00212"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.315414Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.315414Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:113ebc1f180ae0fc126ba22025175eaebc05bde8a4c43a29adaab4e30ca70257","observation_id":"eeb18f8a-e0ef-4baa-93f4-2acffdad1482","resolution":{"observed_at":"2026-08-16T04:52:52.315414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:52:52.321230Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.321230Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:e99ce0e31858a7fa845b8b824d34f6850d2d23ec924a1bdc3bc9ba1bdd63d818","observation_id":"612b08d9-55f2-45ea-8380-917ed6650f4f","resolution":{"observed_at":"2026-08-16T04:52:52.321230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.258465Z","title":"Chateval: Towards better llm-based evaluators through multi-agent debate","venue":null,"work_id":"d2d27589-f6aa-49d0-ab9c-294af5ab216f","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.326732Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:7fe9e83d3154e2ba11a2cf0e0c459522ed88ea90a2dd7621b047b9a354b14fd1","observation_id":"5bcde0db-295e-4216-8e79-3844f4d43e01","resolution":{"observed_at":"2026-08-16T04:52:53.263639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.244238Z","title":null,"venue":null,"work_id":"6b398fe5-7bb1-41cb-89d5-c823bd8dcad4","year":1989},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.331073Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:77e5a6d52a789ceb004d3f184307bb22951132b6fb6cb88a2719a6cd85a7e160","observation_id":"6c4f2676-a02e-4899-897e-ab1efd31f5a3","resolution":{"observed_at":"2026-08-16T04:52:53.248940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-16T04:52:52.335539Z","title":"Process reinforcement through implicit rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.335539Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:61886a6627df6716026b776aaaa440b184c09a2425437ebcfd3dd05c9cca05a6","observation_id":"4e9c293b-6212-4654-a1c7-ce0214a6744c","resolution":{"observed_at":"2026-08-16T04:52:52.335539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T04:52:52.340472Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning deepseek-ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.340472Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:2949a271a9e9fac495caf0c2afd2996b7ad74fd8df4458e3084232a849f37343","observation_id":"434bb8f4-00d0-4874-a66a-05dfc1a1468a","resolution":{"observed_at":"2026-08-16T04:52:52.340472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.229475Z","title":"Mind2web: Towards a generalist agent for the web","venue":null,"work_id":"e5963551-6fed-4d74-a22b-623ebf24d2ea","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.345024Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:b009b28840d319d1a86bd124b9d66f7fd929a9040f4f0d79282b315bad909a8a","observation_id":"21c9123b-1996-418a-9ba7-9a3a98c2dfd9","resolution":{"observed_at":"2026-08-16T04:52:53.234429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04468","last_updated":"2024-11-07T06:36:19Z","snapshot_observed_at":"2026-08-13T07:44:55.410720Z","submitted_at":"2024-11-07T06:36:19Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04468","snapshot_observed_at":"2026-08-16T04:52:52.349993Z","title":"Magentic-one: A generalist multi-agent system for solving complex tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.349993Z"},"links":{"cited_paper":"/paper/2411.04468","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:e9362f2238f009a0c6823b21d80f3e11a57b4b288af80fc5391ad81c6df75074","observation_id":"86d3c182-ed28-472f-a674-da328553c038","resolution":{"observed_at":"2026-08-16T04:52:52.349993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.215155Z","title":"Gptscore: Evaluate as you desire","venue":null,"work_id":"038b3215-850f-4cc2-bed4-fefe5d478094","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.354606Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:8b568a6f3e418717b6995886cd5747255f8546f75aada376b4e3de28b6de9ab6","observation_id":"0578aa97-27e7-4016-87af-e7af5e83d630","resolution":{"observed_at":"2026-08-16T04:52:53.219902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05556","last_updated":"2024-09-09T12:25:10Z","snapshot_observed_at":"2026-08-16T13:20:12.644130Z","submitted_at":"2024-09-09T12:25:10Z","title":"SciAgents: Automating scientific discovery through multi-agent intelligent graph reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05556","snapshot_observed_at":"2026-08-16T04:52:52.358888Z","title":"and Buehler, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.358888Z"},"links":{"cited_paper":"/paper/2409.05556","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:71066b425626b2cf621df69ed27b7f887ad26e860afb769e0741c845e95e0341","observation_id":"aaf638b5-586b-4faa-9b55-ed3638351b34","resolution":{"observed_at":"2026-08-16T04:52:52.358888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-16T04:52:52.363628Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.363628Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:fc7cb810a86f98ad59c264c17be4e1b18814d467496d1d6ed37e66df33d13413","observation_id":"9bd1be5d-f5ab-40ac-87bf-b0389080e709","resolution":{"observed_at":"2026-08-16T04:52:52.363628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.200712Z","title":null,"venue":null,"work_id":"51bdc7c7-f9f3-45e2-a1d5-69b3d18a11e2","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.368191Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:23dda21742ffe39021cd27bdc7a63989b07a79d90c2b2866e268ce3c59adaec5","observation_id":"47dbc562-0599-444a-a976-e082db0a0e05","resolution":{"observed_at":"2026-08-16T04:52:53.205473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.372548Z","title":"Language model preference evaluation with multiple weak evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.372548Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:cd09c8b25ac09250bb0db64cf12a7529f3a4d46c05bbf549c32d4845b7e8018a","observation_id":"0fc95672-48d2-43f7-8149-805c8ddf91f9","resolution":{"observed_at":"2026-08-16T04:52:52.372548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.186342Z","title":"and Chang, K","venue":null,"work_id":"daf4096a-9209-4c3d-a70f-c4bc6a535132","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.376662Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:00d30786b72e30d81c9e885e9976a917dbaf8b59cbca741ed2636321a1fe2123","observation_id":"68f24689-dfff-42d7-b02d-14357cd5f136","resolution":{"observed_at":"2026-08-16T04:52:53.191161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-08-13T03:11:04.678829Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-16T04:52:52.380916Z","title":"S., Yu, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.380916Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:6942f5a988aec2497f9c2c75e10fd33ba43eba5852921ba688da64d89e194128","observation_id":"90069297-e888-44b4-83ea-f9370fb869b8","resolution":{"observed_at":"2026-08-16T04:52:52.380916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.170835Z","title":"E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., and Narasimhan, K","venue":null,"work_id":"0ceaf97f-b338-4ff3-b9f2-dfc258a3ca09","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.385288Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:225d84fe259ebc9c1fbfb47cb3e3bdd78c155ac037a689d872e6ae0b5ff604cd","observation_id":"e107323d-9ca6-4c56-98d6-3b72754803a5","resolution":{"observed_at":"2026-08-16T04:52:53.176151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.156003Z","title":"Camel: Communicative agents for\" mind\" exploration of large language model society","venue":null,"work_id":"0a3f6dab-0ef8-4a54-bd21-9bb054f52839","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.389596Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:b7b1d9a1dd434dd2cf83794bc7a1c37d330892b8f3e6b0021ef7d18ac7087a48","observation_id":"16c63f3b-9e16-4e04-8b96-f2b054407ec8","resolution":{"observed_at":"2026-08-16T04:52:53.161097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.141317Z","title":null,"venue":null,"work_id":"db71e899-cc50-4f05-9fc1-296596c2baa5","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.393725Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:ef9dd1b5e5754a12b5edac4e4380f7033abb703912a4234ec85226053eb848ad","observation_id":"b4323b50-fe6b-4bd4-a884-2a2146dc8a3d","resolution":{"observed_at":"2026-08-16T04:52:53.145767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.125929Z","title":"Let's verify step by step","venue":null,"work_id":"50d488f7-bcd5-4bd5-8823-1d3c959252c2","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.398128Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:56c0eb5e4b674ed96b2f0bae5503290ef4aa233da0c0f31cf6fadd3b59fd74fe","observation_id":"79adb9b2-9bf1-4d8a-9282-a624da5df62f","resolution":{"observed_at":"2026-08-16T04:52:53.131040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-16T04:52:52.402348Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.402348Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:2ecf095b1600388c92c55e6cb4e4fa6f99418ebb884aa90d9f89695b12c9ea02","observation_id":"d9f0fce0-4341-4061-a273-2974b25bf652","resolution":{"observed_at":"2026-08-16T04:52:52.402348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.110069Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":"2ce142d1-6acb-4c65-89ac-a5f2661f41a1","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.406591Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:79fdd9119b70895052e4fc3e3354e4cd6bde85ecb6f62ae92c3eb9c3ca0a293c","observation_id":"9a9e113d-62bd-466f-94be-4960f86b3daa","resolution":{"observed_at":"2026-08-16T04:52:53.116325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.095520Z","title":"W., and Rainforth, T","venue":null,"work_id":"aa527ae1-ac63-47f3-b18d-f9eabf313394","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.410781Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:adece13de8f10adc6fac815152d883714c70b51d439c9d2b83b681d76dce75d1","observation_id":"5ec88ca0-9bdc-46fe-adda-e41600265fcc","resolution":{"observed_at":"2026-08-16T04:52:53.099840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01437","last_updated":"2024-07-12T17:20:34Z","snapshot_observed_at":"2026-08-16T13:38:02.935764Z","submitted_at":"2024-07-01T16:32:16Z","title":"Needle in the Haystack for Memory Based Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01437","snapshot_observed_at":"2026-08-16T04:52:52.415074Z","title":"Needle in the haystack for memory based large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.415074Z"},"links":{"cited_paper":"/paper/2407.01437","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:acfd8635ae5889a6a654e3785e84ad0b923b4df4dc4a6dfca4c21394df292da2","observation_id":"4b4f0114-a585-42ac-a365-4d527526664c","resolution":{"observed_at":"2026-08-16T04:52:52.415074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.080674Z","title":"Evaluation thesaurus","venue":null,"work_id":"38edd01c-3ade-4976-a050-c54de03e7380","year":1991},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.419455Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:df5668fe6899bcb0fa27afc24991fa5dba9d1fc98d6fa788534836cd2d585b58","observation_id":"c173ac21-371d-4361-8f91-533f9933c469","resolution":{"observed_at":"2026-08-16T04:52:53.085514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.064830Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"1242ed65-cabe-4176-8712-fd40872d497e","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.423594Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:011344ea1edba1217e79cb9aafedb1202ec86b463c97a26299ebaacbd3e5dcc5","observation_id":"03a0d808-5fe6-4f0b-ae90-1e7b8c8cac9d","resolution":{"observed_at":"2026-08-16T04:52:53.069810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19425","last_updated":"2025-03-02T06:36:57Z","snapshot_observed_at":"2026-08-16T13:48:03.308448Z","submitted_at":"2024-05-29T18:08:37Z","title":"Adaptive In-conversation Team Building for Language Model Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19425","snapshot_observed_at":"2026-08-16T04:52:52.427782Z","title":"Adaptive in-conversation team building for language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.427782Z"},"links":{"cited_paper":"/paper/2405.19425","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:97095a329ef99a1fd2b60d10849dea276e78f27220707070d35dccfba4e9abc5","observation_id":"c7fad762-37a0-41ef-87e1-b5d486f71d07","resolution":{"observed_at":"2026-08-16T04:52:52.427782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12624","last_updated":"2025-08-18T00:07:23Z","snapshot_observed_at":"2026-08-16T13:41:49.392632Z","submitted_at":"2024-06-18T13:49:54Z","title":"Judging the Judges: Evaluating Alignment and Vulnerabilities in LLMs-as-Judges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12624","snapshot_observed_at":"2026-08-16T04:52:52.432244Z","title":"S., Choudhary, K., Ramayapally, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.432244Z"},"links":{"cited_paper":"/paper/2406.12624","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:aec4b66259034417d1b678b28deb9d6413f9fdbc74e91d49714fb02664713c86","observation_id":"4f647eab-1785-4289-83e3-ecc0419328eb","resolution":{"observed_at":"2026-08-16T04:52:52.432244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.050799Z","title":null,"venue":null,"work_id":"174d6c09-0e4b-4502-899f-fcd4bf6506d7","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.436745Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:a66c175a8723fab64d052d0a5ab3111e09d77cc2b877aa0f8e3e0f48313e7a26","observation_id":"72c61dc7-ef0f-4d48-853d-115de6b50840","resolution":{"observed_at":"2026-08-16T04:52:53.055296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03350","last_updated":"2024-12-28T09:18:36Z","snapshot_observed_at":"2026-08-16T13:03:19.281079Z","submitted_at":"2024-11-04T04:43:01Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03350","snapshot_observed_at":"2026-08-16T04:52:52.441020Z","title":"A comprehensive survey of small language models in the era of large language models: Techniques, enhancements, applications, collaboration with llms, and trustworthiness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.441020Z"},"links":{"cited_paper":"/paper/2411.03350","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:0c3f87705d68be297a52b72ede367ae2cc01eba65482eba5dafc854de5054ab3","observation_id":"caafc080-b63f-4d76-854d-89e4b1855026","resolution":{"observed_at":"2026-08-16T04:52:52.441020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-14T10:08:59.886019Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-16T04:52:52.445451Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.445451Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:ee737ebc0c52e41d3104fc8a858d945a7df19c15a23ce0a8bfd3db10a70c3730","observation_id":"e717bc1c-aa6e-4dd8-9c4b-4a45ce41771f","resolution":{"observed_at":"2026-08-16T04:52:52.445451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.035348Z","title":"V., Zhou, D., et al","venue":null,"work_id":"afef49e3-84b6-49e5-a356-6fe93abf38fb","year":2022},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.449941Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:e001f252f734fb12cf1d58afd4ab35fd089ebd94203e8ddb9889dfa25aac33da","observation_id":"6b2f2f81-e2de-4d29-9ce3-e32b09deab70","resolution":{"observed_at":"2026-08-16T04:52:53.040009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.020294Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation framework","venue":null,"work_id":"97515bb6-f759-48d0-80ab-aea4b6b42713","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.454323Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:6815c2cf01216a90ace7373777dd4dfe706656eb7a7acfab1e293de9f7bdd7d3","observation_id":"4a528a6b-da18-4817-998c-0bcfc1971114","resolution":{"observed_at":"2026-08-16T04:52:53.024879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-14T22:26:00.902198Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-16T04:52:52.458239Z","title":"J., Cheng, Z., Shin, D., Lei, F., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.458239Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:e25a1cf8a68afda914b1d1763e94bd55b0af67a11da9a72f23e7a712fa128dc8","observation_id":"4e26073e-1684-4554-962b-a529dc555f27","resolution":{"observed_at":"2026-08-16T04:52:52.458239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:53.002884Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"5879f5b0-f59d-4712-9a25-af589fb4409d","year":2022},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.462474Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:e6bf8c9e50a2d2640cfd849bca5e11df7050413b35be5360c72e921da30baa33","observation_id":"1827b626-9416-438b-a685-7787c2cd9a49","resolution":{"observed_at":"2026-08-16T04:52:53.009732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.987635Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":"c556b968-99a0-4b6e-b960-1e8283d7d350","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.466791Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:868f4c6c6aba05f7587c663d150a30574ac9bbafc9cc6ae98cc8c2157c24fdc9","observation_id":"1667d99c-9a08-4a98-8f5c-2efed1ad85aa","resolution":{"observed_at":"2026-08-16T04:52:52.992320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.973104Z","title":"J., Malaviya, C., Bogin, B., Press, O., and Berant, J","venue":null,"work_id":"d781faa3-b7a5-443d-bb37-87d8e7a6cb31","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.470974Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:3a6a0768714c040d89bf9c0fc7532cedb27e8a38fa2f0a109e6b9c20e1accf3c","observation_id":"8623e744-fe0f-4e4e-a591-3e35c3c5c8e2","resolution":{"observed_at":"2026-08-16T04:52:52.977650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.05689","last_updated":"2020-03-12T10:12:22Z","snapshot_observed_at":"2026-08-11T04:06:19.914166Z","submitted_at":"2020-03-12T10:12:22Z","title":"Hyper-Parameter Optimization: A Review of Algorithms and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.05689","snapshot_observed_at":"2026-08-16T04:52:52.475316Z","title":"and Zhu, H","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.475316Z"},"links":{"cited_paper":"/paper/2003.05689","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:f42017f16f6ccbb6c5baf23baf87264c57756d6ecec12ea2a4b707f9ddc8a291","observation_id":"3ecd998e-0387-4c81-88d3-d2505118e300","resolution":{"observed_at":"2026-08-16T04:52:52.475316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03046","last_updated":"2023-10-03T22:16:13Z","snapshot_observed_at":"2026-08-16T14:55:19.126146Z","submitted_at":"2023-10-03T22:16:13Z","title":"EcoAssistant: Using LLM Assistant More Affordably and Accurately","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03046","snapshot_observed_at":"2026-08-16T04:52:52.479845Z","title":"H., and Wang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.479845Z"},"links":{"cited_paper":"/paper/2310.03046","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:ab09bc4ab05dfa333008bb49fd6cd620c30ff8b683ca19d6b105011bfe151005","observation_id":"e8792fdf-4b1b-4289-8c47-b9d21335793b","resolution":{"observed_at":"2026-08-16T04:52:52.479845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.958652Z","title":"Targeted hyperparameter optimization with lexicographic preferences over multiple objectives","venue":null,"work_id":"ad98e17f-89e2-46df-b0fb-c33b306be98b","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.484393Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:af2ff3dac3c9000091584190a86c87bd206264b9641791a2ca04443e13976114","observation_id":"16062771-5e72-4f79-8e56-8ec704c3b6d7","resolution":{"observed_at":"2026-08-16T04:52:52.963215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01643","last_updated":"2024-11-03T17:37:06Z","snapshot_observed_at":"2026-08-16T13:03:23.850036Z","submitted_at":"2024-11-03T17:37:06Z","title":"EcoAct: Economic Agent Determines When to Register What Action","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01643","snapshot_observed_at":"2026-08-16T04:52:52.488577Z","title":"H., Mallick, A., Madrigal, D., Xia, M., R \\\"u hle, V., Wu, Q., and Wang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.488577Z"},"links":{"cited_paper":"/paper/2411.01643","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:a51bd4fea3cb599c8cb80c20d3ee3323f2c18f9b8d4a03f107a585fbfcfa62ce","observation_id":"6b260e53-dede-40c1-bbc6-45eed70d9a6a","resolution":{"observed_at":"2026-08-16T04:52:52.488577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.944116Z","title":"Offline training of language model agents with functions as learnable weights","venue":null,"work_id":"b03c13e6-16a9-49eb-bcfb-36a85cecaecf","year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.492901Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:9542a1fb71d12d0940070341a79439107e2d4177ebfa083b8325673bfe722ee4","observation_id":"e17d1601-1c5c-48c2-891b-836cb6fe5ba1","resolution":{"observed_at":"2026-08-16T04:52:52.948781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00024","last_updated":"2025-05-12T03:01:39Z","snapshot_observed_at":"2026-08-17T08:18:18.529456Z","submitted_at":"2025-04-25T02:55:21Z","title":"Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00024","snapshot_observed_at":"2026-08-16T04:52:52.497186Z","title":"Nemotron-research-tool-n1: Tool-using language models with reinforced reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.497186Z"},"links":{"cited_paper":"/paper/2505.00024","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:0aaa0b12b1df1ebfe5b9cb7883ea8eeb067581354052d485ce83efd973e16d4d","observation_id":"55fba8a4-b624-42d2-84ac-ee7f9f39423a","resolution":{"observed_at":"2026-08-16T04:52:52.497186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-14T07:02:14.518172Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-16T04:52:52.501689Z","title":"Processbench: Identifying process errors in mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.501689Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:1dcda8fefde437c94abdcbe9a9365bfba5777a31175cf38f5300575422afa45c","observation_id":"7af62ab7-d0ab-40e0-b01d-01ccbb1c483e","resolution":{"observed_at":"2026-08-16T04:52:52.501689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:52:52.927660Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"fcc610e7-3b42-4242-aafc-67b82b03cfe4","year":2023},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.506300Z"},"links":{"citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:074b3d389f56e60c7c5d753eb08fd12bf1660b787135a2904767d5fb6db63a6a","observation_id":"61ba5cd1-7e64-4f95-9a46-891fcb6b3f80","resolution":{"observed_at":"2026-08-16T04:52:52.933992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12328","last_updated":"2025-04-12T16:07:36Z","snapshot_observed_at":"2026-08-16T12:41:46.263954Z","submitted_at":"2025-04-12T16:07:36Z","title":"A Comprehensive Survey of Reward Models: Taxonomy, Applications, Challenges, and Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12328","snapshot_observed_at":"2026-08-16T04:52:52.510706Z","title":"A comprehensive survey of reward models: Taxonomy, applications, challenges, and future","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.510706Z"},"links":{"cited_paper":"/paper/2504.12328","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:bb2134139323ab3796715cbef917c84aa4bd284da18a3f26e27f41645613db09","observation_id":"91966d66-931c-4012-a1c1-ca91d6e7fac4","resolution":{"observed_at":"2026-08-16T04:52:52.510706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10934","last_updated":"2024-10-16T17:54:12Z","snapshot_observed_at":"2026-08-16T13:09:29.535530Z","submitted_at":"2024-10-14T17:57:02Z","title":"Agent-as-a-Judge: Evaluate Agents with Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10934","snapshot_observed_at":"2026-08-16T04:52:52.515047Z","title":"Agent-as-a-judge: Evaluate agents with agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T04:52:52.515047Z"},"links":{"cited_paper":"/paper/2410.10934","citing_paper":"/paper/2505.00212"},"observation_digest":"sha256:bb37635d0c6de934ee74e4f0c008ed7d69a075a82c696b5fc7b27f1d01ad6800","observation_id":"29b727f4-68d3-4b07-8e77-bbe15fe8f17c","resolution":{"observed_at":"2026-08-16T04:52:52.515047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","latest_version":3,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-16T04:45:52.319427Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 49 inbound Pith citation observations for arXiv:2505.00212."}