{"as_of":"2026-08-10T23:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:353be289cdf355314882f6db71916c723a3461bc93d5518c7b56adb27b085177","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:44:21.487169Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:18:04.402438Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02282","snapshot_observed_at":"2026-08-02T08:18:04.402438Z","title":"Guan, X.; Zeng, J.; Xin, C.; Lu, Y.; Lin, H.; Han, X.; Sun, L.; and Meng, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.06503","last_updated":"2026-07-16T16:47:09Z","snapshot_observed_at":"2026-08-02T08:18:02.051652Z","submitted_at":"2026-07-07T17:03:55Z","title":"Doomed from the Start: Early Abort of LLM Agent Episodes via a Recall-Controlled Probe Cascade","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:18:04.402438Z"},"links":{"cited_paper":"/paper/2606.02282","citing_paper":"/paper/2607.06503"},"observation_digest":"sha256:ac89c83ca38753dfa620876c34c232fe50caf94287fe5db083deb67d78a5d3ad","observation_id":"f3d74e3f-40a8-4ca9-8651-9f77e3e35274","resolution":{"observed_at":"2026-08-02T08:18:04.402438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.02282/citation-record","integrity":"/paper/2606.02282/integrity","json":"/paper/2606.02282/citation-record.json","paper":"/paper/2606.02282"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3712003","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T13:44:40.486861Z","title":"Llm-based multi-agent systems for software engineering: Literature review, vision, and the road ahead.ACM Trans.Softw","venue":"ACM Transactions on Software Engineering and Methodology","work_id":"0caaec0f-69fb-4b25-add7-217ae6f62d51","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:33ccfb4e2ad9f052b2fae2a1b45b54df56375f60bcafa0f5135383d3d7345f28","observation_id":"5055d1ac-792f-4b40-882b-ecd1eb8675a2","resolution":{"observed_at":"2026-06-28T14:52:18.574523Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:27.767336+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:27.767336+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s44336-024-00009-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vicinagearth1(1), 9 (2024)","venue":"Vicinagearth.","work_id":"c8cab405-d001-4027-b3f0-2ebd5d4dd3be","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:43cc0847d1c7e65f5491a910a46edf6f7b9b954c8f1e7efb72feae9effa22c8a","observation_id":"bef5a00d-6046-4430-bdbe-b0ac42afd965","resolution":{"observed_at":"2026-06-28T14:52:18.568217Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"In: 20 Rambow, O., Wanner, L., Apidianaki, M., Al-Khalifa, H., Eugenio, B.D., Schockaert, S., Darwish, K., Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:af807635614e8a8ffdf946f5c2f424a9ce012418c2a9c15f577080f2c3c1e68c","observation_id":"080d7e5a-dd0a-463c-8c08-4290ce027c0f","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":"2405.15793","doi":"10.48550/arxiv.2405.15793","metadata_source":"pith","pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","venue":"cs.SE","work_id":"01826cd9-a652-403c-a2ec-531da9fe2b6a","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:f817627084a84e2857f85afc75fb8375b58cb09a5756c44a1f203bb2d5c78f23","observation_id":"b42f2abe-d2ab-4e83-9a1b-cee4c8f8fd50","resolution":{"observed_at":"2026-07-01T23:06:19.964496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12189","last_updated":"2025-04-01T19:47:19Z","snapshot_observed_at":"2026-08-08T15:20:57.103568Z","submitted_at":"2024-10-16T03:22:35Z","title":"DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing","version":3},"cited_work":{"arxiv_id":"2410.12189","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12189","snapshot_observed_at":"2026-07-10T11:57:03.407150Z","title":"Parameswaran, and Eugene Wu","venue":"cs.DB","work_id":"d3d9805e-cd99-435d-9eee-3dd96fe44e78","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2410.12189","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:82354f447abc87e944fc9c8d65e64f807356a106420dfbf9c572bc841d18b7cb","observation_id":"bb00e441-200a-4abc-9687-8278951dae2f","resolution":{"observed_at":"2026-07-01T23:06:19.946068Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03578","last_updated":"2026-01-28T04:55:23Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:06:42Z","title":"LLM Multi-Agent Systems: Challenges and Open Problems","version":3},"cited_work":{"arxiv_id":"2402.03578","doi":"10.48550/arxiv.2402.03578","metadata_source":"pith","pith_arxiv_id":"2402.03578","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM Multi-Agent Systems: Challenges and Open Problems","venue":"cs.MA","work_id":"c39b4786-4cab-4eaa-88c0-f2402c17c059","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2402.03578","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:8c29d84c538df919a1c998327266d45153c8a48ebfd4dedb765af56cbcb35fff","observation_id":"9af505ca-d080-49f7-95af-858efe16b742","resolution":{"observed_at":"2026-07-01T23:06:19.903285Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-08-05T20:35:55.884484Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":"2306.03314","doi":"10.48550/arxiv.2306.03314","metadata_source":"pith","pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","venue":"cs.AI","work_id":"6ed8494c-c488-407e-b9c0-61e9a411ce26","year":2023},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:8e1928508778827978825293accdcc8519cb7d68230422a4a84f582da45f10e1","observation_id":"819e717e-cbcb-4e1c-89e2-7a813005aebb","resolution":{"observed_at":"2026-07-01T23:06:19.955982Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-024-07930-y","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://www.nature.com/articles/ s41586-024-07930-y","venue":"Nature","work_id":"73e4508a-0123-4a2b-ad7d-ee8cddda5079","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:85eb480fca8813af37170fea43be1ae488d8e00dfc889fc4aee908361385e454","observation_id":"ab8387b2-9367-44f9-ac1d-c4ba2ef3232d","resolution":{"observed_at":"2026-06-28T14:52:18.572458Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-22T22:52:59.377502+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T22:52:59.377502+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01231","last_updated":"2025-07-01T23:10:02Z","snapshot_observed_at":"2026-08-10T00:36:42.611689Z","submitted_at":"2025-07-01T23:10:02Z","title":"Rethinking the Illusion of Thinking","version":1},"cited_work":{"arxiv_id":"2507.01231","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01231","snapshot_observed_at":"2026-07-01T23:06:19.951416Z","title":"https://arxiv.org/abs/2507.01231","venue":null,"work_id":"f75ed0e1-716d-42d5-b6f2-364c273f9f3c","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2507.01231","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:61f5ecb2960b6ae5805c46c45193fe8590d85390c3dea5c98cde910307d2a68e","observation_id":"5a1396a1-c680-4555-8906-862066218414","resolution":{"observed_at":"2026-07-01T23:06:19.953276Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-024-07421-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:37:44.753801Z","title":"Farquhar, J","venue":"Nature","work_id":"01db46ad-1693-4ad4-96c9-8f4620693f17","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:ebe9351dd03b1bee6bbebebb8e2b0461dab95fefd60c9794ce420277746ee498","observation_id":"4fa3866a-8da6-4d8d-938b-aadfe5d4558f","resolution":{"observed_at":"2026-06-28T14:52:18.583133Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:19:07.31045+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:19:07.31045+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04664","last_updated":"2025-09-04T21:26:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-04T21:26:31Z","title":"Why Language Models Hallucinate","version":1},"cited_work":{"arxiv_id":"2509.04664","doi":"10.48550/arxiv.2509.04664","metadata_source":"pith","pith_arxiv_id":"2509.04664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Language Models Hallucinate","venue":"cs.CL","work_id":"6bfb3eed-1270-492c-8fbe-a5671f3f779c","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2509.04664","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:935c0f3cafb9f17dd2fa3bb9e7ed8e105c3c6b48daf1cbd9bc82cd3df6e90cc5","observation_id":"2316f796-ce99-4cdc-8427-115367973bed","resolution":{"observed_at":"2026-07-01T23:06:19.977845Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T03:37:35.427946Z","title":"Failure modes in LLM systems: A system-level taxonomy for reliable AI applications","venue":null,"work_id":"9ae802d5-9af3-4797-b8f1-d7b936cb46c6","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:23a1cf461b7373022b467ac558d7e386cb7e1d69efdef326a933c3009946ad02","observation_id":"4621bfd8-f059-4d8d-bf1c-7042dc103122","resolution":{"observed_at":"2026-07-01T23:06:19.947079Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-09T14:46:30.842437Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"cited_work":{"arxiv_id":"2504.15585","doi":"10.48550/arxiv.2504.15585","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15585","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A comprehensive survey in llm (-agent) full stack safety: Data, training and deployment","venue":"ArXiv.org","work_id":"890e4d27-50d3-4726-8e34-bbd56d407411","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2504.15585","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:48d093045276760c64d62238bb97efbbb67df8cbaa435633df8748427f4f2a31","observation_id":"df30c543-00b4-46cf-9de7-8d4e668bdb15","resolution":{"observed_at":"2026-07-01T23:06:19.985654Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"http://data.europa.eu/eli/reg/2024/1689/oj","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:d3d8665732181851837b02c008c3895e0011060b6aeb4523d7f126fa7edd86f0","observation_id":"a9ea9698-29cf-4fc5-8cf3-541bc03ad35a","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":"2211.09110","doi":"10.1007/bf01194075","metadata_source":"pith","pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Holistic Evaluation of Language Models","venue":"cs.CL","work_id":"cc02a01e-7218-47dc-8e66-3333e7e4adec","year":2022},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:97dcc4b7e9f60b6210d5ff26c25525df97607db8fa74ddacc085d8bfa2c69a2e","observation_id":"685bd280-a0d8-406c-a1a0-ce8de7ed8827","resolution":{"observed_at":"2026-07-01T23:06:19.949950Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04069","last_updated":"2024-10-03T13:51:53Z","snapshot_observed_at":"2026-08-09T00:13:53.804763Z","submitted_at":"2024-07-04T17:15:37Z","title":"A Systematic Survey and Critical Review on Evaluating Large Language Models: Challenges, Limitations, and Recommendations","version":2},"cited_work":{"arxiv_id":"2407.04069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04069","snapshot_observed_at":"2026-07-01T23:06:19.949816Z","title":"https: //arxiv.org/abs/2407.04069","venue":null,"work_id":"8a257265-23f7-41c5-aeda-5938ae5f939f","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2407.04069","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:1918cc7d299049d5b9c4e092d6197b955ef9c4aecd888340686bdebeeb406e54","observation_id":"7c4d314b-cdf5-40b4-809a-b207d9049004","resolution":{"observed_at":"2026-07-01T23:06:19.951903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"https://arxiv.org/abs/2306","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:a1d6df61b54a0780be77a1fb48bad2831ada1a9e3c83cdbaa328acc9f6cda51e","observation_id":"31a20018-47ef-4b86-bf25-ec016d05bae2","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44401-025-00043-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"npj Health Systems 2, 40 (2025) https://doi.org/10.1038/s44401-025-00043-2","venue":"npj Health Systems","work_id":"f3cc2af1-f8b7-4279-a4fc-a5d0266115f5","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:94778c55d6997f4011fb333506f3f8640a18e6026bcc2a141e952a3c16a5adc9","observation_id":"700d4dda-906a-4678-9e40-2336e54bda8f","resolution":{"observed_at":"2026-06-28T14:52:18.580965Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.101253","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:17:45.740193Z","title":"2026 , issn =","venue":null,"work_id":"1fa7c3fa-b5e1-4294-95ba-b8e238a4c4e4","year":2026},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:7048312f5f698d474970fb49b625930d3236344ba4afa36a9d6229ba9d9ba6ea","observation_id":"873048f8-b33b-4e62-8142-65ffbc3df3ac","resolution":{"observed_at":"2026-06-28T14:52:18.566058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:53ecc1583001df5342cd8e7a545b8edb7d1887a250523025689c87c06e15370e","observation_id":"3fa3cb2b-74dc-44fd-bdc6-2e19064f4eb5","resolution":{"observed_at":"2026-07-01T23:06:19.969256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12624","last_updated":"2025-08-18T00:07:23Z","snapshot_observed_at":"2026-08-01T14:58:17.402553Z","submitted_at":"2024-06-18T13:49:54Z","title":"Judging the Judges: Evaluating Alignment and Vulnerabilities in LLMs-as-Judges","version":6},"cited_work":{"arxiv_id":"2406.12624","doi":"10.48550/arxiv.2406.12624","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Judging the judges: Evaluating alignment and vulner- abilities in llms-as-judges","venue":"arXiv (Cornell University)","work_id":"d0e0145b-d0f4-43ff-8b70-fee617aaf5c5","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2406.12624","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:8731a13edfd5e7a90efe54f3a960a7430d14d14f78341c0e1b2d503c409b7310","observation_id":"7233044c-0e63-43ce-a851-2f150da5f7d3","resolution":{"observed_at":"2026-07-01T23:06:19.960925Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-08T03:32:23.667881Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":"2305.17926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-07-11T02:27:48.661096Z","title":"Large Language Models are not Fair Evaluators","venue":"cs.CL","work_id":"d04a3326-b025-498f-a8f0-3d2df254a77f","year":2023},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:eb27bc31d5ef0aaee44ae54dd83009880f31354108d87618183851a462ce1745","observation_id":"76204d9f-174b-4be3-8dd8-303ec4fa956d","resolution":{"observed_at":"2026-07-01T23:06:19.925796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03506","doi":"10.48550/arxiv.2511.03506","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Prateek Chhikara, Dev Khant, Saket Aryan, Taranjeet Singh, and Deshraj Yadav","venue":"ArXiv.org","work_id":"7ca25b51-b6cf-4bc9-b1cf-e521d7651cf1","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:f4f7efff466498ec2a2a49fc5bea19a43595893fc4f05a5915695eb3d40e0749","observation_id":"93671f8d-fba3-40da-8712-ac70792a1dda","resolution":{"observed_at":"2026-07-01T23:06:19.982199Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.06749","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T09:17:48.261321Z","title":"arXiv preprint arXiv:2512.06749 , year=","venue":null,"work_id":"ee6451a6-81ba-46f1-9bd0-787d7b6d8f9a","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:de4d81a490dc02a49d3af1f7314d6469fed769678a27280a775079d81107d63a","observation_id":"315980d2-35b2-4c66-b9ec-480516efb5c9","resolution":{"observed_at":"2026-07-01T23:06:19.941569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:5807d089db95c3a17289d8a44d24f2ef06d235f733815fb2d8eaeb55f5034b49","observation_id":"4cd7f753-4201-413a-ba27-6787f0bb1f6e","resolution":{"observed_at":"2026-07-01T23:06:19.957040Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11495","last_updated":"2023-09-25T15:25:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-20T17:50:55Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","version":2},"cited_work":{"arxiv_id":"2309.11495","doi":"10.48550/arxiv.2309.11495","metadata_source":"pith","pith_arxiv_id":"2309.11495","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","venue":"cs.CL","work_id":"e9e9983c-a72a-4864-9005-cd09bbd7876c","year":2023},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2309.11495","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:0c0b8fefacf9bfb60298f1ca106d3b04161fa53b48ad1ecfeb0e08c738e581db","observation_id":"0417c235-66b6-44a6-b570-a0095f9cdd6d","resolution":{"observed_at":"2026-07-01T23:06:19.960172Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T02:04:26.079898Z","title":"Louis, G","venue":null,"work_id":"9f349f1f-0e39-446f-8ac6-694a06c25de5","year":2026},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:604b5bb1e83dd7bcb975f39d644cc1c00fefcdf42923cf51d4bfb0c3cbc66168","observation_id":"69bcbd02-7da9-4284-8899-87080e11c741","resolution":{"observed_at":"2026-06-28T14:52:18.578425Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.474","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Humans or LLM s as the Judge? A Study on Judgement Bias","venue":null,"work_id":"15d44b6d-5659-44dd-9508-d9df529b958b","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:c95816f2e6e9ffdabee166186ef9d7330add6c3d2076fcb3d0c4d52e2dfc4ae0","observation_id":"7418b2a8-7688-4cec-9e5f-fb6e2a460f31","resolution":{"observed_at":"2026-06-28T14:52:18.570342Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:20.543814+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:20.543814+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.847","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating LLMs’ assessment of mixed-context hallucination through the lens of summarization","venue":null,"work_id":"132ecf6f-cef0-4132-a2f0-82e6da41a58a","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:e4d47ab146d38f7a502d3ba9ce6a8b1c6277f08bb06f8b39d6c2742965c31c43","observation_id":"1a191f59-dbf4-4eaa-8068-87c07f0ad85d","resolution":{"observed_at":"2026-06-28T14:52:18.576656Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-07T15:57:31.436553Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:ac8195625889eef320bfeb5544cc052f915b1bff5d2aedf1ec88dacf17c29f64","observation_id":"962780bd-e35e-4e07-b705-746c026de1e3","resolution":{"observed_at":"2026-07-01T23:06:19.973490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20138","last_updated":"2025-06-03T05:45:06Z","snapshot_observed_at":"2026-08-09T03:05:57.179419Z","submitted_at":"2024-12-28T12:54:06Z","title":"TradingAgents: Multi-Agents LLM Financial Trading Framework","version":7},"cited_work":{"arxiv_id":"2412.20138","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20138","snapshot_observed_at":"2026-07-04T20:00:07.722366Z","title":"Hongyang Yang, Xiao-Yang Liu, and Christina Dan Wang","venue":null,"work_id":"e792c1b3-342a-4de2-98eb-fa551be974af","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2412.20138","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:5221e1cb7b8f6ce1b027ac74764e78dc6c1412e3f0fc40605bf20e203bb33377","observation_id":"13184d36-3d3e-4db6-acf0-ab851b3f207e","resolution":{"observed_at":"2026-07-01T23:06:19.993900Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15631","last_updated":"2026-07-07T09:54:57Z","snapshot_observed_at":"2026-08-07T17:57:53.478530Z","submitted_at":"2025-02-21T17:59:13Z","title":"The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer","version":2},"cited_work":{"arxiv_id":"2502.15631","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.15631","snapshot_observed_at":"2026-07-08T01:18:18.325605Z","title":"The relationship between reasoning and performance in large language models–o3 (mini) thinks harder, not longer","venue":null,"work_id":"e5001a66-f2eb-4c38-b22b-8a742f35cb47","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2502.15631","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:45437d15153041ea48e34a02f9a7d0c26cb8cd701b94c8bfaa0cfc5bb3df283c","observation_id":"859994c3-1ca0-4545-b32b-3e1455ab0487","resolution":{"observed_at":"2026-07-08T01:18:18.325605Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-07T19:18:10.858896Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":"2412.18547","doi":"10.48550/arxiv.2412.18547","metadata_source":"pith","pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token- budget-aware llm reasoning.arXiv preprint arXiv:2412.18547","venue":"cs.CL","work_id":"0b1644b7-8d09-4762-bde3-136a4f66b62b","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:394db6997fb687ae6357801a4c8904fa5fbfbb942d670940b9eecf46de52b124","observation_id":"96e41e81-cee8-43e2-b53c-cdf18e815c7d","resolution":{"observed_at":"2026-07-01T23:06:19.913499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:43d0511a83c15eb685471016a460c5f36343a8791f82e612fdef33bdc9f336f2","observation_id":"1c3edb67-77fd-4f27-8beb-31648f24eee8","resolution":{"observed_at":"2026-07-01T23:06:19.931752Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"https://storage","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:ea4531202a4ee62865fd10f80e1e53742470123eb0d0f046406c54d16a47bc53","observation_id":"45a4f476-efbe-4977-8d17-b9353774c955","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-10T17:02:50.054809Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:8803fe7352687e050aff61cfe33697d4df3c43753ba4e4f5db15aa7d86301d8e","observation_id":"62bcb056-0dc1-489a-a3ef-03dfc0d047ae","resolution":{"observed_at":"2026-07-01T23:06:19.927773Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"https://github.com/langchain-ai/langgraph","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:9909d9273ff8540409eabfd546c11427fc9b0146e36c104284ad010826c7c1ce","observation_id":"d16a36ff-ecf8-4bcf-be92-d5e6736c3c01","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8592.2024","doi":"10.1109/iros58592.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dreher, T","venue":null,"work_id":"69074442-dd66-4e16-9324-8a2cc82601db","year":2024},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:12ab4850273cd45934be59869e2be73218f34e47cefb167951c5eeab2772acf2","observation_id":"f6ed08de-403f-4b21-866c-fa45c81786ee","resolution":{"observed_at":"2026-07-01T23:06:19.897464Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/1743-0003-4-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Journal of NeuroEngineering and Rehabilitation","work_id":"2c60caad-b7f1-474a-954f-a8cf86103fa0","year":2007},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:650969023856a41edbaf63581aaed5375d19ba901f074650dd1ed102508b66d1","observation_id":"2562ba68-e634-47c4-aee9-65b48b1c1f2f","resolution":{"observed_at":"2026-06-28T14:52:18.584694Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:b5c36b6ec027158ab873f47c756cad0b05b3742a4a99280d645a5d5e3956c507","observation_id":"1c78668a-bc9a-4e78-ad3d-ff7707073db0","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"- This collaborative stage leverages the collective expertise of the agents to detect potential causes and propose solutions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:9cc6710c5047bb6b957effdfd46a8f022ffce1218c64f142acbbe065dc196f83","observation_id":"7db21ca3-e83e-4db1-aad3-e5563407085c","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"system_name","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:664ddd1dcc3202f9ac1aa500932edfc4b51241939441dfe9b595853d5d490f42","observation_id":"1f679d4a-c17e-4e15-baf4-a8f19a2e27b3","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"Pointing out any possible mistakes, flaws or problems that could have caused the incident","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:1876900b9e8b5732086fb396a33cd29a11ea3b70aec17c019d2e397c712c4476","observation_id":"70c429da-668e-46ae-a8d2-c5da6c0e887d","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"This collaborative approach aims to leverage the collective expertise of the team to identify potential causes and solutions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:394c5cbc08ff41ebf87580abb6e4af6e6da4d49883e7602eeffa5d1c30d9364a","observation_id":"dd3149c0-c0f9-4fe4-ab43-bc154c2de4ad","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"this agent behaved anomalously","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:c645dc283831f6225c4f8693b5becdb518667ac240558cda19d3932734dbf4b7","observation_id":"30e4e247-d152-47ff-9410-db226dfd1f93","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:e4877294713c770eec7ebf59f1cc47944f3bcbacbcbee85b7ff2e6fd56681f1e","observation_id":"d86b63fa-ff7b-424e-93e2-f0a51fe20c61","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:9ed88d61422d249c15198b02092ffdf789d18c574dc0ed66c6f124bd6e927bcc","observation_id":"28b3eb56-a351-4eb4-86c6-2fea78a1beaf","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"hazard_vector","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:191cef5c953045164755aa36822e21b2847134af12bb3835403b4c3e815bce51","observation_id":"e5baede4-aa4d-42c3-86db-3da82c06080e","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:383b8820c97ed067827f53813bc78c4530d2c85fc1117cd5d6b2c71a0ab630e5","observation_id":"a80b5a57-31a5-491c-9d88-3b1a7af485d3","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:44:21.487169Z","title":"hazard_vector","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T14:44:21.487169Z"},"links":{"citing_paper":"/paper/2606.02282"},"observation_digest":"sha256:a1f5b8ee152c6fbf24c1c7d59d936fb14961af93e808d7857bc77958cece4b89","observation_id":"026b1975-8f70-4c70-8c0c-68964c6399a6","resolution":{"observed_at":"2026-06-28T14:44:21.487169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.02282","last_updated":"2026-06-01T14:05:35Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T18:17:14.626749Z","submitted_at":"2026-06-01T14:05:35Z","title":"POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":2,"metadata_mismatch":23,"parse_uncertain":0,"unresolved":16,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2606.02282."}