{"as_of":"2026-08-17T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a38dd11bbc5cfbbbb325ed33f2e1066720b32bdd179ef3ae765c64f4dbc458d","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:46:29.077278Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:12:09.952843Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2604.15597","last_updated":"2026-04-17T00:33:32Z","snapshot_observed_at":"2026-08-16T17:52:50.623740Z","submitted_at":"2026-04-17T00:33:32Z","title":"LLMs Corrupt Your Documents When You Delegate","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-10T09:47:21.966292Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2604.15597"},"observation_digest":"sha256:b50e460eb3c8005f7f5b6513f6c937db39d4c173b17c2d54de51814b52c65b6b","observation_id":"ddff6922-1cf3-4055-83be-510cd414c2ca","resolution":{"observed_at":"2026-05-10T09:48:47.626847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2605.04375","last_updated":"2026-05-16T14:48:40Z","snapshot_observed_at":"2026-08-16T17:21:49.564488Z","submitted_at":"2026-05-06T00:50:34Z","title":"Experiment-as-Code Labs: A Declarative Stack for AI-Driven Scientific Discovery","version":1},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-08T17:28:41.217810Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2605.04375"},"observation_digest":"sha256:887f82a99f8c7f7bdfe9806e39cfd413ed9411e0d5498f0ea6fad2b1c13c7839","observation_id":"0247fec9-b64b-4ff5-b8d1-8863f7809c47","resolution":{"observed_at":"2026-05-08T20:04:06.598794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2605.04375","last_updated":"2026-05-16T14:48:40Z","snapshot_observed_at":"2026-08-16T17:21:49.564488Z","submitted_at":"2026-05-06T00:50:34Z","title":"Experiment-as-Code Labs: A Declarative Stack for AI-Driven Scientific Discovery","version":2},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-21T00:13:07.546472Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2605.04375"},"observation_digest":"sha256:6789899c7237e25f00328c462701e2fb5a4ee8e8190cb842daa829b474c97ff1","observation_id":"f603da73-d2fd-44f9-b490-51cab57d9fb7","resolution":{"observed_at":"2026-05-21T00:13:52.344837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2605.07062","last_updated":"2026-05-08T00:15:43Z","snapshot_observed_at":"2026-07-06T23:19:25.538514Z","submitted_at":"2026-05-08T00:15:43Z","title":"From Assistance to Agency: Rethinking Autonomy and Control in CI/CD Pipelines","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T02:06:14.217588Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2605.07062"},"observation_digest":"sha256:bf403fe6079478f000a034dfb278a9bc3709cf4e57970ee6d03d8906fcdb4461","observation_id":"b341aca9-665d-4d30-a077-6ec02259c301","resolution":{"observed_at":"2026-05-11T03:55:57.170897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2605.15425","last_updated":"2026-05-14T21:16:23Z","snapshot_observed_at":"2026-08-16T01:50:53.566981Z","submitted_at":"2026-05-14T21:16:23Z","title":"Runtime-Structured Task Decomposition for Agentic Coding Systems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-19T14:46:37.166185Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2605.15425"},"observation_digest":"sha256:bd00fa014dd03466b980607af398b1ce8a04e6466da3e11f241f4f2988ffbdc2","observation_id":"df8a5b55-37bf-49a0-8ef3-7ecabce42b99","resolution":{"observed_at":"2026-05-19T14:47:36.175763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2606.08590","last_updated":"2026-06-07T12:05:09Z","snapshot_observed_at":"2026-08-16T04:11:05.232419Z","submitted_at":"2026-06-07T12:05:09Z","title":"Auditable Graph-Guided Root Cause Analysis for Kubernetes Incidents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T18:10:31.747998Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2606.08590"},"observation_digest":"sha256:66baa1706705992f26a8525acfbcf11788a65b936dea569c8713f57ce91bc231","observation_id":"d0025bab-9094-4305-adcc-ad8f611abf7d","resolution":{"observed_at":"2026-07-02T23:27:28.084149Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":"2502.05352","doi":"10.48550/arxiv.2502.05352","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.05352 , year=","venue":"ArXiv.org","work_id":"cbb806e9-e9cb-466c-9a99-aaccc8617172","year":2025},"citing_paper":{"arxiv_id":"2606.29159","last_updated":"2026-06-28T02:47:31Z","snapshot_observed_at":"2026-08-02T05:24:21.930613Z","submitted_at":"2026-06-28T02:47:31Z","title":"Pooled Leaderboards Hide System-Specific Winners: A Reporting-Protocol Audit of Offline Root-Cause Analysis Benchmarks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-30T07:52:33.302523Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2606.29159"},"observation_digest":"sha256:27b427234936372bd24ead4add638bce25372461534f794c8e967570da13f4df","observation_id":"ecaeffc4-54e8-476c-8a4e-e48ca3bdc2a5","resolution":{"observed_at":"2026-06-30T07:54:21.844748Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-02T12:47:54.895493Z","title":"key\": \"","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22563","last_updated":"2026-05-29T16:42:23Z","snapshot_observed_at":"2026-08-13T18:51:20.694784Z","submitted_at":"2026-05-29T16:42:23Z","title":"Synthetic Scenario Generation for Evaluation of Industry 4.0 Agents","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T12:47:54.895493Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2607.22563"},"observation_digest":"sha256:f4c4bc28f5b50791d45ff73571f8ab221452b878354280ca402dfd1c2d5bd05a","observation_id":"7e62ae76-ef13-4998-bb89-f97064594ab4","resolution":{"observed_at":"2026-08-02T12:47:54.895493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-03T07:41:24.219547Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29405","last_updated":"2026-07-31T13:24:34Z","snapshot_observed_at":"2026-08-13T08:34:02.633611Z","submitted_at":"2026-07-31T13:24:34Z","title":"Beyond Component Testing: Validating Agentic AI Systems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T07:41:24.219547Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2607.29405"},"observation_digest":"sha256:8984d409fb0e4519a6ca0067e84667d49b6c9efb456a9c1c6952d1a4537a7dc1","observation_id":"4886e0b6-7834-48f1-94b6-916a93d33fd3","resolution":{"observed_at":"2026-08-03T07:41:24.219547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05352","snapshot_observed_at":"2026-08-11T23:12:09.952843Z","title":"Itbench: Evaluating ai agents across diverse real-world it automation tasks.arXiv preprint arXiv:2502.05352, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09119","last_updated":"2026-08-10T04:53:05Z","snapshot_observed_at":"2026-08-16T00:01:56.727123Z","submitted_at":"2026-08-10T04:53:05Z","title":"Motif 3: Technical Report","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:12:09.952843Z"},"links":{"cited_paper":"/paper/2502.05352","citing_paper":"/paper/2608.09119"},"observation_digest":"sha256:70955633248bf22b1e07a75e800cbccfaf0a6cb193699408aab08323900501be","observation_id":"07b4d204-c61b-4404-a55a-7273f46e0ce1","resolution":{"observed_at":"2026-08-11T23:12:09.952843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05352/citation-record","integrity":"/paper/2502.05352/integrity","json":"/paper/2502.05352/citation-record.json","paper":"/paper/2502.05352"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.492504Z","title":null,"venue":null,"work_id":"3f6138da-ead9-4885-8628-0f48af2e095e","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:28.997937Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:c9a636f9f04f065b62e01316daf107109d19a2c5b2bfe73585a11195675aad55","observation_id":"b520474b-66a0-4189-814d-065f8998975c","resolution":{"observed_at":"2026-08-08T19:46:29.497251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.478141Z","title":null,"venue":null,"work_id":"163f01c8-3916-428d-8169-263b717b6a9c","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.003034Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:8de7683b7a8d7f0d22ebc155306088f06aacc783e57d3fc120d679c92dd59e5a","observation_id":"c889bd70-fa31-40ab-a2fa-37ce087048ef","resolution":{"observed_at":"2026-08-08T19:46:29.482665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.463488Z","title":"playground","venue":null,"work_id":"2cf89128-decb-4bde-8ad8-4aebabe7b34a","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.008256Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:de5e7285f1dcc3df24c7bec83fa982a8d7d4bfb4d630149eee9d690a62d6c6d4","observation_id":"aaac6ff3-c0d8-4503-b018-7d1e1aba76d3","resolution":{"observed_at":"2026-08-08T19:46:29.468237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.448361Z","title":"(b) Benchmark Runner deploys the scenario’s environ- ment by executing the deploy_scenario function","venue":null,"work_id":"48ac9c0c-594f-4c1b-9724-3844e6951161","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.013367Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:1904bacf43ef1d8c7c6b87b0ce3f6d24ab01984fa5209b18965953590006a678","observation_id":"e325e85d-2de9-4d5f-9002-5fca9ce9247c","resolution":{"observed_at":"2026-08-08T19:46:29.453209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.433612Z","title":"node failure","venue":null,"work_id":"db777f87-aa43-481e-a3a6-35583ccaba8e","year":2002},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.018208Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:281d3e9a4da44f079c9f470d0cb3a70d285e047c91b2cc8af2cfdd4cef0d656b","observation_id":"1a10f1a3-76de-4437-9fe3-385fccd199d0","resolution":{"observed_at":"2026-08-08T19:46:29.438610Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.340822Z","title":null,"venue":null,"work_id":"b02fc2d4-cebd-480b-9308-f5a8dbd89907","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.048796Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:e90df67146872074e151dbb001cb2386ebe934b08d03c696496c2f6c30ec8c41","observation_id":"36705693-e0e4-468a-93bd-80e0e613a7d3","resolution":{"observed_at":"2026-08-08T19:46:29.345593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.324519Z","title":"pass\" or","venue":null,"work_id":"5537c3a9-f2f8-4357-b04d-e13dea12bc11","year":2024},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.053147Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:337031a2d7b49569e78f2f00c3da5377113446a420ccb56dee6f27279faba4a0","observation_id":"39f41ebf-5218-4df1-a208-237a3b5de4f7","resolution":{"observed_at":"2026-08-08T19:46:29.329503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.276234Z","title":"Kick agent Y with report","venue":null,"work_id":"14e2f89c-fa65-4197-86fa-43576ccf9970","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.067745Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:033eb1639450d92b08a3f44318fa2f581bc15090817169108651063c90a58b93","observation_id":"ef9f8cff-5133-4745-8dd3-c2eadf8fe02a","resolution":{"observed_at":"2026-08-08T19:46:29.280862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.417978Z","title":"We group the agents by Agent Types that reflect the IT operations personas, for example CISO, FInOps, or SRE type","venue":null,"work_id":"d88b9a4a-b867-4dd6-948f-537a4dea47e7","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.025165Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:5ab10257fb37df05551c492e1b0501509537aa51a8d4c43a69a4b8e9e5689d0a","observation_id":"4910c503-b40e-449d-9630-68d83db3678f","resolution":{"observed_at":"2026-08-08T19:46:29.423396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.402408Z","title":"Typi- cal tasks for CISO are to collect evidence and assess compliance controls posture","venue":null,"work_id":"86337e77-b8c0-42fe-bc2e-088bbe517b0d","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.029907Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:004bca4594dab83aeeeb1e5243f1a8d8967e714ffae26df3ad9071baa954b64e","observation_id":"271a0c99-016f-42b9-9770-2269da4593af","resolution":{"observed_at":"2026-08-08T19:46:29.407414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.387041Z","title":"For CISO, for instance, each Kubernetes CIS-benchmark requirement instantiated on OPA is a unique scenario","venue":null,"work_id":"22ef4faa-5753-474a-937d-0122f4efd70a","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.035193Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:63bf392f297fc051709ef87843f971c43318151213686ea2d09fc7c3c38889d6","observation_id":"3f4c685f-4084-4291-8963-ec9fc441979c","resolution":{"observed_at":"2026-08-08T19:46:29.391966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.371530Z","title":null,"venue":null,"work_id":"d0b41809-3246-4e23-92a7-1a0005969265","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.039864Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:ed6ae50e4b3c6638e2719141cfe5be74544ca4f9a7a061db801bbfad18840095","observation_id":"361d25b6-d50e-4bdb-8a2c-4490dbfc7bfd","resolution":{"observed_at":"2026-08-08T19:46:29.376752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.355573Z","title":null,"venue":null,"work_id":"78e5c01a-f84d-48c7-9423-132e6adfcbac","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.044374Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:d9046d25ac8c94817c207d07030fc04ff49a38da7077ca4c8526714aabba8b7e","observation_id":"efb97043-9e9b-4379-96ba-48c424d43d33","resolution":{"observed_at":"2026-08-08T19:46:29.361161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.307630Z","title":null,"venue":null,"work_id":"62fe9807-c363-4e7f-9fe4-e4e396814704","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.058418Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:3b47d8280bb520178e2d55262611e9bcd280e9082f831567e4701015d9ae65a4","observation_id":"3d356a79-91fc-446c-9f27-634725a3142c","resolution":{"observed_at":"2026-08-08T19:46:29.312564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.291101Z","title":"deploy_environment","venue":null,"work_id":"d0c47f7d-6e44-4ed4-ad99-616ecf12f40f","year":2024},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.062904Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:2ee3f09c0f9bd7b8d76655eafccae07f9a4ac2bce6fcaa7c7c870b3f20dab7be","observation_id":"927cc06d-5a49-4738-9248-13ca839ca6ff","resolution":{"observed_at":"2026-08-08T19:46:29.296425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.260745Z","title":"Clear deployed scenario2","venue":null,"work_id":"50953cd8-ae78-43e0-b5db-d4037bef7a52","year":null},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.072903Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:d256ad3cb4549558e523a8ac580e98d690cc061e6ed4038388760d5bd7641c53","observation_id":"882879e2-8f54-4857-b0f4-cee53f461396","resolution":{"observed_at":"2026-08-08T19:46:29.265588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.242592Z","title":"mini- mize the admission of containers wishing to share the host network namespace","venue":null,"work_id":"6f839d96-f7ec-4123-92aa-b79622e58705","year":2021},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:29.077278Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:d634fbb2fe889f87c4b119ebb3204ee71e79512023618dba12cbf124456a1d9e","observation_id":"da5608ce-a675-45f1-b012-5b675355edc1","resolution":{"observed_at":"2026-08-08T19:46:29.249324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04123","last_updated":"2024-03-07T00:44:01Z","snapshot_observed_at":"2026-08-16T14:12:07.883399Z","submitted_at":"2024-03-07T00:44:01Z","title":"Exploring LLM-based Agents for Root Cause Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04123","snapshot_observed_at":"2026-08-08T19:46:28.986960Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":365,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:28.986960Z"},"links":{"cited_paper":"/paper/2403.04123","citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:e4d617e27fdbc5162a0827381ad2c9a95679fca954a2982ae423dc2c34a4cbfa","observation_id":"b2537391-61d0-4d00-a9fc-cf0f6ec47733","resolution":{"observed_at":"2026-08-08T19:46:28.986960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:28.981608Z","title":"doi: 10.1145/2829988.2787496","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:28.981608Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:154c73f014f784a7bbb7eb5fa40be7d0b631cd3b1502fa82336a0bcfbc035dc4","observation_id":"a14c3c13-3df1-4e31-956b-ea1e4feaddc7","resolution":{"observed_at":"2026-08-08T19:46:28.981608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.508035Z","title":null,"venue":null,"work_id":"135397be-1a98-4665-aa03-8aa1e894d419","year":2023},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:28.992760Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:a197f10c87170e039eb36a6e937b493b8a027ac1faadfa788f8ddc59a717026b","observation_id":"1f66d25f-b529-403d-b8f0-689eb1e46340","resolution":{"observed_at":"2026-08-08T19:46:29.513270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:46:29.524003Z","title":"the AI revolution hasn’t happened yet","venue":null,"work_id":"ba92ecfa-321e-40bf-a2a8-80de0d38c9ee","year":2025},"citing_paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T19:46:28.975048Z"},"links":{"citing_paper":"/paper/2502.05352"},"observation_digest":"sha256:eeea10b8432805c740d72ec56b5c4d1573cad345db83b3ca4cea071d38944053","observation_id":"33c4311d-fded-49d5-a82d-ead5ae4a6d64","resolution":{"observed_at":"2026-08-08T19:46:29.529339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.05352","last_updated":"2025-02-07T21:46:52Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T00:13:07.515086Z","submitted_at":"2025-02-07T21:46:52Z","title":"ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 10 inbound Pith citation observations for arXiv:2502.05352."}