{"as_of":"2026-08-15T01:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fc6b82e00e970cd57e59954555d5377d88ac780fe5642663586b42bc4ea9878","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:31:23.785317Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2604.18874","last_updated":"2026-04-20T21:53:39Z","snapshot_observed_at":"2026-08-11T10:04:47.128566Z","submitted_at":"2026-04-20T21:53:39Z","title":"How Adversarial Environments Mislead Agentic AI?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-10T04:04:41.152756Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2604.18874"},"observation_digest":"sha256:414e50df85749401d0a76d03082a63e320694dc6b2af1a35b4dbd2904c43d2c0","observation_id":"bdeab335-c9da-42f9-b11e-4ff36007e409","resolution":{"observed_at":"2026-05-11T12:11:07.718136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2605.09012","last_updated":"2026-05-09T15:52:49Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T15:52:49Z","title":"Re$^2$Math: Benchmarking Theorem Retrieval in Research-Level Mathematics","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T02:07:39.648269Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2605.09012"},"observation_digest":"sha256:6b640dbba4d78986f9da3fed41e14ed6e5ea48a561a56f5a1e591ac68bbd11fc","observation_id":"1d8d5f3f-c906-4727-a5b8-61bc406facc8","resolution":{"observed_at":"2026-05-12T02:11:16.023052Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-14T09:37:41.438142Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-05-20T10:30:50.256635Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:15cddd0bf3b3eaaa0844f778931db90933887a8085e0560ef57db87cc06dce3f","observation_id":"fe585871-120e-480a-8c5b-d85aed7880a2","resolution":{"observed_at":"2026-05-20T10:33:12.766594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-02T13:43:37.843484Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-14T09:37:41.438142Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:37.843484Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:d59de8a13d21144f994c1e9b64c0b50686b598bb2e7b36a81d01ed913349c660","observation_id":"3c7b53dd-ecea-491f-b0c6-531e11b12ae2","resolution":{"observed_at":"2026-08-02T13:43:37.843484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2605.19196","last_updated":"2026-05-18T23:55:08Z","snapshot_observed_at":"2026-07-06T23:29:57.003383Z","submitted_at":"2026-05-18T23:55:08Z","title":"Time to REFLECT: Can We Trust LLM Judges for Evidence-based Research Agents?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T10:15:37.280308Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2605.19196"},"observation_digest":"sha256:47c23868ab4132bab7fa8d41ec2923993adb666ac7bd87cfadfc680edf917b31","observation_id":"63874281-696b-42b9-ba4b-30048d32597d","resolution":{"observed_at":"2026-05-20T10:18:11.803436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2606.11337","last_updated":"2026-06-09T18:16:04Z","snapshot_observed_at":"2026-08-12T14:40:15.617322Z","submitted_at":"2026-06-09T18:16:04Z","title":"Can AI Agents Synthesize Scientific Conclusions?","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T13:05:07.718882Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2606.11337"},"observation_digest":"sha256:2b266832d002e90a4ab1a50934fce9536b12bd0ad109ab42a59d6e3631697e47","observation_id":"ce938068-7677-442d-aafd-00d753d2714f","resolution":{"observed_at":"2026-07-03T05:47:41.464352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:ef463222e6123577436f60e529ff8895f6f604e9a04e70550fa37fc0fce4bc2a","observation_id":"23d8e122-682a-449b-8338-2bebfcf18d13","resolution":{"observed_at":"2026-06-27T09:50:48.558404Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":"2508.15804","doi":"10.48550/arxiv.2508.15804","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReportBench: Evaluating deep research agents via academic survey tasks","venue":"arXiv (Cornell University)","work_id":"cb426d3d-866c-4daf-81b7-dea902e27d4a","year":2025},"citing_paper":{"arxiv_id":"2606.26246","last_updated":"2026-06-24T18:00:12Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:00:12Z","title":"Lacuna: A Research Map for Machine Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T00:51:24.834719Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2606.26246"},"observation_digest":"sha256:e6f68ab552b65082710c3b2c1f7b8696468c387c39ba4f5cfa3e3d4facee653d","observation_id":"c109b3bd-556f-4c9f-9fee-b656683dbbea","resolution":{"observed_at":"2026-07-04T16:09:57.429847Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-01T09:12:23.111579Z","title":"arXiv preprint arXiv:2508.15804 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20872","last_updated":"2026-07-23T02:50:35Z","snapshot_observed_at":"2026-08-08T15:41:04.334099Z","submitted_at":"2026-07-23T02:50:35Z","title":"LegalCiteTrust: Benchmarking Citation Trustworthiness in Chinese Long-Form Legal Research Reports","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T09:12:23.111579Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2607.20872"},"observation_digest":"sha256:b0f05259bda3b8ba4ad22cb9d90a15c2abc2399f60a762072af4c8cfc4853f92","observation_id":"5055cc52-ed68-4162-a2ef-3e885940b6e0","resolution":{"observed_at":"2026-08-01T09:12:23.111579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-07-30T20:14:27.112809Z","title":"Reportbench: Evaluating deep research agents via academic survey tasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23524","last_updated":"2026-07-26T07:45:01Z","snapshot_observed_at":"2026-08-14T06:00:48.844048Z","submitted_at":"2026-07-26T07:45:01Z","title":"Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T20:14:27.112809Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2607.23524"},"observation_digest":"sha256:c7e49cd89c1e40818d87008c85895a7f388b290ba7bb88da51e96f2972f96ac5","observation_id":"5bfb1fb4-55e5-4704-af5a-e5a7138abfa0","resolution":{"observed_at":"2026-07-30T20:14:27.112809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-07-31T00:05:16.749966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.749966Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:124eba67235cd9c3adc8e130ecf559ba98b40588784db87da843757f018297a9","observation_id":"10752821-d4e1-44bf-90eb-44ffccd332c5","resolution":{"observed_at":"2026-07-31T00:05:16.749966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-05T00:22:58.884828Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00764","last_updated":"2026-08-01T16:54:41Z","snapshot_observed_at":"2026-08-09T13:32:46.703956Z","submitted_at":"2026-08-01T16:54:41Z","title":"FinDeepIndicator: Benchmarking Deep Research Agents in End-to-End Financial Indicator Construction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T00:22:58.884828Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2608.00764"},"observation_digest":"sha256:32264204bd047a692ce76fa1c423a0164d7ddf33dba12a3f3091b745e84fd26b","observation_id":"590e4f03-85f8-4884-8aa2-fec5936a469f","resolution":{"observed_at":"2026-08-05T00:22:58.884828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-04T13:31:21.958519Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02163","last_updated":"2026-08-03T12:43:00Z","snapshot_observed_at":"2026-08-09T10:48:32.320099Z","submitted_at":"2026-08-03T12:43:00Z","title":"From Simple QA to Deep Research: A Verifiable Benchmark Constructed through Iterative Task Evolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:31:21.958519Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2608.02163"},"observation_digest":"sha256:8dd878d2c15ecce01cc4421cf27e9c98cbaeff5dcd9a59daa0eb031448ddf2d7","observation_id":"ea6935a7-5399-4696-a958-6549381a1da9","resolution":{"observed_at":"2026-08-04T13:31:21.958519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-11T00:31:23.785317Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-14T17:51:09.844851Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.785317Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b417de1516e5a8735df52e844be7c68c4b95f31ee49d08617e55acb73240a16b","observation_id":"7af85fb0-70f3-422c-855f-4d0a9a5d2e88","resolution":{"observed_at":"2026-08-11T00:31:23.785317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.15804/citation-record","integrity":"/paper/2508.15804/integrity","json":"/paper/2508.15804/citation-record.json","paper":"/paper/2508.15804"},"outbound":[],"paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2508.15804."}