{"as_of":"2026-08-18T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed71190db20d7fe8813eb5ad9b41e111193877d2514d2d7e900298d37f619777","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:45:42.019150Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T14:49:53.357083Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:41:09.640177Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"cited_work":{"arxiv_id":"2505.12057","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12057","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"edema,” whereas ρ(o) =neg denotes an explicitly negated wording such as “No edema","venue":null,"work_id":"b6c69bac-6487-42a0-abdb-c7f5ca4fb7ab","year":2025},"citing_paper":{"arxiv_id":"2605.05810","last_updated":"2026-05-07T07:46:17Z","snapshot_observed_at":"2026-08-16T04:48:01.615261Z","submitted_at":"2026-05-07T07:46:17Z","title":"CXR-ContraBench: Benchmarking Negated-Option Attraction in Medical VLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T14:49:53.357083Z"},"links":{"cited_paper":"/paper/2505.12057","citing_paper":"/paper/2605.05810"},"observation_digest":"sha256:cc0571a4afcf8dd6265572ceae00d23421834aa2a0348c578aefb8157124030c","observation_id":"cd907dbd-47b3-4ad1-aae8-46f4c2f0950f","resolution":{"observed_at":"2026-05-11T18:41:09.654894Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12057/citation-record","integrity":"/paper/2505.12057/integrity","json":"/paper/2505.12057/citation-record.json","paper":"/paper/2505.12057"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.719050Z","title":"The growing nationwide radiologist shortage: current opportunities and ongoing challenges for international medical graduate radiologists","venue":null,"work_id":"ea215ee3-3cf3-4e64-8a9f-a892281150d7","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.843413Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:a28f36a878f650d7db510871ee3c29397b565210d7f0645cd5a6e24a9964f3f7","observation_id":"a2f90fcc-96b4-492b-8172-08f5c5a89bf6","resolution":{"observed_at":"2026-08-15T20:45:42.724065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.704439Z","title":"Large-scale validation of the feasibility of gpt-4 as a proofreading tool for head ct reports","venue":null,"work_id":"73dd04c6-e56a-4a58-a0f3-507dd17690c1","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.848430Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:01037f38827d8921d1aa6df898fcb33caa8ae25dc2da515bf10a6f05ee9b8b43","observation_id":"d60bc232-3f71-42db-97fd-b0884e6e1131","resolution":{"observed_at":"2026-08-15T20:45:42.708908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.689989Z","title":"Potential of gpt-4 for detecting errors in radiology reports: implications for reporting accuracy","venue":null,"work_id":"86fd8891-6e71-46f2-b3ef-4c84c4e79e0a","year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.852928Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:21cf1762e13914872bf5e8547e8b89e85db0ab77bdf9b3792c9ab90a9c7a267e","observation_id":"693583cc-16d3-4a39-81da-f0a59b209a10","resolution":{"observed_at":"2026-08-15T20:45:42.694733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.676719Z","title":"Diagnostic error and bias in the department of radiology: a pictorial essay","venue":null,"work_id":"51bf8e5c-d8f3-4927-a24a-6e7f84df9162","year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.857548Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:dfaccb842d4c8e8161fab26a536e6deab712bce3a6f0633b13c2182cae55429e","observation_id":"88b5b451-9c10-48d8-bb56-84ab74131825","resolution":{"observed_at":"2026-08-15T20:45:42.681063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.662865Z","title":"Errors in radiology: A standard review","venue":null,"work_id":"9adaea26-a9c0-4428-8d8d-64a5eb988647","year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.862012Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:0ff77c7d16e7311e84a0fcc9a82a3335bc76445617f2217a67777581321450fb","observation_id":"b50a4360-2198-4b3e-9975-fda2416d92b0","resolution":{"observed_at":"2026-08-15T20:45:42.667495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.649031Z","title":"Work overload and diagnostic errors in radiology","venue":null,"work_id":"62c57b88-9eb6-40f7-93e6-74e9bf64b446","year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.866513Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:f253a4c2637851a67266e4cf69b051174a44d386c89845b6d4e2cc7fc99f5f8e","observation_id":"b2b780e9-f312-4f82-a682-3a4efca37b0d","resolution":{"observed_at":"2026-08-15T20:45:42.653461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-16T14:25:27.106074Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-15T20:45:41.871279Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.871279Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:66f0accd30d0255ae4c83f83a0877fdf36f7fe214f1ff29c283effd2b6375b9d","observation_id":"85a820f2-8847-43d0-a6d0-8fff59ae9741","resolution":{"observed_at":"2026-08-15T20:45:41.871279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11490","last_updated":"2024-03-18T03:41:09Z","snapshot_observed_at":"2026-08-16T15:31:47.700377Z","submitted_at":"2023-05-19T07:44:39Z","title":"LLM-CXR: Instruction-Finetuned LLM for CXR Image Understanding and Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11490","snapshot_observed_at":"2026-08-15T20:45:41.875809Z","title":"LLM-CXR: instruction-finetuned llm for cxr image understanding and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.875809Z"},"links":{"cited_paper":"/paper/2305.11490","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:c6da966ac74a1ed6a7e15d9b92e46979da29a27880d4c4094b4c4f5388dabec9","observation_id":"f77eb686-8e43-4cb9-8a16-da352e3bf34c","resolution":{"observed_at":"2026-08-15T20:45:41.875809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09117","last_updated":"2025-05-29T08:27:32Z","snapshot_observed_at":"2026-08-16T15:47:47.336880Z","submitted_at":"2023-03-16T07:23:55Z","title":"Cross-Modal Causal Intervention for Medical Report Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09117","snapshot_observed_at":"2026-08-15T20:45:41.880132Z","title":"Cross-modal causal intervention for medical report generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.880132Z"},"links":{"cited_paper":"/paper/2303.09117","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:19926197701caf439d4338b1e3db196ed3112908126939fc2f734714b9ab72ee","observation_id":"5254989f-3e8a-41b5-b972-7dfd5192f0ae","resolution":{"observed_at":"2026-08-15T20:45:41.880132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:41.884867Z","title":"Collaboration between clinicians and vision–language models in radiology report generation.Nature Medicine, 31(2):599–608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.884867Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:f5697a25347812080bc575ed164c27e916e2fbc3da82f6c5d515ae5a6154b0ea","observation_id":"4c1f2033-e96d-430f-a633-e02a8742b8b5","resolution":{"observed_at":"2026-08-15T20:45:41.884867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.624726Z","title":"Dacg: Dual attention and context guidance model for radiology report generation","venue":null,"work_id":"281b71a1-6f32-4829-b65b-c5e48c08f5da","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.889335Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:c620117ac27fe665bc1d8256fa8d92573d78b4978c63b59d7e439ed1caf9a4d4","observation_id":"8bb44e85-6449-4157-b129-eb74df90b885","resolution":{"observed_at":"2026-08-15T20:45:42.630074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06828","last_updated":"2024-12-06T21:33:03Z","snapshot_observed_at":"2026-08-18T01:51:02.256228Z","submitted_at":"2024-12-06T21:33:03Z","title":"Enhancing LLMs for Impression Generation in Radiology Reports through a Multi-Agent System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06828","snapshot_observed_at":"2026-08-15T20:45:41.893781Z","title":"Enhancing llms for impression generation in radiology reports through a multi-agent system","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.893781Z"},"links":{"cited_paper":"/paper/2412.06828","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:6ca1962382227849f08a3b0b364229b01f0447c743267eaa91aa457ebe0fe6c6","observation_id":"4ea07e03-1b34-43c8-bc2b-e2f1fbb73532","resolution":{"observed_at":"2026-08-15T20:45:41.893781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.609971Z","title":"Large language models for error detection in radiology reports: a comparative analysis between closed-source and privacy-compliant open-source models","venue":null,"work_id":"b4e86923-78d6-4018-af1b-7e426a3282b2","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.898681Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:ec4f149230822ce9cb2dcf8a6c5c2ee3d84e94374ff2d5d87512a9b29e0655e7","observation_id":"74cd184b-43f8-48bb-b7e8-befe31caf35d","resolution":{"observed_at":"2026-08-15T20:45:42.614690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.594075Z","title":"The use of large language models in detecting chinese ultrasound report errors","venue":null,"work_id":"06917cd3-fe0f-43f7-b2ad-44f603756949","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.902887Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:8b441f76ff0e000d3ab341153821bf0a7ff437b5d00f1722d66558ab5586b880","observation_id":"32694e39-2ce5-4901-86d3-7aab24c34421","resolution":{"observed_at":"2026-08-15T20:45:42.599000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.579543Z","title":"Radiology report expert evaluation (rexval) dataset, 2023","venue":null,"work_id":"7116561d-5221-4dde-a4d1-3d3c02a60a77","year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.907259Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:3f8ea61578d73db458757e2d1fdc91199d9c5685bd999548e91b5a0ac19fbf47","observation_id":"835b208b-26c3-4703-b152-c6a27a17057c","resolution":{"observed_at":"2026-08-15T20:45:42.584195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.564579Z","title":"Radiology report generation models evaluation dataset for chest x-rays (RadEvalX)","venue":null,"work_id":"11916661-4634-4ae9-b217-da564f63b3f3","year":null},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.911575Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:d62597ee69f3f4a55c0f2eb28254e2562a2c3c58926936f4d67df8104d6744ec","observation_id":"1242929a-6718-4bd7-8e1d-a70ff8551faf","resolution":{"observed_at":"2026-08-15T20:45:42.569649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.550237Z","title":"RRED: a radiology report error detector based on deep learning framework","venue":null,"work_id":"2c5f0bce-f3a6-42d0-b9a4-3284bc0c345c","year":2022},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.916084Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:ba153cd21e512eb4ea67cfc36ad9bb0512df83499ea89c788716a3c11a9200d9","observation_id":"415920d8-bc2f-4a5b-b2ce-b0fe9b3b9f95","resolution":{"observed_at":"2026-08-15T20:45:42.555044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.535249Z","title":"ReXErr: Synthesizing clinically meaningful errors in diagnostic radiology reports","venue":null,"work_id":"d34f9daf-205a-44bf-8d85-cbcea7c02294","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.920295Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:5a52e1e1e2414e4bbb3e4d9617cda0bfdb701bc3fc718351f9ef0d29e2dc9f07","observation_id":"84990f18-84dd-46d2-96ad-082d23afc87e","resolution":{"observed_at":"2026-08-15T20:45:42.539975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:41.924482Z","title":"Mimic-cxr, a de-identified publicly available database of chest radiographs with free-text reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.924482Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:51b00944a6d79683c314fd15299f85faa3758236f127d101a4b7e23f953a0b1b","observation_id":"9c95da45-f746-4dfc-ae2e-510dfa4a683f","resolution":{"observed_at":"2026-08-15T20:45:41.924482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.511133Z","title":"Chest x- ray report generation through fine-grained label learning","venue":null,"work_id":"739d74ad-43bd-4693-9911-6d6b9c43a052","year":2020},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.928936Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:33af5eab66b66b1fd1214cfcc971a38263ebc581f530ce6b65dc40e0779945f9","observation_id":"c2bc4636-1949-41af-8708-783c077b22e7","resolution":{"observed_at":"2026-08-15T20:45:42.515901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.496513Z","title":"Automated radiographic re- port generation purely on transformer: A multicriteria supervised approach","venue":null,"work_id":"3c4d6b8c-9118-4423-b0e6-714d717d9a3d","year":2022},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.933270Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:a005a38cfb3230010df9104de6ca6ca3e13685d63eb5d683914f581c8c905262","observation_id":"4e766b9b-ce73-44ad-99f7-10459651f598","resolution":{"observed_at":"2026-08-15T20:45:42.501120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06471","last_updated":"2021-05-25T07:47:23Z","snapshot_observed_at":"2026-08-16T18:22:28.281959Z","submitted_at":"2021-05-25T07:47:23Z","title":"Writing by Memorizing: Hierarchical Retrieval-based Medical Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06471","snapshot_observed_at":"2026-08-15T20:45:41.937502Z","title":"Writing by memorizing: Hierar- chical retrieval-based medical report generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.937502Z"},"links":{"cited_paper":"/paper/2106.06471","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:7b3aecd380cad3e134801ec4d10cbade75e13991edbc5a2f61e26e41bcb6da5c","observation_id":"7369e2e6-5be0-44f1-8001-2652600a97f2","resolution":{"observed_at":"2026-08-15T20:45:41.937502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.482176Z","title":"Retrieval- based chest x-ray report generation using a pre-trained contrastive language-image model","venue":null,"work_id":"6b8b5534-225f-4381-8f45-37e716bacdd6","year":2021},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.942157Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:a5d16684db52b232b0f734d5e7f4a5da6152e51d0a026bde71ca41dd742042e7","observation_id":"a2e5a15a-f964-4a5b-9514-4b5cf520a7bb","resolution":{"observed_at":"2026-08-15T20:45:42.486667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15122","last_updated":"2026-08-12T05:03:18Z","snapshot_observed_at":"2026-08-15T23:09:01.180109Z","submitted_at":"2024-11-22T18:40:02Z","title":"ReXrank: A Public Leaderboard for AI-Powered Radiology Report Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15122","snapshot_observed_at":"2026-08-15T20:45:41.946558Z","title":"ReXrank: A public leaderboard for ai-powered radiology report generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.946558Z"},"links":{"cited_paper":"/paper/2411.15122","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:16a27c4bf2dc8af78a0d858fc14f773d0fb66154698d288c03304dfed35fac3b","observation_id":"fe719b4c-6cc9-4f73-bcee-915b1474473d","resolution":{"observed_at":"2026-08-15T20:45:41.946558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:41.951182Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.951182Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:67ad0c1fa987fa2f7226038af08e15762b9bd6a6dec21b48839d07c924037fcb","observation_id":"da230c29-0ab9-417c-ac2d-09046bffbe5d","resolution":{"observed_at":"2026-08-15T20:45:41.951182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:41.955174Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.955174Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:adc2457665e5a7e3e6d9d106493139b8a75c219e1c294e4f8ca3f6c34762bac4","observation_id":"0ac73cbf-bf37-453c-bcf6-eedbf90d4cc1","resolution":{"observed_at":"2026-08-15T20:45:41.955174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09167","last_updated":"2020-10-18T20:30:22Z","snapshot_observed_at":"2026-08-18T10:13:36.303045Z","submitted_at":"2020-04-20T09:46:40Z","title":"CheXbert: Combining Automatic Labelers and Expert Annotations for Accurate Radiology Report Labeling Using BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09167","snapshot_observed_at":"2026-08-15T20:45:41.959153Z","title":"Chexbert: combining automatic labelers and expert annotations for accurate radiology report labeling using bert","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.959153Z"},"links":{"cited_paper":"/paper/2004.09167","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:1b1f5b17887c412dce57a73e5f7c6aa1050af8f95205ff8fed5f4373c4cb4eea","observation_id":"b47042c6-b656-4ade-9011-3fb648817359","resolution":{"observed_at":"2026-08-15T20:45:41.959153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.448788Z","title":"Evaluating progress in automatic chest x-ray radiology report generation","venue":null,"work_id":"0ef7c0ce-9c03-4717-a29a-09f7e1a43320","year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.963911Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:a4c9237d5ac8a1c4245ae51e27d85c3fc7be584674c99c7e156d907874935715","observation_id":"666cfcf1-08a0-4534-8ac5-88c0a4acb718","resolution":{"observed_at":"2026-08-15T20:45:42.453793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03595","last_updated":"2025-01-22T06:24:43Z","snapshot_observed_at":"2026-08-16T13:54:59.184115Z","submitted_at":"2024-05-06T16:04:03Z","title":"GREEN: Generative Radiology Report Evaluation and Error Notation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03595","snapshot_observed_at":"2026-08-15T20:45:41.968161Z","title":"Green: Generative radiology report evaluation and error notation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.968161Z"},"links":{"cited_paper":"/paper/2405.03595","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:799cb41358629307d0c00c760061504ddfefb5b25b2e9c8122b895a5a864ea7a","observation_id":"191d015c-bc57-4db4-8312-12b94802fb77","resolution":{"observed_at":"2026-08-15T20:45:41.968161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04336","last_updated":"2025-04-06T03:02:36Z","snapshot_observed_at":"2026-08-16T12:43:40.629734Z","submitted_at":"2025-04-06T03:02:36Z","title":"Generative Large Language Models Trained for Detecting Errors in Radiology Reports","version":1},"cited_work":{"arxiv_id":"2504.04336","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.04336","snapshot_observed_at":"2026-08-15T20:45:42.296551Z","title":"Generative Large Language Models Trained for Detecting Errors in Radiology Reports","venue":"cs.CL","work_id":"037303a1-c3b5-44d0-94b4-9fc28a6eff3b","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.972776Z"},"links":{"cited_paper":"/paper/2504.04336","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:b3055b917f54f55733dd2e3b47b405f7dbfcbb88aecb07bbdb984ec0d306d55e","observation_id":"e9ac5fdf-4c5b-43ab-aa2e-177b1240cebc","resolution":{"observed_at":"2026-08-15T20:45:42.303604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:45:41.977393Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.977393Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:2eefee7e6fbef70d61e3aa3db80f9fa6ab855c8c48da158fce8ceb6879d27e12","observation_id":"0bc1b998-8562-4884-af9a-1aee68e3db1c","resolution":{"observed_at":"2026-08-15T20:45:41.977393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T20:45:41.981918Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.981918Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:5db082ab3c67d5c510e2867a2a68b596aee3877000e79e6340e71b9786b5885f","observation_id":"74d406bd-7e02-469c-9451-39fb3d4af035","resolution":{"observed_at":"2026-08-15T20:45:41.981918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-16T12:54:49.819371Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-15T20:45:41.986352Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.986352Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:36e044266cd35e841aaa507fa5c5cb3e5debb645b013cc85da2bf2ae6034437b","observation_id":"0fc0e750-1d4f-40eb-b098-5e0d00dd77f9","resolution":{"observed_at":"2026-08-15T20:45:41.986352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-15T20:45:41.991117Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.991117Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:b565fe0d007492d828b84f2faf3f2090b252d020bcd9b8a9e2ba08f206bd27fe","observation_id":"f1a5ce22-164a-4aff-bbf8-479cb12063dd","resolution":{"observed_at":"2026-08-15T20:45:41.991117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:41.995569Z","title":"Baichuan-omni-1.5 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:41.995569Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:f4f065b268a9aaefdabe5a1b83ddb3a884c5ca83b17365ae1bf7fe5a7cd7d27b","observation_id":"92925b22-0f3d-421e-9279-99e9dcd70e94","resolution":{"observed_at":"2026-08-15T20:45:41.995569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T20:45:42.000445Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:42.000445Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:89b1a5fafdc256ad6a0b0421eeb5b5ad3af593bec5e5ea88ed44089f154939a6","observation_id":"29dbe717-be95-4245-b4af-ced72b339a03","resolution":{"observed_at":"2026-08-15T20:45:42.000445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:45:42.005696Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:42.005696Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:9b1ea25fddaa095b84694c15eea0942a2fd0d4e81c19ed4f6f72bd2ba475518d","observation_id":"27a13837-8ef8-47c2-b61b-173ca97a3a10","resolution":{"observed_at":"2026-08-15T20:45:42.005696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:42.434413Z","title":"Introducing openai o3 and o4-mini","venue":null,"work_id":"877cca04-f3b7-49eb-8268-a29ff15f72f1","year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:42.010417Z"},"links":{"citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:9e23a9564d05b2b0176b0e4d2d4f0072d4212a017605189202181c60dd3e4cf0","observation_id":"3afb02b3-30c3-46cf-a6a4-15bc650dacd7","resolution":{"observed_at":"2026-08-15T20:45:42.438956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-15T20:45:42.014887Z","title":"Bertscore: Evaluating text generation with bert","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:42.014887Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:6bed3fa1f96b17082823802ffce40319245127839f30b66965869d5ed2ed1715","observation_id":"8bb8aac3-1de2-48b8-be6a-946ca8e210f6","resolution":{"observed_at":"2026-08-15T20:45:42.014887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03981","last_updated":"2025-05-06T21:08:27Z","snapshot_observed_at":"2026-08-15T23:38:33.747558Z","submitted_at":"2025-05-06T21:08:27Z","title":"X-Reasoner: Towards Generalizable Reasoning Across Modalities and Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03981","snapshot_observed_at":"2026-08-15T20:45:42.019150Z","title":"X-reasoner: Towards generalizable reasoning across modalities and domains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:45:42.019150Z"},"links":{"cited_paper":"/paper/2505.03981","citing_paper":"/paper/2505.12057"},"observation_digest":"sha256:a3515286aba96729d46a905e6c628c4d88c5a309fe3407ce81bd678a108954e3","observation_id":"48cabf78-0376-4e4f-8bd5-abffa02c9207","resolution":{"observed_at":"2026-08-15T20:45:42.019150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12057","last_updated":"2025-05-17T15:39:39Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T15:08:27.808595Z","submitted_at":"2025-05-17T15:39:39Z","title":"CorBenchX: Large-Scale Chest X-Ray Error Dataset and Vision-Language Model Benchmark for Report Error Correction"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2505.12057."}