{"as_of":"2026-08-11T13:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34b27bf099caefabc73870882d1b64b7e19916dc8826d9f63a07fb2523814d95","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":55,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:50:36.604885Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":24,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T23:08:21.673251Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2305.10415"},"observation_digest":"sha256:8dfc1a41be8aa2ff5c9885a39af45c9c31fc951d7912b53ca9ddc073aee119fd","observation_id":"71ed8c23-5d72-4121-90c3-5dbff6ecfaa8","resolution":{"observed_at":"2026-05-15T23:08:21.825246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2401.02458","last_updated":"2026-04-29T07:43:10Z","snapshot_observed_at":"2026-07-29T23:57:44.096283Z","submitted_at":"2024-01-04T08:00:32Z","title":"Data-Centric Foundation Models in Computational Healthcare: A Survey","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T04:13:05.328492Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2401.02458"},"observation_digest":"sha256:cb5d59fd9de7724d99c66a86b032240dd90578f24c6f219fffd6ebf76e02971d","observation_id":"f4184161-98bf-4faa-80a2-a516e0a946fa","resolution":{"observed_at":"2026-05-24T04:13:52.746843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2408.16213","last_updated":"2024-08-29T02:12:58Z","snapshot_observed_at":"2026-08-02T05:05:13.711617Z","submitted_at":"2024-08-29T02:12:58Z","title":"M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-23T22:03:33.418989Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2408.16213"},"observation_digest":"sha256:32d924b3fa9de50d70a5872fff34dc5d31623eea4a0d9cb1f487b534d91a323e","observation_id":"1edf6b04-a0e6-4972-b3ec-b99b6e5b0e04","resolution":{"observed_at":"2026-05-23T22:05:50.496878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-11T10:50:36.604885Z","title":"arXiv preprint arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16086","last_updated":"2025-01-22T17:18:15Z","snapshot_observed_at":"2026-08-11T10:45:35.026027Z","submitted_at":"2024-12-20T17:33:50Z","title":"Towards Interpretable Radiology Report Generation via Concept Bottlenecks using a Multi-Agentic RAG","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:50:36.604885Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2412.16086"},"observation_digest":"sha256:095400cf57a69fae3a84ce2f51f63f140315f9cb0cbc7b4266e5b089a502bc39","observation_id":"668afad2-a850-4e3c-bbd7-61f7767b7d94","resolution":{"observed_at":"2026-08-11T10:50:36.604885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-10T14:56:56.066419Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14685","last_updated":"2025-01-24T18:01:07Z","snapshot_observed_at":"2026-08-10T14:52:19.200316Z","submitted_at":"2025-01-24T18:01:07Z","title":"Rethinking Foundation Models for Medical Image Classification through a Benchmark Study on MedMNIST","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:56:56.066419Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2501.14685"},"observation_digest":"sha256:1f8b77f50a4c7bb2b9749f0d1d7569526242ce96788a13595f85213c4cb54898","observation_id":"725378fc-3082-48d2-aa1d-919681894adc","resolution":{"observed_at":"2026-08-10T14:56:56.066419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-09T12:11:03.419216Z","title":"V.; Valanarasu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02438","last_updated":"2025-02-04T16:04:48Z","snapshot_observed_at":"2026-08-10T08:37:45.334064Z","submitted_at":"2025-02-04T16:04:48Z","title":"Medical Multimodal Model Stealing Attacks via Adversarial Domain Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T12:11:03.419216Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2502.02438"},"observation_digest":"sha256:a7ad7ab81469522291395f80188c8430b7d8f5418eb418bac0e3fa0700700e57","observation_id":"79077809-c002-4b41-9b00-bd8cb7ae0a3a","resolution":{"observed_at":"2026-08-09T12:11:03.419216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-09T11:35:32.550582Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02673","last_updated":"2025-05-29T01:45:45Z","snapshot_observed_at":"2026-08-09T11:28:38.587779Z","submitted_at":"2025-02-04T19:31:00Z","title":"MedRAX: Medical Reasoning Agent for Chest X-ray","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T11:35:32.550582Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2502.02673"},"observation_digest":"sha256:58bb6b3f3fcd553e2b3ab6855d51a48693ecb4f89e144e8521593d5ba3ed796d","observation_id":"3a5f7395-0187-44b2-aabf-7bc156caa77a","resolution":{"observed_at":"2026-08-09T11:35:32.550582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-08T20:10:52.338921Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05142","last_updated":"2025-06-19T14:25:55Z","snapshot_observed_at":"2026-08-09T13:19:18.259577Z","submitted_at":"2025-02-07T18:16:15Z","title":"Chest X-ray Foundation Model with Global and Local Representations Integration","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T20:10:52.338921Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2502.05142"},"observation_digest":"sha256:875fda036c9ced8cd7be3ef8499ec7aaf01332e132e32092858f6c01acdd51da","observation_id":"03e91c85-a745-4890-8d8f-e5c2a9ebe89d","resolution":{"observed_at":"2026-08-08T20:10:52.338921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T22:13:31.264734Z","title":"arXiv preprint arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09242","last_updated":"2025-02-13T11:57:51Z","snapshot_observed_at":"2026-08-07T22:53:39.152523Z","submitted_at":"2025-02-13T11:57:51Z","title":"From large language models to multimodal AI: A scoping review on the potential of generative AI in medicine","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-07T22:13:31.264734Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2502.09242"},"observation_digest":"sha256:e5836ed0d197532af9336e18df55570461697c38d8893fe150065c160bd4f388","observation_id":"6b93a514-a254-4ac1-8c85-34fbfb3705c0","resolution":{"observed_at":"2026-08-07T22:13:31.264734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2504.07415","last_updated":"2026-04-18T04:19:29Z","snapshot_observed_at":"2026-07-06T21:07:04.785627Z","submitted_at":"2025-04-10T03:14:01Z","title":"RA-RRG: Multimodal Retrieval-Augmented Radiology Report Generation with Key Phrase Extraction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T21:09:07.088042Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2504.07415"},"observation_digest":"sha256:d518fce411bbaf24914d4147537c7723120f2ce50eeb22ed94e37c8b86b7bb19","observation_id":"ee0a27ff-2d50-422b-9bd5-545603d86998","resolution":{"observed_at":"2026-05-22T21:12:08.656908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T15:41:30.787093Z","title":"Preprint, arXiv:2401.12208","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14318","last_updated":"2025-06-02T05:56:06Z","snapshot_observed_at":"2026-08-10T08:52:50.082977Z","submitted_at":"2025-05-20T13:05:41Z","title":"RADAR: Enhancing Radiology Report Generation with Supplementary Knowledge Injection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:30.787093Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.14318"},"observation_digest":"sha256:8d6f611b0a17cb9aee4a0116546a30c868ba7e63a538fb4a1246672c5dab0b2f","observation_id":"2360f96f-9874-481d-a370-04c535021463","resolution":{"observed_at":"2026-08-07T15:41:30.787093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T15:27:22.224494Z","title":"Chexagent: Towards a foun- dation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15123","last_updated":"2025-08-24T14:40:35Z","snapshot_observed_at":"2026-08-09T16:58:46.218963Z","submitted_at":"2025-05-21T05:16:45Z","title":"Seeing the Trees for the Forest: Rethinking Weakly-Supervised Medical Visual Grounding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:27:22.224494Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.15123"},"observation_digest":"sha256:e27fc964850f17f1f5635b316ce305c391a387b88d9066fc6090859fde005cb8","observation_id":"39d4635b-8722-4f76-981a-b727d611bb67","resolution":{"observed_at":"2026-08-07T15:27:22.224494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T14:33:45.012023Z","title":"Tsai, Andrew Johnston, Cameron Olsen, Tanishq Mathew Abraham, Sergios Gatidis, Akshay S Chaudhari, and Curtis Langlotz","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18503","last_updated":"2025-05-24T04:45:45Z","snapshot_observed_at":"2026-08-07T23:09:57.753840Z","submitted_at":"2025-05-24T04:45:45Z","title":"Focus on What Matters: Enhancing Medical Vision-Language Models with Automatic Attention Alignment Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:33:45.012023Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.18503"},"observation_digest":"sha256:c7f98fe3853fb9d76dceb6324f4618314674468b4d94cc4023961089db63859f","observation_id":"da91735a-8b64-48e4-bac6-89d57b8ad2cb","resolution":{"observed_at":"2026-08-07T14:33:45.012023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T13:18:03.524986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22222","last_updated":"2025-05-28T10:54:40Z","snapshot_observed_at":"2026-08-07T13:10:16.672530Z","submitted_at":"2025-05-28T10:54:40Z","title":"Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:18:03.524986Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.22222"},"observation_digest":"sha256:59a9a6b3264f0083f4d12f1c6bf1c71cfde6b6d37b4842cf9c04b364c0f60fc1","observation_id":"d2ba9d0c-55df-4e8a-ab26-af54ecf64ac7","resolution":{"observed_at":"2026-08-07T13:18:03.524986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T12:57:02.664591Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23143","last_updated":"2025-05-29T06:30:40Z","snapshot_observed_at":"2026-08-11T01:10:04.694422Z","submitted_at":"2025-05-29T06:30:40Z","title":"Interpreting Chest X-rays Like a Radiologist: A Benchmark with Clinical Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.664591Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.23143"},"observation_digest":"sha256:4f54c4e7142d0e07bf439c129c57480339af6daf570bcc67afa9dd7a9a24d361","observation_id":"81daf345-ddd9-4d5d-b2b1-463ec3df5a27","resolution":{"observed_at":"2026-08-07T12:57:02.664591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-07T12:33:52.246181Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24223","last_updated":"2025-06-02T07:21:17Z","snapshot_observed_at":"2026-08-10T06:19:22.715505Z","submitted_at":"2025-05-30T05:23:01Z","title":"Automated Structured Radiology Report Generation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:52.246181Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2505.24223"},"observation_digest":"sha256:0b9822ac455f7966f8d31726c6ef1c31c74d061f6d1608b3d8c9db7fd4c764f5","observation_id":"bd320f3f-ef8a-4a54-b302-5335c2e89c00","resolution":{"observed_at":"2026-08-07T12:33:52.246181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2506.09067","last_updated":"2026-04-09T22:50:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-08T16:26:51Z","title":"Enhancing the Safety of Medical Vision-Language Models by Synthetic Demonstrations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T10:54:55.262180Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2506.09067"},"observation_digest":"sha256:4df17c168cef275e326af589e6ba5fb8a891bc37dd0e1ae3c15cd50a46170879","observation_id":"3a794871-ecd6-40e4-b134-8f9371aa64f6","resolution":{"observed_at":"2026-05-19T10:57:16.531110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T21:55:46.597320Z","title":"Chexagent: Towards a foun- dation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23102","last_updated":"2026-07-06T06:04:13Z","snapshot_observed_at":"2026-08-08T21:05:19.837782Z","submitted_at":"2025-06-29T06:08:55Z","title":"Region-Aware Multimodal Large Language Model via SlowFast Tokenization and Pseudo-Mask Guidance for 3D CT Report Generation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:55:46.597320Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2506.23102"},"observation_digest":"sha256:15d13dedc0894fb1f37d375e9a2090e39851a16fb5037e786d70d699aac01db6","observation_id":"aef1de60-bf37-4f5a-8553-d44f9e7e7987","resolution":{"observed_at":"2026-08-06T21:55:46.597320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T21:15:08.328213Z","title":"P., Reis, E., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02987","last_updated":"2025-07-24T12:44:31Z","snapshot_observed_at":"2026-08-07T08:32:30.823208Z","submitted_at":"2025-07-01T11:14:45Z","title":"Leveraging the Structure of Medical Data for Improved Representation Learning","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:15:08.328213Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2507.02987"},"observation_digest":"sha256:499cf2203ea1f83b4c751961a2f4d9844de999d9d0468152000610f94353abe3","observation_id":"d23c3a00-2d99-414e-b8f1-16a90bcc5c20","resolution":{"observed_at":"2026-08-06T21:15:08.328213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T19:01:14.766653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07148","last_updated":"2025-07-09T08:42:14Z","snapshot_observed_at":"2026-08-09T07:24:18.637353Z","submitted_at":"2025-07-09T08:42:14Z","title":"Explainable Artificial Intelligence in Biomedical Image Analysis: A Comprehensive Survey","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:01:14.766653Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2507.07148"},"observation_digest":"sha256:92ba426c4784f70c013d5bec6574a0b1f517f8b6a6c7f17bd0bc23624ba8d2a1","observation_id":"7268c637-2604-443d-ada6-dcb235686b2d","resolution":{"observed_at":"2026-08-06T19:01:14.766653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T18:12:25.359141Z","title":"arXiv preprint arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09097","last_updated":"2025-07-12T00:45:38Z","snapshot_observed_at":"2026-08-09T16:57:55.403326Z","submitted_at":"2025-07-12T00:45:38Z","title":"RadEyeVideo: Enhancing general-domain Large Vision Language Model for chest X-ray analysis with video representations of eye gaze","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:12:25.359141Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2507.09097"},"observation_digest":"sha256:91a61b35f148b142169d4a922fb6721429df3ec9a414f080b136f782c2f14818","observation_id":"32d9294f-4d91-4d2c-b988-3d000bb0ed86","resolution":{"observed_at":"2026-08-06T18:12:25.359141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T16:40:41.329861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12950","last_updated":"2025-07-18T09:19:19Z","snapshot_observed_at":"2026-08-08T08:02:10.889574Z","submitted_at":"2025-07-17T09:43:20Z","title":"Insights into a radiology-specialised multimodal large language model with sparse autoencoders","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:40:41.329861Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2507.12950"},"observation_digest":"sha256:f3625d453c4e0cef9c81e9c655700eb69a3c6134530e17dbf88594421af3aec7","observation_id":"3b25c5f2-95bd-43c9-af23-0c3d59d03968","resolution":{"observed_at":"2026-08-06T16:40:41.329861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T15:04:18.549125Z","title":"arXiv preprint arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16940","last_updated":"2025-07-22T18:24:18Z","snapshot_observed_at":"2026-08-10T00:54:09.887740Z","submitted_at":"2025-07-22T18:24:18Z","title":"AURA: A Multi-Modal Medical Agent for Understanding, Reasoning & Annotation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:18.549125Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2507.16940"},"observation_digest":"sha256:3c770ba29827d4fbf96ec458865ee295dee99a68c0364aa8b76cb24055ccd8bc","observation_id":"0ccd0c8e-5f6d-4e54-85ea-1d1ff3deb98d","resolution":{"observed_at":"2026-08-06T15:04:18.549125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-06T11:00:49.826478Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03733","last_updated":"2025-07-31T05:07:18Z","snapshot_observed_at":"2026-08-06T21:11:56.499497Z","submitted_at":"2025-07-31T05:07:18Z","title":"CX-Mind: A Pioneering Multimodal Large Language Model for Interleaved Reasoning in Chest X-ray via Curriculum-Guided Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:00:49.826478Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2508.03733"},"observation_digest":"sha256:678a578d4c0d7b3eae53a7a17577acdbc803bf5114b3e852bfce650c02b6e9d5","observation_id":"c5a3ee03-0311-49ec-879b-fd8d03963058","resolution":{"observed_at":"2026-08-06T11:00:49.826478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T23:56:49.031301Z","title":"Chexagent: Towards a foun- dation model for chest X-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04572","last_updated":"2025-08-06T15:54:44Z","snapshot_observed_at":"2026-08-09T16:58:26.710423Z","submitted_at":"2025-08-06T15:54:44Z","title":"Knowledge to Sight: Reasoning over Visual Attributes via Knowledge Decomposition for Abnormality Grounding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:56:49.031301Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2508.04572"},"observation_digest":"sha256:02ef3f21cede7c0f3a300910e55ae3f92a9f6806bee93d0bfc8114ace983737a","observation_id":"1ff48316-cf0d-4c38-b933-875eead9b60e","resolution":{"observed_at":"2026-08-05T23:56:49.031301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T16:03:16.013950Z","title":"arXiv preprint arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19322","last_updated":"2025-08-26T14:33:09Z","snapshot_observed_at":"2026-08-07T11:56:04.043856Z","submitted_at":"2025-08-26T14:33:09Z","title":"AT-CXR: Uncertainty-Aware Agentic Triage for Chest X-rays","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T16:03:16.013950Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2508.19322"},"observation_digest":"sha256:004d69901cb78adb8567a6a142098e5db08d2456142b13c812acd3a3431cc35a","observation_id":"7393a998-fd24-4c4b-8182-f39766ebc816","resolution":{"observed_at":"2026-08-05T16:03:16.013950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T10:38:07.507287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03903","last_updated":"2025-09-04T05:53:58Z","snapshot_observed_at":"2026-08-10T17:22:01.550054Z","submitted_at":"2025-09-04T05:53:58Z","title":"A Generative Foundation Model for Chest Radiography","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:38:07.507287Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2509.03903"},"observation_digest":"sha256:99cec15716f230eaeb6cea33641c5327dda895a1cc8796dc6c7c88607fecc1d6","observation_id":"26a70aaf-1152-4d9f-afdc-694920f876b2","resolution":{"observed_at":"2026-08-05T10:38:07.507287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-04T23:45:22.779768Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation.arXiv preprint arXiv:2401.12208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06409","last_updated":"2025-09-08T08:01:26Z","snapshot_observed_at":"2026-08-10T06:19:17.284687Z","submitted_at":"2025-09-08T08:01:26Z","title":"Teaching AI Stepwise Diagnostic Reasoning with Report-Guided Chain-of-Thought Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T23:45:22.779768Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2509.06409"},"observation_digest":"sha256:36b15834eb49dfb093757927636a3ababbf777aa0ae11866116117d09e4d03a4","observation_id":"dbb5e2d0-5bf2-4bc4-a078-eca343dfea0f","resolution":{"observed_at":"2026-08-04T23:45:22.779768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-04T16:33:15.458286Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.15234","last_updated":"2026-06-01T07:20:14Z","snapshot_observed_at":"2026-08-08T07:09:49.009478Z","submitted_at":"2025-09-17T09:44:59Z","title":"Exploring the Capabilities of Large Language Model Encoders for Image-Text Retrieval in Chest X-rays","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T16:33:15.458286Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2509.15234"},"observation_digest":"sha256:79aff3b970feeb8fa8224d1f8dcdb675c1b8b6ca1e6b29b4b3806e38bf35c9a4","observation_id":"c2ae2297-0477-41fb-9c39-d175384f9aca","resolution":{"observed_at":"2026-08-04T16:33:15.458286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2509.20490","last_updated":"2026-04-15T03:26:59Z","snapshot_observed_at":"2026-08-02T13:44:47.619708Z","submitted_at":"2025-09-24T19:08:01Z","title":"RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T13:42:27.605436Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2509.20490"},"observation_digest":"sha256:72e5cdf0137d485db01eaa0be97f0cb4f521f983db66a2424e53aa3162ab5c29","observation_id":"ab635e0c-a224-4462-a07e-3ada657b3331","resolution":{"observed_at":"2026-05-18T13:42:38.536084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-04T13:51:53.644209Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation.arXiv preprint arXiv:2401.12208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24739","last_updated":"2026-07-22T03:37:07Z","snapshot_observed_at":"2026-08-10T09:36:07.326330Z","submitted_at":"2025-09-29T13:03:57Z","title":"Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.644209Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2509.24739"},"observation_digest":"sha256:57f07631ba5f7acaec29838af1b504f26c2ffc9dfeefe78833c44dfa521e4f60","observation_id":"578fea1f-7a86-4cf2-a4d7-c3b22b82479a","resolution":{"observed_at":"2026-08-04T13:51:53.644209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2510.07191","last_updated":"2026-04-25T19:09:40Z","snapshot_observed_at":"2026-08-01T18:20:54.109595Z","submitted_at":"2025-10-08T16:25:04Z","title":"Resolution scaling governs DINOv3 transfer performance in chest radiograph classification","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T09:05:29.448447Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2510.07191"},"observation_digest":"sha256:be8b52ff93ff75202b3b6d2396902c603aed097c8a1f1a8d7cba9b37af30eab5","observation_id":"5f1e90bb-afcc-4e6e-bf29-948f7000a9ec","resolution":{"observed_at":"2026-05-18T09:06:09.123715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-03T23:17:38.258982Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation.arXiv preprint arXiv:2401.12208,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06625","last_updated":"2026-05-25T21:15:58Z","snapshot_observed_at":"2026-08-10T06:19:22.045768Z","submitted_at":"2025-11-10T02:04:46Z","title":"Explainable Cross-Disease Reasoning for Cardiovascular Risk Assessment from Low-Dose Computed Tomography","version":5},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T23:17:38.258982Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2511.06625"},"observation_digest":"sha256:a4801113b4a2372fa24063db5f9a6c3544603cdeace2b5f406bbf93ef8108442","observation_id":"143d033d-3fef-4a02-bc6a-3e26f373cbcb","resolution":{"observed_at":"2026-08-03T23:17:38.258982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2511.15825","last_updated":"2026-04-16T03:23:17Z","snapshot_observed_at":"2026-07-06T22:36:24.466921Z","submitted_at":"2025-11-19T19:32:29Z","title":"IMACT-CXR: An Interactive Multi-Agent Conversational Tutoring System for Chest X-Ray Interpretation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T20:13:43.296245Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2511.15825"},"observation_digest":"sha256:f42e8dad2be21fe344599b75a22d3651482070570020970ac49d535c2d7ba8c0","observation_id":"e9c4cd41-f961-4903-b1d1-67a9ffc6f77f","resolution":{"observed_at":"2026-05-17T20:15:10.570284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-03T12:25:48.954823Z","title":"arXiv preprint arXiv:2401.12208 (2024) 2, 3, 10, 11, 12, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03191","last_updated":"2026-05-23T10:05:21Z","snapshot_observed_at":"2026-08-10T13:09:19.390416Z","submitted_at":"2026-01-06T17:13:23Z","title":"AnatomiX, an Anatomy-Aware Grounded Multimodal Large Language Model for Chest X-Ray Interpretation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T12:25:48.954823Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2601.03191"},"observation_digest":"sha256:a2942fd5fe1e356110fac5cb84fa77e6a670ffb62388957082a9e45988b8468a","observation_id":"59aca732-4f62-4175-8c19-b94b6dae9f5e","resolution":{"observed_at":"2026-08-03T12:25:48.954823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.09450","last_updated":"2026-05-17T13:20:28Z","snapshot_observed_at":"2026-07-06T22:58:17.167367Z","submitted_at":"2026-04-10T16:07:14Z","title":"ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:54:54.441128Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.09450"},"observation_digest":"sha256:a10f6c14a2ed6511c5c4785162d0d472f1300a65a30acf420db9649a2e8893d5","observation_id":"e02676fd-3fa0-47be-ad3f-9de52f58ce12","resolution":{"observed_at":"2026-05-11T05:51:10.700562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.09450","last_updated":"2026-05-17T13:20:28Z","snapshot_observed_at":"2026-07-06T22:58:17.167367Z","submitted_at":"2026-04-10T16:07:14Z","title":"ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T08:52:04.531938Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.09450"},"observation_digest":"sha256:2a92a08e54bd8eddf6733973c98dab98b38e2ba9505c1d42840825ce2c5545fa","observation_id":"9c5cbc9a-ce3f-429a-874a-856dd3cfa681","resolution":{"observed_at":"2026-05-21T08:54:05.841903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.13060","last_updated":"2026-03-18T07:43:49Z","snapshot_observed_at":"2026-08-11T12:05:53.491954Z","submitted_at":"2026-03-18T07:43:49Z","title":"Dental-TriageBench: Benchmarking Multimodal Reasoning for Hierarchical Dental Triage","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T10:21:29.325655Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.13060"},"observation_digest":"sha256:fd435000145e9d0114c756ca051eb104a38772f7bdd1a6701ce5920cab2bdd29","observation_id":"b15d33c2-6cf0-46e7-8dbd-894c410e6746","resolution":{"observed_at":"2026-05-15T10:25:26.856334Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.13598","last_updated":"2026-04-15T08:08:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T08:08:06Z","title":"Enhancing Reinforcement Learning for Radiology Report Generation with Evidence-aware Rewards and Self-correcting Preference Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-10T14:09:06.139625Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.13598"},"observation_digest":"sha256:dbed146b671568ef15594cf95c3bdf7f6cdb8119b0f75c18dd83c499c0cc21bf","observation_id":"989cd699-6dfc-43e2-b908-510e6152d72c","resolution":{"observed_at":"2026-05-10T14:10:28.715692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.18250","last_updated":"2026-04-20T13:27:39Z","snapshot_observed_at":"2026-07-31T07:27:11.914766Z","submitted_at":"2026-04-20T13:27:39Z","title":"Medical Image Understanding Improves Survival Prediction via Visual Instruction Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T04:37:16.531706Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.18250"},"observation_digest":"sha256:304bcac8c210de5279e2930f5e7a5c07454b42266189e85f7a4be040de699752","observation_id":"ee4b77a3-020e-4475-beac-c48866885fdf","resolution":{"observed_at":"2026-05-10T12:10:23.172896Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.18967","last_updated":"2026-05-03T23:49:12Z","snapshot_observed_at":"2026-08-07T14:09:13.033453Z","submitted_at":"2026-04-21T01:30:51Z","title":"CXRMate-2: Structured Multimodal Temporal Embeddings and Tractable Reinforcement Learning for Clinically Acceptable Chest X-ray Radiology Report Generation","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-10T03:39:29.333130Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.18967"},"observation_digest":"sha256:9b9cf4e7630de86192d87823f550318a13b3d875c9c710ba761c780401727fef","observation_id":"7be8c482-cff6-44ed-8eab-cb8095002187","resolution":{"observed_at":"2026-05-10T05:00:37.128672Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2604.22989","last_updated":"2026-04-24T20:03:04Z","snapshot_observed_at":"2026-07-06T23:09:19.041332Z","submitted_at":"2026-04-24T20:03:04Z","title":"CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T12:22:11.995334Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2604.22989"},"observation_digest":"sha256:c24b88452e8091433ad03104309cfa9f1f629a7ddcf29d8ce0caed78b3745fbf","observation_id":"f292390f-d334-40f4-8885-a463984ab536","resolution":{"observed_at":"2026-05-11T19:16:09.835198Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2605.05810","last_updated":"2026-05-07T07:46:17Z","snapshot_observed_at":"2026-07-06T23:18:22.301347Z","submitted_at":"2026-05-07T07:46:17Z","title":"CXR-ContraBench: Benchmarking Negated-Option Attraction in Medical VLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T14:49:53.357083Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2605.05810"},"observation_digest":"sha256:e1ae3ad8f6f54c98f5a20dd68e55dc9cb003fd5fa21680bc664cefd7c2ab1139","observation_id":"6c511b3d-8290-4743-b502-398a2f03e206","resolution":{"observed_at":"2026-05-11T18:41:09.674350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2605.20469","last_updated":"2026-05-19T20:30:32Z","snapshot_observed_at":"2026-08-02T07:20:59.680105Z","submitted_at":"2026-05-19T20:30:32Z","title":"HalluCXR: Benchmarking and Mitigating Hallucinations in Medical Vision-Language Models for Chest Radiograph Interpretation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T06:37:43.679397Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2605.20469"},"observation_digest":"sha256:9cfc77bae7633cd38e424830809e12b28553e443562d4dc9d748b18352f9aef6","observation_id":"3561ae8c-1ca2-4b20-b4d7-543df8886d0e","resolution":{"observed_at":"2026-05-21T06:39:43.807466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2605.23629","last_updated":"2026-05-22T13:41:10Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:41:10Z","title":"DDX-TRACE: A Benchmark for Medical Diagnostic Trajectories in VLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T04:53:33.343509Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2605.23629"},"observation_digest":"sha256:97bbbd3acdb02890bcd155cf594db418d428fb7b9bada95ba2fea33696eb0da6","observation_id":"e998a46c-7fab-413a-bcdc-c9b225b4a27a","resolution":{"observed_at":"2026-05-25T04:55:23.425258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2605.26691","last_updated":"2026-05-26T08:29:38Z","snapshot_observed_at":"2026-08-02T06:12:03.711761Z","submitted_at":"2026-05-26T08:29:38Z","title":"Mind the Tool Failures: Achieving Synergistic Tool Gains for Medical Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T18:05:59.091231Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2605.26691"},"observation_digest":"sha256:d921ef2a3bd3fc70c04c0adb0a376fc6fecfccdeff280e8d9c94bf105a857649","observation_id":"02dd9825-6396-405c-83b2-c48fcc513a72","resolution":{"observed_at":"2026-06-29T18:13:49.066105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2606.06407","last_updated":"2026-06-04T17:12:47Z","snapshot_observed_at":"2026-08-05T17:36:56.552057Z","submitted_at":"2026-06-04T17:12:47Z","title":"A Vision-language Framework for Comparative Reasoning in Radiology","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:36.018960Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2606.06407"},"observation_digest":"sha256:1543d8f791da5f0aa5ea4d4be30a2c91c270b4932cba5a0382d94da630678243","observation_id":"7d3b0fd0-a797-416b-b1cb-e09d926e5702","resolution":{"observed_at":"2026-07-02T12:56:57.364862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2606.12590","last_updated":"2026-06-10T18:35:36Z","snapshot_observed_at":"2026-08-06T17:35:29.796295Z","submitted_at":"2026-06-10T18:35:36Z","title":"Analyzing and Improving Fine-grained Preference Optimization in Medical LVLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:52:20.508013Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2606.12590"},"observation_digest":"sha256:31229d0bd16dde2a3833c449e1635d2ecf7d01a5861ef75ec762962dfdb7a439","observation_id":"b02fb5a8-86f4-47dd-ba0b-5e78ca9cacd4","resolution":{"observed_at":"2026-07-03T10:48:02.089484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2606.21020","last_updated":"2026-06-19T01:10:24Z","snapshot_observed_at":"2026-08-03T02:11:51.290870Z","submitted_at":"2026-06-19T01:10:24Z","title":"CheXpercept: A Benchmark for Evaluating Expert-Level Lesion Perception in Chest X-rays","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T15:05:13.422803Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2606.21020"},"observation_digest":"sha256:24007261d64e72e1921459f7a66deedb8ecdee79c93a142e61a91b126b8c10a3","observation_id":"977f2967-d1da-4a07-813c-dcd3d7ff87f4","resolution":{"observed_at":"2026-07-04T05:59:37.434190Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2606.21290","last_updated":"2026-06-19T10:13:38Z","snapshot_observed_at":"2026-08-02T05:44:37.652049Z","submitted_at":"2026-06-19T10:13:38Z","title":"NoduLoCC2026: Lung Nodule Localization and Classification Contest from Chest X-Ray Images","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T14:53:04.584448Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2606.21290"},"observation_digest":"sha256:6669447de7d065471b8634e3d622de714764f78008704e685769af3666501c68","observation_id":"865f0b0e-916f-4c33-92f9-cac28c5a3ee6","resolution":{"observed_at":"2026-07-04T06:09:36.637801Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":"2401.12208","doi":"10.48550/arxiv.2401.12208","metadata_source":"pith","pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language foundation model to enhance efficiency of chest x-ray interpretation","venue":"cs.CV","work_id":"91ab4cd1-413f-4e31-be3f-78e309d19006","year":2024},"citing_paper":{"arxiv_id":"2607.05880","last_updated":"2026-07-07T06:23:08Z","snapshot_observed_at":"2026-08-02T21:48:04.145448Z","submitted_at":"2026-07-07T06:23:08Z","title":"Harrison.Rad 1.5 Technical Report: A radiology foundation model that can draft reports from images, priors and clinical context","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-08T22:06:55.065652Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2607.05880"},"observation_digest":"sha256:b3756f011d4ae78c4861c0366ffa2103a0f88d85b9362323f3f2fe49eabd353d","observation_id":"0dfa0d70-9a3b-4d06-a255-4e925f77f650","resolution":{"observed_at":"2026-07-08T22:15:39.397153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-02T04:15:40.389346Z","title":"Chexagent: Towards a foundation model for chest x-ray interpretation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16323","last_updated":"2026-07-15T11:06:35Z","snapshot_observed_at":"2026-08-10T06:19:21.894726Z","submitted_at":"2026-07-15T11:06:35Z","title":"ECG-LLM: Foundation Model for ECG-Based Cardiac Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T04:15:40.389346Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2607.16323"},"observation_digest":"sha256:225f745ef4ca9f084d9bbc3037ccda48f92018fecdbce1aeaff14a419bfd8079","observation_id":"88e3936e-61b0-46bc-b415-a4f87bacabb9","resolution":{"observed_at":"2026-08-02T04:15:40.389346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-01T15:04:54.741899Z","title":"arXiv:2401.12208 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18577","last_updated":"2026-07-20T23:19:28Z","snapshot_observed_at":"2026-08-05T06:25:50.581335Z","submitted_at":"2026-07-20T23:19:28Z","title":"Attention Without Grounding: Causal Evaluation of Visual Explanations in Medical VLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:04:54.741899Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2607.18577"},"observation_digest":"sha256:4d6a190d4136e85e363dad43f2f373052c1aeda348369a65141aacbbda1af82e","observation_id":"76dff016-4f40-4bf1-822b-d86446c8bb59","resolution":{"observed_at":"2026-08-01T15:04:54.741899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-07-31T06:20:30.025041Z","title":"Tsai, Andrew Johnston, Cameron Olsen, Tanishq Mathew Abraham, Sergios Gatidis, Akshay S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24743","last_updated":"2026-07-28T10:52:57Z","snapshot_observed_at":"2026-08-11T13:31:23.305118Z","submitted_at":"2026-07-27T17:59:49Z","title":"ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-31T06:20:30.025041Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2607.24743"},"observation_digest":"sha256:42772bc6a4b69e2962e849d1842dd8004e8ad2e98e1d131e535a4e2f15eec28a","observation_id":"a093b395-a272-4cb4-8da1-a57e4c359fca","resolution":{"observed_at":"2026-07-31T06:20:30.025041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12208","snapshot_observed_at":"2026-08-01T05:38:55.229125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27564","last_updated":"2026-07-30T01:16:32Z","snapshot_observed_at":"2026-08-07T07:40:18.643570Z","submitted_at":"2026-07-30T01:16:32Z","title":"Inference-Time Agentic Decision Rules Beat Longer Evolving Search for Multi-Image Medical Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T05:38:55.229125Z"},"links":{"cited_paper":"/paper/2401.12208","citing_paper":"/paper/2607.27564"},"observation_digest":"sha256:c78cbca45af3b8df7e3566e9a32ad4b5acb443f61812b698e870ada10341da83","observation_id":"7e5022ae-f457-48ef-93bf-f0c2f78613d4","resolution":{"observed_at":"2026-08-01T05:38:55.229125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2401.12208/citation-record","integrity":"/paper/2401.12208/integrity","json":"/paper/2401.12208/citation-record.json","paper":"/paper/2401.12208"},"outbound":[],"paper":{"arxiv_id":"2401.12208","last_updated":"2024-12-18T20:56:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T08:31:58.372526Z","submitted_at":"2024-01-22T18:51:07Z","title":"A Vision-Language Foundation Model to Enhance Efficiency of Chest X-ray Interpretation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 55 inbound Pith citation observations for arXiv:2401.12208."}