{"as_of":"2026-08-18T22:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:038bf03ff9c5eb7219d8a31cc914e6ce4d6d9be4f7588aebda66dff5f153569e","coverage":[{"denominator":260,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:52:02.095212Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:03:02.894433Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:23:37.663790Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12195","snapshot_observed_at":"2026-08-16T00:03:02.894433Z","title":"A survey of medical vision-and-language applications and their techniques,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03153","last_updated":"2025-05-06T03:59:25Z","snapshot_observed_at":"2026-08-18T21:42:47.513619Z","submitted_at":"2025-05-06T03:59:25Z","title":"Robust Fairness Vision-Language Learning for Medical Image Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:03:02.894433Z"},"links":{"cited_paper":"/paper/2411.12195","citing_paper":"/paper/2505.03153"},"observation_digest":"sha256:282d5fc1c8714b1987be370fa77620a1f126169de4f98ec0d2c6db207b592c2c","observation_id":"6db47784-b93e-49d0-9103-d3939cec5854","resolution":{"observed_at":"2026-08-16T00:03:02.894433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12195","snapshot_observed_at":"2026-08-07T15:21:17.662259Z","title":"arXiv preprint arXiv:2411.12195 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15425","last_updated":"2025-05-23T14:16:48Z","snapshot_observed_at":"2026-08-13T16:09:48.465227Z","submitted_at":"2025-05-21T12:08:31Z","title":"On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:21:17.662259Z"},"links":{"cited_paper":"/paper/2411.12195","citing_paper":"/paper/2505.15425"},"observation_digest":"sha256:b5e2487ead6c984b0c44b5badfdfd9cdd0c852f006345a7e1c99463a7a690982","observation_id":"ba554940-a11b-4daa-adf3-e009f5bc99d8","resolution":{"observed_at":"2026-08-07T15:21:17.662259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12195","snapshot_observed_at":"2026-08-07T12:35:06.495285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24173","last_updated":"2025-05-30T03:33:25Z","snapshot_observed_at":"2026-08-17T15:47:45.736345Z","submitted_at":"2025-05-30T03:33:25Z","title":"DrVD-Bench: Do Vision-Language Models Reason Like Human Doctors in Medical Image Diagnosis?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:06.495285Z"},"links":{"cited_paper":"/paper/2411.12195","citing_paper":"/paper/2505.24173"},"observation_digest":"sha256:b4f01fa935b73c161fda310b368149694758dbd5997fab474edca29fd4d51a4f","observation_id":"80dba695-eae7-455b-887b-0270f5a1e83d","resolution":{"observed_at":"2026-08-07T12:35:06.495285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"cited_work":{"arxiv_id":"2411.12195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12195","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of medical vision-and-language applications and their techniques","venue":null,"work_id":"41cc5877-d221-4d86-b228-a466fe9c56e4","year":2024},"citing_paper":{"arxiv_id":"2605.15997","last_updated":"2026-05-15T14:27:07Z","snapshot_observed_at":"2026-08-16T12:08:36.504464Z","submitted_at":"2026-05-15T14:27:07Z","title":"Segmentation, Detection and Explanation: A Unified Framework for CT Appearance Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T18:20:38.720544Z"},"links":{"cited_paper":"/paper/2411.12195","citing_paper":"/paper/2605.15997"},"observation_digest":"sha256:bca75f1390da11ba377da123eaa69d16426d2a4bdcaeab36b32896e534177bba","observation_id":"dee38c91-f420-42e6-b9ec-a603ac3c224c","resolution":{"observed_at":"2026-05-20T18:23:37.665916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.12195/citation-record","integrity":"/paper/2411.12195/integrity","json":"/paper/2411.12195/citation-record.json","paper":"/paper/2411.12195"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.522348Z","title":"Med- ical Image Analysis 88, 102802 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.522348Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9a09449228c5da9bd02e01f9fa40ee383c89700c3567c5907c82d9ec6a39ef86","observation_id":"ca356b5f-9100-4724-8ba7-c0ebcec17286","resolution":{"observed_at":"2026-08-12T17:52:01.522348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.528446Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.528446Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:ae86f548a1c67098671aabcd78bea1cfed2a58e4f3b0dfcdd2a986dbe39024c4","observation_id":"daf2662e-cedd-4094-a684-de3a8b0805b3","resolution":{"observed_at":"2026-08-12T17:52:01.528446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.16056","last_updated":"2022-04-28T01:16:11Z","snapshot_observed_at":"2026-08-16T23:37:48.537613Z","submitted_at":"2020-10-30T04:08:03Z","title":"Generating Radiology Reports via Memory-driven Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.16056","snapshot_observed_at":"2026-08-12T17:52:01.534054Z","title":"arXiv preprint arXiv:2010.16056 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.534054Z"},"links":{"cited_paper":"/paper/2010.16056","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:8b434e25450b36c6e4df3997f34cfed807af19d349ee9ed9fb037bea64d71a5b","observation_id":"e2d1c332-c875-4dd4-90d7-7a47e2b6e601","resolution":{"observed_at":"2026-08-12T17:52:01.534054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.539984Z","title":"Progress in Biomedical Engineering 5(2), 022001 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.539984Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9450ba65ce868b9900b5873212c9fb3cc798f1352aa980e7a21dc5a15e3a4838","observation_id":"d223b113-5ad8-4fe9-9f4c-edb46cf7da66","resolution":{"observed_at":"2026-08-12T17:52:01.539984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.545644Z","title":"IEEE Transactions on Medical Imaging 42(2), 354–367 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.545644Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:bfdda0965fcc50a9b2e63bb133a5c30ae2da35d54bda745b421ca409564dfc73","observation_id":"f144643b-da05-4a6f-9002-03acf726c629","resolution":{"observed_at":"2026-08-12T17:52:01.545644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.552391Z","title":"In: Interna- tional Conference on Information Processing in Medical Imaging, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.552391Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2fb10ced59edc349d33047f82f16c965830bab79d737cabb3617373000ce3515","observation_id":"2d86848a-813a-4f11-9013-4c1719419159","resolution":{"observed_at":"2026-08-12T17:52:01.552391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.558900Z","title":"In: Interna- tional Workshop on Multiscale Multimodal Medical Imaging, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.558900Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:3fff180ea30404aae4505fb062a9e02736bc5d3694717e55324355149fa5f3c3","observation_id":"92044921-f23e-4dae-bbbd-d70353d81b84","resolution":{"observed_at":"2026-08-12T17:52:01.558900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13752","last_updated":"2023-11-23T00:57:35Z","snapshot_observed_at":"2026-08-16T14:41:00.869198Z","submitted_at":"2023-11-23T00:57:35Z","title":"3D-MIR: A Benchmark and Empirical Study on 3D Medical Image Retrieval in Radiology","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13752","snapshot_observed_at":"2026-08-12T17:52:01.564365Z","title":"arXiv preprint arXiv:2311.13752 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.564365Z"},"links":{"cited_paper":"/paper/2311.13752","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:1953709f5d3405cfe819fd2c2ca87c3714a8fd964b3261c26cccf313a7d13d05","observation_id":"a22b153f-f6e5-4498-91b6-f77dfc687391","resolution":{"observed_at":"2026-08-12T17:52:01.564365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.570117Z","title":"ACM Computing Surveys (CSUR) 54(10s), 1–40 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.570117Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2d4a00fbc2e0a48d23cc2ac2a275fed558a8582a869d77ea09c0e806149f5e68","observation_id":"5a40323c-13b8-45de-b6e9-d14c2196addd","resolution":{"observed_at":"2026-08-12T17:52:01.570117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.576496Z","title":"In: Proceedings of the AAAI Conference on Artificial Intel- ligence, vol","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.576496Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:706bbe1e620b88aea88e5b640f9ae57dcfeb5ced37196e6607f3dd5a80b7f373","observation_id":"976aad37-fe39-4a00-bdd5-0f3e854af676","resolution":{"observed_at":"2026-08-12T17:52:01.576496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.581635Z","title":"IEEE Transactions on Medical Imaging 41(11), 3332–3343 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.581635Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:33cedbab36a43fe8feebf4da6083176f74594c058772d43f78e34af6d5b7b9d8","observation_id":"b105268b-001d-403f-a6df-8a82d9379bde","resolution":{"observed_at":"2026-08-12T17:52:01.581635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.587185Z","title":"Med- ical image analysis 67, 101819 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.587185Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2a49623d6f7aa34e548fb0392ad93f08294b0fd09bfe12c82a67b961167d2fdd","observation_id":"2e55551d-9adf-47bd-86aa-6e1c1cb01284","resolution":{"observed_at":"2026-08-12T17:52:01.587185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.592517Z","title":"In: Interna- tional Conference on Multimedia Modeling, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.592517Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:f477037c06fc3b14b9a362da6c4a72b587a6709a4f593395d7a56c371dbfc2c8","observation_id":"9cd91baf-6018-40ce-93f4-75e53baf717b","resolution":{"observed_at":"2026-08-12T17:52:01.592517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.598847Z","title":"In: International Conference on Medical Image Computing and Computer- Assisted Intervention, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.598847Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:4abdff82175e7d971eafed2c3bda71715ae25c17f6927a2048d869cd0ac8426b","observation_id":"7f9b0c43-5de9-4b29-a9a8-fc5cd4a17637","resolution":{"observed_at":"2026-08-12T17:52:01.598847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02469","last_updated":"2024-04-15T13:51:30Z","snapshot_observed_at":"2026-08-18T17:31:40.395667Z","submitted_at":"2024-03-04T20:29:51Z","title":"Vision-Language Models for Medical Report Generation and Visual Question Answering: A Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02469","snapshot_observed_at":"2026-08-12T17:52:01.605452Z","title":"arXiv preprint arXiv:2403.02469 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.605452Z"},"links":{"cited_paper":"/paper/2403.02469","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:91d830dccda3b00c9706551f48063deaf9ed14e2ee7f6b66ebffb7dd35bfdca8","observation_id":"ca45e851-3e4e-465e-ae15-bbafe474923a","resolution":{"observed_at":"2026-08-12T17:52:01.605452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12833","last_updated":"2025-03-06T17:18:49Z","snapshot_observed_at":"2026-08-16T13:50:56.561846Z","submitted_at":"2024-05-21T14:37:35Z","title":"A Survey of Deep Learning-based Radiology Report Generation Using Multimodal Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12833","snapshot_observed_at":"2026-08-12T17:52:01.611240Z","title":"arXiv preprint arXiv:2405.12833 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.611240Z"},"links":{"cited_paper":"/paper/2405.12833","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:5276e8180b50669fb80fec9b5bead9a52a760f5886d9cd088b1c6e1d80dcbcdf","observation_id":"94795a31-19ea-4dbb-9c9d-cb4b78f103ef","resolution":{"observed_at":"2026-08-12T17:52:01.611240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.617144Z","title":"BioMedical Engineering OnLine 22(1), 48 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.617144Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:bca2349301cd3389a48b0f094c14251ad028e693bc31dacc5a61223ee0d9ef2c","observation_id":"56b7e66f-c958-48f4-9f98-3d0bd815c9b9","resolution":{"observed_at":"2026-08-12T17:52:01.617144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14199","last_updated":"2024-04-25T09:25:24Z","snapshot_observed_at":"2026-08-18T01:21:24.024122Z","submitted_at":"2023-11-23T20:52:44Z","title":"A Systematic Review of Deep Learning-based Research on Radiology Report Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14199","snapshot_observed_at":"2026-08-12T17:52:01.622892Z","title":"arXiv preprint arXiv:2311.14199 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.622892Z"},"links":{"cited_paper":"/paper/2311.14199","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:94752be76175a35e1b70cf4efa58cd59f157d2a1bd23ad6ad8dc2d9e74d4f973","observation_id":"1782b99e-7650-4b39-92f3-2570907e77ba","resolution":{"observed_at":"2026-08-12T17:52:01.622892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.630110Z","title":"Informat- ics in Medicine Unlocked, 101273 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.630110Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:bcd3b9ad620fc6a2670c0369ddc0220711723a21d2ba9ded8cfed113e75558ff","observation_id":"a65af560-a4c6-45b3-b6d4-57fa032fe7e2","resolution":{"observed_at":"2026-08-12T17:52:01.630110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.636579Z","title":"Multimedia Tools and Applications 20 81(10), 13409–13439 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.636579Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:88f4cb528342d80e8e0dca135f55dd6d8ee2f644b66a2425205c4484c555bd2a","observation_id":"1f380e6b-432f-45ae-9327-91712b734e7c","resolution":{"observed_at":"2026-08-12T17:52:01.636579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.642536Z","title":"Pattern Recognition Letters 150, 57–75 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.642536Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:0e21dc7f62295f6b53012ca0feaa56dd894828de73d3a2cf893dbe4118cac092","observation_id":"c47332ed-1b6f-4d7f-8d65-40f1e0f206bd","resolution":{"observed_at":"2026-08-12T17:52:01.642536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.649932Z","title":"Artifi- cial Intelligence in Medicine, 102611 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.649932Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:939ae1574e3635585049470f1b14736ee4558a48f8ee7e6377165d90eada482c","observation_id":"f0b65838-5fea-4f23-a851-f1a0cbd35327","resolution":{"observed_at":"2026-08-12T17:52:01.649932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.658411Z","title":"In: Asia-Pacific Web (APWeb) and Web-Age Information Management (W AIM) Joint International Conference on Web and Big Data, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.658411Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:e60932760c8aea8659c5334fb91319026cf55965ff83814f082cfe7e1a1ef18c","observation_id":"58471c48-adf8-450a-a055-2456170f9bc2","resolution":{"observed_at":"2026-08-12T17:52:01.658411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.664999Z","title":"International Journal of Computer Vision, 1–17 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.664999Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:b07257e1b8e8091f482eff281be02d71bbf2e223546b0298682cc93dd460f555","observation_id":"975f2b81-80b4-48e2-a3c2-75e525b7c41a","resolution":{"observed_at":"2026-08-12T17:52:01.664999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-08-16T14:35:27.100627Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-12T17:52:01.670433Z","title":"arXiv preprint arXiv:2312.07353 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.670433Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:8e7647ffbde5a3d35e9b9f32e70ce8c6c3a85d42b41e8800272052e910ca5934","observation_id":"15052ed5-0909-4656-9f4a-2af5eb2c452d","resolution":{"observed_at":"2026-08-12T17:52:01.670433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.676541Z","title":"IET Image Processing 16(5), 1243–1267 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.676541Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9e8ad189a6779c8f2c7824f2595ff862440b84a2a0df246d9d796520cd912ac0","observation_id":"bb8feb3b-20df-4207-a7aa-a63a36873a8d","resolution":{"observed_at":"2026-08-12T17:52:01.676541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14579","last_updated":"2023-04-11T06:23:39Z","snapshot_observed_at":"2026-08-16T16:50:41.204579Z","submitted_at":"2022-06-24T08:16:01Z","title":"Competence-based Multimodal Curriculum Learning for Medical Report Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14579","snapshot_observed_at":"2026-08-12T17:52:01.681852Z","title":"arXiv preprint arXiv:2206.14579 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.681852Z"},"links":{"cited_paper":"/paper/2206.14579","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:cb557ea8b8393b40ef19ee73c9aa5ec129c7b1e6df8e78ace2aa16c122038e06","observation_id":"cd48674a-2552-4049-aad2-3ff5512c5b41","resolution":{"observed_at":"2026-08-12T17:52:01.681852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12186","last_updated":"2022-10-21T18:27:45Z","snapshot_observed_at":"2026-08-18T10:16:20.332404Z","submitted_at":"2022-10-21T18:27:45Z","title":"Improving the Factual Correctness of Radiology Report Generation with Semantic Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12186","snapshot_observed_at":"2026-08-12T17:52:01.687652Z","title":"arXiv preprint arXiv:2210.12186 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.687652Z"},"links":{"cited_paper":"/paper/2210.12186","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:d7dfd896c9064deb776b8752233b6e2684ca820e714a15e74e0ade3bb1b509c4","observation_id":"314cfdb9-1d7a-41ae-b0d4-872cb0427d3f","resolution":{"observed_at":"2026-08-12T17:52:01.687652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-12T17:52:01.694031Z","title":"arXiv preprint arXiv:1409.1556 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.694031Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:eb4a0064ee5b4eed945959eaa226ff2397ab0eb455c1fd9817825193ff6955d1","observation_id":"382f5a08-368a-4ed8-a2cc-1786af76493d","resolution":{"observed_at":"2026-08-12T17:52:01.694031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.699776Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.699776Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:69965540c3e4db488af7b26e9712bdf5901520f4d5fe34186b608245bf173557","observation_id":"2e67f652-8873-4cca-956f-ee006d2e8115","resolution":{"observed_at":"2026-08-12T17:52:01.699776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.705769Z","title":"Advances in neural information processing systems 30 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.705769Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:74a89bbb37371b9b81587e51e91491c7e4a958b48b6d1718b91f46ce011d10f7","observation_id":"1f6dae4c-febf-495a-af35-207131a1fa63","resolution":{"observed_at":"2026-08-12T17:52:01.705769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.711435Z","title":"IEEE Journal of Biomedical and Health Informatics 27(2), 1016–1025 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.711435Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:34ee7ca69b12212e2c24521158f3a3599247bef67a5bdb44a91f6406ea2bd56d","observation_id":"a25c99a8-7089-4f96-9016-b5a18d70ed5f","resolution":{"observed_at":"2026-08-12T17:52:01.711435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.716754Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.716754Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:083870c1006bea37b1e5996cd4583ffff9d22148c169086524376fa1928929da","observation_id":"649332ff-5989-43f3-9f0f-24969a0ae5f2","resolution":{"observed_at":"2026-08-12T17:52:01.716754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.722567Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.722567Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9f1d9d8c5790ac24001a4af4f5a91ecd2f5326cf1f2006b81f09733b57159b40","observation_id":"b5ec0971-2764-4a7b-86a8-5b521d3cce4d","resolution":{"observed_at":"2026-08-12T17:52:01.722567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.728249Z","title":"In: International Conference on Medical Image Computing and Computer-assisted Inter- vention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.728249Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:c0292c9684dd8184305cdc7b35961074b9b0739ad4b0aba310a55308e497aa27","observation_id":"cb49a927-5e18-4116-842f-52f6e08ba878","resolution":{"observed_at":"2026-08-12T17:52:01.728249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.733352Z","title":"arXiv preprint arXiv:2106.06965 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.733352Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:4f7e165d480a1c88b4e1c010d00b2639e48a4de155c23b164b2da7f648f53078","observation_id":"a4ade487-cbc0-405b-9bbd-424fa5a4b7f2","resolution":{"observed_at":"2026-08-12T17:52:01.733352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.738964Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.738964Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:45be3eac73ed984bda1a5befc477690ebf877a5b50b5f0fbf4f3fad1718c5943","observation_id":"b1213cf8-11e4-4101-bad5-b6c30a69a59d","resolution":{"observed_at":"2026-08-12T17:52:01.738964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.744173Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.744173Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:b8b7602ccca3d1a249aafb109adf6cba7b9538c2347a215dd3372b041923e988","observation_id":"18ab6696-c490-4511-bd93-7462db1405e5","resolution":{"observed_at":"2026-08-12T17:52:01.744173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.749592Z","title":"Medical Image Analysis 83, 102675 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.749592Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:193e9a610e02071b8de62916bc4c2754f6718291021217841a4a6aa7153e6456","observation_id":"c6f56e4f-5a33-4418-adb6-f6fa28f6b6e9","resolution":{"observed_at":"2026-08-12T17:52:01.749592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13155","last_updated":"2023-02-15T07:33:35Z","snapshot_observed_at":"2026-08-18T14:47:00.360576Z","submitted_at":"2023-01-30T18:33:32Z","title":"Advancing Radiograph Representation Learning with Masked Record Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13155","snapshot_observed_at":"2026-08-12T17:52:01.755584Z","title":"arXiv preprint arXiv:2301.13155 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.755584Z"},"links":{"cited_paper":"/paper/2301.13155","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:14354432bf19432f85fa8c29ff72239f246685e8d54704579dc51a35f6ff7041","observation_id":"5ea47f4b-9cba-4997-be4f-f6380042b00b","resolution":{"observed_at":"2026-08-12T17:52:01.755584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.761060Z","title":"In: Pro- ceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.761060Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2fa853126f478652b409e89d4665adec5b62dee9be9e5b534d089f7335db7c06","observation_id":"5743f659-1121-4aab-9cc4-85da004ab519","resolution":{"observed_at":"2026-08-12T17:52:01.761060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13258","last_updated":"2022-04-28T02:32:53Z","snapshot_observed_at":"2026-08-16T17:04:03.977358Z","submitted_at":"2022-04-28T02:32:53Z","title":"Cross-modal Memory Networks for Radiology Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13258","snapshot_observed_at":"2026-08-12T17:52:01.767129Z","title":"arXiv preprint arXiv:2204.13258 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.767129Z"},"links":{"cited_paper":"/paper/2204.13258","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:5ba62caadf2128c9f9bd5ed626e93db9a51e7096a58fb52561f81dc8e17eb864","observation_id":"05d89a90-dfa0-466c-b562-0c3c8c9ee5c4","resolution":{"observed_at":"2026-08-12T17:52:01.767129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.772886Z","title":"In: European Con- ference on Computer Vision, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.772886Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:92d4f33d783f13d5540dc1f48538c41c072ef57165b08ef360fd425e398f4344","observation_id":"1ae00d1d-a7b8-4dc7-b4c5-9ca4c9ed897f","resolution":{"observed_at":"2026-08-12T17:52:01.772886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.778438Z","title":"In: Machine Learning for Health, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.778438Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:78276bc5e82ea1cc8607b7f712ba15f7482170c5a5ae360fc5544f56b4ba41f5","observation_id":"8084558d-859a-4fc2-81f6-b68378cad1ad","resolution":{"observed_at":"2026-08-12T17:52:01.778438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.783766Z","title":"In: International Con- ference on Medical Image Computing and Computer-Assisted Intervention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.783766Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:c273e83fe30d4b4de74575f8811788d44f8825b7436db3c2dfe94cb58334df0b","observation_id":"0e52a80a-5d7e-4bf9-9e30-abf3d41f6459","resolution":{"observed_at":"2026-08-12T17:52:01.783766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.788952Z","title":"In: Medical Image Computing and Computer Assisted Intervention–MICCAI 2020: 23rd International Conference, Lima, Peru, Octo- ber 4–8, 2020, Proceedings, Part VII 23, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.788952Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:1fddd17a928c7c0e0e81eeb9f79dcc38a8c08ae581e1b0beefafc627cf6ce3b5","observation_id":"43763cd1-73cf-4ca6-a136-68444afcd365","resolution":{"observed_at":"2026-08-12T17:52:01.788952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.794367Z","title":"Advances in neural information processing systems 27 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.794367Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7ee84701ae15e45e403f4e83e4727b8b8f934001bb5e4976051c8629e149ace4","observation_id":"79271e62-6425-496e-80cc-d4815f8f3d88","resolution":{"observed_at":"2026-08-12T17:52:01.794367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.799554Z","title":"In: Interna- tional Conference on Medical Image Com- puting and Computer-Assisted Intervention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.799554Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:da11a5ccb1c097a133e68c7b8d9c880903f11d942e957a3e87354e0e389cc0c2","observation_id":"255ad314-f6c7-474b-8410-c3822a1c8803","resolution":{"observed_at":"2026-08-12T17:52:01.799554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02467","last_updated":"2020-10-06T04:18:18Z","snapshot_observed_at":"2026-08-17T09:44:16.293709Z","submitted_at":"2020-10-06T04:18:18Z","title":"Learning Visual-Semantic Embeddings for Reporting Abnormal Findings on Chest X-rays","version":1},"cited_work":{"arxiv_id":"2010.02467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.02467","snapshot_observed_at":"2026-08-12T17:52:03.784950Z","title":"Learning Visual-Semantic Embeddings for Reporting Abnormal Findings on Chest X-rays","venue":"cs.CV","work_id":"9b900d31-baea-48e5-834f-aaeb00c28226","year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.804534Z"},"links":{"cited_paper":"/paper/2010.02467","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:34909d0883d456ff7e0b113026e7d5dbe0af3d1cffa4ac5c8727d83c05348023","observation_id":"27c60dbd-bba5-4f04-bd77-ef53423f7c97","resolution":{"observed_at":"2026-08-12T17:52:03.791162Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.810142Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Applica- tions of Computer Vision, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.810142Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:ad7ca11db806422c811d290d3ddfb80dd9eceaf6e6a41d11f7ed489dc497621a","observation_id":"4fc49f57-c62a-4c88-82f8-eeb2cd04518a","resolution":{"observed_at":"2026-08-12T17:52:01.810142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.815715Z","title":"In: Proceed- ings of the IEEE/CVF Winter Conference on Applications of Computer Vision, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.815715Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:96f1b522722d7f4e6f1e108eb0361cf370e80c97a4bd6daf4cf25d8d86197c69","observation_id":"56f0f551-cbf3-4d38-9ea8-c8f9519db634","resolution":{"observed_at":"2026-08-12T17:52:01.815715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.821529Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.821529Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:55a0b464070d070324c756394ac2faec5165c89b01f12d97a64791d2d58a5b74","observation_id":"1e8e1834-b9e7-4db4-94a8-560af9905172","resolution":{"observed_at":"2026-08-12T17:52:01.821529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.826866Z","title":"IEEE Transactions on Medical Imaging (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.826866Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:d2739b6b017b38a8456bf37dabed3727bf67ef20e54aca64ea9fa5ab03adc6a5","observation_id":"99108090-a82b-401d-ba8d-a9cfeee70be5","resolution":{"observed_at":"2026-08-12T17:52:01.826866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.832233Z","title":"Medical Image Analysis 82, 102603 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.832233Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:6539b2df42838340bc94487d3be17124aedec197e7ce742efb65708cd6521406","observation_id":"ab2828de-b4d3-4e90-942d-d464a972b725","resolution":{"observed_at":"2026-08-12T17:52:01.832233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.837662Z","title":"In: International Conference on Medical Image Computing and Computer-Assisted Inter- vention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.837662Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:866b5958372e9bdde9d3ff900545261d2b70ca9e6ad40fe194b5121cf153fc35","observation_id":"24b08117-ab3c-42ae-9ade-cd19eb907ef3","resolution":{"observed_at":"2026-08-12T17:52:01.837662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.842893Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.842893Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:cb6156108bd7942bfd28702f380a4f8abc6adc2f9bfe5f382fe5a6c9f78271ab","observation_id":"f11ca364-6b3a-42bf-89df-eafdfa648de2","resolution":{"observed_at":"2026-08-12T17:52:01.842893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.848450Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.848450Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:0330a9c579a7d65fcde5b5c3092c34ed1b1b992c013c4caf7811229758319659","observation_id":"f61fa569-9e1b-45c8-840b-940360874f63","resolution":{"observed_at":"2026-08-12T17:52:01.848450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.853772Z","title":"Medical image analysis 80, 102510 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.853772Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:3c58ceeab7e7f82502dd008bf1c530223ebc1762fbcfef8e01f5384e8e7e9ae7","observation_id":"e5edd124-fce9-4199-b040-9fd30f4d90be","resolution":{"observed_at":"2026-08-12T17:52:01.853772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.859131Z","title":"IEEE Jour- nal of Biomedical and Health Informatics 26(11), 5631–5640 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.859131Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:16738b904cb2cdadad01e9effbdf4af31898c0d6952dc80293a4ef2734647a48","observation_id":"a968d52b-90e3-421a-9da6-8666b00aa942","resolution":{"observed_at":"2026-08-12T17:52:01.859131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.864177Z","title":"IEEE Journal of Biomedical and Health Informatics (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.864177Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:3327770718202380b9da43a4b394db50169dabd012841b5a52637c39d4110a25","observation_id":"4319b0d1-9617-4b2c-84b3-cff1ee81016a","resolution":{"observed_at":"2026-08-12T17:52:01.864177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.869333Z","title":"In: Proceedings of the IEEE/CVF Interna- tional Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.869333Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:40edcc83e64e398c458f16393cd80e60e7f37057b5faaef03c539ea4d547430c","observation_id":"348201c6-c8b3-4291-ba01-55edec7449b5","resolution":{"observed_at":"2026-08-12T17:52:01.869333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09777","last_updated":"2021-08-31T17:57:10Z","snapshot_observed_at":"2026-08-16T18:44:29.917406Z","submitted_at":"2021-02-19T07:42:13Z","title":"Progressive Transformer-Based Generation of Radiology Reports","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09777","snapshot_observed_at":"2026-08-12T17:52:01.874428Z","title":"arXiv preprint arXiv:2102.09777 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.874428Z"},"links":{"cited_paper":"/paper/2102.09777","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7b42c0e134016fb7d598c7a28d366bcae43e4c3037e23ada67c0e80b7b40e265","observation_id":"e0efa456-8163-4d05-b155-bf440fbac20c","resolution":{"observed_at":"2026-08-12T17:52:01.874428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12126","last_updated":"2021-08-27T05:47:28Z","snapshot_observed_at":"2026-08-16T18:00:37.294877Z","submitted_at":"2021-08-27T05:47:28Z","title":"Automated Generation of Accurate \\& Fluent Medical X-ray Reports","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12126","snapshot_observed_at":"2026-08-12T17:52:01.880681Z","title":"arXiv preprint arXiv:2108.12126 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.880681Z"},"links":{"cited_paper":"/paper/2108.12126","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:bfea7caa431e97a5d2eac55b59c80f932f21d94ed42cc8804848fbe252e12479","observation_id":"0db1640b-6570-4680-abcb-41774df37b41","resolution":{"observed_at":"2026-08-12T17:52:01.880681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.886020Z","title":"In: International Conference on Medical Image Computing and Computer-Assisted Inter- vention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.886020Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:c3385f6fc3616be4a469ebf0e653aa6f19f7acbe8a6035c0c90dff0d54c8aaf7","observation_id":"a9756c0a-16ef-4935-95c5-42345d66cac4","resolution":{"observed_at":"2026-08-12T17:52:01.886020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.891174Z","title":": Chest x-ray report genera- tion through fine-grained label learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.891174Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:633c6c00aef435f32c9e371508de536a8faa3508b2a30c4eeda798cc6ec5a9a2","observation_id":"0ab6503b-2e15-4e47-92eb-a843dd6ca2df","resolution":{"observed_at":"2026-08-12T17:52:01.891174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06471","last_updated":"2021-05-25T07:47:23Z","snapshot_observed_at":"2026-08-16T18:22:28.281959Z","submitted_at":"2021-05-25T07:47:23Z","title":"Writing by Memorizing: Hierarchical Retrieval-based Medical Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06471","snapshot_observed_at":"2026-08-12T17:52:01.896078Z","title":"arXiv preprint arXiv:2106.06471 (2021) 23","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.896078Z"},"links":{"cited_paper":"/paper/2106.06471","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:eab05b89a72f9a2f5f52bbff3c520f463de13f972ac47036b9ff7d5e02c1d9e1","observation_id":"29984e07-1679-472c-a2b7-390ea287f242","resolution":{"observed_at":"2026-08-12T17:52:01.896078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.901450Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.901450Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9613c03ffda85c7cef551bbd605e26d14ab68737e9e90294a23482280bf748b2","observation_id":"44d2ae20-0509-4186-bc76-0a3bb23fc84e","resolution":{"observed_at":"2026-08-12T17:52:01.901450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.906779Z","title":"Medical image analysis 67, 101872 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.906779Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2e733cb49bac62b9b687490cf90062c3b2c11db4f85917a88edbcd78ee7a1a6f","observation_id":"991c18a2-3860-4d6e-98b7-f8a4313d7799","resolution":{"observed_at":"2026-08-12T17:52:01.906779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T17:52:01.912354Z","title":"arXiv preprint arXiv:2302.13971 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.912354Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:ed1e8ba544e69d6d3cfda2ff6f4d07d3b59f2c00b8f2cc76edfdd6e96acbe1db","observation_id":"fc61f205-4cc1-46e5-86d1-0fd812f08697","resolution":{"observed_at":"2026-08-12T17:52:01.912354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T17:52:01.917597Z","title":"arXiv preprint arXiv:2307.09288 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.917597Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:563e4c69c2b1ddc2ff55e0d0a01c40dde2b45f66aa6f4eef2cf6927b41b81d69","observation_id":"ac41fe7c-424b-4b6a-b88b-f981c7901e72","resolution":{"observed_at":"2026-08-12T17:52:01.917597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.923717Z","title":"Advances in neural information processing systems 33, 1877–1901 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.923717Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:efc0b8df9403b5b115b374c4bf40d647ca31df4f4eb206d5dd0bd56860b62ae5","observation_id":"f8e096d2-9fb8-4359-9555-ad4302df3def","resolution":{"observed_at":"2026-08-12T17:52:01.923717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T17:52:01.929522Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.929522Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7287d9f7cf648920e80a393d1ef2466c34275d84440cdfbd6afb2d8f5ad425dd","observation_id":"d76f4732-3e56-441e-942f-74264d0b51ab","resolution":{"observed_at":"2026-08-12T17:52:01.929522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.934875Z","title":"Journal of Machine Learning Research 24(240), 1–113 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.934875Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:90b5bc04e7761645acc4d81efe5f18d1f5f0297cc79726ec9d8bd30c98718715","observation_id":"a85d4eff-7d69-4c7d-917e-309b789459cb","resolution":{"observed_at":"2026-08-12T17:52:01.934875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.940423Z","title":"In: In2nd AIxIA Workshop on Artifi- cial Intelligence For Healthcare, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.940423Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:526108c9abab1c156c8ae3081122cc49a1984ef28574a9b6db67f70971349ee4","observation_id":"a2dcd55e-d8c4-4956-864e-ef5253ff1ab8","resolution":{"observed_at":"2026-08-12T17:52:01.940423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00998","last_updated":"2024-04-01T09:02:12Z","snapshot_observed_at":"2026-08-16T14:04:42.568854Z","submitted_at":"2024-04-01T09:02:12Z","title":"LLM-RadJudge: Achieving Radiologist-Level Evaluation for X-Ray Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00998","snapshot_observed_at":"2026-08-12T17:52:01.946669Z","title":"arXiv preprint arXiv:2404.00998 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.946669Z"},"links":{"cited_paper":"/paper/2404.00998","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:4c0b12e6eb34df7f1a780055454b5a513265079c9a49430300795bac8c4d7607","observation_id":"5ba3d0d1-62bb-4653-b3c6-617b6e9393e6","resolution":{"observed_at":"2026-08-12T17:52:01.946669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17778","last_updated":"2024-04-27T04:42:45Z","snapshot_observed_at":"2026-08-16T13:57:24.109705Z","submitted_at":"2024-04-27T04:42:45Z","title":"MRScore: Evaluating Radiology Report Generation with LLM-based Reward System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17778","snapshot_observed_at":"2026-08-12T17:52:01.952300Z","title":"arXiv preprint arXiv:2404.17778 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.952300Z"},"links":{"cited_paper":"/paper/2404.17778","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7dc5b5d0969cd9f5924957cd12784cc40e3583214da2fdb21d08cfd35d0ed7a1","observation_id":"a0286cfc-fc90-486f-9be9-93d7b54586bd","resolution":{"observed_at":"2026-08-12T17:52:01.952300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.958357Z","title":"Meta-Radiology 1(3), 100033 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.958357Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:cff33fc88a73a1d5026910ebfb56ea90ca98e6f3744381448250cd2442a866b1","observation_id":"7cb55258-d3a4-4ded-906b-9a48782cf30b","resolution":{"observed_at":"2026-08-12T17:52:01.958357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.963712Z","title":"In: Proceedings of the AAAI Conference on Artificial Intel- ligence, vol","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.963712Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:8b39c9f7b3c8d2a99fa7e74ad1672a08f396fbd54dcce378bf161d92f9d29022","observation_id":"e4965f1f-a9c5-421c-a384-c6b582d96fa9","resolution":{"observed_at":"2026-08-12T17:52:01.963712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.971704Z","title":"In: Machine Learning for Healthcare Conference, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.971704Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:85d82d8d2d1e740673c16468b1280714b16aaed9005f5d493ee71422da8d8e22","observation_id":"52e7e0ed-9765-4c52-8e84-f766008f95e0","resolution":{"observed_at":"2026-08-12T17:52:01.971704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11209","last_updated":"2024-04-17T09:45:43Z","snapshot_observed_at":"2026-08-18T17:06:00.462811Z","submitted_at":"2024-04-17T09:45:43Z","title":"Prompt-Guided Generation of Structured Chest X-Ray Report Using a Pre-trained LLM","version":1},"cited_work":{"arxiv_id":"2404.11209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11209","snapshot_observed_at":"2026-08-12T17:52:03.617833Z","title":"Prompt-Guided Generation of Structured Chest X-Ray Report Using a Pre-trained LLM","venue":"cs.AI","work_id":"263b954a-cf18-4406-a4b9-ba055a5a800f","year":2024},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.977160Z"},"links":{"cited_paper":"/paper/2404.11209","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:3edcb17b7ea15242161d8f4848e2660ccfd502f4b5b4bd84421e867bb9b13118","observation_id":"610d8182-6b42-43a1-8ea8-9f114188a7e0","resolution":{"observed_at":"2026-08-12T17:52:03.623363Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.982862Z","title":"Medical Image Analysis 86, 102798 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.982862Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:427b9b37ddf4886973c55b3f1ca5d345bbcfffe76ad0ca63edf436746a620e16","observation_id":"8bff233f-2dc0-4d66-bbb1-afdd838f9b1a","resolution":{"observed_at":"2026-08-12T17:52:01.982862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.989076Z","title":"IEEE Transactions on Multimedia (2021) 24","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.989076Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:39f4a69821711ba84ba99ccc98b2d0b1d770f71d9567e98c5fb265346b7413e2","observation_id":"13fc820d-e8da-4a9a-8efe-51a4f2dba09f","resolution":{"observed_at":"2026-08-12T17:52:01.989076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:01.994969Z","title":"In: Inter- national Conference on Medical Image Com- puting and Computer-Assisted Intervention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:01.994969Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:47d676c0c4a098c0a77b241f8d0e992583beaddc3d26bed84cab80afee536455","observation_id":"c9dd6f35-3d3b-4f85-9bc1-41bd64dd8167","resolution":{"observed_at":"2026-08-12T17:52:01.994969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.001833Z","title":"Advances in Neural Information Processing Systems 34, 16266–16279 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.001833Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:b9186891d95d33c43e70a3ba22fc2f4911c8b425dcd9f356d46a011e6a8943d9","observation_id":"e3260a0a-debf-4cc6-bbde-0dbe6f0e17d9","resolution":{"observed_at":"2026-08-12T17:52:02.001833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.008424Z","title":"In: Proceedings of the AAAI Conference on Artificial Intel- ligence, vol","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.008424Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:1ef98d3dedec45f5f8642371d23a4f628b1d19c835600a3e8d3a0d5a459a1046","observation_id":"90bc3333-3f39-472b-aaec-ebd4daee0245","resolution":{"observed_at":"2026-08-12T17:52:02.008424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.014051Z","title":"In: International Conference on Medical Image Computing and Computer-Assisted Intervention, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.014051Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:173a4f465399741022b834f8120ce49607ed15083d451b0027257a55282edcfe","observation_id":"2c87b047-0d7f-4859-b9e3-3e9591b3d472","resolution":{"observed_at":"2026-08-12T17:52:02.014051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.021860Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.021860Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:fd57774a7ad9706af71bd56cdf235e2740ad0d7b15cca8412a7f9a0dde2c2c9e","observation_id":"d5db78d9-caf5-4f81-8d4e-8c87693fe5cf","resolution":{"observed_at":"2026-08-12T17:52:02.021860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.027832Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.027832Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:f5c741476cb18438640fe580a048a92b8f663508976aaa5c4c3ddf8faba203f2","observation_id":"79e55891-5754-41d6-9d70-afcb81de7df4","resolution":{"observed_at":"2026-08-12T17:52:02.027832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08749","last_updated":"2023-10-10T17:29:52Z","snapshot_observed_at":"2026-08-18T18:16:21.899152Z","submitted_at":"2023-06-14T21:17:31Z","title":"Utilizing Longitudinal Chest X-Rays and Reports to Pre-Fill Radiology Reports","version":2},"cited_work":{"arxiv_id":"2306.08749","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.08749","snapshot_observed_at":"2026-08-12T17:52:03.593887Z","title":"Utilizing Longitudinal Chest X-Rays and Reports to Pre-Fill Radiology Reports","venue":"cs.CL","work_id":"0bd21155-c6d0-48ee-8d67-1fe262510d30","year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.033878Z"},"links":{"cited_paper":"/paper/2306.08749","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:6f8be1e44c9242d0fb855597d58aff4da5d973ca9114798e6d55846de2b8745c","observation_id":"b4e08b7c-8122-459e-9a9a-716b4771b99a","resolution":{"observed_at":"2026-08-12T17:52:03.599942Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.040008Z","title":"In: International Workshop on Machine Learning in Medical Imaging, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.040008Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:dc6f210693dfb062e97b587af09ee180604ff120483f4ba832f605fb999869d6","observation_id":"1f681698-c444-4431-88ea-3cca1df85dfb","resolution":{"observed_at":"2026-08-12T17:52:02.040008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.045411Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.045411Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7dc77b789161c50e892ca663c85f1f1b2973df30f6e0bec35f893fac77c1b5e7","observation_id":"4fd862dc-3c9b-4c36-b836-d9fe345d372d","resolution":{"observed_at":"2026-08-12T17:52:02.045411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.050804Z","title":"In: International Conference on Machine Learn- ing, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.050804Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:2436faecd059d7621fbdfcbb20880501173d17764521b187430cf99999a0a283","observation_id":"5d1f258d-125c-4969-b295-c28a45997883","resolution":{"observed_at":"2026-08-12T17:52:02.050804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.056329Z","title":"In: Findings of the Association for Computational Linguistics: EMNLP 2020, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.056329Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:bbdac17c80b94b28675b40d2713dd4c8adc97d1bbb53dbd68ee2bf30353dd314","observation_id":"aad10161-e1ad-4cd5-8016-fdf4bc9bab58","resolution":{"observed_at":"2026-08-12T17:52:02.056329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.061863Z","title":"Journal of the American Medical Informatics Asso- ciation 23(2), 304–310 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.061863Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:021a9b343cf7e64ccf2ae4cb2431155d4cfe9898adf8418114ffc8ab5a83f365","observation_id":"b45a3919-01d5-488b-b362-a04a8aa6ec17","resolution":{"observed_at":"2026-08-12T17:52:02.061863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.067500Z","title":"Scientific data 6(1), 317 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.067500Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7e4d2ca25ee2a7c4ca7702f54f1731cab0877b9db41db272007ec219c5b737fd","observation_id":"b5f2123a-e636-4b8b-b9f3-53a57ed77022","resolution":{"observed_at":"2026-08-12T17:52:02.067500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.072786Z","title":"Medical image analysis 66, 101797 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.072786Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:96fa5b3cf94c999d46e17740b65749f73576470c899663960922f7b177c4a555","observation_id":"b259c139-47d1-4396-85d2-5228360bee1b","resolution":{"observed_at":"2026-08-12T17:52:02.072786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.078083Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence, vol","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.078083Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9cfaaf142188b6a05b33f9989c7491236a92bb960fdc7ca826a5a535774081db","observation_id":"ac1c1086-96e6-46a2-b3d6-fed12c75ec4a","resolution":{"observed_at":"2026-08-12T17:52:02.078083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16685","last_updated":"2024-10-10T10:53:41Z","snapshot_observed_at":"2026-08-18T16:22:39.738761Z","submitted_at":"2023-05-26T07:12:35Z","title":"Act Like a Radiologist: Radiology Report Generation across Anatomical Regions","version":2},"cited_work":{"arxiv_id":"2305.16685","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16685","snapshot_observed_at":"2026-08-12T17:52:03.569392Z","title":"Act Like a Radiologist: Radiology Report Generation across Anatomical Regions","venue":"cs.CV","work_id":"cf0fb8f1-e989-4567-99a1-799f3db13be2","year":2023},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.084500Z"},"links":{"cited_paper":"/paper/2305.16685","citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:9b7bb20f3742a4ef2edc055b72b50e6867ba8b44d7ee3508c9ecc59e49f3c0a7","observation_id":"4ccd1e5f-e9b2-4c46-81da-ace5ac410f4a","resolution":{"observed_at":"2026-08-12T17:52:03.574935Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.090136Z","title":"In: Proceedings of the 40th Annual Meeting of the Asso- ciation for Computational Linguistics, pp","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.090136Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:fd44ae055e8e3c5cf29468f13e7aeda3a4c05b1eed7ac5121316b97dbaf35779","observation_id":"4b3eb574-455d-42b4-956b-1292586d7313","resolution":{"observed_at":"2026-08-12T17:52:02.090136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:52:02.095212Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T17:52:02.095212Z"},"links":{"citing_paper":"/paper/2411.12195"},"observation_digest":"sha256:7d60b05f14914df802dfdc0224c553b7de237a79ce994b1e850383da2627430d","observation_id":"87ce322c-ad99-46f1-961d-b040842c3e70","resolution":{"observed_at":"2026-08-12T17:52:02.095212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.12195","last_updated":"2024-11-19T03:27:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T10:51:35.423187Z","submitted_at":"2024-11-19T03:27:05Z","title":"A Survey of Medical Vision-and-Language Applications and Their Techniques"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":96,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":260},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 260 outbound references and 4 inbound Pith citation observations for arXiv:2411.12195."}