{"as_of":"2026-08-16T03:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31289ceb3babedaef7907e5ae33b918c4fe01d3f1e994f0434991bb3dafcf5f8","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:32:12.368913Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:54:41.933749Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T14:04:44.782937Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19665","snapshot_observed_at":"2026-08-06T19:54:41.933749Z","title":"Recurrent visual feature extraction and stereo attentions for ct report generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04333","last_updated":"2025-07-06T10:37:16Z","snapshot_observed_at":"2026-08-13T09:11:04.552012Z","submitted_at":"2025-07-06T10:37:16Z","title":"Computed Tomography Visual Question Answering with Cross-modal Feature Graphing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:41.933749Z"},"links":{"cited_paper":"/paper/2506.19665","citing_paper":"/paper/2507.04333"},"observation_digest":"sha256:7738e302693205141ebe739b8221b50cc7e89698d6038db998e77d5100834458","observation_id":"867720fa-cb2a-42bc-b8c2-e00437be774d","resolution":{"observed_at":"2026-08-06T19:54:41.933749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"cited_work":{"arxiv_id":"2506.19665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19665","snapshot_observed_at":"2026-06-30T14:04:44.782937Z","title":"Recurrent visual feature extraction and stereo attentions for ct report generation.arXiv preprint arXiv:2506.19665, 2025","venue":null,"work_id":"d43ec54e-dcb9-4d96-ba28-0f3b5cb44426","year":2025},"citing_paper":{"arxiv_id":"2605.24371","last_updated":"2026-05-23T03:18:56Z","snapshot_observed_at":"2026-08-15T02:37:55.784094Z","submitted_at":"2026-05-23T03:18:56Z","title":"SliceWorld: A Predictive and Controllable World-State Model for CT Report Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T13:57:09.053990Z"},"links":{"cited_paper":"/paper/2506.19665","citing_paper":"/paper/2605.24371"},"observation_digest":"sha256:94b68984a382984ae47719a7645d34ca557b6a977ec12cc1f3b2169c8d931da9","observation_id":"74970003-7cf3-4931-a301-d5b8be4844fc","resolution":{"observed_at":"2026-06-30T14:04:44.784670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19665/citation-record","integrity":"/paper/2506.19665/integrity","json":"/paper/2506.19665/citation-record.json","paper":"/paper/2506.19665"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.164327Z","title":"Generating Radiology Reports via Memory-driven Transformer,","venue":null,"work_id":"6d03e435-0d09-410c-a3f6-a13cbb2f3bdf","year":2020},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.134889Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:fd8ed8c3e13db03ce01a031d12b1c267f21e4a059148c1049f23ca50170015dd","observation_id":"367f08d5-a61b-4022-9354-8d86cc2fbe2c","resolution":{"observed_at":"2026-08-15T18:32:13.168414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.148252Z","title":"Ratchet: Med- ical transformer for chest x-ray diagnosis and reporting,","venue":null,"work_id":"563bc245-6c61-4450-b8f5-4d04c999b74c","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.140671Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:1b05190d8dc9d62d27bcd72a8e8db8a6be972b078072f39386e1d0522839f65f","observation_id":"28fb95c4-5a4d-4f79-9133-897db0be870e","resolution":{"observed_at":"2026-08-15T18:32:13.153635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.130947Z","title":"XrayGPT: Chest radiographs summarization using large medical vision-language models,","venue":null,"work_id":"8d52c03e-795c-4019-8285-099ac7265ac9","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.145862Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:b5dc572c53659ebb696320b8234352b905e470845f25f688c39352b0e54b0f27","observation_id":"1969a769-dc09-4cff-9912-09564feac391","resolution":{"observed_at":"2026-08-15T18:32:13.136583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.112901Z","title":"Automated pul- monary nodule detection in ct images using deep convolutional neural networks,","venue":null,"work_id":"09f2ae54-bc05-496f-8df0-379185889f34","year":2019},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.150610Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:3aa9710d547cc5365fc545f26e9483dfafaefca859ff18fed600c6c84a22c13f","observation_id":"180e9ed2-6054-4456-8ba0-2e7398734ee2","resolution":{"observed_at":"2026-08-15T18:32:13.119633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.155593Z","title":"Unet++: Redesigning skip connections to exploit multiscale features in image segmentation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.155593Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:e95c0ffd9a571d8cbaeba2d442f11730dd281e3bd4238db7a320bc6f5d345978","observation_id":"da48fa2a-df88-4086-bfed-01a3911aadd3","resolution":{"observed_at":"2026-08-15T18:32:12.155593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.091593Z","title":"Unet 3+: A full-scale connected unet for medical image segmentation,","venue":null,"work_id":"7e65e627-8b8c-4ce4-94e9-c6ca00849ef4","year":2020},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.160776Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:b689b40475bd7eacddbdb5a23ce29f85d0cfd09ca84f023fd910b398eea92ac4","observation_id":"125d1a6d-9d89-4ebb-9403-9ec3eb97f8c5","resolution":{"observed_at":"2026-08-15T18:32:13.095917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.073513Z","title":"Sanet: A slice-aware network for pulmonary nodule detection,","venue":null,"work_id":"7122d92a-b225-4ebc-b191-0b2ac04cc95f","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.165822Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:7cca06e3e559ecfd99214c7ac2800ba53ec8fc065577c7b3fb7139a1f46b30fa","observation_id":"9cd81f06-d292-4024-bde1-30e12691d85f","resolution":{"observed_at":"2026-08-15T18:32:13.078691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.054972Z","title":"Lung nodule classi- fication of ct images based on the deep learning algorithms,","venue":null,"work_id":"eb04ae6d-5750-4f75-af0a-f0f29ce5b3b4","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.170558Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:204abd0da8df8a60c8f0978a4656ecaf3e9203a3085900b5088649e88a684ee9","observation_id":"cd436671-ec74-430e-98a9-970cdf21850d","resolution":{"observed_at":"2026-08-15T18:32:13.061052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.038949Z","title":"Semi-supervised deep transfer learning for benign-malignant diagnosis of pulmonary nodules in chest ct images,","venue":null,"work_id":"0bd3e037-bc23-4b08-bcb0-d76e8d6de87a","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.175080Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:758591db89cffde3a548e7d817f6920dd18f57089986d02f30bb37dd1302b14a","observation_id":"d58d259d-d401-4a1b-a1e5-f3e757615fc7","resolution":{"observed_at":"2026-08-15T18:32:13.044603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.022469Z","title":"Medical-vlbert: Medical visual language bert for covid-19 ct report generation with alternate learning,","venue":null,"work_id":"948ee91a-a6c6-4c46-b3ff-50fea9e4049a","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.179933Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:04d8c342fbbb4a0fffb45ae74a8673aa320aa9296c95e2ecb1cb35da09eba803","observation_id":"a47d74a5-4f11-4fe8-9561-17c82b38dec0","resolution":{"observed_at":"2026-08-15T18:32:13.027359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:13.006172Z","title":"Swin-unet: Unet-like pure transformer for medical image segmentation,","venue":null,"work_id":"14dbe9ec-de99-4590-a5c3-a77e25826842","year":2022},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.184755Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:ca3663cbb3c3c18d452a110181ac3b7a48e1a73fa12b0cce4b5483a5f63ced6a","observation_id":"cbba84c2-3204-4ade-821f-ea9ee0d6bdbd","resolution":{"observed_at":"2026-08-15T18:32:13.011806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.987900Z","title":"A multilevel transfer learning tech- nique and lstm framework for generating medical captions for limited ct and dbt images,","venue":null,"work_id":"05f74ebe-125d-4349-9f29-76e46c8a7274","year":2022},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.189513Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:797667198762ec8db75f3b0bfef9d8e4b503de93f140add642ed047620d5f265","observation_id":"96de92c1-6407-4ab0-a594-3305520295d2","resolution":{"observed_at":"2026-08-15T18:32:12.994063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19330","last_updated":"2024-09-28T12:31:07Z","snapshot_observed_at":"2026-08-14T09:48:52.319840Z","submitted_at":"2024-09-28T12:31:07Z","title":"3D-CT-GPT: Generating 3D Radiology Reports through Integration of Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19330","snapshot_observed_at":"2026-08-15T18:32:12.193990Z","title":"3d-ct-gpt: Generating 3d radiology reports through integration of large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.193990Z"},"links":{"cited_paper":"/paper/2409.19330","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:a638babc7eb3cbe41012e92f657e2793e0c82db9e732259f163b4a4723a0920d","observation_id":"64adb230-7e95-43b0-9dea-13c51be53730","resolution":{"observed_at":"2026-08-15T18:32:12.193990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16386","last_updated":"2024-03-25T03:02:51Z","snapshot_observed_at":"2026-08-13T00:46:04.884370Z","submitted_at":"2024-03-25T03:02:51Z","title":"Dia-LLaMA: Towards Large Language Model-driven CT Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16386","snapshot_observed_at":"2026-08-15T18:32:12.198866Z","title":"Dia-llama: Towards large language model-driven ct report generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.198866Z"},"links":{"cited_paper":"/paper/2403.16386","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:93dc0f9f8ee8a3dac71f333600c6af76cae23530c83af99d3f493a87e2bb8899","observation_id":"56244bfb-ed67-45a2-8988-2f80e98ebebd","resolution":{"observed_at":"2026-08-15T18:32:12.198866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00578","last_updated":"2024-03-31T06:55:12Z","snapshot_observed_at":"2026-08-13T19:26:05.889698Z","submitted_at":"2024-03-31T06:55:12Z","title":"M3D: Advancing 3D Medical Image Analysis with Multi-Modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00578","snapshot_observed_at":"2026-08-15T18:32:12.203692Z","title":"M3d: Advancing 3d medical image analysis with multi-modal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.203692Z"},"links":{"cited_paper":"/paper/2404.00578","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:b2f3334945597cd2622f6bd07317eace988b361f8535df6d717b14d17024cf7c","observation_id":"798aebe8-d62b-4fb3-a650-7e1e5543e530","resolution":{"observed_at":"2026-08-15T18:32:12.203692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.974124Z","title":"CT2Rep: Automated radi- ology report generation for 3d medical imaging,","venue":null,"work_id":"b57c9ef7-af9b-48e9-9970-c8d83128013c","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.209920Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:9d4f3a599a1bb8738714c56e65e8b2044eb063831cc6affe641e0cf05a5d5c96","observation_id":"c59326e6-4a23-44a0-9c05-3ed2fb40b3f9","resolution":{"observed_at":"2026-08-15T18:32:12.978635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.959858Z","title":"Generative adversarial network with robust discrimina- tor through multi-task learning for low-dose ct denoising,","venue":null,"work_id":"f1a26044-d601-4d1a-b2f4-d22fb0136182","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.214814Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:699669cfc3763fe9d22facbb37d8d36c73d832bb162e63eedd05924b5621d27a","observation_id":"af163ed8-d53e-4773-99a3-e5323732fd2d","resolution":{"observed_at":"2026-08-15T18:32:12.964142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.218634Z","title":"Ct-agrg: Automated abnormality-guided report gen- eration from 3d chest ct volumes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.218634Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:93980f6ecce8e59eefdc9ad119a77462da36d7f1fa4a1882fc376e95b0ab1979","observation_id":"f627e1b8-aa3f-480c-a2f7-fb4346f16c3a","resolution":{"observed_at":"2026-08-15T18:32:12.218634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.945242Z","title":"Explainable artificial intelligence (xai) in deep learning-based medical image analysis,","venue":null,"work_id":"73c7df26-21f4-47fa-b97b-2f7807f1ef5c","year":2022},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.223133Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:a78ce9a9780078ce2fee93f8ab6219a1900a95053d8358066f93d722bcaa36e3","observation_id":"fc50a145-4d10-4287-994e-6ca53b752b03","resolution":{"observed_at":"2026-08-15T18:32:12.949968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.932271Z","title":"Granularity matters: pathological graph-driven cross-modal alignment for brain ct re- port generation,","venue":null,"work_id":"308b2134-497a-4847-b4ec-675a9aa879e9","year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.227035Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:80c0a3e0c6b6ca416cd45e825937675641d2ababbc7ee0cc564f9b9e3ae568b4","observation_id":"76f4dd0a-0b75-410a-8c9e-d1100f39cb3e","resolution":{"observed_at":"2026-08-15T18:32:12.936427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.919186Z","title":"Co-occurrence rela- tionship driven hierarchical attention network for brain ct report generation,","venue":null,"work_id":"b59de86b-878d-46f3-8ae2-2d2a9a94624f","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.231662Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:57747e6afe9babd35c870182e3ff8bfbb6b48b521a0821a1707947cf674cdc47","observation_id":"19bcddfe-177b-4ab6-8a62-b77db346b3d3","resolution":{"observed_at":"2026-08-15T18:32:12.923687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02233","last_updated":"2024-05-10T03:59:34Z","snapshot_observed_at":"2026-08-15T17:38:58.447750Z","submitted_at":"2023-12-04T06:40:12Z","title":"MedXChat: A Unified Multimodal Large Language Model Framework towards CXRs Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02233","snapshot_observed_at":"2026-08-15T18:32:12.237088Z","title":"MedXChat: Bridging CXR Modal- ities with a Unified Multimodal Large Model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.237088Z"},"links":{"cited_paper":"/paper/2312.02233","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:1d9a79aa14c1de8d3f5a49665e7f8605e4adb0b21adebb3717de328b7e2cd15e","observation_id":"da325d47-66f0-4861-b1e8-ed5de4f01339","resolution":{"observed_at":"2026-08-15T18:32:12.237088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16213","last_updated":"2024-08-29T02:12:58Z","snapshot_observed_at":"2026-08-02T05:05:13.711617Z","submitted_at":"2024-08-29T02:12:58Z","title":"M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16213","snapshot_observed_at":"2026-08-15T18:32:12.241470Z","title":"M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.241470Z"},"links":{"cited_paper":"/paper/2408.16213","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:90ddd71810d1a1753ca8d637393c2eb3b526a32166764fcc6838677ca1e14c16","observation_id":"649d54e8-ed4f-48ad-8ca4-503837bd8ee2","resolution":{"observed_at":"2026-08-15T18:32:12.241470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.245487Z","title":"3d u-net: learning dense volumetric segmentation from sparse annotation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.245487Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:b0d592b929569e3d612e4ec40ee49930c75f199796e587173242667fe4c5cf6c","observation_id":"a2d7e8e9-b6a6-45b2-a811-2f070e7df6ef","resolution":{"observed_at":"2026-08-15T18:32:12.245487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.895888Z","title":"Unetr: Transformers for 3d medical image segmentation,","venue":null,"work_id":"b4620b45-8f05-4b4a-8b46-81b11a20276a","year":2022},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.249438Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:c41fd72dcbf199a4d1e7ccf4b157e95088d192bdad61d516ca1b72b1283a3e79","observation_id":"5757f897-6832-4329-b9cb-3e663e37f500","resolution":{"observed_at":"2026-08-15T18:32:12.900222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.879843Z","title":"Swin unet3d: a three-dimensional medical image segmentation network combining vision transformer and convolution,","venue":null,"work_id":"32da9d12-f1b6-466c-a186-57f9d57eeb8e","year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.253850Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:917d292c63b5892b6aaccb881fc38a74fddafe082f0a06eccfb2e29295c82af1","observation_id":"fc3708e2-e4ff-417b-a52c-63add6bed9fc","resolution":{"observed_at":"2026-08-15T18:32:12.884895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16684","last_updated":"2024-07-30T02:15:03Z","snapshot_observed_at":"2026-08-12T23:16:13.254270Z","submitted_at":"2024-07-23T17:50:00Z","title":"AutoRG-Brain: Grounded Report Generation for Brain MRI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16684","snapshot_observed_at":"2026-08-15T18:32:12.258658Z","title":"Autorg-brain: Grounded report generation for brain mri,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.258658Z"},"links":{"cited_paper":"/paper/2407.16684","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:b21408aa6024bf13f9eb38554bbced9d0d4e28ba8eff36639a4df8d46594d007","observation_id":"81006820-01af-4204-b949-980076001d63","resolution":{"observed_at":"2026-08-15T18:32:12.258658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.263691Z","title":"Unetr++: delving into efficient and accurate 3d medical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.263691Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:6d5d32e5a059f1106b692b9371d7e6f72e1fb56e1ff020b522d9f28ee844a6db","observation_id":"a548735d-fc80-40d2-ab10-601b05493a4e","resolution":{"observed_at":"2026-08-15T18:32:12.263691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.855140Z","title":"Generalized zero-shot chest x-ray diagnosis through trait-guided multi-view semantic embedding with self- training,","venue":null,"work_id":"d415d950-b96d-472b-b833-e190fa1a8878","year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.269093Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:18fbf5befe7258eeab3cc02f998ec92ad3b1eafce241e806076378e3944e4f4f","observation_id":"41e7a6e5-aa89-40a0-a3c0-fc494ad37cf0","resolution":{"observed_at":"2026-08-15T18:32:12.859997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14199","last_updated":"2024-04-25T09:25:24Z","snapshot_observed_at":"2026-08-15T20:58:18.062711Z","submitted_at":"2023-11-23T20:52:44Z","title":"A Systematic Review of Deep Learning-based Research on Radiology Report Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14199","snapshot_observed_at":"2026-08-15T18:32:12.273289Z","title":"A systematic review of deep learning- based research on radiology report generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.273289Z"},"links":{"cited_paper":"/paper/2311.14199","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:331602dc939720c1f6d49f2a4b8d067abd1d7af65cc5d4a5c84ef72e641c8a24","observation_id":"071448da-0079-4beb-93d2-e8d96be952a9","resolution":{"observed_at":"2026-08-15T18:32:12.273289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.836231Z","title":"Diffusion networks with task-specific noise control for radiology report generation,","venue":null,"work_id":"a4e5c14a-1f99-4eec-a190-a4286ffc6a2b","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.277980Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:c340d58bbd453c0441558c888fee37d9cc0b2001b3779321c243ebd0e3cf0586","observation_id":"3ba19b73-e693-430b-a337-0640381fc447","resolution":{"observed_at":"2026-08-15T18:32:12.842508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T18:32:12.284220Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.284220Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:d8357796954975cbd5a32d53a5cf8f3e58bbfec73a41d659758e1df031fc0214","observation_id":"b4cad25a-6fb7-4a63-81d4-39219785f6ea","resolution":{"observed_at":"2026-08-15T18:32:12.284220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T18:32:12.289541Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.289541Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:2b2df57ca8488d391b72e142aa2b1b3f41663b8c419feed25a19df5347e77a2d","observation_id":"81ab1e01-997c-4b21-a498-da0787ed8ff0","resolution":{"observed_at":"2026-08-15T18:32:12.289541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.816693Z","title":"Attention is All You Need,","venue":null,"work_id":"ba6ba7bc-082d-4921-acd9-5d3743d4dace","year":2017},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.294311Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:9505d0423d41d36da3068165f0fb2bf9a4389a9bb878a02964f53c84a57eed58","observation_id":"a0eda7da-c545-45be-8f70-d3240eb44e52","resolution":{"observed_at":"2026-08-15T18:32:12.825075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.803222Z","title":"Attention on Atten- tion for Image Captioning,","venue":null,"work_id":"e991bc5d-9dfe-4921-a029-494888c1747a","year":2019},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.299524Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:f109cde723f11a504357d132aa65f261d644873e8d40b7d813b38a0a41b0da40","observation_id":"9a924e7b-e134-4523-a7a8-bdb8b3ce4d2c","resolution":{"observed_at":"2026-08-15T18:32:12.807991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.305076Z","title":"Supertagging Combinatory Categorial Grammar with Attentive Graph Convolutional Networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.305076Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:1a3989814450505c11d1fade5cab0c755ff53f98b2f1cd193c2850fed0c10dad","observation_id":"5aef8628-f471-4698-91cf-bd08b2c018c8","resolution":{"observed_at":"2026-08-15T18:32:12.305076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.778431Z","title":"Learning multimodal contrast with cross-modal memory and reinforced contrast recognition,","venue":null,"work_id":"9c7cb24b-5194-4744-94b7-1f7ae13eea79","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.310747Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:8997ae0f136bf7f3089bf9dfafb71e293d96ebe8cd15ff7de081a20a00800bf0","observation_id":"1cbfe6b6-ef2d-4a1b-aef6-0bdaf524b62d","resolution":{"observed_at":"2026-08-15T18:32:12.782532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02463","last_updated":"2023-11-16T12:38:46Z","snapshot_observed_at":"2026-08-15T08:06:18.479854Z","submitted_at":"2023-08-04T17:00:38Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02463","snapshot_observed_at":"2026-08-15T18:32:12.315843Z","title":"To- wards generalist foundation model for radiology,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.315843Z"},"links":{"cited_paper":"/paper/2308.02463","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:6bf925fdd4466437925794d8e2f6ff8ce8d4df1da181cc1269266e07fe362db4","observation_id":"75b37336-6549-4e4c-9a10-6193af4b7727","resolution":{"observed_at":"2026-08-15T18:32:12.315843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-15T18:32:12.320567Z","title":"Efficient esti- mation of word representations in vector space,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.320567Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:8a094f12f701d1e91eac25e4a38f3da400414f153213c1de0d1499c64f2810c6","observation_id":"9340a571-be55-44bc-9d91-42260ff55e62","resolution":{"observed_at":"2026-08-15T18:32:12.320567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.763635Z","title":"Learning Word Representations with Regularization from Prior Knowledge,","venue":null,"work_id":"a585697a-7b81-4bc2-a766-6514e14a7675","year":2017},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.325404Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:60d6c87b8e16f415e0c6c1cf9a4a539e25c5d6daf127e62df0ca8455a3fc440f","observation_id":"a7bf9c1b-a9d5-4814-b749-cb4ca7ca8aee","resolution":{"observed_at":"2026-08-15T18:32:12.769189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.751088Z","title":"Joint Learning Embeddings for Chinese Words and Their Components via Ladder Structured Networks,","venue":null,"work_id":"cd2fac7c-f95c-42d5-83c6-b2f4a8bd4f21","year":2018},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.329299Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:3e44e67ff2dacc43d13f0c1e34d607850133dcaa3865b22ad2db4b5686cc16ba","observation_id":"967e2c36-9cfe-4a0c-b389-0cca2b88e994","resolution":{"observed_at":"2026-08-15T18:32:12.755551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.738138Z","title":"BERT: Pre- training of Deep Bidirectional Transformers for Language Un- derstanding,","venue":null,"work_id":"f32018b8-ca13-4477-83b5-a479ac5ef774","year":2019},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.333480Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:f3686bee542ffdbf5642c265fe1267c7d919fe51778945462de34b92f97528a2","observation_id":"cd0c300e-3cb2-49dd-91fb-3527ceaa4a56","resolution":{"observed_at":"2026-08-15T18:32:12.742569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.722968Z","title":"BART: Denoising sequence-to-sequence pre-training for natural language genera- tion, translation, and comprehension,","venue":null,"work_id":"bd8a8aac-55a9-458d-8851-40e2ca8a7907","year":2020},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.337350Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:7bc991cf847b533557d63dfa3b99fb9c31adae7b6559ffd3faa0df0c548dcd7d","observation_id":"4748c049-45e7-4336-abd9-d105b77bcd31","resolution":{"observed_at":"2026-08-15T18:32:12.728219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.343975Z","title":"Llava-Med: Training a large language-and-vision assistant for biomedicine in one day,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.343975Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:ef5cc03bd14cf72096086f9e9d09dfebd07350b13b779371bda1bb985cfb2b5d","observation_id":"d3d8c2a8-66b8-49c7-b3ec-31807c5dc49e","resolution":{"observed_at":"2026-08-15T18:32:12.343975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.697791Z","title":"ChiMed-GPT: A Chinese medical large language model with full training regime and better alignment to human preferences,","venue":null,"work_id":"3f65f36d-5dc5-4bb2-a3c9-df3344c1598b","year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.348069Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:122de5f60eb89f433ba233a5c1c0eed1f4f6bdd3a8976718ad6a3e2fcd21d807","observation_id":"b39ee149-08f4-471a-8ef0-e2dcbde7fd37","resolution":{"observed_at":"2026-08-15T18:32:12.704547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T18:32:12.352437Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.352437Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:893dbacead410adc984caa6d39dff9b7c215b1b6fab1a4214a37b2fb7524e701","observation_id":"a71f6404-88c7-41b3-9eb4-6791e729f2a2","resolution":{"observed_at":"2026-08-15T18:32:12.352437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-14T21:12:00.450049Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-15T18:32:12.355978Z","title":"Visual-rft: Visual reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.355978Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:29c7c7c012b6ca90115af81c9d03aa9ca617d8f34694f84955b99ff2e4fdfd77","observation_id":"d615b444-1c9a-43a4-9e3f-2fb4d4f395af","resolution":{"observed_at":"2026-08-15T18:32:12.355978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07086","last_updated":"2025-06-08T11:15:57Z","snapshot_observed_at":"2026-08-10T10:55:15.234500Z","submitted_at":"2025-06-08T11:15:57Z","title":"Representation Decomposition for Learning Similarity and Contrastness Across Modalities for Affective Computing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07086","snapshot_observed_at":"2026-08-15T18:32:12.359954Z","title":"Repre- sentation decomposition for learning similarity and contrast- ness across modalities for affective computing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.359954Z"},"links":{"cited_paper":"/paper/2506.07086","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:a4864bde7b6c834a640c6afd9432f0f56bb7377a663122b4fdab93b3296ba73a","observation_id":"96cdba50-ffd2-4e65-83aa-38ea572e8f9c","resolution":{"observed_at":"2026-08-15T18:32:12.359954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-13T01:30:54.104133Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-15T18:32:12.364655Z","title":"R1- vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.364655Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:34ce24ca15b76bb539a50a6dda7642539739aa05e7526d830bcf33e868c75905","observation_id":"cdc9654a-2f32-4f42-985d-8243acb6a2c7","resolution":{"observed_at":"2026-08-15T18:32:12.364655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:32:12.368913Z","title":"Vivit: A video vision transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T18:32:12.368913Z"},"links":{"citing_paper":"/paper/2506.19665"},"observation_digest":"sha256:7c0b4e04d4db7b51ad8b0a4363fd655ef159adad713aa178885bee51d897fc65","observation_id":"00197f94-90f0-428f-891d-e79198f9ffc8","resolution":{"observed_at":"2026-08-15T18:32:12.368913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19665","last_updated":"2025-06-24T14:29:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T18:26:18.611069Z","submitted_at":"2025-06-24T14:29:06Z","title":"Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2506.19665."}