{"as_of":"2026-08-10T01:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c0499c0b6e689ec186d1eeed2dd13ad5e88ea758aebf0202ae934226cca5564","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:40:59.075135Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T14:09:06.139625Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:10:28.670574Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"cited_work":{"arxiv_id":"2507.07568","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07568","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"211ea36f-a3ba-4122-843b-b206b4a92a8e","year":2025},"citing_paper":{"arxiv_id":"2604.13598","last_updated":"2026-04-15T08:08:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T08:08:06Z","title":"Enhancing Reinforcement Learning for Radiology Report Generation with Evidence-aware Rewards and Self-correcting Preference Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-10T14:09:06.139625Z"},"links":{"cited_paper":"/paper/2507.07568","citing_paper":"/paper/2604.13598"},"observation_digest":"sha256:0fc967085fb1fdc5e7364ca24c184097e64029629e0bea1d797ea9a9b0c1a4ef","observation_id":"5c7c268a-d65a-4457-a4fa-2afbffd5e22a","resolution":{"observed_at":"2026-05-10T14:10:28.672612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07568/citation-record","integrity":"/paper/2507.07568/integrity","json":"/paper/2507.07568/citation-record.json","paper":"/paper/2507.07568"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.634276Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:54.634276Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:be5f827aeab4fedc38da9ce0d8ff327affbce631b2894e41f1098adf6f08656e","observation_id":"78479a4d-5929-44c4-a896-406487b8c21b","resolution":{"observed_at":"2026-08-06T18:40:54.634276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:05.555199Z","title":"Instance-level expert knowledge and aggregate discrimina- tive attention for radiology report generation","venue":null,"work_id":"215f2f2c-da36-48d9-a41a-983f0a80aff7","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:54.698556Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:7e25256256c6b15164086d119f5a0fe22388294f608a1159a669b6f1d511df50","observation_id":"66c350e7-409e-48e6-b3ab-d8610a0fc357","resolution":{"observed_at":"2026-08-06T18:41:05.610400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08078","last_updated":"2024-06-04T12:27:38Z","snapshot_observed_at":"2026-07-06T17:01:00.985811Z","submitted_at":"2023-12-13T11:47:28Z","title":"Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08078","snapshot_observed_at":"2026-08-06T18:40:54.786069Z","title":"Fine-grained image-text alignment in medical imaging en- ables cyclic image-report generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:54.786069Z"},"links":{"cited_paper":"/paper/2312.08078","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:15001147b9fd3632697cb1803e6479603bb1fa9eecb5ce8953f34468ef368a63","observation_id":"a3ec215e-a41d-40fe-81a3-32556a435ba6","resolution":{"observed_at":"2026-08-06T18:40:54.786069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.16056","last_updated":"2022-04-28T01:16:11Z","snapshot_observed_at":"2026-08-07T11:49:12.409435Z","submitted_at":"2020-10-30T04:08:03Z","title":"Generating Radiology Reports via Memory-driven Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.16056","snapshot_observed_at":"2026-08-06T18:40:54.869300Z","title":"Generating radiology reports via memory-driven trans- former","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:54.869300Z"},"links":{"cited_paper":"/paper/2010.16056","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:5cf21c78d12bbc70449c99048a8e8c116d37aab9a6f73f3df902c279aa39431c","observation_id":"d504dc60-88db-48ec-b52f-f26993d8d51c","resolution":{"observed_at":"2026-08-06T18:40:54.869300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13258","last_updated":"2022-04-28T02:32:53Z","snapshot_observed_at":"2026-08-06T22:43:19.014396Z","submitted_at":"2022-04-28T02:32:53Z","title":"Cross-modal Memory Networks for Radiology Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13258","snapshot_observed_at":"2026-08-06T18:40:54.940751Z","title":"Cross-modal memory networks for radiology report gener- ation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:54.940751Z"},"links":{"cited_paper":"/paper/2204.13258","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:b2b08df743aba98c2996a08dd75836fe616b238585019545c8edb51da18d685d","observation_id":"9d6a7184-3743-452e-b37b-29994f9f3119","resolution":{"observed_at":"2026-08-06T18:40:54.940751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:55.064495Z","title":"Meshed-memory transformer for image cap- tioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.064495Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:fa097ebe501c2cd8ff9b4eff7523f23e5989b90e70621f3be4a0b27c32cf8761","observation_id":"52a97cc1-afeb-4dec-95d9-80a01c7c7f76","resolution":{"observed_at":"2026-08-06T18:40:55.064495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:05.376986Z","title":"To- wards diverse and natural image descriptions via a condi- tional gan","venue":null,"work_id":"265d3a5c-bf4a-40b3-9bab-f3113e34eafb","year":2017},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.148019Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:de2cc8816fcfcd7b1beab354f28cfeb865b254251879e2a673910b104958aae9","observation_id":"e2f3b51a-843d-4293-9f9d-eec123549feb","resolution":{"observed_at":"2026-08-06T18:41:05.462231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:05.207125Z","title":"Meteor 1.3: Automatic metric for reliable optimization and evaluation of machine translation systems","venue":null,"work_id":"f754bc76-018a-4f24-a94f-98d9f11f589c","year":2011},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.209257Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:6cad6ca5d73e6d095e66f391e9383d0562ee56e293ebd7b7f9d8d3267f062b7f","observation_id":"e41aad48-9aba-4b14-8f8b-079ca4ba5034","resolution":{"observed_at":"2026-08-06T18:41:05.278577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:05.046655Z","title":"Long short-term memory","venue":null,"work_id":"75772ff7-8126-4a0d-8327-95d53a7f77cd","year":2012},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.323303Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:27e7b029cab2297a7a4ef9a08a51f4abb376660aba4124f9e525663bc047694c","observation_id":"444720c9-34f8-4b33-ba88-03685b39b303","resolution":{"observed_at":"2026-08-06T18:41:05.109519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:04.898104Z","title":"Scaling up vision-language pre-training for image captioning","venue":null,"work_id":"5a5d431a-4350-45ba-87d4-df1e29f14a3f","year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.433036Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:0c20cb34bd7bb0185475b3985456b532fc70b6e9a95610a188e01e133ebffdad","observation_id":"69c3d97e-2961-4c1f-a040-89f0b82b9409","resolution":{"observed_at":"2026-08-06T18:41:04.969520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:04.667517Z","title":"Kiut: Knowledge-injected u-transformer for radiology report generation","venue":null,"work_id":"9f8dc77d-42ce-42ef-98c1-940d2aeef113","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.534153Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:1c6b965db1e8fefef02280ba1cec78b25c83a5f4b9b26379abea9cb086bc5dc2","observation_id":"fd4f6c4e-9dfe-4597-9e56-c1c3019e36e6","resolution":{"observed_at":"2026-08-06T18:41:04.768171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:04.534130Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison","venue":null,"work_id":"3623ad57-054d-4dd7-a4a9-7af5f7e43079","year":2019},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.655311Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:cc1617b0cb7960e923beeec12d469e34346a2d00caa3da345c8924b621f6a46d","observation_id":"b3f8e06e-977d-4568-84cd-db6808602b1d","resolution":{"observed_at":"2026-08-06T18:41:04.578931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:04.330525Z","title":"Promptmrg: Diagnosis-driven prompts for medical report generation","venue":null,"work_id":"47602fa3-7119-4aab-8530-b5d7a10d1482","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.760521Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:c72cafd590d79b70d1fc7d021d61840913693f69abc299402ff79add6fed3c3f","observation_id":"66150774-7d3f-42a1-96e6-d9944ecf8717","resolution":{"observed_at":"2026-08-06T18:41:04.442761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:04.194568Z","title":"Zero-shot camouflaged object detection","venue":null,"work_id":"c6da83a8-b20d-4f02-b858-a3b84da63f13","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:55.898674Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:b148632c60831e14e5f5d0f84db2432dda3b07b16854dfbfa0ecaccebf8351d4","observation_id":"5b4ef1b4-7b98-4a38-993f-91d441f63684","resolution":{"observed_at":"2026-08-06T18:41:04.318825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:03.481437Z","title":"Dynamic graph enhanced contrastive learning for chest x-ray report generation","venue":null,"work_id":"5741081a-28e5-44a5-b002-96fb0d0c2104","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.011195Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:b4233d73842144ed04143befb49d70678e62a1d70f6badad45baacac2db6719e","observation_id":"baffaa0e-0a8a-4797-b2e5-e7060b176690","resolution":{"observed_at":"2026-08-06T18:41:03.750014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:03.232476Z","title":"Unify, align and refine: Multi- level semantic alignment for radiology report generation","venue":null,"work_id":"741b2dba-8444-439e-9a78-dfd1e0183101","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.141380Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:90992946d30d423c2c849f7f87631068abbfd609cc1aa2605bbe131be48e9b42","observation_id":"db6feba9-9b44-4b77-87e1-a16bb8ee3b6e","resolution":{"observed_at":"2026-08-06T18:41:03.303434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:56.262544Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.262544Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:8acebad7062d0f72fc4fc6b29ea1534a1164b0eb6d22572a6fb74b800ad1246b","observation_id":"445c98da-8d75-4fc3-9628-def98b1f73b0","resolution":{"observed_at":"2026-08-06T18:40:56.262544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:03.073959Z","title":"Exploring and distilling posterior and prior knowl- edge for radiology report generation","venue":null,"work_id":"4319bce9-750c-4e91-809e-0de5c13a2497","year":2021},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.361215Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:7db77d9abecbf4531546b36c549123a7d4a23d2411968b51af8507e9f15e1cf4","observation_id":"3e1d39db-f330-47b2-b6be-84e91f921b60","resolution":{"observed_at":"2026-08-06T18:41:03.132064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:02.802578Z","title":"Grounding dino: Marry- ing dino with grounded pre-training for open-set object de- tection, 2024","venue":null,"work_id":"260b868c-3250-409f-8eaa-513d0a6a22da","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.507414Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:1e434c34c767cca9f1da289e08757552069ef28a9da774c8a62999c7295884f9","observation_id":"26596a90-efe7-46db-97ae-9bbbeb7ec035","resolution":{"observed_at":"2026-08-06T18:41:02.954214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:02.611435Z","title":"Knowing when to look: Adaptive attention via a visual sen- tinel for image captioning","venue":null,"work_id":"3557f38b-0b81-4925-8bce-ffb02d91c178","year":2017},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.639657Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:86dd7813c513a6e2af68c5e1d78665720726715583c82adcf05e74460e9fcd60","observation_id":"c30f39ce-c50a-4523-a79e-52880908d818","resolution":{"observed_at":"2026-08-06T18:41:02.739319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:02.425395Z","title":"Im- proving chest x-ray report generation by leveraging warm starting","venue":null,"work_id":"0d1455ae-8262-47f8-bcac-3ce5cc378849","year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.748965Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:9df5cd5de391743f84e0bd93c7ea123b07e5f6b90165985220cdb242464b3b3f","observation_id":"f1115d3c-2adf-4404-beba-d14d20bf12da","resolution":{"observed_at":"2026-08-06T18:41:02.508737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09777","last_updated":"2021-08-31T17:57:10Z","snapshot_observed_at":"2026-07-06T10:42:44.947174Z","submitted_at":"2021-02-19T07:42:13Z","title":"Progressive Transformer-Based Generation of Radiology Reports","version":3},"cited_work":{"arxiv_id":"2102.09777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.09777","snapshot_observed_at":"2026-08-06T18:40:59.202487Z","title":"Progressive Transformer-Based Generation of Radiology Reports","venue":"cs.CL","work_id":"89301ab1-22c8-4319-be77-e68d7bbbb43d","year":2021},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.851674Z"},"links":{"cited_paper":"/paper/2102.09777","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:d0098fcf4c7b0ee40cc881ad7d467d57e5a09d076a1c7bde8dcbbc8b6c60bfd0","observation_id":"7600f648-b485-4dec-a247-a68a9f9f67cb","resolution":{"observed_at":"2026-08-06T18:40:59.265156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.08458","last_updated":"2015-12-02T18:06:03Z","snapshot_observed_at":"2026-07-06T04:37:52.737823Z","submitted_at":"2015-11-26T17:45:01Z","title":"An Introduction to Convolutional Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.08458","snapshot_observed_at":"2026-08-06T18:40:56.975156Z","title":"An introduction to convolutional neural networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:56.975156Z"},"links":{"cited_paper":"/paper/1511.08458","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:9210355be76c4adbc2972ba594b188ba8a4492d131fd1ca530618ffe8fe9f404","observation_id":"481197d6-1da4-4f23-a372-1101e123d7bb","resolution":{"observed_at":"2026-08-06T18:40:56.975156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:02.192034Z","title":"X-linear attention networks for image captioning","venue":null,"work_id":"bfb76f37-06b4-45f0-b714-59c775b0149a","year":2020},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.092731Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:1d7b9143964ae72829932968586756601c945895edb1404bbf50a93b94adeb92","observation_id":"8a47ff2b-b8ab-4ff7-8152-aeba2f888650","resolution":{"observed_at":"2026-08-06T18:41:02.280231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:57.192845Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.192845Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:da1352813604a2e52bbff482716600760f9c974c65215709e197df6fe00d42d9","observation_id":"399b2de2-7ed2-4d59-b049-64f5531a590b","resolution":{"observed_at":"2026-08-06T18:40:57.192845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:01.999735Z","title":"Self-critical sequence training for image captioning","venue":null,"work_id":"2b937b1a-d914-414d-87d5-36fb6936904a","year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.300223Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:c786f80a6248c9549f9478dc4adbcc94226a986871057b5b78f60b86eb56072c","observation_id":"2279dcf1-cd36-4f63-90c1-8bcec903b8a5","resolution":{"observed_at":"2026-08-06T18:41:02.077441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09167","last_updated":"2020-10-18T20:30:22Z","snapshot_observed_at":"2026-08-09T16:57:24.839639Z","submitted_at":"2020-04-20T09:46:40Z","title":"CheXbert: Combining Automatic Labelers and Expert Annotations for Accurate Radiology Report Labeling Using BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09167","snapshot_observed_at":"2026-08-06T18:40:57.387664Z","title":"Chexbert: com- bining automatic labelers and expert annotations for accu- rate radiology report labeling using bert","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.387664Z"},"links":{"cited_paper":"/paper/2004.09167","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:9fb7bce96f2a8e920eabe269df88c721fb91d1c580224b5318390f9573e466c9","observation_id":"6cbdd847-1624-48ba-bea7-e050a2f5ce2f","resolution":{"observed_at":"2026-08-06T18:40:57.387664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:01.807081Z","title":"Interactive and explainable region-guided radiol- ogy report generation","venue":null,"work_id":"dd7126f0-4d02-4d9e-88f2-728a376c5df2","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.521412Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:fee3514b17851f9f7c8dea877f713aa8fb262057a9d61f9dfaf42d683388b596","observation_id":"bb509744-ab22-429f-9980-1e8dc68f5de1","resolution":{"observed_at":"2026-08-06T18:41:01.885758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:57.653944Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.653944Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:302fc2a86614b72cefed0f99ae16898a7d11e88fb219ecbf9b07cef9a1d5ef77","observation_id":"9f787231-8d18-4ab0-b334-5b4bb60b2e60","resolution":{"observed_at":"2026-08-06T18:40:57.653944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:01.450496Z","title":"Hergen: El- evating radiology report generation with longitudinal data,","venue":null,"work_id":"125ebbd6-6b3a-40a2-b070-f97820b3e0a6","year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.808493Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:a1f615b7bd4ca5056541837d48028efcd0946b70cf90c301d16fa816dd685526","observation_id":"726f4580-4d9c-4fb2-a79d-9b8813b37521","resolution":{"observed_at":"2026-08-06T18:41:01.679143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:01.312440Z","title":"Cross-modal pro- totype driven network for radiology report generation","venue":null,"work_id":"a39cb7b4-3019-4685-b2de-d2cb0d2fa59e","year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.876827Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:4b6de26e1314c00e8c9ce294203be3467bc4ad0d7195b4fba81cba976a6899a5","observation_id":"dc82586b-a8f1-4b1b-a1e6-cee1f9b0c2b3","resolution":{"observed_at":"2026-08-06T18:41:01.372332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:01.177321Z","title":"Multi-view feature fusion and visual prompt for remote sensing image captioning","venue":null,"work_id":"caf51042-4ae8-4a2b-974a-08a5a1fababd","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:57.968629Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:3663fe28771917ce7ae0e404d16c9c7101fa219e401a521a0480acc14c43d353","observation_id":"b743310e-a002-4e63-b0ea-cbe3e98c47af","resolution":{"observed_at":"2026-08-06T18:41:01.242470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:00.895762Z","title":"Medclip: Contrastive learning from unpaired medical images and text, 2022","venue":null,"work_id":"e6a7dc67-0934-4453-8a8b-260c22fd9db0","year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.066074Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:da2f6b81437777f04997e735f06a1db3d24e28f152dbab42240fe6ac4c8f7531","observation_id":"777f3ed9-0a61-4858-a7bf-c2a69703f466","resolution":{"observed_at":"2026-08-06T18:41:01.050486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:00.640978Z","title":"Metransformer: Radiology report generation by transformer with multiple learnable expert tokens","venue":null,"work_id":"d771bee6-9a5a-49a0-8a62-6770f17b2d83","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.159836Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:56214e8e1f52d884bdf7a72b8365043ce390f2ecfe0fe97d414a15d8bf35f244","observation_id":"81bd850c-94a1-4f1e-9f70-de01d224ba5b","resolution":{"observed_at":"2026-08-06T18:41:00.765205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:00.389993Z","title":"Medklip: Medical knowledge enhanced language-image pre-training in radiology, 2023","venue":null,"work_id":"a0ec3709-7c6f-4dae-9358-6d1b9a955959","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.283944Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:b7efcdb064ccdc2760d382a2eb6fba4a2a4760992799c702fe34fc30a6ffefb0","observation_id":"00e48e2c-8dbf-4bc5-a4ec-39c6a2f85fcf","resolution":{"observed_at":"2026-08-06T18:41:00.516888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:00.137876Z","title":"Clinical-bert: Vision-language pre-training for radiograph diagnosis and reports generation","venue":null,"work_id":"99718669-9972-4332-b645-7f5e02898b68","year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.395579Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:3b34ac8e6a31c693e7acfbaf946f25d86f40ace939349c4f745af7c65c35b540","observation_id":"ca36f8da-a3e4-4651-88e2-b907d02e5427","resolution":{"observed_at":"2026-08-06T18:41:00.236712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:41:00.035079Z","title":"Knowledge matters: Chest radiology report genera- tion with general and specific knowledge","venue":null,"work_id":"2b66f6be-e5a5-4b5f-a0b3-00c344401a5b","year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.484139Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:785690194cc4e54495fa88493e45d54f9a896a4c2bd7ccbfc81c717190ed8a66","observation_id":"a1c43eb3-35d8-4341-8c96-d4285d96a71d","resolution":{"observed_at":"2026-08-06T18:41:00.110219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:59.935162Z","title":"Radiology report generation with a learned knowledge base and multi-modal alignment","venue":null,"work_id":"47031cf8-aac8-4dab-97c5-9696e0e3f0d4","year":2023},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.584779Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:6f6bb26e208156ced73f77f14182914c36379f493d5ae2f11626a47fa873f5bf","observation_id":"3a4ab974-bc06-472f-a825-8bb259196c28","resolution":{"observed_at":"2026-08-06T18:40:59.972046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:59.791218Z","title":"Improving hyperbolic representations via gromov- wasserstein regularization","venue":null,"work_id":"390670be-9745-4673-8e3f-781e1d15a0d7","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.684853Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:446cd072a6a224baa6e7df126859be9bc8a77d79ee106986bf7aee04c73712f3","observation_id":"fc0a99fe-33e2-4751-b791-a7d51508a97f","resolution":{"observed_at":"2026-08-06T18:40:59.865065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:59.653391Z","title":"Otseg: Multi-prompt sinkhorn attention for zero-shot semantic segmentation","venue":null,"work_id":"74a7ccd1-ac0d-4e6e-82a2-a39469e7f4e7","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.767838Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:b73f20850d6de41d01c231026ede424b162b05b86cda0cefbf0b9b9d65b66947","observation_id":"61a4302a-1b9b-4391-b4d0-5c6efedcccd2","resolution":{"observed_at":"2026-08-06T18:40:59.719371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-07-06T13:06:27.153765Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-06T18:40:58.884213Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.884213Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:7be11640a967595e87b2dbbb636531c1311a2a9d01732d5ba1a1c9b643c2500c","observation_id":"6f210f77-71be-4632-afa1-6bd23d153e4a","resolution":{"observed_at":"2026-08-06T18:40:58.884213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:59.497755Z","title":"Anatomy-guided weakly- supervised abnormality localization in chest x-rays","venue":null,"work_id":"fe38f144-3728-4766-af7e-6e3bcd8f27ff","year":null},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:58.967913Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:03d493b4a53a78a713d2d57776ae9422b4c7a12ee2dfd4d46ceb24412a932662","observation_id":"59a90ce7-959b-4231-9389-27b178fc4b20","resolution":{"observed_at":"2026-08-06T18:40:59.576735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:59.379646Z","title":"Sam-guided enhanced fine-grained encoding with mixed semantic learning for medical image captioning","venue":null,"work_id":"a3766dbf-10ae-4c14-a6cb-78e336d77aad","year":2024},"citing_paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:59.075135Z"},"links":{"citing_paper":"/paper/2507.07568"},"observation_digest":"sha256:734f6725ac1a127aae2a0e0de1e49c857907ae810c8c96eec053b6b33c269fbe","observation_id":"21525339-621f-46bf-876d-c7d8cecf6915","resolution":{"observed_at":"2026-08-06T18:40:59.428509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07568","last_updated":"2025-07-10T09:13:10Z","latest_version":1,"primary_category":"stat.ME","snapshot_observed_at":"2026-08-09T11:34:01.895101Z","submitted_at":"2025-07-10T09:13:10Z","title":"Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2507.07568."}