{"as_of":"2026-08-14T00:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3a08d31521f642e2cd0354f316cafe8f97a72cfe0702963cbf9c95e2eaca925","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:21:08.658927Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17301/citation-record","integrity":"/paper/2411.17301/integrity","json":"/paper/2411.17301/citation-record.json","paper":"/paper/2411.17301"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.09812","last_updated":"2023-11-05T07:26:26Z","snapshot_observed_at":"2026-08-13T10:10:49.934981Z","submitted_at":"2023-09-18T14:35:35Z","title":"R2GenGPT: Radiology Report Generation with Frozen LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09812","snapshot_observed_at":"2026-08-12T12:21:08.542715Z","title":"R2gengpt: Radiology report generation with frozen llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.542715Z"},"links":{"cited_paper":"/paper/2309.09812","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:ee7c2fda18e702d03fd4e1305070048d5cce85a8a91e28df2a7bb2921cab33c7","observation_id":"e6d31ec8-8f66-4724-8bfd-8f9206422b85","resolution":{"observed_at":"2026-08-12T12:21:08.542715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:09.055896Z","title":"Kargen: Knowledge-enhanced automated radiology report generation using large language models","venue":null,"work_id":"402746aa-1fec-406e-b726-79cc0cfaeb03","year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.547242Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:6608290ebf15c703e43e36585f9680b77358c135229bd1a5a7112f97d169d49a","observation_id":"e362ed1d-3ec2-4c44-b474-dc6c15e06866","resolution":{"observed_at":"2026-08-12T12:21:09.060385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.551070Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.551070Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:fe12242d97938f8c8c8970d919ebaed3d0ac899b01b78a1d3e407c7fd1c450b0","observation_id":"d764540a-7f6a-4bb8-ab54-002724db1e2a","resolution":{"observed_at":"2026-08-12T12:21:08.551070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:09.034279Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":"5e74ff4a-13e8-4a27-a269-76607afb7c18","year":2019},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.555076Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:02bbacd3199c7e8767b1d6c0da3ae3c1b606635771861b7ea0ae0f016b9e7df6","observation_id":"2f3a0b02-f895-45e8-b009-e0066d3540aa","resolution":{"observed_at":"2026-08-12T12:21:09.038497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:09.020261Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":"5cc9ca01-5483-43e5-a339-cf964d3f5d15","year":2020},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.559591Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:2868c458a2a0ef64a268280f842ff4b72a5fe22a003258c138f30a37d1e9f8fa","observation_id":"312e0d7b-0dfb-4995-92ea-bf18530e148f","resolution":{"observed_at":"2026-08-12T12:21:09.024761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09167","last_updated":"2020-10-18T20:30:22Z","snapshot_observed_at":"2026-08-09T16:57:24.839639Z","submitted_at":"2020-04-20T09:46:40Z","title":"CheXbert: Combining Automatic Labelers and Expert Annotations for Accurate Radiology Report Labeling Using BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09167","snapshot_observed_at":"2026-08-12T12:21:08.563560Z","title":"Chexbert: combining automatic labelers and expert annotations for accurate radiology report labeling using bert","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.563560Z"},"links":{"cited_paper":"/paper/2004.09167","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:1ab9630e195723680eb37420d86c5302dc6a8986f82b78a57d3f67dbff2562f0","observation_id":"771eaf76-0250-47db-8ce4-f2679130936a","resolution":{"observed_at":"2026-08-12T12:21:08.563560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.14463","last_updated":"2021-08-29T23:19:33Z","snapshot_observed_at":"2026-08-13T18:55:51.098017Z","submitted_at":"2021-06-28T08:24:23Z","title":"RadGraph: Extracting Clinical Entities and Relations from Radiology Reports","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.14463","snapshot_observed_at":"2026-08-12T12:21:08.568328Z","title":"Radgraph: Extracting clinical entities and relations from radiology reports","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.568328Z"},"links":{"cited_paper":"/paper/2106.14463","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:5ffc7eccbb4d0aa3b9e0131ecfc055424df94d5cc63e7649ee60677b594fcaa4","observation_id":"a4966d0d-52f0-42ae-9e06-ffdd440385d9","resolution":{"observed_at":"2026-08-12T12:21:08.568328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:09.004114Z","title":"A systematic evaluation of gpt-4v’s multimodal capability for chest x-ray image analysis","venue":null,"work_id":"f3128ea9-9a37-42fb-aa7c-ef940c420a50","year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.572724Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:08e4dd1ce595cdd04f33d18a010dec5c634a860daf754d30156cd7029a618bd5","observation_id":"2dcc9769-9e03-4404-ab29-31b324a34b4e","resolution":{"observed_at":"2026-08-12T12:21:09.008581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.989641Z","title":"Evaluating progress in automatic chest x-ray radiology report generation","venue":null,"work_id":"5fc70593-3902-4fb8-a493-66df14c1ac6c","year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.576414Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:8f221cf63f6e75e74a235dbdb3eafd7553533d4da979aba9d27f5b0461b05cab","observation_id":"869b3239-2197-4dd4-b489-f3a332069347","resolution":{"observed_at":"2026-08-12T12:21:08.994643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T12:21:08.579911Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.579911Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:619bb01d3630bd9f24b07e7face9260be6419fb83d49b6351753c0c090c157d0","observation_id":"7aeb1634-a525-40da-999e-681e2e1fea86","resolution":{"observed_at":"2026-08-12T12:21:08.579911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01937","last_updated":"2023-05-03T07:28:50Z","snapshot_observed_at":"2026-08-13T11:50:17.843572Z","submitted_at":"2023-05-03T07:28:50Z","title":"Can Large Language Models Be an Alternative to Human Evaluations?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01937","snapshot_observed_at":"2026-08-12T12:21:08.583992Z","title":"Can large language models be an alternative to human evaluations? arXiv preprint arXiv:2305.01937, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.583992Z"},"links":{"cited_paper":"/paper/2305.01937","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:bc41f758c1d11c222abd4cfe1011329360f1dd2cf4ab26a15f006e1dbc759747","observation_id":"c7038c9c-3323-4c76-8d93-48edf064a7e2","resolution":{"observed_at":"2026-08-12T12:21:08.583992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17778","last_updated":"2024-04-27T04:42:45Z","snapshot_observed_at":"2026-08-13T00:20:30.577218Z","submitted_at":"2024-04-27T04:42:45Z","title":"MRScore: Evaluating Radiology Report Generation with LLM-based Reward System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17778","snapshot_observed_at":"2026-08-12T12:21:08.588094Z","title":"Mrscore: Evaluating radiology report generation with llm-based reward system","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.588094Z"},"links":{"cited_paper":"/paper/2404.17778","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:34877752ec3a1106e42dbbef9e54901b2370c8538162e68cbd5046ee670e78ac","observation_id":"c49fe582-12f2-4742-b351-02967f109c81","resolution":{"observed_at":"2026-08-12T12:21:08.588094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.974359Z","title":"Introducing meta llama 3: The most capable openly available llm to date","venue":null,"work_id":"12bdb9b7-eb1d-472d-8291-c27a08f76052","year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.592620Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:90c64214c897b2d0540ca4b33fefd1c648aee555d8a798fcfb2bcf02d2b95792","observation_id":"8dc19c80-8967-4a66-8ad6-6722eb964c84","resolution":{"observed_at":"2026-08-12T12:21:08.979077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.958262Z","title":"Training small multimodal models to bridge biomedical competency gap: A case study in radiology imaging","venue":null,"work_id":"e4c797ca-83bd-40ef-bed7-5249fcb41a89","year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.596499Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:fb117b21424a5371c0167f1838e07d746a4faaf8a5612422603285da2d26abe9","observation_id":"725648d9-36e8-40eb-9591-5ec5d084e877","resolution":{"observed_at":"2026-08-12T12:21:08.964740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20613","last_updated":"2024-08-12T06:36:10Z","snapshot_observed_at":"2026-08-12T23:53:34.538821Z","submitted_at":"2024-05-31T04:05:09Z","title":"FineRadScore: A Radiology Report Line-by-Line Evaluation Technique Generating Corrections with Severity Scores","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20613","snapshot_observed_at":"2026-08-12T12:21:08.600326Z","title":"Fineradscore: A ra- diology report line-by-line evaluation technique generating corrections with severity scores","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.600326Z"},"links":{"cited_paper":"/paper/2405.20613","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:db0bf271aeda78a1c0735e77ff02fa3e16f68559c3fb5dcdaca26e974cf204bb","observation_id":"7bf57cc0-b0e7-464d-944c-d2ce351a9519","resolution":{"observed_at":"2026-08-12T12:21:08.600326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03595","last_updated":"2025-01-22T06:24:43Z","snapshot_observed_at":"2026-08-13T00:13:50.484959Z","submitted_at":"2024-05-06T16:04:03Z","title":"GREEN: Generative Radiology Report Evaluation and Error Notation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03595","snapshot_observed_at":"2026-08-12T12:21:08.604750Z","title":"Green: Generative radiology report evaluation and error notation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.604750Z"},"links":{"cited_paper":"/paper/2405.03595","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:f88fb46950a93af804f6bf0e07d6c136b2f323c4bb60436e63080760e9e96761","observation_id":"85e34cd8-3d07-4caa-bbc2-6047b48133c0","resolution":{"observed_at":"2026-08-12T12:21:08.604750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.609156Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.609156Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:c9144a3567238b242daf70c7167eef8cf67634fc7cade5fe16d988d0a8187336","observation_id":"9f3be8fe-3f83-4ea9-8297-1feaec04c900","resolution":{"observed_at":"2026-08-12T12:21:08.609156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.613503Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.613503Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:b0f4e0e14159227c22d605661e30b7496016586685e6e6479816e88f1afe675b","observation_id":"ce2b866d-a1c0-40a4-87f5-490756ae8e79","resolution":{"observed_at":"2026-08-12T12:21:08.613503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-12T12:21:08.617336Z","title":"Bertscore: Evaluating text generation with bert","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.617336Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:7f411ac7a4c912c80be08fd0992ee980782ecfe6d0214a313c51bd8a8f509830","observation_id":"82d7c256-4636-424e-b272-3d26930150a0","resolution":{"observed_at":"2026-08-12T12:21:08.617336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.927507Z","title":"Ball, Katie S","venue":null,"work_id":"26ee3feb-b5cd-41f5-8631-d35be0c90258","year":2019},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.621466Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:a264b8590ffaec429074fdddbb1bca1327cde39b11e0424aff21f1f5584ad689","observation_id":"cbadb49b-85c1-420c-b22c-fb8d4483bca5","resolution":{"observed_at":"2026-08-12T12:21:08.931609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T12:21:08.625577Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.625577Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:869c9f507b6cc52dbb4ce9c46ced5fd0323722bed1e60943acdfde5f2da97cd7","observation_id":"edd5be86-c22f-48f4-81f2-088997455f24","resolution":{"observed_at":"2026-08-12T12:21:08.625577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.915095Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"62172a38-1593-4f91-b12e-706012eb7c90","year":2022},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.629337Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:8b43af13268c4586b28fd394e8b352e90595f2c400ed6610e0683856999da1b6","observation_id":"e358548a-67b3-4d45-8ca0-d537808ccde9","resolution":{"observed_at":"2026-08-12T12:21:08.919378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.900217Z","title":"Radiology report expert evaluation (rexval) dataset, 2023","venue":null,"work_id":"b53dac45-a75d-438a-979a-2d3f882aa501","year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.633339Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:5b0b7853ccac8faa9052acb68574c596457ac5acd32bf9bc6ee9d05ea877885b","observation_id":"3a76d29d-e63d-44da-9a46-91e2c677a5fb","resolution":{"observed_at":"2026-08-12T12:21:08.904986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.637034Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.637034Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:f84b393dc17d55041ab2fa0f12d498eae1cf70a87fd45fc1c728bac034577498","observation_id":"6766ba41-a013-44cc-94f9-6f59710e67e3","resolution":{"observed_at":"2026-08-12T12:21:08.637034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.873707Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality, march 2023","venue":null,"work_id":"e7d72c5a-7ffb-42a5-8c6d-105475fb4443","year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.641226Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:2090736cb643f610ed9a41db978c84b506ac25e163011d8a35512ecf01f4833e","observation_id":"36b312b4-a7e0-41ec-8382-dcb71e4cb49b","resolution":{"observed_at":"2026-08-12T12:21:08.878205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-12T12:21:08.645097Z","title":"Meditron-70b: Scaling medical pretraining for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.645097Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:69728c584bd5e6cbba044821b04647eec6f36f87c4a8cd7048e28b59550002f3","observation_id":"815b0578-7460-44ae-87a7-dd4697a5659e","resolution":{"observed_at":"2026-08-12T12:21:08.645097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.859559Z","title":null,"venue":null,"work_id":"fa4c8780-a0e7-46e2-8fea-cadd5d015517","year":2024},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.650236Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:47bc2c3a901e3d110441b27b985839a9cc62825131822c6ea1de35443b8985ca","observation_id":"666b1553-5ebd-41b0-bd31-b88523f292ff","resolution":{"observed_at":"2026-08-12T12:21:08.864031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-12T12:21:08.654293Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.654293Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:3270d44a0d614ae6d289c2f5d4fe74dddfb0cfbc03772c1a32fb221ea245df33","observation_id":"13aed032-967b-4cf8-9710-ade766c5023b","resolution":{"observed_at":"2026-08-12T12:21:08.654293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:21:08.842341Z","title":"Textbooks are all you need ii: phi-1.5 technical report, 2023","venue":null,"work_id":"5dca41f7-12f7-4eef-bcdd-1844438b9b77","year":2023},"citing_paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:21:08.658927Z"},"links":{"citing_paper":"/paper/2411.17301"},"observation_digest":"sha256:03169bef4b95ab65b6b87290dec50ad3f2e517b282b32e56163af2c0296dae31","observation_id":"cb974d84-6d09-48b6-990f-63767890c61f","resolution":{"observed_at":"2026-08-12T12:21:08.848982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17301","last_updated":"2025-02-13T12:25:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T12:29:14.129218Z","submitted_at":"2024-11-26T10:48:55Z","title":"ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2411.17301."}