{"as_of":"2026-08-19T11:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:285e5b463e45687faad909185f405d62425069ef5a294a0d6e963623686d1ea3","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:42:02.726920Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:57:51.206063Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T03:56:21.604762Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-08-06T15:57:51.206063Z","title":"Riegler, and P ˚ al Halvorsen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14544","last_updated":"2025-07-19T09:04:13Z","snapshot_observed_at":"2026-08-18T03:51:14.575321Z","submitted_at":"2025-07-19T09:04:13Z","title":"Multimodal AI for Gastrointestinal Diagnostics: Tackling VQA in MEDVQA-GI 2025","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:51.206063Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2507.14544"},"observation_digest":"sha256:92bd278231d41f76a2eea2f7de6838d7773d5ab0be082387de773c79b4426ac0","observation_id":"f0beebc1-9999-4b7e-97b3-738c0a256f0c","resolution":{"observed_at":"2026-08-06T15:57:51.206063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":"2506.09958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"50f12829-08fd-426a-82d6-ba4468fecb52","year":2025},"citing_paper":{"arxiv_id":"2605.10761","last_updated":"2026-05-11T15:57:35Z","snapshot_observed_at":"2026-08-02T12:12:15.627459Z","submitted_at":"2026-05-11T15:57:35Z","title":"RadThinking: A Dataset for Longitudinal Clinical Reasoning in Radiology","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T03:55:55.359488Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2605.10761"},"observation_digest":"sha256:822bff392269a1007b08fd9ce67b435853d11661a050d507f5abd386dbcb4ea9","observation_id":"16a6d077-dde9-4722-9d55-5f74cf186cc2","resolution":{"observed_at":"2026-05-12T03:56:21.606430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-08-01T16:57:30.636879Z","title":"Kvasir-VQA-x1: A multimodal dataset for medical reasoning and robust MedVQA in gastrointestinal endoscopy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-17T17:05:26.306533Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.636879Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:dc7a134c76f15fae8fe94846782eff2e00ed300588fd1a31e129fa4697dcd34b","observation_id":"e4faedd8-0162-413c-94cc-6b6cde36c72b","resolution":{"observed_at":"2026-08-01T16:57:30.636879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09958/citation-record","integrity":"/paper/2506.09958/integrity","json":"/paper/2506.09958/citation-record.json","paper":"/paper/2506.09958"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.560852Z","title":"Foundation metrics for evaluating effectiveness of healthcare conversations powered by generative AI.npj Digital Med., 7(82):1–14, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.560852Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2e1105db9535abb5230f626e9acff146b974dbc9952fe4acf25d7d1dc7ff0d0d","observation_id":"1c52b270-b9ff-4969-b23b-a8c9878cbd98","resolution":{"observed_at":"2026-08-07T04:42:02.560852Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-08-17T03:00:38.806206Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-07T04:42:02.564894Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning.arXiv, April 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.564894Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d54cdf4de6832dca1c7bc3758ae337bcb122d6a2b7084999151698bcfb7012a7","observation_id":"a2c6ce8e-7a85-4ee8-bff5-7d04aa538d59","resolution":{"observed_at":"2026-08-07T04:42:02.564894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.568482Z","title":"A deep learning framework for quality assessment and restoration in video endoscopy.arXiv, April 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.568482Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:bb87002276e78edb366dd1ec9741a30aa4fca3f15b4493f89ae241af29940a52","observation_id":"a011d625-0122-4965-8059-336b9f3babff","resolution":{"observed_at":"2026-08-07T04:42:02.568482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T04:42:02.572023Z","title":"Qwen2.5-vl technical report.arXiv preprint arXiv:2502.13923, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.572023Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:4a69536e3a8c3a23a91d72f3d77891abd808f51faa8c46b357b808f1809dc6c8","observation_id":"742143e1-a8a9-4ca3-8b5c-06eadc2925fb","resolution":{"observed_at":"2026-08-07T04:42:02.572023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.575479Z","title":"Vision–Language Model for Visual Question Answering in Medical Imagery.Bioengineering, 10(3):380, March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.575479Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:6257509ef3dc99b82fdaa47087535f17f2558bbe110b71f891cec620435d0018","observation_id":"9b01ca2c-d2e7-4f42-b1c4-a6b01b57a0d9","resolution":{"observed_at":"2026-08-07T04:42:02.575479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.578778Z","title":"Smedsrud, Steven Hicks, Debesh Jha, Sigrun L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.578778Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:b757aa0ff0e5e7ce33644fe94d4df9e809b038c4cb8402fc8ff247294769baf7","observation_id":"c8071b00-5997-42eb-b362-7c04b953944f","resolution":{"observed_at":"2026-08-07T04:42:02.578778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.581769Z","title":"Iglovikov, and Alexandr A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.581769Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:4bae323a873e5549653cd475ad0a6b38df31f29496646f41afdcae564a74b2b3","observation_id":"c193399a-2514-4e52-8e1b-6bf57876587d","resolution":{"observed_at":"2026-08-07T04:42:02.581769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-15T20:49:51.676387Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-07T04:42:02.584675Z","title":"A Simple Framework for Contrastive Learning of Visual Representations.arXiv, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.584675Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c323e3eb58e9f31e61adf18ba0ec7e6b64fae95915efa6356fe07d0f77556260","observation_id":"4b9b7d8e-612e-4d26-8bcb-8f5485610ce8","resolution":{"observed_at":"2026-08-07T04:42:02.584675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20327","last_updated":"2025-03-09T05:23:35Z","snapshot_observed_at":"2026-08-19T00:56:46.278733Z","submitted_at":"2024-10-27T03:56:56Z","title":"R-LLaVA: Improving Med-VQA Understanding through Visual Region of Interest","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20327","snapshot_observed_at":"2026-08-07T04:42:02.588945Z","title":"R-LLaV A: Improving Med-VQA Understanding through Visual Region of Interest.arXiv, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.588945Z"},"links":{"cited_paper":"/paper/2410.20327","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c875d16dfe444eee9324d19ce327992c8759f0a74bf647633ed9f12e9838ae17","observation_id":"b1d98937-3b9b-4a47-92f4-fc1afd4bd9c3","resolution":{"observed_at":"2026-08-07T04:42:02.588945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.591678Z","title":"Generative Models in Medical Visual Question Answering: A Survey.Appl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.591678Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:4da12dccd165f85df03e361d5b881a3164c5e539a8b14f94095ca9216efd0148","observation_id":"e0f0c41c-5985-4413-907c-2d2629c589ea","resolution":{"observed_at":"2026-08-07T04:42:02.591678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.594102Z","title":"LLM-based NLG Evaluation: Current Status and Challenges.Computational Linguistics, pages 1–27, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.594102Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:22adf997b993ca4676f3e7c92fd815e0c4e1ddd761a215a39dfbc496c44b020d","observation_id":"a3b1350f-f88c-4339-96fa-4f4a2a8c620f","resolution":{"observed_at":"2026-08-07T04:42:02.594102Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.597646Z","title":"Hicks, Vajira Thambawita, P ˚ al Halvorsen, and Michael A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.597646Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:a60d5f61783e50aab52f90b833eb42689388388a0a90a1dce207c582afa9b238","observation_id":"1c7bb54d-d855-4835-93c3-d9ae3e933a37","resolution":{"observed_at":"2026-08-07T04:42:02.597646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.744921Z","title":"Medgemma hugging face, May 2025","venue":null,"work_id":"5c102f84-b587-4184-a6e8-e8f34e9f594b","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.600361Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:636e35f54264004bfb79346c3a3bf21620c787dbacc739168658f53276b0f716","observation_id":"b8cbc6fb-8c62-40bc-bf01-60df620470cb","resolution":{"observed_at":"2026-08-07T04:42:04.839627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13039","last_updated":"2024-04-19T17:51:52Z","snapshot_observed_at":"2026-08-16T13:59:23.477970Z","submitted_at":"2024-04-19T17:51:52Z","title":"LaPA: Latent Prompt Assist Model For Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.13039","doi":"10.48550/arxiv.2404.13039","metadata_source":"pith","pith_arxiv_id":"2404.13039","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"LaPA: Latent Prompt Assist Model For Medical Visual Question Answering","venue":"cs.CV","work_id":"2cfaca8a-055a-4ec9-ba78-e2faf88a45dc","year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.603313Z"},"links":{"cited_paper":"/paper/2404.13039","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:5ce3eb778451b27264708830fc8f6520307d048a7cfe60cf809ffc7d81490273","observation_id":"2d9bf78c-e0a5-4e92-8415-b4f5e3352157","resolution":{"observed_at":"2026-08-07T04:42:03.038603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18536","last_updated":"2025-03-24T10:42:48Z","snapshot_observed_at":"2026-08-16T12:47:24.558682Z","submitted_at":"2025-03-24T10:42:48Z","title":"DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels","version":1},"cited_work":{"arxiv_id":"2503.18536","doi":"10.48550/arxiv.2503.18536","metadata_source":"pith","pith_arxiv_id":"2503.18536","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels","venue":"cs.CV","work_id":"027347f8-703c-4d86-8341-015f08ba099b","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.606380Z"},"links":{"cited_paper":"/paper/2503.18536","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:ad37d250e99ed750f53f5d0c8a682b8435cab0a8b842348854cef581c27a0d34","observation_id":"059da0cf-f138-4789-8bb7-8129831f33a1","resolution":{"observed_at":"2026-08-07T04:42:03.024840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.609354Z","title":"Vision-language models for medical report generation and visual question answering: a review.Front","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.609354Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c482826be47915c3d90d7e213ce432eaa04dd27d5a48eba9896fd04156157447","observation_id":"73acb3fc-ee4d-4efb-9116-8e12b4afe5dd","resolution":{"observed_at":"2026-08-07T04:42:02.609354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-08-16T03:03:21.512563Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-07T04:42:02.612276Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing.arXiv, November 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.612276Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:9589112ab7c8f0f26f42095f5e5310502863f256badb5eb66c9e549152006b14","observation_id":"ce258bb0-d390-4241-ad2d-c3a69acb344b","resolution":{"observed_at":"2026-08-07T04:42:02.612276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.555642Z","title":"Overview of imageclefmedical 2023-medical visual question answering for gastrointestinal tract","venue":null,"work_id":"90e8da99-3789-4b24-8898-7fbc96105fe2","year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.617533Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:a0b368f012bdca3ad657c7b36f8926d0b57b34741bc7fd162eb61cd300fd4917","observation_id":"ba445f8d-489f-472a-be4c-234269813756","resolution":{"observed_at":"2026-08-07T04:42:04.613594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T04:42:02.620794Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.620794Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c32def39dec226718337da698c0c29514bd173675d41696c2cce50d039db46ab","observation_id":"0dc39b54-26f4-4063-9f9c-6e19054be7dc","resolution":{"observed_at":"2026-08-07T04:42:02.620794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.624394Z","title":"Summers, and Yingying Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.624394Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:0278884cb591e610fb3d0a201f9952a1ce43f467056a19ee8cd2add777c3324a","observation_id":"8aee339d-ca74-4715-94d7-19d6be5718b2","resolution":{"observed_at":"2026-08-07T04:42:02.624394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.627513Z","title":"Sadman Hafiz, Jamin Rahman Jim, Md","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.627513Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:cb7eeebdf0ddc5485f1e14052d76369931be57146977e9cd5d9f3b7cf20cdcf3","observation_id":"84594a3c-9911-445d-91f4-5d41e69b0f21","resolution":{"observed_at":"2026-08-07T04:42:02.627513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-67835-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Hicks, Vajira Thambawita, Enrique Garcia-Ceja, Michael A","venue":"Lecture notes in computer science","work_id":"2ae8fa38-b5ee-4c5d-916a-75c68bf10543","year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.631069Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2b873e32518f488742e081232718181dd61c0b1f3d527adf9b675b98cbca3fef","observation_id":"eff2e767-9c63-482a-920e-2a60e8a62874","resolution":{"observed_at":"2026-08-07T04:42:02.991850Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.633750Z","title":"Lau, Soumya Gayen, Asma Ben Abacha, and Dina Demner-Fushman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.633750Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:9cd96d95bd1f4538561fd9fff2b783ad10d4378be9195d221b8616fff793f82d","observation_id":"bb2fe99e-3373-4845-ab3f-2a81e219314a","resolution":{"observed_at":"2026-08-07T04:42:02.633750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.636692Z","title":"Meteor: an automatic metric for MT evaluation with high levels of correlation with human judgments","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.636692Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2b51b8dff6f93691d872f813a3476c057189ac27e6148a083934933802db44a5","observation_id":"d8645d43-43fa-4eed-ad94-0683aa80f03b","resolution":{"observed_at":"2026-08-07T04:42:02.636692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-07T04:42:02.639446Z","title":"LLaV A-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day.arXiv, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.639446Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:69eb4d4e722c8a24fdba1fd7a68efb6be4cbae0b768c009be6323df882b86540","observation_id":"9b4184d9-7b52-4b7d-a755-5e76e336007f","resolution":{"observed_at":"2026-08-07T04:42:02.639446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12215","last_updated":"2024-01-22T18:59:07Z","snapshot_observed_at":"2026-08-16T14:25:26.933920Z","submitted_at":"2024-01-22T18:59:07Z","title":"Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12215","snapshot_observed_at":"2026-08-07T04:42:02.642311Z","title":"Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models.arXiv, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.642311Z"},"links":{"cited_paper":"/paper/2401.12215","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:57dc48b5c104d385321daff93c1c9ba0044a9c3445a32891f8fed1ed861b7a20","observation_id":"6374a26f-cdb1-4954-b58a-21362fd715d5","resolution":{"observed_at":"2026-08-07T04:42:02.642311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.645547Z","title":"Candidate-Heuristic In-Context Learning: A new framework for enhancing medical visual question answering with LLMs.Information Processing & Management, 61(5):103805, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.645547Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:a1a3bb06d7d7f9d5b01f5be0b4740aca95e522cb824c1319f5f4a8957db79082","observation_id":"5f2a347e-1273-423f-8ea4-455a9a976e34","resolution":{"observed_at":"2026-08-07T04:42:02.645547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.648531Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.648531Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:969fb288347024f26be85c8b4433ee184bb65a74b69b2c54caf8d19842312b2a","observation_id":"b3ee46df-b7b5-4e5a-86c2-0948147c2b90","resolution":{"observed_at":"2026-08-07T04:42:02.648531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10261","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:03.480208Z","title":"Medical visual question answering: A survey.Artif","venue":null,"work_id":"c3b9274a-ab1b-495e-8e32-6d09ce6d0705","year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.651405Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2c97b957b4bc192d48ff3f5afc6755d5b6ca1999e20604faea50d8bbe111c173","observation_id":"2c6ec00c-b26a-4396-806b-9c645233b806","resolution":{"observed_at":"2026-08-07T04:42:03.491149Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.654115Z","title":"Slake: A Semantically-Labeled Knowledge-Enhanced Dataset For Medical Visual Question Answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.654115Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:54c7e23a96bbca4f008aa185c56e7c1fa78fa44b03c4a7ca4a97f14ab85bf149","observation_id":"4927d41e-e237-47b8-aa8b-a2ea1a5640b1","resolution":{"observed_at":"2026-08-07T04:42:02.654115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T04:42:02.657045Z","title":"Visual Instruction Tuning.arXiv, April 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.657045Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:6c22a93721db2be66e1b1805a6a734fdeee082038a56ca672a77df0e6675f504","observation_id":"454e4dff-4980-4af8-8a5a-ac47abd2aee0","resolution":{"observed_at":"2026-08-07T04:42:02.657045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.391220Z","title":"Peft: State-of- the-art parameter-efficient fine-tuning methods","venue":null,"work_id":"a94ef3de-7473-4d2b-a508-c0da59b91196","year":2022},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.659998Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:de1fa7c5965b4cf25a9241743b1a5eefe1153bbc917316293fedf81555e4c272","observation_id":"35c11c11-694e-4dd3-92a9-a62c5d80325b","resolution":{"observed_at":"2026-08-07T04:42:04.463784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15189","last_updated":"2023-07-27T20:36:02Z","snapshot_observed_at":"2026-08-16T15:12:41.052629Z","submitted_at":"2023-07-27T20:36:02Z","title":"Med-Flamingo: a Multimodal Medical Few-shot Learner","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15189","snapshot_observed_at":"2026-08-07T04:42:02.665674Z","title":"Med-Flamingo: a Multimodal Medical Few-shot Learner.arXiv, July 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.665674Z"},"links":{"cited_paper":"/paper/2307.15189","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:27a59fe412f924711fc0abf75fd92b6f38219a39978167bb811a0418e34f6183","observation_id":"2f0cbe2a-c590-420f-9b06-cbd8b6b11149","resolution":{"observed_at":"2026-08-07T04:42:02.665674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:42:02.668362Z","title":"GPT-4 Technical Report.arXiv, March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.668362Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:f101c2eca1f5ee187deaf9ca9f7c6a8392967a30b796c3593f59833e8fc88c7a","observation_id":"27c44666-2662-4c50-8ac3-b0c032f09de0","resolution":{"observed_at":"2026-08-07T04:42:02.668362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.671397Z","title":"Chaudhari, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.671397Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d7e2abedd897eb6bebc35fa6f12b0cd14a2b86447e36a36866f59dfba51f6662","observation_id":"63bbee4d-3107-4a92-94b2-4d782acf47e3","resolution":{"observed_at":"2026-08-07T04:42:02.671397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.673870Z","title":"BLEU: a method for automatic evaluation of ma- chine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.673870Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:fcbddea609558fe0cfb40438c1b90071f13441ce4705d63fbe14162cbde6586d","observation_id":"de414271-f059-4fcd-86d9-dd21f162ea55","resolution":{"observed_at":"2026-08-07T04:42:02.673870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.228724Z","title":"chrF: character n-gram F-score for automatic MT evaluation.ACL Anthology, pages 392–395, September","venue":null,"work_id":"0201780f-b631-4a24-9d75-2aa92830272e","year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.676750Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:1e73d3b50266be94b009dbe6dedbd33541a044b8eda49f79003baa78a8dca966","observation_id":"c9f0e415-519b-4534-b083-ff7561b001d0","resolution":{"observed_at":"2026-08-07T04:42:04.314693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-07T04:42:02.682342Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models.arXiv, October 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.682342Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:0639660cd9be70d32cb7eb3e338559cb31c6f665a9442836b6e1ee76a49af0f4","observation_id":"71e43144-29fe-42b6-bee7-f243b85df2ec","resolution":{"observed_at":"2026-08-07T04:42:02.682342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00084","last_updated":"2024-09-04T08:22:28Z","snapshot_observed_at":"2026-08-13T14:19:09.832396Z","submitted_at":"2024-08-25T14:50:47Z","title":"Vision-Language and Large Language Model Performance in Gastroenterology: GPT, Claude, Llama, Phi, Mistral, Gemma, and Quantized Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00084","snapshot_observed_at":"2026-08-07T04:42:02.685440Z","title":"Samaan, Reem Al Shabeeb, Farah Ladak, Jamie O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.685440Z"},"links":{"cited_paper":"/paper/2409.00084","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:f312e240e61dcd8517fc3520c06d79fcef2352d3378cb4cd98be9a452f9e3a5e","observation_id":"12a40f5f-3c5e-486e-86aa-fae06d9bfec2","resolution":{"observed_at":"2026-08-07T04:42:02.685440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-18T19:40:05.706404Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:42:02.689211Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.689211Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:f88309f300c0e325a4b86c6166bbcdc2482eee325f0b3fc07ed19125ab2d2528","observation_id":"3d5da4d0-b840-4da3-a59f-969e4b5f2476","resolution":{"observed_at":"2026-08-07T04:42:02.689211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.692791Z","title":"Pfohl, Heather Cole-Lewis, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.692791Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:fb6e7ea16596c417b085e68a5835942f4422a8bd0bc6948859333eb1e3128936","observation_id":"24d49581-6a9f-44fb-848d-238a30735c5b","resolution":{"observed_at":"2026-08-07T04:42:02.692791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T04:42:02.695513Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.695513Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:0a2b1ae84f43641712519f8c3cd2b8fc0a4d8f6f1b8310e8c426c9d93a9a6605","observation_id":"c7b19ffe-ac7f-4563-9322-33b9c37baa25","resolution":{"observed_at":"2026-08-07T04:42:02.695513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.698427Z","title":"Sanders, Yuchen Liu, Kennarey Seang, Bach Xuan Tran, Atanas G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.698427Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:e248a38f3fc32bf845da3441c0c164f83cacd27e8e73730b882010d1ae478857","observation_id":"ea035ea9-0fd3-475e-bb1f-20b208f33a15","resolution":{"observed_at":"2026-08-07T04:42:02.698427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.701389Z","title":"Wilkinson, Michel Dumontier, IJsbrand Jan Aalbersberg, Gabrielle Appleton, Myles Axton, Arie Baak, Niklas Blomberg, Jan-Willem Boiten, Luiz Bonino da Silva Santos, Philip E","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.701389Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:1b62fd513f7273c9307cc209e627fa4edb889491e2c3bd905c5e15608244d49e","observation_id":"61c26755-4ced-440d-9ee4-61af9d046faf","resolution":{"observed_at":"2026-08-07T04:42:02.701389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.078187Z","title":null,"venue":null,"work_id":"8b0c39b6-1b54-41a8-a211-4b186ece9938","year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.704076Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d6218d7c8be8c646d95a56a4160cd851e36f28cc4bbf24b09fcac277d15df937","observation_id":"fab20e9a-a383-49f6-9eb6-f9752df995cf","resolution":{"observed_at":"2026-08-07T04:42:04.164751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12148","last_updated":"2023-12-19T13:31:24Z","snapshot_observed_at":"2026-08-16T14:33:23.059607Z","submitted_at":"2023-12-19T13:31:24Z","title":"Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12148","snapshot_observed_at":"2026-08-07T04:42:02.706457Z","title":"Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment.arXiv, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.706457Z"},"links":{"cited_paper":"/paper/2312.12148","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c3267791dbe5698b910f04234236c0cee2ba4c649452fb271babfc8f80db6714","observation_id":"e22cee96-9e5c-420f-825a-ebdb89da6b06","resolution":{"observed_at":"2026-08-07T04:42:02.706457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.16964","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning.arXiv, May 2025","venue":"arXiv (Cornell University)","work_id":"a3283ec3-d492-4bb0-9d35-05463bafc699","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.709606Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:9aa8864eaf4b582f9420f591f39aec7c8f23f5feb86b49803c9a994810d27107","observation_id":"ede2d0b1-2c9f-4fa3-b54b-9e6713528d75","resolution":{"observed_at":"2026-08-07T04:42:02.854127Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.712182Z","title":"Fine-grained Adaptive Visual Prompt for Generative Medical Visual Question Answering.AAAI, 39(9):9662–9670, April 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.712182Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:501b9f7b1cfeb848e65b59496f2c68b7144d172ea5bdb5c644cb0e40f74b9580","observation_id":"f5190ec1-fb2e-44d6-8a72-8eb1b5c4be42","resolution":{"observed_at":"2026-08-07T04:42:02.712182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:03.962971Z","title":"Medical Visual Question Answering via Conditional Reasoning","venue":null,"work_id":"84c5e2f7-142d-4dfa-90c9-0672f37e21bf","year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.715622Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c4716f566144043d05285acac8576502f72b1a1f97aa856c6acca917cd39fbd6","observation_id":"5f569dee-710c-4b5a-8fbc-8f61c8bd0d7e","resolution":{"observed_at":"2026-08-07T04:42:04.013804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T04:42:02.720800Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.720800Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:60460b3c77afebe25460a2e6c8a45643a366be445ca1cab491e0f51574758ff8","observation_id":"9685044a-1a2a-4a01-b705-e61c3f63213f","resolution":{"observed_at":"2026-08-07T04:42:02.720800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-08-15T13:17:09.334808Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-07T04:42:02.723789Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering.arXiv, May 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.723789Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:20c8f3712f5031a46be245d332ba3b0c194ee77de06ea1c3187485ffcc17e2fe","observation_id":"fb0332a3-b5c3-4810-82d8-acbe4ada430d","resolution":{"observed_at":"2026-08-07T04:42:02.723789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05517","last_updated":"2025-05-19T06:50:53Z","snapshot_observed_at":"2026-08-18T09:53:00.616100Z","submitted_at":"2024-08-10T11:00:13Z","title":"SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05517","snapshot_observed_at":"2026-08-07T04:42:02.726920Z","title":"Swift:a scalable lightweight infrastructure for fine-tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.726920Z"},"links":{"cited_paper":"/paper/2408.05517","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d6213c43c2c1c8ee3c447efb0511434d3da3e1aba35a32fa8b1c7507aea52de0","observation_id":"24983bd3-10c5-4138-8d99-7ff0ad5ad655","resolution":{"observed_at":"2026-08-07T04:42:02.726920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.679485Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.679485Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:27462c5c0ff754a87455bdf7337bc2101f50dec0e5fc7ab4255a025c9030146d","observation_id":"9973781f-b476-41fa-82b6-60c86ed56032","resolution":{"observed_at":"2026-08-07T04:42:02.679485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.718367Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.718367Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:cb3e7d3c719fb6a785831bdff57609d9b7c23480fd2dcae9d7f07a2c2ba8f407","observation_id":"7fd676bb-74cc-4ad6-8035-32ac396b560a","resolution":{"observed_at":"2026-08-07T04:42:02.718367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":42,"verified_exact":4,"verified_fuzzy":5},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 3 inbound Pith citation observations for arXiv:2506.09958."}