{"as_of":"2026-08-10T19:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:889a8012f21c2a77fe5063709afafe796bf4854599fb365ecfe9a423a43115dc","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:23:34.251478Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14451/citation-record","integrity":"/paper/2506.14451/integrity","json":"/paper/2506.14451/citation-record.json","paper":"/paper/2506.14451"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:40.877781Z","title":"Ai agriculture: Boost yields with yolo11","venue":null,"work_id":"6b2c7a5e-d209-474f-b40c-5714b6c3008f","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:27.265747Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:dac0f5ca72ba78110131dfa5c52428be83bbd001213af8ca62937b9c33290116","observation_id":"ec56a057-e04d-4262-8001-903c35a4029f","resolution":{"observed_at":"2026-08-07T00:23:40.967727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:40.536950Z","title":"Video alarms for 24/7 security & monitoring","venue":null,"work_id":"e9a12633-5ce0-48f6-9475-5ce8fc87d08d","year":2025},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:27.418380Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:dbdc75777ca2723355630df8549a83156295a4d7fe1584c73a9bcf23d08d79b4","observation_id":"c7f06b3d-0d6d-4bca-9e00-731828a23a25","resolution":{"observed_at":"2026-08-07T00:23:40.739764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:40.283975Z","title":"Babydoctor","venue":null,"work_id":"9e138f08-07d4-44e8-9f0e-72df294863e3","year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:27.656722Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:95e47f35804b5ca1d7bb9ba6df3d2cbdb24aced34bc5fad4bb10ca44e6193996","observation_id":"bfa3fdd1-49fd-4511-926c-a17d98f64c3e","resolution":{"observed_at":"2026-08-07T00:23:40.414749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05977","last_updated":"2023-07-21T22:33:49Z","snapshot_observed_at":"2026-08-09T08:25:37.898595Z","submitted_at":"2023-03-10T15:17:22Z","title":"Open-Ended Medical Visual Question Answering Through Prefix Tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05977","snapshot_observed_at":"2026-08-07T00:23:27.807414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:27.807414Z"},"links":{"cited_paper":"/paper/2303.05977","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:513a96afa9b04e68090a46b04f10b8cb5ae3b9d29a52cd7aaab489647177bbea","observation_id":"7f9771bc-cce5-4c08-b089-e7182919ab72","resolution":{"observed_at":"2026-08-07T00:23:27.807414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:27.948216Z","title":"Large language models encode clinical knowledge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:27.948216Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:6fecd66b5bb180763c072d286dd36c032134f697f7092f02713f421e513ec0f3","observation_id":"4539574b-bd30-4d18-b4d9-921ead02e053","resolution":{"observed_at":"2026-08-07T00:23:27.948216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-07T00:23:28.089245Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.089245Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:db530cc6b0e7d257b6bd0939c06ffd2e860effbed4fbca958c8c0779abb21a70","observation_id":"f54cbccb-7601-4b8d-8582-8583470fb906","resolution":{"observed_at":"2026-08-07T00:23:28.089245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:28.220965Z","title":"All you may need for VQA are image captions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.220965Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:e012512898d2603c5415ad93108b675ff89c68c8471ea802f5892f1e860581e5","observation_id":"fe28cd94-c7d3-457b-922f-f142786229b3","resolution":{"observed_at":"2026-08-07T00:23:28.220965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.04372","last_updated":"2022-09-09T16:11:11Z","snapshot_observed_at":"2026-08-06T22:59:36.269223Z","submitted_at":"2022-09-09T16:11:11Z","title":"Pre-training image-language transformers for open-vocabulary tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.04372","snapshot_observed_at":"2026-08-07T00:23:28.371503Z","title":"Pre-training image-language transform- ers for open-vocabulary tasks, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.371503Z"},"links":{"cited_paper":"/paper/2209.04372","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:21f78432b04cf2bfe7d34f49de62fd3e319f44dceff40f9bbfbe61d3e70eabbc","observation_id":"d1162de9-890e-4f20-a76d-1880e20ce34c","resolution":{"observed_at":"2026-08-07T00:23:28.371503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-07T00:23:28.513170Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.513170Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:c586e10f118cc55902a9fccf8f1ea6ee7909c53d0c54496a7194b3659a267365","observation_id":"4000eada-f398-4613-9ea6-deae126fac19","resolution":{"observed_at":"2026-08-07T00:23:28.513170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T00:23:28.620385Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.620385Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:09a2e5208cabf44669004155141aed42d5462b64008bfbac2fd7916482e8033e","observation_id":"a9fa2a7e-21b0-410a-b5aa-2ee7e433f06f","resolution":{"observed_at":"2026-08-07T00:23:28.620385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09542","last_updated":"2021-02-18T18:44:50Z","snapshot_observed_at":"2026-08-10T19:28:21.235368Z","submitted_at":"2021-02-18T18:44:50Z","title":"SLAKE: A Semantically-Labeled Knowledge-Enhanced Dataset for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09542","snapshot_observed_at":"2026-08-07T00:23:28.726343Z","title":"Slake: A semantically- labeled knowledge-enhanced dataset for medical visual question answering, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.726343Z"},"links":{"cited_paper":"/paper/2102.09542","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:5f4a0ae9a2a200b6060d5fa20a37cda4b4c890ae51f2fc47a7f5580621631279","observation_id":"30253ec1-9cae-49de-a3d9-70dd616e2b02","resolution":{"observed_at":"2026-08-07T00:23:28.726343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:40.041841Z","title":"Pmc-vqa dataset, 2023","venue":null,"work_id":"cd3cadd4-c30e-42ee-87ce-a20dc8222803","year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:28.888678Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:e8734daf59621d143278f4d3c420b04711f42051c5a728402053accb064f2d24","observation_id":"1bcf2d61-6aa5-4f61-b3bd-31817e2745d0","resolution":{"observed_at":"2026-08-07T00:23:40.164049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:39.841520Z","title":"Friedrich","venue":null,"work_id":"0d9eb60c-720d-4aee-8cac-d837893cdd73","year":2018},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.062397Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:1e84b57c10741a731a651ad622edbed46ad51ed47d9243b3962aa004202e5edc","observation_id":"3e7782c8-cf99-42e5-8da6-7863d4c2895d","resolution":{"observed_at":"2026-08-07T00:23:39.927335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:39.633117Z","title":"Medpix 2.0: A comprehensive multimodal biomedical dataset for advanced ai applications,","venue":null,"work_id":"e9cfe1bd-b4c3-4e26-94a3-c5ea7b22287e","year":null},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.278258Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:26c243eea2aa6d814311d29300c01188c02e024c570c2470bfb8b8c07488946d","observation_id":"5b8dd4e6-d4df-453e-92b9-fb8b6674edfd","resolution":{"observed_at":"2026-08-07T00:23:39.719471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-07T00:23:29.522542Z","title":"Pmc-vqa: Visual instruction tuning for medical visual question answering, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.522542Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:65488ca28261f581cc0c8aa5cb199968a8f99decafdd0b1c704773791b244102","observation_id":"e4d07c8a-2724-44c8-9b77-9cbe7892e121","resolution":{"observed_at":"2026-08-07T00:23:29.522542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:39.417444Z","title":"ChatGPT: A Large Language Model","venue":null,"work_id":"a11ac7b0-860a-4749-a754-af7f408a55d2","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.686173Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:beb7953cdc2cd9604b03c96ea5fad72bf79b37e5ff520833af423072872cc4c7","observation_id":"a09c52bf-c3ae-4769-837f-400ce84440a6","resolution":{"observed_at":"2026-08-07T00:23:39.521645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:39.165993Z","title":"Healthsearchqa","venue":null,"work_id":"1dce7105-2417-4e8c-8aef-fa19ab1cbd30","year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.811893Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:72bbf0708932c7a2c4d8d1abd11e4ea05542d919091fdfb10a4b9bbdec466326","observation_id":"cc9fb1ab-c5b9-41ee-b940-03cbe2c3cd8a","resolution":{"observed_at":"2026-08-07T00:23:39.299179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-07T00:23:29.950617Z","title":"Chi, Jeff Dean, Jacob Devlin, Adam Roberts, Denny Zhou, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.950617Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:2a43c09b4ac5b716facb0af203da2e5f9036d777b52215919f89f6373edb3819","observation_id":"57de0cb8-6f11-42f4-9d75-99494a06c8e8","resolution":{"observed_at":"2026-08-07T00:23:29.950617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:38.833621Z","title":"PubMed Central (PMC), 2024","venue":null,"work_id":"bdfc7dfb-5469-4ccd-9ff6-6a426625d64e","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.128714Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:4ea57f09bc7d08b86d8806f9db333fdfad967fc03d9ed922958f3b3cd02a89c0","observation_id":"b8c58e19-c26b-4cbf-bcfe-f0b155d32171","resolution":{"observed_at":"2026-08-07T00:23:38.989774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:38.485108Z","title":"Nvidia a100 tensor core gpu, 2020","venue":null,"work_id":"17688cef-cdb8-4132-a4fa-743d497486bb","year":2020},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.319813Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:a687cf959d4639415cd593109f95dd1e92e83d6f7cd732ae00b62eeecb53b61d","observation_id":"4fa5e36c-643f-4338-92e0-8ee30e3622c7","resolution":{"observed_at":"2026-08-07T00:23:38.646705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T00:23:30.450629Z","title":"Llama: Open and efficient foundation language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.450629Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:91de9211c36dcff9c9babb35198cba04f3348c949f160c64f22d27f2ada63e9e","observation_id":"831b2eae-40e2-4858-ba9b-ecc6360b60ed","resolution":{"observed_at":"2026-08-07T00:23:30.450629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:38.180986Z","title":"Hewett, Jamie Huynh, Mojan Javaheripi, Xin Jin, Piero Kauffmann, Nikos Karampatziakis, Dongwoo Kim, Mahmoud Khademi, Lev Kurilenko, James R","venue":null,"work_id":"e1d76cfd-8e0f-4030-858e-729459ea9b50","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.594413Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:a7f77b2f7f597f8ecb23797c752d06233cdcefc5bf0a2fa3fbf967fc4041e6b7","observation_id":"3ac30739-9eba-4feb-9db3-532bf6a81145","resolution":{"observed_at":"2026-08-07T00:23:38.318674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:37.794078Z","title":"Show and tell: A neural image caption generator","venue":null,"work_id":"3288aaa1-f8ff-4cc4-a2b9-5a46e53dd0c3","year":2015},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.705884Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:853b9639722d6051e6e5c634e6fe4b8822391e4fac400ddb23d764982b5cfab4","observation_id":"8e293975-e68e-47a1-be04-f74b75299807","resolution":{"observed_at":"2026-08-07T00:23:37.961957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:37.556186Z","title":"Referitgame: Referring to objects in photographs of natural scenes","venue":null,"work_id":"3a4015d0-2232-4fed-b569-6a1f037a8a66","year":2014},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.744779Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:6a1c60c7c1b7b43c34cfe664e2614fefb9c70d39df8a19aca91502c6f5e05811","observation_id":"5b7c4b12-36c4-4440-aa26-94f877dc2130","resolution":{"observed_at":"2026-08-07T00:23:37.666127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:30.809954Z","title":"Conceptual captions: A cleaned, hypernymed, image alt-text dataset for automatic image captioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.809954Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:9acb6f19bddfcb9d2b78edc401e8ddaee95af414afc4204f1e7576db2b9a2dad","observation_id":"c0720076-7434-4d3b-9187-7ab8b2d5bc05","resolution":{"observed_at":"2026-08-07T00:23:30.809954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:30.876388Z","title":"Wit: Wikipedia-based image text dataset for multimodal multilingual machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.876388Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:4ff306449025e15f480f78514b2ce5af80f50467291fe098969c8eb218f68e1d","observation_id":"bbbce065-2314-4c16-9136-1ed86bdef1c8","resolution":{"observed_at":"2026-08-07T00:23:30.876388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-07T00:23:30.994202Z","title":"Sigmoid loss for language image pre-training, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:30.994202Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:86e5c14038d0339bfa693c44a4258dd31901f5996ceb541fea4685301da58906","observation_id":"e1978bb5-3fc9-45e6-af55-31c7f0705918","resolution":{"observed_at":"2026-08-07T00:23:30.994202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06226","last_updated":"2018-08-19T16:49:06Z","snapshot_observed_at":"2026-07-06T06:56:20.935388Z","submitted_at":"2018-08-19T16:49:06Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.06226","snapshot_observed_at":"2026-08-07T00:23:31.138731Z","title":"Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural text processing, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.138731Z"},"links":{"cited_paper":"/paper/1808.06226","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:379e1eb60f4686044a14319d0126a9ef5dc680f774408f166061540f4ba09769","observation_id":"33b1f385-4617-4822-b532-f7b89672dace","resolution":{"observed_at":"2026-08-07T00:23:31.138731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T00:23:31.335216Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.335216Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:f41834011ef53b3f686337f0a3059f5ce0f1bdadf14f66fa06617fa4ca29d076","observation_id":"e61a3d70-704c-4738-a674-5cf794f2ea23","resolution":{"observed_at":"2026-08-07T00:23:31.335216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:31.482403Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.482403Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:9b71934aa134828d03d676270428f1230e3c273d4a63b48f18877635505eedc2","observation_id":"289501d2-eec9-4c8c-9733-645b9a3e14fb","resolution":{"observed_at":"2026-08-07T00:23:31.482403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03118","last_updated":"2024-06-24T22:45:20Z","snapshot_observed_at":"2026-07-06T17:55:24.972926Z","submitted_at":"2024-04-03T23:57:34Z","title":"LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03118","snapshot_observed_at":"2026-08-07T00:23:31.623245Z","title":"Lvlm-interpret: An interpretability tool for large vision-language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.623245Z"},"links":{"cited_paper":"/paper/2404.03118","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:85a1fa06e86b92302f168c71852234f529f2da4a9996820e8b04d7112ca42573","observation_id":"5e4f2de0-b97d-40f0-980b-4e688a2f2045","resolution":{"observed_at":"2026-08-07T00:23:31.623245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:37.125682Z","title":"Searching for unintended biases with saliency","venue":null,"work_id":"46db2bfe-d84f-474c-96a8-f89a081093d4","year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.772560Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:cdc5a80b013a5ef16e9c8e9a5ffa8ad61008819adb6a78a7232d37691c5a2326","observation_id":"93204a6e-e295-487d-a9b2-c0c4d5cdc31d","resolution":{"observed_at":"2026-08-07T00:23:37.379690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T00:23:31.949289Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:31.949289Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:42aa61d7cdb803835dc3487c1a58469a890d07904430f2252bdc16766aa3ba33","observation_id":"ae0d4fd1-efac-4eaf-9544-ae9fb747d88d","resolution":{"observed_at":"2026-08-07T00:23:31.949289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:32.128508Z","title":"Transformer interpretability beyond attention visualization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.128508Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:66b30115c89e0a3e8b758dab84e5df50df2745f164de6b2f594418140bdf1ca9","observation_id":"f63b4285-b633-469b-ad53-2207b4205ba5","resolution":{"observed_at":"2026-08-07T00:23:32.128508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:36.711253Z","title":"Explainability for vision transformers","venue":null,"work_id":"7f6f5c23-93a8-46f2-8ca1-6a473a9ed828","year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.290834Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:bff6b5b353cfb758b79028dc5b262f527f80f185cf6443e45ddf059a38d92659","observation_id":"59422169-b181-46bf-9803-d3861e16fe34","resolution":{"observed_at":"2026-08-07T00:23:36.907413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:36.450821Z","title":"MedPix: Free Online Medical Image Database","venue":null,"work_id":"5ee89f25-49a7-4d79-85ad-5d7f968a413b","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.496897Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:cefd7e2b321df31d0744081719a6e773d19f6f456b6a3dc3f1f7cd8419cecb42","observation_id":"655eca3d-cd21-4dd0-8210-4857c8648b83","resolution":{"observed_at":"2026-08-07T00:23:36.596688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:36.125041Z","title":"Lin et al","venue":null,"work_id":"f9a83b51-e36f-4c83-8a4b-dadb79bcee2d","year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.680380Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:c7277323f796459f5b3ab9781fb5da809f70a4f4a9d9bcb3cbaa8afae02ce15f","observation_id":"4f00ec0a-4b42-47a9-a2ad-f5eba5034d95","resolution":{"observed_at":"2026-08-07T00:23:36.292038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06594","last_updated":"2023-03-12T07:22:08Z","snapshot_observed_at":"2026-08-10T09:51:58.628373Z","submitted_at":"2023-03-12T07:22:08Z","title":"ChatGPT Asks, BLIP-2 Answers: Automatic Questioning Towards Enriched Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06594","snapshot_observed_at":"2026-08-07T00:23:32.836660Z","title":"Chatgpt asks, blip-2 answers: Automatic questioning towards enriched visual descriptions, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.836660Z"},"links":{"cited_paper":"/paper/2303.06594","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:b4482324a90f50bd07cc59a0506f6a7159f2b33348255c509940f8d69120fe70","observation_id":"7d012bea-a758-4e5b-b7e6-288bc1cba0b5","resolution":{"observed_at":"2026-08-07T00:23:32.836660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T00:23:32.995157Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:32.995157Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:0d6f06f999b0feb13450ada8b6fe5c66f66010ff6b6eea784c6bb52021d5e0ed","observation_id":"32ec1b1e-398d-44fd-be06-9ef775484672","resolution":{"observed_at":"2026-08-07T00:23:32.995157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:23:33.203526Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:33.203526Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:f25a2cc3d8dff5e02a4e6c66ac564b2a295dbdaed3a116d3cbfb914b513f1e92","observation_id":"0954788b-bf76-486d-9c5d-b306f716040b","resolution":{"observed_at":"2026-08-07T00:23:33.203526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:33.397044Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:33.397044Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:9baa1a7bca4e670add4f95a0fd4ba0885abd66e882712a31e4d477b2c48b456a","observation_id":"a16d0374-6607-4850-be23-ffa3b0545237","resolution":{"observed_at":"2026-08-07T00:23:33.397044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14525","last_updated":"2022-07-29T07:45:56Z","snapshot_observed_at":"2026-07-06T13:36:37.251739Z","submitted_at":"2022-07-29T07:45:56Z","title":"Curriculum Learning for Data-Efficient Vision-Language Alignment","version":1},"cited_work":{"arxiv_id":"2207.14525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.14525","snapshot_observed_at":"2026-08-07T00:23:34.532788Z","title":"Curriculum Learning for Data-Efficient Vision-Language Alignment","venue":"cs.CV","work_id":"28c83799-cb80-4261-baa6-fd0f0cb58723","year":2022},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:33.591624Z"},"links":{"cited_paper":"/paper/2207.14525","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:62ca91009e06687e80afcc62dac7b4ee0b2f7b1c93ac88d13248c7dea66524e8","observation_id":"718c9b81-d977-480c-9672-755c7693d463","resolution":{"observed_at":"2026-08-07T00:23:34.651542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:35.837627Z","title":"PMC Open Access Subset","venue":null,"work_id":"46b8bf36-d34d-421a-a776-c7c72b2578ba","year":2003},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:33.694606Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:fe720290357d423123b1ac91fdabc1670b932275d77bc023299602caf72ea5c2","observation_id":"42a278dc-d580-42c9-bf0c-bc8caf2d22ae","resolution":{"observed_at":"2026-08-07T00:23:35.960620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:35.486797Z","title":"When scaling meets llm finetuning: The effect of data, model and finetuning method","venue":null,"work_id":"c8804f58-b1d6-420a-81fe-9bc9dec2d322","year":2024},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:33.873751Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:2a5ccbc85daaa78f4db5653a60ef7919533884b079185be2560579ac599715bc","observation_id":"c7ff8832-b00c-4283-9c0c-11f6eaa9d962","resolution":{"observed_at":"2026-08-07T00:23:35.673139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.07042","last_updated":"2019-11-14T17:34:51Z","snapshot_observed_at":"2026-08-02T04:11:08.699777Z","submitted_at":"2019-01-21T19:01:00Z","title":"MIMIC-CXR-JPG, a large publicly available database of labeled chest radiographs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.07042","snapshot_observed_at":"2026-08-07T00:23:34.021746Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:34.021746Z"},"links":{"cited_paper":"/paper/1901.07042","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:7b38e8605d833df072aeb7470bed0fcfd539178997dd3685273e1ae9f64f5881","observation_id":"3e3b4cb3-70d0-4fbc-abcf-c88da8af3805","resolution":{"observed_at":"2026-08-07T00:23:34.021746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:34.151279Z","title":"Bleu: A method for auto- matic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:34.151279Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:2beb369c0d20ec0a1b2d852e487ccd39f638376ce0147daf0f2e9d3b5c487419","observation_id":"f4476fcd-a708-45f0-a359-2255ac72e2d7","resolution":{"observed_at":"2026-08-07T00:23:34.151279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:23:35.213580Z","title":"\"\" Figure 9: Generate Literature Based Questions Prompt B Evaluation and Saliency Diagnostics def evaluate_generation(generation,ground): prompt = f","venue":null,"work_id":"5b33a100-c5e4-43bb-9efb-a58baff68c7c","year":2004},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:34.251478Z"},"links":{"citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:61ca8d15b5a9481ea76971d73ee70a5ab1876b91c249f57cb1fc10461ed3c408","observation_id":"ff2e4bf9-dcfe-475b-9459-33bef2cb4f91","resolution":{"observed_at":"2026-08-07T00:23:35.265017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02994","last_updated":"2025-07-17T12:30:16Z","snapshot_observed_at":"2026-07-06T18:40:52.966572Z","submitted_at":"2024-07-03T10:49:21Z","title":"MedPix 2.0: A Comprehensive Multimodal Biomedical Data set for Advanced AI Applications with Retrieval Augmented Generation and Knowledge Graphs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02994","snapshot_observed_at":"2026-08-07T00:23:29.392852Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:29.392852Z"},"links":{"cited_paper":"/paper/2407.02994","citing_paper":"/paper/2506.14451"},"observation_digest":"sha256:4d48656bb015763a71768096ff6a50cf38264ba02f824b2aa89d72428a1bb512","observation_id":"86b58f7c-bb01-4536-a29c-4e6bcfd0f61f","resolution":{"observed_at":"2026-08-07T00:23:29.392852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.14451","last_updated":"2025-06-17T12:15:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T04:05:04.805112Z","submitted_at":"2025-06-17T12:15:08Z","title":"Adapting Lightweight Vision Language Models for Radiological Visual Question Answering"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2506.14451."}