{"as_of":"2026-08-15T12:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:152a413f92d6ce047511641ec4b61313831069093fde727aeb917411d8f6b3f1","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:57:22.751107Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T19:39:46.922877Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T23:24:01.588708Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"cited_work":{"arxiv_id":"2506.06600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06600","snapshot_observed_at":"2026-06-29T23:24:01.588708Z","title":null,"venue":null,"work_id":"ecf6cccd-4f04-4f58-a415-743a16591c37","year":2025},"citing_paper":{"arxiv_id":"2605.25273","last_updated":"2026-05-24T21:59:32Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-24T21:59:32Z","title":"LLM-as-a-Judge in Healthcare: A Scoping Analysis of Applications, Methods, and Human Alignment","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-06-29T23:18:59.283834Z"},"links":{"cited_paper":"/paper/2506.06600","citing_paper":"/paper/2605.25273"},"observation_digest":"sha256:79524bfc6d55d207ae8397ceb23bf05e6c33a93e32d7ee6f95bd277f2b471bb2","observation_id":"a7916707-232e-4e32-99ff-9c13587ee46b","resolution":{"observed_at":"2026-06-29T23:24:01.590061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06600","snapshot_observed_at":"2026-07-12T19:39:46.922877Z","title":"& Ngo, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05174","last_updated":"2026-04-17T03:08:55Z","snapshot_observed_at":"2026-08-04T02:46:52.030357Z","submitted_at":"2026-04-17T03:08:55Z","title":"Improving Heart-Focused Medical Question Answering in LLMs via Variance-Aware Rubric Rewards with GRPO","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T19:39:46.922877Z"},"links":{"cited_paper":"/paper/2506.06600","citing_paper":"/paper/2606.05174"},"observation_digest":"sha256:a3517973039518005ddda8d19f1e711fe48a33c2f3f20ccf89509518b78e5cac","observation_id":"03ad372f-6803-41f7-bc9d-8f8783da5a6d","resolution":{"observed_at":"2026-07-12T19:39:46.922877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06600/citation-record","integrity":"/paper/2506.06600/integrity","json":"/paper/2506.06600/citation-record.json","paper":"/paper/2506.06600"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T05:57:22.627032Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.627032Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:f6619c6fea0f3ce67eff53be206c3b81f288fd095efc43dd351617cdc7bd1180","observation_id":"c57bfb3f-f07d-4a98-a200-4525fd253797","resolution":{"observed_at":"2026-08-07T05:57:22.627032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:57:22.632278Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.632278Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:5abd238ee186873bdf5de86401922d90c85eb8907f1038c41d2a427d33cac8f0","observation_id":"20461b7d-3f2e-4d9e-96ff-b7c3c5a2d8d5","resolution":{"observed_at":"2026-08-07T05:57:22.632278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T05:57:22.637181Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.637181Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:c3165094526e043c3a3e5b04ca83f399af00a0ee2854c21b83380903f9f89cef","observation_id":"21a63095-f6ba-463f-9676-4a004d5f9353","resolution":{"observed_at":"2026-08-07T05:57:22.637181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:57:22.641263Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.641263Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:a8b38edd2eaf3c4ab74cc27f91a73a3232570d42458852ff330aae4093c0170c","observation_id":"05346d2e-3ece-4cfa-93fd-f83fcabbd77e","resolution":{"observed_at":"2026-08-07T05:57:22.641263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.190015Z","title":"Qwen3, April 2025","venue":null,"work_id":"b49aee4b-afe7-44bd-9b3e-56f81370e23b","year":2025},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.646242Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:d2b4e1c88d9d53d22c36ddd3a68c15485a3d371cfb172e8e80986cdcf4066e92","observation_id":"d355fdae-063a-4c0b-890d-c6dbc462590b","resolution":{"observed_at":"2026-08-07T05:57:23.193547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.178816Z","title":"Visual-language models for medical image analysis: A survey","venue":null,"work_id":"94bcba51-d8c1-4b61-922d-ce7a10a4b37d","year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.650068Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:7dc0ef7f493302cb34446daf25cfe56cbeac4fd411fc3d3f1663834849303abc","observation_id":"a27ca818-e6c9-4536-ba0d-7a5c6713cedd","resolution":{"observed_at":"2026-08-07T05:57:23.182550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.654852Z","title":"Med-flamingo: a multimodal medical few-shot learner","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.654852Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:81b066d5f2695ce565dbc3a6b209ed59e6e05c552753f079a566b6ea0afd82fc","observation_id":"3d146fbb-eb46-4603-916d-570fde5b3fc8","resolution":{"observed_at":"2026-08-07T05:57:22.654852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16994","last_updated":"2024-04-11T03:44:49Z","snapshot_observed_at":"2026-08-13T04:09:42.530944Z","submitted_at":"2024-02-26T20:00:57Z","title":"GEM3D: GEnerative Medial Abstractions for 3D Shape Synthesis","version":2},"cited_work":{"arxiv_id":"2402.16994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16994","snapshot_observed_at":"2026-08-07T05:57:22.978669Z","title":"GEM3D: GEnerative Medial Abstractions for 3D Shape Synthesis","venue":"cs.CV","work_id":"60cdcf19-bffb-4aab-8798-81ca02263225","year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.658151Z"},"links":{"cited_paper":"/paper/2402.16994","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:69ab6b46b0610aa0cae9ecd646d25c3dae0c9e7f94c90b1c5fbf5f69a5d92b16","observation_id":"22fc5508-addf-460e-b57b-05dff12354d4","resolution":{"observed_at":"2026-08-07T05:57:22.982969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-07T05:57:22.662714Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.662714Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:fdec6b1da1120ec94c880186023e33e42452db07fcad0429089a6c5106fc32be","observation_id":"e4811ea2-b637-4362-a90f-f8fe9f73e1ad","resolution":{"observed_at":"2026-08-07T05:57:22.662714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.666851Z","title":"Biomedgpt: A unified and generalist biomedical generative pre-trained transformer for vision, language, and multimodal tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.666851Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:4bc2e539ce5867b2c1f3b4638545d7a7c1d4636e98af823bdd0e7a05b1109e8d","observation_id":"b8a46e70-17ed-4b53-9668-28f92aec6133","resolution":{"observed_at":"2026-08-07T05:57:22.666851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.670308Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.670308Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:6e57f65a2ff18e06284adb10d2f18ebf4de634bef5e73190956f9c9bae411e8d","observation_id":"621c8906-edb3-44d1-83ca-f6fdc282c21e","resolution":{"observed_at":"2026-08-07T05:57:22.670308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.673917Z","title":"Mimic-cxr, a de-identified publicly available database of chest radiographs with free-text reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.673917Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:d1e0d9db1d61652e985b9f6916669bc5533d7195e869152dcf8af3050615a285","observation_id":"48f93aba-269a-4d53-b74d-ce843f717b7f","resolution":{"observed_at":"2026-08-07T05:57:22.673917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07890","last_updated":"2023-12-27T03:36:29Z","snapshot_observed_at":"2026-08-13T11:43:21.605181Z","submitted_at":"2023-05-13T10:27:29Z","title":"Robust Kalman Filters Based on the Sub-Gaussian $\\alpha$-stable Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07890","snapshot_observed_at":"2026-08-07T05:57:22.677585Z","title":"Pmc-15m: A large-scale dataset for medical vision-language pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.677585Z"},"links":{"cited_paper":"/paper/2305.07890","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:b9b001a13583fa7dcaffed91bbf1fa34249de9f8f4105ec518fd4dc881708cbc","observation_id":"1aad558e-94e1-447e-bc96-998d294aecf9","resolution":{"observed_at":"2026-08-07T05:57:22.677585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.137924Z","title":"Artificial intelligence in radiology","venue":null,"work_id":"91494111-2c6d-4c6d-905d-8163f6930936","year":2018},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.681298Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:ed401773287fd4a2a5e52eb9abb8866a781ead43b9858000f2363aca823bde08","observation_id":"fca66905-e254-4a17-a9af-fc70bf6fc588","resolution":{"observed_at":"2026-08-07T05:57:23.142062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T05:57:22.684656Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.684656Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:2194ced1b8c69528b884cd3c5524d61347dac2abb36a69593aa508b1eb134295","observation_id":"6349b17c-70c1-4041-a3ed-97f290a22c00","resolution":{"observed_at":"2026-08-07T05:57:22.684656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.688075Z","title":"Med-r1: Reinforce- ment learning for generalizable medical reasoning in vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.688075Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:8fb50d99fe4ac97a4e2c04e068cd1b2ea7e47a3c45f390028d31a7d2ae4c12e1","observation_id":"eeb376da-144c-4f9e-bf4e-0ecab4f05ec3","resolution":{"observed_at":"2026-08-07T05:57:22.688075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.126153Z","title":"Explainability for artificial intelligence in healthcare: a multidisciplinary perspective","venue":null,"work_id":"1a81ca07-5567-4d03-a48e-8cebceff060c","year":2020},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.691442Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:b0b631584a16b128293ffe8bf8cc174608c56f154b88993a80fa8cadeba7e9ca","observation_id":"d591a105-dcc3-4bbb-b57a-fa8afe9d2838","resolution":{"observed_at":"2026-08-07T05:57:23.130793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.114658Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"32680cc2-68d9-426b-a5f0-f4d1d4960838","year":2022},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.695048Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:235ac2d950491672c93fc7ea7a67abd686d811101a996cb89b229fa26cd0445c","observation_id":"dd1ecbe9-32cb-47c8-b2ae-cec7f1c9e7aa","resolution":{"observed_at":"2026-08-07T05:57:23.118859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13736","last_updated":"2024-12-18T11:14:02Z","snapshot_observed_at":"2026-08-14T01:14:02.224454Z","submitted_at":"2024-12-18T11:14:02Z","title":"MedCoT: Medical Chain of Thought via Hierarchical Expert","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13736","snapshot_observed_at":"2026-08-07T05:57:22.698599Z","title":"Medcot: Medical chain of thought via hierarchical expert","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.698599Z"},"links":{"cited_paper":"/paper/2412.13736","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:ba12fb8add17042660bb69eebf390f0605e01f957b394574f61271f78bb4384d","observation_id":"c2ab2436-87e7-4f78-94c6-47d7493cd9ed","resolution":{"observed_at":"2026-08-07T05:57:22.698599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.100179Z","title":"Silvar-med: A speech-driven visual language model for explainable abnormality detection in medical imaging","venue":null,"work_id":"b693967f-cc40-4178-9ea8-8d60570e61e8","year":2025},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.702267Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:ee2933381079798e03a1c0ea8bcac4f38b9ab7ebf415c138e77afa43908f16b8","observation_id":"b0fc92e6-b2f7-47af-b297-9e93e147bed8","resolution":{"observed_at":"2026-08-07T05:57:23.105655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08912","last_updated":"2024-01-17T01:54:24Z","snapshot_observed_at":"2026-08-13T04:40:58.337745Z","submitted_at":"2024-01-17T01:54:24Z","title":"Two-Stage Estimation and Variance Modeling for Latency-Constrained Variational Quantum Algorithms","version":1},"cited_work":{"arxiv_id":"2401.08912","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08912","snapshot_observed_at":"2026-08-07T05:57:22.839800Z","title":"Two-Stage Estimation and Variance Modeling for Latency-Constrained Variational Quantum Algorithms","venue":"math.OC","work_id":"a4c38a3d-5fa4-4c00-9cd6-cdbb0260b032","year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.706142Z"},"links":{"cited_paper":"/paper/2401.08912","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:3be50e2e11e7325160a9ff1d67044880c12d02517cbc025f737202b2bc08a45d","observation_id":"c1813c07-a182-4df5-af8e-fb5791917559","resolution":{"observed_at":"2026-08-07T05:57:22.845736Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.088703Z","title":"Reinforcement learning for medical image analysis: Current progress and future directions","venue":null,"work_id":"2a67d942-64e4-4d90-a40f-f9ad27fc1920","year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.710524Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:5f0178b2c4524679c62e7d73b0364666589463605ea7040b6546149c35ad46bb","observation_id":"0f22b2dd-101a-4481-9ea9-42dce54c8cf9","resolution":{"observed_at":"2026-08-07T05:57:23.092508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09876","last_updated":"2024-03-14T21:13:38Z","snapshot_observed_at":"2026-08-13T00:53:55.180683Z","submitted_at":"2024-03-14T21:13:38Z","title":"Which shapes can appear in a Curve Shortening Flow Singularity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09876","snapshot_observed_at":"2026-08-07T05:57:22.713892Z","title":"Generalized reward-driven policy optimization for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.713892Z"},"links":{"cited_paper":"/paper/2403.09876","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:ed9c6d6a4464d495eb902c4fb1d94d576ccc1bcb384664c04d5add3c3d06a33c","observation_id":"fe64f8fd-0251-4290-99d3-5e70ee5715fa","resolution":{"observed_at":"2026-08-07T05:57:22.713892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-13T12:45:18.778190Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-07T05:57:22.717492Z","title":"Huatuogpt-vision, towards injecting medical visual knowledge into multimodal llms at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.717492Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:937223203450f5fd2be5a60364c9c08de099f2aa2d038804335098ef40dca71e","observation_id":"a3f3f9be-363b-4006-9834-d829cd011408","resolution":{"observed_at":"2026-08-07T05:57:22.717492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.721052Z","title":"A dataset of clinically generated visual questions and answers about radiology images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.721052Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:2ca0018001f867991dd6392f790942082f4413a12679b618cdbf38c6eccb0647","observation_id":"34f1c314-0099-4ed5-96ae-1d085cc868c4","resolution":{"observed_at":"2026-08-07T05:57:22.721052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09542","last_updated":"2021-02-18T18:44:50Z","snapshot_observed_at":"2026-08-13T20:12:29.285044Z","submitted_at":"2021-02-18T18:44:50Z","title":"SLAKE: A Semantically-Labeled Knowledge-Enhanced Dataset for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09542","snapshot_observed_at":"2026-08-07T05:57:22.724573Z","title":"Slake: A semantically- labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.724573Z"},"links":{"cited_paper":"/paper/2102.09542","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:7af0d1259d867593e443db7235017f73a193086f19c9c4a08bdc681d8ea15701","observation_id":"0758ad61-c5fa-4d6f-b6c8-001ca2c3f319","resolution":{"observed_at":"2026-08-07T05:57:22.724573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.070588Z","title":"Hasan, Vivek V","venue":null,"work_id":"ebc4142e-9cbe-41da-988f-3c266493b5d6","year":2019},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.728235Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:8d7316d7d7d2d1e9378cb365586190c435575de61220e5ce39b19aa2d634db35","observation_id":"8c7b02f2-f134-4049-86c5-81af31d62f94","resolution":{"observed_at":"2026-08-07T05:57:23.074082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:57:22.731580Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.731580Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:b5c5b07e49dd909fffd8f7dba0f4493efce3a1852ecbb88b7baa56aeee044618","observation_id":"c5d2c434-a1a8-4ce4-aaa3-5290bd92de62","resolution":{"observed_at":"2026-08-07T05:57:22.731580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.058999Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":"ec5936fe-f125-4a8d-ac65-d0e0ac4ed73f","year":null},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.735194Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:9b859fe656d5e868a11d9a58721b2aedf3181a16058daed6bbc3c5b632c8f17a","observation_id":"55493f64-ddfc-4e72-b236-94359fc45321","resolution":{"observed_at":"2026-08-07T05:57:23.063149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.742808Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.742808Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:d3283d35ad7157e35bfa3e64ebf78288cde1c798e3c4bcdacad2b9bbcd36681c","observation_id":"cedffaf2-33a3-4aaf-a605-84f17b598694","resolution":{"observed_at":"2026-08-07T05:57:22.742808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:22.747458Z","title":"Cambrian-1: A fully open, vision-centric exploration of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.747458Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:e5049419306a9975b2b2f24e57e8c5880e25ea69c8c956f4a174f5a746907536","observation_id":"d107493a-58e3-434b-8b63-5de0e80d7d93","resolution":{"observed_at":"2026-08-07T05:57:22.747458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-08-14T19:11:11.139675Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-07T05:57:22.751107Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.751107Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:f092e001b5407b0a62f7e87716840c39a91f51c5894a2370eb3ad6fba3d2036d","observation_id":"a1a0afb0-d962-481f-9147-dd3b48a2456a","resolution":{"observed_at":"2026-08-07T05:57:22.751107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:57:23.048164Z","title":null,"venue":null,"work_id":"1301c02e-27fa-48e5-b475-f0eca782c351","year":null},"citing_paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:22.738698Z"},"links":{"citing_paper":"/paper/2506.06600"},"observation_digest":"sha256:026db113bdb3ed72c899bdfdfeda9d5187522ee0ae7c999077105f31fdfb8a77","observation_id":"04006296-ec90-4526-8845-f0df9fa6fb01","resolution":{"observed_at":"2026-08-07T05:57:23.051792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06600","last_updated":"2025-06-14T19:41:30Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T11:49:25.157432Z","submitted_at":"2025-06-07T00:26:23Z","title":"RARL: Improving Medical VLM Reasoning and Generalization with Reinforcement Learning and LoRA under Data and Hardware Constraints"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 2 inbound Pith citation observations for arXiv:2506.06600."}