{"as_of":"2026-08-10T04:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dcceaf59f9322912a7ce94c0df3d2240396387311d8b26560d4a5a5a1006dfff","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:19:47.183398Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T13:30:26.488826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T21:18:59.467672Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"cited_work":{"arxiv_id":"2507.11200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.11200","snapshot_observed_at":"2026-07-03T21:18:59.467672Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study,","venue":null,"work_id":"1790f7a6-bb19-4099-b2bd-ba649bf56526","year":2025},"citing_paper":{"arxiv_id":"2606.20723","last_updated":"2026-07-05T00:08:36Z","snapshot_observed_at":"2026-08-07T20:39:30.702446Z","submitted_at":"2026-06-16T22:33:14Z","title":"Evaluation of Medical Vision Language Models HuluMed and MedGemma, and general purpose chatbots Gemma 3, ChatGPT Plus, and Claude Pro on real previously unseen wound images","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T00:42:29.542446Z"},"links":{"cited_paper":"/paper/2507.11200","citing_paper":"/paper/2606.20723"},"observation_digest":"sha256:bd80f9c86f3a8460f9852358424a6c9cd18ded56611b3ac26ae1e64c415b13df","observation_id":"a4d1559b-01ff-4c57-80ba-495f6bd1e003","resolution":{"observed_at":"2026-07-03T21:18:59.469375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11200","snapshot_observed_at":"2026-07-12T13:30:26.488826Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20723","last_updated":"2026-07-05T00:08:36Z","snapshot_observed_at":"2026-08-07T20:39:30.702446Z","submitted_at":"2026-06-16T22:33:14Z","title":"Evaluation of Medical Vision Language Models HuluMed and MedGemma, and general purpose chatbots Gemma 3, ChatGPT Plus, and Claude Pro on real previously unseen wound images","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T13:30:26.488826Z"},"links":{"cited_paper":"/paper/2507.11200","citing_paper":"/paper/2606.20723"},"observation_digest":"sha256:7c6e71500309d37f5ac08104387dc55c89c32e54b7d4e9d81afb187fc1c48076","observation_id":"0e712b36-152f-4be7-bb8a-d510af778c50","resolution":{"observed_at":"2026-07-12T13:30:26.488826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.11200/citation-record","integrity":"/paper/2507.11200/integrity","json":"/paper/2507.11200/citation-record.json","paper":"/paper/2507.11200"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:19:46.780825Z","title":", \" * write output.state after.block = add.period write","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.780825Z"},"links":{"citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:d848694419a6ef038542253ec535b559a07afb4ba571208224df87a034b03d50","observation_id":"740feadf-96d1-44be-8a17-9966a2751240","resolution":{"observed_at":"2026-08-06T17:19:46.780825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:19:46.808585Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.808585Z"},"links":{"citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:233c8a65dc89b7d1ed7b960ea332b2956f016f36889c3815e49a3e298b4174c7","observation_id":"1d22e2f0-6239-43fb-b5d2-e812226b0145","resolution":{"observed_at":"2026-08-06T17:19:46.808585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T17:19:46.853396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.853396Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:159fcdbe3aeab599f46d51a09e9b1cfecb7e068a3475c8d2a5db82f1a39e72b2","observation_id":"2364e215-df6b-4c97-ad7a-176ea07231e5","resolution":{"observed_at":"2026-08-06T17:19:46.853396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-06T18:57:51.817317Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-06T17:19:46.890585Z","title":"arXiv preprint arXiv:2406.19280 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.890585Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:1493cd2807a7838317f3150f47214b36afe42d62c4a9f3446b8cc3b8a87f2745","observation_id":"faf3aa55-f2f1-43e7-b1d3-3c55f7592289","resolution":{"observed_at":"2026-08-06T17:19:46.890585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-06T17:19:46.982626Z","title":"arXiv preprint arXiv:2502.19634 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.982626Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:f4ccea583c76253ba43bccf396e1896bff26ca6605edf88f82263646092342fc","observation_id":"9c0eb45d-968e-4b77-abab-ae40351bd9f6","resolution":{"observed_at":"2026-08-06T17:19:46.982626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-10T00:26:12.133363Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-08-06T17:19:47.032597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.032597Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:42620edd8d78fbe0d4f867d1185d5846e7f57929ee79aa43656e2221d54fa5cd","observation_id":"46e0d4a7-b639-4306-8547-51f65d2169d2","resolution":{"observed_at":"2026-08-06T17:19:47.032597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11462","last_updated":"2025-06-24T03:27:30Z","snapshot_observed_at":"2026-08-07T15:44:34.694747Z","submitted_at":"2025-05-16T17:16:27Z","title":"Disentangling Reasoning and Knowledge in Medical Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11462","snapshot_observed_at":"2026-08-06T17:19:47.083790Z","title":"arXiv preprint arXiv:2505.11462 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.083790Z"},"links":{"cited_paper":"/paper/2505.11462","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:9273d7ff4479fdef22294e762bd24c6c47cd7a2d4298ce971a4ba77ad2cad7eb","observation_id":"a2fd42b1-9267-40cb-a7c9-dcdd005dd195","resolution":{"observed_at":"2026-08-06T17:19:47.083790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07044","last_updated":"2025-06-13T04:22:02Z","snapshot_observed_at":"2026-07-06T21:38:34.998414Z","submitted_at":"2025-06-08T08:47:30Z","title":"Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07044","snapshot_observed_at":"2026-08-06T17:19:47.183398Z","title":"arXiv preprint arXiv:2506.07044 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.183398Z"},"links":{"cited_paper":"/paper/2506.07044","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:1521f4aeb9f17a64b1fe972d5c1b4e2ff7976524b8dd14cc762ac1b988eb32d6","observation_id":"369e548c-b35f-4172-a194-0dc66d14b44b","resolution":{"observed_at":"2026-08-06T17:19:47.183398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T21:25:23.616174Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 8 of 8 outbound references and 2 inbound Pith citation observations for arXiv:2507.11200."}