{"as_of":"2026-08-10T18:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5805022255197f14192031635901431993ee9fd4811279fd750e77c16a6513e0","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:11:47.567352Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19610/citation-record","integrity":"/paper/2506.19610/integrity","json":"/paper/2506.19610/citation-record.json","paper":"/paper/2506.19610"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.166929Z","title":"Bioengineering10(3), 380 (2023)","venue":null,"work_id":"a9c409f4-21bf-4978-a3c9-05fba9610101","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:44.768365Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:f0b4cf74e5ee7075ac4456c8fde8dc789abb7dcc731c718502306235258a7365","observation_id":"ab56e807-9636-4f1f-981d-6d0a99227a15","resolution":{"observed_at":"2026-08-06T23:11:49.170078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.156660Z","title":null,"venue":null,"work_id":"df8b8472-bf88-4d80-9038-eb7d637c5b8c","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:44.868836Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:0e88193e39ab23fca4f23b5cd3506615b87891e1f002b49756fe2183a2e4d0ac","observation_id":"a6a3105e-3854-465d-a957-c39abe0c93e6","resolution":{"observed_at":"2026-08-06T23:11:49.160172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:45.025910Z","title":"In: Proceedings of CLEF (Conference and Labs of the Evaluation Forum) 2019 Working Notes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.025910Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:5fb00c810a33d5faeb8e4e800af39c52871aea42020fa3a33efabb4fdbca892a","observation_id":"84c6fdfe-414f-4330-af3e-514dda1370df","resolution":{"observed_at":"2026-08-06T23:11:45.025910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.139224Z","title":null,"venue":null,"work_id":"f6e454f7-f4bb-4c2c-988a-2d222c331a35","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.148638Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:0b19ea43da372fff1ee247753bb3e9c0a84c7c5662ed5d0a9111fd4fb22ab83d","observation_id":"c68ae7ef-836f-404b-b4b2-912b239138f2","resolution":{"observed_at":"2026-08-06T23:11:49.142649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.129148Z","title":"In: Proceedings of the 30th ACM Interna- tional Conference on Multimedia","venue":null,"work_id":"88a7729f-2695-44a7-b71f-1653fa84c9ee","year":2022},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.249200Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:6597742638d1f1a987418af8d74a9fb2d5fdaa478c4fe67b9c39ca7d3a40da32","observation_id":"b63ea16b-2ae9-4bde-8a62-abac6fcbf0e0","resolution":{"observed_at":"2026-08-06T23:11:49.132801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.118894Z","title":null,"venue":null,"work_id":"f8a7a9f9-979f-4de2-af86-b5472259337f","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.327589Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:94487eb11cc7b35e561cf9faf097473a57fb6e8832ecf32c016cea4323cf4a10","observation_id":"bd5b26cd-3434-4955-b29e-29e95e6ea24f","resolution":{"observed_at":"2026-08-06T23:11:49.122495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12372","last_updated":"2024-10-07T08:06:13Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:53:19Z","title":"MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12372","snapshot_observed_at":"2026-08-06T23:11:45.441753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.441753Z"},"links":{"cited_paper":"/paper/2404.12372","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:1056c0df55819fb573d1af8fff30b64fb14326125c8893829b4b90dbc807b195","observation_id":"3a035e3b-4228-4493-8483-3955a0358e9c","resolution":{"observed_at":"2026-08-06T23:11:45.441753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.108451Z","title":"In: Proceedings of the 2021 International Conference on Multimedia Retrieval","venue":null,"work_id":"aa6ba820-42a5-4f6b-8a96-d92d628820c7","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.507395Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:7efdaa9f623ace140d0cb9c0768446a15483fff7a8c5845ad60f582bb23d931f","observation_id":"583f5383-bba9-4dc3-8ab2-e580f165b55b","resolution":{"observed_at":"2026-08-06T23:11:49.112114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.097923Z","title":null,"venue":null,"work_id":"593f838a-0109-4636-bf14-53d11faf6d5c","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.553423Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:746bfcaabe1249aa32b3a5ab19dbf6b890a39aa570ff9d82b6e7b12c6cf2d728","observation_id":"7f1c79f9-f699-45fe-ab6b-281d42a87bb6","resolution":{"observed_at":"2026-08-06T23:11:49.101468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02797","last_updated":"2025-01-16T02:31:20Z","snapshot_observed_at":"2026-07-06T17:11:58.725249Z","submitted_at":"2024-01-05T13:22:12Z","title":"PeFoMed: Parameter Efficient Fine-tuning of Multimodal Large Language Models for Medical Imaging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02797","snapshot_observed_at":"2026-08-06T23:11:45.618607Z","title":"arXiv preprint arXiv:2401.02797 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.618607Z"},"links":{"cited_paper":"/paper/2401.02797","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:e39cfa0c78f3e8679608c2b446820488a408a54b98df51364693ee23575896fa","observation_id":"af359957-d2aa-45cc-be68-3ad557b436f3","resolution":{"observed_at":"2026-08-06T23:11:45.618607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-06T23:11:45.674583Z","title":"arXiv preprint arXiv:2003.10286 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.674583Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:7391bdace990de0a1a7737447fb21d2e667de38802a5427e492c99cd1f827e59","observation_id":"c1e378e8-b54f-4da4-a4c8-fdc492abbda2","resolution":{"observed_at":"2026-08-06T23:11:45.674583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12849","last_updated":"2025-06-15T13:42:46Z","snapshot_observed_at":"2026-08-07T00:34:09.105878Z","submitted_at":"2025-06-15T13:42:46Z","title":"CAPO: Reinforcing Consistent Reasoning in Medical Decision-Making","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12849","snapshot_observed_at":"2026-08-06T23:11:45.745150Z","title":"arXiv preprint arXiv:2506.12849 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.745150Z"},"links":{"cited_paper":"/paper/2506.12849","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:bbd073a87cb602900c9ba2709243106c1f662818ee6150532795060927ef8c40","observation_id":"ac4bee25-5ee2-430f-a2cf-f2470ebc54a0","resolution":{"observed_at":"2026-08-06T23:11:45.745150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14692","last_updated":"2025-04-20T17:53:56Z","snapshot_observed_at":"2026-08-07T16:00:45.181263Z","submitted_at":"2025-04-20T17:53:56Z","title":"OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14692","snapshot_observed_at":"2026-08-06T23:11:45.867138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.867138Z"},"links":{"cited_paper":"/paper/2504.14692","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:f1c6ae593f4e339bf3f75c924b2042cbd667a27eb11c36a3489a541b15db187f","observation_id":"2d9ee975-fa18-4d4f-be38-500cc7621c67","resolution":{"observed_at":"2026-08-06T23:11:45.867138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15334","last_updated":"2025-06-06T02:50:17Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T08:56:52Z","title":"Modality-Fair Preference Optimization for Trustworthy MLLM Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15334","snapshot_observed_at":"2026-08-06T23:11:45.902077Z","title":"arXiv preprint arXiv:2410.15334 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.902077Z"},"links":{"cited_paper":"/paper/2410.15334","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:aa633113c84f96ff583d30ea185401c2df483fdf0c64aaa7a30adf71f16b16da","observation_id":"6aff2449-e255-4017-98b9-686c20e5728c","resolution":{"observed_at":"2026-08-06T23:11:45.902077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00805","last_updated":"2025-06-01T03:11:00Z","snapshot_observed_at":"2026-08-10T17:40:40.575154Z","submitted_at":"2025-06-01T03:11:00Z","title":"HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00805","snapshot_observed_at":"2026-08-06T23:11:45.967272Z","title":"arXiv preprint arXiv:2506.00805 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.967272Z"},"links":{"cited_paper":"/paper/2506.00805","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:8cee687a782487da135d99eb802b8e4d55d4844e5ed7c50a2acaa91f4fca706e","observation_id":"05ccbcef-1e70-4497-beca-28d787d1beef","resolution":{"observed_at":"2026-08-06T23:11:45.967272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04514","last_updated":"2024-04-06T05:59:02Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T05:59:02Z","title":"Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04514","snapshot_observed_at":"2026-08-06T23:11:46.047700Z","title":"arXiv preprint arXiv:2404.04514 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.047700Z"},"links":{"cited_paper":"/paper/2404.04514","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:b7ddb0d5a842d9e7fdbb0e3ccba135d90944920b646c6591c8c703d0e9878f5d","observation_id":"a1ad24e4-5e56-4f70-b626-6dd19f423b2c","resolution":{"observed_at":"2026-08-06T23:11:46.047700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.129278Z","title":"In: Find- ingsoftheAssociationforComputationalLinguistics:EMNLP2024.pp.3843–3860 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.129278Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:2103ce64a0c8eb729552ba8a88c3f09247f27bd82d7e12fbfb89d85412bfa41d","observation_id":"36c18eee-4a13-49c9-928b-81b84b7c3ca5","resolution":{"observed_at":"2026-08-06T23:11:46.129278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.081661Z","title":"In: 2021 IEEE 18th International Symposium on Biomedical Imaging","venue":null,"work_id":"a8fa9967-2185-4697-b3a9-9753d6cd96fd","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.217100Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:4e52ceff9a6b634a556d5db97e5394eb21675f29eb77be884713538f39eeedf5","observation_id":"41723efb-3d81-4335-9be6-82f2a54d54f0","resolution":{"observed_at":"2026-08-06T23:11:49.084777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01394","last_updated":"2021-04-03T13:01:19Z","snapshot_observed_at":"2026-08-08T15:51:22.683833Z","submitted_at":"2021-04-03T13:01:19Z","title":"MMBERT: Multimodal BERT Pretraining for Improved Medical VQA","version":1},"cited_work":{"arxiv_id":"2104.01394","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.01394","snapshot_observed_at":"2026-08-06T23:11:48.054339Z","title":"MMBERT: Multimodal BERT Pretraining for Improved Medical VQA","venue":"cs.CV","work_id":"8d94e50a-c351-490f-b2df-92f042278c9a","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.281433Z"},"links":{"cited_paper":"/paper/2104.01394","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:7517d090bd5b397269d23a720eee8a60966c06c77d07ceaa3a8f423a2c5193f5","observation_id":"907dee4b-530d-4b2f-8235-66046f6decaa","resolution":{"observed_at":"2026-08-06T23:11:48.140882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.343641Z","title":"Scientific data 5(1), 1–10 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.343641Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:2a50c522101eb70e0569d1978ff33f4990c4740458cb171f41ba71242a70982d","observation_id":"9499a12e-5bc1-4ac7-a1f0-08f8c80da03a","resolution":{"observed_at":"2026-08-06T23:11:46.343641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-06T23:11:46.434701Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.434701Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:dc1b3bc376c6cc159a567b6ce5c0f193552b10e3e4af3a447dcbf43ed83f0e97","observation_id":"48700bed-40d1-49b6-abc6-a5f6e4b9c8ae","resolution":{"observed_at":"2026-08-06T23:11:46.434701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.505899Z","title":"Advances in Neural Information Processing Systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.505899Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:12941ee9b4223d094c5550541967f6915b9e4c87cedaf80fda4b10923bf7a8ac","observation_id":"5bb856c1-a65a-49e2-bb9b-12c4eed75918","resolution":{"observed_at":"2026-08-06T23:11:46.505899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.057811Z","title":"In: 2022 IEEE/CVF Conference on Computer Vision and Pattern Recog- nition (CVPR)","venue":null,"work_id":"52cbd2bb-fcb2-412c-bc2c-0fb76ad02f52","year":2022},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.560639Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:38d77002c3a4926f4e0cb233db3222a4d33cb8e590341ad70d4099edfad95865","observation_id":"4dd45ddd-ee77-47ea-ada8-2bd1d24afc79","resolution":{"observed_at":"2026-08-06T23:11:49.061186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.047162Z","title":null,"venue":null,"work_id":"023da7a0-03a9-435a-a80a-b79319c3330e","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.642266Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:ff1b918b0258104f7ad46067fddf60ce13d67de4088e047ab09def4732142206","observation_id":"1aefe957-281a-4481-b57e-97e3862d2a1a","resolution":{"observed_at":"2026-08-06T23:11:49.051084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.699157Z","title":"Advances in neural information processing systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.699157Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:548f3f97f2d3a5fc72e5cdce815fbf740120226dee2d2baccbfea80c5aed8c6c","observation_id":"abfcf717-2264-48c7-bf28-afcd04f3ab78","resolution":{"observed_at":"2026-08-06T23:11:46.699157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.027893Z","title":"IEEE Transactions on Emerging Topics in Computational Intelligence (2023)","venue":null,"work_id":"fc8eebf6-6e82-474c-bc48-469ff8429624","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.761213Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:8d95a124f0e83103588f6895a48ddfcfbed2609e9f7fa7c814a50f0906672da6","observation_id":"525e39b5-42f0-4e47-85ff-be14166875d5","resolution":{"observed_at":"2026-08-06T23:11:49.031564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.016208Z","title":"In: Proceedings of the 2024 Conference on Empirical Meth- ods in Natural Language Processing","venue":null,"work_id":"16587802-4c04-471c-8463-16e14a46ba5c","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.838851Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:938c1998244c911f522582b7e115f77131c65998f79e96a1864c8910b5de6f05","observation_id":"1fdbe272-5dd9-4c0f-867c-aa27783ce246","resolution":{"observed_at":"2026-08-06T23:11:49.020016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.003732Z","title":"Nature Medicine pp","venue":null,"work_id":"ab14d3d3-7f0c-4e0f-a59b-0a4f1db40d5f","year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.886937Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:b7cd70bfd09b5d7f084cfac51e10c1e8821f92de2cf65f676d833c4882774ae9","observation_id":"f051e981-0bbe-44cf-9129-c5cf56c847e3","resolution":{"observed_at":"2026-08-06T23:11:49.007501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.963364Z","title":"In: International Conference on Information Processing in Medical Imaging","venue":null,"work_id":"9b01560e-12f2-445d-b210-e9c0ac294a02","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.977415Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:83b14172e3da7b168083040047e8a43fcdce40a2b95eace65044c6bded11ce1a","observation_id":"633ddd3c-5e6c-4c34-9d03-0f89e8c9c69d","resolution":{"observed_at":"2026-08-06T23:11:48.996409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15011","last_updated":"2023-12-22T18:59:58Z","snapshot_observed_at":"2026-07-06T17:07:23.809593Z","submitted_at":"2023-12-22T18:59:58Z","title":"Gemini vs GPT-4V: A Preliminary Comparison and Combination of Vision-Language Models Through Qualitative Cases","version":1},"cited_work":{"arxiv_id":"2312.15011","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.15011","snapshot_observed_at":"2026-08-06T23:11:47.747486Z","title":"Gemini vs GPT-4V: A Preliminary Comparison and Combination of Vision-Language Models Through Qualitative Cases","venue":"cs.CV","work_id":"e18aad01-51e8-478a-8cfe-b5d0a0ef6c09","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.025420Z"},"links":{"cited_paper":"/paper/2312.15011","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:2f73ab5d30cc664fd10c802d8a4a41e9ff4fe368030c413f0dd4bfb8131f20d6","observation_id":"de595bf9-b477-4cd4-a25b-7539d25a7145","resolution":{"observed_at":"2026-08-06T23:11:47.843956Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.763344Z","title":"NPJ Digital Medicine7(1), 20 (2024)","venue":null,"work_id":"0f78d6fa-033a-45bf-94f4-96b19b007c0b","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.128968Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:3a95f680da67d94db01c87be6851856d8b18a00744696330790e65b8b959d4c2","observation_id":"17ce1651-bc5d-4029-9031-7b18df3bbefe","resolution":{"observed_at":"2026-08-06T23:11:48.851091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:47.219617Z","title":"In: International Conference on Medical Image Computing and Computer- Assisted Intervention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.219617Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:61c33dd60bb14e1ad37987982e3dce40e1260950d82768221dcf3beb60721bab","observation_id":"ba46c4f6-caa2-44c1-8a60-6cd5fa1ae6fa","resolution":{"observed_at":"2026-08-06T23:11:47.219617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01097","last_updated":"2023-04-17T17:06:29Z","snapshot_observed_at":"2026-08-09T00:47:38.021076Z","submitted_at":"2023-04-03T15:57:51Z","title":"DoctorGLM: Fine-tuning your Chinese Doctor is not a Herculean Task","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01097","snapshot_observed_at":"2026-08-06T23:11:47.244723Z","title":"arXiv preprint arXiv:2304.01097 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.244723Z"},"links":{"cited_paper":"/paper/2304.01097","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:e4f410e3cee3107cdda659f76849b9eb0e4f5a7f8b8922ace01eb8783ebb51d1","observation_id":"b2c682da-7f5b-4e9f-a1c1-8b5e21dabcbd","resolution":{"observed_at":"2026-08-06T23:11:47.244723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.553603Z","title":"arXiv e-prints pp","venue":null,"work_id":"9e23d687-eb6f-4dea-9f28-fdd2635f01bb","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.337658Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:12b66be42f496659c5e1faa1a40d283f6fa940e0c7be0af419025c67c7508af1","observation_id":"9fbc6074-2042-4156-93c3-88bae1a942ad","resolution":{"observed_at":"2026-08-06T23:11:48.649571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-06T23:11:47.453315Z","title":"arXiv preprint arXiv:2302.00923 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.453315Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:1d098ed906dc3246dc9a59a30dd7b3f46480be858a441324fd0c25a6a61ed92b","observation_id":"90270684-ff5a-4647-bdab-e290706fab79","resolution":{"observed_at":"2026-08-06T23:11:47.453315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.337864Z","title":"In: Thirty- seventh Conference on Neural Information Processing Systems (2023)","venue":null,"work_id":"b03dbb0a-bdf8-4e5a-aceb-f588ccc83ece","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.567352Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:b367bfa0f5985211a4134c94967994baf4163767f7e8cd823c5964cc03f87633","observation_id":"0dc9890f-dd1f-449e-91fb-fa85ffb66d7c","resolution":{"observed_at":"2026-08-06T23:11:48.482334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","latest_version":2,"primary_category":"cs.CE","snapshot_observed_at":"2026-08-09T00:48:04.792100Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.19610."}