{"as_of":"2026-08-21T09:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:926eb2253e3c372a8173ea695892555231d73734956331436294b3e5529f0ea7","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:29:36.511758Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12928/citation-record","integrity":"/paper/2608.12928/integrity","json":"/paper/2608.12928/citation-record.json","paper":"/paper/2608.12928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.eacl-srw.44","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.669014Z","title":"Annotation-Efficient Vision-Language Model Adaptation to the P olish Language Using the LL a VA Framework","venue":null,"work_id":"b6e0d82e-b5fe-449c-a0e6-03fd1cdd230a","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.306797Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:bcc5e2f318dfdc5fe8b2863cfc3c942cc6dcd57d7290d5c99fc33a8da8f50bb5","observation_id":"5bb8eb6c-56a3-45a5-8aac-95779aa588d2","resolution":{"observed_at":"2026-08-15T20:29:36.675027Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.312340Z","title":"Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.312340Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:1ee952840774e2848abb280b5785b630d3ff05595e77f636748190119812dac1","observation_id":"6e8e333a-6354-4116-a902-872d918ef6b7","resolution":{"observed_at":"2026-08-15T20:29:36.312340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.318911Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.318911Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:c47b5cdc27d8d91e9640dca2f45ca41f0bcfab838e6ed154cc13dde5aba2a6c4","observation_id":"b86cc106-17f9-405b-8a07-97968fe25467","resolution":{"observed_at":"2026-08-15T20:29:36.318911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.234852Z","title":null,"venue":null,"work_id":"e629f673-1f79-4972-97ca-cc7766114af1","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.323956Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:359470781feb81d46f58caaf26ea713813b228746d7d8e2938f8a0172699a72a","observation_id":"a21dfa53-e633-43d0-9480-f83bd6259e16","resolution":{"observed_at":"2026-08-15T20:29:37.240769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02266","last_updated":"2025-01-04T12:04:46Z","snapshot_observed_at":"2026-08-19T09:52:41.893972Z","submitted_at":"2025-01-04T12:04:46Z","title":"LLMzSz{\\L}: a comprehensive LLM benchmark for Polish","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02266","snapshot_observed_at":"2026-08-15T20:29:36.329103Z","title":"arXiv preprint arXiv:2501.02266 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.329103Z"},"links":{"cited_paper":"/paper/2501.02266","citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:10374a5cb0ddbb60ffccbcef79b12268e8a3eb9f87d6f2599b5224475ecb44db","observation_id":"6e66ba6e-e602-4945-b4a2-a9115a8d43fb","resolution":{"observed_at":"2026-08-15T20:29:36.329103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.151","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.639138Z","title":"Towards Developing a Multilingual and Code-Mixed Visual Question Answering System by Knowledge Distillation","venue":null,"work_id":"232b73da-6ac2-418b-a2a6-adbe57a7c381","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.334811Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:bcc862bfee202aae3cfcaccb0c7619e8ed4a6d3fd8c015a1343ac7adcc0920f5","observation_id":"7c779479-debc-4302-9ca2-ea3b88e9ece3","resolution":{"observed_at":"2026-08-15T20:29:36.644951Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.340195Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.340195Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:e678564258827e21faff80b9f16d3b2c7a09e32016fa0050c49599b13370926d","observation_id":"7324f780-42e1-405a-951e-7fa99fdb3438","resolution":{"observed_at":"2026-08-15T20:29:36.340195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.345009Z","title":"Artifacts or Abduction: How Do LLM s Answer Multiple-Choice Questions Without the Question?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.345009Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:a711bba57e8b0bbd719b4feb63d9cf0ed85ec2b3fd2343228628437b62c71949","observation_id":"e6dcadf2-b077-40a9-b50d-4267e6426bd9","resolution":{"observed_at":"2026-08-15T20:29:36.345009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.350616Z","title":"Which of These Best Describes Multiple Choice Evaluation with LLM s? A) Forced B ) Flawed C ) Fixable D ) All of the Above","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.350616Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:c922e7e81b2ef4e15f2078ae1a3717c1bd0b544937acd69fa9c039679b8ebce8","observation_id":"fafc7553-1c75-48bc-89c8-43a8a8a8da71","resolution":{"observed_at":"2026-08-15T20:29:36.350616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.208239Z","title":"2024 , eprint=","venue":null,"work_id":"73bc9e0b-8ce3-47d0-9691-07a77787067d","year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.356680Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:d99a11257936eb8140b6b8c75270ed4fcdb2d1b6a4720cb4520b2103b70b1535","observation_id":"ebae2032-79f3-46cf-b609-c67697eed21f","resolution":{"observed_at":"2026-08-15T20:29:37.212959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.192161Z","title":"2026 , eprint=","venue":null,"work_id":"c6e5d8ad-6f16-4ee2-b6b7-ddadfc3c0753","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.362619Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:69bfaa47fbd46c6adf8e048fe6f4463fc976919d7302950a10f62daa0ffc3b8c","observation_id":"fadff88d-5e42-49f0-be31-a6424e337509","resolution":{"observed_at":"2026-08-15T20:29:37.197292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.480","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.597327Z","title":"P olish- E nglish medical knowledge transfer: A new benchmark and results","venue":null,"work_id":"b2941b8b-ba63-4a67-8027-7f335ed379d8","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.368222Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:211c7b9760cfbdcbb3c3b768d940b8f5f0214f0bb3bb58dd372f810f8de297cd","observation_id":"1cf1a991-894a-4974-bde3-e270a58ba985","resolution":{"observed_at":"2026-08-15T20:29:36.603198Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.174750Z","title":"2026 , howpublished =","venue":null,"work_id":"eb3aab29-9a5a-4be3-b018-9ff06a516291","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.373653Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:2424628c1bbfe8dc98a8f252a130f14531b6e72602e442fe3e99603f6c15880c","observation_id":"4712cd2c-f4cc-4d89-9186-52556622934a","resolution":{"observed_at":"2026-08-15T20:29:37.179988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.156330Z","title":"reVISION: A Polish Benchmark for Evaluating Vision-Language Models on Multimodal National Exam Data , year=","venue":null,"work_id":"1a3c84fa-18cf-4aae-b43b-fb664d23616f","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.380142Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:1be244625b161d0a0d155787f9dbcf1dc2d2b1ec82484edeb560282fdbdd3863","observation_id":"1fb96ccd-4941-475d-ba38-da945edd99a1","resolution":{"observed_at":"2026-08-15T20:29:37.162874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.385425Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.385425Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:c9d3d54b266b1512fdc1b51392077fb2453be12cc4ae0962744440d43a86c35f","observation_id":"739db54a-6095-4bac-8179-aabea38c55ad","resolution":{"observed_at":"2026-08-15T20:29:36.385425Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.390344Z","title":"EXAMS - V : A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.390344Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:13a60a19b91e0837964302c1ec85bcda64e2347ec72ea7e4c5c6c478bcc6e845","observation_id":"5f6bc3f5-3ce0-47be-80bd-a3dcedf33b41","resolution":{"observed_at":"2026-08-15T20:29:36.390344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.126799Z","title":"Scientific Data , volume =","venue":null,"work_id":"f7cbd676-c96f-4eeb-bfd4-532a81ccf405","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.395247Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:1ceff71c0f344582a26ac334fb8db56498d4948a4ea1fb45324bfa7c6737a545","observation_id":"57e16b8a-ec2d-47d9-82ed-1c4ada1f788d","resolution":{"observed_at":"2026-08-15T20:29:37.132443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.109753Z","title":"Hasan and Yuan Ling and Oladimeji Farri and Joey Liu and Matthew Lungren and Henning M\\\"uller , title =","venue":null,"work_id":"190425ab-8813-43b8-9033-4d48a25e7a32","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.400945Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:faaf3d98e37d418f06354ebf5e7519f49ade2d3bba5b2d9a3db75181da4a04f4","observation_id":"3d4d9ad8-3132-4698-909a-ae4531d9819d","resolution":{"observed_at":"2026-08-15T20:29:37.114905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.092799Z","title":"Working Notes of","venue":null,"work_id":"903a2c73-c16b-4016-aa8d-4894a4d79b36","year":2019},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.406103Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:10c86a440698088d516b4338461fada7f4989af51851e3833eeb40e09264e840","observation_id":"c2bcd8d3-acda-45e9-9542-98355b1155f1","resolution":{"observed_at":"2026-08-15T20:29:37.099163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.075601Z","title":"Overview of the","venue":null,"work_id":"c232714a-17b4-4123-9022-50a8a2378c80","year":2020},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.412810Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:638c65b1b16464bd2b0015f9acd45608e737187c6ae4f51f1c6fa80344917994","observation_id":"f9282cce-b387-4bda-a53f-9716ac164c9a","resolution":{"observed_at":"2026-08-15T20:29:37.081451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.059351Z","title":"Overview of the","venue":null,"work_id":"b92dd9b0-7d2d-4249-b7c8-32e1bd2beb94","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.417787Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:d93f371dd114e6f273563c903ea9bbdee1944a99a288ed6eb5216a9eee6fcd9f","observation_id":"3fec154f-b382-48cd-be7b-0009c73b91aa","resolution":{"observed_at":"2026-08-15T20:29:37.064348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-short.90","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.568091Z","title":"Towards Visual Question Answering on Pathology Images","venue":null,"work_id":"2ec556ec-aa1a-4942-9295-b164bbef741f","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.424381Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:fb7485b459b3f22dcb25a8db2089e3fce63eee89fe3f8e1f0c1274a8c5cc7ea3","observation_id":"82f46247-4765-4af9-9030-0677df9fa20d","resolution":{"observed_at":"2026-08-15T20:29:36.574969Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.042006Z","title":"2023 , url =","venue":null,"work_id":"37e9fce2-b63b-4653-a523-f0bbbff6e404","year":2023},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.429582Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:81e449d15b9a0fea1f1af55d3753e5f18930bc91862a45e36e27e5c086588bc4","observation_id":"78aa71c5-06b6-4bf9-b104-6cb1e15c0486","resolution":{"observed_at":"2026-08-15T20:29:37.046942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.434677Z","title":"Towards Injecting Medical Visual Knowledge into Multimodal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.434677Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:13ab25d2ec44cfb48e6cc780831849809484805df26f224f8d9efbfa082014ed","observation_id":"79fc0afd-ae17-4a9b-bc6e-8910cc9fd4a4","resolution":{"observed_at":"2026-08-15T20:29:36.434677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.024623Z","title":"Slake: A Semantically-Labeled Knowledge-Enhanced Dataset For Medical Visual Question Answering , year=","venue":null,"work_id":"81e90bd0-bce3-4c83-ba86-9240fa2d61ed","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.440921Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:9833fe0443279c86698843743155ba43f6f1cee55a82ba5c4564c4af8212dd8c","observation_id":"fca90e38-987f-4ac9-ae39-6768095dc8e8","resolution":{"observed_at":"2026-08-15T20:29:37.029961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.446248Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , month = apr, year =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.446248Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:b1374a9471cfdf966738f2cde0f0125b7f99c8f66a7323f7740e98a77e4d8379","observation_id":"1212fc71-0220-46ea-a611-2b24262e91a6","resolution":{"observed_at":"2026-08-15T20:29:36.446248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5348.2025","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.790955Z","title":"2025 IEEE 38th International Symposium on Computer-Based Medical Systems (CBMS) , pages =","venue":null,"work_id":"11c83a8a-65ce-4381-b7e1-028ca6a28fd6","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.452542Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:323c6b30f3d100453bf88cc4158874137880ce2e1e4959b25fb1a7ee83f582f7","observation_id":"ff307ca8-b3d4-4ffa-9fd5-6cfb8977c520","resolution":{"observed_at":"2026-08-15T20:29:36.800339Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.005917Z","title":"Kennedy and Yetisgen, Meliha , journal =","venue":null,"work_id":"91004c58-8138-4b4d-af36-fc7dea852189","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.457652Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:c0af7ca9215b12027232046c6dfc8b05f8edcc080551033a694c721187ea7765","observation_id":"04345bf1-17ac-4095-9fe3-5cf547e4e1fc","resolution":{"observed_at":"2026-08-15T20:29:37.011750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.986125Z","title":"2026 , eprint =","venue":null,"work_id":"0a95f4be-2217-4a80-b5de-fdc94af39c50","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.462777Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:2b251e61f2fb13607b09cbf0b19bc9b9bd488b1d77b90d83ce00931ef8e3d262","observation_id":"21af4605-4313-4587-b467-3e730494ca3f","resolution":{"observed_at":"2026-08-15T20:29:36.992710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.966466Z","title":"2026 , eprint =","venue":null,"work_id":"c76fb916-8996-4b32-a44d-93266ad30ab5","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.472237Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:f3bf7d5f99f65b36ab079fbd53047a37e6b4225d429c4034e1a0681ec49c1cf5","observation_id":"9bb25061-9002-47d0-9ef9-fb2c3fb194ff","resolution":{"observed_at":"2026-08-15T20:29:36.972988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.479021Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.479021Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:261188bf4d8c4c0bcbd579e147f33c7c20e74c4e5a65650bbd33ebd69cea54f5","observation_id":"48dac0f7-b239-451d-82ea-da3ec9c1898a","resolution":{"observed_at":"2026-08-15T20:29:36.479021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.933106Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"34fcf6c6-63f9-4972-8221-b5e7749f6b79","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.485582Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:efdd71287e254045ed9eabbf786ab2a594a0fe838a7531410388af1df12edfc5","observation_id":"e058d13f-4693-4d8d-9e44-63f4039f7497","resolution":{"observed_at":"2026-08-15T20:29:36.939448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.911789Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"8748a1f4-d8c5-4238-b8e8-0cc261dc8952","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.490570Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:ed95ff5ccb1a250eddb01859fdf9d9ade02af77166f9a423b75e344dd6b53ec1","observation_id":"16a1aa4b-b433-484d-90c4-53d3ee81b408","resolution":{"observed_at":"2026-08-15T20:29:36.918653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.892765Z","title":"2019 , url =","venue":null,"work_id":"3134e252-9cd3-4f4a-880c-40fd8737e630","year":2019},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.496219Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:6817f7c00024c0733bbd99bdc76ce41f90d282830085436f7ccf5a5e237f6cd5","observation_id":"91e51785-758e-404c-bc9f-fdff3555d96d","resolution":{"observed_at":"2026-08-15T20:29:36.899571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.874222Z","title":"Computer Vision -- ECCV 2020 , series =","venue":null,"work_id":"af469942-99c2-465c-8396-b986e830ce60","year":2020},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.501195Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:5648e7611a23a8fc76a2945412995630e50c753ed6eceb50bfae96a094f59ef5","observation_id":"a85235f7-e669-4f08-bae5-393a6f2f4019","resolution":{"observed_at":"2026-08-15T20:29:36.879616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.854590Z","title":"Medical Image Computing and Computer Assisted Intervention -- MICCAI 2023 , series =","venue":null,"work_id":"bc16c3e9-8410-49ff-b8ca-28793299f286","year":2023},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.506729Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:377dd68bb489ae66cf3afecf1f86fd012905debc803a390d6c44d18ac741d5f6","observation_id":"9c667f1e-cb29-4d80-90e7-fdc15d74782e","resolution":{"observed_at":"2026-08-15T20:29:36.860669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.832817Z","title":null,"venue":null,"work_id":"71250207-ec6a-4824-9f82-5f9e448a3325","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.511758Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:efa9fb1b3697bfb8c002a22d46c15352b320ed5999369b9d5e44dcd83a88ec86","observation_id":"1af0deff-77e2-46bb-bc5f-a9d784084bf1","resolution":{"observed_at":"2026-08-15T20:29:36.838867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T03:40:53.232828Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2608.12928."}