{"as_of":"2026-08-14T19:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9623cb27535e70122669544321a9472423bc5324f51c6c1fa88b6c83936abcef","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:12:12.857120Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T01:20:57.490329Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T13:36:09.441352Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.19469","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19469","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Surgery-r1: Ad- vancing surgical-vqla with reasoning multimodal large lan- guage model via reinforcement learning","venue":null,"work_id":"9d82352b-f3b1-4f17-8167-f6597499a356","year":2025},"citing_paper":{"arxiv_id":"2604.20319","last_updated":"2026-04-22T08:18:21Z","snapshot_observed_at":"2026-08-11T14:31:55.370099Z","submitted_at":"2026-04-22T08:18:21Z","title":"SurgCoT: Advancing Spatiotemporal Reasoning in Surgical Videos through a Chain-of-Thought Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T01:20:57.490329Z"},"links":{"cited_paper":"/paper/2506.19469","citing_paper":"/paper/2604.20319"},"observation_digest":"sha256:cdd1a048aec068088d5ef497320e7a9662a4083ced0c2306f408cbaa3756124f","observation_id":"a0d79053-ef30-4d96-8b51-effcfd95991b","resolution":{"observed_at":"2026-05-11T13:36:09.445468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19469/citation-record","integrity":"/paper/2506.19469/integrity","json":"/paper/2506.19469/citation-record.json","paper":"/paper/2506.19469"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.166268Z","title":"Concepts and trends in autonomy for robot-assisted surgery,","venue":null,"work_id":"4f071d3e-6648-4ad3-b434-6403a113bb6d","year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.340298Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:283cfd0b3e51f5dfcdcca0b9bd5ea716c1dc453069162da2b8836da53f220433","observation_id":"bd697da2-b79a-442a-b65f-f0e3d050d967","resolution":{"observed_at":"2026-08-06T23:12:14.173621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:11.376982Z","title":"Video-instrument synergistic network for referring video instrument segmentation in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.376982Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:dce4cfe0e3bbf555d22e0e3f1ea80b8435517f58cd8a822ce9281651e94ad69c","observation_id":"cfd39512-8508-47db-8ef8-20a0cb87cf53","resolution":{"observed_at":"2026-08-06T23:12:11.376982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.14886","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.750067Z","title":"Surgical scene understanding in the era of foundation ai models: A comprehensive review,","venue":null,"work_id":"72f8a241-a9e3-454a-b3b8-f3abb57dc47d","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.489433Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:f32d940527c2519824516258d0e7ddac1aa31f2a68b549fb282196d816aa444d","observation_id":"ab67220b-0ff0-411a-9e3a-34e603e06a02","resolution":{"observed_at":"2026-08-06T23:12:13.764243Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.125863Z","title":"Dynamic interactive relation capturing via scene graph learning for robotic surgical report generation,","venue":null,"work_id":"32f570cc-1939-4aeb-ba58-bc82ce0afd67","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.593164Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ebcf2f36f5d3559ad37b15cffc5b4d4795cc28a237f2aafe5ed58152021f9b62","observation_id":"6e8a677e-16a2-4d2f-a440-12d07a17961a","resolution":{"observed_at":"2026-08-06T23:12:14.134619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.093151Z","title":"Surgical-vqla: Trans- former with gated vision-language embedding for visual question localized-answering in robotic surgery,","venue":null,"work_id":"7c1e2676-4c69-482c-9c6f-59e566a9f9bd","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.688527Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:eac4da0605a102a2a3558b0b0463d216c967fcedfc49c304ad006c4056a9e1a8","observation_id":"e760edad-c1b7-4f84-80bd-7371f65f92d5","resolution":{"observed_at":"2026-08-06T23:12:14.104660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.068424Z","title":"Cat-vil: co-attention gated vision- language embedding for visual question localized-answering in robotic surgery,","venue":null,"work_id":"f2e1336c-eb62-4f8e-8e5d-b6bdbbe778db","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.782589Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ec4beb7ef4149bc0790ac45b53e56dddcda7d651771509e710552cf76d4bf36a","observation_id":"b681fea7-dda6-461b-8703-b9b884e2920c","resolution":{"observed_at":"2026-08-06T23:12:14.076170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.035055Z","title":"Enhancing visual reasoning with llm-powered knowledge graphs for visual question localized-answering in robotic surgery,","venue":null,"work_id":"e83cebaa-cbb3-4433-bfa3-5a39c96f70c0","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.844089Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:e8c8b52245293cdc79889a3df61630e664cd4daa2a3312f3dd74b63bb038f605","observation_id":"d6747373-95e1-489d-b022-668002a275f4","resolution":{"observed_at":"2026-08-06T23:12:14.043677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T23:12:11.980924Z","title":"Gpt-4 technical report. arxiv 2303.08774,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.980924Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:fbf1e27a9f8918102db05e06cf38ab9aa56effa3b193b13d0e44bd0bf93408e5","observation_id":"29dac86e-9eab-47d5-898c-2b4ae9589523","resolution":{"observed_at":"2026-08-06T23:12:11.980924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T23:12:12.114296Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.114296Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7ae9994b771745c0f3d5050d24db8eb9df869d82b229ac3523060032ab2ef06f","observation_id":"784c6ea1-a4cb-4e60-acf0-64322a506138","resolution":{"observed_at":"2026-08-06T23:12:12.114296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16664","last_updated":"2024-10-23T16:27:48Z","snapshot_observed_at":"2026-08-13T04:09:57.705250Z","submitted_at":"2024-02-26T15:35:24Z","title":"LLM-Assisted Multi-Teacher Continual Learning for Visual Question Answering in Robotic Surgery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16664","snapshot_observed_at":"2026-08-06T23:12:12.276314Z","title":"Llm-assisted multi-teacher continual learning for visual question answering in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.276314Z"},"links":{"cited_paper":"/paper/2402.16664","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:769dafb8aae8b78a8f4ec04a7f03920f02d04341854518059491b1473f8e31f0","observation_id":"911b0418-63a3-4064-8520-d5ed2a09d0d5","resolution":{"observed_at":"2026-08-06T23:12:12.276314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T23:12:12.352837Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.352837Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:eaa322a7eb6c03a22c5d05172ba1a59c90cc99777dfd4edae4dda5bf2baf056c","observation_id":"7742205c-8c04-4a3b-b966-e500c0e12a92","resolution":{"observed_at":"2026-08-06T23:12:12.352837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.009243Z","title":"Otter: A multi-modal model with in-context instruction tun- ing,","venue":null,"work_id":"542154a5-6129-4b5d-be95-a40a1f62eb85","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.483938Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:3a45216fdf87992a40b62c00be8ab536f2cdbabb47dd900ad5a14e2a89da69c2","observation_id":"4eca0bd3-3398-41b4-a2a1-434f4c374f34","resolution":{"observed_at":"2026-08-06T23:12:14.017830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10948","last_updated":"2025-03-16T02:23:30Z","snapshot_observed_at":"2026-08-13T00:48:05.013862Z","submitted_at":"2024-03-22T08:38:27Z","title":"Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10948","snapshot_observed_at":"2026-08-06T23:12:12.503145Z","title":"Surgical-lvlm: Learning to adapt large vision-language model for grounded visual question answering in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.503145Z"},"links":{"cited_paper":"/paper/2405.10948","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7b45bcf21931282580bce3b6f17a3fda7e3ed5f13baab2ffd911c7d448c6c1f7","observation_id":"7d6a7c04-3975-4b2c-8d0f-bf7970b85d68","resolution":{"observed_at":"2026-08-06T23:12:12.503145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11347","last_updated":"2025-03-15T02:35:48Z","snapshot_observed_at":"2026-08-14T18:20:08.438957Z","submitted_at":"2025-01-20T09:12:06Z","title":"EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11347","snapshot_observed_at":"2026-08-06T23:12:12.627569Z","title":"Endochat: Grounded multimodal large language model for endoscopic surgery,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.627569Z"},"links":{"cited_paper":"/paper/2501.11347","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:2f24b5af9204a04cbb859baf66c51746065cec7b8a629a32bc5230bc97211166","observation_id":"5cf0f6de-075d-481a-aa46-24909667bbcb","resolution":{"observed_at":"2026-08-06T23:12:12.627569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-08-13T12:48:26.884823Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-06T23:12:12.655869Z","title":"A survey on hallucination in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.655869Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:4e22acaa36ebe72cbf75ff85d06c1923535d005e1e325d107bc255f7cf840799","observation_id":"163e1094-d61a-4214-b2e8-7daf56552e77","resolution":{"observed_at":"2026-08-06T23:12:12.655869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T23:12:12.661327Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.661327Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:c4f667555b2fc619d922487767fab4d2b8f40cafa63f4f187ae78c5bc288ca4f","observation_id":"95a736b1-c5fa-41f9-a2f3-36bc164ccf8e","resolution":{"observed_at":"2026-08-06T23:12:12.661327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:12:12.668699Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.668699Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:e7ee390f8e2a5d7be1539e2dbb9e2f8fe8be6f8d4416166766b5576a3cf03220","observation_id":"edabc439-2543-4743-b1a0-17d8b09e2f00","resolution":{"observed_at":"2026-08-06T23:12:12.668699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14135","last_updated":"2024-12-18T18:24:47Z","snapshot_observed_at":"2026-08-14T12:37:01.715676Z","submitted_at":"2024-12-18T18:24:47Z","title":"Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14135","snapshot_observed_at":"2026-08-06T23:12:12.674901Z","title":"Scaling of search and learning: A roadmap to reproduce o1 from reinforcement learning perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.674901Z"},"links":{"cited_paper":"/paper/2412.14135","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:09c17b73650d66a4d54344dd030edd24ff2cc68175e49258469ee5c63edb5b6e","observation_id":"9984e66c-a7c6-402c-8922-84dea3f6083e","resolution":{"observed_at":"2026-08-06T23:12:12.674901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T23:12:12.682873Z","title":"Automatic chain of thought prompting in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.682873Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:9312d25192b7d4203535cc44496b0f4c0b9e78fa4e77f510b4be50b446c650d0","observation_id":"ecbf9516-801e-4646-90d2-b0560d9acc53","resolution":{"observed_at":"2026-08-06T23:12:12.682873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-06T23:12:12.688769Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.688769Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ed926d5a5fb6f08390f9ee4e189608a29fb8c7bc29010c367789e7494ce3ac99","observation_id":"6a9393af-ed01-4f5b-b4d7-83a19c9309e6","resolution":{"observed_at":"2026-08-06T23:12:12.688769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18013","last_updated":"2025-03-23T10:21:14Z","snapshot_observed_at":"2026-08-11T13:43:56.795993Z","submitted_at":"2025-03-23T10:21:14Z","title":"Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18013","snapshot_observed_at":"2026-08-06T23:12:12.695884Z","title":"Vision-r1: Evolving human-free alignment in large vision- language models via vision-guided reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.695884Z"},"links":{"cited_paper":"/paper/2503.18013","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:d378a657f0868ad87610576cd4f662779d0b512fbe1d124c93db1bc38a5f6b8a","observation_id":"11926f27-4162-4895-8f2b-c855a4d22f50","resolution":{"observed_at":"2026-08-06T23:12:12.695884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-06T23:12:12.708747Z","title":"Video-r1: Reinforcing video reasoning in mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.708747Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a993a8b1e90e70470773cc3e89da9f90e5bcdedc912da655d6ebc5c62845153b","observation_id":"14e73cbf-1563-4072-b7dd-1fb2720c3fb2","resolution":{"observed_at":"2026-08-06T23:12:12.708747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.715293Z","title":"Med-r1: Reinforcement learning for generalizable medical reasoning in vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.715293Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:6062aede5a83ac12ed224c3ebe5c0a035d3b615efaadd96252990f17bd138d80","observation_id":"1378fa37-0922-4fe9-bf05-d13e38584077","resolution":{"observed_at":"2026-08-06T23:12:12.715293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-06T23:12:12.721082Z","title":"Huatuogpt-o1, towards medical complex reasoning with llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.721082Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:1ea991ea27e580201ed05d21def756127a1e63b300724be824a9812f8a134fcf","observation_id":"427df6e0-825a-431b-9410-84e29b6a4a42","resolution":{"observed_at":"2026-08-06T23:12:12.721082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-08-13T05:54:09.385656Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-06T23:12:12.727040Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.727040Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:c6c5472f4b3d39284354c82fdf59497c41a0539f8bbb1f5b78785dbc8522a132","observation_id":"cc933ffa-6545-4645-ae21-a3a1bff3e0ed","resolution":{"observed_at":"2026-08-06T23:12:12.727040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:12:12.732788Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.732788Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7100a64fc403c59519ba7c59237a982c7cb798b0ba24d6ffd1a82de4243d8cb1","observation_id":"9a515ed5-d779-42ea-908a-6b772492f5c1","resolution":{"observed_at":"2026-08-06T23:12:12.732788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T23:12:12.739097Z","title":"Aligning large multimodal models with factually augmented rlhf,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.739097Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:0bf7f8bd82853b19f8e8477d4934e4933997f8faa323f55d1af5d2243e885db9","observation_id":"9a80e5d9-411f-4fdd-8c1a-0c49d5ae2f18","resolution":{"observed_at":"2026-08-06T23:12:12.739097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.745011Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.745011Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:dffc45722e9ce6aefc9369861ae53db77cf47119510707af12208cd9a98a6b9c","observation_id":"c5d0ac4f-3bda-4696-bd88-3e959df2a637","resolution":{"observed_at":"2026-08-06T23:12:12.745011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01584","last_updated":"2024-10-15T01:16:20Z","snapshot_observed_at":"2026-08-14T09:35:24.079025Z","submitted_at":"2024-06-03T17:59:06Z","title":"SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01584","snapshot_observed_at":"2026-08-06T23:12:12.750753Z","title":"Spatialrgpt: Grounded spatial reasoning in vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.750753Z"},"links":{"cited_paper":"/paper/2406.01584","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:bd0bd658739f60451f83e5fcf67c0ca1ac5a3f563e47aaacd8fec7a450f8ba8b","observation_id":"1cb6f7bd-1dfe-4715-881b-fbe525c78b9a","resolution":{"observed_at":"2026-08-06T23:12:12.750753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14171","last_updated":"2025-07-02T21:00:36Z","snapshot_observed_at":"2026-08-10T08:02:13.965614Z","submitted_at":"2024-12-18T18:59:54Z","title":"Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14171","snapshot_observed_at":"2026-08-06T23:12:12.756251Z","title":"Thinking in space: How multimodal large language models see, remember, and recall spaces,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.756251Z"},"links":{"cited_paper":"/paper/2412.14171","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ec68f3e14a1526ec0568e16e9fbef5a3fa3df84545a424a0993fce3c3cb0d98a","observation_id":"364724d7-0984-4df3-9e81-5a3c1ade3d92","resolution":{"observed_at":"2026-08-06T23:12:12.756251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.972989Z","title":"Langloc: Language-driven localization via formatted spatial description genera- tion,","venue":null,"work_id":"68cddae4-5216-4562-87f5-057e11f928b4","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.761595Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:847667a48d2c144bdf3373a811269edde472c18aebe0b15d928da64321bc2332","observation_id":"05c073c1-fc3b-49ff-bc03-159e8a3a529f","resolution":{"observed_at":"2026-08-06T23:12:13.980112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T23:12:12.768154Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.768154Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:403457744c3c51015071263e11ace6ae6a5ac2c27d067a558651db6cf35167e2","observation_id":"f5101bf7-41c8-4e75-9dd1-4178d6f09b16","resolution":{"observed_at":"2026-08-06T23:12:12.768154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.912172Z","title":"Surgical-vqa: Visual question answering in surgical scenes using transformer,","venue":null,"work_id":"6ed5ccb4-c09d-47b5-a3be-2e99f3e419b5","year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.779282Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ad9431258c9143965ade51c5d7becdc7bf12be32ddc538dc26a3d82c98d9d004","observation_id":"4352587b-6c54-497e-849a-5a90884d80bb","resolution":{"observed_at":"2026-08-06T23:12:13.922312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.889978Z","title":"Beyond bilinear: Generalized multimodal factorized high-order pooling for visual question answering,","venue":null,"work_id":"223a05e1-a2a3-49a5-a5ff-553f2e3cfecf","year":2018},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.784644Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7ca2cb5775a8e49a9bbf9afc78c50de01a57f3d13287af062916497e9338a1aa","observation_id":"dbc56a84-e3da-4f42-b0f6-cc6eef8646df","resolution":{"observed_at":"2026-08-06T23:12:13.895806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.867519Z","title":"Block: Bilinear superdiagonal fusion for visual question answering and visual relation- ship detection,","venue":null,"work_id":"ffba0590-d608-4a0e-a1bb-b3ba2c7f1f75","year":2019},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.791470Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:edbd9004685943246f54ac37300de1ec70d56480e29c9d5ae0e1e57b52b4fe06","observation_id":"7c35949f-2a47-494d-85cf-98290fc3d337","resolution":{"observed_at":"2026-08-06T23:12:13.872822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.848793Z","title":"Mutan: Multi- modal tucker fusion for visual question answering,","venue":null,"work_id":"daaab9d1-cfa4-4baa-95c0-d475c52c6571","year":2017},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.798619Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:82cd455465926a66283c94f904fc12859eff9dd018ecdc284e2e02ece218012c","observation_id":"fb416d27-3a48-4e2d-ac3e-5d2fd8e00d98","resolution":{"observed_at":"2026-08-06T23:12:13.854178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.825504Z","title":"Surgicalgpt: end- to-end language-vision gpt for visual question answering in surgery,","venue":null,"work_id":"aa2a5c2a-0dea-4978-bd4a-e97139c2c8b2","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.807977Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:b92baa5c743e41bf1919945d00cc1ecda9f8ee6cd869fa905c1ea1ea3d59d27c","observation_id":"64124cf8-9188-46a3-8933-19be1b1d7bec","resolution":{"observed_at":"2026-08-06T23:12:13.832918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11190","last_updated":"2020-08-03T01:55:24Z","snapshot_observed_at":"2026-08-05T21:16:20.262505Z","submitted_at":"2020-01-30T06:37:07Z","title":"2018 Robotic Scene Segmentation Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.11190","snapshot_observed_at":"2026-08-06T23:12:12.816231Z","title":"2018 robotic scene segmentation challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.816231Z"},"links":{"cited_paper":"/paper/2001.11190","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:f6b8091cbed1badbec2c0f035449ee570212fc3a9a15b0cf96f305dace5a5ad9","observation_id":"464c2954-80a4-47f8-b714-e862ca54a132","resolution":{"observed_at":"2026-08-06T23:12:12.816231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06426","last_updated":"2019-02-21T17:01:02Z","snapshot_observed_at":"2026-08-14T17:15:06.830535Z","submitted_at":"2019-02-18T07:08:36Z","title":"2017 Robotic Instrument Segmentation Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06426","snapshot_observed_at":"2026-08-06T23:12:12.826059Z","title":"2017 robotic instrument segmentation challenge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.826059Z"},"links":{"cited_paper":"/paper/1902.06426","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a1d7f06bd816c0cd43589e54c42a22231433cfb280fe4c170b8187c90b99c15b","observation_id":"30b3032c-54da-4f24-9c6c-e35bcac52831","resolution":{"observed_at":"2026-08-06T23:12:12.826059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.832743Z","title":"A review on evaluation metrics for data classification evaluations,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.832743Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:61bdf9c3bcdb75ff3dd9fd02090fe02fcc7fdf76da4b06b7f0ba7d407125bb28","observation_id":"ada20978-0cb4-447c-8932-df36c11596fe","resolution":{"observed_at":"2026-08-06T23:12:12.832743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.838951Z","title":"Generalized intersection over union: A metric and a loss for bounding box regression,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.838951Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:9dc84caf441d1a0147d8e3f82086d4cef027b9cffa3fca51701a06ba59938415","observation_id":"6470ce9e-7fcf-41e3-a7e1-6d99c2e56055","resolution":{"observed_at":"2026-08-06T23:12:12.838951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.845636Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.845636Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:2ef3b67ac7124df282a634b59cd8dacdf47c89209a8adf61e68e09612241d371","observation_id":"ad8bc998-1407-4e1c-b31a-b1a81205c427","resolution":{"observed_at":"2026-08-06T23:12:12.845636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.850954Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.850954Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:692f31d8e676fd9182358d5eda95e8bfb39b515561ef0abc4a3b7b9d1e35aa5b","observation_id":"94b649a3-3737-4dbc-8bd3-1c8d53c93269","resolution":{"observed_at":"2026-08-06T23:12:12.850954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:12:12.857120Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.857120Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:be9890239dd77aec6cd3056743e1a83474b29f09e779421afdef74a63a23c424","observation_id":"c18551c6-e599-4abc-8a1d-48fd6edc248a","resolution":{"observed_at":"2026-08-06T23:12:12.857120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T02:30:32.528809Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.19469."}