{"as_of":"2026-08-14T11:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:edee1858a6dccf77219316bdd6516278ba7bc678da946c7c9d66160fdbd66d02","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:37:02.212362Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01841/citation-record","integrity":"/paper/2506.01841/integrity","json":"/paper/2506.01841/citation-record.json","paper":"/paper/2506.01841"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10502","last_updated":"2025-05-16T13:15:25Z","snapshot_observed_at":"2026-08-12T08:32:24.761073Z","submitted_at":"2025-05-15T17:05:21Z","title":"WeGA: Weakly-Supervised Global-Local Affinity Learning Framework for Lymph Node Metastasis Prediction in Rectal Cancer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10502","snapshot_observed_at":"2026-08-07T11:37:02.112005Z","title":"Wega: Weakly-supervised global-local affinity learning framework for lymph node metastasis prediction in rectal cancer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.112005Z"},"links":{"cited_paper":"/paper/2505.10502","citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:47c10e943c100a583054e651960152b5efdb75ee8ac6c49eefd27361dc26e4cb","observation_id":"0e7a1b6c-f40a-4c50-ae55-2d9404184e17","resolution":{"observed_at":"2026-08-07T11:37:02.112005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.116332Z","title":"Multi-modal disease segmentation with continual learning and adaptive decision fusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.116332Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:7543e877b556e2968f01c2bd72c9dcc46c0b2bef26161e0cf7d8dfa25c32b2d8","observation_id":"1729bf7f-a586-479c-a4c3-75ae19594490","resolution":{"observed_at":"2026-08-07T11:37:02.116332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.551133Z","title":"Tooth instance segmentation and disease detection with uncertainty-aware contrastive learning and cross-scale attention","venue":null,"work_id":"6a5acf2e-7613-4924-9ced-881754a4773f","year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.119933Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:7a1efbd2ef0c3a9267fe69ae4e582f4c942ffc848ef10f7b7ce4710b755bf52c","observation_id":"80eb8898-ee3b-4a87-9005-42805eb33ba2","resolution":{"observed_at":"2026-08-07T11:37:02.554398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.123326Z","title":"Transmed: Transformers advance multi-modal medical image classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.123326Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:2f2d4972fcfd1145d3d3f05367bb9bcbf82f55f69b557441218aa0fc5f23393e","observation_id":"d5538723-24dd-4e76-93aa-e68a5c1eb1f3","resolution":{"observed_at":"2026-08-07T11:37:02.123326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.537079Z","title":"Facial video-based non- contact stress recognition utilizing multi-task learning with peak attention","venue":null,"work_id":"441a665d-d4bb-4c5c-bc47-885796d0afdb","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.127052Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:f8c176f386ea93b11d2ef1a6639a22064117b3c9a9fc8a679d6921484fca4890","observation_id":"7e67cabe-ab39-4bf8-be34-77ee74fced5a","resolution":{"observed_at":"2026-08-07T11:37:02.540565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.528162Z","title":"An anatomy-aware framework for automatic segmentation of parotid tumor from multimodal mri","venue":null,"work_id":"368abe9f-65a8-4d43-aa72-d0039e815643","year":2023},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.131172Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:86f730360f8beb754b1c535ac70df03655fb51869420f2e698e8b07f27000bfb","observation_id":"f7aced4c-f919-4d9b-9cfb-7661f398ced0","resolution":{"observed_at":"2026-08-07T11:37:02.531336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.135045Z","title":"Desam: Decoupled segment anything model for generalizable medical image segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.135045Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:4cbbbfdbcd7a90f5d08082dcb96f4b2078d51d5f54701fcea91272116f72b26b","observation_id":"a3747f31-1668-4880-810a-dee0abdccd6b","resolution":{"observed_at":"2026-08-07T11:37:02.135045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.513460Z","title":"Mba-net: Sam-driven bidirec- tional aggregation network for ovarian tumor segmentation","venue":null,"work_id":"18bb4237-a146-473a-8306-6f4a40204e60","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.138401Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:532328e8b55ecbc325325ce920c3d6bc3aa274a3957ef34966304fe37e389518","observation_id":"4df88c99-d5d4-4a50-ac3f-82c8e43d91a0","resolution":{"observed_at":"2026-08-07T11:37:02.516431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.07687","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.320076Z","title":"Abs-mamba: Sam2-driven bidirectional spiral mamba network for medical image translation","venue":null,"work_id":"f6c0c7f7-32b0-4afc-9985-d09c0331a10b","year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.141925Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:8aeecba08fe4275164c93489c85bc0573a2fb4f781b2b7debcea0f1c9e0fa1f7","observation_id":"0a9a2d75-4d90-411a-99b6-091d06f2bfaf","resolution":{"observed_at":"2026-08-07T11:37:02.325218Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.504719Z","title":"Medical image segmentation review: The suc- cess of u-net","venue":null,"work_id":"21c3a734-4c8a-4445-86bf-176e0cee42ad","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.144946Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:011de12d2ac777f62adcd1602ead0d16085a6727032054568c496e5a5ad09fc6","observation_id":"6773e2c8-5a50-4ebd-b0b4-0cf81a38ea21","resolution":{"observed_at":"2026-08-07T11:37:02.507706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.496009Z","title":"Qualitative evaluation of common quantitative metrics for clinical acceptance of automatic segmentation: a case study on heart contouring from ct images by deep learning algorithms","venue":null,"work_id":"5e36d1e2-d3c5-45e4-850f-565edc8511bc","year":2022},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.148019Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:204c1e2d9fa460e97b44c0f59f1cfa556498363bfb1394b97bf4f5e30835c9b0","observation_id":"9a7c15ac-4b29-4c4b-87fa-701e88794dcc","resolution":{"observed_at":"2026-08-07T11:37:02.499244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.486293Z","title":"No-reference seg- mentation annotation quality assessment","venue":null,"work_id":"6f8f3140-56c8-4e1f-b34a-f3a6197a2448","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.151375Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:43a7b96f097170825de2f6bb731dece9381d458d70d5819b4008fca5b7862dc3","observation_id":"f97b1479-25e2-483e-96ee-78a3990ac8fa","resolution":{"observed_at":"2026-08-07T11:37:02.489780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.477165Z","title":"Medical image segmentation automatic quality control: A multi- dimensional approach","venue":null,"work_id":"fad01d1d-a651-4504-bf06-c71d80cfd57c","year":2021},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.154679Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:f97645c64494db5bb45e9232754ac3becf3f5580707d940c18a448b1890bebe9","observation_id":"22b624f3-aef7-4dd2-bf1c-836ce35ae6fa","resolution":{"observed_at":"2026-08-07T11:37:02.480358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09899","last_updated":"2023-12-15T15:49:53Z","snapshot_observed_at":"2026-08-13T05:00:51.712611Z","submitted_at":"2023-12-15T15:49:53Z","title":"SQA-SAM: Segmentation Quality Assessment for Medical Images Utilizing the Segment Anything Model","version":1},"cited_work":{"arxiv_id":"2312.09899","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.09899","snapshot_observed_at":"2026-08-07T11:37:02.248300Z","title":"SQA-SAM: Segmentation Quality Assessment for Medical Images Utilizing the Segment Anything Model","venue":"eess.IV","work_id":"c31040d4-ad30-4346-84ed-79c97c8cb3e3","year":2023},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.157663Z"},"links":{"cited_paper":"/paper/2312.09899","citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:2e5a48f371f6d43fd5fb78ed4685e7b6903d5f0b7eac8ed9c83dc8f9f4b5ec60","observation_id":"dd2687d4-a594-4912-a4d8-ff0d8916e08f","resolution":{"observed_at":"2026-08-07T11:37:02.253749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.468094Z","title":"A robust quality estimation method for medical image segmentation with small datasets","venue":null,"work_id":"915e9423-0736-4b1b-a67a-1122590cebc2","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.161079Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:3edacf8168fbc111166b1b3acdd5b712b2e24fadfa759b061e3cec98acc060f5","observation_id":"380962c2-55a6-4141-9cea-f10e7701d9b8","resolution":{"observed_at":"2026-08-07T11:37:02.471551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.459238Z","title":"Segmentation quality assessment by automated detection of erroneous surface regions in medical images","venue":null,"work_id":"9b028e1e-f882-4a3d-8eed-ca9ccb599d97","year":2023},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.164609Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:558dce22652029c8848f54bb54fec9ca79ff967d2e23eef3c16c01983580cb93","observation_id":"3deed07d-a769-43c9-bfeb-f60fd09234b0","resolution":{"observed_at":"2026-08-07T11:37:02.462391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.450016Z","title":"Trustworthy clinical ai solutions: A unified review of uncertainty quantifi- cation in deep learning models for medical image analysis","venue":null,"work_id":"bbf0a183-c1d5-4284-8d84-59ee7d686d30","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.167476Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:da33ced2f38a3d1f7e4d46fcb5b069abc1540a10352933ea111b35149892ffbd","observation_id":"7947a234-b50f-494e-bae8-601805961ca9","resolution":{"observed_at":"2026-08-07T11:37:02.453293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.440151Z","title":"Efficient bayesian uncertainty estimation for nnu-net","venue":null,"work_id":"322af99a-9c6f-46dd-9573-2e1532332593","year":2022},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.170395Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:019eec0744da212a74d2092f38a9e2e017c0f53c630dc1c9c18479620e4cc7f3","observation_id":"2b6f7c3e-a7a8-4e99-b608-c5b549ac6aff","resolution":{"observed_at":"2026-08-07T11:37:02.443670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00327","last_updated":"2024-06-01T07:03:15Z","snapshot_observed_at":"2026-08-12T23:52:39.894081Z","submitted_at":"2024-06-01T07:03:15Z","title":"Quality Sentinel: Estimating Label Quality and Errors in Medical Segmentation Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00327","snapshot_observed_at":"2026-08-07T11:37:02.173266Z","title":"Quality sentinel: Estimat- ing label quality and errors in medical segmentation datasets","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.173266Z"},"links":{"cited_paper":"/paper/2406.00327","citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:b277e18ba3d8deadd8f0ac01d4d97bdd7ddc474c1a742b293c323483ad269d56","observation_id":"376b4a1a-f577-4acc-9ed7-18633d1573fa","resolution":{"observed_at":"2026-08-07T11:37:02.173266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.176629Z","title":"A survey on evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.176629Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:c3e934f888edcad0d1fe234ca03363684ddec638680585395451d0a9f9d111ec","observation_id":"20ed0486-1d52-4c69-a624-0dbebf84c5c6","resolution":{"observed_at":"2026-08-07T11:37:02.176629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.179605Z","title":"Large language models in medicine","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.179605Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:56505a73c08ff87beb6d66447be36a4c9ce65000064890bb2d36054b1202b038","observation_id":"1050a3f2-ed5d-47a5-8b9d-47e878ac089b","resolution":{"observed_at":"2026-08-07T11:37:02.179605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.182671Z","title":"Application of large language models in medicine","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.182671Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:ec3536c2b167a530b6510b058edf78660d95cc2e379a88d2eee32ddd6430e13a","observation_id":"f76589b7-e619-4b9e-94b4-f37bc062229f","resolution":{"observed_at":"2026-08-07T11:37:02.182671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.414427Z","title":"Gpt-4v (ision) is a human-aligned evaluator for text-to-3d generation","venue":null,"work_id":"6504a281-a5ee-4a74-aa06-fcae84b1096a","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.185576Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:5c3168d5c5b24e46817e443bdae1cd393229126e30d0304907806133296d7724","observation_id":"be4639f6-0f4d-4e92-a2ce-fefb2b1a7890","resolution":{"observed_at":"2026-08-07T11:37:02.417983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.405101Z","title":"Multimodal large language models address clinical queries in laryngeal cancer surgery: a com- parative evaluation of image interpretation across different models","venue":null,"work_id":"5502b3b1-1418-4652-83f5-06ba9ddbc366","year":2025},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.188557Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:94105971bc3199de1169fe77912bbd62defc76e848aa3b3e237d548774756590","observation_id":"8b25a40c-b80d-4d0f-9723-3a7e0383d5e4","resolution":{"observed_at":"2026-08-07T11:37:02.408625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.395902Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":"ba4470eb-9382-4ac2-a7fa-a06f9ea856bd","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.191560Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:1ec1a717be3af45640d469ef8173f3dc6759772e5d76433153489af43af64cac","observation_id":"25774fd4-8512-434d-ab57-525ec3abb4cf","resolution":{"observed_at":"2026-08-07T11:37:02.398846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.387061Z","title":"Large language models are latent variable models: Explaining and find- ing good demonstrations for in-context learning","venue":null,"work_id":"7ce5a55d-9ec0-469d-8db5-872f0850fe7a","year":2023},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.194593Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:4c77c8c6491262ac275613bd1e4449319915d018ceeef352a4b8ceb6ee996444","observation_id":"f7d34442-0061-4409-8054-05efd2b43374","resolution":{"observed_at":"2026-08-07T11:37:02.390325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.377857Z","title":"Prompt engineering in consistency and reliability with the evidence- based guideline for llms","venue":null,"work_id":"63094828-2633-4bfe-a399-ac8a025ea2d4","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.197657Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:086bfef3c20e499b470ca7b1f0222327c3b13c7a2f506e533abfefe59702d6d6","observation_id":"44f6468c-c1d5-481e-991f-8d1b917b4b95","resolution":{"observed_at":"2026-08-07T11:37:02.381051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.368911Z","title":"Ai-generated annotations dataset for diverse cancer radiol- ogy collections in nci image data commons","venue":null,"work_id":"83cdd707-b8af-4d03-80f2-f668f5d1f1a1","year":2024},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.200742Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:da992eec1a1f40122de855a75a0ab4c77a214fe00b6c10e81f31daa09e9774aa","observation_id":"e43fcdc2-ab1c-4381-b2ec-c148eadc08a3","resolution":{"observed_at":"2026-08-07T11:37:02.371954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.203761Z","title":"nnu-net: a self-configuring method for deep learning-based biomedical image segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.203761Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:412e0f37868fc4db6a8715c015a77b54d35e00acf8529828d572b6b2f5b01ce4","observation_id":"9d072df3-0bab-464d-b58c-528f994bf0ec","resolution":{"observed_at":"2026-08-07T11:37:02.203761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.355163Z","title":"Efficientnet: Rethinking model scaling for convolu- tional neural networks","venue":null,"work_id":"d894ae85-093f-48e9-b9b8-8afaac6f5c48","year":2019},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.206667Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:bba72389ecf40275e2b5f21a1b8c7fe193a9618fe877919a162f7e4fa0a44f86","observation_id":"bf7e1e2a-363e-4d46-8e4f-f8a5e49d163d","resolution":{"observed_at":"2026-08-07T11:37:02.358434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.209519Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.209519Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:61516c9e1ff11ab3c9727a3215bfb4ee47d401e416e53aab61bb3bbb0ec3dd57","observation_id":"4808135a-6bff-49c2-966b-c7eb38afbaf7","resolution":{"observed_at":"2026-08-07T11:37:02.209519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:37:02.340635Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"c81ac029-3af2-4faa-992e-4928386b789c","year":null},"citing_paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:02.212362Z"},"links":{"citing_paper":"/paper/2506.01841"},"observation_digest":"sha256:5eeb9b09988c39b7414762a5fde42f66c486daa8786c76853b3aceae74c68196","observation_id":"20a8455d-18ae-4d86-9c78-bd7ef9d6a68c","resolution":{"observed_at":"2026-08-07T11:37:02.344124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01841","last_updated":"2025-06-02T16:28:03Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-10T03:51:48.937215Z","submitted_at":"2025-06-02T16:28:03Z","title":"Beyond Pixel Agreement: Large Language Models as Clinical Guardrails for Reliable Medical Image Segmentation"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":20},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.01841."}