{"as_of":"2026-08-19T22:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ad269021f69ac79ece78e8152eee4ac41a093d6722016baa5769d0a28b717c2","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T00:23:55.654447Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.18471/citation-record","integrity":"/paper/2606.18471/integrity","json":"/paper/2606.18471/citation-record.json","paper":"/paper/2606.18471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Medical Decision Making , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:435787a9a2e90b6fd0c5e32a005d3a7488fc22fc76d1f9285a8708a8223709f3","observation_id":"e31da0b5-f537-489a-b99a-5cae65f880d6","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Medical Decision Making , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:f4e8552e1aa24fd12b5814aa549ef29bd5b10587b6bd06f8050016f15ee61804","observation_id":"b94a0ff3-f9ce-41c1-80d9-03072bee5846","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:34ba99191524c46afa1b303ecab358bcc3f52dc57a7347a7209e94b5d64faeac","observation_id":"e30673f6-ea2a-4f96-b81a-fc409200749d","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of the American Medical Informatics Association , volume=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:17b6754fd953d99e562c702ed9cc4a490745a6e89f1fdb6f91792e0395c045f1","observation_id":"618bbeef-973b-4512-a6b7-c1cc042944f8","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"BMC Bioinformatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:0bab65d5d9b9031c340482811c425900328a1d1dcc7b07ebd1299bf2f7a67195","observation_id":"3c3f3773-87b4-4f04-a242-d0157ead1308","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"2023 , note=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:47fdad7ecc0e2cea4f29f45e158db4c6bf8a72372018065fc0c44228ef7feb0d","observation_id":"d02345f0-e607-4fa8-8d46-8c9a8840ddd7","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Biomedical Informatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:0176a46842989f46848014e4f563c539be35d66f342c2f635da91e51dd0de156","observation_id":"dba0e088-bb04-43d2-b271-7a017701d584","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Biomedical Informatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:649f36410d2b6f4b8e467f1757b18b5b2c4047a42d648ab034ea805a4dda48f1","observation_id":"0eed5d11-653f-4126-bf62-c5b4db933f94","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"AMIA Joint Summits on Translational Science Proceedings , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:6364a33f01723e332269963fc1ae8ac4c389be34b44349447e833d3505d7d8ca","observation_id":"f2feadc9-ee09-4e98-a9fc-cd52643b059b","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Digital Imaging , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:95999d0ca3ebb66390ee311e49b77ec6407c622987b78f7982234f521e0a679d","observation_id":"222b328f-ca34-40cc-b03a-16919e6c4706","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 22nd Workshop on Biomedical Natural Language Processing and BioNLP Shared Tasks , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:ff7f0de9637809b1fdec570b7b458f182507956d9417064afc5cf05675de85d2","observation_id":"45c4fb6b-7cbe-4f2f-b676-90eda9f974a3","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 23rd Workshop on Biomedical Natural Language Processing , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:9fd08e51270e9e31b50e856a571c7f9152e138362fd0da7db954fa38d84a0288","observation_id":"e4feae5a-cc58-4f54-a81f-d43eb69fa6e2","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"AMIA Annual Symposium Proceedings , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:d86469b71c5ca4f2fafe8f650425221b5b3d3113e8bb412bdb4f426809d09b7c","observation_id":"e67c937a-92fd-4b45-bca6-b34afb5046b1","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Digital Imaging , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:7c9abaa573dc9ea40a77636c4c7386d52f5b65a3033a13fa0a88715e33088613","observation_id":"06d77fcd-a117-42cb-af6b-5b87f68d67f1","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:f6c42b597f0a13a1b0cf722c64cb1cf3dbb02539fb7f2f8fc049119c3f9d35df","observation_id":"61e1e618-475b-40dd-8a9b-c8916946b3d9","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Nature Medicine , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:8cb1a68893ca0bac62071ec46199cac67317ae11f5fb02a175afac42c1a6e9dd","observation_id":"647429f8-854d-4c89-a7c6-d8933941d569","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Medical Internet Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:95b68c29909229b4d23c233f2285040eabf18b5a8dc402e6c084e8610d70910b","observation_id":"5fd4f7d3-a435-4ea8-8437-3c56a72e6e46","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 1st Workshop on Uncertainty-Aware NLP (UncertaiNLP 2024) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:ef11bcfff1c3e54c75376b8bb02e3674d02ac21f3c3939b8a36f4c5ab8d6151b","observation_id":"6a5509bf-3bef-4b95-bace-b7d62c93a859","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:4266cf60ad85d453a110b8d330f05971f980e272f92eecd37c905cb636666932","observation_id":"e2fb9a11-a6f4-405b-b5e7-aacd6e8e6f77","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of General Internal Medicine , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:a61804eb5b960c8bd3a401835bc246f55f3b4f59d308c36fa4d354e40c596bf3","observation_id":"30d9f312-32ab-4a51-8883-62fb5fd0ca2d","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of the American Medical Informatics Association , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:8ea6e22ea371cde45355d8bda50eff8bfea26a063fdf03a787a66c4fe6e82005","observation_id":"5019d643-4a6a-4c4b-8336-5a3efe9588b7","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Healthcare Informatics Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:e13e9a1f34690077353d9c9c4e595d345593be84396170d5f9a4c11205cfa1c5","observation_id":"09c7c24c-27a8-4526-a6d9-fe86ff6cf389","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Nature , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:17a21d4519bed7757412fedcca6646aa8ace84f06a8be21a7c60cb6de07ff012","observation_id":"2860732e-8c2f-47ab-a27b-357d41c9d5f0","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Briefings in Bioinformatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:937bc11535881412009e934f5a9ea7b2fe18fd38529fcf2701e6c993e750b4a0","observation_id":"8b07fdae-2767-44e3-8bce-d9f62a75c1db","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"BMC Bioinformatics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:37f1e90886dab767a917ca9ca1fe48f129ea180f8d2bf7bd10d8fc078befd081","observation_id":"3c9bc20c-984d-4649-bad0-a9e9f8aa0b5c","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:bb63c4f5645ba377606b020e97720c6e51aed028df6de9ff5415ee7ded3883b8","observation_id":"4f3aa541-9ac0-498b-870c-da41410ba2fc","resolution":{"observed_at":"2026-07-03T21:38:58.258068Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 1st Workshop on Uncertainty-Aware NLP (UncertaiNLP 2024) , year=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:9fbc990b6f2350017c8e561502744d3e57c6d138b0d5a8d33fc90dba33d614c5","observation_id":"c04abada-d32e-4b2c-b9d9-3bd5e3cc3a7e","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:d0a204b06507dfc30f0ac5f940fecedee297a56c34f2a24eefc729ddbc4fde84","observation_id":"3f5d3a99-17e2-47e8-a24b-a8124b149e85","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"and Zhang, Rui , title=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:7e803118952d69d1d067f6c49d459af6d57820071d3e43f2b8d1f3602539fd5c","observation_id":"270e5184-15f9-49ba-908d-d4a4ebf7ace8","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"and Afshar, Majid , title=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:f35f0f5361c737e55803711c56beb55bf68ad54d55ece837b4a39efba3e03db1","observation_id":"71470ae1-e1bb-466e-97eb-2c1777687981","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16040","last_updated":"2024-11-11T10:40:50Z","snapshot_observed_at":"2026-08-17T15:18:49.449652Z","submitted_at":"2024-02-25T09:41:50Z","title":"EHRNoteQA: An LLM Benchmark for Real-World Clinical Practice Using Discharge Summaries","version":5},"cited_work":{"arxiv_id":"2402.16040","doi":"10.48550/arxiv.2402.16040","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16040","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2402.16040 , abstract =","venue":"arXiv (Cornell University)","work_id":"6c173bab-aa6a-4daf-bb9c-76bbb313a928","year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"cited_paper":"/paper/2402.16040","citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:2915525784b0e85a19e45267e606633097a90444d434fa9340d6d37f3e8efc6e","observation_id":"d81d0800-87ec-4cbd-a9c3-9d20d03f7734","resolution":{"observed_at":"2026-07-03T21:28:59.517829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00716","last_updated":"2024-10-16T09:18:58Z","snapshot_observed_at":"2026-08-16T13:57:50.581405Z","submitted_at":"2024-04-25T15:51:06Z","title":"Large Language Models in the Clinic: A Comprehensive Benchmark","version":4},"cited_work":{"arxiv_id":"2405.00716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00716","snapshot_observed_at":"2026-07-03T21:38:58.254119Z","title":"Large language models in the clinic: a comprehensive benchmark","venue":null,"work_id":"fb746cd2-a9e0-4e8c-90d8-18d738d737c8","year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"cited_paper":"/paper/2405.00716","citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:2c7ca04664d14221f5b0ccb2f1650d3641e8124b9e210fca61c7ffed420ae388","observation_id":"dcc158fe-9db7-46db-8f09-3a105a042014","resolution":{"observed_at":"2026-07-03T21:38:58.255535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"and Wornow, Michael and Swaminathan, Akshay and Lehmann, Lisa Soleymani and Hong, Hyo Jung and Kashyap, Mehr and Chaurasia, Akash R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:58e2f46e0b7ace42469f8c3accdad74d12a59b70fe23ed2849774d5f6f3a2712","observation_id":"9c11ed67-e6d2-4b5b-a09a-13eacb36d398","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Medical Internet Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:fde8526ffb3434be73533acf6798289d851c1756360438b9febb45fc9df76f00","observation_id":"05e3ed89-c138-4412-9e8d-77df7c4de620","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:ce40db5b163abd1f6aa173539680361a799a2a4ddf7c1be21a9f6a5d42685d7d","observation_id":"6741c24a-719b-44ba-bd98-16c0e2530f1e","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:df1943dd634c42394faea400cba519c4d4ca5bc2390f6c8e2c9589751e5b8547","observation_id":"aafb433e-b0eb-430f-9d2f-44316d22cba1","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Proceedings of the Twelfth Language Resources and Evaluation Conference , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:3db54ce70718c5480c256ca5d75f14b2d378a7fc1d545707f7a082e61eec0866","observation_id":"91c55632-93cf-435f-85c5-d51bf040f5cc","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"BMC Bioinformatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:50866a41c879fbced3436d0402347559520e77de03f575bab90f6369c61ec853","observation_id":"4caf9441-6d78-4436-9665-e377decd3ec4","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"2025 , month=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:b3e860ca9c03d784c4697a8455c0fb3236a18a4122780e84bab0dee8dc5064d1","observation_id":"54676b33-bb73-4a47-a2b6-12a1d9f44673","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"2025 , howpublished=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:d4537ff8e16bfed66405a84e124d1491c8de62a58fa232a5c82dd7786a3d47db","observation_id":"0fcce632-15b0-492b-8ec4-fe1c1d9c0f15","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"2025 , month=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:0b044957dcbc5551fba6af7490f4ff6cf1e705cb8272b4c20942666ccc178783","observation_id":"ccfc290a-deca-4d16-af5d-785a10a4d577","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"and Collisson, Eric A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:b46cf467ee536bcdb04e60b85ce2492117d08dea8a724b0c8f16434c079bc62d","observation_id":"e75494cb-7aca-49c8-bb8b-6eece5b91a6a","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"biometrics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:e9930f80ec0e259bf3473e708c8ee1dea04fb9d4284694777c57530848884a58","observation_id":"a46dbb13-91c9-4bf9-bb7d-3647599ecb58","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"MedIR workshop, sigir , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:901a047e339b2c37c576e3fa52ba4b492f954ceaad328acc90115e85a366a582","observation_id":"bfe0ab56-304d-4ec6-85b2-4dfb59b91cbf","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"AMIA Annual Symposium Proceedings , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:7ea337f10c084eb9725bb0f0258b354ad61be399b552a33a0073f6e05379fc1d","observation_id":"a57b539a-09da-47ae-ab22-0539239f3e68","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Nucleic Acids Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:b1af0cd7de0011fd0be69879a214f587d0998d843371fb411c3140c566f3f8ff","observation_id":"f680b6a3-e77a-486c-a59a-28134316c6fb","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Journal of Biomedical Informatics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:c4d107afc3a441e6950a0b46ea6f84c75bee581d450792776996560427c948f0","observation_id":"53c398fa-3e43-425d-9f58-79ddee127cfa","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":"1904.09675","doi":"10.48550/arxiv.1904.09675","metadata_source":"pith","pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERTScore: Evaluating Text Generation with BERT","venue":"cs.CL","work_id":"9eaaaac1-0a96-4f5f-9b13-30c46e9e1346","year":2019},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:44dc8686d7f2eae4ccbddf4a9c0e866c3bf163f68bf995fdf9d34af56c9689bc","observation_id":"f9ad5fda-efae-463c-b322-99362d04c97e","resolution":{"observed_at":"2026-07-03T21:28:59.514797Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:14.227491+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:14.227491+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T00:23:55.654447Z","title":"Patterns , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-27T00:23:55.654447Z"},"links":{"citing_paper":"/paper/2606.18471"},"observation_digest":"sha256:e39462e988b910c9a49ea6c6a57a4a2e8ea9a5174e2698045a02038053472432","observation_id":"f75b9232-27c2-4a59-81ab-d00a287b8190","resolution":{"observed_at":"2026-06-27T00:23:55.654447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.18471","last_updated":"2026-06-16T20:30:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T05:49:16.513842Z","submitted_at":"2026-06-16T20:30:53Z","title":"Possible or Definite? A Benchmark for Evaluating Diagnostic Uncertainty Preservation in Clinical Text"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":45,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2606.18471."}