{"as_of":"2026-08-11T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4ae722885473b89fb5f3a009921b52adbae8bfb39ed4cb4b40d1d28da1d62f7","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:28:22.701010Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17095/citation-record","integrity":"/paper/2505.17095/integrity","json":"/paper/2505.17095/citation-record.json","paper":"/paper/2505.17095"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:18.545896Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.545896Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:e110fa176c382c5d1c26b44b5a51ef6fce56438b6e9455f9e11ad4a6d3842e38","observation_id":"545e9168-9c1c-4fa1-a6d6-2160340b64ce","resolution":{"observed_at":"2026-08-07T15:28:18.545896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:18.676307Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.676307Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7ca10ab97750b9743875b36279f224789acb16a6cbbac0f560d8feef1076d507","observation_id":"3e199913-0c7e-493e-b552-1f73826b8e57","resolution":{"observed_at":"2026-08-07T15:28:18.676307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-07-06T18:58:35.218405Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-07T15:28:18.784104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.784104Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:6f1606963491dd920941d63303734df679a5c2cdef08633a6a90cfd014aa459e","observation_id":"6f031bff-9e47-4538-8380-c782f87652aa","resolution":{"observed_at":"2026-08-07T15:28:18.784104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-85003-w","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Rahmani, and Youlin Li","venue":"Scientific Reports","work_id":"5b127dec-147c-4c1d-a4b0-52f7ed807bd8","year":2025},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.916189Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:fa286547f12c38adfccfc94b35153301143229679846250ff63fb0df84fbc7d7","observation_id":"cb749c51-d812-4432-8d9b-66baad453fd4","resolution":{"observed_at":"2026-08-07T15:28:26.006630Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.025921Z","title":"Sebire, Saleh Khalil, Elham Asgari, Christopher Tan, Andrew Taylor, and Dominic Pimenta","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.025921Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:f8fc76bb688ba5ce442eab26c1f3823a47c99a678deecb84df02f5c48b355e26","observation_id":"35ad88a8-a0a5-4022-af59-67259a56e4ab","resolution":{"observed_at":"2026-08-07T15:28:19.025921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02039","last_updated":"2026-05-15T07:07:50Z","snapshot_observed_at":"2026-07-06T18:40:10.103133Z","submitted_at":"2024-07-02T08:11:18Z","title":"Prompt Stability Scoring for Text Annotation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02039","snapshot_observed_at":"2026-08-07T15:28:19.116860Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.116860Z"},"links":{"cited_paper":"/paper/2407.02039","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:f32eaa92eb90b10cc710f7ba7b9c46513797609bfed986bb584db703ef0d69a9","observation_id":"f0354ff8-c2e3-4b61-9a13-cabf543b041e","resolution":{"observed_at":"2026-08-07T15:28:19.116860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18346","last_updated":"2024-05-28T16:43:41Z","snapshot_observed_at":"2026-08-08T10:59:03.627117Z","submitted_at":"2024-05-28T16:43:41Z","title":"Intelligent Clinical Documentation: Harnessing Generative AI for Patient-Centric Clinical Note Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18346","snapshot_observed_at":"2026-08-07T15:28:19.270196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.270196Z"},"links":{"cited_paper":"/paper/2405.18346","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:5142ddc58dc7dd3c1d174386ef134f1f2c3f2c9f5a1be4030cdeef16a9c95367","observation_id":"03e9cc4a-01bd-4cd9-973f-6860447e380e","resolution":{"observed_at":"2026-08-07T15:28:19.270196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.clinicalnlp-1.1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"94e2d914-7d2b-4268-9594-da991c826ca9","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.350669Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:bfdfdb3efe6260b092ffb309d3cd4ebb883a5586cb26f3ad2d87ed0afc14002d","observation_id":"b5c38088-02c5-4497-a132-c5fa265f4781","resolution":{"observed_at":"2026-08-07T15:28:25.789786Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.419917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.419917Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:d77e32a1531c03e50cfea35507f45a6b418d3b8846a7b01a1b0f15d058f19d45","observation_id":"4762bb75-b517-48c9-a52f-b6a177d21600","resolution":{"observed_at":"2026-08-07T15:28:19.419917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.474288Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.474288Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:2bd0041acc592dfcc61728d4efa438a86d94d986677c6703909662d158788570","observation_id":"016cd5c8-f737-4163-8f59-2481fb8ccbc1","resolution":{"observed_at":"2026-08-07T15:28:19.474288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s12553-021-00568-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Nambudiri","venue":"Health and Technology","work_id":"9087efe0-7c0d-4aaa-804c-69877b4a0e95","year":2021},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.553401Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:a2ebf46df80f8ecb59389a31c67822aa38903234327e6f9b4a3e49799332bb8a","observation_id":"db66a195-658c-4d4d-ad70-a76d807b50de","resolution":{"observed_at":"2026-08-07T15:28:25.516563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.clinicalnlp-1.36","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"e0be1542-3d06-4dac-ba7c-1fe2d86093e9","year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.699109Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:0bc3d5a239525bd49443c7d9c4dba40642509340536ab28bffded0246ac76810","observation_id":"d218f442-d4aa-4f91-8526-093e25e86295","resolution":{"observed_at":"2026-08-07T15:28:25.211566Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/59617","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"JMIR Medical Informatics","work_id":"27fce42c-f65b-4f28-8713-fb0423c0909b","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.835466Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:ba9c27d1dd508d5c11b04e6828126690bd31ebc95067ce1ac295f18397175aae","observation_id":"8d3c30a9-5ce3-4dfe-aea0-71832e21c7cd","resolution":{"observed_at":"2026-08-07T15:28:24.911183Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/54419","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Gold, and Vishnu Mohan","venue":"Journal of Medical Internet Research","work_id":"97600af0-6ac2-443e-a746-2b6dcd86c0f6","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.997095Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:0b6cc468f2f604f17efb453eab0a9fd7150177f0929d92c3958861d842a1ee21","observation_id":"b4f155b0-a035-4adf-bc0b-acfbe676b719","resolution":{"observed_at":"2026-08-07T15:28:24.646083Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.13211","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.847280Z","title":"Akdogan, Jessica Atkins, Mohamed B","venue":null,"work_id":"12792ab9-874a-4139-bad2-9695ff835f90","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.118227Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:6660d67caa61a7c723fed6eb78f13a662386eac12db70fe37579c9ba450774dd","observation_id":"0b00c702-a108-430f-b331-d05736248e93","resolution":{"observed_at":"2026-08-07T15:28:26.928726Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.633054Z","title":null,"venue":null,"work_id":"9b501a32-c360-4014-bd7e-a824809707ea","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.257178Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7636c221b16dda8c468f58ef140cb66219b21a0e7ea2108cbc9ff5320683cefb","observation_id":"360da593-0879-41ae-b68d-d180032a3f19","resolution":{"observed_at":"2026-08-07T15:28:27.709683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.12445","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.667974Z","title":null,"venue":null,"work_id":"6eb1d5b4-029c-4142-af4f-3971fbea95cc","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.356613Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:328ade0bb2155c149df05973bb76aa046ad65376afa50e77a22de7e84add7037","observation_id":"471f0add-3d1d-4d98-b9e8-5ada45aac9cc","resolution":{"observed_at":"2026-08-07T15:28:26.715873Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"reader/2860305","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.466013Z","title":null,"venue":null,"work_id":"ae8a498c-d7be-4308-8ecd-8323d66573e3","year":2020},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.457250Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:0cbce2f4a9960bc42a9152f0fc8d3497b464197b8ac5b498d25b3889a411ac95","observation_id":"66b77b6c-3cb5-46a4-bb30-34e4f5e0ae11","resolution":{"observed_at":"2026-08-07T15:28:26.543053Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s12909-024-06048-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"McCoy, Faye Yu Ci Ng, Christopher M","venue":"BMC Medical Education","work_id":"38126693-937d-4cd0-8e7d-577949a5c125","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.573090Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7dbe3cc5e0e744daab450a7c9f3352f9cf0168396aac0e0ad88ad84def89f175","observation_id":"f0bda5ea-ae83-4587-9ad0-18d2cf1f5e63","resolution":{"observed_at":"2026-08-07T15:28:24.346060Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ergon.2019.06.012","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Pennathur","venue":"International Journal of Industrial Ergonomics","work_id":"05144e8e-e4fc-4f6b-b2be-fd0a338b0470","year":2019},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.719002Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:48181c7e7487d50fb24a28162eb3c1149c8edf03f4e31426c93f5dc13efd185e","observation_id":"9c0539b9-67c4-4346-b6ec-8b8f6dc119f9","resolution":{"observed_at":"2026-08-07T15:28:24.065742Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:20.840862Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.840862Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:375dfece5bf1f2800c7ecb16d591a5ed6e4ac5eb7fa5f708a2785ad6983ebc04","observation_id":"7076c52c-d4d9-4717-86ae-8babcc286d6f","resolution":{"observed_at":"2026-08-07T15:28:20.840862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-019-0190-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Quiroz, Liliana Laranjo, Ahmet Baki Kocaballi, Shlomo Berkovsky, Dana Rezazadegan, and Enrico Coiera","venue":"npj Digital Medicine","work_id":"493870be-1193-436c-a822-8103c7e16170","year":2019},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.944217Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7c4585aeb2a7018fa28e7531f31e9866d7a5c5408e421373a5ede92a84c18b9b","observation_id":"3dd95755-3335-47c8-90c9-2a4a316c76e1","resolution":{"observed_at":"2026-08-07T15:28:23.800870Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.045394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.045394Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:c92840329933ba6330b4419d57e30f7f21dbe059c06cd5ad299735f9a756101d","observation_id":"dcd1a8d0-97bd-4d35-a5ad-19a631f90eba","resolution":{"observed_at":"2026-08-07T15:28:21.045394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16478","last_updated":"2024-04-25T10:03:14Z","snapshot_observed_at":"2026-08-05T22:46:11.346164Z","submitted_at":"2024-04-25T10:03:14Z","title":"Evaluating Consistency and Reasoning Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16478","snapshot_observed_at":"2026-08-07T15:28:21.131043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.131043Z"},"links":{"cited_paper":"/paper/2404.16478","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:d90ff572f2879bee7ac5e16f3643b5172a5763204d3847218ba2c9bf437a7426","observation_id":"8bcd07dc-8050-4cc9-8e32-0f41c6a7c13a","resolution":{"observed_at":"2026-08-07T15:28:21.131043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.489641Z","title":null,"venue":null,"work_id":"f507d492-fc3b-4773-a530-e6176d72ce97","year":2021},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.251803Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:51f11a627c7b1d7bc9d677e8c8b8919e4cdaab636bb88ffe651633e205142446","observation_id":"a08155d6-4545-4c81-90bb-908ddb7edd6c","resolution":{"observed_at":"2026-08-07T15:28:27.571936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/57721","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Journal of Medical Internet Research","work_id":"99e3da4e-cd68-4657-a752-77613abd4e11","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.397661Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:dbbb62c4d34272ab4fb09c2582e8f793ba285c8cee152d4a291133f7400b0a1d","observation_id":"a31d8ed8-6421-4745-91a0-bf2c0f81b4a1","resolution":{"observed_at":"2026-08-07T15:28:23.505634Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00715","last_updated":"2025-05-27T14:58:40Z","snapshot_observed_at":"2026-07-06T18:08:21.770341Z","submitted_at":"2024-04-25T15:34:53Z","title":"Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation","version":6},"cited_work":{"arxiv_id":"2405.00715","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00715","snapshot_observed_at":"2026-08-07T15:28:26.149575Z","title":"Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation","venue":"cs.CL","work_id":"88675979-50e0-438e-b31c-feb5861409f0","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.525302Z"},"links":{"cited_paper":"/paper/2405.00715","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:84c5416a1c301f4ba54c1f3a86ccc1c91d81c49dfed7c7b63407904cdc052402","observation_id":"43ed2592-f723-4b4e-8681-1e7894b5f171","resolution":{"observed_at":"2026-08-07T15:28:26.272163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.711043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.711043Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:dd7ce807202f22502ad12a2cf96082824324254f3ed72a9a075d95523b1f7a69","observation_id":"a6267c53-5da6-4ecf-a5a7-6a05736bf0a9","resolution":{"observed_at":"2026-08-07T15:28:21.711043Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.819970Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.819970Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:1996116faa38ab0147a79cb808c57dce69a5c54b1b9d103bcb585cd40e8732c3","observation_id":"52e6195b-9c5f-4d53-82b7-fd7a8ccc746e","resolution":{"observed_at":"2026-08-07T15:28:21.819970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/54811","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"JMIR Medical Informatics","work_id":"8264fdc5-e2ce-4098-b8f0-2341a270432a","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.958266Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:b397d4e9a168e42eed51bf470c9fecfda2be73fbfbb2ef5ee330922ee4b4aad2","observation_id":"524d9d08-9753-4281-bfed-e5bb647aad90","resolution":{"observed_at":"2026-08-07T15:28:23.238463Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:22.130493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.130493Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:30c3fcfecbdad5a4f4f03c2d85b61195ea98ad42cfa7a7058e5832353c70d98f","observation_id":"3359e3e9-8a9c-4779-8484-ce2658534173","resolution":{"observed_at":"2026-08-07T15:28:22.130493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.356965Z","title":null,"venue":null,"work_id":"be2bad49-187f-472c-992c-76bea4c935d4","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.229663Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:8c7de0d33c8eb99b01b53380793fbbc916bd81199b30d66753fd56a69a264364","observation_id":"224e5fb2-952e-4f34-9811-f7240bb54e4a","resolution":{"observed_at":"2026-08-07T15:28:27.413515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T15:28:22.370716Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.370716Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7757c34fbc5d7984315709d677486ee3deafc573cbe7c50b5d1117eb7dbfe278","observation_id":"2dd1728c-1d31-487b-b5fc-577f9164bcd2","resolution":{"observed_at":"2026-08-07T15:28:22.370716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3555111","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the ACM on Human-Computer Interaction","work_id":"e241615b-4f6a-45ab-a6bd-5a9ef77b7277","year":2022},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.540412Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:0786f2953e57cf5e905fce3f999f1c31bf333d474ad1e6f058f4a436e1c3b69a","observation_id":"37bc608e-0626-4d53-ba53-32c804110b48","resolution":{"observed_at":"2026-08-07T15:28:22.995871Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.134373Z","title":null,"venue":null,"work_id":"051d555e-1ff2-4d58-8012-85b64989d140","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.701010Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:e8f7c66d65b31deef11ff75cc0b8ed5a4aa85d482422d7bcb7dcaa73c009de01","observation_id":"42334b87-d979-4a62-9709-4d43b0c01f1d","resolution":{"observed_at":"2026-08-07T15:28:27.263988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T07:09:37.066504Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":5,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":18,"verified_exact":10,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.17095."}