{"as_of":"2026-08-22T04:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4b14790944afb46ebff9a586a1606b85d29d72f7d75142d8dd467083004082b","coverage":[{"denominator":200,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:39:22.216622Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00230/citation-record","integrity":"/paper/2412.00230/integrity","json":"/paper/2412.00230/citation-record.json","paper":"/paper/2412.00230"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.01172","last_updated":"2020-02-26T14:28:42Z","snapshot_observed_at":"2026-08-20T08:32:26.363931Z","submitted_at":"2019-04-02T02:09:01Z","title":"Recent Advances in Natural Language Inference: A Survey of Benchmarks, Resources, and Approaches","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01172","snapshot_observed_at":"2026-08-12T05:39:21.794528Z","title":"arXiv:1904.01172 (v2)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.794528Z"},"links":{"cited_paper":"/paper/1904.01172","citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c3bdb70af42c8b9106d6772a78692b51e378591d36469f95266a3bfe05da9c6e","observation_id":"d6af6076-304d-4ec9-8e87-52a1aee6a747","resolution":{"observed_at":"2026-08-12T05:39:21.794528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.799612Z","title":"Data and its (dis)contents: a survey of dataset development and use in machine learning research","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.799612Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:207e6de896d3db8955d99af756f1ac6a05ae3ae3b4329f226f9a7e5a26b518b5","observation_id":"7641736b-a0c8-48d8-904a-0f199f363016","resolution":{"observed_at":"2026-08-12T05:39:21.799612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.803647Z","title":"Computational Methods for Corpus Annotation and Analysis","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.803647Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:a76726e3e6e72648ce3f415d323a0a1790576f97fd62b0e24524b0e7783fc99f","observation_id":"af1ab74a-eb06-4648-b978-9de0a09bf504","resolution":{"observed_at":"2026-08-12T05:39:21.803647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.807466Z","title":"& Pustejovsky, James D., eds","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.807466Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9ecbb0bdc32e4f914468f7c88f4faad605d90b60f13b0e4ec2707b7df319721c","observation_id":"fe2ab205-b123-4b4e-a7c4-24399bf440dd","resolution":{"observed_at":"2026-08-12T05:39:21.807466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.811326Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.811326Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:091837142033415a7831011d7ca8fc637ee3eac06bf03815fcd8acc31760ffe1","observation_id":"40fd766c-b122-41d2-b56c-b4b90630b7b2","resolution":{"observed_at":"2026-08-12T05:39:21.811326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.815186Z","title":"Two biomedical sublanguages: a description based on the theories of Zellig Harris","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.815186Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c7b4b4b472ddfa3732b2c9478fe8d4645e257ca3ea44115fc2ed0b508b5435db","observation_id":"3d711950-a6e7-47f6-8142-7369607b45fe","resolution":{"observed_at":"2026-08-12T05:39:21.815186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.819108Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.819108Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:fcc6bfc4e29867297f90c7a84f6662241cf9d1f5ced1fc25d839422dee6416e4","observation_id":"552dd135-81dc-4f13-bbcc-39dc0ea0c474","resolution":{"observed_at":"2026-08-12T05:39:21.819108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.822555Z","title":"Document clustering of clinical narratives: a systematic study of clinical sublanguages","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.822555Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:938874daac52354514de1261654d158d265239c7a88ea84bcab289e500e5776c","observation_id":"d30169a7-9a59-4c1f-82b1-c48aa2aec970","resolution":{"observed_at":"2026-08-12T05:39:21.822555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.826058Z","title":"Stylistic features of case reports as a genre of medical discourse","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.826058Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3b06d9a2ae232eefce72fbd3acaa57f0c1056199f1c0545afe80dd38aa460920","observation_id":"45255b4e-38d3-4bac-bd23-36e23bd05b74","resolution":{"observed_at":"2026-08-12T05:39:21.826058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.829982Z","title":"Cross -domain German medical named entity recognition using a pre -trained language model and unified medical semantic types","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.829982Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:46cb8180f98173bf8940a40eb0016477311ae553bfd55861e3b0ab685d05ad42","observation_id":"edafc59f-af50-4797-9b8e-102835340080","resolution":{"observed_at":"2026-08-12T05:39:21.829982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.833598Z","title":"Annotation and initial evaluation of a large annotated German oncological corpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.833598Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9f56fcf7e4ef4180eb3b596d7ab87f44a4e6437404edea7afd3ea6bdb7469e3d","observation_id":"176b7d17-09da-47f7-8d1a-29c95d3c3dab","resolution":{"observed_at":"2026-08-12T05:39:21.833598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.837298Z","title":"An annotated corpus of textual explanations for clinical decision support","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.837298Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:40fe0f0ecc9a679b1c007c7ca46c4c7fb50cb1909713087ca87278a9d6fcbca5","observation_id":"22a8ae6b-87dc-4825-b990-455ef27e4d54","resolution":{"observed_at":"2026-08-12T05:39:21.837298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.840789Z","title":"Building a German clinical named entity recognition system without in -domain training data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.840789Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:102d3b03dacaf8dcb4b155db44bd06a3245d3a9b799845e5bfa745af02360b17","observation_id":"5ea3ec64-b007-41dd-bc12-b3264ae4437f","resolution":{"observed_at":"2026-08-12T05:39:21.840789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.844143Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.844143Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:5ff2a6bef87dba845842b3e226e0a43345ea2206fb14d6db3df6c2484d541716","observation_id":"582f8054-6a0f-4ae4-be58-2aa67759e9ac","resolution":{"observed_at":"2026-08-12T05:39:21.844143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.847624Z","title":"A short review of ethical challenges in clinical natural language processing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.847624Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e2004f670a9a9eedfb57a024471842fb504d54c5512f828a11ebfe1fc9c26423","observation_id":"d81f27a9-4fbd-453e-b4d2-c038723b5e71","resolution":{"observed_at":"2026-08-12T05:39:21.847624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.851385Z","title":"Semi -automated de- identification of German content sensitive reports for big data analytics","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.851385Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:7d026f850c0db2bea4c73620d36588f3e4a9a018c7b35b441c4bedc1ca04e06b","observation_id":"8f2f07a9-ce60-4f1c-81c0-3e695a2b47a7","resolution":{"observed_at":"2026-08-12T05:39:21.851385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.854722Z","title":"De-identifying GraSCCo: a pilot study for the de -identification of the German Medical Text Project ( GeMTeX) corpus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.854722Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:92f133cd3656fb6ed5878e270902c5fd9ce5348c7a53debcf9f6491b810ded74","observation_id":"c1b6be2d-c7d8-4dc0-bac0-2d9f038555da","resolution":{"observed_at":"2026-08-12T05:39:21.854722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.858421Z","title":"How to improve information extraction from German medical notes","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.858421Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:28be758bd88464bc58eb86b081a06da4eb65b036c438476500135e2433487cbf","observation_id":"e5a357ed-b927-415c-bb4c-d316d9f2ee83","resolution":{"observed_at":"2026-08-12T05:39:21.858421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.861940Z","title":"German medical natural language processing: a data-centric survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.861940Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f9ac169bc59693b2a554dd96e8c79768b44d91e20889f06ef625274fbf1f80b1","observation_id":"c5e05f6e-f191-4fa3-97c1-4717db190e7f","resolution":{"observed_at":"2026-08-12T05:39:21.861940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.865478Z","title":"Preferred reporting items for systematic reviews and meta-analyses: the Prisma statement","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.865478Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:87910df257045535f787970097d19b9131e1fcdc8c01edeee6c06ce0bfc83b22","observation_id":"c4dfd97d-6266-4dff-8b13-8c9526a3da9e","resolution":{"observed_at":"2026-08-12T05:39:21.865478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.869046Z","title":"An annotated German-language medical text corpus as language resource","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.869046Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:018525cf8053728d6eb3a8675f94ad8c9d8d7318c8b59d43fcdc771dfe987ab7","observation_id":"ad4bfd39-d195-4c24-9fe5-4a48a1b5281d","resolution":{"observed_at":"2026-08-12T05:39:21.869046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.872648Z","title":"Disclose models, hide the data: how to make use of confidential corpora without seeing sensitive raw data","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.872648Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ffd8dab15073775b7c2023cc19d264a4c56b8d64943795799558c48c553d49b8","observation_id":"0b60ebe0-48ca-4e6b-86cf-76ea588ebce7","resolution":{"observed_at":"2026-08-12T05:39:21.872648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.876422Z","title":"Sharing models and tools for processing German clinical texts","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.876422Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c9be9f39dfa2ae82679fb7612d65524ce2b483c38b0840c66da46d397be83f1a","observation_id":"d2d51e3b-00d7-46a0-a520-41089d1e1965","resolution":{"observed_at":"2026-08-12T05:39:21.876422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.879998Z","title":"Biomedical data mining in clinical routine: expanding the impact of hospital information systems","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.879998Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:70fc2209b645dba7e873e5c50bd3422984d330a5e3d8923cd5f229704da99314","observation_id":"68542d43-f941-41ad-8547-90d4b998cfbb","resolution":{"observed_at":"2026-08-12T05:39:21.879998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.883597Z","title":"Enhanced information retrieval from narrative German-language clinical text documents using automated document classificati on","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.883597Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d0b57f16627b32ffe7fac654d9fbf53d34526788874da9e21d88e1dad9c85fbc","observation_id":"7098ca8b-0bbe-4f91-a301-0d45012b472a","resolution":{"observed_at":"2026-08-12T05:39:21.883597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.887440Z","title":"Truecasing clinical narratives","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.887440Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:4f54b280e047f5fad623d557cde7f13e897c0d312839003b1d355554c91a8474","observation_id":"4ed18497-5db8-4d0c-bca6-72062471c88b","resolution":{"observed_at":"2026-08-12T05:39:21.887440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.891590Z","title":"Information extraction from unstructured electronic health records and integration into a data warehouse","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.891590Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3c9a6f52ffb742929868df2d38267edc7654a5f6b1c29accd6adc1ce96df7d8a","observation_id":"9291be7d-6a7f-4c61-bbf9-5853d3cc4e5e","resolution":{"observed_at":"2026-08-12T05:39:21.891590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.899040Z","title":"Identifying pathological findings in German radiology reports using a syntacto -semantic parsing approach","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.899040Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:0835d337f6eeaae9649d39516f36cae5796df7b4f0f73e79a574c9c2446e5f1e","observation_id":"8ac4d1ed-162c-401e-a885-72a815685249","resolution":{"observed_at":"2026-08-12T05:39:21.899040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.906550Z","title":"Corpus-based translation of ontologies for improved multilingual semantic annotation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.906550Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1ef37d5c61fef16fe26081cb949a51125b9428c1b735f9274576bc0450b4ba34","observation_id":"8e01229c-d5db-41d1-8724-9e253ac53255","resolution":{"observed_at":"2026-08-12T05:39:21.906550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.910630Z","title":"Fine-grained information extraction from German transthoracic echocardiography reports","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.910630Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b76224d81e33213f49beb21f85b4cdf2c101ac3101d7ecddd86ad0c7d1c5025c","observation_id":"c0b43f2f-b747-4e91-aa20-91cacda165a9","resolution":{"observed_at":"2026-08-12T05:39:21.910630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.914918Z","title":"A corpus of German clinical reports for ICD and OPS- based language modeling","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.914918Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:4b3f6021f82bbaf8a875f88f7e4651051090c4110694da407df8735e91b7d725","observation_id":"027bb04e-d137-4281-ae49-e4ba79c115e6","resolution":{"observed_at":"2026-08-12T05:39:21.914918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.919053Z","title":"Automated classification of selected data elements from free -text diagnostic reports in clinical research","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.919053Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1dfc337a540d6619ef77d030c8d2211b09bd144d5cabcad839865753bb7a8c42","observation_id":"7899f1d0-779e-4d46-b717-e3fd774cc310","resolution":{"observed_at":"2026-08-12T05:39:21.919053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.923376Z","title":"A fine -grained corpus annotation schema of German nephrology records","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.923376Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:775a069a5a369060222babe5bb97595f6bf83ec8228177058c157d185c1fc4b9","observation_id":"a0ea1713-477e-4575-90a0-1050c2369b8c","resolution":{"observed_at":"2026-08-12T05:39:21.923376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.927532Z","title":"Unsupervised abbreviation detection in clinical narratives","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.927532Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:8b2a070756387cb02bdca4b2f8c15ff01f301c9e81b9e28fdf4504018c361e0e","observation_id":"4592fec0-0464-4264-80b2-e601bfae2a81","resolution":{"observed_at":"2026-08-12T05:39:21.927532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.931635Z","title":"Negation detection in clinical reports written in German","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.931635Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:77e1e5dab3da8da927343a864a9879f2f324a141ef1903af69f0642c08c1a64c","observation_id":"ab30f5e7-5d42-4d80-b6eb-92f2eb68c8e0","resolution":{"observed_at":"2026-08-12T05:39:21.931635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.935691Z","title":"Unsupervised abbreviation expansion in clinical narratives","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.935691Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:684cadd22c44d067864bcc4e93054a009d7c6c19f345c46c93b48b91d56127c2","observation_id":"08ad669e-20c5-4341-892d-eb09a615ee41","resolution":{"observed_at":"2026-08-12T05:39:21.935691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.939743Z","title":"Detecting named entities and relations in German clinical reports","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.939743Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:37ca47260103a173972e8f7c805820448d502f089f99baa5f4a987b47778d669","observation_id":"5ea258c8-35ce-4235-a19f-91577cebd137","resolution":{"observed_at":"2026-08-12T05:39:21.939743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.943822Z","title":"Semi -automatic terminology generation for information extraction from German chest X-ray reports","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.943822Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:18cd8bf0e6e326e8ae85b40246c8f1915e7c2da1be643fa5c0f5edd1ab00fc71","observation_id":"fdeb5c54-44d4-474d-9e69-ceec74ad9ab7","resolution":{"observed_at":"2026-08-12T05:39:21.943822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.947863Z","title":"3000PA: towards a national reference corpus of German clinical language","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.947863Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d459e63d6f1c496e856b1a18e744b17d92d518f8e8b35098312625acd2b50b89","observation_id":"25923c5b-d99d-4438-b086-98683c902835","resolution":{"observed_at":"2026-08-12T05:39:21.947863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.952427Z","title":"CDA- compliant section annotation of German -language discharge summaries: guideline development, annotation campaign, section classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.952427Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3b46b3951d21bdc0ec0e1897b6e5c10bfd1732506b74989e7340b329f7fa92ee","observation_id":"cab86d48-4ad5-48af-bbef-c118108929ad","resolution":{"observed_at":"2026-08-12T05:39:21.952427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.956616Z","title":"Natural language processing of German clinical colorectal cancer notes for guideline - based treatment evaluation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.956616Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bf2d7a8a155f11734e002bbffbbe83442842974fbde0971cd30510f89730aae4","observation_id":"23285fe5-7d0e-4a01-92fd-58f94ddcb78a","resolution":{"observed_at":"2026-08-12T05:39:21.956616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.895197Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.895197Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:60e99fcf9edc462b9920566c4fd804d2d76f93547fa1e70b0af04e0568de5033","observation_id":"09cbba1e-3d56-4cbb-bc09-af6c04a5eec5","resolution":{"observed_at":"2026-08-12T05:39:21.895197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.965115Z","title":"Deep learning approaches outperform conventional strategies in de-identification of German medical reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.965115Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:5cdc4d69e62ca57e9a1944aa3732c79034ff7f3cef438f8387d2acb1d34a8a2a","observation_id":"9900b85f-96dd-4b6c-8b15-7a0fa58b3221","resolution":{"observed_at":"2026-08-12T05:39:21.965115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.960719Z","title":"Annotating German clinical documents for de - identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.960719Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6aeb66c0bcb36d3d1ee6008f63cf37706d0a47da32f8e51b1f2b4f3d23b39181","observation_id":"dccb2726-e632-492e-beb9-1151e7acfd91","resolution":{"observed_at":"2026-08-12T05:39:21.960719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.972953Z","title":"An evolutionary approach to the annotation of discharge summaries","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.972953Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:67d1cde93906726b86c6374b71295632c1c69e7a23e79948fcb734cbcb6ea6fa","observation_id":"253a44bc-2d0f-4fee-bea3-4b12b48f9476","resolution":{"observed_at":"2026-08-12T05:39:21.972953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.969059Z","title":"Knowledge-based best of breed approach for automated detection of clinical events based on German free text digital hospital discharge letters","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.969059Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:df6d360ba5545365bd195ddfe6b6d6f2c858588586ab2fa1de00233b530aafdf","observation_id":"d60d87f5-38da-4fb2-8816-7d9820494aaa","resolution":{"observed_at":"2026-08-12T05:39:21.969059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.981045Z","title":"Information extraction models for German clinical text","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.981045Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:fca6e1262b905d3f975d8e096cf596b5dfa7eefa55c3ddf7e112b67f21f15503","observation_id":"9f4d94db-cae6-46de-90de-bcb5116d8c42","resolution":{"observed_at":"2026-08-12T05:39:21.981045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.977052Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.977052Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:581d147bb6fd2f2fa1a64a6dfccb45c212a059ac132f0cc7a8ad7945543a48b6","observation_id":"cf92986d-24bc-4dba-bb0b-901f95636a71","resolution":{"observed_at":"2026-08-12T05:39:21.977052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/20552076211057662","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.688653Z","title":"Automatic extraction of 12 cardiovascular concepts from German discharge letters using pre -trained language models","venue":null,"work_id":"07bac647-edf4-4062-978a-f98215c935d2","year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.989711Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3ff343c4d72bd9eef875c6dfbd7b1d83845dc64feb204423f66e3facf0dfd4de","observation_id":"9251d8aa-4af7-4a7e-a5c4-3bd9a195dd44","resolution":{"observed_at":"2026-08-12T05:39:22.693765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.985510Z","title":"Merkmalsextraktion aus klinischen Routinedaten mittels Text-Mining","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.985510Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1842bed673cc46f318b78f7952d193601acb93b4b5aa8d962357c8bf28ec1a54","observation_id":"be6f2349-b7d6-44d8-b545-a40c03825754","resolution":{"observed_at":"2026-08-12T05:39:21.985510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.998511Z","title":"Using a corpus-assisted discourse studies approach to analyse gender: a case study of German radiology reports","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.998511Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:eb5efbd4500b21e51443dcea5181d90240b6c0a827a7fc9eb86410e2047a8e00","observation_id":"b18b5e40-af64-4508-90d4-0413129ad758","resolution":{"observed_at":"2026-08-12T05:39:21.998511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.994107Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.994107Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:88755375b93c6e9516ac27f8e21433fadde49880233483fdaf0a6210429a3288","observation_id":"2473128d-40f2-4882-9822-fd2efba4d1c0","resolution":{"observed_at":"2026-08-12T05:39:21.994107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.03885","last_updated":"2022-08-15T13:39:45Z","snapshot_observed_at":"2026-08-19T08:44:04.797669Z","submitted_at":"2022-07-08T13:19:19Z","title":"A Medical Information Extraction Workbench to Process German Clinical Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.03885","snapshot_observed_at":"2026-08-12T05:39:22.007645Z","title":"arXiv preprint arXiv:2207.03885","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.007645Z"},"links":{"cited_paper":"/paper/2207.03885","citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bf564486258f6bd0ebdd782a2d470b9f832a396b33f715fcde442420872603ae","observation_id":"e7004597-fc89-4cdd-85a0-e39761256c97","resolution":{"observed_at":"2026-08-12T05:39:22.007645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.003526Z","title":"Deep learning-based detection of psychiatric attributes from German mental health records","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.003526Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d3d543103e6740400d0863805b03461573bc4630ef8aaa85ff79fc46d4c52359","observation_id":"643aace9-0328-4098-9c2b-9c0d95011d6a","resolution":{"observed_at":"2026-08-12T05:39:22.003526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.017045Z","title":"Patient - friendly clinical notes: towards a new text simplification dataset","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.017045Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bc1c45ee93590e764010b19a3a6e5f6295b8b821326c896883f0e398dec88248","observation_id":"c8b2d2f2-12a5-408a-9400-3509c0b3909e","resolution":{"observed_at":"2026-08-12T05:39:22.017045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.012883Z","title":"A domain -adapted dependency parser for German clinical text","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.012883Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:acc20e14f378c5daab91184bd22752d27bfb676abfd5d6543f46f23c9ec0ac85","observation_id":"819701dc-cad1-427d-bb6c-303bd29cde97","resolution":{"observed_at":"2026-08-12T05:39:22.012883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.027119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.027119Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2afae517932679d14e0976fc6c234cac5e8887d33a5e2cc0cfb478179431ef6e","observation_id":"5894918f-a407-466a-941f-ea86515f41ae","resolution":{"observed_at":"2026-08-12T05:39:22.027119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.021735Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.021735Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:898afe9d58359ce810ab7161fea95adabbe3bfd41bfce2bfd9f7de4f08f19036","observation_id":"6e207615-43bc-4d73-8e00-07c88736c021","resolution":{"observed_at":"2026-08-12T05:39:22.021735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.035259Z","title":"Announcement of the German Medical Text Corpus Project ( GeMTeX)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.035259Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d97720c2bb7b11d65e4463293b3738f1fed6b818b7efd8ef6da05e3e9f3c0da2","observation_id":"3ad330e4-4293-49a4-9673-876fadfa4104","resolution":{"observed_at":"2026-08-12T05:39:22.035259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.031365Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.031365Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:a451373d6523d743757b41814943df5aa638342b0ea34647bfee4174c9cf2a41","observation_id":"3cd79cfc-e8b8-4788-8e86-7f2b14599997","resolution":{"observed_at":"2026-08-12T05:39:22.031365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.044028Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.044028Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:5047609eb76e7939bacd513d943be5f8ae670d48588b4ed446465766616181e4","observation_id":"8c25b791-362c-434f-9155-b687dbb19264","resolution":{"observed_at":"2026-08-12T05:39:22.044028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.040003Z","title":"Final report on the German clinical reference corpus 3000PA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.040003Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:946e83b043329c0f21a2e9641aff03d8a62115297ec0e1d8426888ae2dca9f7d","observation_id":"60be8ccd-72f5-4caf-96ca-bc4efcff2d1f","resolution":{"observed_at":"2026-08-12T05:39:22.040003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.052834Z","title":"Masketeer: an ensemble-based pseudonymization tool with entity recognition for German unstructured medical free text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.052834Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d90c121f05e46cf480384917799151f3937297eeaf8c5fa60c699e9afe8f97d8","observation_id":"115ba6b0-a149-4e05-9b4a-a2eb3a237bc7","resolution":{"observed_at":"2026-08-12T05:39:22.052834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.048821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.048821Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:678e8f079cce31ba18b59b9cd2d87a14273be5cc3369f46a39063e117ea11297","observation_id":"04da8f02-c9d3-4514-8b5f-17486870b6a1","resolution":{"observed_at":"2026-08-12T05:39:22.048821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.061927Z","title":"Extraction of UMLS® concepts using Apache cTakes™ for German language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.061927Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bc67c246d7d25cdc71f42f34fbaa514e30a80653a0f53f19e6e919aea984b564","observation_id":"b60548d4-0385-4560-bb4c-be7d4e65f529","resolution":{"observed_at":"2026-08-12T05:39:22.061927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.057994Z","title":"Zero -shot LLMs for named entity recognition: targeting cardiac 28 function indicators in German clinical texts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.057994Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:7a3cbbfbec627ee30f38b4e2395d86813fdce33392a16417b7fc0c84da030592","observation_id":"2c2759b9-a586-4d1a-9e16-cfd64623f5cc","resolution":{"observed_at":"2026-08-12T05:39:22.057994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.070000Z","title":"Software Impacts, 11:#100212 [4 pp.]","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.070000Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f764b335df09693239899aea89cf12b6f14cf5ff1bec04af0c176271cc73fad0","observation_id":"7c2ac78d-6e9e-4f45-9489-bad85de7b52d","resolution":{"observed_at":"2026-08-12T05:39:22.070000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.065811Z","title":"F., & Leveling, Johannes, & Kelly, Liadh, & Goeuriot, Lorraine, & Martínez, David, & Zuccon, Guido (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.065811Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1d5ca93beb80fa236f258077f988b9bd697a839804dd2b53a4853402875bcc90","observation_id":"2c425369-c7aa-4e1b-ad20-ee518774f592","resolution":{"observed_at":"2026-08-12T05:39:22.065811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.078636Z","title":"2018 n2c2 Shared Task o n Adverse Drug Events and Medication Extraction in Electronic Health Records","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.078636Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1e5aed317646c15a9a6ac8992b2a2323ac67b2455b34359827d41e8c82425a37","observation_id":"37c78ec5-d69b-4722-8729-ce53b5f7df1c","resolution":{"observed_at":"2026-08-12T05:39:22.078636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.074751Z","title":"German medical named entity recognition model and data set creation using machine translation and word alignment: algorithm development and validation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.074751Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c566792a2110d74f7bb15b53387e29ad13fb7b2611fbf404297bb24b8f1785c1","observation_id":"c8b3ff53-9a3e-4705-bf6d-f39ac0e5cb86","resolution":{"observed_at":"2026-08-12T05:39:22.074751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.086069Z","title":"Harnessing the power of LLMs in practice: a survey on ChatGPT and beyond","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.086069Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e566a5e6b973a613b42c54d8cfe67023360b256009c0b0e522beb645a80c3145","observation_id":"b587a46c-cb5d-4fa0-ac49-bacae2ebdff6","resolution":{"observed_at":"2026-08-12T05:39:22.086069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.082396Z","title":"GerNERMed++ : semantic annotation in German medical NLP through transfer -learning, translation and word alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.082396Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:314f9619f38a2e94877ae21792e8937f1b71d0a8f25b966e48474a503c8af3b6","observation_id":"e3180517-e4a9-456e-9016-14442ec5bbb7","resolution":{"observed_at":"2026-08-12T05:39:22.082396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.094050Z","title":"Sharing copies of synthetic clinical corpora without physical distribution: a case study to get around IPRs and privacy constraints featuring the German JSynCC corpus","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.094050Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bc78151754b01b0bae494a63a9ccae06ff3749a386bb7054800d7edcfdd7cf5e","observation_id":"66f2ed6f-20a3-4ea5-b50c-b2a281097030","resolution":{"observed_at":"2026-08-12T05:39:22.094050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.090181Z","title":"A comprehensive survey on pretrained foundation models: a history from Bert to ChatGPT","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.090181Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e2fa6ee38c675d90567ce6e070fc18c159aef2984c655527e472b304b0ff3a61","observation_id":"8c19cd3f-fe4d-4395-a4a7-244eed174b2c","resolution":{"observed_at":"2026-08-12T05:39:22.090181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.103924Z","title":"Annotated dataset creation through large language models for non-English medical NLP","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.103924Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:18771668c17f8743541f8248980aa77f27e93676261ac5d9a94e8c63e887a891","observation_id":"d61207fe-8017-424a-b871-b34f603e5c37","resolution":{"observed_at":"2026-08-12T05:39:22.103924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.098945Z","title":"GraSCCo : the first publicly shareable, multiply-alienated German clinical text corpus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.098945Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:62257c98ec15ee8aabe7d9bcd479736cc6eda7e3813cd4dc8d54b58b54535898","observation_id":"a63a355a-ed02-41b7-9edd-699841769823","resolution":{"observed_at":"2026-08-12T05:39:22.098945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.111719Z","title":"Privacy risks of general -purpose language models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.111719Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b9a6cf97d065482dc80bf80fa05aba788e5fafb0823fd824e1bae457665e21ce","observation_id":"bb14d7ab-af11-4f62-bfff-f51d259e9369","resolution":{"observed_at":"2026-08-12T05:39:22.111719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.107869Z","title":"Lernen, Wissen, Daten, Analysen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.107869Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:559c9a93e89e701a3b035e5fde874b7733a43ab5d3cc0c5a05a198b7425b79c3","observation_id":"89e91f57-140b-456e-be54-5e036897b858","resolution":{"observed_at":"2026-08-12T05:39:22.107869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.120096Z","title":"Clinical text anonymization, its influence on downstream NLP tasks and the risk of re -identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.120096Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e6cac05bf11eb60cbb2bdbcb8300e3f6188518027755ca5cd675882a7d6423ff","observation_id":"9781586b-67a2-4cbb-938f-9f8d8af7a49d","resolution":{"observed_at":"2026-08-12T05:39:22.120096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.115909Z","title":"Extracting training data f rom large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.115909Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c1e24ed0762e9507b63335c6240326646d508ef2807880fb6671b2fdef87bc22","observation_id":"ddbd69a1-8a1e-4c07-a98d-8d76caea64ed","resolution":{"observed_at":"2026-08-12T05:39:22.115909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.129026Z","title":"Semantic annotation for concept -based cross -language medical information retrieval","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.129026Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3ed96637a2932527db29d28c6c68bdeaeaea206eae12cdacdcc9e3bd8621afe6","observation_id":"d9541c3f-e420-43c0-9ed9-c2d768f8b2b5","resolution":{"observed_at":"2026-08-12T05:39:22.129026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.124421Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.124421Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d4ba1bd4ba3a2a0daf7be314f97cdfb071fa8e0fc9f7bbc879e8913e7e2bd0e2","observation_id":"a5fc5272-f6bb-45c3-a828-3505f645ba72","resolution":{"observed_at":"2026-08-12T05:39:22.124421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.138089Z","title":"Customizing parallel corpora at the document level","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.138089Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e0b2007c22dca9eeb253725bb6379015c12e34e3a0a0ca401bba7aa7ed48be00","observation_id":"eb0eb0ed-86d2-4eae-a25e-5669bc3fc5ef","resolution":{"observed_at":"2026-08-12T05:39:22.138089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.133110Z","title":"Cross -language MeSH indexing using morpho-semantic normalization","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.133110Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d06abcb1df7d483e217be76229fe7ca6a108bc8b69e8e13d5c12e00065c5e362","observation_id":"2f214c9c-3b23-4569-b670-16695c087120","resolution":{"observed_at":"2026-08-12T05:39:22.133110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.146769Z","title":"Collaboratively annotating multilingual parallel corpora in the biomedical domain: some Mantras","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.146769Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9d15b065b5d034c94fd5b37a0c3818d853bb6d0805c81f544c30add822a7d826","observation_id":"551a0acc-499b-42ff-8b8d-4b8138ee0395","resolution":{"observed_at":"2026-08-12T05:39:22.146769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.142039Z","title":"Revising the compositional method for terminology acquisition from comparable corpora","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.142039Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6c9186d1a4a9d284c4bd06d0917d2149a05a33a6d7efeafb0d51c1e294cca8aa","observation_id":"dad453df-af47-4e28-9b2e-3cc3b72a2bf7","resolution":{"observed_at":"2026-08-12T05:39:22.142039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.155737Z","title":"Version 1.0","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.155737Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:307fc28e278f578143742951e5da11d98bcf1e8f0f1c4c2c4f4a749e728f08b0","observation_id":"278156ab-a04e-4d6c-812c-b26dc255de4c","resolution":{"observed_at":"2026-08-12T05:39:22.155737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.150856Z","title":"A multilingual gold -standard corpus for biomedical concept recognition: the Mantra GSC","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.150856Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2bfd2492631dff91293ae4b26805cfe86910a8ad7a37b969fb73ca3808fe406f","observation_id":"1f10076c-d850-4227-b137-8c0cf7c4d285","resolution":{"observed_at":"2026-08-12T05:39:22.150856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.164900Z","title":"On the construction of multilingual corpora for clinical text mining","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.164900Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2dfd48c0823f7c960256187307b8d82e8e123ef36a2cf1ca0dce11bf56e39784","observation_id":"3b9a479e-f93c-4d48-b506-a2645fef9ea6","resolution":{"observed_at":"2026-08-12T05:39:22.164900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.160033Z","title":"Leveraging Wikipedia knowledge to classify multilingual biomedical documents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.160033Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3d343e1b2c821ea299ca71af578b696a825b48388bc83fb49018e2104142fda7","observation_id":"751416c8-8c33-4071-aa67-e28e31bb0868","resolution":{"observed_at":"2026-08-12T05:39:22.160033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.173593Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.173593Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f6f769403aad8b6aa87b08872c9f46dabc0d7fbb471a9f1c716d3b40db8ac001","observation_id":"263548c9-6bd5-4703-9e8d-3e76db7e9adb","resolution":{"observed_at":"2026-08-12T05:39:22.173593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.168948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.168948Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e575026fe9a371701b5f3cae7517c419e79cd0327c53e34623ab14fd7285c6e0","observation_id":"0682e9d4-1aba-4478-bd70-76a348d39b75","resolution":{"observed_at":"2026-08-12T05:39:22.168948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.182396Z","title":"Sector: a neural model for coherent topic segmentation and classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.182396Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:547937a0bc1aa1d8880120af9c4b76f5e4a98d3ad8a1596024ba691f2016c352","observation_id":"70f6a6a8-72bc-4460-a3e3-22a594d11cd0","resolution":{"observed_at":"2026-08-12T05:39:22.182396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.177590Z","title":"Crit ical assessment of transformer-based AI models for German clinical notes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.177590Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ed9afcc68ec1ab54ec55603749a24f0ff444c15762d7b0febd324df49ac04601","observation_id":"96bc4b47-d3b6-40de-aadc-32e11446213e","resolution":{"observed_at":"2026-08-12T05:39:22.177590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.190162Z","title":"Tracking and analyzing recent developments in German-language online press in the face of the coronavirus crisis: cOWIDplus Analysis and cOWIDplus Viewer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.190162Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:994b1884d053c24e1ad7f537524a96a2b52850a7e8c620735d2232ff15a02c25","observation_id":"1950caea-e6b7-4186-b49d-07d741666ac6","resolution":{"observed_at":"2026-08-12T05:39:22.190162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.186270Z","title":"From witch’s shot to music making bones: resources for medical laymen to technical language and vice versa","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.186270Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:38b0d9263da5efcb1fc09f5b378e65b892b0b274fe5844ee9009713eb05a0cf3","observation_id":"1b827318-53b0-4043-be92-197f7c53c612","resolution":{"observed_at":"2026-08-12T05:39:22.186270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.198367Z","title":"Fang-Covid: a new large -scale benchmark dataset for fake news detection in German","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.198367Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:76dcc78f3ab6544cb1d0f167c44d25711e8d2f483d30db00ec1836c462e04b76","observation_id":"cc54bef6-ea4e-4c50-a9c0-e4da5a4061aa","resolution":{"observed_at":"2026-08-12T05:39:22.198367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.194249Z","title":"Investigating label suggestions for opinion mining in German Covid-19 social media","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.194249Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:42003b621d0980a029a74fa64a482a3382dfba3ade49cb95a16c0e8e09bebb44","observation_id":"f4899341-a8bb-4854-9603-6616abb63e6e","resolution":{"observed_at":"2026-08-12T05:39:22.194249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.211542Z","title":"A dataset for pharmacovigilance in German, French, and Japanese: annotating adverse drug reactions across languages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.211542Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:682211b2f473f8b9465b92fbcce336a42f055ceac388a1612bf425d1c13d15a8","observation_id":"1fe97e27-eb05-4540-ab75-05d9ecb0a5c4","resolution":{"observed_at":"2026-08-12T05:39:22.211542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.216622Z","title":"Automatic identification of COVID -19-related narratives in German Telegram channels and chats","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.216622Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6bb44205abdab886e4b95d52ab4c76e71ad19a16c8194c0e0ec51311e9a292cb","observation_id":"50e1079b-793b-4ec6-b4bf-fcde43722a46","resolution":{"observed_at":"2026-08-12T05:39:22.216622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T08:44:16.349116Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":200},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 100 of 200 outbound references and 0 inbound Pith citation observations for arXiv:2412.00230."}