{"as_of":"2026-08-17T17:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:625cb013e1446533ce25ddb7e58fe6965e04a50d4640add1f9f64accebcb096d","coverage":[{"denominator":200,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:39:22.216622Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00230/citation-record","integrity":"/paper/2412.00230/integrity","json":"/paper/2412.00230/citation-record.json","paper":"/paper/2412.00230"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.01172","last_updated":"2020-02-26T14:28:42Z","snapshot_observed_at":"2026-08-14T16:53:16.830193Z","submitted_at":"2019-04-02T02:09:01Z","title":"Recent Advances in Natural Language Inference: A Survey of Benchmarks, Resources, and Approaches","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01172","snapshot_observed_at":"2026-08-12T05:39:21.794528Z","title":"arXiv:1904.01172 (v2)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.794528Z"},"links":{"cited_paper":"/paper/1904.01172","citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:8fc4cc1c681e46c96e0d289b8d6cae86fbc16f1d6dff9cb47c5e63aa4690e76a","observation_id":"d6af6076-304d-4ec9-8e87-52a1aee6a747","resolution":{"observed_at":"2026-08-12T05:39:21.794528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.799612Z","title":"Data and its (dis)contents: a survey of dataset development and use in machine learning research","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.799612Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ec22a781d55c67e0ffd7a8a5d1171a5326d76fc5c28411e662ff10673ac91426","observation_id":"7641736b-a0c8-48d8-904a-0f199f363016","resolution":{"observed_at":"2026-08-12T05:39:21.799612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.803647Z","title":"Computational Methods for Corpus Annotation and Analysis","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.803647Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d0f3731c8fee66d9cb3b2d13ec229f53ddadd250752fc55688b9f5218550647d","observation_id":"af1ab74a-eb06-4648-b978-9de0a09bf504","resolution":{"observed_at":"2026-08-12T05:39:21.803647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.807466Z","title":"& Pustejovsky, James D., eds","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.807466Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2a33775095955fa524ca92a9abdf29e07c5512304ef62996803c8137d745083b","observation_id":"fe2ab205-b123-4b4e-a7c4-24399bf440dd","resolution":{"observed_at":"2026-08-12T05:39:21.807466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.811326Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.811326Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:83bb62919f0b11729bfbbd80c70836195c3dab37879765c8cd5e24ffbe57a38a","observation_id":"40fd766c-b122-41d2-b56c-b4b90630b7b2","resolution":{"observed_at":"2026-08-12T05:39:21.811326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.815186Z","title":"Two biomedical sublanguages: a description based on the theories of Zellig Harris","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.815186Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:498398360e40998a99dfb9b64057b532bb4fe6b4c7239dcca0de2d78c9a8a14f","observation_id":"3d711950-a6e7-47f6-8142-7369607b45fe","resolution":{"observed_at":"2026-08-12T05:39:21.815186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.819108Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.819108Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:8c64ddb7dbb81b96ba9f50a031003f31e8eafff3e7df1a29249aaadd3ccbb23f","observation_id":"552dd135-81dc-4f13-bbcc-39dc0ea0c474","resolution":{"observed_at":"2026-08-12T05:39:21.819108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.822555Z","title":"Document clustering of clinical narratives: a systematic study of clinical sublanguages","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.822555Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ec6b078fdec80b896629582d69cf7aa066bf06c860bf992efa9dc6aefc5da0f5","observation_id":"d30169a7-9a59-4c1f-82b1-c48aa2aec970","resolution":{"observed_at":"2026-08-12T05:39:21.822555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.826058Z","title":"Stylistic features of case reports as a genre of medical discourse","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.826058Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:947b4bb30c0d2c6ea4898300d6da3ba8480b83a9d95330aadbd178bf59e0716d","observation_id":"45255b4e-38d3-4bac-bd23-36e23bd05b74","resolution":{"observed_at":"2026-08-12T05:39:21.826058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.829982Z","title":"Cross -domain German medical named entity recognition using a pre -trained language model and unified medical semantic types","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.829982Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:67a202a8ac58a87e215a368266aee0d319900f65e1cff793148fe8079e18dbcb","observation_id":"edafc59f-af50-4797-9b8e-102835340080","resolution":{"observed_at":"2026-08-12T05:39:21.829982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.833598Z","title":"Annotation and initial evaluation of a large annotated German oncological corpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.833598Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b493897477f405b96268d5aee0214a5e8c88a5900d622af3310dec73d7c57519","observation_id":"176b7d17-09da-47f7-8d1a-29c95d3c3dab","resolution":{"observed_at":"2026-08-12T05:39:21.833598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.837298Z","title":"An annotated corpus of textual explanations for clinical decision support","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.837298Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2c92f933fe630843944487fffcb24f4229aad5550aada79b780b011adcfd981b","observation_id":"22a8ae6b-87dc-4825-b990-455ef27e4d54","resolution":{"observed_at":"2026-08-12T05:39:21.837298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.840789Z","title":"Building a German clinical named entity recognition system without in -domain training data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.840789Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3b8458f7ad29c8f0d973a80f9702cfca2838b0d034b0c97de6aaeedfb97cf2ac","observation_id":"5ea3ec64-b007-41dd-bc12-b3264ae4437f","resolution":{"observed_at":"2026-08-12T05:39:21.840789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.844143Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.844143Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c15dc2c936871833dac5b9bcd59a1135e3a258f475c391d82ef011748e918183","observation_id":"582f8054-6a0f-4ae4-be58-2aa67759e9ac","resolution":{"observed_at":"2026-08-12T05:39:21.844143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.847624Z","title":"A short review of ethical challenges in clinical natural language processing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.847624Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:1770f32252937a7c1dc2cca03c4d2f957fd119b39de93954c17e8ebd41719dec","observation_id":"d81f27a9-4fbd-453e-b4d2-c038723b5e71","resolution":{"observed_at":"2026-08-12T05:39:21.847624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.851385Z","title":"Semi -automated de- identification of German content sensitive reports for big data analytics","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.851385Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:16a0a16002f450e8c2969567fbe5771b0dc05ce3450172ae81a8aaca6af83fe4","observation_id":"8f2f07a9-ce60-4f1c-81c0-3e695a2b47a7","resolution":{"observed_at":"2026-08-12T05:39:21.851385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.854722Z","title":"De-identifying GraSCCo: a pilot study for the de -identification of the German Medical Text Project ( GeMTeX) corpus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.854722Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:4a8404ac1c9e08145b72f7d7534f56ae3960575e9e22e758ddb07468dc85c549","observation_id":"c1b6be2d-c7d8-4dc0-bac0-2d9f038555da","resolution":{"observed_at":"2026-08-12T05:39:21.854722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.858421Z","title":"How to improve information extraction from German medical notes","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.858421Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:0c183176aff8fa1e13c6c7e6cc4a253920caf34dda561d2094f8ceb9b3b24f62","observation_id":"e5a357ed-b927-415c-bb4c-d316d9f2ee83","resolution":{"observed_at":"2026-08-12T05:39:21.858421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.861940Z","title":"German medical natural language processing: a data-centric survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.861940Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ccc414993ccdd62e4663702bec50708ff1648369646e4b2fffd57b21949fc763","observation_id":"c5e05f6e-f191-4fa3-97c1-4717db190e7f","resolution":{"observed_at":"2026-08-12T05:39:21.861940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.865478Z","title":"Preferred reporting items for systematic reviews and meta-analyses: the Prisma statement","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.865478Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:cb9325123703a24eb471c31e7f8ad47c96639998ddf13b9ed29a86e7d17c0316","observation_id":"c4dfd97d-6266-4dff-8b13-8c9526a3da9e","resolution":{"observed_at":"2026-08-12T05:39:21.865478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.869046Z","title":"An annotated German-language medical text corpus as language resource","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.869046Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:351243749621dd067f91fa2bd842b15516c03aa238aedb84cb411bb3701952fc","observation_id":"ad4bfd39-d195-4c24-9fe5-4a48a1b5281d","resolution":{"observed_at":"2026-08-12T05:39:21.869046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.872648Z","title":"Disclose models, hide the data: how to make use of confidential corpora without seeing sensitive raw data","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.872648Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:40d58c3e04b675cbd4cdae0bc9e30912d0fb7d46070240497d6ee46c518fdaba","observation_id":"0b60ebe0-48ca-4e6b-86cf-76ea588ebce7","resolution":{"observed_at":"2026-08-12T05:39:21.872648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.876422Z","title":"Sharing models and tools for processing German clinical texts","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.876422Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ade9b5d21fb53397939692168dbef1ebd86c4bd3e9935b02ca06183f696f9057","observation_id":"d2d51e3b-00d7-46a0-a520-41089d1e1965","resolution":{"observed_at":"2026-08-12T05:39:21.876422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.879998Z","title":"Biomedical data mining in clinical routine: expanding the impact of hospital information systems","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.879998Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9bdc37946c29dddd5d0b8fe5ca8b436e0765802e2f293f7b2f1ce5526a3ae831","observation_id":"68542d43-f941-41ad-8547-90d4b998cfbb","resolution":{"observed_at":"2026-08-12T05:39:21.879998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.883597Z","title":"Enhanced information retrieval from narrative German-language clinical text documents using automated document classificati on","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.883597Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:fbe32722585d22ab125a0ace358facfd5cdcc32c46c28a7e290df73d344409f9","observation_id":"7098ca8b-0bbe-4f91-a301-0d45012b472a","resolution":{"observed_at":"2026-08-12T05:39:21.883597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.887440Z","title":"Truecasing clinical narratives","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.887440Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f47a6e14cfd4a07d5effeb34eb30fdc46b29b6491ba5a6c88f212964003ec409","observation_id":"4ed18497-5db8-4d0c-bca6-72062471c88b","resolution":{"observed_at":"2026-08-12T05:39:21.887440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.891590Z","title":"Information extraction from unstructured electronic health records and integration into a data warehouse","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.891590Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6f8d2ca46d7009a8928a7210dea4ad5bdfeee04a7c577da2d3fe262c6edaf9e0","observation_id":"9291be7d-6a7f-4c61-bbf9-5853d3cc4e5e","resolution":{"observed_at":"2026-08-12T05:39:21.891590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.899040Z","title":"Identifying pathological findings in German radiology reports using a syntacto -semantic parsing approach","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.899040Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:669f6face222fa9dbbbcade908d48ab5b3a2a872e6dd13dc60aaf4ff2c26da99","observation_id":"8ac4d1ed-162c-401e-a885-72a815685249","resolution":{"observed_at":"2026-08-12T05:39:21.899040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.906550Z","title":"Corpus-based translation of ontologies for improved multilingual semantic annotation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.906550Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ade60fa69c4c45657b03b08ae8e664cbb051a95210078f062d8ed0f29fb58205","observation_id":"8e01229c-d5db-41d1-8724-9e253ac53255","resolution":{"observed_at":"2026-08-12T05:39:21.906550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.910630Z","title":"Fine-grained information extraction from German transthoracic echocardiography reports","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.910630Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3319c58f91b18fb2f2e821bf995ed26e839c0d76b759be9adc2b1bf8665b1f27","observation_id":"c0b43f2f-b747-4e91-aa20-91cacda165a9","resolution":{"observed_at":"2026-08-12T05:39:21.910630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.914918Z","title":"A corpus of German clinical reports for ICD and OPS- based language modeling","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.914918Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e5561ae8d111983eb93399ef2404aa70a6b8442c97fee8aba176c5abf999dc1e","observation_id":"027bb04e-d137-4281-ae49-e4ba79c115e6","resolution":{"observed_at":"2026-08-12T05:39:21.914918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.919053Z","title":"Automated classification of selected data elements from free -text diagnostic reports in clinical research","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.919053Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:60b0218c4ca9a8fc2abd39f6c24d0ad12df0cdc6aabf91008f80a50dca63968c","observation_id":"7899f1d0-779e-4d46-b717-e3fd774cc310","resolution":{"observed_at":"2026-08-12T05:39:21.919053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.923376Z","title":"A fine -grained corpus annotation schema of German nephrology records","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.923376Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:29f1e619b02536d355c7ffd66d373e0f5ac6c79cb3181cf11e04f5c72bd5dd0d","observation_id":"a0ea1713-477e-4575-90a0-1050c2369b8c","resolution":{"observed_at":"2026-08-12T05:39:21.923376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.927532Z","title":"Unsupervised abbreviation detection in clinical narratives","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.927532Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b660da06878ab9a316c195dd213fa0840b1e582a99fc1d1ef222f79996db030d","observation_id":"4592fec0-0464-4264-80b2-e601bfae2a81","resolution":{"observed_at":"2026-08-12T05:39:21.927532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.931635Z","title":"Negation detection in clinical reports written in German","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.931635Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:3aa9c27648e87f9c958f04d1c786f552f74b725d0db87425996a9522f2cce081","observation_id":"ab30f5e7-5d42-4d80-b6eb-92f2eb68c8e0","resolution":{"observed_at":"2026-08-12T05:39:21.931635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.935691Z","title":"Unsupervised abbreviation expansion in clinical narratives","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.935691Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:43290f439b35be8b58b697e886ccffb52ec5c07e44c17a6da86bf6f4a7803144","observation_id":"08ad669e-20c5-4341-892d-eb09a615ee41","resolution":{"observed_at":"2026-08-12T05:39:21.935691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.939743Z","title":"Detecting named entities and relations in German clinical reports","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.939743Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:cf26326807c4c99ee86c518a4a2d89fd95c9bf5aaf922e5a07d6ae6da3fe71ff","observation_id":"5ea258c8-35ce-4235-a19f-91577cebd137","resolution":{"observed_at":"2026-08-12T05:39:21.939743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.943822Z","title":"Semi -automatic terminology generation for information extraction from German chest X-ray reports","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.943822Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:87e21b53f30834c45c4b50c45631c6561eb1fece392d51297c3a3ecc1250a5e1","observation_id":"fdeb5c54-44d4-474d-9e69-ceec74ad9ab7","resolution":{"observed_at":"2026-08-12T05:39:21.943822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.947863Z","title":"3000PA: towards a national reference corpus of German clinical language","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.947863Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:68ebb322725a8dab4dc26fa5d8f2129050dbff088198ba478fb578d7a6d8db88","observation_id":"25923c5b-d99d-4438-b086-98683c902835","resolution":{"observed_at":"2026-08-12T05:39:21.947863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.952427Z","title":"CDA- compliant section annotation of German -language discharge summaries: guideline development, annotation campaign, section classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.952427Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:802eb3b4da97c834f758ebf90faad2a853c52839cca3b16b27c7edd329b43bea","observation_id":"cab86d48-4ad5-48af-bbef-c118108929ad","resolution":{"observed_at":"2026-08-12T05:39:21.952427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.956616Z","title":"Natural language processing of German clinical colorectal cancer notes for guideline - based treatment evaluation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.956616Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:43f6a67ea65f550209792e9456299a3d86bc12ee3ba17eba477885c6252b0f3d","observation_id":"23285fe5-7d0e-4a01-92fd-58f94ddcb78a","resolution":{"observed_at":"2026-08-12T05:39:21.956616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.895197Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.895197Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c1db23591eedc1a5ca1b55a5ab15380f22607a5cc7e93bb9df92b4cc710dfe11","observation_id":"09cbba1e-3d56-4cbb-bc09-af6c04a5eec5","resolution":{"observed_at":"2026-08-12T05:39:21.895197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.965115Z","title":"Deep learning approaches outperform conventional strategies in de-identification of German medical reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.965115Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:7e2478cbd2646d76fe2902b59c66aad0a30ae8917bd788add332d6f190caed96","observation_id":"9900b85f-96dd-4b6c-8b15-7a0fa58b3221","resolution":{"observed_at":"2026-08-12T05:39:21.965115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.960719Z","title":"Annotating German clinical documents for de - identification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.960719Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6b38dc09c1530410fc49c405bd29b48f298747d0e0c60453a53ca7fa7f7b89a4","observation_id":"dccb2726-e632-492e-beb9-1151e7acfd91","resolution":{"observed_at":"2026-08-12T05:39:21.960719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.972953Z","title":"An evolutionary approach to the annotation of discharge summaries","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.972953Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:c03de47536f7de9597b6657cc9647f604092c2d25a98f4a297e087e40cce6556","observation_id":"253a44bc-2d0f-4fee-bea3-4b12b48f9476","resolution":{"observed_at":"2026-08-12T05:39:21.972953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.969059Z","title":"Knowledge-based best of breed approach for automated detection of clinical events based on German free text digital hospital discharge letters","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.969059Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d32c30b64f2d749408afe0909e83a39818fbaf0b8d8e87a06e06423a13171e22","observation_id":"d60d87f5-38da-4fb2-8816-7d9820494aaa","resolution":{"observed_at":"2026-08-12T05:39:21.969059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.981045Z","title":"Information extraction models for German clinical text","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.981045Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2525fbe386ac631104555b74dbbcbd271e43bdc62f3bb2f108d0d7b5448420e6","observation_id":"9f4d94db-cae6-46de-90de-bcb5116d8c42","resolution":{"observed_at":"2026-08-12T05:39:21.981045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.977052Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.977052Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:04b19bc9c207af2a0451ad0078fc5456482cc2e494b6987eef48c6851a846b39","observation_id":"cf92986d-24bc-4dba-bb0b-901f95636a71","resolution":{"observed_at":"2026-08-12T05:39:21.977052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/20552076211057662","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.688653Z","title":"Automatic extraction of 12 cardiovascular concepts from German discharge letters using pre -trained language models","venue":null,"work_id":"07bac647-edf4-4062-978a-f98215c935d2","year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.989711Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6e527dd59c744e05779e36482cf1fb11bc2bd02ee8e68d64409e8b3a95c267da","observation_id":"9251d8aa-4af7-4a7e-a5c4-3bd9a195dd44","resolution":{"observed_at":"2026-08-12T05:39:22.693765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.985510Z","title":"Merkmalsextraktion aus klinischen Routinedaten mittels Text-Mining","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.985510Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:45a9db32b9f23e1fba348284e0af3de26934cf588989bab0883b360187f62fe8","observation_id":"be6f2349-b7d6-44d8-b545-a40c03825754","resolution":{"observed_at":"2026-08-12T05:39:21.985510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.998511Z","title":"Using a corpus-assisted discourse studies approach to analyse gender: a case study of German radiology reports","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.998511Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9214d6d11d4670e97923a7100046086dced8c96b7bc4b868971286bfbfe3d392","observation_id":"b18b5e40-af64-4508-90d4-0413129ad758","resolution":{"observed_at":"2026-08-12T05:39:21.998511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:21.994107Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:21.994107Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6754110110eaca3d1552ebb550b9242d2dbb3de8a48c919a7ee98d1d7a9a23cb","observation_id":"2473128d-40f2-4882-9822-fd2efba4d1c0","resolution":{"observed_at":"2026-08-12T05:39:21.994107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.03885","last_updated":"2022-08-15T13:39:45Z","snapshot_observed_at":"2026-08-16T16:47:23.076101Z","submitted_at":"2022-07-08T13:19:19Z","title":"A Medical Information Extraction Workbench to Process German Clinical Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.03885","snapshot_observed_at":"2026-08-12T05:39:22.007645Z","title":"arXiv preprint arXiv:2207.03885","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.007645Z"},"links":{"cited_paper":"/paper/2207.03885","citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e3852393a4575dc11b776e81c00de247f5f04d523f8df625ec0a59c61e7349bb","observation_id":"e7004597-fc89-4cdd-85a0-e39761256c97","resolution":{"observed_at":"2026-08-12T05:39:22.007645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.003526Z","title":"Deep learning-based detection of psychiatric attributes from German mental health records","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.003526Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:59292afbd15405dda9505792da42d5e4bed6d5654c14399c05e33a04cd0598ab","observation_id":"643aace9-0328-4098-9c2b-9c0d95011d6a","resolution":{"observed_at":"2026-08-12T05:39:22.003526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.017045Z","title":"Patient - friendly clinical notes: towards a new text simplification dataset","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.017045Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:0be4dbfe01f73c49454e438fd38806d9de46149f0bcfee8c3a477f7372e8d24b","observation_id":"c8b2d2f2-12a5-408a-9400-3509c0b3909e","resolution":{"observed_at":"2026-08-12T05:39:22.017045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.012883Z","title":"A domain -adapted dependency parser for German clinical text","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.012883Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:474444ef9ad7f9df34dc736a2e036cac4cebdd6b0d541d1c4c0b2456e8326465","observation_id":"819701dc-cad1-427d-bb6c-303bd29cde97","resolution":{"observed_at":"2026-08-12T05:39:22.012883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.027119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.027119Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:fceaad9f3ce044c4e2598d8928db3e1a4a3abb74849e4ebdd46faec198aca868","observation_id":"5894918f-a407-466a-941f-ea86515f41ae","resolution":{"observed_at":"2026-08-12T05:39:22.027119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.021735Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.021735Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:5de94b014209bef9eeb924185068cfca615dac056e2beb0f71b6f8d8c141381e","observation_id":"6e207615-43bc-4d73-8e00-07c88736c021","resolution":{"observed_at":"2026-08-12T05:39:22.021735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.035259Z","title":"Announcement of the German Medical Text Corpus Project ( GeMTeX)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.035259Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:9b59dc9985a8b8998fd54841994932a82808dff83467fff1fb353d3cb9ed97bd","observation_id":"3ad330e4-4293-49a4-9673-876fadfa4104","resolution":{"observed_at":"2026-08-12T05:39:22.035259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.031365Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.031365Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:217b03ef24dc762e8db85729954ee54e2483e4339ab8c4ddb3f9c4f3b5ba1e3f","observation_id":"3cd79cfc-e8b8-4788-8e86-7f2b14599997","resolution":{"observed_at":"2026-08-12T05:39:22.031365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.044028Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.044028Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:eaa35916394859a83c80f3056d07a22ea71bba0d98802cf36c5714efbb268792","observation_id":"8c25b791-362c-434f-9155-b687dbb19264","resolution":{"observed_at":"2026-08-12T05:39:22.044028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.040003Z","title":"Final report on the German clinical reference corpus 3000PA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.040003Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:649186a4d923bb68d76d11785b6868a16080d8c935c4c2eac7f09fb688247c69","observation_id":"60be8ccd-72f5-4caf-96ca-bc4efcff2d1f","resolution":{"observed_at":"2026-08-12T05:39:22.040003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.052834Z","title":"Masketeer: an ensemble-based pseudonymization tool with entity recognition for German unstructured medical free text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.052834Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d1a84b60456e66e27f1c0295138ba06600a0ba848879d8ee64217e2f3f247870","observation_id":"115ba6b0-a149-4e05-9b4a-a2eb3a237bc7","resolution":{"observed_at":"2026-08-12T05:39:22.052834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.048821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.048821Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:95c9addf2ad421c1531ab8fba638a32383f8afde4af62818e8ac5246f0cc36e1","observation_id":"04da8f02-c9d3-4514-8b5f-17486870b6a1","resolution":{"observed_at":"2026-08-12T05:39:22.048821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.061927Z","title":"Extraction of UMLS® concepts using Apache cTakes™ for German language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.061927Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f41e27919af3ce7676fe898ee4b2532d75d11b7604661c81011b70ac4dba7604","observation_id":"b60548d4-0385-4560-bb4c-be7d4e65f529","resolution":{"observed_at":"2026-08-12T05:39:22.061927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.057994Z","title":"Zero -shot LLMs for named entity recognition: targeting cardiac 28 function indicators in German clinical texts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.057994Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:12ebd730de10e94a9fbc58cb0ac1269bb572223593ebfb2ba3f7ba6203406e89","observation_id":"2c2759b9-a586-4d1a-9e16-cfd64623f5cc","resolution":{"observed_at":"2026-08-12T05:39:22.057994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.070000Z","title":"Software Impacts, 11:#100212 [4 pp.]","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.070000Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e2f35c271ff08b6364e33fc734218af78597c5cf6d38855e328ec34eed0505fa","observation_id":"7c2ac78d-6e9e-4f45-9489-bad85de7b52d","resolution":{"observed_at":"2026-08-12T05:39:22.070000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.065811Z","title":"F., & Leveling, Johannes, & Kelly, Liadh, & Goeuriot, Lorraine, & Martínez, David, & Zuccon, Guido (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.065811Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:448505b82e653136a529c6e00c11e4bb78ca0e99521ae838ffd181611e51dc68","observation_id":"2c425369-c7aa-4e1b-ad20-ee518774f592","resolution":{"observed_at":"2026-08-12T05:39:22.065811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.078636Z","title":"2018 n2c2 Shared Task o n Adverse Drug Events and Medication Extraction in Electronic Health Records","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.078636Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:bc93ec1909769201a93f50b28a9a4fa51a1e13a328e890c8b39068a81997d86d","observation_id":"37c78ec5-d69b-4722-8729-ce53b5f7df1c","resolution":{"observed_at":"2026-08-12T05:39:22.078636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.074751Z","title":"German medical named entity recognition model and data set creation using machine translation and word alignment: algorithm development and validation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.074751Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:02c87183024a67af56ad4de60f771b93f9fdba9044d1d5f69edc90e82ad3b46b","observation_id":"c8b3ff53-9a3e-4705-bf6d-f39ac0e5cb86","resolution":{"observed_at":"2026-08-12T05:39:22.074751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.086069Z","title":"Harnessing the power of LLMs in practice: a survey on ChatGPT and beyond","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.086069Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:e8faa5c7111cf44061fa2dbee5d6d63b6bc3dd06efa196b275da537388297546","observation_id":"b587a46c-cb5d-4fa0-ac49-bacae2ebdff6","resolution":{"observed_at":"2026-08-12T05:39:22.086069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.082396Z","title":"GerNERMed++ : semantic annotation in German medical NLP through transfer -learning, translation and word alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.082396Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b5be654880be4d3e76b76fcbac2a25a67a1683649e08aada186532514ae0d8a0","observation_id":"e3180517-e4a9-456e-9016-14442ec5bbb7","resolution":{"observed_at":"2026-08-12T05:39:22.082396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.094050Z","title":"Sharing copies of synthetic clinical corpora without physical distribution: a case study to get around IPRs and privacy constraints featuring the German JSynCC corpus","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.094050Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:69680db5eb83b4a2487d7742e1582a873a2807f6b3fd604e708a0f11399d33a3","observation_id":"66f2ed6f-20a3-4ea5-b50c-b2a281097030","resolution":{"observed_at":"2026-08-12T05:39:22.094050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.090181Z","title":"A comprehensive survey on pretrained foundation models: a history from Bert to ChatGPT","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.090181Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:7ec26dc8852797f377edcd71b09c60e326660c45469872a6f44b5a0c2f540287","observation_id":"8c19cd3f-fe4d-4395-a4a7-244eed174b2c","resolution":{"observed_at":"2026-08-12T05:39:22.090181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.103924Z","title":"Annotated dataset creation through large language models for non-English medical NLP","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.103924Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:25c715b1b8a21a7ee6ec5f07a0c14f337d8c265cfed92ea773a6d452b5e437d7","observation_id":"d61207fe-8017-424a-b871-b34f603e5c37","resolution":{"observed_at":"2026-08-12T05:39:22.103924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.098945Z","title":"GraSCCo : the first publicly shareable, multiply-alienated German clinical text corpus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.098945Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:09e9928a9031a18aca0bb15d9b1c6a17bbdfb9f000fc1e384057c94d55a0bdfa","observation_id":"a63a355a-ed02-41b7-9edd-699841769823","resolution":{"observed_at":"2026-08-12T05:39:22.098945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.111719Z","title":"Privacy risks of general -purpose language models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.111719Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d9bf0879bc1090295ef873cef98d2cfb36b771be46db96cfaff23f96b8d0510e","observation_id":"bb14d7ab-af11-4f62-bfff-f51d259e9369","resolution":{"observed_at":"2026-08-12T05:39:22.111719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.107869Z","title":"Lernen, Wissen, Daten, Analysen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.107869Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:22f3228eddabc435938130bdaa0b90267fff0eb0e531bcfe89aa1387c88fbc56","observation_id":"89e91f57-140b-456e-be54-5e036897b858","resolution":{"observed_at":"2026-08-12T05:39:22.107869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.120096Z","title":"Clinical text anonymization, its influence on downstream NLP tasks and the risk of re -identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.120096Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:a89e538fce51ae020e4d3f47d72ca744ba8026583453babcfdf23ac96d128db7","observation_id":"9781586b-67a2-4cbb-938f-9f8d8af7a49d","resolution":{"observed_at":"2026-08-12T05:39:22.120096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.115909Z","title":"Extracting training data f rom large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.115909Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:50b86abcc27379e98af6b39cc50e24eea7553a01035ab29a8deacb39d36c4226","observation_id":"ddbd69a1-8a1e-4c07-a98d-8d76caea64ed","resolution":{"observed_at":"2026-08-12T05:39:22.115909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.129026Z","title":"Semantic annotation for concept -based cross -language medical information retrieval","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.129026Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:51ffdb52e7008723823db43f31d8430da5d54e90461abb2b8ec36cd67774abe2","observation_id":"d9541c3f-e420-43c0-9ed9-c2d768f8b2b5","resolution":{"observed_at":"2026-08-12T05:39:22.129026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.124421Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.124421Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:350c5eed3179bc5f4dd4cfc7edd52cf8954ae8cee8c8cc27b612f01c99393575","observation_id":"a5fc5272-f6bb-45c3-a828-3505f645ba72","resolution":{"observed_at":"2026-08-12T05:39:22.124421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.138089Z","title":"Customizing parallel corpora at the document level","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.138089Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:a0a773e0b2faf3c8fe9b705d13c11d1ee6fc7562f8589a99a35f368a018ba61d","observation_id":"eb0eb0ed-86d2-4eae-a25e-5669bc3fc5ef","resolution":{"observed_at":"2026-08-12T05:39:22.138089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.133110Z","title":"Cross -language MeSH indexing using morpho-semantic normalization","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.133110Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2687a94e70095429a4aa147294f75c6a25262fc7cae9ff0200a17d52e4c9234a","observation_id":"2f214c9c-3b23-4569-b670-16695c087120","resolution":{"observed_at":"2026-08-12T05:39:22.133110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.146769Z","title":"Collaboratively annotating multilingual parallel corpora in the biomedical domain: some Mantras","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.146769Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:a5e6bd8609130c1582db70d38f63258e353bb0502ac3901d4ae3ebd6fb7b4ddd","observation_id":"551a0acc-499b-42ff-8b8d-4b8138ee0395","resolution":{"observed_at":"2026-08-12T05:39:22.146769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.142039Z","title":"Revising the compositional method for terminology acquisition from comparable corpora","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.142039Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:efc525ca0b54f7c822ed625af62b255912ce995d0309f953cf5aa8b5e1e766f7","observation_id":"dad453df-af47-4e28-9b2e-3cc3b72a2bf7","resolution":{"observed_at":"2026-08-12T05:39:22.142039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.155737Z","title":"Version 1.0","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.155737Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:d54f19aee9e941bab1a569a337ccc77290670f074f94a31496ab5c63d1ccf678","observation_id":"278156ab-a04e-4d6c-812c-b26dc255de4c","resolution":{"observed_at":"2026-08-12T05:39:22.155737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.150856Z","title":"A multilingual gold -standard corpus for biomedical concept recognition: the Mantra GSC","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.150856Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:25c7b1a0f126a4687b33410856b338bda8dcff2fb46277c1d3c64fe98fbfea89","observation_id":"1f10076c-d850-4227-b137-8c0cf7c4d285","resolution":{"observed_at":"2026-08-12T05:39:22.150856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.164900Z","title":"On the construction of multilingual corpora for clinical text mining","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.164900Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:b5581fff37b5a6816b9a50625129d63fc49239142adec36fcd8b99d6f9a24292","observation_id":"3b9a479e-f93c-4d48-b506-a2645fef9ea6","resolution":{"observed_at":"2026-08-12T05:39:22.164900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.160033Z","title":"Leveraging Wikipedia knowledge to classify multilingual biomedical documents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.160033Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:ea96566c3206be6421b29d0c0ee68c89c3adb0beba2a1c4d7ed7315d6291edd1","observation_id":"751416c8-8c33-4071-aa67-e28e31bb0868","resolution":{"observed_at":"2026-08-12T05:39:22.160033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.173593Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.173593Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:2f6704e195b48c2d2fb386c2568a6b509ae6dad7ef24abf59a8fcd996c29acdc","observation_id":"263548c9-6bd5-4703-9e8d-3e76db7e9adb","resolution":{"observed_at":"2026-08-12T05:39:22.173593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.168948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.168948Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:92bcfd2ef7040ce5caaba4c9934e7518f7f3e7c74f0dbde2078c41557f01d03a","observation_id":"0682e9d4-1aba-4478-bd70-76a348d39b75","resolution":{"observed_at":"2026-08-12T05:39:22.168948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.182396Z","title":"Sector: a neural model for coherent topic segmentation and classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.182396Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:017070db300bb8c97d1703f2ce4e8939b5a42497147f33e5631d22bf1c968576","observation_id":"70f6a6a8-72bc-4460-a3e3-22a594d11cd0","resolution":{"observed_at":"2026-08-12T05:39:22.182396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.177590Z","title":"Crit ical assessment of transformer-based AI models for German clinical notes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.177590Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:44d2408b68dd8aca91d1b65224bba92eb1b94f80373fc0ad8b28861aac29cf42","observation_id":"96bc4b47-d3b6-40de-aadc-32e11446213e","resolution":{"observed_at":"2026-08-12T05:39:22.177590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.190162Z","title":"Tracking and analyzing recent developments in German-language online press in the face of the coronavirus crisis: cOWIDplus Analysis and cOWIDplus Viewer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.190162Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:6e36419c6db641e818415f22e3687f504efe154ce13e2e71d9b356f25d862a7c","observation_id":"1950caea-e6b7-4186-b49d-07d741666ac6","resolution":{"observed_at":"2026-08-12T05:39:22.190162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.186270Z","title":"From witch’s shot to music making bones: resources for medical laymen to technical language and vice versa","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.186270Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:cb747251a933f96f10005bd0dc7c26949630c80d98e1dc093ac4d9064a34c1b6","observation_id":"1b827318-53b0-4043-be92-197f7c53c612","resolution":{"observed_at":"2026-08-12T05:39:22.186270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.198367Z","title":"Fang-Covid: a new large -scale benchmark dataset for fake news detection in German","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.198367Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:40478ae4922e56dc56234d2636ee0086a876c9b2c531b16bb3ae14049d78ad14","observation_id":"cc54bef6-ea4e-4c50-a9c0-e4da5a4061aa","resolution":{"observed_at":"2026-08-12T05:39:22.198367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.194249Z","title":"Investigating label suggestions for opinion mining in German Covid-19 social media","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.194249Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:f3739d556908b2fa02349be7f7ec76be532a366e16b8b1c1cb63190ab1a02112","observation_id":"f4899341-a8bb-4854-9603-6616abb63e6e","resolution":{"observed_at":"2026-08-12T05:39:22.194249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.211542Z","title":"A dataset for pharmacovigilance in German, French, and Japanese: annotating adverse drug reactions across languages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.211542Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:7b16650262aaa6997d7aa0eafb0c9add71ace058c7787804eb1ced4ce9668595","observation_id":"1fe97e27-eb05-4540-ab75-05d9ecb0a5c4","resolution":{"observed_at":"2026-08-12T05:39:22.211542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:39:22.216622Z","title":"Automatic identification of COVID -19-related narratives in German Telegram channels and chats","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T05:39:22.216622Z"},"links":{"citing_paper":"/paper/2412.00230"},"observation_digest":"sha256:79691e58dafc7d07cc96311aa6cc08a6494590456ae942396fe1664152f1c7bd","observation_id":"50e1079b-793b-4ec6-b4bf-fcde43722a46","resolution":{"observed_at":"2026-08-12T05:39:22.216622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.00230","last_updated":"2025-02-18T20:17:34Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T05:33:32.860645Z","submitted_at":"2024-11-29T19:56:58Z","title":"Clinical Document Corpora -- Real Ones, Translated and Synthetic Substitutes, and Assorted Domain Proxies: A Survey of Diversity in Corpus Design, with Focus on German Text Data"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":200},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 200 outbound references and 0 inbound Pith citation observations for arXiv:2412.00230."}