{"as_of":"2026-08-08T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b5b7371084f20f180cb222889a6caf08690160b5045773170d8aecd83644256","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:28:22.701010Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17095/citation-record","integrity":"/paper/2505.17095/integrity","json":"/paper/2505.17095/citation-record.json","paper":"/paper/2505.17095"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:18.545896Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.545896Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:596e54f9bc5e61203465e3cd6f3faed581b090276b7dfb64efe63ebfb7dfe3d1","observation_id":"545e9168-9c1c-4fa1-a6d6-2160340b64ce","resolution":{"observed_at":"2026-08-07T15:28:18.545896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:18.676307Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.676307Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:8814b4f671cdd8e61cd4eeddb37562bd6505b47629eca74b37eccd90d65de681","observation_id":"3e199913-0c7e-493e-b552-1f73826b8e57","resolution":{"observed_at":"2026-08-07T15:28:18.676307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-07-06T18:58:35.218405Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-07T15:28:18.784104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.784104Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:a87921fd5558a8e36b96ba56f9a02b7c57e2047cd3de8a3f13f6a0e46eb20f18","observation_id":"6f031bff-9e47-4538-8380-c782f87652aa","resolution":{"observed_at":"2026-08-07T15:28:18.784104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-85003-w","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:25.883053Z","title":"Rahmani, and Youlin Li","venue":null,"work_id":"5b127dec-147c-4c1d-a4b0-52f7ed807bd8","year":2025},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:18.916189Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:00b47eff767986a1dc184905aea6fa83097f6f1c4db9b5ce227b929dc5699834","observation_id":"cb749c51-d812-4432-8d9b-66baad453fd4","resolution":{"observed_at":"2026-08-07T15:28:26.006630Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.025921Z","title":"Sebire, Saleh Khalil, Elham Asgari, Christopher Tan, Andrew Taylor, and Dominic Pimenta","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.025921Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:6cedfb26ed97900dfc3fabd8d3e7501087387e8ce315861495bc0e6e6d274ebb","observation_id":"35ad88a8-a0a5-4022-af59-67259a56e4ab","resolution":{"observed_at":"2026-08-07T15:28:19.025921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02039","last_updated":"2026-05-15T07:07:50Z","snapshot_observed_at":"2026-07-06T18:40:10.103133Z","submitted_at":"2024-07-02T08:11:18Z","title":"Prompt Stability Scoring for Text Annotation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02039","snapshot_observed_at":"2026-08-07T15:28:19.116860Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.116860Z"},"links":{"cited_paper":"/paper/2407.02039","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:5f9375107624901b8a2ff4797bab117b82fef16ebdb7f94ba973226d4e2ddea0","observation_id":"f0354ff8-c2e3-4b61-9a13-cabf543b041e","resolution":{"observed_at":"2026-08-07T15:28:19.116860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18346","last_updated":"2024-05-28T16:43:41Z","snapshot_observed_at":"2026-08-06T20:06:18.397322Z","submitted_at":"2024-05-28T16:43:41Z","title":"Intelligent Clinical Documentation: Harnessing Generative AI for Patient-Centric Clinical Note Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18346","snapshot_observed_at":"2026-08-07T15:28:19.270196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.270196Z"},"links":{"cited_paper":"/paper/2405.18346","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:5f08b7ff78ce0097fd5a843813cfbfdc84cd90f0c16e47f075be7f8a8ccd075a","observation_id":"03e9cc4a-01bd-4cd9-973f-6860447e380e","resolution":{"observed_at":"2026-08-07T15:28:19.270196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.clinicalnlp-1.1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:25.639135Z","title":null,"venue":null,"work_id":"94e2d914-7d2b-4268-9594-da991c826ca9","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.350669Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:43a3f083876eb9064a9b44dee0813a5f367b092bb89c41f59224feb24d00ef63","observation_id":"b5c38088-02c5-4497-a132-c5fa265f4781","resolution":{"observed_at":"2026-08-07T15:28:25.789786Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.419917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.419917Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:0e6a3a22d93d18b59d9db92b4378d7a2d87bd95d3cbcc808447ea4c69d93c044","observation_id":"4762bb75-b517-48c9-a52f-b6a177d21600","resolution":{"observed_at":"2026-08-07T15:28:19.419917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:19.474288Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.474288Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:1b5f7c61a647816eab9005c786b92aeb2ad6d44b3e537d3b29530716b1c45f35","observation_id":"016cd5c8-f737-4163-8f59-2481fb8ccbc1","resolution":{"observed_at":"2026-08-07T15:28:19.474288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s12553-021-00568-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:25.371221Z","title":"Nambudiri","venue":null,"work_id":"9087efe0-7c0d-4aaa-804c-69877b4a0e95","year":2021},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.553401Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:d1652d13dd4994cd3a7d98842fe966bef6a1c2c31a4e812c60e4e8e71303a638","observation_id":"db66a195-658c-4d4d-ad70-a76d807b50de","resolution":{"observed_at":"2026-08-07T15:28:25.516563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.clinicalnlp-1.36","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:25.041149Z","title":null,"venue":null,"work_id":"e0be1542-3d06-4dac-ba7c-1fe2d86093e9","year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.699109Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:8ba3abc926372543b3a5c889b149a621af4993f7131d44f03c1ee2d21fefbfe9","observation_id":"d218f442-d4aa-4f91-8526-093e25e86295","resolution":{"observed_at":"2026-08-07T15:28:25.211566Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/59617","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:24.788715Z","title":null,"venue":null,"work_id":"27fce42c-f65b-4f28-8713-fb0423c0909b","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.835466Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:2373a6d7b5c1402bd30763bef424c366bcbcac1758108aa87608bde3f543f4f2","observation_id":"8d3c30a9-5ce3-4dfe-aea0-71832e21c7cd","resolution":{"observed_at":"2026-08-07T15:28:24.911183Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/54419","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:24.466718Z","title":"Gold, and Vishnu Mohan","venue":null,"work_id":"97600af0-6ac2-443e-a746-2b6dcd86c0f6","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:19.997095Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:ac26d1f77170876be3c7bfed73cff61e67d918cfb46c644b5cd7be9e7b9f1bc2","observation_id":"b4f155b0-a035-4adf-bc0b-acfbe676b719","resolution":{"observed_at":"2026-08-07T15:28:24.646083Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.13211","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.847280Z","title":"Akdogan, Jessica Atkins, Mohamed B","venue":null,"work_id":"12792ab9-874a-4139-bad2-9695ff835f90","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.118227Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:4ba158211c32dca980da8a92e73c6fa14a491cc8db468516beb66712bae20915","observation_id":"0b00c702-a108-430f-b331-d05736248e93","resolution":{"observed_at":"2026-08-07T15:28:26.928726Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.633054Z","title":null,"venue":null,"work_id":"9b501a32-c360-4014-bd7e-a824809707ea","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.257178Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7d1214282807935d5f150ccf32440798c9490d0640175dc76e50f8545dee96d5","observation_id":"360da593-0879-41ae-b68d-d180032a3f19","resolution":{"observed_at":"2026-08-07T15:28:27.709683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.12445","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.667974Z","title":null,"venue":null,"work_id":"6eb1d5b4-029c-4142-af4f-3971fbea95cc","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.356613Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:52b8653a6e2bc14038a478f8052d9500df23ae7878f01f6badfb067247c619ce","observation_id":"471f0add-3d1d-4d98-b9e8-5ada45aac9cc","resolution":{"observed_at":"2026-08-07T15:28:26.715873Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"reader/2860305","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:26.466013Z","title":null,"venue":null,"work_id":"ae8a498c-d7be-4308-8ecd-8323d66573e3","year":2020},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.457250Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:8aee02b05db27dbfb568586b83b91c59729abc6769412926299bf3c264de071b","observation_id":"66b77b6c-3cb5-46a4-bb30-34e4f5e0ae11","resolution":{"observed_at":"2026-08-07T15:28:26.543053Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s12909-024-06048-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:24.224802Z","title":"McCoy, Faye Yu Ci Ng, Christopher M","venue":null,"work_id":"38126693-937d-4cd0-8e7d-577949a5c125","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.573090Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:1b1e43acbdb0542078e7893d08fb18ad8c202abff365aa07431f1b203e4d0030","observation_id":"f0bda5ea-ae83-4587-9ad0-18d2cf1f5e63","resolution":{"observed_at":"2026-08-07T15:28:24.346060Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ergon.2019.06.012","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:23.946538Z","title":"Pennathur","venue":null,"work_id":"05144e8e-e4fc-4f6b-b2be-fd0a338b0470","year":2019},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.719002Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:684f875bc0ee2d4219c498a15fd9cd51fa0ccb673216ffaaf3161a547e2d2db0","observation_id":"9c0539b9-67c4-4346-b6ec-8b8f6dc119f9","resolution":{"observed_at":"2026-08-07T15:28:24.065742Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:20.840862Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.840862Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:4510a6b18b3b78e2777bfade03d0624cafd13422ec141302f6f8418f7a69a60b","observation_id":"7076c52c-d4d9-4717-86ae-8babcc286d6f","resolution":{"observed_at":"2026-08-07T15:28:20.840862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-019-0190-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:23.691324Z","title":"Quiroz, Liliana Laranjo, Ahmet Baki Kocaballi, Shlomo Berkovsky, Dana Rezazadegan, and Enrico Coiera","venue":null,"work_id":"493870be-1193-436c-a822-8103c7e16170","year":2019},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:20.944217Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:042c6bcc1c9f0821eb5e51bd780eee5d033aa733f76f4219b2b390923e4c5ae2","observation_id":"3dd95755-3335-47c8-90c9-2a4a316c76e1","resolution":{"observed_at":"2026-08-07T15:28:23.800870Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.045394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.045394Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:c417717c1b50fa88b939c080e33f1f75aeba3885e35b5727b45231695c39f344","observation_id":"dcd1a8d0-97bd-4d35-a5ad-19a631f90eba","resolution":{"observed_at":"2026-08-07T15:28:21.045394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16478","last_updated":"2024-04-25T10:03:14Z","snapshot_observed_at":"2026-08-05T22:46:11.346164Z","submitted_at":"2024-04-25T10:03:14Z","title":"Evaluating Consistency and Reasoning Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16478","snapshot_observed_at":"2026-08-07T15:28:21.131043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.131043Z"},"links":{"cited_paper":"/paper/2404.16478","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:7fb7b84d45592ffd6e54874506fbf6abcd464585fccc128bb5528332fb70488b","observation_id":"8bcd07dc-8050-4cc9-8e32-0f41c6a7c13a","resolution":{"observed_at":"2026-08-07T15:28:21.131043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.489641Z","title":null,"venue":null,"work_id":"f507d492-fc3b-4773-a530-e6176d72ce97","year":2021},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.251803Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:4b047b88411edd07669a4472028cf11f62feffba207261fcb11e03307087bd1c","observation_id":"a08155d6-4545-4c81-90bb-908ddb7edd6c","resolution":{"observed_at":"2026-08-07T15:28:27.571936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/57721","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:23.374151Z","title":null,"venue":null,"work_id":"99e3da4e-cd68-4657-a752-77613abd4e11","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.397661Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:2a92c66103ddad6b0d3196b02cc8571a0745d843cb51bcada96da985d954d1ea","observation_id":"a31d8ed8-6421-4745-91a0-bf2c0f81b4a1","resolution":{"observed_at":"2026-08-07T15:28:23.505634Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00715","last_updated":"2025-05-27T14:58:40Z","snapshot_observed_at":"2026-07-06T18:08:21.770341Z","submitted_at":"2024-04-25T15:34:53Z","title":"Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation","version":6},"cited_work":{"arxiv_id":"2405.00715","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00715","snapshot_observed_at":"2026-08-07T15:28:26.149575Z","title":"Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation","venue":"cs.CL","work_id":"88675979-50e0-438e-b31c-feb5861409f0","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.525302Z"},"links":{"cited_paper":"/paper/2405.00715","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:b980d2897bbfbb8af9a0166ad0f662202853899a8c681c5be33f43a300393820","observation_id":"43ed2592-f723-4b4e-8681-1e7894b5f171","resolution":{"observed_at":"2026-08-07T15:28:26.272163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.711043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.711043Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:938c3f149f02ce3f05a1259c0ceac9c015e53778638978f02d73fca53f397bd3","observation_id":"a6267c53-5da6-4ecf-a5a7-6a05736bf0a9","resolution":{"observed_at":"2026-08-07T15:28:21.711043Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:21.819970Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.819970Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:d7293a9a35c227961fa96874154081b07fa5d4670c83d953e4d5fdb73d81fca0","observation_id":"52e6195b-9c5f-4d53-82b7-fd7a8ccc746e","resolution":{"observed_at":"2026-08-07T15:28:21.819970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/54811","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:23.147417Z","title":null,"venue":null,"work_id":"8264fdc5-e2ce-4098-b8f0-2341a270432a","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:21.958266Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:ccd41c791fa70bdc85d23a019cc552df91e78cc186b87c16f7e8b113801c5593","observation_id":"524d9d08-9753-4281-bfed-e5bb647aad90","resolution":{"observed_at":"2026-08-07T15:28:23.238463Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:22.130493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.130493Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:e1054ebc18c7029cb6a641d718993515556001466ca200b2ae7c5400b11cc3b3","observation_id":"3359e3e9-8a9c-4779-8484-ce2658534173","resolution":{"observed_at":"2026-08-07T15:28:22.130493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.356965Z","title":null,"venue":null,"work_id":"be2bad49-187f-472c-992c-76bea4c935d4","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.229663Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:f81296b3dd704e7cab8b7d7ecebd1c56467334164547441ea26d1081ed5194ba","observation_id":"224e5fb2-952e-4f34-9811-f7240bb54e4a","resolution":{"observed_at":"2026-08-07T15:28:27.413515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T15:28:22.370716Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.370716Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:4e94a6525101cf9c44791b8f63d50bcefb3e36a45495847c552d50470f19dbe2","observation_id":"2dd1728c-1d31-487b-b5fc-577f9164bcd2","resolution":{"observed_at":"2026-08-07T15:28:22.370716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3555111","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:22.872349Z","title":null,"venue":null,"work_id":"e241615b-4f6a-45ab-a6bd-5a9ef77b7277","year":2022},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.540412Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:f14bc7cd8412298b01c81f9e12cd050c15cd274b949d707e56d6e16fbeacc669","observation_id":"37bc608e-0626-4d53-ba53-32c804110b48","resolution":{"observed_at":"2026-08-07T15:28:22.995871Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:28:27.134373Z","title":null,"venue":null,"work_id":"051d555e-1ff2-4d58-8012-85b64989d140","year":2024},"citing_paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:22.701010Z"},"links":{"citing_paper":"/paper/2505.17095"},"observation_digest":"sha256:fb9e02eaef52aceb8ca4338456eab7d168efa15791bfb01786bc34f1f690c324","observation_id":"42334b87-d979-4a62-9709-4d43b0c01f1d","resolution":{"observed_at":"2026-08-07T15:28:27.263988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17095","last_updated":"2025-05-21T03:44:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:22:30.199753Z","submitted_at":"2025-05-21T03:44:13Z","title":"Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":5,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":18,"verified_exact":10,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.17095."}