{"as_of":"2026-08-09T20:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8632c0ca4c0c61a7e572d622cd976fdf93fedcaa05de074de4d12bdbcd7e1e7d","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T00:11:49.586225Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26333/citation-record","integrity":"/paper/2607.26333/integrity","json":"/paper/2607.26333/citation-record.json","paper":"/paper/2607.26333"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:42.735365Z","title":"On model evalu- ation under non-constant class imbalance, in: International Conference on Computational Science, Springer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:42.735365Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:d3bb6e97a31076a3388733cad4a85343fdc11c95b4db95b8d8edc71d9007d5b1","observation_id":"3fedd4b4-4993-4ccc-87e9-ccd7b58a017d","resolution":{"observed_at":"2026-08-01T00:11:42.735365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:42.813571Z","title":"A study of why we need to reassess full reference image quality assessment with medical images","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:42.813571Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:ad0cbaa48b3b4ab98a1424e3f38b146b396b4bf956cd0d78fed9e0cd76e09cbb","observation_id":"dab6dee2-77a5-405c-af8f-528b418bc00f","resolution":{"observed_at":"2026-08-01T00:11:42.813571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:42.970641Z","title":"A study on the adequacy of com- mon iqa measures for medical images, in: Su, R., Frangi, A.F., Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:42.970641Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:ce0170ef0ce05e88af94e7fabb96d0c7c5180733a965e2c723a778d83017d137","observation_id":"805f847a-20b4-4b19-a472-98ad645b9e76","resolution":{"observed_at":"2026-08-01T00:11:42.970641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.086690Z","title":"Padch- est: A large chest x-ray image dataset with multi-label annotated reports","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.086690Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:034df2c9b5f8dd64e3401bdfe398b5ee7035814071de8a77d0256c5fa3c69a38","observation_id":"0d08084f-df88-4531-8d22-224dfe735479","resolution":{"observed_at":"2026-08-01T00:11:43.086690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.180334Z","title":"Why almost all ml models for medicine are wrong-and what we need for evidence-based medical ai","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.180334Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:2b8d6dc080edf1c3f0b12f0695bb4e0400135f0f03dfadd56136fe51cd7ac56c","observation_id":"7c3e1b4b-892e-4f2f-8d4a-d91df3763f62","resolution":{"observed_at":"2026-08-01T00:11:43.180334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.282048Z","title":"A simple frame- work for contrastive learning of visual representations, in: International conference on machine learning, PmLR","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.282048Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:b8ca39cdcb8e68b4506b92a9abe5244830e71b6b011ac0c4d9802442f8fb0ebf","observation_id":"00485add-ab30-4b4e-8ccc-a6cc06631fe4","resolution":{"observed_at":"2026-08-01T00:11:43.282048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.366017Z","title":"Towards unifying medical vision-and-language pre-training via soft prompts, in: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.366017Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:40983ee9b8b3964dced0096431dcb20853c6ce69027d70ff43203f2d9dbe9126","observation_id":"259eee47-b02a-4ef8-a242-e3c37bbcf3a8","resolution":{"observed_at":"2026-08-01T00:11:43.366017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.522627Z","title":"A coefficient of agreement for nominal scales","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.522627Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:5ddeffa7bdc7282f7c829c596bf0682a8ff94d76a36117ba691bfd15a52f475d","observation_id":"59a6c268-2666-4e4f-9a31-472e06a3dd6d","resolution":{"observed_at":"2026-08-01T00:11:43.522627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.665004Z","title":"Weighted kappa: Nominal scale agreement provision for scaled disagreement or partial credit","venue":null,"work_id":null,"year":1968},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.665004Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:10e91b1abff1bb0c64fb0a6cc30c9c8b7383e71f62eac2b8f376c744484ba651","observation_id":"3db369bf-6f9f-4fa9-b583-5d399a9271c9","resolution":{"observed_at":"2026-08-01T00:11:43.665004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.792441Z","title":"On the limits of cross-domain generalization in automated x-ray prediction, in: Medical Imaging with Deep Learning, PMLR","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.792441Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:17cc0ebf78d00ab2e8edf1fb1c51c3c1119637fa01dc93053ce24df545f84b02","observation_id":"2dc09c3b-1d3f-43ba-b8dd-ecb6cc5969cb","resolution":{"observed_at":"2026-08-01T00:11:43.792441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:43.897766Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:43.897766Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:1760d83e584e5116801969281456c5042cd2540ad11fd78ec10e5fb281579047","observation_id":"ef4bd8d7-9750-446f-99f1-f94a7c09258a","resolution":{"observed_at":"2026-08-01T00:11:43.897766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.154881Z","title":"The relationship between precision-recall and roc curves, in: Proceedings of the 23rd international conference on Machine learning, pp","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.154881Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:3411ca3850655ba1d27a9ffedc5507a4954e074155d05c07bc7dbcafb1ead4e2","observation_id":"fd6a5952-342b-4227-912a-4bea0e49a913","resolution":{"observed_at":"2026-08-01T00:11:44.154881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.256433Z","title":"Maximum likelihood estimation of ob- server error-rates using the EM algorithm","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.256433Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:18627f947b3fe98d63ac8f4e37839c0c8f9b47c7067748453a297013be6c294b","observation_id":"98fe7fc8-e949-4bbd-b6ef-db8e17c617f9","resolution":{"observed_at":"2026-08-01T00:11:44.256433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.368325Z","title":"Preparing a collection of radiology examinations for distribution and retrieval","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.368325Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:81d4f19ae190e38a4e73aa59500a6bb10ebada68df6b6d9e762c7b424446c4f9","observation_id":"bb1d48cf-15fe-4ec4-a1ed-50ee70980c3f","resolution":{"observed_at":"2026-08-01T00:11:44.368325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.516414Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale, in: International Conference on Learning Representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.516414Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:6af095b84fb18738735e1e8e68a281580ec296c548bcb59d552ffd76f0635692","observation_id":"66ee5f4c-f178-4d68-bf2a-929b53637aa5","resolution":{"observed_at":"2026-08-01T00:11:44.516414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.657679Z","title":"Bootstrap methods for standard errors, confidence intervals, and other measures of statistical accuracy","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.657679Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:4e0ee1f3c7209ca0bbbdb14eda065659076b06a7f1136feff830e1fa6265ca78","observation_id":"b7c51911-148b-4c71-acf5-251bdc391bcc","resolution":{"observed_at":"2026-08-01T00:11:44.657679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.761303Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.761303Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:0a8fabdf0277dec2682bd18169bd2befabe63e9481bc269741e3f395d9f8cdb8","observation_id":"05efddd9-8ee4-4b68-b24d-7bad325acc32","resolution":{"observed_at":"2026-08-01T00:11:44.761303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.969695Z","title":"Digital Image Processing","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.969695Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:bec2f6ec30c51c1e1f5a173a642d7b280b33886aabeb6e5df851d71a27e5752d","observation_id":"349fc9aa-e137-4930-b8af-daf77820ae4a","resolution":{"observed_at":"2026-08-01T00:11:44.969695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.104344Z","title":"Evaluating the robustness and readiness of large frontier models in health ai applications","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.104344Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:f6256639393b350512d8dbcfa82a2ad101a0baeee09ed5dedcf117a9f1a6dda8","observation_id":"918b2c98-0553-42a1-b4a0-84130565b4f3","resolution":{"observed_at":"2026-08-01T00:11:45.104344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.239270Z","title":"Robust classification from noisy labels: Integrating additional knowledge for chest radiography abnormality assessment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.239270Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:9f4ad5f48e5943f91a0defced7468b043e79c1e5cb1897ff83e7ffe86309f17c","observation_id":"7e143994-978e-47e8-b834-c0ec4dbba0eb","resolution":{"observed_at":"2026-08-01T00:11:45.239270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.327416Z","title":"The meaning and use of the area under a receiver operating characteristic (roc) curve","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.327416Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:8ed617299c802f39150564592824e0bffed3591a3b1bd811809edcc5d3b730cf","observation_id":"5a0a682f-1682-448b-ac6d-2341440a4c72","resolution":{"observed_at":"2026-08-01T00:11:45.327416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.471359Z","title":"Deep residual learning for image recognition, in: Proceedings of the IEEE conference on computer vision and pattern recognition, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.471359Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:d1ecc77afd2d02337b23abc8d37bfb10e85a84411cf0c68c7e6335a074b2e841","observation_id":"7bd38dc9-9f59-4fc0-882b-f2a010922532","resolution":{"observed_at":"2026-08-01T00:11:45.471359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.621930Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.621930Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:465d6620e27d039d9427706d3075276f62a57cad76e7f71e6fcffa99988b7df4","observation_id":"993dc661-c9a6-4645-ac9e-6ee3e742c6bf","resolution":{"observed_at":"2026-08-01T00:11:45.621930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.706669Z","title":"Densely connected convolutional networks, in: Proceedings of the IEEE conference on computer vision and pattern recognition, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.706669Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:267aafc0efc1510ae8f6d597de8e04175bf05935b9a7b475e0baa0daca230265","observation_id":"64da2cf3-1e82-4f11-99f4-fdcf3a323e76","resolution":{"observed_at":"2026-08-01T00:11:45.706669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.786066Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.786066Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:be12fdcccfe15c40db36141d15f82c6d51993c4dbed34b0c5efa9c8052074799","observation_id":"199ce8f9-cb54-404c-90e6-5a6981675417","resolution":{"observed_at":"2026-08-01T00:11:45.786066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.07031","last_updated":"2019-01-21T18:41:59Z","snapshot_observed_at":"2026-07-06T07:28:03.678849Z","submitted_at":"2019-01-21T18:41:59Z","title":"CheXpert: A Large Chest Radiograph Dataset with Uncertainty Labels and Expert Comparison","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.07031","snapshot_observed_at":"2026-08-01T00:11:45.890801Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert compar- ison","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.890801Z"},"links":{"cited_paper":"/paper/1901.07031","citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:5f4808aba26b760661664f07f23ec1ee7d21f019149daf99c6fd9c637125cfd6","observation_id":"b3a979ca-e194-4b82-a8a5-a14855a3a2b2","resolution":{"observed_at":"2026-08-01T00:11:45.890801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.931760Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.931760Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:dcc040f03c92fdae906a12e4c023940549a1db520f60293efcdf8370d18d5c1a","observation_id":"e241173c-8cc8-4d14-ac5a-b07cf6f77353","resolution":{"observed_at":"2026-08-01T00:11:45.931760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:45.978536Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:45.978536Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:22199d64b9fd107ea77da7940518cc006799fe79a2f9a577e079f99c495cee3a","observation_id":"b02a625c-24b1-495e-9cf5-83ba3dcc9db0","resolution":{"observed_at":"2026-08-01T00:11:45.978536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.171686Z","title":"Parameter choices in 32 haarpsiforiqawithmedicalimages, in: 2025IEEE22ndInternationalSym- posium on Biomedical Imaging (ISBI), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.171686Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:333e890b9fef2ad950fe7fb0bb1fad95e09e60c35bf79a7b1ede0e7c7c995c5b","observation_id":"111eb404-328f-4d22-ad6a-b2a333a1eea6","resolution":{"observed_at":"2026-08-01T00:11:46.171686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.232734Z","title":"A new measure of rank corre- lation","venue":null,"work_id":null,"year":1938},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.232734Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:b2c9267adb6ba8d0a9790161133766ad17c22b247f595470c7a3aa97a85f73da","observation_id":"579c6dd3-8739-4429-b458-261f011e4e6b","resolution":{"observed_at":"2026-08-01T00:11:46.232734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.342935Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.342935Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:8d368f7efaaf845cc57ade7eb0ae64583c24c36a6de0a1fe5399dad6182c2885","observation_id":"4b0177fe-e109-42f8-8c49-d3e146db9bcc","resolution":{"observed_at":"2026-08-01T00:11:46.342935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-43907-0_61","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Lecture notes in computer science","work_id":"94c6eec1-f199-4a49-a372-44613fb8ace7","year":2023},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.459776Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:3a2eaa21e78ba8ead8200da31d44fe20fb991faeb98f02c41efcbad842ff3052","observation_id":"edf0f91c-3a78-40a4-a36e-4de18df4e34d","resolution":{"observed_at":"2026-08-01T00:16:17.958673Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.552762Z","title":"Chest radiograph interpretation with deep learning models: as- sessment with radiologist-adjudicated reference standards and population- adjusted evaluation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.552762Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:20be75d94891425f0de7edba375d8d9eccdf1b75aa9209e01b079bb534bb39f8","observation_id":"66b670ac-5e74-46ff-bd80-aa1d01790455","resolution":{"observed_at":"2026-08-01T00:11:46.552762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.651448Z","title":"completely blind","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.651448Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:3fcc81412c7cf9945f21f244637b8927c2177013666c148dcc056392114cfb17","observation_id":"6a03de6c-78d6-4b1c-84cf-39648e798f6a","resolution":{"observed_at":"2026-08-01T00:11:46.651448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.749115Z","title":"Vindr-cxr: An open dataset of chest x-rays with radiologist’s annotations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.749115Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:f395f13901e05afade2ebd75679bce7f90c6b8aa2710c41f2af75cda28fbd738","observation_id":"33646996-47af-43b6-ab6d-e94336c76d6d","resolution":{"observed_at":"2026-08-01T00:11:46.749115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-01T00:11:46.835603Z","title":"Representation learning with con- trastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.835603Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:9ff99265ada64fdb18c40158accf3e0d33df9d614ab3257abcaea28ca72898bc","observation_id":"8f338c78-277e-45fc-8af4-b88b9dd18194","resolution":{"observed_at":"2026-08-01T00:11:46.835603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.16061","last_updated":"2020-10-11T02:15:11Z","snapshot_observed_at":"2026-08-04T20:09:58.097029Z","submitted_at":"2020-10-11T02:15:11Z","title":"Evaluation: from precision, recall and F-measure to ROC, informedness, markedness and correlation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.16061","snapshot_observed_at":"2026-08-01T00:11:46.953472Z","title":"Evaluation: fromprecision, recallandf-measuretoroc, informedness, markednessandcorrelation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.953472Z"},"links":{"cited_paper":"/paper/2010.16061","citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:7d421c439893a462a592e45d1662fbe1dce8ec4c55e475c31ee76277a6428137","observation_id":"12f149b0-ab7f-4048-ba78-bc106e1ccfe5","resolution":{"observed_at":"2026-08-01T00:11:46.953472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.083730Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.083730Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:7265bb23428035acf54772621265aaf2104c39b595c505e656755a033bed0423","observation_id":"a3687f27-9872-4431-a8af-6c519b27c31a","resolution":{"observed_at":"2026-08-01T00:11:47.083730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.294861Z","title":"Deep learning for chest radiograph diagnosis: A retrospective comparison of the chexnext algorithm to practicing radiologists","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.294861Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:520459f0846815ac69fa38da08d8107fbc889e07ea4ee1c0a1ad8f273fb175f9","observation_id":"b90d1296-e1ec-439a-afd5-97a28e002bca","resolution":{"observed_at":"2026-08-01T00:11:47.294861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.435368Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.435368Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:957f2c0fe40794ae469d20bade8ec37e036f14a3b529e2c74b705a2a004f7a1f","observation_id":"71c18515-3803-4f75-9653-31b2bd3ccfd2","resolution":{"observed_at":"2026-08-01T00:11:47.435368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.665813Z","title":"A haar wavelet-basedperceptualsimilarityindexforimagequalityassessment","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.665813Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:c38613a80696a18a2f87ab4db93c083cac740bcf53c815f9424e462bc588f847","observation_id":"249bc22b-49cb-4d64-8694-669ab27f1a49","resolution":{"observed_at":"2026-08-01T00:11:47.665813Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.713125Z","title":"Common pitfalls and recommendations for using machine learning to detect and prognosticate for covid-19 using chest radiographs and ct scans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.713125Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:5c32cd27ea68d0a3dba78de86adc69e1b357b43782a3499efbd1de9f1c9d3176","observation_id":"4bd00655-16a0-43cc-9501-35ca1b753d9d","resolution":{"observed_at":"2026-08-01T00:11:47.713125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.795581Z","title":"The sankey diagram in energy and material flow man- agement: part ii: methodology and current applications","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.795581Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:1be3383ac688bbb9ff5896a003535b733fbfc3a6bc5a261899f22520882b5905","observation_id":"a4c706a7-14e5-417f-a7ec-dec6735294a2","resolution":{"observed_at":"2026-08-01T00:11:47.795581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.908678Z","title":"Speedy iqa for desktop: An image viewer and labeller for image quality assessment (iqa).https://github.com/selbs/speedy_iqa","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.908678Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:69f2959cc5974174d46a45b20e31183dadc3eda48fd87aa355f63018a388d734","observation_id":"ab98b84a-3056-4566-8e31-54bd50dea5f7","resolution":{"observed_at":"2026-08-01T00:11:47.908678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.539537Z","title":"Scientific Data 9, 487","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.539537Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:47291c46e0d7f9f10b6d06e0ba568d15a1877b61c649f381e9c08f5c6a48ccad","observation_id":"e7007490-969b-40c8-823a-7931759e3f10","resolution":{"observed_at":"2026-08-01T00:11:47.539537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.094663Z","title":"Augmenting the national institutes of health chest radiograph dataset with expert annotations of possible pneumonia","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.094663Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:920ebadd37f89f06f913134730ba63c9252dca2081e49a8603da23afccf51b6e","observation_id":"fb342ceb-541f-480a-8840-08bf5db610bc","resolution":{"observed_at":"2026-08-01T00:11:48.094663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.233291Z","title":"The proof and measurement of association between two things","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.233291Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:de69f5a499a7c0c82873704c006f4864925257a2071cc590b60d203cbe0d8aa7","observation_id":"d2676738-4059-4735-af44-bcffc3ad7b22","resolution":{"observed_at":"2026-08-01T00:11:48.233291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.328731Z","title":"Multi-granularity cross-modal alignment for gener- alized medical visual representation learning, in: Advances in Neural Information Processing Systems, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.328731Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:1bec059dd851e870f4f9314e789b3f615cb8af10285b0a083558834c338f686f","observation_id":"acb0d0a8-7cff-401b-9f8d-ed7c44347a41","resolution":{"observed_at":"2026-08-01T00:11:48.328731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.394334Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.394334Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:cd3934a18bb905dc0f2f0bc7fe343b8f9a1c7c9db4738665735fa85a1a40b4eb","observation_id":"65a638e5-a3fe-4237-9ccf-d7f795c06731","resolution":{"observed_at":"2026-08-01T00:11:48.394334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.992529Z","title":"Speedy qc: Customisable annotation tool for medical images.https://github.com/selbs/speedy_qc","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.992529Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:1f8e09b3af3564908cdb7fa31ab163eaf9eb7080c05b4c435956c98e38f3e289","observation_id":"b2228353-8b3a-448e-a9d6-822f9fc82e28","resolution":{"observed_at":"2026-08-01T00:11:47.992529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.610617Z","title":"MedCLIP: Con- trastive learning from unpaired medical images and text, in: Goldberg, Y., Kozareva, Z., Zhang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.610617Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:dc20c831f96b1057a4a0b5ffb01885fbc64034a88953b1f7445aeddb86bbcb29","observation_id":"f02e1ae4-f70d-43c4-823a-7145a1812bdf","resolution":{"observed_at":"2026-08-01T00:11:48.610617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.666754Z","title":"The effect of class imbalance on precision-recall curves","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.666754Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:be08556fcd6de96585187f6e8e02a27863ebe5d0722e914916dddc576086aa5c","observation_id":"127b9778-82b3-4c5c-a8a3-ff2f2017b020","resolution":{"observed_at":"2026-08-01T00:11:48.666754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.717301Z","title":"Medklip: Med- ical knowledge enhanced language-image pre-training for x-ray diagnosis, in: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.717301Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:b571075ac8e983a067b77da6811b17f725d9bd6d3354abff75abd8d0c804fa08","observation_id":"1c212356-ce4f-49fb-8bad-564800ce6a00","resolution":{"observed_at":"2026-08-01T00:11:48.717301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14480","last_updated":"2020-05-29T09:57:17Z","snapshot_observed_at":"2026-08-05T09:57:13.051039Z","submitted_at":"2020-05-29T09:57:17Z","title":"Weakly Supervised Lesion Localization With Probabilistic-CAM Pooling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14480","snapshot_observed_at":"2026-08-01T00:11:48.819424Z","title":"Weakly supervised lesion localization with probabilistic-cam pooling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.819424Z"},"links":{"cited_paper":"/paper/2005.14480","citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:4fc585356a7d97a0c9864d8504ce48a4e8d0fbf86e43ed8a185fc58dd9852ea9","observation_id":"a502cdb6-2bba-40de-8bfa-e42dbc693516","resolution":{"observed_at":"2026-08-01T00:11:48.819424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.925163Z","title":"Fsim: A feature similarity indexforimagequalityassessment","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.925163Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:27925daee127df0b513a3e1d00443143dc63281f400fae74055ac378f72fc27c","observation_id":"271cd28f-d0ea-44a7-94e7-402c9a937644","resolution":{"observed_at":"2026-08-01T00:11:48.925163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:48.553935Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.553935Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:f8a1b1193601737eb0134246199c4f0576f238c1bbcf5815c8bf68e3a794697d","observation_id":"c19c0ac2-2861-4b58-a1fa-69ba2a86a5e9","resolution":{"observed_at":"2026-08-01T00:11:48.553935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.167285Z","title":"Gen- eralized radiograph representation learning via cross-supervision between images and free-text radiology reports","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.167285Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:9f65db5b0670830c9d008ad1b031fad60fd9bcd7e2546953cfb70c01cac85567","observation_id":"a70cc348-c996-48cb-bc8d-719077fbad2c","resolution":{"observed_at":"2026-08-01T00:11:49.167285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.340535Z","title":"Advancing radiograph representation learning with masked record modeling, in: The Eleventh International Conference on Learning Representations (ICLR)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.340535Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:18bb87d4be6a79b97e53fbd56eb7935bf4406c7258bec4010b248d0fc1f62093","observation_id":"047eff1b-446b-40d7-a05e-b357b8dbd51b","resolution":{"observed_at":"2026-08-01T00:11:49.340535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.503099Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.503099Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:3e39ba37ad1708c041959974b7ddd6e122210894c18d922d7e59e22768023423","observation_id":"aeab8b40-961b-4fd5-b1ff-d7f1ebc3a3e9","resolution":{"observed_at":"2026-08-01T00:11:49.503099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.027192Z","title":"Contrastive learning of medical visual representations from paired images and text, in: Proceedings of the 7th Machine Learning for Healthcare Con- ference, PMLR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.027192Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:3981543cb5537576dbfb1fcda59c8511a125d64ebfcdb3079ca6f7d37b0dd179","observation_id":"4f85eb6d-f819-487f-b986-efe05c012592","resolution":{"observed_at":"2026-08-01T00:11:49.027192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.236534Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.236534Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:e8c358948e56be1062aed90e3cfe65bbf9015e7e6501bc11cd5773fef2c0c6d5","observation_id":"e0e9b13d-2d67-4dc8-a053-892324b28d40","resolution":{"observed_at":"2026-08-01T00:11:49.236534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:49.586225Z","title":"Advances in Neural Information Processing Systems 37, 6625–6647","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:49.586225Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:b4834e66d6cb80a2c9f95a9e6dce5990dd69767b94af810efc92e7c8e8e7f336","observation_id":"afb074c6-94b9-4b4d-99aa-09cd7f63df77","resolution":{"observed_at":"2026-08-01T00:11:49.586225Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.02315","last_updated":"2017-12-14T19:35:31Z","snapshot_observed_at":"2026-07-06T05:41:30.478760Z","submitted_at":"2017-05-05T17:31:12Z","title":"ChestX-ray8: Hospital-scale Chest X-ray Database and Benchmarks on Weakly-Supervised Classification and Localization of Common Thorax Diseases","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.02315","snapshot_observed_at":"2026-08-01T00:11:48.464692Z","title":"CoRR abs/1705.02315","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:48.464692Z"},"links":{"cited_paper":"/paper/1705.02315","citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:97de6aebb73e59948551386f99c12daf8b706b00ab5e40a3f471e8886aecae23","observation_id":"fd5441fc-9199-4456-b11c-6a62df3fa5c6","resolution":{"observed_at":"2026-08-01T00:11:48.464692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:46.115876Z","title":"URL:https://physionet.org/content/ mimic-cxr/, doi:10.13026/C2JT1Q","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:46.115876Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:c358958cdf9cd85060e4f003b20f02732f104a9975c0a7417af117a1b3ea7507","observation_id":"8ac6d052-2c89-4b1b-95e5-f585cfff7e3a","resolution":{"observed_at":"2026-08-01T00:11:46.115876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:47.193546Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:47.193546Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:d70ac02932d8619000f29f5551dd4934dc832ea8fba03021114a4f893355e578","observation_id":"f8407190-c205-4f33-b539-abbd08ebe44e","resolution":{"observed_at":"2026-08-01T00:11:47.193546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.034628Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.034628Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:74f191acaecba4d0cc32b85d33d1287b77edf6682309a20edeaf8b3cf5a2f5c8","observation_id":"63592e01-ff73-4975-b3d2-dc6ba100ea78","resolution":{"observed_at":"2026-08-01T00:11:44.034628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:11:44.854276Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T00:11:44.854276Z"},"links":{"citing_paper":"/paper/2607.26333"},"observation_digest":"sha256:d287a47abea38b9fe6ef4ed79fba6a469dd440926d1c1ce6d277921208b6ff28","observation_id":"6af84ac7-d469-4278-b006-18ac30f767e2","resolution":{"observed_at":"2026-08-01T00:11:44.854276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26333","last_updated":"2026-07-28T23:11:04Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-08T05:50:51.193335Z","submitted_at":"2026-07-28T23:11:04Z","title":"Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2607.26333."}