{"as_of":"2026-08-11T15:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6fc26227bd9f68c3cbd64b8a186de19deafc2e7b65b0b8dbcd870e4d0abb9bf5","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:16:54.891424Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.26422/citation-record","integrity":"/paper/2606.26422/integrity","json":"/paper/2606.26422/citation-record.json","paper":"/paper/2606.26422"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.100804","doi":"10.1016/j.patter.2023.100804","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kapoor, A","venue":"Patterns","work_id":"105afbbb-a894-4243-87bf-c292ee0b1a4f","year":2023},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:31a98701fbf4cd631edb7f57b3e8eda2e73b76a21be93fe26e03bfa20fd398cc","observation_id":"e2f3ed93-c283-42f9-bbc1-72480e1dff63","resolution":{"observed_at":"2026-06-26T01:18:50.028347Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T17:19:31.402496+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T17:19:31.402496+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/h0040957","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: https://doi.org/10.1037/h0040957","venue":"Psychological Bulletin","work_id":"e428b04e-57a8-456c-b2f8-b94acf877fac","year":1955},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:ed515fd92c25928ab320b82bd43cfa2066a818e423c64602a9f1c42f234563b0","observation_id":"29fd47cf-54e6-4229-beac-43c60db91dcb","resolution":{"observed_at":"2026-06-26T01:18:50.019955Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:04.721108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:04.721108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7560.328759","doi":"10.1145/3287560.3287591","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Model Cards for Model Reporting","venue":null,"work_id":"fb93094c-804e-4d49-acde-0f68bf751504","year":2015},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:025cfa6eb8d2a92ecfd32163aea2448faf2de389fe22e7d0a3d2c3d173231191","observation_id":"465ce874-376f-485f-95e4-a46e7409a915","resolution":{"observed_at":"2026-06-26T01:18:50.024140Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Statistical power analysis for the behavioral sciences , isbn =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:3c6f3f91ac5b6bdc8112a9413f057590831cd98d6d7591a515c0cfa4ec9a29da","observation_id":"36e66c86-0fe8-4126-88b4-26a121d029c1","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/e599842011-001","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"National Center for Special Education Research , author =","venue":"Time to knit","work_id":"67cfc064-b919-433a-a371-00c99d997a6f","year":2000},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:29411ebad6d852c84dee673965d2bf4f9437ceb9704896363f56413df5f94b26","observation_id":"85fb6669-655b-4ae3-9a48-6ed551d20bc5","resolution":{"observed_at":"2026-06-26T01:18:50.021791Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":", editor =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:1ba504e691ac176277e3929e0d885c32b3c424007077ad54c06f37b907a4bd1e","observation_id":"80e06027-6d33-457f-8406-482d6e98e2c8","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3102/0162373707299","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:18:50.028864Z","title":"Educational Evaluation and Policy Analysis , author =","venue":null,"work_id":"d54fd3f9-a1a6-4f3b-bbc5-d182dedf53a6","year":2007},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:5385c52ee34293ebadbfa583923e3368b793563f37266a59fc4a6d2e5ca36754","observation_id":"72aa6683-0538-4093-8247-2b7cd3e6b127","resolution":{"observed_at":"2026-06-26T01:18:50.030263Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Stewart, Brandon M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e5b03b1cfb90097570ced1b39ee0ad4930aaabab2e2ad58b484cf6615b783344","observation_id":"7b161a60-a86d-4b12-a19d-12ee5c0991a1","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Proceedings of the 2020 conference on fairness, accountability, and transparency , author =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e0d513081ea98266c848936c827b6eb56553c6aeb3f88c3b512b04de48714d02","observation_id":"c221f7c8-c984-4e4a-8795-2f76053305ce","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Gender shades:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:a7c2b46c7254079153bcabe58d149a99f934648393571bb7175055538d0c2bc8","observation_id":"20c70552-ea4c-49ef-a7ca-0997dae39c73","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:355d09555eb1321ef6e7adebf67c7be7b2a846ff28e863f7a309ccba24c1a0a4","observation_id":"a27779bf-d342-445e-9e75-f881693ceea9","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3758/s13428-024-02441-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shadows of wisdom: Classifying meta-cognitive and morally grounded narrative content via large language models","venue":"Behavior Research Methods","work_id":"d377a4cb-6f24-4349-8fe7-50c922d9cb29","year":2024},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:77bd90ecdc97eb9843ccabb4f8c8f0efdcabd297624d30bc3407a71654f5c750","observation_id":"cadd13dc-6fb6-4080-9182-775b70e90cec","resolution":{"observed_at":"2026-06-26T01:18:50.032037Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.230501612","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:18:50.024639Z","title":"Proceedings of the National Academy of Sciences , publisher =","venue":null,"work_id":"a0657149-cc04-499f-ace8-8f775e496eb8","year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:4333dbaddbe3a53d491442ef9f997fcb505e4dfdfd663f57c74418d0fc13a0e5","observation_id":"31beb987-ec83-4773-8cdb-95058072d93e","resolution":{"observed_at":"2026-06-26T01:18:50.025752Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/23328584241303495","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":", month = dec, year =","venue":"AERA Open","work_id":"1e86c911-585c-4afd-9fb2-890d5a4b48bc","year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:a0784651c0341170a7fab274b1897b991f9e25b442c4ace95bf3f61cf64171b9","observation_id":"8342b57e-efaa-4d8a-ae1c-cc7bf68cd7ae","resolution":{"observed_at":"2026-06-26T01:18:50.018427Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":", year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:ba1943524925c34dc3d67b19f004dd8ca02ed7ed7830f0cddaed93288f129a5d","observation_id":"59252c20-0799-4d09-9579-48939d4fce93","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10223","last_updated":"2025-08-13T22:20:36Z","snapshot_observed_at":"2026-08-06T10:38:08.862058Z","submitted_at":"2025-08-13T22:20:36Z","title":"A Comprehensive Comparison of the Wald, Wilson, and adjusted Wilson Confidence Intervals for Proportions","version":1},"cited_work":{"arxiv_id":"2508.10223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10223","snapshot_observed_at":"2026-07-04T15:49:58.038526Z","title":"arXiv preprint arXiv:2508.10223 , author =","venue":null,"work_id":"798d91d8-18d8-4ba2-8cff-e0b361adc56f","year":2025},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"cited_paper":"/paper/2508.10223","citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:f2a508e51cc742282b14caf3cf8cc28f7010871a05975854434d5ad16b11e67d","observation_id":"23fb2aa5-8a5b-495f-ad57-134a8003471c","resolution":{"observed_at":"2026-07-04T15:49:58.039762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":", year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:702e60410c4c34b0b856fe937109a0e7febf31c610e0bd0ed64cbfd55a913817","observation_id":"187ab06a-4f02-48b9-9077-e3006ed94d0a","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Survey sampling , publisher =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:a806a9223bd9189711bbc519911afe083dcba109e30e01323379057208a58325","observation_id":"fbb6600a-aaba-448c-9f61-bc211c4c62c1","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e5dac2ac31e09f9c74a6e9942171ff41c5e58838d68f9cab17d38677046c9da0","observation_id":"b1b8d90e-94fa-43f9-b2c5-b0cb15d8fcca","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Pearson, Egon S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:899b5132e8e4c15a6c67af2f12ea1ad28b11f2505b381737d03d3f2ce491097a","observation_id":"99b6cd70-6287-4a07-b755-f132c4ba0a28","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Monographs on statistics and applied probability , author =","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:1e8954910dcdf1e72d643ede11fa8754768c4d148cdccc329e8df65ce6c2bbd7","observation_id":"81ab3456-d5d1-432f-aedc-5c15fc8ab317","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Model evaluation, model selection, and algorithm selection in machine learning , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:a1f0ccb7db6278adc7c0e86e8b0fb103c4c0edf81447c9d3c59c991ce79db887","observation_id":"5be30351-b913-4efd-bfbb-e402f20228f8","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Evaluation metrics and statistical tests for machine learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:a0efc1efa60da976e81cd1b45067ed12c48a56af6f1d7f4176af56de1bec82df","observation_id":"0a678e17-eecd-40a6-957a-6b130782583f","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Nonparametric standard errors and confidence intervals , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:cb78fc2f42be44790e85268d16e0b2959bc884261f3a076272826c327b81474f","observation_id":"c171f60e-ccc9-4a0a-8a54-3d33346e1503","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Why question machine learning evaluation methods , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e57feda215765cff7a66b3df23f6896a196ccd89668f2c40c676ca14502156c0","observation_id":"a159bb7e-99da-4b32-8a9f-74803a8382e3","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Huang, Jin and Zhang, Harry , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e169383310aa4ad03cffb6d066c05346fe71aed199d041711ada2dd47b09569a","observation_id":"ae474e2a-45b9-49c5-a089-9fa7d642c0bc","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Reisenbichler, Emily S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:cd8c3a1233e8781b6904d1540b300dc2bf05fbaa6dad40479b04d9e1c86c9700","observation_id":"8be426be-0fe0-47e9-9626-49cfe848eb15","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Journal of the Royal Statistical Society: Series B (Methodological) , author =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:e2abf3d3dab72601db315dbcfee4c429bd6e930167ce24eb630e455d7d548ca8","observation_id":"84d28653-3ac8-415f-8bf4-a88912e50c61","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"WIREs Comp Stat , author =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:ec568c30fe87320c3edd705302ed22570d11ebe492c6e19eade1e0cc72b0c521","observation_id":"60943801-dceb-4058-bf23-f53c6e52ca1d","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Evaluating confidence interval methods for binomial proportions in clustered surveys , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:40581eefd65fc6e972b2430177176958e524aae47d0c53a3faa47f822995f31e","observation_id":"59e3ab88-adea-43aa-b239-d0a81a18e594","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.cct.2012.05.004","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Contemporary Clinical Trials , author =","venue":"Contemporary Clinical Trials","work_id":"1dca289a-1784-47c4-997c-6bc49473b055","year":2012},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:2c30230aab0c3f77d4f9ddc95ae2c0d777707477e89510babba3db7a6b056865","observation_id":"5cca7828-f5e1-4eee-8279-eb44fece6089","resolution":{"observed_at":"2026-06-26T01:18:50.016845Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Graubard, Barry I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:bf58bc83b1d542ae139d5a0c147ebf41ec0aed9c984781b9d26e5e5f17219dad","observation_id":"5986aac9-66f0-4bd0-8764-a10642a962a9","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Leveraging large language models to identify microcounseling skills in psychotherapy transcripts , doi =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:0ceaeb71e8efc799e6a62ae68a6fb1ac3beae17b69fc95b416db2c4a7ae9057a","observation_id":"9339503f-b19d-476b-9dcf-e861fa58e48e","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Proceedings of the fourth workshop on computational linguistics and clinical psychology—from linguistic signal to clinical reality , author =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:9ef59f317212d4d6ca40e73af1d9f57ae193944be71aa7a838a211cb1e9e6035","observation_id":"fbae1641-6eec-4114-9ff9-462f14ffe8f5","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Neurons, behavior, data analysis and theory , author =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:0cf83bb3fada9774d8a838d38b0e74855f0fa22dfd8e283a5ef9734685a144eb","observation_id":"3d9f2613-760e-4e69-addf-809bce80d926","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"and Welsh, Alan H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:66452cd7e62c1b1ce237bb873e5ec042ac46754c4a2149da8761da3dccea6442","observation_id":"10ad149f-d1a1-469f-ab50-3eab3eb9e83e","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"Bernoulli , volume =","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:9cb06093b46e306023fa1f003544076516aedf76640151b0647c506f5eca7e28","observation_id":"2a91d471-a7bd-4f7c-8730-6fa6b23ac03b","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:16:54.891424Z","title":"REVSTAT-Statistical Journal , author =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-26T01:16:54.891424Z"},"links":{"citing_paper":"/paper/2606.26422"},"observation_digest":"sha256:9c0bd4e5c347306b88bb46add9945b9a2d2457ec8880e561e5da9576eba488c0","observation_id":"b46584e8-4246-4138-bbd9-3fa3d881ef53","resolution":{"observed_at":"2026-06-26T01:16:54.891424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26422","last_updated":"2026-06-24T22:24:25Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T00:52:13.015980Z","submitted_at":"2026-06-24T22:24:25Z","title":"Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":28,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2606.26422."}