{"as_of":"2026-08-08T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e50402e787a1e68394c8c1d209430175ae5ecb385978ed41a869174409121c5f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:04:04.898211Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":"2501.10970","doi":"10.48550/arxiv.2501.10970","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reichart, R","venue":"ArXiv.org","work_id":"3f44a146-228f-4706-b85a-626437aa1e5d","year":2025},"citing_paper":{"arxiv_id":"2502.17773","last_updated":"2026-06-15T23:04:52Z","snapshot_observed_at":"2026-08-07T17:51:32.023600Z","submitted_at":"2025-02-25T02:07:29Z","title":"How Many Human Survey Respondents is a Large Language Model Worth? An Uncertainty Quantification Perspective","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-23T03:14:00.526112Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2502.17773"},"observation_digest":"sha256:eaa55e4773ca1a0e05d82c1dc3a5e47ec1376ffb8fe1b9530dc706ffbf171b1b","observation_id":"ba4a2884-781c-47f3-be0c-4ac0a44f9252","resolution":{"observed_at":"2026-05-23T03:15:21.289225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-07T15:04:04.898211Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16520","last_updated":"2025-05-30T10:53:48Z","snapshot_observed_at":"2026-08-07T14:57:11.423328Z","submitted_at":"2025-05-22T11:00:53Z","title":"Are the Hidden States Hiding Something? Testing the Limits of Factuality-Encoding Capabilities in LLMs","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:04:04.898211Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2505.16520"},"observation_digest":"sha256:941c372ff3ebba0f6d414aad33ccaa80cd9dd5e46ee223a0be6942278eba5964","observation_id":"23413ca2-6ffe-41c4-ab1f-82c3100367c4","resolution":{"observed_at":"2026-08-07T15:04:04.898211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-07T14:17:35.541169Z","title":"The Altern ative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators wi th LLMs, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19402","last_updated":"2025-05-26T01:38:02Z","snapshot_observed_at":"2026-08-07T14:12:42.016336Z","submitted_at":"2025-05-26T01:38:02Z","title":"Recalibrating the Compass: Integrating Large Language Models into Classical Research Methods","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:35.541169Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2505.19402"},"observation_digest":"sha256:5255acdc2bfb5493359bae61672bd4f65edc3c4b82c507462eb50fb2b9160630","observation_id":"f76b4449-d78a-4ec0-baf0-65a16d2ba282","resolution":{"observed_at":"2026-08-07T14:17:35.541169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-07T14:05:06.332229Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20088","last_updated":"2025-05-29T15:47:53Z","snapshot_observed_at":"2026-08-07T13:57:08.806526Z","submitted_at":"2025-05-26T15:01:56Z","title":"Multi-Domain Explainability of Preferences","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:05:06.332229Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2505.20088"},"observation_digest":"sha256:86d8122cc4072f42c044674908cbffaa644d953134975bd8ac97c77006634b96","observation_id":"88be4fb8-bd12-4cb5-88ef-726c42c7928a","resolution":{"observed_at":"2026-08-07T14:05:06.332229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-06T21:15:08.542384Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.00828","last_updated":"2025-07-01T15:00:55Z","snapshot_observed_at":"2026-08-06T21:03:28.532309Z","submitted_at":"2025-07-01T15:00:55Z","title":"ProxAnn: Use-Oriented Evaluations of Topic Models and Document Clustering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:15:08.542384Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2507.00828"},"observation_digest":"sha256:f526da01a84ef6011b56a019d672ce92ee6b2e720c6e98c3221d48a5b55f8afb","observation_id":"bb2a8f9b-2df4-4727-9cb3-89df77f03b3c","resolution":{"observed_at":"2026-08-06T21:15:08.542384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":"2501.10970","doi":"10.48550/arxiv.2501.10970","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reichart, R","venue":"ArXiv.org","work_id":"3f44a146-228f-4706-b85a-626437aa1e5d","year":2025},"citing_paper":{"arxiv_id":"2507.05385","last_updated":"2026-05-05T05:57:05Z","snapshot_observed_at":"2026-07-06T21:53:32.678356Z","submitted_at":"2025-07-07T18:15:29Z","title":"EduCoder: An Open-Source Annotation System for Education Transcript Data","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-19T05:35:52.219876Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2507.05385"},"observation_digest":"sha256:bc6975d4fa45fe0db2d08c3ad0c65c510e2cf5839aefc8a13c2a884ae18f60a8","observation_id":"b958903d-046f-4147-8229-74b87bd1188b","resolution":{"observed_at":"2026-05-19T05:37:05.540440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-06T17:49:40.826384Z","title":"The alternative annotator test for llm-as-a-judge: How to statistically justify replacing human annotators with llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09820","last_updated":"2025-07-13T22:34:20Z","snapshot_observed_at":"2026-08-08T07:26:19.185941Z","submitted_at":"2025-07-13T22:34:20Z","title":"Measuring What Matters: A Framework for Evaluating Safety Risks in Real-World LLM Applications","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:49:40.826384Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2507.09820"},"observation_digest":"sha256:4c70852c61bac9634351ff6b96b0b31bc02e5f43ca69946c59390745aae0d118","observation_id":"cbd87949-a508-4ff1-9728-fbf3ffe6c530","resolution":{"observed_at":"2026-08-06T17:49:40.826384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-06T15:02:21.683550Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17015","last_updated":"2025-07-22T20:57:09Z","snapshot_observed_at":"2026-08-07T12:17:11.302795Z","submitted_at":"2025-07-22T20:57:09Z","title":"Can External Validation Tools Improve Annotation Quality for LLM-as-a-Judge?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:02:21.683550Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2507.17015"},"observation_digest":"sha256:e8b94a3a8cbe981b0248a30280cf9e3691b175310d8e0b8e8ccb0dfd4397c3ac","observation_id":"0aeb6484-a2ca-438d-bea8-95f5b98646f7","resolution":{"observed_at":"2026-08-06T15:02:21.683550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":"2501.10970","doi":"10.48550/arxiv.2501.10970","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reichart, R","venue":"ArXiv.org","work_id":"3f44a146-228f-4706-b85a-626437aa1e5d","year":2025},"citing_paper":{"arxiv_id":"2605.15365","last_updated":"2026-05-14T19:45:02Z","snapshot_observed_at":"2026-07-06T23:26:41.848219Z","submitted_at":"2026-05-14T19:45:02Z","title":"Greedy or not, here I come: Language production under vocabulary constraints in humans and resource-rational models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-19T15:33:00.984344Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2605.15365"},"observation_digest":"sha256:fecacec05ccde73eb1f9a6553350ed6555274a6024e0da3aedf4f60a31de9195","observation_id":"05fbd995-8ae2-4e05-9f4d-6350a5a8bb39","resolution":{"observed_at":"2026-05-19T15:33:07.548115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":"2501.10970","doi":"10.48550/arxiv.2501.10970","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reichart, R","venue":"ArXiv.org","work_id":"3f44a146-228f-4706-b85a-626437aa1e5d","year":2025},"citing_paper":{"arxiv_id":"2605.27025","last_updated":"2026-05-26T13:44:48Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:44:48Z","title":"Attribute-Based Diagnosis of LLM Alignment with Hate Speech Annotations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T18:27:50.159580Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2605.27025"},"observation_digest":"sha256:6ad71ae975759e814b035301859191b19f09424875dea417415aa5f7f17365d5","observation_id":"f17c4560-d09f-4ffa-9ef6-05541150e15c","resolution":{"observed_at":"2026-06-29T18:33:50.726078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T13:24:24.238635+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10970","snapshot_observed_at":"2026-08-01T02:55:58.149738Z","title":"arXiv preprint arXiv:2501.10970 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25292","last_updated":"2026-07-28T04:58:46Z","snapshot_observed_at":"2026-08-07T04:25:53.240099Z","submitted_at":"2026-07-28T04:58:46Z","title":"Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T02:55:58.149738Z"},"links":{"cited_paper":"/paper/2501.10970","citing_paper":"/paper/2607.25292"},"observation_digest":"sha256:db0c0d8e7e4761a03b3540fa25f2de00a7599fa514eed27fe87cf67d6c7d8df9","observation_id":"04c52b5d-503c-4852-b7e2-411c3c0f2c35","resolution":{"observed_at":"2026-08-01T02:55:58.149738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10970/citation-record","integrity":"/paper/2501.10970/integrity","json":"/paper/2501.10970/citation-record.json","paper":"/paper/2501.10970"},"outbound":[],"paper":{"arxiv_id":"2501.10970","last_updated":"2025-08-08T06:36:34Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-19T07:09:11Z","title":"The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2501.10970."}