{"as_of":"2026-08-16T09:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d86e284265715610c78b075bba80ecc376a5c4cfab290e97b15549473565f140","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:28:14.265774Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:51.149973Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2305.09620","last_updated":"2026-05-19T19:24:46Z","snapshot_observed_at":"2026-07-06T15:28:16.998343Z","submitted_at":"2023-05-16T17:13:07Z","title":"AI-Augmented Surveys: Leveraging Large Language Models and Surveys for Opinion Prediction","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-24T08:47:23.231930Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2305.09620"},"observation_digest":"sha256:1d0d94a4aca0c5ac4f58e78518dae4cde39a493871c4e5b7779ed496ab0cc57f","observation_id":"e9f7d148-839e-42ce-8b10-84a39255a7fe","resolution":{"observed_at":"2026-05-24T08:49:14.002548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2309.11495","last_updated":"2023-09-25T15:25:49Z","snapshot_observed_at":"2026-08-12T01:35:36.884518Z","submitted_at":"2023-09-20T17:50:55Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-18T01:06:49.811982Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2309.11495"},"observation_digest":"sha256:e9763ee2ce660d5d7b695b2bb8b13e4080bd8661424156f2106409f9b334ebfd","observation_id":"1c92d103-afe7-40c6-9443-8016d59add23","resolution":{"observed_at":"2026-05-18T01:06:50.474295Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2401.00761","last_updated":"2026-04-29T05:14:57Z","snapshot_observed_at":"2026-08-08T00:10:34.537036Z","submitted_at":"2024-01-01T14:02:27Z","title":"Identifying the Achilles' Heel: An Iterative Method for Dynamically Uncovering Factual Errors in Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T04:41:48.938278Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2401.00761"},"observation_digest":"sha256:d06f7eae35f2106253a6a3d1d9e72341d87d41fcfffd7e30d0ceed8215647cbf","observation_id":"e3a868ec-c0ed-4d52-9f25-df2169db957e","resolution":{"observed_at":"2026-05-24T04:43:53.980663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-08-14T02:18:02.339361Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-17T23:04:44.287660Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2402.13228"},"observation_digest":"sha256:56d19820c20ec7a95e403d8c20d33ea3551b4a40356604439ac30f8cf052eb2d","observation_id":"d8f18681-9e81-4f7e-8a9d-e64bbd1f26d4","resolution":{"observed_at":"2026-05-17T23:04:44.505064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-08-12T12:28:14.265774Z","title":", author An, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17204","last_updated":"2024-11-28T01:04:40Z","snapshot_observed_at":"2026-08-12T18:21:48.089006Z","submitted_at":"2024-11-26T08:21:24Z","title":"Strategic Prompting for Conversational Tasks: A Comparative Analysis of Large Language Models Across Diverse Conversational Tasks","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T12:28:14.265774Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2411.17204"},"observation_digest":"sha256:27bf0b4651307890eb2f2c26e58369738bbee3106f17d44675353e4b0c129fa5","observation_id":"cc7a962d-bb78-447a-9fc9-4a979c470ac7","resolution":{"observed_at":"2026-08-12T12:28:14.265774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2604.24819","last_updated":"2026-04-27T14:05:18Z","snapshot_observed_at":"2026-08-14T07:12:48.519357Z","submitted_at":"2026-04-27T14:05:18Z","title":"Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corpora","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T03:13:30.648190Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2604.24819"},"observation_digest":"sha256:b9201c1e14a8fb2407c91811b41c9f6b38190250368c61b7e3a16deb826ccd0b","observation_id":"cc855fc7-a873-4d5b-b9c1-b4c173e2cd46","resolution":{"observed_at":"2026-05-11T22:11:16.300342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":"2303.12767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-04T13:29:51.149973Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":"c380b705-8686-4597-8d68-23e24970a276","year":2023},"citing_paper":{"arxiv_id":"2606.26749","last_updated":"2026-06-25T08:33:34Z","snapshot_observed_at":"2026-08-01T16:00:20.311664Z","submitted_at":"2026-06-25T08:33:34Z","title":"Structure Before Collapse: Transient semantic geometry in next-token prediction","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-06-26T05:14:07.208255Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2606.26749"},"observation_digest":"sha256:380b5beddcb50717e4ba611f6479ac6383b41f9a37dda913d2b81066268b12cd","observation_id":"906ae647-b257-48e8-9f6a-320c6f5ad4ee","resolution":{"observed_at":"2026-07-04T13:29:51.151419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12767","snapshot_observed_at":"2026-07-11T06:09:35.110633Z","title":"arXiv preprint arXiv:2303.12767 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05537","last_updated":"2026-07-06T18:18:44Z","snapshot_observed_at":"2026-08-14T09:22:40.153094Z","submitted_at":"2026-07-06T18:18:44Z","title":"Prompt engineering using order-of-addition experiments: An application to generating two-level fractional factorial designs","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-11T06:09:35.110633Z"},"links":{"cited_paper":"/paper/2303.12767","citing_paper":"/paper/2607.05537"},"observation_digest":"sha256:293fd6aadca1ac621c2e2f545b8954087d2e58f6e34bf60b76fd9723ecf8c291","observation_id":"e535b227-9148-4d67-8367-004f59e2c19c","resolution":{"observed_at":"2026-07-11T06:09:35.110633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.12767/citation-record","integrity":"/paper/2303.12767/integrity","json":"/paper/2303.12767/citation-record.json","paper":"/paper/2303.12767"},"outbound":[],"paper":{"arxiv_id":"2303.12767","last_updated":"2024-08-22T14:19:06Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T15:42:56.643778Z","submitted_at":"2023-03-22T17:32:56Z","title":"Can we trust the evaluation on ChatGPT?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2303.12767."}