{"as_of":"2026-08-23T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60e0ead4259d10f7da5386699bfa3e647f86e91d1286a2239c0913330d91c005","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:21:25.996298Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":13,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":"2305.18486","doi":"10.48550/arxiv.2305.18486","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tahmid Rahman Laskar, M","venue":"arXiv (Cornell University)","work_id":"f9601077-111f-49a4-826f-24991603ad9f","year":2023},"citing_paper":{"arxiv_id":"2404.10981","last_updated":"2024-08-23T00:17:02Z","snapshot_observed_at":"2026-08-14T10:51:21.055151Z","submitted_at":"2024-04-17T01:27:42Z","title":"A Survey on Retrieval-Augmented Text Generation for Large Language Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-24T02:15:05.379583Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2404.10981"},"observation_digest":"sha256:30a53ad81eefb68f553daf8c50fb8d067bc89bc6272831a9d38186861f79c75c","observation_id":"86fe6ce0-57e2-43b6-9055-5afff4a46d8a","resolution":{"observed_at":"2026-05-24T02:15:55.252575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-16T10:21:25.996298Z","title":"Saiful Bari, Mizanur Rahman, Md Am- ran Hossen Bhuiyan, Shafiq Joty, and Jimmy Xiangji Huang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18413","last_updated":"2025-04-25T15:14:25Z","snapshot_observed_at":"2026-08-18T16:11:20.779302Z","submitted_at":"2025-04-25T15:14:25Z","title":"An Empirical Study of Evaluating Long-form Question Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:21:25.996298Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2504.18413"},"observation_digest":"sha256:fa67aa5d3bead60deaba296b506f0e8d308ecbefe6e8313396340adcec1d9d0c","observation_id":"ee5747c1-46fa-4e75-8990-c261c810452c","resolution":{"observed_at":"2026-08-16T10:21:25.996298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-15T23:41:18.234345Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04666","last_updated":"2025-05-07T05:04:30Z","snapshot_observed_at":"2026-08-19T00:09:07.318375Z","submitted_at":"2025-05-07T05:04:30Z","title":"Fine-Tuning Large Language Models and Evaluating Retrieval Methods for Improved Question Answering on Building Codes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:41:18.234345Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2505.04666"},"observation_digest":"sha256:7817e13ded2aa5ef270a4a39063105e4bbbacb7cdd10fda08c61a8a98b0d89f1","observation_id":"53970024-7059-452c-8efb-5401dbe97f31","resolution":{"observed_at":"2026-08-15T23:41:18.234345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-07T12:11:06.862023Z","title":"A systematic study and comprehensive evaluation of chat- gpt on benchmark datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.862023Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a64526159a6832b751a516978e8ace337b4b756a9c2ac87d7de2748c260fe675","observation_id":"c2b25631-689f-4039-a697-f7538705028e","resolution":{"observed_at":"2026-08-07T12:11:06.862023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-07T05:33:26.943474Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07626","last_updated":"2025-06-09T10:45:18Z","snapshot_observed_at":"2026-08-16T22:56:23.943906Z","submitted_at":"2025-06-09T10:45:18Z","title":"Intent Matters: Enhancing AI Tutoring with Fine-Grained Pedagogical Intent Annotation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:33:26.943474Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2506.07626"},"observation_digest":"sha256:dee665a4b10abf80391141efb98b40fc2499f67e20630cdb62599c2954e56b15","observation_id":"a32a603d-58f8-424e-892d-0bdd52441206","resolution":{"observed_at":"2026-08-07T05:33:26.943474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-04T19:24:53.001834Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09272","last_updated":"2025-09-11T09:02:15Z","snapshot_observed_at":"2026-08-20T17:33:20.364005Z","submitted_at":"2025-09-11T09:02:15Z","title":"Fusing Knowledge and Language: A Comparative Study of Knowledge Graph-Based Question Answering with LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:24:53.001834Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2509.09272"},"observation_digest":"sha256:766f3c0595b6ce6224333fcd30b252c54ad9a32fd71b283e5a3c516226039ee8","observation_id":"26886995-d1a5-40bb-b637-57ade7dbad5f","resolution":{"observed_at":"2026-08-04T19:24:53.001834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-15T14:25:40.316937Z","title":"arXiv preprint arXiv:2305.18486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-22T16:21:38.046043Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":179,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:40.316937Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:d71a8ef267d409792dc005940d43112d6584ab81d324831dc2d67040bc9b73f4","observation_id":"01dc94d4-e247-4426-9290-60f5a4144ba9","resolution":{"observed_at":"2026-08-15T14:25:40.316937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.18486/citation-record","integrity":"/paper/2305.18486/integrity","json":"/paper/2305.18486/citation-record.json","paper":"/paper/2305.18486"},"outbound":[],"paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T00:14:59.053415Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2305.18486."}