{"as_of":"2026-08-07T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25f430245ddec6ddd959a89d84712bb09062f04c56dffd68137b5752ff2e9c19","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:23:38.646723Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T05:05:54.821162Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":"2504.07114","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2504.07114","venue":null,"work_id":"7bde547f-b27b-46c5-aebe-07c965260367","year":2024},"citing_paper":{"arxiv_id":"2505.06120","last_updated":"2025-05-09T15:21:44Z","snapshot_observed_at":"2026-08-02T13:06:07.304813Z","submitted_at":"2025-05-09T15:21:44Z","title":"LLMs Get Lost In Multi-Turn Conversation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T00:57:10.262350Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2505.06120"},"observation_digest":"sha256:086668cf513292ac0016f9a8056a13c95938de8d26bc8b71aed19e367101b9c5","observation_id":"2790fd59-30e4-41f4-81cc-bf53fcf0615d","resolution":{"observed_at":"2026-05-14T01:11:09.390293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-07T00:23:38.646723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14200","last_updated":"2025-06-17T05:36:39Z","snapshot_observed_at":"2026-08-07T00:15:54.611734Z","submitted_at":"2025-06-17T05:36:39Z","title":"ELI-Why: Evaluating the Pedagogical Utility of Language Model Explanations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:23:38.646723Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2506.14200"},"observation_digest":"sha256:4c49363806e4d6175dc34a0e900b4b254ef5421ee7ce4c49e27e4831c9c11973","observation_id":"5989d867-c302-43ac-a69b-f03d7820edff","resolution":{"observed_at":"2026-08-07T00:23:38.646723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-06T22:30:29.181666Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.21521","last_updated":"2025-06-29T18:12:45Z","snapshot_observed_at":"2026-08-06T22:21:16.447968Z","submitted_at":"2025-06-26T17:41:35Z","title":"Potemkin Understanding in Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T22:30:29.181666Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2506.21521"},"observation_digest":"sha256:589f8c8ebb7e97b794c2cf7c4e4d389fd55228bd337dc6cc6d21d08a070d4f23","observation_id":"570370e0-e76e-4430-9284-c1068694b47e","resolution":{"observed_at":"2026-08-06T22:30:29.181666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-06T18:16:07.543314Z","title":"Chang, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08983","last_updated":"2025-07-11T19:35:29Z","snapshot_observed_at":"2026-08-06T18:05:14.367192Z","submitted_at":"2025-07-11T19:35:29Z","title":"Exploiting Leaderboards for Large-Scale Distribution of Malicious Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:07.543314Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2507.08983"},"observation_digest":"sha256:06bf81697098376669080bf5d4f7e89583ec519c50b087d0d31a4dcd9ba3ca43","observation_id":"e4479443-39dc-4cf1-96c9-f96965848b79","resolution":{"observed_at":"2026-08-06T18:16:07.543314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":"2504.07114","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2504.07114","venue":null,"work_id":"7bde547f-b27b-46c5-aebe-07c965260367","year":2024},"citing_paper":{"arxiv_id":"2510.18731","last_updated":"2026-04-29T19:05:29Z","snapshot_observed_at":"2026-07-06T22:33:43.999976Z","submitted_at":"2025-10-21T15:32:26Z","title":"Mitigating Lost in Multi-turn Conversation via Curriculum RL with Verifiable Accuracy and Abstention Rewards","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T05:04:10.226166Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2510.18731"},"observation_digest":"sha256:e57b8577f63a97408004f2f255b5c20b8e36419967433f4a9cba1c948043be84","observation_id":"f6526d21-e822-4690-ae2d-1722ca13d9c4","resolution":{"observed_at":"2026-05-18T05:05:54.829589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-07-14T11:49:31.595873Z","title":"arXiv preprint arXiv:2504.07114 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-14T11:49:31.595873Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:b830adf9dafaf9a083f3ff6b8207f294f03c9b60a749fc4c27b23a94d9639ce6","observation_id":"37b2e37a-518e-46b9-b839-f64d1398afe8","resolution":{"observed_at":"2026-07-14T11:49:31.595873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-02T07:20:34.591235Z","title":"arXiv preprint arXiv:2504.07114 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:34.591235Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:c9d10d9cd2edbb8008db21a1ca24bf980f18261461350f3e2a9048306d444a99","observation_id":"52ea65f1-f84f-45ff-b0fc-ca81773892be","resolution":{"observed_at":"2026-08-02T07:20:34.591235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.07114/citation-record","integrity":"/paper/2504.07114/integrity","json":"/paper/2504.07114/citation-record.json","paper":"/paper/2504.07114"},"outbound":[],"paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2504.07114."}