{"as_of":"2026-08-18T17:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b0f7f1317453cf903d9914b508e75221f2d6d169b61d67b618eb26e2f551ce1","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:30:29.570448Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.04487/citation-record","integrity":"/paper/2505.04487/integrity","json":"/paper/2505.04487/citation-record.json","paper":"/paper/2505.04487"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.308448Z","title":": Self-rag: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":"1544d8a1-e9d7-4c1a-a264-5a2304b02ee7","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.387501Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:93d5ddf628b4999c479e7d883b9b7ee3b82cc0fd9dd48f2f2943178b3a088d03","observation_id":"21d23f28-d9f2-41ec-ae56-b0215dc91084","resolution":{"observed_at":"2026-08-15T23:30:30.313905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03441","last_updated":"2024-06-05T16:35:30Z","snapshot_observed_at":"2026-08-17T03:24:39.971144Z","submitted_at":"2024-06-05T16:35:30Z","title":"Cycles of Thought: Measuring LLM Confidence through Stable Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03441","snapshot_observed_at":"2026-08-15T23:30:29.392944Z","title":": Cycles of thought: Measuring llm confidence through stable explanations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.392944Z"},"links":{"cited_paper":"/paper/2406.03441","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:aedf003ade61ad739895b1350d04bcb409c98f92a6dc270bfe7a34b5eecc7059","observation_id":"f449debe-8782-4e9f-92cd-e722b0e20866","resolution":{"observed_at":"2026-08-15T23:30:29.392944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06280","last_updated":"2023-04-22T10:03:23Z","snapshot_observed_at":"2026-08-16T16:24:48.218411Z","submitted_at":"2022-10-12T15:03:28Z","title":"Language Models are Realistic Tabular Data Generators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06280","snapshot_observed_at":"2026-08-15T23:30:29.398533Z","title":": Language models are realistic tabular data generators","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.398533Z"},"links":{"cited_paper":"/paper/2210.06280","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:cc7f8f565e36365c6c3085cc8ee5989e761d9bd2c823c5ba1f02b38f5f976757","observation_id":"2cf3ee2d-f7c7-4791-a807-3624c2e5cfd3","resolution":{"observed_at":"2026-08-15T23:30:29.398533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.292246Z","title":"M., Scharl A., Nixon L","venue":null,"work_id":"01c522f8-1cc0-4035-826a-558e8381fbef","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.403601Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:e5fb4eff6688e5af817d6068a8c1fa140e1e61a936f5d92099f35ec50ec501ad","observation_id":"eb39fe71-28a2-4b5c-b3e4-3b5ec18c56ef","resolution":{"observed_at":"2026-08-15T23:30:30.297188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.276247Z","title":": Visual-interactive Exploration of Interesting Multivariate Relations in Mixed Research Data Sets","venue":null,"work_id":"ac740b05-fddf-43bc-a724-1fb60ef79a92","year":2014},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.408359Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:41c7c9803e8973eb868450fb13718a54cfbd2f16652e5f01a57cac65344eba09","observation_id":"e9389761-0b97-4658-b2dc-9cc451328eb1","resolution":{"observed_at":"2026-08-15T23:30:30.281726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.259719Z","title":": Knowledgevis: Interpreting language models by comparing fill-in-the-blank prompts","venue":null,"work_id":"777a6506-6eb7-4c49-8339-17d0cbde9ab3","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.412968Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:b1f7af38b222a20a8b26f8fe9e0f9dda7248b55e8b2af70498d03f973fa27725","observation_id":"be1c213d-36e0-4800-bb5f-8ffdf7e8ed52","resolution":{"observed_at":"2026-08-15T23:30:30.265394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.243011Z","title":"A., Fu E., Bertucci D., Holstein K., Talwalkar A., Hong J","venue":null,"work_id":"c72b6d28-9688-496b-98ec-33e1d8385124","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.418096Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:d2db61962f19ace0c037249e5b96e7d597662966b7147251242a04b98a677f15","observation_id":"b6d2d65f-308a-4795-b4b3-e92395d9408e","resolution":{"observed_at":"2026-08-15T23:30:30.248919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.227314Z","title":"S., Crossley S., Endert A","venue":null,"work_id":"2c6733f8-12ee-451b-b268-bf28232a9248","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.422837Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:f690c4b2c9de7c51f79071fa9377feefb20ae57088fff67450d642369289a1a7","observation_id":"67ffe457-b31d-417c-b7d8-07910e5d274e","resolution":{"observed_at":"2026-08-15T23:30:30.232352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.211875Z","title":null,"venue":null,"work_id":"2f256c74-a16d-4470-a9c4-caf32b572a41","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.427271Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:74040aad790dffd82f68e5dd96b524fe78727e589c9b6df17d31fe1cb2897116","observation_id":"81a5bd4e-512f-4e5a-8a40-38307c4af774","resolution":{"observed_at":"2026-08-15T23:30:30.216494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00708","last_updated":"2025-08-07T14:48:25Z","snapshot_observed_at":"2026-08-16T13:58:23.696046Z","submitted_at":"2024-04-23T19:57:03Z","title":"Understanding Large Language Model Behaviors through Interactive Counterfactual Generation and Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00708","snapshot_observed_at":"2026-08-15T23:30:29.431639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.431639Z"},"links":{"cited_paper":"/paper/2405.00708","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:a56a76b671548bd2741ce867fabd889d813bf92e85b455c9988c582f999aa868","observation_id":"76a229d4-d992-4c44-9b6a-c356a02f64ed","resolution":{"observed_at":"2026-08-15T23:30:29.431639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.194621Z","title":null,"venue":null,"work_id":"0ccc2263-6453-49ce-b335-c6a9d4127137","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.436525Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:28df79c6b9821720df36ec9b1df2c206e0448c4ee8ac9027746e214eb5d9e8ed","observation_id":"5677f1e6-0183-459b-b436-028474e6f5d7","resolution":{"observed_at":"2026-08-15T23:30:30.200273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17944","last_updated":"2024-06-21T19:59:54Z","snapshot_observed_at":"2026-08-18T04:13:28.735758Z","submitted_at":"2024-02-27T23:59:01Z","title":"Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17944","snapshot_observed_at":"2026-08-15T23:30:29.441265Z","title":"A., Zhang J., Hu Z., Qi Y., Nickleach S., Socolinsky D., Sengamedu S., Faloutsos C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.441265Z"},"links":{"cited_paper":"/paper/2402.17944","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:686d0d7db68d7f161f2e9234581264358b9b2a83bbb8ebbb14fdde32f8dafca6","observation_id":"f2b8f1b5-8b52-4ff8-a2a2-4c4244c1a6b0","resolution":{"observed_at":"2026-08-15T23:30:29.441265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10868","last_updated":"2025-02-27T15:37:21Z","snapshot_observed_at":"2026-08-15T03:30:22.750526Z","submitted_at":"2025-01-18T20:26:00Z","title":"JSONSchemaBench: A Rigorous Benchmark of Structured Outputs for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10868","snapshot_observed_at":"2026-08-15T23:30:29.446030Z","title":": Generating structured outputs from language models: Benchmark and studies","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.446030Z"},"links":{"cited_paper":"/paper/2501.10868","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:6b7f1ff996bbd58c24782a9ce722c550d737d9473083cfb40b511788fc21aed6","observation_id":"d0233cd4-6ca4-4215-a588-dc059dfb069d","resolution":{"observed_at":"2026-08-15T23:30:29.446030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.177351Z","title":": Tabllm: Few-shot classification of tabular data with large language models","venue":null,"work_id":"5b61fa52-955c-4e5b-b85e-f8e7f83ad041","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.451069Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:87b31f41c7044fbb01828f153409209567693e8a51bed78beb8036bc481c7848","observation_id":"a49d0c4f-f8cf-4721-b1e1-4b13f1a97704","resolution":{"observed_at":"2026-08-15T23:30:30.182631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11207","last_updated":"2023-10-17T12:34:32Z","snapshot_observed_at":"2026-08-16T14:51:24.284234Z","submitted_at":"2023-10-17T12:34:32Z","title":"Can Large Language Models Explain Themselves? A Study of LLM-Generated Self-Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11207","snapshot_observed_at":"2026-08-15T23:30:29.455668Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.455668Z"},"links":{"cited_paper":"/paper/2310.11207","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:d270c3623b391726d757846192d518be3434e444f14711acc3c89d705d4a2552","observation_id":"9de1ed4d-63a7-44ca-807c-887c0b58f40f","resolution":{"observed_at":"2026-08-15T23:30:29.455668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.161069Z","title":"S., Lee Y., Shin J., Kim Y.-H., Kim J","venue":null,"work_id":"0b9b9e97-01c1-45b8-9861-5d2b1fc2aa0d","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.460436Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:5d53e4ee7b3dcc2388afcb95cf822387603ea8f1e4b9c7075e4352bedc60ab31","observation_id":"5711bc59-a8a6-47a1-b645-6d73203bb682","resolution":{"observed_at":"2026-08-15T23:30:30.166397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.144353Z","title":"X., Wexler J., Reif E., Kallarackal K., Chang M., Terry M., Dixon L","venue":null,"work_id":"7de22a5b-065d-4fca-b193-befa0be2ed23","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.465072Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:c8522c18e471b8dc40ddf78b7424d512e7bae8a8a74a26fdef07a7f258f62f12","observation_id":"7de903a1-91aa-487c-a0d1-9e630203ec56","resolution":{"observed_at":"2026-08-15T23:30:30.149537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02205","last_updated":"2025-02-09T17:13:51Z","snapshot_observed_at":"2026-08-16T13:13:05.725049Z","submitted_at":"2024-10-03T04:34:04Z","title":"Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02205","snapshot_observed_at":"2026-08-15T23:30:29.469678Z","title":": Aligning with logic: Measuring, evaluating and improving logical consistency in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.469678Z"},"links":{"cited_paper":"/paper/2410.02205","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:dd06779a15cc272270d0449383145c11b033cfea2db723e62ad813ceb3437acb","observation_id":"3996e708-4c99-4d34-8dd6-c6c6424377af","resolution":{"observed_at":"2026-08-15T23:30:29.469678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02762","last_updated":"2024-12-31T06:54:19Z","snapshot_observed_at":"2026-08-16T15:18:21.421288Z","submitted_at":"2023-07-06T04:05:44Z","title":"PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02762","snapshot_observed_at":"2026-08-15T23:30:29.474521Z","title":": Prd: Peer rank and discussion improve large language model based evaluations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.474521Z"},"links":{"cited_paper":"/paper/2307.02762","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:b2a85b1cd9ae04f828d069f475156bfc967dbcd485ec106645ea4fad262727a9","observation_id":"37064ebf-fadd-475c-b2cf-15f888bd95bf","resolution":{"observed_at":"2026-08-15T23:30:29.474521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-08-18T08:00:35.964338Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-15T23:30:29.479293Z","title":": On llms-driven synthetic data generation, curation, and evaluation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.479293Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:76186a45254fb0ea776195e5417001a5c3be66ff5b4c7798647daf46e3c18991","observation_id":"475604ba-763d-4408-8e3e-b81e425cff1a","resolution":{"observed_at":"2026-08-15T23:30:29.479293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.127107Z","title":"C., Bryan C","venue":null,"work_id":"cd474173-9d8b-423e-a9f1-d4f72f6f189c","year":2025},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.483939Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:45810052e64905c96ee11c2af9e6976aa6f11da9ec85bf098ebf10f7845de4a3","observation_id":"556d888a-4216-445d-8be5-3a602167b0ee","resolution":{"observed_at":"2026-08-15T23:30:30.132973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:29.488329Z","title":": A review of faithfulness metrics for hallucination assessment in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.488329Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:6c35cdd73e67a593617cca92071e63888b88d20b8dfe32e775bbafcde977a05e","observation_id":"c36cb41c-655c-4386-9c12-606e25cf680f","resolution":{"observed_at":"2026-08-15T23:30:29.488329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.111037Z","title":": Assessing the potentials of llms and gans as state-of-the-art tabular synthetic data generation methods","venue":null,"work_id":"69f77905-124e-4bcb-81c9-3a56ae7b7ec0","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.492762Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:e8cc46f7a8cfa053b7a15c99edfad582e971ab13677f8bef89e83c0890afa9ec","observation_id":"0d7807c7-f86c-4544-a8a1-6c8e5d905f4c","resolution":{"observed_at":"2026-08-15T23:30:30.115889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:29.497218Z","title":": Visualization analysis and design","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.497218Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:e3efd0412ab31eecfa50cecf5112eb9cafe3e206970998990061889141268b05","observation_id":"13d873e3-7df3-4086-964f-b19684e9c475","resolution":{"observed_at":"2026-08-15T23:30:29.497218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03479","last_updated":"2024-07-03T19:53:47Z","snapshot_observed_at":"2026-08-16T13:37:15.218290Z","submitted_at":"2024-07-03T19:53:47Z","title":"Human-Centered Design Recommendations for LLM-as-a-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03479","snapshot_observed_at":"2026-08-15T23:30:29.502034Z","title":"S., Johnson J., Nair R., Daly E., Geyer W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.502034Z"},"links":{"cited_paper":"/paper/2407.03479","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:c4eb9c487e3ff0d309ba60e5bc134c2014fb0f6949bad87cd5850e69e03058f4","observation_id":"70fa1381-9ced-4a64-ac84-4ef91d15ef08","resolution":{"observed_at":"2026-08-15T23:30:29.502034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.083180Z","title":": Assessing the research landscape and clinical utility of large language models: a scoping review","venue":null,"work_id":"89bdeb74-216b-4837-8ecc-f9b018c46d5d","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.506891Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:36ada1af5e28b6dce44b1674a1fa99173bde07b9c02600a9263282d171bbafc5","observation_id":"37ddca93-e3a9-4fe4-8958-218160d9dfee","resolution":{"observed_at":"2026-08-15T23:30:30.088749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.065861Z","title":": LFPeers : Temporal similarity search and result exploration","venue":null,"work_id":"4b50f694-febb-4dd3-9a15-0cc5ea79afe7","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.511587Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:9cb1f0046080573f079a135a89c5b3869d11bb54c8f07710ac952dbcb3ee6a7b","observation_id":"38aa9515-f065-4c3c-8de2-5be255154004","resolution":{"observed_at":"2026-08-15T23:30:30.070908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11840","last_updated":"2026-07-29T21:54:40Z","snapshot_observed_at":"2026-08-17T19:24:07.879665Z","submitted_at":"2025-01-21T02:49:43Z","title":"AI-Assisted Data Extraction for Systematic Reviews in Education","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11840","snapshot_observed_at":"2026-08-15T23:30:29.516917Z","title":"L., Jaldi C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.516917Z"},"links":{"cited_paper":"/paper/2501.11840","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:120ced2c378afd1d09c5c19ce3c6878b3cad3947b1d8e5866d7ca1906ee34bc2","observation_id":"e031bf35-286f-4e8b-a3a1-ec12de05e166","resolution":{"observed_at":"2026-08-15T23:30:29.516917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03038","last_updated":"2024-03-31T20:51:33Z","snapshot_observed_at":"2026-08-16T19:43:50.873716Z","submitted_at":"2024-01-05T19:27:58Z","title":"SPADE: Synthesizing Data Quality Assertions for Large Language Model Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03038","snapshot_observed_at":"2026-08-15T23:30:29.521750Z","title":"G., Wu E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.521750Z"},"links":{"cited_paper":"/paper/2401.03038","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:c7c31653b6c5279f595139ff60d81c75fd545f6c8b160a877b52007fdeb68136","observation_id":"de5ba155-d913-4928-8f8f-81de0408d9dc","resolution":{"observed_at":"2026-08-15T23:30:29.521750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.049885Z","title":null,"venue":null,"work_id":"5abc8ffb-8c9d-4a45-b510-2d53337f0bee","year":2022},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.526194Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:21d8ebc063bb56d093b1220456971002e5a7104368172bfd0b79af22728b778b","observation_id":"79f73cb5-ba24-4814-bb23-2cffd1f60265","resolution":{"observed_at":"2026-08-15T23:30:30.054764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15250","last_updated":"2024-06-24T07:49:25Z","snapshot_observed_at":"2026-08-16T14:07:18.787739Z","submitted_at":"2024-03-22T14:47:35Z","title":"Comprehensive Reassessment of Large-Scale Evaluation Outcomes in LLMs: A Multifaceted Statistical Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15250","snapshot_observed_at":"2026-08-15T23:30:29.530638Z","title":": Comprehensive reassessment of large-scale evaluation outcomes in llms: A multifaceted statistical approach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.530638Z"},"links":{"cited_paper":"/paper/2403.15250","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:5eb4145b3f5139ae32775a46ea05c659d5792c31289e4ea808ffd5344c11ed12","observation_id":"1852a8b1-6bd0-43ee-a98f-d89e1de1759b","resolution":{"observed_at":"2026-08-15T23:30:29.530638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.032874Z","title":": Who validates the validators? aligning llm-assisted evaluation of llm outputs with human preferences","venue":null,"work_id":"abbb9238-0230-4cf7-8a7a-6dbf982d215e","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.535558Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:e59de22cd86755ceaae8d6fddc6a06add2fe7bb82cb1915a49d1d7c77e6196f6","observation_id":"97c8c5f1-4665-4c15-99a4-8a6f4fd07fe3","resolution":{"observed_at":"2026-08-15T23:30:30.038137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05122","last_updated":"2020-08-12T06:07:44Z","snapshot_observed_at":"2026-08-02T21:59:17.195799Z","submitted_at":"2020-08-12T06:07:44Z","title":"The Language Interpretability Tool: Extensible, Interactive Visualizations and Analysis for NLP Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.05122","snapshot_observed_at":"2026-08-15T23:30:29.540261Z","title":": The language interpretability tool: Extensible, interactive visualizations and analysis for nlp models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.540261Z"},"links":{"cited_paper":"/paper/2008.05122","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:f3eac4597371d037c17113f20a98db536aec28daae46b6a4d4c628c3f4c4d7c8","observation_id":"50006088-a5b1-42aa-acea-ca7b9fea26df","resolution":{"observed_at":"2026-08-15T23:30:29.540261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:30.016184Z","title":": Human-llm collaborative annotation through effective verification of llm labels","venue":null,"work_id":"f2196f77-27c7-4cd5-8e30-457334b9bfe4","year":2024},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.545259Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:3c0d7183cd49e7df3e5606e8079040afc03eb434ef04ca75981df3b11dc6642a","observation_id":"ea5f47bf-c847-4cb4-b9a5-7f79ac112a50","resolution":{"observed_at":"2026-08-15T23:30:30.021401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:29.996835Z","title":": Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"7ce510dd-f673-4f83-9b51-d67079a2cf41","year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.549997Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:193291c8d1862e3ab489a96f9ac4ecd80e2a13551466d989e867adc6d7000e83","observation_id":"d50d39b3-4864-4173-9d59-00a610d5d402","resolution":{"observed_at":"2026-08-15T23:30:30.004082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14122","last_updated":"2024-04-02T01:47:40Z","snapshot_observed_at":"2026-08-16T14:50:06.706673Z","submitted_at":"2023-10-21T21:39:48Z","title":"Beyond Yes and No: Improving Zero-Shot LLM Rankers via Scoring Fine-Grained Relevance Labels","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14122","snapshot_observed_at":"2026-08-15T23:30:29.554543Z","title":": Beyond yes and no: Improving zero-shot llm rankers via scoring fine-grained relevance labels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.554543Z"},"links":{"cited_paper":"/paper/2310.14122","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:bdb1bcf4b60a6b3925bf7c686e56abea4ffe3268a04a66e995eb6e19016732ad","observation_id":"d99e551e-84cd-497c-96ba-9b6c903d47ba","resolution":{"observed_at":"2026-08-15T23:30:29.554543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10145","last_updated":"2023-04-22T08:55:33Z","snapshot_observed_at":"2026-08-17T14:45:26.211282Z","submitted_at":"2023-04-20T08:08:12Z","title":"Can ChatGPT Reproduce Human-Generated Labels? A Study of Social Computing Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10145","snapshot_observed_at":"2026-08-15T23:30:29.559195Z","title":": Can chatgpt reproduce human-generated labels? a study of social computing tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.559195Z"},"links":{"cited_paper":"/paper/2304.10145","citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:f2699c44e7db3d9b7b862dab7a7a5f80f9e423ada31f99a4ada6da55252ec438","observation_id":"cf075e40-e43e-4146-a97e-c19d761a034c","resolution":{"observed_at":"2026-08-15T23:30:29.559195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:29.564656Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.564656Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:6343e80df912f7aaaaec7d316d3030f654a427ba815a108c4657107d8158beb5","observation_id":"276cdb32-f951-41ff-b14e-c23be570b9b7","resolution":{"observed_at":"2026-08-15T23:30:29.564656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:30:29.570448Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T23:30:29.570448Z"},"links":{"citing_paper":"/paper/2505.04487"},"observation_digest":"sha256:bafc343278208b6d3bfab120be2914fb79e9206a6c6043840f9b64d35f8e41fb","observation_id":"ab723bdc-f2c5-42b8-878a-edef2438ea54","resolution":{"observed_at":"2026-08-15T23:30:29.570448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.04487","last_updated":"2025-05-07T15:01:23Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-18T13:33:30.546207Z","submitted_at":"2025-05-07T15:01:23Z","title":"A Design Space for the Critical Validation of LLM-Generated Tabular Data"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2505.04487."}