{"as_of":"2026-08-07T11:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e75630ac54933f45cd2b714a9efa16df43900a72b91f978368d23db819b03543","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:27:16.063038Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:14:36.119264Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:27:26.253320Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"cited_work":{"arxiv_id":"2507.15839","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.15839","snapshot_observed_at":"2026-07-02T22:27:26.253320Z","title":"Nguyen, S","venue":null,"work_id":"94ecb4a0-1122-4793-849e-8c983e6e7561","year":2025},"citing_paper":{"arxiv_id":"2606.08736","last_updated":"2026-06-07T17:10:40Z","snapshot_observed_at":"2026-08-07T01:30:36.696297Z","submitted_at":"2026-06-07T17:10:40Z","title":"Declarative Outcome-Conformant Synthesis: Exact, Closed-Form Specification Satisfaction and a Conformance Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T18:52:00.562764Z"},"links":{"cited_paper":"/paper/2507.15839","citing_paper":"/paper/2606.08736"},"observation_digest":"sha256:7a1456a9af4712a5532b39c8c7bf5f94fd83e10760318cb7ca549e6c15c0d65b","observation_id":"427ddbf5-1063-44fa-be97-d5beadcf1e59","resolution":{"observed_at":"2026-07-02T22:27:26.254947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15839","snapshot_observed_at":"2026-08-04T19:14:36.119264Z","title":"InInternational Conference on Learning Representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01879","last_updated":"2026-08-03T08:24:35Z","snapshot_observed_at":"2026-08-06T23:33:23.537602Z","submitted_at":"2026-08-03T08:24:35Z","title":"LAB-Tab: LLM-Augmented Bayesian Network Adaptation for Few-Shot Tabular Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T19:14:36.119264Z"},"links":{"cited_paper":"/paper/2507.15839","citing_paper":"/paper/2608.01879"},"observation_digest":"sha256:38973cbcacc90cf503dee201d5ca0ecd8f7e5fef2a557cad8b6b372ad36224c2","observation_id":"ed50973c-4a97-4cd1-8fb1-c0d6d18a04e9","resolution":{"observed_at":"2026-08-04T19:14:36.119264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15839/citation-record","integrity":"/paper/2507.15839/integrity","json":"/paper/2507.15839/citation-record.json","paper":"/paper/2507.15839"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.233227Z","title":"Geometric dataset distances via optimal transport.Advances in Neural Information Processing Systems, 33:21428–21439, 2020","venue":null,"work_id":"083292f9-0949-43c6-a628-ad2263520e75","year":2020},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.011719Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:f7143b4ad5b169a4cb84e216de112684cb10f80958e7400b7fd8cf7cff7c4935","observation_id":"f5c66ed4-2dd8-4eb3-8abe-9a5530982a9b","resolution":{"observed_at":"2026-08-06T15:27:16.235844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-06T15:27:16.014797Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.014797Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:3eb23757668e7ccc384772cad6fc8f9c187e5f5331f0d2f76f9c874bc61cd2a6","observation_id":"189340ac-502a-4102-9814-b2dd7dd538eb","resolution":{"observed_at":"2026-08-06T15:27:16.014797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06280","last_updated":"2023-04-22T10:03:23Z","snapshot_observed_at":"2026-08-04T17:31:19.505383Z","submitted_at":"2022-10-12T15:03:28Z","title":"Language Models are Realistic Tabular Data Generators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06280","snapshot_observed_at":"2026-08-06T15:27:16.017672Z","title":"Language models are realistic tabular data generators","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.017672Z"},"links":{"cited_paper":"/paper/2210.06280","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:dc9d56111860ba0d4fa9002861dd10b1334a4eada10188db3c1fdf081a6b2e7f","observation_id":"47ebc4f0-ce5b-4f8c-97a6-1625b353953b","resolution":{"observed_at":"2026-08-06T15:27:16.017672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.020532Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.020532Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:4140378a47570a0777a07639dcc40524ddce404475236d19f350717706f54b8b","observation_id":"bd347e56-d179-4312-b9a4-1a721477534a","resolution":{"observed_at":"2026-08-06T15:27:16.020532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T15:27:16.023027Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.023027Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:49e2748bec2c3799fd9988029ed19639623188e620fbf5afacd4b3e3448632f7","observation_id":"3a3b108a-438b-4ca4-a805-a20cc8690baf","resolution":{"observed_at":"2026-08-06T15:27:16.023027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.220332Z","title":"Generating multi-label discrete patient records using generative adversarial networks","venue":null,"work_id":"b4586586-7795-4123-8b71-83125ae575e8","year":2017},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.025502Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:09de06015e30a49922496008f5e1a625c94f602fcb1b26ae66b0c84cf98fe0f5","observation_id":"582247cd-7d02-4300-ac69-429c95643d5c","resolution":{"observed_at":"2026-08-06T15:27:16.222925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.212874Z","title":"Faker, n.d","venue":null,"work_id":"63d7b24d-d4c0-406f-9606-229635887f74","year":2025},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.028625Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:12413990e898e314dbb6a4f253cf4924eb231e627b1662855357052e4e112904","observation_id":"9c5e1833-5e71-4038-a33a-9a4b286eef2c","resolution":{"observed_at":"2026-08-06T15:27:16.215428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.205246Z","title":"Openfema data sets, 2025","venue":null,"work_id":"c6de0695-eb3f-4e4a-b23e-ae1f6526acad","year":2025},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.030903Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:99463c74f13e394610211979d38a8dce4a866b7f632481506641ae50392dffd4","observation_id":"510b3035-d60e-424d-a087-c91780fef745","resolution":{"observed_at":"2026-08-06T15:27:16.207811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.198031Z","title":"Name generator, 2025","venue":null,"work_id":"3f8589f5-7ea9-4799-9576-814a0334479c","year":2025},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.033167Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:07cb3d0e6b846e2bafc826d927e7694e2569a7107df373df37fd9176e89fd340","observation_id":"39f525bf-d756-4516-b147-c0c02696d519","resolution":{"observed_at":"2026-08-06T15:27:16.200442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.190399Z","title":"Generative adversarial networks","venue":null,"work_id":"9b8eef0d-b440-4388-bdcb-429f5ea516fb","year":2020},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.035354Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:79cb9ea8fd656410572acac2a62ae7d68e4f4ef2b7b60e8798f571533fe96cb0","observation_id":"b5ce9250-02fb-41e2-b315-7ff75ade22e3","resolution":{"observed_at":"2026-08-06T15:27:16.192828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04190","last_updated":"2024-03-07T03:38:44Z","snapshot_observed_at":"2026-07-06T17:40:45.750926Z","submitted_at":"2024-03-07T03:38:44Z","title":"Generative AI for Synthetic Data Generation: Methods, Challenges and the Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04190","snapshot_observed_at":"2026-08-06T15:27:16.037597Z","title":"Generative ai for synthetic data generation: Methods, challenges and the future","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.037597Z"},"links":{"cited_paper":"/paper/2403.04190","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:bda67757d3f1239358e02bfe4ecf9d118fc6f78b0459b76ccb99f562727e4de6","observation_id":"8d669bfb-5e19-47b4-81c6-d95cca2c3e72","resolution":{"observed_at":"2026-08-06T15:27:16.037597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05144","last_updated":"2024-04-08T01:55:28Z","snapshot_observed_at":"2026-07-06T17:56:53.470829Z","submitted_at":"2024-04-08T01:55:28Z","title":"Enhancing Clinical Efficiency through LLM: Discharge Note Generation for Cardiac Patients","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05144","snapshot_observed_at":"2026-08-06T15:27:16.040197Z","title":"Enhancing clinical efficiency through llm: Discharge note generation for cardiac patients","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.040197Z"},"links":{"cited_paper":"/paper/2404.05144","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:e162d2d9a16781046d682eb7caee4f59df0a0bed3538eca32ce19d620231bb92","observation_id":"b3afa05b-9b01-42a4-b3fc-5ec83c7a7d97","resolution":{"observed_at":"2026-08-06T15:27:16.040197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.042680Z","title":"Auto-encoding variational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.042680Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:e32d716336f06555f78674e7f666619dfece545f62ffa0a5c00a1b73d77826b2","observation_id":"178dac75-ffd1-4885-862c-079217a3902e","resolution":{"observed_at":"2026-08-06T15:27:16.042680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.178551Z","title":"Medsyn: Llm-based synthetic medical text generation framework","venue":null,"work_id":"5f8594e2-9b9d-4610-87d0-14e144969094","year":2024},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.044976Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:0d10c503b921708f5d0dc167c639d93bb352d1973268032a9299d5393f49cef9","observation_id":"656e54f8-49d0-43f1-a4c5-ab1e1a5cba5e","resolution":{"observed_at":"2026-08-06T15:27:16.180858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.170899Z","title":"Transforming dental diagnostics with arti- ficial intelligence: advanced integration of chatgpt and large language models for patient care","venue":null,"work_id":"a78e13d0-b071-4d5d-b870-faa1cf09bcde","year":2025},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.047073Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:997d59f42ed1cecfddc1e8fab553039e68b6e23f475d0f7930885ae08baa13ed","observation_id":"5c40feb9-ab0d-4b11-85ad-3f1b6b76e043","resolution":{"observed_at":"2026-08-06T15:27:16.173514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.163582Z","title":"The synthetic data vault","venue":null,"work_id":"21039a44-5d3f-4e7c-8dea-9fcdede33aa6","year":2016},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.049286Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:60726b7a55fc9bc581f7928b14000490432dca82c0a331e2495a3c042696265b","observation_id":"a6ca0328-b14a-4e09-98cc-cd299f711c6a","resolution":{"observed_at":"2026-08-06T15:27:16.165939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.155956Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"16417ff5-5783-44e6-b467-819e1569ef02","year":2019},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.051397Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:43ced488f3c4267100f9bd95f2082d4b0c89c7e2529450465ae8a12567ba0cba","observation_id":"28eae8b7-864c-4238-8193-a82e93bce481","resolution":{"observed_at":"2026-08-06T15:27:16.158662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.053468Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.053468Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:7523331da31a6d5afba89440c0ff6f4f3c8eaf2af1f43fbb915f1399cbef16ae","observation_id":"a3a2fedf-5273-4c26-99be-516598c7dd3c","resolution":{"observed_at":"2026-08-06T15:27:16.053468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-03T03:32:02.223426Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-06T15:27:16.055674Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.055674Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:add0d04bfd423603317649d9d17dfbc5671bb3f2a4b5ddb6abeea5f81ed65a85","observation_id":"d43efb75-1c9d-434a-80f9-25c58bf05c5f","resolution":{"observed_at":"2026-08-06T15:27:16.055674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.02390","last_updated":"2017-02-08T12:11:41Z","snapshot_observed_at":"2026-07-06T05:29:16.241446Z","submitted_at":"2017-02-08T12:11:41Z","title":"A Hybrid Convolutional Variational Autoencoder for Text Generation","version":1},"cited_work":{"arxiv_id":"1702.02390","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.02390","snapshot_observed_at":"2026-08-06T15:27:16.091103Z","title":"A Hybrid Convolutional Variational Autoencoder for Text Generation","venue":"cs.CL","work_id":"5d5a1942-2eb8-4e87-b617-b2d039b130da","year":2017},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.058235Z"},"links":{"cited_paper":"/paper/1702.02390","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:84186d5eb99093cc9732a8500a490bf2353c841df27a9bbcb6d55f0024e9db01","observation_id":"68586a5d-58f0-4d7a-b69c-2d43d0d9999b","resolution":{"observed_at":"2026-08-06T15:27:16.095780Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07295","last_updated":"2025-03-02T01:39:57Z","snapshot_observed_at":"2026-07-06T19:30:43.691433Z","submitted_at":"2024-10-09T16:21:38Z","title":"IterGen: Iterative Semantic-aware Structured LLM Generation with Backtracking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07295","snapshot_observed_at":"2026-08-06T15:27:16.060699Z","title":"Itergen: Iterative structured llm generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.060699Z"},"links":{"cited_paper":"/paper/2410.07295","citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:395c03a9c572189def41361bc21ae10b6e079050457332d6906e4014a93eac31","observation_id":"f27cbe1d-1ee4-4a3c-8df4-3f41fbd91276","resolution":{"observed_at":"2026-08-06T15:27:16.060699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:27:16.144006Z","title":"Large language model as attributed training data generator: A tale of diversity and bias","venue":null,"work_id":"c0d41168-209d-4902-9e5c-559baed79428","year":2023},"citing_paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:16.063038Z"},"links":{"citing_paper":"/paper/2507.15839"},"observation_digest":"sha256:54cbf8a5a550f2bc22428c18ffc0f5f6ed6f532f8672292565540c1c2da62a55","observation_id":"a0c10f86-90e2-4c4b-aec5-0d0d3ff24a90","resolution":{"observed_at":"2026-08-06T15:27:16.146684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.15839","last_updated":"2025-07-21T17:51:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T15:20:00.237665Z","submitted_at":"2025-07-21T17:51:46Z","title":"FASTGEN: Fast and Cost-Effective Synthetic Tabular Data Generation with LLMs"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 2 inbound Pith citation observations for arXiv:2507.15839."}