{"as_of":"2026-08-08T00:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c905c28f748a4e9f60bad680e5ddecae870622b4f13911764465f1a7cb2d589","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:58.568816Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":6,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T13:17:39.444002Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2407.21772"},"observation_digest":"sha256:c68cad8ec28e36be53931486abac80c9e6d48c0241ad37ea51c0f1f621f29e96","observation_id":"890944fb-0147-4a33-afbe-c6476202fa84","resolution":{"observed_at":"2026-05-20T13:17:39.527398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2504.13217","last_updated":"2026-05-18T14:05:55Z","snapshot_observed_at":"2026-08-01T15:57:04.534831Z","submitted_at":"2025-04-17T04:00:40Z","title":"Sustainability via LLM Right-sizing","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T19:24:58.690462Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2504.13217"},"observation_digest":"sha256:76af3f5484c86280742e058de219e301e15ccfe90bc14a4339467fc9374e1533","observation_id":"83cfefb7-5384-4832-8fec-07716a0c6b44","resolution":{"observed_at":"2026-05-22T19:25:03.702637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2504.20605","last_updated":"2026-05-02T05:59:29Z","snapshot_observed_at":"2026-07-06T21:16:23.106510Z","submitted_at":"2025-04-29T10:15:28Z","title":"TF1-EN-3M: Three Million Synthetic Moral Fables for Training Small, Open Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T19:01:42.307514Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2504.20605"},"observation_digest":"sha256:8a56d48c55cd71f9d3c2ce751db92118a9539cde642a722876de3afbf19b623b","observation_id":"4c48cbe3-b118-422a-b45b-530734da7e96","resolution":{"observed_at":"2026-05-22T19:01:57.855097Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T15:29:58.568816Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14978","last_updated":"2025-08-15T23:31:27Z","snapshot_observed_at":"2026-08-07T19:41:32.840096Z","submitted_at":"2025-05-20T23:40:57Z","title":"JARVIS: A Multi-Agent Code Assistant for High-Quality EDA Script Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:58.568816Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.14978"},"observation_digest":"sha256:61d5feaf7409f4ce855c94d53ba9df6b4dcb6ccdc6b3aa64bd95ade04f317eae","observation_id":"725c5199-8b6e-437d-b9e0-eb3305b62565","resolution":{"observed_at":"2026-08-07T15:29:58.568816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T14:49:32.064271Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17615","last_updated":"2025-05-23T08:22:09Z","snapshot_observed_at":"2026-08-07T14:41:42.448586Z","submitted_at":"2025-05-23T08:22:09Z","title":"Large language model as user daily behavior data generator: balancing population diversity and individual personality","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:49:32.064271Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.17615"},"observation_digest":"sha256:f623efb244eb564bb6c7f9411bc1a22300569881b1780e8762c6cc2e4e05acb2","observation_id":"f413e2ad-43c6-4d89-a4db-76e344c06d18","resolution":{"observed_at":"2026-08-07T14:49:32.064271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T14:33:13.460742Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":272,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.460742Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:3b4da289c2d3d080b5f485ba60da0e7738e6a58b10665d80182414d8c507b12f","observation_id":"a6823ea5-7bdf-4c84-a979-7dd7cfc98994","resolution":{"observed_at":"2026-08-07T14:33:13.460742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T14:00:31.486151Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20416","last_updated":"2025-05-26T18:06:50Z","snapshot_observed_at":"2026-08-07T13:52:46.937698Z","submitted_at":"2025-05-26T18:06:50Z","title":"GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:00:31.486151Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.20416"},"observation_digest":"sha256:2f6a5fda80ffa126269423e1bf77315a5783533e021248e235a4092aadfcb550","observation_id":"e988690b-12a9-44ef-9570-b074cb7ce78d","resolution":{"observed_at":"2026-08-07T14:00:31.486151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T13:56:04.125085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20500","last_updated":"2025-05-26T20:01:44Z","snapshot_observed_at":"2026-08-07T13:51:04.145641Z","submitted_at":"2025-05-26T20:01:44Z","title":"Beyond Keywords: Evaluating Large Language Model Classification of Nuanced Ableism","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:04.125085Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.20500"},"observation_digest":"sha256:833ea272b5a52dd30348df19d7e14392775ab03160e8d1c75a0f9e325d433fb0","observation_id":"99359307-681a-4093-852c-b3bfbc5a5ed4","resolution":{"observed_at":"2026-08-07T13:56:04.125085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T13:08:01.650048Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22591","last_updated":"2025-05-28T17:02:47Z","snapshot_observed_at":"2026-08-07T13:01:09.104228Z","submitted_at":"2025-05-28T17:02:47Z","title":"Self-Error-Instruct: Generalizing from Errors for LLMs Mathematical Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:01.650048Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.22591"},"observation_digest":"sha256:d21cf6a1bb6bb954c12a022aa0fc7807585fc7cbcd2d29c0302abf2481269d6a","observation_id":"bd5b2807-5380-4afa-b7fd-cb19bde98ccd","resolution":{"observed_at":"2026-08-07T13:08:01.650048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T12:44:06.650241Z","title":"On llms-driven synthetic data generation, curation, and evaluation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23996","last_updated":"2025-05-29T20:45:18Z","snapshot_observed_at":"2026-08-07T21:00:36.726464Z","submitted_at":"2025-05-29T20:45:18Z","title":"Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:06.650241Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.23996"},"observation_digest":"sha256:d51558664b3d13b45d7548313952f226644fe412221163eaefef5f3b8a10b145","observation_id":"b8060b6a-96bb-4117-b0b6-c8d9a0695d7d","resolution":{"observed_at":"2026-08-07T12:44:06.650241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T12:35:30.421658Z","title":"org/abs/2406.15126,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24292","last_updated":"2025-05-30T07:06:11Z","snapshot_observed_at":"2026-08-07T12:24:21.752751Z","submitted_at":"2025-05-30T07:06:11Z","title":"Mind the Quote: Enabling Quotation-Aware Dialogue in LLMs via Plug-and-Play Modules","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:30.421658Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2505.24292"},"observation_digest":"sha256:172a07174acf885cfdb3701c582d0148bb01b2b08460325f0112efc4fccac204","observation_id":"3c26e6a5-b823-4894-9ec8-1e16ed46b9f6","resolution":{"observed_at":"2026-08-07T12:35:30.421658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T11:07:56.669407Z","title":"On llms-driven synthetic data generation, curation, and evaluation: A survey.arXiv preprint arXiv:2406.15126, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03448","last_updated":"2025-06-03T23:20:24Z","snapshot_observed_at":"2026-08-07T11:00:30.403553Z","submitted_at":"2025-06-03T23:20:24Z","title":"RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:56.669407Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.03448"},"observation_digest":"sha256:d028fdd0fa8ae2189c99d0089dbdf8cc6c59ba31c9327490b903d69ea9c84852","observation_id":"2696c1ba-bdf1-49a3-b809-0e61438c4ba9","resolution":{"observed_at":"2026-08-07T11:07:56.669407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T10:50:50.163370Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04172","last_updated":"2025-06-04T17:15:19Z","snapshot_observed_at":"2026-08-07T10:44:14.455669Z","submitted_at":"2025-06-04T17:15:19Z","title":"Does Prompt Design Impact Quality of Data Imputation by LLMs?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:50.163370Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.04172"},"observation_digest":"sha256:08ae0177c8449934608239fdac7f8d4fc7c3b2d6c33b21eded44938efb05bc64","observation_id":"bab40330-8c93-4715-950b-a85c840ea0ef","resolution":{"observed_at":"2026-08-07T10:50:50.163370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T05:33:50.951802Z","title":"On LLMs-Driven Synthetic Data Gener- ation, Curation, and Evaluation: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07647","last_updated":"2025-06-09T11:12:02Z","snapshot_observed_at":"2026-08-07T22:34:01.355447Z","submitted_at":"2025-06-09T11:12:02Z","title":"Foundation Model Empowered Synesthesia of Machines (SoM): AI-native Intelligent Multi-Modal Sensing-Communication Integration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:50.951802Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.07647"},"observation_digest":"sha256:c7542218a478f1d343e587aeaa268f35b2d2f603af5707fd6651913e509c2e28","observation_id":"93bbf116-0989-4c37-8b3c-b4001d090f20","resolution":{"observed_at":"2026-08-07T05:33:50.951802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T05:05:37.118238Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08750","last_updated":"2025-06-10T12:45:12Z","snapshot_observed_at":"2026-08-07T05:00:24.387959Z","submitted_at":"2025-06-10T12:45:12Z","title":"Unlocking the Potential of Large Language Models in the Nuclear Industry with Synthetic Data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:05:37.118238Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.08750"},"observation_digest":"sha256:2b48d154fd90d9783461a943ecd7d64fc7db2523516b58d3d9c28dc8dff76232","observation_id":"574188a8-7994-4b1b-aa44-c4fafaf13b44","resolution":{"observed_at":"2026-08-07T05:05:37.118238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-07T00:14:06.967525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14927","last_updated":"2025-06-17T19:14:30Z","snapshot_observed_at":"2026-08-07T22:44:05.385663Z","submitted_at":"2025-06-17T19:14:30Z","title":"MDBench: A Synthetic Multi-Document Reasoning Benchmark Generated with Knowledge Guidance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:06.967525Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.14927"},"observation_digest":"sha256:d8b42bbba20e2cc3ba1dc3807c90d3e742dea8c7d92f4c914ab8332abc69925a","observation_id":"fcd82b9e-de32-48a2-8c7e-f66f1cbf1563","resolution":{"observed_at":"2026-08-07T00:14:06.967525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T22:56:32.834913Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20274","last_updated":"2025-06-25T09:34:25Z","snapshot_observed_at":"2026-08-07T12:25:51.783364Z","submitted_at":"2025-06-25T09:34:25Z","title":"Enterprise Large Language Model Evaluation Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:32.834913Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.20274"},"observation_digest":"sha256:49f65dbc340a9522166a08e5d7e013cc965d2d1cd8556aac0529663fbbeaf053","observation_id":"c3dea55e-8b96-4cb9-97c7-39ffa85710e5","resolution":{"observed_at":"2026-08-06T22:56:32.834913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T21:36:40.094301Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23762","last_updated":"2025-06-30T12:09:29Z","snapshot_observed_at":"2026-08-06T21:29:49.550137Z","submitted_at":"2025-06-30T12:09:29Z","title":"Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead","version":1},"reference_index":235,"source":"pdf_text","source_observed_at":"2026-08-06T21:36:40.094301Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2506.23762"},"observation_digest":"sha256:903b9c3655484547238b3f8dc050161de80c6ebabefaf41063e6b8c6412d399a","observation_id":"1b340424-07fc-4105-aed3-5e3db21e1b0c","resolution":{"observed_at":"2026-08-06T21:36:40.094301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T20:25:24.594546Z","title":"On llms-driven synthetic data generation, curation, and evaluation: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02804","last_updated":"2026-06-28T12:40:31Z","snapshot_observed_at":"2026-08-07T08:25:09.971477Z","submitted_at":"2025-07-03T17:07:20Z","title":"Multimodal Mathematical Reasoning with Diverse Solving Perspective","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T20:25:24.594546Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2507.02804"},"observation_digest":"sha256:0656816aa4a9573e528f270da32e5ab03fff748dc970bd9093c504bd122fed14","observation_id":"7e4b5e67-e0bb-4d3f-bf5f-471fee0c1b7d","resolution":{"observed_at":"2026-08-06T20:25:24.594546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T15:46:27.789467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15092","last_updated":"2025-07-20T19:14:43Z","snapshot_observed_at":"2026-08-07T20:32:21.745386Z","submitted_at":"2025-07-20T19:14:43Z","title":"A Penalty Goes a Long Way: Measuring Lexical Diversity in Synthetic Texts Under Prompt-Influenced Length Variations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:46:27.789467Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2507.15092"},"observation_digest":"sha256:de4d0f17a3c5ae89cd7aeb3c996ebf905cdf36918aa52a96a35b642cb835d188","observation_id":"f3f078ea-e490-4762-8c9a-1bafb49c87b4","resolution":{"observed_at":"2026-08-06T15:46:27.789467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T15:50:37.908542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15892","last_updated":"2025-07-20T13:41:02Z","snapshot_observed_at":"2026-08-06T15:41:37.557381Z","submitted_at":"2025-07-20T13:41:02Z","title":"StaAgent: An Agentic Framework for Testing Static Analyzers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:37.908542Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2507.15892"},"observation_digest":"sha256:1b9fde67e624f9fbc2e5427275544f661817273f8d0192c4d69e17411ec21c32","observation_id":"2e77c0ea-1796-4f21-a6a5-65b116f4353f","resolution":{"observed_at":"2026-08-06T15:50:37.908542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-06T05:22:29.785059Z","title":"arXiv preprint arXiv:2406.15126 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01866","last_updated":"2025-08-03T17:42:00Z","snapshot_observed_at":"2026-08-06T23:06:11.846316Z","submitted_at":"2025-08-03T17:42:00Z","title":"Separation Logic of Generic Resources via Sheafeology","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:22:29.785059Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2508.01866"},"observation_digest":"sha256:94e80c2e7f71b91799f0a3e6a10faceaa6fe12f4d8486ce43bdfc299a5c924f3","observation_id":"2638cc1b-afbf-463a-af2d-1ee6cb7c114c","resolution":{"observed_at":"2026-08-06T05:22:29.785059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T16:02:03.543010Z","title":"arXiv preprint arXiv:2406.15126","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19069","last_updated":"2025-08-26T14:26:32Z","snapshot_observed_at":"2026-08-07T02:35:16.060570Z","submitted_at":"2025-08-26T14:26:32Z","title":"Can Structured Templates Facilitate LLMs in Tackling Harder Tasks? : An Exploration of Scaling Laws by Difficulty","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T16:02:03.543010Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2508.19069"},"observation_digest":"sha256:19fa6452084ee0d7a9805f488d5136a54c6189751d3b0857cff05777f3e104d5","observation_id":"712f1cf3-7c7d-49bc-8a5e-da308e5f1203","resolution":{"observed_at":"2026-08-05T16:02:03.543010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-03T18:04:30.736714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.07246","last_updated":"2026-07-29T04:24:14Z","snapshot_observed_at":"2026-08-05T18:56:42.339423Z","submitted_at":"2025-12-08T07:40:48Z","title":"Ensembling LLM-Induced Decision Trees for Explainable and Robust Error Detection","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T18:04:30.736714Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2512.07246"},"observation_digest":"sha256:01446f252ebac43246da96cdf573485032e6abda9c5112a0c01bbd4bb6053714","observation_id":"20af70e1-bc96-44b8-bc74-c32143b195a6","resolution":{"observed_at":"2026-08-03T18:04:30.736714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-03T01:17:11.752127Z","title":"On llms-driven synthetic data generation, cura- tion, and evaluation: A survey.arXiv preprint arXiv:2406.15126, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10388","last_updated":"2026-05-29T05:05:29Z","snapshot_observed_at":"2026-08-07T17:40:15.715656Z","submitted_at":"2026-02-11T00:23:13Z","title":"Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:17:11.752127Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2602.10388"},"observation_digest":"sha256:602c5fca17a32c6881b807076693031f671b4197646e0e7e487f8ac231ed4e55","observation_id":"d3266ee6-522b-4bee-9f24-2c6dec1c55d6","resolution":{"observed_at":"2026-08-03T01:17:11.752127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-02T20:26:40.494982Z","title":"On llms-driven synthetic data generation, curation, and evaluation: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23312","last_updated":"2026-06-02T19:40:01Z","snapshot_observed_at":"2026-08-05T07:45:18.112116Z","submitted_at":"2026-02-26T18:20:26Z","title":"Evaluating Zero-Shot and One-Shot Adaptation of Small Language Models in Leader-Follower Interaction","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T20:26:40.494982Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2602.23312"},"observation_digest":"sha256:72a5f78cfb1601161ad5f8361092c7c146b3025895b57a1b4621b73a0fdf85fb","observation_id":"a659fb5e-e911-4f3a-ab29-9e12d0ff0099","resolution":{"observed_at":"2026-08-02T20:26:40.494982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2603.12296","last_updated":"2026-05-19T01:33:15Z","snapshot_observed_at":"2026-08-03T13:09:34.264460Z","submitted_at":"2026-03-11T20:36:02Z","title":"Synthetic Data Generation for Brain-Computer Interfaces: Overview, Benchmarking, and Future Directions","version":2},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-05-21T11:26:13.074820Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2603.12296"},"observation_digest":"sha256:12bef8c80bcfff3ec6656d55aa6f379d6aa163f2ce5d89d1d0daa39bd00357a9","observation_id":"9c00e8b3-e66b-48be-b0ad-7a4b50ce7297","resolution":{"observed_at":"2026-05-21T11:30:02.555967Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2604.24544","last_updated":"2026-04-27T14:39:41Z","snapshot_observed_at":"2026-07-06T23:10:33.821313Z","submitted_at":"2026-04-27T14:39:41Z","title":"STELLAR-E: a Synthetic, Tailored, End-to-end LLM Application Rigorous Evaluator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T03:39:30.528601Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2604.24544"},"observation_digest":"sha256:136612826ddc4b4b7994fa10ecdbe1c1e317645da41ca3f8c5682295af947d5a","observation_id":"23c81e38-a8d9-4451-b942-6d7d66a9dcde","resolution":{"observed_at":"2026-05-11T22:01:10.900240Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2605.30529","last_updated":"2026-05-28T20:06:43Z","snapshot_observed_at":"2026-08-02T08:55:40.388952Z","submitted_at":"2026-05-28T20:06:43Z","title":"Generalistic or Specific Embeddings, Which is Better? An Empirical Study on Search for Clinical Coding in Non-English Languages","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T07:27:03.060416Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2605.30529"},"observation_digest":"sha256:3873127d703a2930f3c0d2a8c1521facbc746a39b67de65ee3f3d9c3f447d0cd","observation_id":"504947f0-1718-445b-9340-02f3f479b4cc","resolution":{"observed_at":"2026-06-29T07:33:14.004650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2605.30637","last_updated":"2026-05-28T22:38:26Z","snapshot_observed_at":"2026-07-06T23:39:53.132531Z","submitted_at":"2026-05-28T22:38:26Z","title":"EHRBench: An Automated and Reliable EHR-based Benchmark for Clinical Decision Making with LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T06:41:06.828814Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2605.30637"},"observation_digest":"sha256:d0bdaa5547de89fa654f9cd17ced49c21931aafb529c7b6953cafc7025465e55","observation_id":"b07bf8c5-9b38-4291-b43e-1e213c5f7033","resolution":{"observed_at":"2026-06-29T06:43:10.450895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":183,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:d0e67ff6c2d2caf846b87aa82bd606079d787a7dbe3ec5b8b5febd6e6f7ec7cf","observation_id":"743079c3-2c4b-4f49-959f-2c9ce247e40d","resolution":{"observed_at":"2026-06-30T22:15:05.703956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":"2406.15126","doi":"10.48550/arxiv.2406.15126","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luccioni, A","venue":"arXiv (Cornell University)","work_id":"157afed6-d453-4ad3-8c5e-f0f8d311d18c","year":2024},"citing_paper":{"arxiv_id":"2606.12443","last_updated":"2026-05-19T16:58:15Z","snapshot_observed_at":"2026-07-06T23:51:22.219590Z","submitted_at":"2026-05-19T16:58:15Z","title":"Occupational Prompting Reveals Cultural Bias in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T18:03:09.275405Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2606.12443"},"observation_digest":"sha256:4e5a77dd925dbb37071349a8f36eeebfc66456545a29dc87afffb67d83dacee8","observation_id":"12b1cfe5-285e-4912-9d0e-03f1aeea657f","resolution":{"observed_at":"2026-06-30T18:04:57.826486Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.15126/citation-record","integrity":"/paper/2406.15126/integrity","json":"/paper/2406.15126/citation-record.json","paper":"/paper/2406.15126"},"outbound":[],"paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:34:51.641949Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2406.15126."}