{"as_of":"2026-08-09T06:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:388ff308e37d36513a34d35cc92b508f0a9eccde41ceb0f9acdc099c404a4639","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:20:36.651160Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:26:40.199715Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08661","snapshot_observed_at":"2026-08-02T20:26:40.199715Z","title":"Few-shot LLM Synthetic Data with Distribution Matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23312","last_updated":"2026-06-02T19:40:01Z","snapshot_observed_at":"2026-08-09T02:50:43.884684Z","submitted_at":"2026-02-26T18:20:26Z","title":"Evaluating Zero-Shot and One-Shot Adaptation of Small Language Models in Leader-Follower Interaction","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T20:26:40.199715Z"},"links":{"cited_paper":"/paper/2502.08661","citing_paper":"/paper/2602.23312"},"observation_digest":"sha256:39bc171911038716076a287c0b36ad0ae0b9a1c849d9dd8441a4d993a473d6d4","observation_id":"a95febf7-cb5f-4ece-abab-2aae9f6c3dbd","resolution":{"observed_at":"2026-08-02T20:26:40.199715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.08661/citation-record","integrity":"/paper/2502.08661/integrity","json":"/paper/2502.08661/citation-record.json","paper":"/paper/2502.08661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.294068Z","title":null,"venue":null,"work_id":"b967fbee-4d44-45fd-a0e4-c6947df0b170","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.415598Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:37480a8f44b6c75e4cef80d7c6a9a55b0c1c5ba8ab13275072203d568d93f3f7","observation_id":"d62c1468-b50a-47e3-b96c-934b2c4decc9","resolution":{"observed_at":"2026-08-08T17:20:37.297619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.284184Z","title":null,"venue":null,"work_id":"cb9bb0ec-57a2-435d-abaa-9cea92df15bd","year":2007},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.424586Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:b1ffdf80053b99348922dcd2efe70e18f3d4c411b74993ab978271e896fb8ada","observation_id":"c8d9942e-84bc-4873-92a3-e2b45acf3748","resolution":{"observed_at":"2026-08-08T17:20:37.287495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.428057Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.428057Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ac7911d92e8d4e2f9ce09a20b5f4449ab712a2bb48a8c49e578c0e010b1bba37","observation_id":"38c30234-dee3-4ac2-b55a-b8b26ff90a87","resolution":{"observed_at":"2026-08-08T17:20:36.428057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01580","last_updated":"2023-10-18T03:31:02Z","snapshot_observed_at":"2026-08-09T02:51:58.427022Z","submitted_at":"2023-03-02T21:13:56Z","title":"Mixture of Soft Prompts for Controllable Data Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01580","snapshot_observed_at":"2026-08-08T17:20:36.431814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.431814Z"},"links":{"cited_paper":"/paper/2303.01580","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:088d5a516a28229319abfbe365ed535cc4bf65914ac3f7bd204424252df13e20","observation_id":"224d07fd-ec55-4421-a1eb-bf7512066d1d","resolution":{"observed_at":"2026-08-08T17:20:36.431814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.436892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.436892Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:e17bd7d371d464eda5297ce3ea803470c405338b78a221efb465b87f04387bcf","observation_id":"e9ba704f-c5df-45dd-a14d-f06ae48b726f","resolution":{"observed_at":"2026-08-08T17:20:36.436892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.440325Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.440325Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:bb541d1a616409e3ab22cd7a7a23c5ef718ab1398f0c9579d2f5ffcd5a6a52fb","observation_id":"88159421-0bf8-4502-80ea-6549102d2785","resolution":{"observed_at":"2026-08-08T17:20:36.440325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.444115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.444115Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:76b7114992811bce6c7e4b90173f130e3d5a3ca930de4e6248cb33a6a963fd10","observation_id":"e548400e-d0f6-4c93-bd22-67b491837c69","resolution":{"observed_at":"2026-08-08T17:20:36.444115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.249421Z","title":null,"venue":null,"work_id":"ef95bddc-d0c7-429f-ab45-0549ff657ffa","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.447196Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:5e1b69e88bfd77f9796dc597fb178adcbd0e8d3a2d916c3bcf331f9947ec5a0e","observation_id":"693f3150-e648-4b81-9d53-8e1816fd138e","resolution":{"observed_at":"2026-08-08T17:20:37.253111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06557","last_updated":"2023-05-11T04:28:58Z","snapshot_observed_at":"2026-07-06T15:25:51.635688Z","submitted_at":"2023-05-11T04:28:58Z","title":"Long-Tailed Question Answering in an Open World","version":1},"cited_work":{"arxiv_id":"2305.06557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.06557","snapshot_observed_at":"2026-08-08T17:20:36.905570Z","title":"Long-Tailed Question Answering in an Open World","venue":"cs.CL","work_id":"7e866e95-8835-4c45-af94-c6ce926953ca","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.450260Z"},"links":{"cited_paper":"/paper/2305.06557","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:4980f96c83f389076238a7a52c177c2556ac6b27b333cd3fbb00b808057bc787","observation_id":"31c99765-a930-4063-990f-ad2164f76d9e","resolution":{"observed_at":"2026-08-08T17:20:36.909701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.238473Z","title":null,"venue":null,"work_id":"f53640f4-8596-4564-85a2-51349ebb87f3","year":2018},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.453994Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:6fe44f646b06166c83bdee82c30483335c60913fc199a94bfb158d9b2719a318","observation_id":"7f70bd21-4022-46af-8bc1-f0266cfca43f","resolution":{"observed_at":"2026-08-08T17:20:37.242199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T17:20:36.457155Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.457155Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:93911b3ee3aa58c66695cfc8b56c5118b0a8a06670288ce64b93961c1cc5aad8","observation_id":"919510c6-84f1-40c9-b2eb-7569d5466c6e","resolution":{"observed_at":"2026-08-08T17:20:36.457155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.460958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.460958Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:6805e72caac70f2cd7bc0986cbeadbe57041a75b957b1047fcb5de55c1ea6d39","observation_id":"701168bb-7e77-4ac0-a82a-6396afc81cac","resolution":{"observed_at":"2026-08-08T17:20:36.460958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.221270Z","title":null,"venue":null,"work_id":"8fbd9590-653a-48f5-8f42-5004a8175a4c","year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.464341Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:8fb3139216e90fa3a4b35ed44052ae955c88374ded4426ebe42412d7704d231c","observation_id":"b3f63e54-f7ba-496e-9b02-ad3dc448738c","resolution":{"observed_at":"2026-08-08T17:20:37.224685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07759","last_updated":"2023-05-24T23:30:43Z","snapshot_observed_at":"2026-08-04T10:35:00.917001Z","submitted_at":"2023-05-12T20:56:48Z","title":"TinyStories: How Small Can Language Models Be and Still Speak Coherent English?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07759","snapshot_observed_at":"2026-08-08T17:20:36.467591Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.467591Z"},"links":{"cited_paper":"/paper/2305.07759","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:20f4c58c2d7686e5f91d733f5b2d2f60af7011add58a39cf8e26a24954fdfe1c","observation_id":"818b2be7-4a71-44a4-9527-7bdf3a5b2ca1","resolution":{"observed_at":"2026-08-08T17:20:36.467591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01794","last_updated":"2020-10-10T06:00:03Z","snapshot_observed_at":"2026-07-06T10:01:26.447380Z","submitted_at":"2020-10-05T05:46:39Z","title":"GenAug: Data Augmentation for Finetuning Text Generators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01794","snapshot_observed_at":"2026-08-08T17:20:36.471319Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.471319Z"},"links":{"cited_paper":"/paper/2010.01794","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:c02c968294fa4096d592ebcade93b6ab8237e702fd2e3d0cf44c03fc37fa428c","observation_id":"9580a686-a2c4-44f4-9305-53776e878f91","resolution":{"observed_at":"2026-08-08T17:20:36.471319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16125","last_updated":"2025-02-11T11:19:40Z","snapshot_observed_at":"2026-08-01T00:40:18.908802Z","submitted_at":"2025-01-27T15:12:27Z","title":"SampleLLM: Optimizing Tabular Data Synthesis in Recommendations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16125","snapshot_observed_at":"2026-08-08T17:20:36.474699Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.474699Z"},"links":{"cited_paper":"/paper/2501.16125","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ade4fea91beb2852c7a215ed626b28deb6166f45b5de0e9f14589b6caa10e90e","observation_id":"191e0662-b20c-4082-8006-44ed4a976954","resolution":{"observed_at":"2026-08-08T17:20:36.474699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12679","last_updated":"2023-02-26T08:14:05Z","snapshot_observed_at":"2026-07-06T13:13:48.138379Z","submitted_at":"2022-05-25T11:38:48Z","title":"Self-Guided Noise-Free Data Generation for Efficient Zero-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12679","snapshot_observed_at":"2026-08-08T17:20:36.478212Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.478212Z"},"links":{"cited_paper":"/paper/2205.12679","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:b7ecb23ef2185ede930bf5ec10ed2fa3f4ebb77dbd1f22dde001f09b8310f88c","observation_id":"69ff358c-c0ed-411b-8227-8e09868ec054","resolution":{"observed_at":"2026-08-08T17:20:36.478212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.210306Z","title":null,"venue":null,"work_id":"774b6afe-e3f7-4f3d-978e-c936baf4755c","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.481571Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:d74f4688d35cc5f8f19424f5b2bc4d3d099b7c7f7aef1318d74bdc61407e33bf","observation_id":"a3130615-2c11-4f63-afa7-c1e99b7243ab","resolution":{"observed_at":"2026-08-08T17:20:37.214322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.485230Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.485230Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:dd248424523789c3a7fb8716582ae3c5f3396b5e09398297a069d2ea51a9b3ba","observation_id":"385c93a1-ff1c-4459-a943-9c9194e16550","resolution":{"observed_at":"2026-08-08T17:20:36.485230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16854","last_updated":"2024-04-05T15:19:19Z","snapshot_observed_at":"2026-08-08T23:14:03.294619Z","submitted_at":"2023-03-29T17:03:21Z","title":"AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16854","snapshot_observed_at":"2026-08-08T17:20:36.489505Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.489505Z"},"links":{"cited_paper":"/paper/2303.16854","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:41963c154f915fd266594eb41a8b37287c6f50e842836f0351e1c3814c7dfc13","observation_id":"21996ee0-8b35-4367-9c72-b43b064f9b8e","resolution":{"observed_at":"2026-08-08T17:20:36.489505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02301","snapshot_observed_at":"2026-08-08T17:20:36.492909Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.492909Z"},"links":{"cited_paper":"/paper/2305.02301","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:5b38022caa1f3f25049230e355feaeb0f1bb41434fa157eda6be073ed6bdd6af","observation_id":"bff466ca-c429-4676-b329-46d3cc6f4440","resolution":{"observed_at":"2026-08-08T17:20:36.492909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.194317Z","title":null,"venue":null,"work_id":"6a4b3de2-1123-4d54-97f6-1435614cf460","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.496555Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:f1a2236358e6128e372b86d31b3e3a7da0fbcb6a269c38bb093a68b6f7a24c14","observation_id":"a989062f-bd0d-4f5f-a4c9-0975edc99d55","resolution":{"observed_at":"2026-08-08T17:20:37.197737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.499525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.499525Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:1625290be4d9bcd932e6b16684c06cfc3dcea5562ff2b5c3f26e4612e992442a","observation_id":"697afddc-9e6d-4cf7-a9d6-1ffbc098666f","resolution":{"observed_at":"2026-08-08T17:20:36.499525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.503007Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.503007Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:1dbda0f71dc78b07ddbb5bf372d7947e93b331f09bbb86c7b73eafefee008a80","observation_id":"cd096cb3-7b30-4903-81ba-75f4900489f3","resolution":{"observed_at":"2026-08-08T17:20:36.503007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.171131Z","title":null,"venue":null,"work_id":"325c5655-18f6-4d7d-8b2c-bfa51a2f69a4","year":2013},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.506190Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:8a4176608cfe15128a7b2fb8d0cd658ca75a4381a7f4de91e5008074b7af1bbe","observation_id":"598c3ec0-6958-41bb-9a23-cd22076e9fe3","resolution":{"observed_at":"2026-08-08T17:20:37.174881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15638","last_updated":"2023-10-24T08:56:49Z","snapshot_observed_at":"2026-08-03T22:15:17.480671Z","submitted_at":"2023-10-24T08:56:49Z","title":"CoAnnotating: Uncertainty-Guided Work Allocation between Human and Large Language Models for Data Annotation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15638","snapshot_observed_at":"2026-08-08T17:20:36.509800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.509800Z"},"links":{"cited_paper":"/paper/2310.15638","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ca62dadb6bcff6940ec8f276519164af82ec8456f0127b7735c26b82b6d74150","observation_id":"22ca6f2e-9847-457e-a48c-c74e7cf1efc0","resolution":{"observed_at":"2026-08-08T17:20:36.509800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07849","last_updated":"2023-10-13T01:31:59Z","snapshot_observed_at":"2026-08-09T02:52:28.730130Z","submitted_at":"2023-10-11T19:51:13Z","title":"Synthetic Data Generation with Large Language Models for Text Classification: Potential and Limitations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07849","snapshot_observed_at":"2026-08-08T17:20:36.513361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.513361Z"},"links":{"cited_paper":"/paper/2310.07849","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:15f59d6d969f136ca9af39858ed450a509a41ba4768114736b3b357d147e4445","observation_id":"38398225-b331-47e4-9176-0d770e9117c0","resolution":{"observed_at":"2026-08-08T17:20:36.513361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.160275Z","title":null,"venue":null,"work_id":"f90dac38-495c-4bdd-aff4-c6ae44284388","year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.516945Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:4c58552b52e8a591535a753f2eb684f535702a7500e1f3f59b86120ae113273c","observation_id":"cf93a94e-920c-4997-b2f5-7d0465919641","resolution":{"observed_at":"2026-08-08T17:20:37.163984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-08-09T02:49:33.324683Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-08T17:20:36.520045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.520045Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:37438ffedf9278d0097b52c60dfe3db22c1adcd984ce1e2119d4d3680cb61d77","observation_id":"f6c3afb6-5661-4ef6-9c40-b6966b13cfa6","resolution":{"observed_at":"2026-08-08T17:20:36.520045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.11351","last_updated":"2022-02-23T08:38:56Z","snapshot_observed_at":"2026-07-06T12:40:40.756799Z","submitted_at":"2022-02-23T08:38:56Z","title":"A Semi-Synthetic Dataset Generation Framework for Causal Inference in Recommender Systems","version":1},"cited_work":{"arxiv_id":"2202.11351","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.11351","snapshot_observed_at":"2026-08-08T17:20:36.791389Z","title":"A Semi-Synthetic Dataset Generation Framework for Causal Inference in Recommender Systems","venue":"cs.IR","work_id":"451759ac-6441-492a-a680-c00609711a6c","year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.523403Z"},"links":{"cited_paper":"/paper/2202.11351","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:73af5ba9d6c9ca6d52871eea298b236d468ec95c2d2b85ee83249e9d971eae0d","observation_id":"7af8c05a-cc12-4faa-9ac5-76b0cd6908b3","resolution":{"observed_at":"2026-08-08T17:20:36.795035Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.148929Z","title":"Abdelzaher, and Jiawei Han","venue":null,"work_id":"46a9d514-b0ce-4c5f-8783-a0553988ca5e","year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.526656Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:25c9e6b9f93498b77aeb19a07cf5f960dba7af00b4a3444f5fed1311df64e591","observation_id":"8df18b66-14b4-460b-99c9-7fa2ad037ad2","resolution":{"observed_at":"2026-08-08T17:20:37.152704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.529841Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.529841Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:90fa065ef86ddb3941435558cc5e9ab8bfd3e1c99c747badc28eb9c4bc28996b","observation_id":"145b83dd-22bc-44c8-8d25-c316c5cca666","resolution":{"observed_at":"2026-08-08T17:20:36.529841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.131855Z","title":null,"venue":null,"work_id":"98d2ca79-3976-4b1d-86bd-7bf4f5859122","year":2019},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.533078Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:585d561ae75f03c0f00fd248570740ab6304e35506f26dceaedd46e49d91e098","observation_id":"cbbeead1-a08e-4801-b0c2-a1860e57fcee","resolution":{"observed_at":"2026-08-08T17:20:37.135412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.536677Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.536677Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:1f8d0a353c146420130f21e8ff3a4a2b3197fab8b76371b0dd81dbacce95694f","observation_id":"2b4aeaf1-4bd9-4e8d-8ddc-1b6cb18d952f","resolution":{"observed_at":"2026-08-08T17:20:36.536677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.539602Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.539602Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:a4cdad6dea98eb355e263d15c5d6c5390f74dab02627a4b4f0c982ddb50d2480","observation_id":"ba314074-bdca-4a63-90e5-6a88b16ba3da","resolution":{"observed_at":"2026-08-08T17:20:36.539602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-08T17:20:36.542570Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.542570Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:05f34ac798ed61b7a5f88cc6eccbef30ebf5cffe96ecd6b5c30cf032ac0ed4d1","observation_id":"c248cbc7-d008-473a-9685-06de5999d595","resolution":{"observed_at":"2026-08-08T17:20:36.542570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-08T17:20:36.549551Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.549551Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:b82c8e63d6122bc66750950b6470277cd6d3b5b6633e02d06860504d1248bd78","observation_id":"09bcf630-8033-4989-87fe-52f7ddf51e00","resolution":{"observed_at":"2026-08-08T17:20:36.549551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.552709Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.552709Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:7032dda27ffd437b0e0bda585c6c6e3d68c9b5b8ef6538d5553c1019325129c9","observation_id":"7b43305f-c75f-41b5-89ed-1fb6f2565f4b","resolution":{"observed_at":"2026-08-08T17:20:36.552709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.102578Z","title":null,"venue":null,"work_id":"f9dccb14-4423-4edb-a0e8-9dae4aa2fade","year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.560068Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:27aa2145c32a95d2f37f98f166dd5a92a1476fa76067327b31d6a192a6430c27","observation_id":"378a8de8-a520-4a27-a05d-8e2dc3f8ace6","resolution":{"observed_at":"2026-08-08T17:20:37.106083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.563490Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.563490Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:97cba98003c3c7c023ac2a941a880258c89e84ded298e0d7565b5a8d6eee0328","observation_id":"b2a44e80-69c3-4185-9867-f69531a7f9ea","resolution":{"observed_at":"2026-08-08T17:20:36.563490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.086080Z","title":null,"venue":null,"work_id":"c15a9ead-c8dc-4b3a-8f66-f7991f77991f","year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.566827Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:795758aca6592bf19934bd18af5a1f1a91e6060ab0a9b041561a94663ca8e1fa","observation_id":"997f3358-73eb-4d70-b912-2f4cd39878d8","resolution":{"observed_at":"2026-08-08T17:20:37.089103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.03642","last_updated":"2020-05-07T17:46:02Z","snapshot_observed_at":"2026-08-08T21:35:55.699766Z","submitted_at":"2020-05-07T17:46:02Z","title":"On Exposure Bias, Hallucination and Domain Shift in Neural Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.03642","snapshot_observed_at":"2026-08-08T17:20:36.570439Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.570439Z"},"links":{"cited_paper":"/paper/2005.03642","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:7c8f61cd9cede4fa5f82bbe9474691a33bfae2702ebbf7da58d92ed2d9a4f5b9","observation_id":"7548c40a-639f-478e-955a-248b3b9be5c5","resolution":{"observed_at":"2026-08-08T17:20:36.570439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13671","last_updated":"2023-10-20T17:14:25Z","snapshot_observed_at":"2026-07-06T16:36:15.820331Z","submitted_at":"2023-10-20T17:14:25Z","title":"Let's Synthesize Step by Step: Iterative Dataset Synthesis with Large Language Models by Extrapolating Errors from Small Models","version":1},"cited_work":{"arxiv_id":"2310.13671","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.13671","snapshot_observed_at":"2026-08-08T17:20:36.740619Z","title":"Let's Synthesize Step by Step: Iterative Dataset Synthesis with Large Language Models by Extrapolating Errors from Small Models","venue":"cs.CL","work_id":"6ff4dc8a-b86b-4d8a-8ecb-2c8706da2203","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.574352Z"},"links":{"cited_paper":"/paper/2310.13671","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:afc412e7d1c3d5631684e19b0ba82e539d7fdb3b1939b59f00f821154a15b815","observation_id":"a125de7b-973e-428d-ba40-dc779b894dd6","resolution":{"observed_at":"2026-08-08T17:20:36.744054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.578104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.578104Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ac605c27a604f510b35db938d8047a5f378ef8ed2303528938becdb3a8cfe946","observation_id":"184f26ab-7f35-4e8c-8592-078d216bda92","resolution":{"observed_at":"2026-08-08T17:20:36.578104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.581486Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.581486Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:95be8eb67e13af5447ef8714100cdb1e33a6e90f215a957902a987949992c837","observation_id":"6c1805c0-e8bc-4475-9ad3-29d9fe483fa1","resolution":{"observed_at":"2026-08-08T17:20:36.581486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.063790Z","title":null,"venue":null,"work_id":"c113e819-a257-4a53-862b-b1f25d3a996f","year":1995},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.584912Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:7e69b0365ccc769a0336ece50458ca399cf34c53ddcc400c839787ae36086af2","observation_id":"bd68134c-86eb-4aee-8395-6b40cf1898e0","resolution":{"observed_at":"2026-08-08T17:20:37.066908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.054697Z","title":null,"venue":null,"work_id":"ef7046d5-dcad-4460-a8b1-8e86ce742288","year":2008},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.588459Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:8ea2d4d879292ec8e7fcb1924f180507cd4849fbfe788fc71d7efa9b7d07e1d7","observation_id":"d72fb42b-1c9c-4c97-b2e5-f1c35fb31fcc","resolution":{"observed_at":"2026-08-08T17:20:37.057869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15614","last_updated":"2023-11-27T08:23:08Z","snapshot_observed_at":"2026-07-06T16:52:57.823137Z","submitted_at":"2023-11-27T08:23:08Z","title":"FreeAL: Towards Human-Free Active Learning in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.15614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15614","snapshot_observed_at":"2026-08-08T17:20:36.726515Z","title":"FreeAL: Towards Human-Free Active Learning in the Era of Large Language Models","venue":"cs.CL","work_id":"3643a3c3-b3a2-47fe-862e-2b64957b00b0","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.592389Z"},"links":{"cited_paper":"/paper/2311.15614","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:c514dde4d36ef5d4566e67d077471f65d7878c50ecf8ca8c2c36cdd758582b63","observation_id":"cb0278cd-35f1-452c-b59e-f711ef0ab412","resolution":{"observed_at":"2026-08-08T17:20:36.730731Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.045369Z","title":null,"venue":null,"work_id":"530b09f5-0f2f-42fd-affa-5fbd31b128e3","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.596620Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:f91457294a4e336b8425b52d758092eb507bf4059b6f461116825ede1cb8d27a","observation_id":"919baf85-578a-4911-9394-13c6d0d20dfb","resolution":{"observed_at":"2026-08-08T17:20:37.048610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.035307Z","title":null,"venue":null,"work_id":"cedae27a-c768-44b5-bfce-402cf242ce67","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.604658Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:3e1de94e2c13dd2ed43ddc6fd64aa221933055cd2f41f3d3b7cc42c945d61ac1","observation_id":"a21a238e-6d1a-4457-82bc-5934aa761faa","resolution":{"observed_at":"2026-08-08T17:20:37.038732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15895","last_updated":"2023-10-18T02:07:12Z","snapshot_observed_at":"2026-08-07T01:06:37.669796Z","submitted_at":"2023-06-28T03:31:31Z","title":"Large Language Model as Attributed Training Data Generator: A Tale of Diversity and Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15895","snapshot_observed_at":"2026-08-08T17:20:36.612382Z","title":"Ratner, Ranjay Kr- ishna, Jiaming Shen, and Chao Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.612382Z"},"links":{"cited_paper":"/paper/2306.15895","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:c965d53dcc1fcd4b605e0083a4d96d12d9b933518c4d8cfb31386420251891c6","observation_id":"3c0f3e25-9dc7-4d59-98d4-6166554dcfc8","resolution":{"observed_at":"2026-08-08T17:20:36.612382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12329","last_updated":"2022-10-22T02:07:10Z","snapshot_observed_at":"2026-08-05T12:22:29.405210Z","submitted_at":"2022-10-22T02:07:10Z","title":"ProGen: Progressive Zero-shot Dataset Generation via In-context Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12329","snapshot_observed_at":"2026-08-08T17:20:36.600536Z","title":"arXiv preprint arXiv:2210.12329 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.600536Z"},"links":{"cited_paper":"/paper/2210.12329","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:4ba93e85b94b7c44f35dc8478cdddf50c29f07036b55cdc7adaa0f350ae9b7e8","observation_id":"20fe0506-ce66-4cbc-a896-7bb76470d416","resolution":{"observed_at":"2026-08-08T17:20:36.600536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.013238Z","title":null,"venue":null,"work_id":"38fbeb06-ede3-46d2-a4b0-6a0e84133634","year":2015},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.620370Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:b0911d1993683c507254842049873f9b0fd5a16ee374826a9163b10501ecc6b6","observation_id":"9728d383-1e56-4e72-ba0e-0e1abda871b5","resolution":{"observed_at":"2026-08-08T17:20:37.017205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.002772Z","title":null,"venue":null,"work_id":"f54c9be9-47e2-4a24-bcf2-a8d20251ef90","year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.624384Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ee976199e0fafc0ac32bc822e54d81cdf650a1c20dcf608fa9224c235ed9d4d1","observation_id":"bc36777e-281b-44f9-b720-679dabf35534","resolution":{"observed_at":"2026-08-08T17:20:37.006394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12892","last_updated":"2025-05-16T01:02:49Z","snapshot_observed_at":"2026-08-05T20:44:37.410583Z","submitted_at":"2024-05-21T16:02:06Z","title":"Retrievable Domain-Sensitive Feature Memory for Multi-Domain Recommendation","version":2},"cited_work":{"arxiv_id":"2405.12892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12892","snapshot_observed_at":"2026-08-08T17:20:36.681101Z","title":"Retrievable Domain-Sensitive Feature Memory for Multi-Domain Recommendation","venue":"cs.IR","work_id":"6f7ed0f5-5905-4460-b69b-3daf61223687","year":2024},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.628288Z"},"links":{"cited_paper":"/paper/2405.12892","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:845b67712757498cc7d8ead312abf0ef5107550a61dcca1a29d6e21be5d0e7ad","observation_id":"4d68e9de-e1a1-4269-af6a-b7720d2861b7","resolution":{"observed_at":"2026-08-08T17:20:36.687057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10703","last_updated":"2023-05-18T04:30:09Z","snapshot_observed_at":"2026-07-06T15:29:01.076710Z","submitted_at":"2023-05-18T04:30:09Z","title":"ReGen: Zero-Shot Text Classification via Training Data Generation with Progressive Dense Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10703","snapshot_observed_at":"2026-08-08T17:20:36.616249Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.616249Z"},"links":{"cited_paper":"/paper/2305.10703","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:41b0d73cbb41f39eb0748e09ef62bd1f15c61e74cb21531e65333d2b503ad12b","observation_id":"bdfa9add-30c5-4240-9026-29545a5ed815","resolution":{"observed_at":"2026-08-08T17:20:36.616249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.991719Z","title":null,"venue":null,"work_id":"e4429089-f5d7-4c20-a46a-a7a264db442f","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.632750Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:c498ca2424a40ed5ffc854d178c9713e9b896c9f516b5c4a1c04a31abcefbc44","observation_id":"dcec66f4-e1d6-47da-99f6-969d0e00efda","resolution":{"observed_at":"2026-08-08T17:20:36.995505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.980336Z","title":"Now, begin summarizing: Figure 6: Prompt used in Stage 1 (Attribute Summarization)","venue":null,"work_id":"4bc56c1e-65af-4bd3-8e18-c75605d4d0e4","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.636687Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:4c150444318512917ea7e06d88ffe2c00cfddba9b850f8c7da655a8b65b9227c","observation_id":"0f27d676-d648-4d46-8605-dc3939e75d39","resolution":{"observed_at":"2026-08-08T17:20:36.984224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.969247Z","title":null,"venue":null,"work_id":"9e9beacc-c1f3-4fb0-878a-e925d7731b79","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.640438Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:305c4b4cdcf0b67ee8f29dbe83725c0cd5ff4d0e78d1a8b2503aac3fc8689d57","observation_id":"3daf6686-c31a-465e-a16e-a6c9e37c2df2","resolution":{"observed_at":"2026-08-08T17:20:36.972977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.958862Z","title":null,"venue":null,"work_id":"40de1016-2d49-4972-b4f8-b0103b810b63","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.643941Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:ba4c1364ca57f61d92ab80e16b4aabd80276f8f9bd3994aeefe2cdafe6ce75ba","observation_id":"28be41ea-cd33-45f2-b246-d5ad4ae2c45f","resolution":{"observed_at":"2026-08-08T17:20:36.962294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.948322Z","title":null,"venue":null,"work_id":"24526b43-b604-46a6-9c10-6eb72a784716","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.647629Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:9e5a96c7d4fa94260920531e4026f8ceec97173dd789cd6450615b37c5b85ffe","observation_id":"6cb3abc2-3bf0-49b4-8bab-ef04071c6868","resolution":{"observed_at":"2026-08-08T17:20:36.951897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:36.936217Z","title":"Now, begin summarizing: Figure 7: Prompt used in Stage 2 (Synthetic Data Generation)","venue":null,"work_id":"cd4380a8-10e7-4ef3-894f-eb7e7b5a3221","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.651160Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:7adc5fde373ee250f126ea9ca8710fef8f05dbb0bcb41c6d3ed6ce9c9dad2ffd","observation_id":"156f72bc-a3c3-4257-b20b-851cf3d08340","resolution":{"observed_at":"2026-08-08T17:20:36.940192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:20:37.024325Z","title":"In Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"c61b348c-4658-488e-93d6-2d83104db398","year":null},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.608550Z"},"links":{"citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:1dd72f462bc7aa645561aebb9cb87f68c1a9bd7ceb7842026cfd913c2db913fd","observation_id":"0fff48ff-7c7b-460e-8a67-3a9d9e29fbc4","resolution":{"observed_at":"2026-08-08T17:20:37.027981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01171","last_updated":"2023-01-09T23:49:03Z","snapshot_observed_at":"2026-07-06T12:56:11.342776Z","submitted_at":"2022-04-03T22:28:31Z","title":"Why Exposure Bias Matters: An Imitation Learning Perspective of Error Accumulation in Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01171","snapshot_observed_at":"2026-08-08T17:20:36.419789Z","title":"arXiv preprint arXiv:2204.01171 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.419789Z"},"links":{"cited_paper":"/paper/2204.01171","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:828d547239f31a28d797f44b21327aa5f8d75db00ad94754cf6eff23a79e9b27","observation_id":"0ecacb90-f9a7-44ac-8a9d-b3933b022e6e","resolution":{"observed_at":"2026-08-08T17:20:36.419789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12112","last_updated":"2024-06-30T12:48:18Z","snapshot_observed_at":"2026-07-06T17:05:14.915707Z","submitted_at":"2023-12-19T12:34:46Z","title":"Curated LLM: Synergy of LLMs and Data Curation for tabular augmentation in low-data regimes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12112","snapshot_observed_at":"2026-08-08T17:20:36.556267Z","title":"arXiv preprint arXiv:2312.12112 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T17:20:36.556267Z"},"links":{"cited_paper":"/paper/2312.12112","citing_paper":"/paper/2502.08661"},"observation_digest":"sha256:792ea4f97d245a612a3ecb07f69e224cb7c6079dd52426b657431653c9356584","observation_id":"e7bff499-f9ba-4a78-a01e-362098c6dc00","resolution":{"observed_at":"2026-08-08T17:20:36.556267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.08661","last_updated":"2025-02-15T03:49:29Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T02:50:32.707309Z","submitted_at":"2025-02-09T16:43:32Z","title":"Few-shot LLM Synthetic Data with Distribution Matching"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 1 inbound Pith citation observation for arXiv:2502.08661."}