Pith. sign in

Paper Citation Record · LEDGER

Evaluating Language Models as Synthetic Data Generators

As of 21 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2412.03679.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.03679 v2

Coverage vector

measured 51 of 51 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T22:17:42.790137Z

measured 53 of 53 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T15:43:12.690861Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T12:52:47.936710Z

Reference resolution

51 of 51 outbound references displayed

  • verified exact0
  • verified fuzzy22
  • unresolved29
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 33ad2754-4767-4156-97b4-347ae0d7c65d · outbound

This paper cites write newline.

Evaluating Language Models as Synthetic Data Generators write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.569688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.569688Z digest=sha256:0f3b0c90ab18d7d294828c71644afa53eee52393de3e4972d35f9dc890dcad5d

Observation 95dd5733-6fa2-44f4-94d9-828a89d12325 · outbound

This paper cites Claude 3.5 sonnet model card addendum.

Evaluating Language Models as Synthetic Data Generators Claude 3.5 sonnet model card addendum

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.514615Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.575075Z digest=sha256:01d948b621c7e6262a8c59312306c735079967206bc2a089eb71832fcbd4c8b4

Observation 43e4570c-8554-418b-9c79-8b0be5fc2f57 · outbound

This paper cites Program Synthesis with Large Language Models.

Evaluating Language Models as Synthetic Data Generators Program Synthesis with Large Language Models

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.579452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.579452Z digest=sha256:a94f013824210c283cf6d39874f7f11acb0fc262279b1fffbfc46b4a890d9285

Observation 1e7b8c13-915e-4f5a-a229-b9814cc8077d · outbound

This paper cites D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al.

Evaluating Language Models as Synthetic Data Generators D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.500324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.586188Z digest=sha256:1d6fb6ef95687ff9e06676f790e38a327f338357b99e86a5ee0514e79055170b

Observation 16b05f5f-003e-4b92-ab0c-fb7a9331b0d2 · outbound

This paper cites A survey on evaluation of large language models.

Evaluating Language Models as Synthetic Data Generators A survey on evaluation of large language models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.589934Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.589934Z digest=sha256:518649718f61fad24decf92110870d2d9db5e16be6af8352f490575f8a741547

Observation 0c015cf2-a048-43a0-933e-697d94028af7 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

Evaluating Language Models as Synthetic Data Generators Evaluating Large Language Models Trained on Code

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.594460Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.594460Z digest=sha256:cd05b970ef0b28c8d1a4f43cedb938f3b81e740fcff0bf84d63c44286e673895

Observation 7a3c1d0c-c392-4d9e-9e77-e619a9e33697 · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

Evaluating Language Models as Synthetic Data Generators Training Verifiers to Solve Math Word Problems

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.598818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.598818Z digest=sha256:7883034e4ec4706c942c88f5318bcf4a658eed2c5ec183453faec5aac202e18b

Observation 944a104c-b2d5-4ac8-89b1-b6f180b95b50 · outbound

This paper cites How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition.

Evaluating Language Models as Synthetic Data Generators How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.604209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.604209Z digest=sha256:7aedad7905043e58666d4ff630b714fb54c13803a951f27eb02ab05a0ec73468

Observation 594600ba-6f3c-421c-b74c-e8af2b740dd1 · outbound

This paper cites The Llama 3 Herd of Models.

Evaluating Language Models as Synthetic Data Generators The Llama 3 Herd of Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.610125Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.610125Z digest=sha256:af14b43b2460b89c703047c94cf1149f443d4a4100cbb0a8ef23386d64c73834

Observation 00050036-8117-4f64-bd7b-778fa7ba162a · outbound

This paper cites Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators.

Evaluating Language Models as Synthetic Data Generators Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.615359Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.615359Z digest=sha256:0016440893ed1e2c4b2d42c23738d072bcc1050e9f049d376a7c87faa876d36a

Observation 195f3afa-1c63-431c-a28c-29b23407f0be · outbound

This paper cites Textbooks Are All You Need.

Evaluating Language Models as Synthetic Data Generators Textbooks Are All You Need

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.620046Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.620046Z digest=sha256:787de935d9c27b9afc014610fe982a6e7296905166a0efe3af2739b7c10ecffa

Observation bab42ba8-c35d-4cc3-8fd7-51d0647ecae7 · outbound

This paper cites Evaluating Large Language Models: A Comprehensive Survey.

Evaluating Language Models as Synthetic Data Generators Evaluating Large Language Models: A Comprehensive Survey

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.625582Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.625582Z digest=sha256:fb26fd059a1cc951629ff12d010ff0e14778c21ff17731a7e65b602d1c50cc40

Observation da5b93db-b078-410f-9e9d-fae597d9bdd4 · outbound

This paper cites Measuring mathematical problem solving with the math dataset.

Evaluating Language Models as Synthetic Data Generators Measuring mathematical problem solving with the math dataset

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.479773Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.630273Z digest=sha256:4610f085d006d5ca259edf74dc9f24ea51c5d6d7c36ae73b096d4d8e5146e327

Observation 8d9c00dc-4ed3-47d1-bb44-abdccf0ec347 · outbound

This paper cites Instruction Induction: From Few Examples to Natural Language Task Descriptions.

Evaluating Language Models as Synthetic Data Generators Instruction Induction: From Few Examples to Natural Language Task Descriptions

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.634690Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.634690Z digest=sha256:bc61e215bf1f8e9540ee4f491b97a26545915628c13fbfe621e03ae9fca5472b

Observation 8dbad316-0276-4d41-9bf1-b1bcaef4d180 · outbound

This paper cites Unnatural instructions: Tuning language models with (almost) no human labor.

Evaluating Language Models as Synthetic Data Generators Unnatural instructions: Tuning language models with (almost) no human labor

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.639288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.639288Z digest=sha256:7604042b802223b54037bbc35efb305cfb6d107683914b3221f0fcca2d502094

Observation 046b8588-a987-498c-ae0e-030d9a9f3927 · outbound

This paper cites GPT-4o System Card.

Evaluating Language Models as Synthetic Data Generators GPT-4o System Card

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.643235Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.643235Z digest=sha256:2fa18a71f49b6fb4e84d4167eaa7f14ba2312462d851eefa413d294eae47469d

Observation 6e56eb8a-aa3c-4b10-9b83-32a942fbbf66 · outbound

This paper cites The cot collection: Improving zero-shot and few-shot learning of language models via chain-of-thought fine-tuning.

Evaluating Language Models as Synthetic Data Generators The cot collection: Improving zero-shot and few-shot learning of language models via chain-of-thought fine-tuning

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.458366Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.647074Z digest=sha256:ba28a9abdbfba77b127550dc541e60fdc48c834f32a009b5579571b0f0958b7c

Observation 7666c8da-dd40-46dc-ad19-4e01800b4c9f · outbound

This paper cites J., Jang, Y., Chae, H., and Yeo, J.

Evaluating Language Models as Synthetic Data Generators J., Jang, Y., Chae, H., and Yeo, J

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.444855Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.651536Z digest=sha256:1bd6fb2c104b9c82a1bf0a4f91a1346bea770f6c3cf8bb4710656b72757bcfe0

Observation 72bb17d2-8df0-46d1-af06-41bd539ad79d · outbound

This paper cites Y., Shin, J., Welleck, S., Neubig, G., Lee, M., Lee, K., and Seo, M.

Evaluating Language Models as Synthetic Data Generators Y., Shin, J., Welleck, S., Neubig, G., Lee, M., Lee, K., and Seo, M

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.433147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.655989Z digest=sha256:e21d043a7e5688da2e6ce5933acc51eca9ebe3ddcc317e241819ed77bace319d

Observation b9251161-cb98-473a-927b-3e2923bfeb0f · outbound

This paper cites RewardBench: Evaluating Reward Models for Language Modeling.

Evaluating Language Models as Synthetic Data Generators RewardBench: Evaluating Reward Models for Language Modeling

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.660036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.660036Z digest=sha256:ac00bcb76647fcb63c859f52f5e7f4bb97545d798164cb20b7d2efd1826c34f4

Observation bf27756e-c868-4022-897d-6918a600534a · outbound

This paper cites From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline.

Evaluating Language Models as Synthetic Data Generators From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.664467Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.664467Z digest=sha256:f3e7cbf107e5eda3230c08132551590c52bd3ba57b45cd34bcb42c52839cbc1c

Observation b48413b9-c263-4357-9b4b-423464317c1b · outbound

This paper cites Universal and Context-Independent Triggers for Precise Control of LLM Outputs.

Evaluating Language Models as Synthetic Data Generators Universal and Context-Independent Triggers for Precise Control of LLM Outputs

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.668642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.668642Z digest=sha256:7156171b563e5a85eafc9dde977c034e1d7bdedc0d0aebc2f2c3e13779896f1f

Observation abbd0eb3-0e65-40b8-9832-a71f5f281618 · outbound

This paper cites Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs.

Evaluating Language Models as Synthetic Data Generators Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.672876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.672876Z digest=sha256:37d7b0b4b85c9e1d8bc0345783ac41c9b0aa6410ae86964b891f54bc18c9718d

Observation 0df4b114-d9d0-4278-8f44-5fbcb9b48e69 · outbound

This paper cites S., Wang, Y., and Zhang, L.

Evaluating Language Models as Synthetic Data Generators S., Wang, Y., and Zhang, L

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.422026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.677857Z digest=sha256:b9859ba4aba0ceccef56d119e3fc231930e21d187fc84b0331f463af2df41388

Observation d4b95646-4797-41f9-af2a-fc89e8ec71ec · outbound

This paper cites Best practices and lessons learned on synthetic data.

Evaluating Language Models as Synthetic Data Generators Best practices and lessons learned on synthetic data

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.410288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.681361Z digest=sha256:680c1889b55afb2736a63e3d643bcefb652431e648a320babb221c89832db9e0

Observation d978c7cb-0e42-4560-ae7b-a3e4c0b2d942 · outbound

This paper cites What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning.

Evaluating Language Models as Synthetic Data Generators What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.399378Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.684853Z digest=sha256:ab9d9925e85cdaaaa1a1fd8dc65810a53e96bd07fab7cda7648b6d13d47852ba

Observation 06634d93-e4fa-4ce3-a8ae-0ec6e609f183 · outbound

This paper cites W., Tay, Y., Zhou, D., Le, Q.

Evaluating Language Models as Synthetic Data Generators W., Tay, Y., Zhou, D., Le, Q

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.388496Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.688909Z digest=sha256:a6fbaca215f7313724795036e305ff61c574a736cfba93aaf1b22fedbfb8d64c

Observation 0a96d054-4045-4552-9aa4-3dbbf51032da · outbound

This paper cites Introducing meta llama 3: The most capable openly available llm to date.

Evaluating Language Models as Synthetic Data Generators Introducing meta llama 3: The most capable openly available llm to date

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.376377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.693121Z digest=sha256:2e51e054d065052ed6478a001b2341933c7b5e33ec56b12e91e5ac175e529934

Observation 687e6f50-30c2-4071-8bc2-be266aa06e30 · outbound

This paper cites Cross-task generalization via natural language crowdsourcing instructions.

Evaluating Language Models as Synthetic Data Generators Cross-task generalization via natural language crowdsourcing instructions

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.363699Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.696879Z digest=sha256:f0fdfcc2fcf4e967dc96af5f4cd3321392e7b25e35229d0a6e6d3c4b9120e09b

Observation 09599f1f-c83e-463e-8b42-ae8e0f0c9692 · outbound

This paper cites Mteb: Massive text embedding benchmark.

Evaluating Language Models as Synthetic Data Generators Mteb: Massive text embedding benchmark

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.347765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.700510Z digest=sha256:ae5c64c8b5793c99eb03744e1b63f676dca4169b982570139df027df7c9e218c

Observation cc2d283d-a704-4151-bd17-15527faae4ea · outbound

This paper cites S., Shen, S., Yong, Z.

Evaluating Language Models as Synthetic Data Generators S., Shen, S., Yong, Z

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.334381Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.704444Z digest=sha256:5fa07117c4c207e849f8982693187ce95ca183c79e62f58f9626f5a9b19b3e4c

Observation b06efdcd-f87b-4d7c-ba83-b1e3caf1b24d · outbound

This paper cites Orca: Progressive Learning from Complex Explanation Traces of GPT-4.

Evaluating Language Models as Synthetic Data Generators Orca: Progressive Learning from Complex Explanation Traces of GPT-4

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.708243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.708243Z digest=sha256:2c39e28a8df8009811e2003f9295499fb2a26e67935f2fddc3268d0dbcd6ed54

Observation 579fa552-fd6e-4d87-a6f0-2ec01010cb04 · outbound

This paper cites Mixeval: Deriving wisdom of the crowd from LLM benchmark mixtures.

Evaluating Language Models as Synthetic Data Generators Mixeval: Deriving wisdom of the crowd from LLM benchmark mixtures

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.322094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.712538Z digest=sha256:f63754af53c6a6909c875673afc74dfcf750df6a0fad8d5ffe6afde13f3e7df0

Observation 93def1ed-bf4e-486b-8093-3d23b0c7ca8f · outbound

This paper cites Leverage the Latest Open Models for Synthetic Data Generation with NVIDIA Nemotron-4-340B.

Evaluating Language Models as Synthetic Data Generators Leverage the Latest Open Models for Synthetic Data Generation with NVIDIA Nemotron-4-340B

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.309404Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.716695Z digest=sha256:cb078ed6ed0858595f1dc570107de328fef23587384beb17c1f18ad781765717

Observation e89988d4-74fd-4d1d-b144-d5138375d3b4 · outbound

This paper cites J., and Hashimoto, T.

Evaluating Language Models as Synthetic Data Generators J., and Hashimoto, T

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.294427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.721993Z digest=sha256:ffe9ebfb50f90700e3c9c181d32e168df4657db65ac4d02d6dfea5ab01ace966

Observation 7a43803c-c023-4f8c-a036-e3576bc2aca1 · outbound

This paper cites StructuredRAG: JSON Response Formatting with Large Language Models.

Evaluating Language Models as Synthetic Data Generators StructuredRAG: JSON Response Formatting with Large Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.726829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.726829Z digest=sha256:680ff8eb2df2df38af21b5216191b52d35ef57a157bb1d96a6f3a27e83ad2cbb

Observation e2fe7637-65c4-426c-b53f-6b68b1a196fe · outbound

This paper cites Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models.

Evaluating Language Models as Synthetic Data Generators Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.732147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.732147Z digest=sha256:56f6c680e2913e3ba59f643b606316c86729b9143da07c6bef1b3308690a3450

Observation 9acbc3db-5856-498a-9ae8-093f04e6c16c · outbound

This paper cites an unresolved cited work.

Evaluating Language Models as Synthetic Data Generators Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.736633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.736633Z digest=sha256:06332390db177a813b1cbc9b1ac4ea9cae6890105bd4abddd25f8b684545dbfc

Observation bca49219-18d5-4ceb-b2c3-51aafbeb8f2a · outbound

This paper cites Qwen2.5: A party of foundation models, September 2024.

Evaluating Language Models as Synthetic Data Generators Qwen2.5: A party of foundation models, September 2024

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.740909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.740909Z digest=sha256:7a8ed95e9525cd98f17dbae5baefe4460f3618309fc2719315f2201f93552713

Observation b7af7163-42ff-464b-89d9-4317d8ef0ebc · outbound

This paper cites Prompt2model: Generating deployable models from natural language instructions.

Evaluating Language Models as Synthetic Data Generators Prompt2model: Generating deployable models from natural language instructions

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.268621Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.745075Z digest=sha256:9fa4c7590793d34209f83b3187ef1688a28f8d187ebf957a8633e1ff9bdc8205

Observation d87ef1bf-0ac0-4b75-8224-832e1f3ad6d5 · outbound

This paper cites S., Arunkumar, A., Stap, D., et al.

Evaluating Language Models as Synthetic Data Generators S., Arunkumar, A., Stap, D., et al

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.748808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.748808Z digest=sha256:607f55d21375aac9a4aa16fd0f4e68e70177c291c1763f50638723af6af30b69

Observation 40a1efc5-4eed-4295-bb0c-a3b0107e7c5a · outbound

This paper cites A., Khashabi, D., and Hajishirzi, H.

Evaluating Language Models as Synthetic Data Generators A., Khashabi, D., and Hajishirzi, H

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.249846Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.753030Z digest=sha256:d83e5361e323fa3ac5370161aea7148956afc37032cab2d437d4f4efe770e0ae

Observation 43ab9403-95d6-4d4c-97af-53699b861a46 · outbound

This paper cites W., Lester, B., Du, N., Dai, A.

Evaluating Language Models as Synthetic Data Generators W., Lester, B., Du, N., Dai, A

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.758206Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.758206Z digest=sha256:df536dd3abbf2112a163539eb12c6c83ae2fe92b811a98dee57c2aa27fe993e1

Observation 3beb33d4-e37a-4246-9214-3c7da17da208 · outbound

This paper cites Wizard LM : Empowering large pre-trained language models to follow complex instructions.

Evaluating Language Models as Synthetic Data Generators Wizard LM : Empowering large pre-trained language models to follow complex instructions

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.228008Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.762601Z digest=sha256:bf3d44a87bed60aefa6be79edb1d9bb983c000e58691999190b47696b41b9337

Observation c5bddd7b-9eaa-48c6-be1f-a4a52ff6b0d7 · outbound

This paper cites Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing.

Evaluating Language Models as Synthetic Data Generators Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.766737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.766737Z digest=sha256:50658bf6e6bf369d96cbf58575f980909aaf6c00882c203e49fd879e363330f6

Observation b9602ff3-1d60-4ea9-a0f5-ed1e6452a33e · outbound

This paper cites Stronger Models are NOT Stronger Teachers for Instruction Tuning.

Evaluating Language Models as Synthetic Data Generators Stronger Models are NOT Stronger Teachers for Instruction Tuning

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.771208Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.771208Z digest=sha256:91c7c10ca9d56538321263dee9aecce541950b552b74529918e11b6fdf857a57

Observation 64013046-f12a-4531-b3de-0cf9980d0f9d · outbound

This paper cites Learning to mine aligned code and natural language pairs from stack overflow.

Evaluating Language Models as Synthetic Data Generators Learning to mine aligned code and natural language pairs from stack overflow

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.775638Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.775638Z digest=sha256:199a926237fd8e93b5536ccfb1ec41130165fff90b15ad4277d0e8839a7be8bd

Observation 582dd6c1-3f76-44d6-aa3d-c8f204a52e55 · outbound

This paper cites Mammoth: Building math generalist models through hybrid instruction tuning.

Evaluating Language Models as Synthetic Data Generators Mammoth: Building math generalist models through hybrid instruction tuning

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.214350Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.779277Z digest=sha256:82b05f331f61a96a800bb7c6251d58c39f5c4dc900451c8edfc03ee5c4fb2dc3

Observation fb2244ec-cdbd-4bf9-b474-a34caa413e3f · outbound

This paper cites MA mmo TH 2: Scaling instructions from the web.

Evaluating Language Models as Synthetic Data Generators MA mmo TH 2: Scaling instructions from the web

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:17:43.200095Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:17:42.782732Z digest=sha256:5cd19d4cd9a6ed9f0a80811c4ec2479a7dc9ec609f17d142bccf49c941bf11cf

Observation 73f717a3-22a9-4cc4-b302-a6b6ca6ad351 · outbound

This paper cites Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning.

Evaluating Language Models as Synthetic Data Generators Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.786222Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.786222Z digest=sha256:80a1948ba0267d54eb80d9491b437beece3a279cdbad47e10273feaedba86927

Observation f9ebf507-8894-4ff7-89e9-8d5428b0746d · outbound

This paper cites Lima: Less is more for alignment.

Evaluating Language Models as Synthetic Data Generators Lima: Less is more for alignment

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-11T22:17:42.790137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:17:42.790137Z digest=sha256:3a53ecab036dffef6f3061b243f41d235f4779d02d8c7d3a62d62a766d4a5d52

Pith citing papers

Observation b1dbf21a-397a-47f7-9126-0a21164927d5 · inbound

Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era cites this paper.

Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era Evaluating Language Models as Synthetic Data Generators

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-05T15:43:12.690861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T15:43:12.690861Z digest=sha256:e5a8117711ac0273ba9c9a2088b5a42037bf7f9914da819e1bd761aeac44c05a

Observation f8e4fb39-e225-44b3-bf99-d4e8c0d65e5c · inbound

Modular Techniques for Synthetic Long-Context Data Generation in Language Model Training and Evaluation cites this paper.

Modular Techniques for Synthetic Long-Context Data Generation in Language Model Training and Evaluation Evaluating Language Models as Synthetic Data Generators

Reference 18

Resolution
verified exact
local_arxiv, observed 2026-08-05T12:52:47.942355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-05T12:52:47.635433Z digest=sha256:53a3b7a4f4f19ff6218cbd5cedcb6eb9718afb3e103a77702a8f3dfe0cc547b7