Pith. sign in

Paper Citation Record · LEDGER

Pre-Training Curriculum for Multi-Token Prediction in Language Models

As of 7 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2505.22757.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22757 v1

Coverage vector

measured 13 of 13 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:06:35.248084Z

measured 13 of 13 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

13 of 13 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e1de7c31-31c0-41cb-a6c9-fede6db9a382 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.553245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:34.707844Z digest=sha256:32e40a1cc77a12e48f883954a4cf1634041f80d597f7a136a9d1336ec6495beb

Observation ce2a8469-eb02-4eec-bf18-c02e2bfa4338 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.346913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:34.802623Z digest=sha256:fca6d0d2e4afe39d47193e580f878f278027ace613d64c836c10108a8451fbc0

Observation 1e41aa12-338e-4ee3-9a78-a50b1f06d5cc · outbound

This paper cites Better & Faster Large Language Models via Multi-token Prediction.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Better & Faster Large Language Models via Multi-token Prediction

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.362380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.362380Z digest=sha256:02a9509c1c04a43b25c78117375ff07c7d0d1ceafab6d8ede7a0d9d1eb8ba1c4

Observation de485d5f-83eb-45d1-80a1-984e362c6066 · outbound

This paper cites Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.434972Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.434972Z digest=sha256:cbf04753eeaa667d03f4ab199699f26f3a8b762365ad8f41401966f8c939a1c7

Observation 73ee8a06-bd2e-4922-9c16-f57bea0744f2 · outbound

This paper cites Your task is to rate the written output sequence on one metric.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Your task is to rate the written output sequence on one metric

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:36.168632Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:34.896235Z digest=sha256:baddf9cc894226000d71f4592b1d72f56692baa1953ab0b6fea08bddb908be23

Observation b4da940d-4135-4371-b73f-2c79e3b66196 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.025653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:34.953689Z digest=sha256:aa321fcc2681f9392d45f2f849d74263ef652a6b7b644ba75bf6b4827f8ea58d

Observation b73d85a4-63bc-409b-92e9-ef29185f669c · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.842497Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:35.036520Z digest=sha256:3ae44724670124e980bbccb7c57d46634f3451604295772262d9b6e049193078

Observation 639ff016-e683-4963-8f32-361330087be6 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.694279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:35.139500Z digest=sha256:f3b20b0eb872e550686acedbf46b390977cdb805ae178796886862d967a5e2d4

Observation 85d0af89-6751-4ab6-986c-ad3b0dcdd654 · outbound

This paper cites Please refer to Warstadt et al.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Please refer to Warstadt et al

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:35.514559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:06:35.248084Z digest=sha256:ab85631244a2ea70b068bb2d64fd7f0efb2971342ef912c8b991d450dd232e9d

Observation 398202df-698a-490c-9b32-685e78db22a5 · outbound

This paper cites Curriculum Learning: A Survey.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Curriculum Learning: A Survey

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.541220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.541220Z digest=sha256:270df00b0209fc92e2cb782115d6d49fe8adbc5f25c2d133179d71ecd999a09b

Observation 04d52ef0-f572-478f-9799-441abc2aa559 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Pre-Training Curriculum for Multi-Token Prediction in Language Models LLaMA: Open and Efficient Foundation Language Models

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.640070Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.640070Z digest=sha256:1d92a8863dbfef4082af053b03b62e966aadf8df1ae84ee780d3fbf5cf9bb1b5

Observation c21b578c-2f79-49e0-bf3c-739d9762956a · outbound

This paper cites SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity.

Pre-Training Curriculum for Multi-Token Prediction in Language Models SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.204491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.204491Z digest=sha256:fef0389ed77b8ed05bb1b15996fc1fee8a10d4e5fe3bfcb8732530ed28519b40

Observation b3a39a96-a593-49f8-8f24-eb5a4933cb99 · outbound

This paper cites Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.266008Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.266008Z digest=sha256:2e64b2e03ea886460063573b156cc6690462535e1da479281823737496636656

Pith citing papers

No inbound Pith citation observations are available.