Pith. sign in

Paper Citation Record · LEDGER

YuLan-Mini: An Open Data-efficient Language Model

As of 11 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 2 inbound Pith citation observations for arXiv:2412.17743.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.17743 v2

Coverage vector

measured 100 of 135 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T05:17:55.889322Z

measured 102 of 102 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-11T06:34:44.6726+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T11:44:04.984553Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T22:42:47.026295Z

Reference resolution

100 of 135 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved99
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation df77c6d9-4f40-4203-bedf-43a1607a9ad6 · outbound

This paper cites Synthetically generated reasoning dataset (gsm8k-inspired) with enhanced diversity using gretel navigator and meta-llama/meta-llama-3.1-405b.

YuLan-Mini: An Open Data-efficient Language Model Synthetically generated reasoning dataset (gsm8k-inspired) with enhanced diversity using gretel navigator and meta-llama/meta-llama-3.1-405b

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.471132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.471132Z digest=sha256:cf3a2adbfd6c30073334c42bb50d87a3dba593a4be5d89d4dbc844b5b6960361

Observation f4218e80-733e-4b6f-b694-44c605f6f83e · outbound

This paper cites GQA: training generalized multi-query transformer models from multi-head checkpoints.

YuLan-Mini: An Open Data-efficient Language Model GQA: training generalized multi-query transformer models from multi-head checkpoints

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.476338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.476338Z digest=sha256:d9e8cae4b446baa386d750ad0170f786fa36c4b32b9d030a14d3726d564c6fd0

Observation 47c0352e-4240-465a-ad63-c8eb4b1d05d6 · outbound

This paper cites Smollm2 - with great data, comes great performance, 2024.

YuLan-Mini: An Open Data-efficient Language Model Smollm2 - with great data, comes great performance, 2024

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.481319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.481319Z digest=sha256:3f3147f4bdcfd367e35ca61bd0cf82281be358ccb1873c4582686ac621e3a18e

Observation e37bebbe-739c-44fd-9835-bf0361a23c9a · outbound

This paper cites Program Synthesis with Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Program Synthesis with Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.485739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.485739Z digest=sha256:babdd37c3d1a56478d29acdcc2cb11540be515f2e75443ab863ab60c7cc6dffa

Observation 3c185ad2-d8ba-4e5a-8194-27ed0d1b079e · outbound

This paper cites Jiang, Jia Deng, Stella Biderman, and Sean Welleck.

YuLan-Mini: An Open Data-efficient Language Model Jiang, Jia Deng, Stella Biderman, and Sean Welleck

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.489943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.489943Z digest=sha256:adff0d704c0365e7b01d57b6668df542f78a3abc38b6222a8a02a76dafd2ebf1

Observation e94615bc-fb03-40db-b562-11ac0fae0d5d · outbound

This paper cites Layer Normalization.

YuLan-Mini: An Open Data-efficient Language Model Layer Normalization

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.493672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.493672Z digest=sha256:87ada9fad9d74d9fca56adecb6c21b7cbc287396eb36a39542de0998a5e001c4

Observation 0e699dc9-a885-4867-ac49-624da63de074 · outbound

This paper cites Numinamath 7b cot, 2024.

YuLan-Mini: An Open Data-efficient Language Model Numinamath 7b cot, 2024

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.498666Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.498666Z digest=sha256:b7ccf06005f17d9b5ef8f6606687165601528d7e83f8b4221416c845c98a8284

Observation 272b80f4-77c6-4adf-a15c-c943b17e1b84 · outbound

This paper cites Stable LM 2 1.6B Technical Report.

YuLan-Mini: An Open Data-efficient Language Model Stable LM 2 1.6B Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.502568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.502568Z digest=sha256:00d215185d5d9d4498c6a279cb0e2ce5b74ebf4262404aa714c3e4438817c5a6

Observation fbf056b8-538a-4826-b382-f64b47e8f88c · outbound

This paper cites DeepSeek LLM: Scaling Open-Source Language Models with Longtermism.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek LLM: Scaling Open-Source Language Models with Longtermism

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.507213Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.507213Z digest=sha256:6e7ec4110f7b12c36ea906af1c158e4b3a907920d23ab1a9da8853d43188f14d

Observation 95f3bacb-3738-4743-8d1c-e8fc6ca2ccde · outbound

This paper cites Enriching word vectors with subword information.

YuLan-Mini: An Open Data-efficient Language Model Enriching word vectors with subword information

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.511890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.511890Z digest=sha256:4e4e6fa3ca7c93d22d0b29aa94a2390db7530e7fee46373f32c408c9cd2d74af

Observation 02e4b734-3974-4cec-a258-a447529ed422 · outbound

This paper cites Language Models are Few-Shot Learners.

YuLan-Mini: An Open Data-efficient Language Model Language Models are Few-Shot Learners

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.515998Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.515998Z digest=sha256:00799d6224f8bb19c2af6d3d7c7d23aa34a22d774ede51333725ac1f4d6b9b4b

Observation 9872fc41-c8f6-4414-b6d4-029bdfe30fa2 · outbound

This paper cites Towards Effective and Efficient Continual Pre-training of Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Towards Effective and Efficient Continual Pre-training of Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.520414Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.520414Z digest=sha256:89acc3be644aec4bff4886bc40738eefcfffef998d3959e30ccc241c79a7a8ff

Observation b69e5e27-df9c-4063-ac7d-257c56c29113 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

YuLan-Mini: An Open Data-efficient Language Model Evaluating Large Language Models Trained on Code

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.524982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.524982Z digest=sha256:8adbbea11b7ae3ac051ed54bdf05f0ddf790e136e65396dbe43e29acd74b5a5d

Observation e5f94ab0-63e4-4d26-aeb0-e904cbdb294f · outbound

This paper cites Extending Context Window of Large Language Models via Positional Interpolation.

YuLan-Mini: An Open Data-efficient Language Model Extending Context Window of Large Language Models via Positional Interpolation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.529338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.529338Z digest=sha256:8cdcf8b6556087c6388dbfeefd160ef8e9a2e3c244611a016ec146d77e0a841f

Observation ed4ff887-4d77-4b69-b3f9-260798e02840 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.533625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.533625Z digest=sha256:da6c595c481ceea3bbaccf96f068d7936571dec1634824642f2d875ab814bcb4

Observation cb83bf82-f089-408a-ae44-9bd1c40c0646 · outbound

This paper cites Stable language model pre-training by reducing embedding variability.

YuLan-Mini: An Open Data-efficient Language Model Stable language model pre-training by reducing embedding variability

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.537912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.537912Z digest=sha256:2d597dc4272dcedf678c5008f13e2a4b6be6c984ae464d1fcb83d6313fbb89ca

Observation da012ea5-0bc2-42ae-97f6-7f9ba1d720ed · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

YuLan-Mini: An Open Data-efficient Language Model Training Verifiers to Solve Math Word Problems

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.542009Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.542009Z digest=sha256:0f2cad16cbf5dbfdb501ef50cd8a285dbff91f73731adaa869cd414e204bc5f3

Observation 22b90065-8b4c-4236-b9db-83e8981b7c1d · outbound

This paper cites Getting the most out of your tokenizer for pre-training and domain adaptation.

YuLan-Mini: An Open Data-efficient Language Model Getting the most out of your tokenizer for pre-training and domain adaptation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.546543Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.546543Z digest=sha256:152ddd3b5eb602282657ffe0e70c92db6c08a56f1c78089ddc8db846eb0e8d74

Observation fba000f4-a138-4d21-aa15-c521de1ca8e9 · outbound

This paper cites Flashattention-2: Faster attention with better parallelism and work partitioning.

YuLan-Mini: An Open Data-efficient Language Model Flashattention-2: Faster attention with better parallelism and work partitioning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.550757Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.550757Z digest=sha256:15b4ed3d3a2efd3807676b560a58363835a76ef1e7037084b4c3d40ac1858563

Observation bbf71baf-c53e-483b-8904-4493fbe45e2e · outbound

This paper cites Fu, Stefano Ermon, Atri Rudra, and Christopher R \' e.

YuLan-Mini: An Open Data-efficient Language Model Fu, Stefano Ermon, Atri Rudra, and Christopher R \' e

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.554907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.554907Z digest=sha256:9cf460f1972bd88a3c1db315fe257a6412718cbeab6d6dda5a4b7b2e158d58be

Observation 30bc93ab-dd92-45a3-970a-41c9f2d2daae · outbound

This paper cites The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family.

YuLan-Mini: An Open Data-efficient Language Model The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.558844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.558844Z digest=sha256:6b349d722d67901ce4fe73cd7cc4654fec0b3e3e8035ce58ce7f2ecf1f881e6b

Observation bc5c1223-b083-41f4-94d7-3c48f1089703 · outbound

This paper cites DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.563036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.563036Z digest=sha256:12224d9b27bb69dd7f9f58f8b928b9630f64d500e88659f9a5ee871e664bb002

Observation af3b0201-dff7-427d-b99f-80d6287253a9 · outbound

This paper cites Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster.

YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.567673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.567673Z digest=sha256:e0614fcafc0ff7872f288cd92903dddad6361240f6be9775b3c00717c54869fa

Observation ccd84ed2-68ac-41d0-8c31-aacf436a642b · outbound

This paper cites Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster.

YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.572114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.572114Z digest=sha256:c64eafa1c662b6bd805298a1a622cace89234af4b74f7d7d72b732eba4179fc5

Observation 36df1169-9b02-4f39-bcb4-79dc5fccd27e · outbound

This paper cites Fewer truncations improve language modeling.

YuLan-Mini: An Open Data-efficient Language Model Fewer truncations improve language modeling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.576433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.576433Z digest=sha256:b3f731b1c0ec6897d9d42190c744f0e2709cb9429ca25f315262824dff7bffd9

Observation 22e330f8-59c7-45d4-86a3-afa5ed5e212f · outbound

This paper cites Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch.

YuLan-Mini: An Open Data-efficient Language Model Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.581180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.581180Z digest=sha256:3317697afc4a9697217d0ac6083956f1f1e805ee230a3a08d900fedba5c95825

Observation 03f5878e-5136-4877-9845-24c75587f9f5 · outbound

This paper cites The Llama 3 Herd of Models.

YuLan-Mini: An Open Data-efficient Language Model The Llama 3 Herd of Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.585075Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.585075Z digest=sha256:85681b6191ff429f80bab62473c90b1040bf87774c2c46815b5abdcc39467a8c

Observation b9452567-fcfc-43d5-b05b-1ed6feac7507 · outbound

This paper cites How to train long-context language models (effectively).

YuLan-Mini: An Open Data-efficient Language Model How to train long-context language models (effectively)

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.589435Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.589435Z digest=sha256:fff8f34ca233c10814b0d70efe9a50f2a107ff27bca604003d7fcb8229777e38

Observation 9a6e0d48-8c4e-4080-af5c-01b40a15c30b · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.593442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.593442Z digest=sha256:e2a6fa9c30f0e9f38f18e3acab9f2d63963c34fcb3e7fb92a5d532712eeb7fe9

Observation f1605bc3-5fd9-4b9b-b773-7caf82493577 · outbound

This paper cites DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.597466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.597466Z digest=sha256:a82972f60d37efbf15817b3bba02aed8a00a371d0cd60c55b4fb269c43a89490

Observation 6a403ff7-89b4-4607-92e6-f7666643267d · outbound

This paper cites Scaling Laws and Compute-Optimal Training Beyond Fixed Training Durations.

YuLan-Mini: An Open Data-efficient Language Model Scaling Laws and Compute-Optimal Training Beyond Fixed Training Durations

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.601448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.601448Z digest=sha256:b7fb61568248195829661e5f7afad8ef6f561330f23cee6030ee828cb39b0eee

Observation 2ddbd7f9-26bc-4f36-ac4f-33c67402dd97 · outbound

This paper cites InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning.

YuLan-Mini: An Open Data-efficient Language Model InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.605726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.605726Z digest=sha256:6c03e92251c74b3c2eba8293cbec275aaf6889a0a6d9504e89f9f69e08eba33c

Observation 63e25bf4-9410-445f-8098-cb5f101cb6e8 · outbound

This paper cites WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models.

YuLan-Mini: An Open Data-efficient Language Model WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.610187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.610187Z digest=sha256:e95ebc78f147f134e44ccdc5944e829cbb11ea5040a2f11fe5f333d05f60d62c

Observation f3b6e776-e0ee-41e8-bbe1-24af0c471084 · outbound

This paper cites Measuring massive multitask language understanding.

YuLan-Mini: An Open Data-efficient Language Model Measuring massive multitask language understanding

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.615373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.615373Z digest=sha256:14c20bffa037a9abd047983a2b9bb7b6c1c9cdb6ab7cd52866856fd096bf8be0

Observation 0f9d24a7-59ad-4173-a868-dccd6a75ca9a · outbound

This paper cites Measuring mathematical problem solving with the MATH dataset.

YuLan-Mini: An Open Data-efficient Language Model Measuring mathematical problem solving with the MATH dataset

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.619133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.619133Z digest=sha256:7870c185f2e8dd4711c3bd1cc6b0a626c42d0ea9b2b5ab16de10ce6655376f8e

Observation 3c4af250-12f0-4265-a334-039538d6197e · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

YuLan-Mini: An Open Data-efficient Language Model RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.622904Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.622904Z digest=sha256:eab1ab598ac888fb62175e96cb634769de1fed76d6d4d853254abdbb959d23c1

Observation 4e44f159-f1be-4f96-95af-8b6c3daa637e · outbound

This paper cites Liger Kernel: Efficient Triton Kernels for LLM Training.

YuLan-Mini: An Open Data-efficient Language Model Liger Kernel: Efficient Triton Kernels for LLM Training

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.627059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.627059Z digest=sha256:4ff4eaad191e0af24781ed530ad08eca0edb4cb6cce702f525a6591b3bd96d3f

Observation 543551f6-61da-48a3-9c78-d6bea96bef33 · outbound

This paper cites MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies.

YuLan-Mini: An Open Data-efficient Language Model MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.631254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.631254Z digest=sha256:b8c26e64594438d263ff288a53c49f1f90673c68405e05e42b84ce5d31a2ce57

Observation af6f29f5-c0f0-4490-bdc5-37df4a1b3eae · outbound

This paper cites Towards reasoning in large language models: A survey.

YuLan-Mini: An Open Data-efficient Language Model Towards reasoning in large language models: A survey

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.635377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.635377Z digest=sha256:ab81e28f4ae1eaf4136c6c8cca335e6950dd43d4ab250b3f63066717bd828ea9

Observation fd4a7a7c-209e-4ac8-8610-9380619344df · outbound

This paper cites OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.639091Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.639091Z digest=sha256:f4955a2819fca6943d23ee517d17366c81e9dab67362cea838721d918c788d09

Observation 7b105f39-5c3a-44cd-87fe-c318ad56a07d · outbound

This paper cites C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models.

YuLan-Mini: An Open Data-efficient Language Model C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.643976Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.643976Z digest=sha256:88a98671d569cb3825493678c7938208c40df2846423811cff6097606e269f8d

Observation 240854d5-6f3e-4d93-b7b2-5728c82054bd · outbound

This paper cites Enhancing LLM Reasoning with Reward-guided Tree Search.

YuLan-Mini: An Open Data-efficient Language Model Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.648063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.648063Z digest=sha256:19801c7bbde2715258a85279518f1d5e44e35dbf7feffdabd1deb586157503cc

Observation 7953ac66-43f5-4b25-a25c-99c2f4eace53 · outbound

This paper cites TinyBERT: Distilling BERT for Natural Language Understanding.

YuLan-Mini: An Open Data-efficient Language Model TinyBERT: Distilling BERT for Natural Language Understanding

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.652243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.652243Z digest=sha256:5140686f9f6813432936e854b10292e5f156074e308914f81535cd33fa9f96bc

Observation c751306f-b105-4e1b-a7a1-8fda87d4eb45 · outbound

This paper cites Calc-x and calcformers: Empowering arithmetical chain-of-thought through interaction with symbolic systems.

YuLan-Mini: An Open Data-efficient Language Model Calc-x and calcformers: Empowering arithmetical chain-of-thought through interaction with symbolic systems

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.656023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.656023Z digest=sha256:0b0070d32a03404662a83968aecf96920d5e09a30a8b77732e8fbfb5599d224a

Observation d7630e91-5b85-4337-a9ec-4517ff9cb306 · outbound

This paper cites Kaplan, Sam McCandlish, T.

YuLan-Mini: An Open Data-efficient Language Model Kaplan, Sam McCandlish, T

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.659548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.659548Z digest=sha256:6f903491feb59948a1d74e1604051f37ce453ace0f59685fd6ab9263bcc4d929

Observation 792d3be0-7377-4567-be23-a8fbd389d9d1 · outbound

This paper cites LAMBADA: backward chaining for automated reasoning in natural language.

YuLan-Mini: An Open Data-efficient Language Model LAMBADA: backward chaining for automated reasoning in natural language

Reference 46

Resolution
verified exact
doi, observed 2026-08-11T05:17:56.539446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=arxiv_source observed=2026-08-11T05:17:55.663382Z digest=sha256:72acf681dfe24af03e2dd5dc05e4c6d29a23db2fb968cf2de2a34315564390aa

Observation 60c94e68-27d2-4cfe-ae69-1de60d8ecccf · outbound

This paper cites Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning.

YuLan-Mini: An Open Data-efficient Language Model Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.666929Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.666929Z digest=sha256:6fc533bd4f59167888e87ef69aab58588dd0c84b997aa5d191db91508ac3e37c

Observation 4057b232-8906-43bd-8b28-ad50ea8af76f · outbound

This paper cites Efficient memory management for large language model serving with pagedattention.

YuLan-Mini: An Open Data-efficient Language Model Efficient memory management for large language model serving with pagedattention

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.672190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.672190Z digest=sha256:35d6fa7d455ad194962aa2c41a86d44a03fa1df6a48944f46dc9a2f252e1b254

Observation 1698723c-f8f3-438e-a616-b412cc3819df · outbound

This paper cites RACE: Large-scale ReAding Comprehension Dataset From Examinations.

YuLan-Mini: An Open Data-efficient Language Model RACE: Large-scale ReAding Comprehension Dataset From Examinations

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.676267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.676267Z digest=sha256:7ed7756d19efd2125440c7b69cc67134c6697aca3f8a7bf8c327c705eb7e7dfa

Observation 3d73b432-089c-424a-ad9f-463f6bf7e903 · outbound

This paper cites Tulu 3: Pushing Frontiers in Open Language Model Post-Training.

YuLan-Mini: An Open Data-efficient Language Model Tulu 3: Pushing Frontiers in Open Language Model Post-Training

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.680324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.680324Z digest=sha256:e93f3b8ae6f3d0996d57d21e98d38870321332301af9d35f392c2670ec850fa8

Observation e1f626a6-a936-45c9-830e-18f7d7523ff6 · outbound

This paper cites To FP8 and Back Again: Quantifying Reduced Precision Effects on LLM Training Stability.

YuLan-Mini: An Open Data-efficient Language Model To FP8 and Back Again: Quantifying Reduced Precision Effects on LLM Training Stability

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.684447Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.684447Z digest=sha256:03c9b010851addb9b8269ec67446b717652f599fd46f0b471ba3d0bd9979678c

Observation e646169e-494e-4935-aa76-3bc0cb5be7e1 · outbound

This paper cites The stability-efficiency dilemma: Investigating sequence length warmup for training GPT models.

YuLan-Mini: An Open Data-efficient Language Model The stability-efficiency dilemma: Investigating sequence length warmup for training GPT models

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.688724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.688724Z digest=sha256:ebbcbda9f187d0d37377320ebe74b0e6c42a5abd87b04246659a4975f4acbb39

Observation ef7c6435-63ab-4922-b7b1-43c270f1fd16 · outbound

This paper cites CMMLU: measuring massive multitask language understanding in chinese.

YuLan-Mini: An Open Data-efficient Language Model CMMLU: measuring massive multitask language understanding in chinese

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.692410Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.692410Z digest=sha256:d3e87235392bbe4ff7dfb892154a147b6d105d819349220da454f1101206c811

Observation 0e8be959-aca8-4043-81cc-e0592cffea2d · outbound

This paper cites DataComp-LM: In search of the next generation of training sets for language models.

YuLan-Mini: An Open Data-efficient Language Model DataComp-LM: In search of the next generation of training sets for language models

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.696737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.696737Z digest=sha256:409a4a0d23aefc9b5c82a43bf94c797259e5fa96b8d68e0146e804f72cb08289

Observation 200054d4-573d-4a44-9017-415b27af45b3 · outbound

This paper cites Numinamath.

YuLan-Mini: An Open Data-efficient Language Model Numinamath

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.701333Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.701333Z digest=sha256:2fb7fc3706a478e3d094b6c2aca8a844ffba1a88fb608e07636e5c416a07f9d7

Observation a1ecbb9f-8465-4419-9f0f-fc3cf894a521 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.704949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.704949Z digest=sha256:ccad01519cfdde3dad571497d476b44d433352bcabaa7046d470e33d93413e00

Observation ab00372e-7f4b-4e68-9899-323b816fbd19 · outbound

This paper cites Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification, 2023.

YuLan-Mini: An Open Data-efficient Language Model Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification, 2023

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.709214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.709214Z digest=sha256:f8c68fc787e1b557b4bb9a33fede8e1a766b97305954cf4af8d102fecc68195d

Observation 51016bb6-ed26-4228-8ce7-e2a0cf89d0a7 · outbound

This paper cites Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelis.

YuLan-Mini: An Open Data-efficient Language Model Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelis

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.713062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.713062Z digest=sha256:5e2529bf7b871f1474e4b7005da01d006e92123fd962349c8505dfb95eb951c1

Observation 71a195d8-08d9-429f-856f-f4e36eb3087e · outbound

This paper cites Let's verify step by step.

YuLan-Mini: An Open Data-efficient Language Model Let's verify step by step

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.717656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.717656Z digest=sha256:b07ae4ee4cec89db0c7d084c7397f27fe1f0a2537517228d4194c99b49f35d55

Observation 1d46ae2a-a2eb-42c1-9a4c-6d00d8b3d451 · outbound

This paper cites Lean-STaR: Learning to Interleave Thinking and Proving.

YuLan-Mini: An Open Data-efficient Language Model Lean-STaR: Learning to Interleave Thinking and Proving

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.721451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.721451Z digest=sha256:e608dbcc008ba17b32947698fae15e6b3eeed5a49f73b3fb3555713064fca062

Observation a0730987-ad22-477c-91cb-3dd1f406fe4b · outbound

This paper cites Evaluating language models for efficient code generation.

YuLan-Mini: An Open Data-efficient Language Model Evaluating language models for efficient code generation

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.725736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.725736Z digest=sha256:4c673dd95675fa3753c615eb3843849318cfb320884408dfc6d167939116ebbc

Observation 332f812f-14f7-49cc-8a0b-bc98b5b1a394 · outbound

This paper cites Longwanjuan: Towards systematic measurement for long text quality.

YuLan-Mini: An Open Data-efficient Language Model Longwanjuan: Towards systematic measurement for long text quality

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.729586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.729586Z digest=sha256:e08f27992c72a1d53a78f1a1ec8b3c21014966a3e0c20aa3863f88f1b3f068d8

Observation 372b526d-e9d4-499b-822f-e2b8c5ae2fc2 · outbound

This paper cites Iandola, Chen Lai, Yuandong Tian, Igor Fedorov, Yunyang Xiong, Ernie Chang, Yangyang Shi, Raghuraman Krishnamoorthi, Liangzhen Lai, and Vikas Chandra.

YuLan-Mini: An Open Data-efficient Language Model Iandola, Chen Lai, Yuandong Tian, Igor Fedorov, Yunyang Xiong, Ernie Chang, Yangyang Shi, Raghuraman Krishnamoorthi, Liangzhen Lai, and Vikas Chandra

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.733247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.733247Z digest=sha256:192dc67d4a1873e5217d4c185cbe3cc5087ca59bf4449cd6158be735ea1bbeb3

Observation 29198369-d345-492c-8104-5ef371e61085 · outbound

This paper cites Decoupled weight decay regularization.

YuLan-Mini: An Open Data-efficient Language Model Decoupled weight decay regularization

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.736619Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.736619Z digest=sha256:7f23a7c2050f5ffd806a6c8d91c688fed3a2c5a829bdfcc6c2047f3c666188d3

Observation 0a8a1e71-1888-423c-b010-e3f41b4cfb23 · outbound

This paper cites Fineweb-edu, May 2024 a.

YuLan-Mini: An Open Data-efficient Language Model Fineweb-edu, May 2024 a

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.740267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.740267Z digest=sha256:a14af90e6eb7124aa23ad44a8603f802ade5e8dc534e146a106e67388940d830

Observation ffbab978-eb00-4886-9b1e-9fa502d20b1e · outbound

This paper cites StarCoder 2 and The Stack v2: The Next Generation.

YuLan-Mini: An Open Data-efficient Language Model StarCoder 2 and The Stack v2: The Next Generation

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.743567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.743567Z digest=sha256:26dca41b222a59f73bc2e68b3878b4430b763ba4066d1ce1aa85a357032144e8

Observation e265e353-5c69-4eb7-8f90-70c410304222 · outbound

This paper cites \# instag: Instruction tagging for analyzing supervised fine-tuning of large language models.

YuLan-Mini: An Open Data-efficient Language Model \# instag: Instruction tagging for analyzing supervised fine-tuning of large language models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.747649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.747649Z digest=sha256:f9231e06d706df89e598608adb4450bf47ec6ed645edaddcc7a1eec626311264

Observation ada51368-6dfe-4c1f-85d8-d15a3b00a4aa · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

YuLan-Mini: An Open Data-efficient Language Model Gemma: Open Models Based on Gemini Research and Technology

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.751805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.751805Z digest=sha256:c60fbab56ec9800b10085af5fef0f15ad2539511744835b009c165a5c3afafa8

Observation 7682d8df-fb4c-48ac-9114-8ad3e7336eb1 · outbound

This paper cites Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems.

YuLan-Mini: An Open Data-efficient Language Model Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.755485Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.755485Z digest=sha256:17bde1f3601f0a5b09b74562f2090a0db26a7b03fcf614a716449cfa01e62e52

Observation 2888ad4e-50be-48ba-990a-1fe349f00bc8 · outbound

This paper cites AgentInstruct: Toward Generative Teaching with Agentic Flows.

YuLan-Mini: An Open Data-efficient Language Model AgentInstruct: Toward Generative Teaching with Agentic Flows

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.759885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.759885Z digest=sha256:a1563a205c80e8de2cee39260bb306af102ba463003c8e8be2c43236f40b199c

Observation 20006ad7-ff15-436b-b12c-742bebf742df · outbound

This paper cites Orca-Math: Unlocking the potential of SLMs in Grade School Math.

YuLan-Mini: An Open Data-efficient Language Model Orca-Math: Unlocking the potential of SLMs in Grade School Math

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.764251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.764251Z digest=sha256:241254af99c2b022e52138c6fb7986806ffd026915c4420d04a48766006555fd

Observation c86fb826-818e-46aa-bd8a-a26fc2b0a430 · outbound

This paper cites A Theory on Adam Instability in Large-Scale Machine Learning.

YuLan-Mini: An Open Data-efficient Language Model A Theory on Adam Instability in Large-Scale Machine Learning

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.769456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.769456Z digest=sha256:7b4fa68f91dd9fab0077b8ab4ac2cca3aa8dcb8f991ca72b173cea9bff5a56ed

Observation 20a028e5-506a-4f8a-b8b4-3fe06c836d58 · outbound

This paper cites A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories.

YuLan-Mini: An Open Data-efficient Language Model A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.775045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.775045Z digest=sha256:4174dc61654794b6bc511164e0e379801cf18153d946d089b22a3efd0855c028

Observation 37f381ee-a220-45c8-b701-6757e7e54e4d · outbound

This paper cites Initialization of large language models via reparameterization to mitigate loss spikes.

YuLan-Mini: An Open Data-efficient Language Model Initialization of large language models via reparameterization to mitigate loss spikes

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.779633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.779633Z digest=sha256:eca9d415a11eb8bf2c14bc513f81f7d508dbd1c458a852457e721216ac2ca4ef

Observation 0d427be1-5e49-4c7f-8999-73dec0ad5d7b · outbound

This paper cites GPT-4 Technical Report.

YuLan-Mini: An Open Data-efficient Language Model GPT-4 Technical Report

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.783357Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.783357Z digest=sha256:bd1cd69d4f3f1f77a4e8c917e0d2d61dc58a647ae1780c712b7ed339a99b91a3

Observation 1a62bfcc-d9f6-461c-8325-421f6c18c33f · outbound

This paper cites Opencsg/chinese-fineweb-edu Datasets at Hugging Face.

YuLan-Mini: An Open Data-efficient Language Model Opencsg/chinese-fineweb-edu Datasets at Hugging Face

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.788805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.788805Z digest=sha256:5305f6914fb167f71d9d6ae93d78cb8371d14855a37c181db02eab5508cf70d1

Observation 4025dfc6-5705-4989-93c8-9e057f581fd7 · outbound

This paper cites Openwebmath: An open dataset of high-quality mathematical web text.

YuLan-Mini: An Open Data-efficient Language Model Openwebmath: An open dataset of high-quality mathematical web text

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.793062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.793062Z digest=sha256:1ef3dd17c5c7df559873e260a1ac6ac64b0fe319908a975122fe8352099f59f3

Observation 8c045feb-349f-4345-b277-87987db0101a · outbound

This paper cites The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale.

YuLan-Mini: An Open Data-efficient Language Model The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale

Reference 78

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.796851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.796851Z digest=sha256:ab7af2795d336fabbfed74cc2b06d0e9a40fd39935c0bf086ec50ee48a235761

Observation b96506b3-2dd9-4ed0-9312-32ccf87930ef · outbound

This paper cites Using the output embedding to improve language models.

YuLan-Mini: An Open Data-efficient Language Model Using the output embedding to improve language models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.800922Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.800922Z digest=sha256:a542755661870f7b5f69d131649fd124a7a31f7f35c2e901629c7b806fb23843

Observation fb3f90b6-cd61-48ce-88a9-3167d0f6cd56 · outbound

This paper cites Bpe-dropout: Simple and effective subword regularization.

YuLan-Mini: An Open Data-efficient Language Model Bpe-dropout: Simple and effective subword regularization

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.805088Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.805088Z digest=sha256:776eb828e623e7b769acfeec3ee0f669f2f4a19984469554e49da93c2b6414ac

Observation dfd598b5-840e-401e-aea0-b701e6d112d4 · outbound

This paper cites Qwen2.5: A party of foundation models, September 2024.

YuLan-Mini: An Open Data-efficient Language Model Qwen2.5: A party of foundation models, September 2024

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.809849Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.809849Z digest=sha256:ab0ebe27405c4a134a91790a5ecf7aae312e8c1ce1e385ec33fbb35683f503c3

Observation cbb74a3b-c0d6-4000-9465-ace5f2b438af · outbound

This paper cites Qwq: Reflect deeply on the boundaries of the unknown, November 2024.

YuLan-Mini: An Open Data-efficient Language Model Qwq: Reflect deeply on the boundaries of the unknown, November 2024

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.813910Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.813910Z digest=sha256:7f8eb87ec9315152677a98d2131a588eead361ce7862f59e66af62e671acc1b3

Observation 11a5e7c4-1136-4352-8252-4ef5e130d539 · outbound

This paper cites Generalized Slow Roll for Tensors.

YuLan-Mini: An Open Data-efficient Language Model Generalized Slow Roll for Tensors

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.818112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.818112Z digest=sha256:f2091ca807871ab789ec314ab6c0dc7083ccd8b8b435040ed4685087f1d8cba3

Observation 98d016bd-757e-40a0-bc69-5d86bb7d5913 · outbound

This paper cites Methods of improving LLM training stability.

YuLan-Mini: An Open Data-efficient Language Model Methods of improving LLM training stability

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.822498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.822498Z digest=sha256:1db95b0058925607cb1ccf953d37a56f343b3cecd2217980a59c7ed44a1996fb

Observation 15560fa9-2c6a-46c7-85fa-55bd7bea687f · outbound

This paper cites Winogrande: an adversarial winograd schema challenge at scale.

YuLan-Mini: An Open Data-efficient Language Model Winogrande: an adversarial winograd schema challenge at scale

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.826872Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.826872Z digest=sha256:9eb76da12dd35ed439c6496b6439cf2cab3cb5758912c4bff49f250fbb69be93

Observation 309525be-37af-4878-aa69-f0beef33a369 · outbound

This paper cites Analysing mathematical reasoning abilities of neural models.

YuLan-Mini: An Open Data-efficient Language Model Analysing mathematical reasoning abilities of neural models

Reference 86

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.830356Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.830356Z digest=sha256:ff4dfc4db6d11a2739335678d69fe6c35e9c3c8d2846aa726d3fd0798c0d1023

Observation dd4fec3b-5f25-4c4d-860d-e6cf23ba19dc · outbound

This paper cites What Language Model to Train if You Have One Million GPU Hours?.

YuLan-Mini: An Open Data-efficient Language Model What Language Model to Train if You Have One Million GPU Hours?

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.834003Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.834003Z digest=sha256:e7c11edf958d97ffb7c94c3a34f65740b599e0e192ad57497c931059bddac2a0

Observation 50587157-1d42-495a-8d07-2e0c299bd7b7 · outbound

This paper cites GLU Variants Improve Transformer.

YuLan-Mini: An Open Data-efficient Language Model GLU Variants Improve Transformer

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.837609Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.837609Z digest=sha256:6f815e862fb9dfba1ff0d717a0a1dc3e035d76b791b61542f00ede17624bef64

Observation 8730c3b9-df50-4f55-9cd3-42ff5cae83c1 · outbound

This paper cites Reflexion: language agents with verbal reinforcement learning.

YuLan-Mini: An Open Data-efficient Language Model Reflexion: language agents with verbal reinforcement learning

Reference 89

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.841726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.841726Z digest=sha256:80e7b2bb3a89615bdd1123507d24d4cc1011f221a39202f05223c6627252f0f7

Observation 49a2a1f1-c421-43ed-bf83-eeefaf70a699 · outbound

This paper cites Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism.

YuLan-Mini: An Open Data-efficient Language Model Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism

Reference 90

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.845648Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.845648Z digest=sha256:393c2d1ac4b20e5b5db7c1cea4c766881b307341bd6c48eb75dc64f3b783db11

Observation 534693d8-74e2-48b1-87d9-c6c9ce775baa · outbound

This paper cites Scaling synthetic logical reasoning datasets with context-sensitive declarative grammars.

YuLan-Mini: An Open Data-efficient Language Model Scaling synthetic logical reasoning datasets with context-sensitive declarative grammars

Reference 91

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.850860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.850860Z digest=sha256:0f954f1ef06fe220e50895f75ad534778b67f855f7b91840cefa4a4fa76604f1

Observation b8249ded-ee17-4de7-b738-8b9f07ef0f4b · outbound

This paper cites Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A.

YuLan-Mini: An Open Data-efficient Language Model Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A

Reference 92

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.855080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.855080Z digest=sha256:03edd6094e06dec0fa1f055d0695dbc36407438f55fc03aa9abdeb798f44725d

Observation 067a34e9-01f5-4deb-ad99-eaf1f3bd5113 · outbound

This paper cites An integrated data processing framework for pretraining foundation models.

YuLan-Mini: An Open Data-efficient Language Model An integrated data processing framework for pretraining foundation models

Reference 93

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.859191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.859191Z digest=sha256:7c46af4aff9791504f75e5ef716a14b0cf022f46d1aafdc97ba998d106b20856

Observation ebafdae7-2f71-4a6e-8c3a-b718eab9b0c1 · outbound

This paper cites Spike No More: Stabilizing the Pre-training of Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Spike No More: Stabilizing the Pre-training of Large Language Models

Reference 94

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.863452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.863452Z digest=sha256:7795f15e72eff5b2a4b0fb5b75db8c648ed198e13f38c6aaf80152214dd56036

Observation f6830659-a783-475b-91fb-768d22f64b1c · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.868198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.868198Z digest=sha256:6288d5b6b4416061b32cb247fd23c2387c6946a1d528f995dbd7c50850ea3cda

Observation f0a4b540-0312-49a1-8aa8-e20ccd484eff · outbound

This paper cites LLMBox : A Comprehensive Library for Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model LLMBox : A Comprehensive Library for Large Language Models

Reference 96

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.872360Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.872360Z digest=sha256:158331886f81413c635d8cd39052978a5e88794e0e739b78ac410dad79e276c1

Observation b99b19bd-383b-440d-bc06-50cc5082675c · outbound

This paper cites Mathscale: Scaling instruction tuning for mathematical reasoning.

YuLan-Mini: An Open Data-efficient Language Model Mathscale: Scaling instruction tuning for mathematical reasoning

Reference 97

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.877674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.877674Z digest=sha256:c3bbc954b585297f0df37e372987eeb7a8b50ed179ee69915482e948a34959f2

Observation 2e309652-293c-493e-8eba-e2a1cf5f4941 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 98

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.881542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.881542Z digest=sha256:7229339a2af6f0589d754a6b5ba187b5ce678b4f8df1a9d1a704399a34cec6b9

Observation d2abf91c-b95f-4497-b093-4e5a31d32053 · outbound

This paper cites D4: improving LLM pretraining via document de-duplication and diversification.

YuLan-Mini: An Open Data-efficient Language Model D4: improving LLM pretraining via document de-duplication and diversification

Reference 99

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.885313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.885313Z digest=sha256:40789743485480f49b443ce87bf5d7c67211f22538847951c0295f92d3bfd5bf

Observation 743e5dc6-35c4-4390-8c15-ea78498a6d02 · outbound

This paper cites Scaling Law with Learning Rate Annealing.

YuLan-Mini: An Open Data-efficient Language Model Scaling Law with Learning Rate Annealing

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.889322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.889322Z digest=sha256:699c7cdcf63826c7f767e05aeba4a5884cb01f4abce2c0f4fd25ce61b54ede89

Pith citing papers

Observation 0f838f95-5254-4696-9768-1be08b293133 · inbound

Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance cites this paper.

Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance YuLan-Mini: An Open Data-efficient Language Model

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T11:44:04.984553Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T11:44:04.984553Z digest=sha256:ce57df48b5590545e49f3e3a88bb3778bfa1f701c0ee760d79a3cc50397ae3cc

Observation bdd60ec4-fc6d-4569-bebe-949dfecc6068 · inbound

Towards Efficient LLMs Annealing with Principled Sample Selection cites this paper.

Towards Efficient LLMs Annealing with Principled Sample Selection YuLan-Mini: An Open Data-efficient Language Model

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-06-28T22:42:47.027667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-06-28T22:36:28.889515Z digest=sha256:e9044092aade0f42563e0b4204647ad6f86bbe8892f4addae9434b971ac39e4d