Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-11T05:17:55.889322Z
Paper Citation Record · LEDGER
As of 11 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 2 inbound Pith citation observations for arXiv:2412.17743.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-11T05:17:55.889322Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-11T06:34:44.6726+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-06T11:44:04.984553Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-06-28T22:42:47.026295Z
100 of 135 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation df77c6d9-4f40-4203-bedf-43a1607a9ad6 · outbound
YuLan-Mini: An Open Data-efficient Language Model Synthetically generated reasoning dataset (gsm8k-inspired) with enhanced diversity using gretel navigator and meta-llama/meta-llama-3.1-405b
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f4218e80-733e-4b6f-b694-44c605f6f83e · outbound
YuLan-Mini: An Open Data-efficient Language Model GQA: training generalized multi-query transformer models from multi-head checkpoints
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 47c0352e-4240-465a-ad63-c8eb4b1d05d6 · outbound
YuLan-Mini: An Open Data-efficient Language Model Smollm2 - with great data, comes great performance, 2024
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e37bebbe-739c-44fd-9835-bf0361a23c9a · outbound
YuLan-Mini: An Open Data-efficient Language Model Program Synthesis with Large Language Models
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3c185ad2-d8ba-4e5a-8194-27ed0d1b079e · outbound
YuLan-Mini: An Open Data-efficient Language Model Jiang, Jia Deng, Stella Biderman, and Sean Welleck
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e94615bc-fb03-40db-b562-11ac0fae0d5d · outbound
YuLan-Mini: An Open Data-efficient Language Model Layer Normalization
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0e699dc9-a885-4867-ac49-624da63de074 · outbound
YuLan-Mini: An Open Data-efficient Language Model Numinamath 7b cot, 2024
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 272b80f4-77c6-4adf-a15c-c943b17e1b84 · outbound
YuLan-Mini: An Open Data-efficient Language Model Stable LM 2 1.6B Technical Report
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fbf056b8-538a-4826-b382-f64b47e8f88c · outbound
YuLan-Mini: An Open Data-efficient Language Model DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 95f3bacb-3738-4743-8d1c-e8fc6ca2ccde · outbound
YuLan-Mini: An Open Data-efficient Language Model Enriching word vectors with subword information
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 02e4b734-3974-4cec-a258-a447529ed422 · outbound
YuLan-Mini: An Open Data-efficient Language Model Language Models are Few-Shot Learners
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9872fc41-c8f6-4414-b6d4-029bdfe30fa2 · outbound
YuLan-Mini: An Open Data-efficient Language Model Towards Effective and Efficient Continual Pre-training of Large Language Models
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b69e5e27-df9c-4063-ac7d-257c56c29113 · outbound
YuLan-Mini: An Open Data-efficient Language Model Evaluating Large Language Models Trained on Code
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e5f94ab0-63e4-4d26-aeb0-e904cbdb294f · outbound
YuLan-Mini: An Open Data-efficient Language Model Extending Context Window of Large Language Models via Positional Interpolation
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ed4ff887-4d77-4b69-b3f9-260798e02840 · outbound
YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cb83bf82-f089-408a-ae44-9bd1c40c0646 · outbound
YuLan-Mini: An Open Data-efficient Language Model Stable language model pre-training by reducing embedding variability
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation da012ea5-0bc2-42ae-97f6-7f9ba1d720ed · outbound
YuLan-Mini: An Open Data-efficient Language Model Training Verifiers to Solve Math Word Problems
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 22b90065-8b4c-4236-b9db-83e8981b7c1d · outbound
YuLan-Mini: An Open Data-efficient Language Model Getting the most out of your tokenizer for pre-training and domain adaptation
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fba000f4-a138-4d21-aa15-c521de1ca8e9 · outbound
YuLan-Mini: An Open Data-efficient Language Model Flashattention-2: Faster attention with better parallelism and work partitioning
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bbf71baf-c53e-483b-8904-4493fbe45e2e · outbound
YuLan-Mini: An Open Data-efficient Language Model Fu, Stefano Ermon, Atri Rudra, and Christopher R \' e
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 30bc93ab-dd92-45a3-970a-41c9f2d2daae · outbound
YuLan-Mini: An Open Data-efficient Language Model The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bc5c1223-b083-41f4-94d7-3c48f1089703 · outbound
YuLan-Mini: An Open Data-efficient Language Model DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation af3b0201-dff7-427d-b99f-80d6287253a9 · outbound
YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ccd84ed2-68ac-41d0-8c31-aacf436a642b · outbound
YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 36df1169-9b02-4f39-bcb4-79dc5fccd27e · outbound
YuLan-Mini: An Open Data-efficient Language Model Fewer truncations improve language modeling
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 22e330f8-59c7-45d4-86a3-afa5ed5e212f · outbound
YuLan-Mini: An Open Data-efficient Language Model Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 03f5878e-5136-4877-9845-24c75587f9f5 · outbound
YuLan-Mini: An Open Data-efficient Language Model The Llama 3 Herd of Models
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b9452567-fcfc-43d5-b05b-1ed6feac7507 · outbound
YuLan-Mini: An Open Data-efficient Language Model How to train long-context language models (effectively)
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9a6e0d48-8c4e-4080-af5c-01b40a15c30b · outbound
YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f1605bc3-5fd9-4b9b-b773-7caf82493577 · outbound
YuLan-Mini: An Open Data-efficient Language Model DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6a403ff7-89b4-4607-92e6-f7666643267d · outbound
YuLan-Mini: An Open Data-efficient Language Model Scaling Laws and Compute-Optimal Training Beyond Fixed Training Durations
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2ddbd7f9-26bc-4f36-ac4f-33c67402dd97 · outbound
YuLan-Mini: An Open Data-efficient Language Model InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 63e25bf4-9410-445f-8098-cb5f101cb6e8 · outbound
YuLan-Mini: An Open Data-efficient Language Model WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f3b6e776-e0ee-41e8-bbe1-24af0c471084 · outbound
YuLan-Mini: An Open Data-efficient Language Model Measuring massive multitask language understanding
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0f9d24a7-59ad-4173-a868-dccd6a75ca9a · outbound
YuLan-Mini: An Open Data-efficient Language Model Measuring mathematical problem solving with the MATH dataset
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3c4af250-12f0-4265-a334-039538d6197e · outbound
YuLan-Mini: An Open Data-efficient Language Model RULER: What's the Real Context Size of Your Long-Context Language Models?
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4e44f159-f1be-4f96-95af-8b6c3daa637e · outbound
YuLan-Mini: An Open Data-efficient Language Model Liger Kernel: Efficient Triton Kernels for LLM Training
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 543551f6-61da-48a3-9c78-d6bea96bef33 · outbound
YuLan-Mini: An Open Data-efficient Language Model MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation af6f29f5-c0f0-4490-bdc5-37df4a1b3eae · outbound
YuLan-Mini: An Open Data-efficient Language Model Towards reasoning in large language models: A survey
Reference 39
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fd4a7a7c-209e-4ac8-8610-9380619344df · outbound
YuLan-Mini: An Open Data-efficient Language Model OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
Reference 40
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7b105f39-5c3a-44cd-87fe-c318ad56a07d · outbound
YuLan-Mini: An Open Data-efficient Language Model C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models
Reference 41
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 240854d5-6f3e-4d93-b7b2-5728c82054bd · outbound
YuLan-Mini: An Open Data-efficient Language Model Enhancing LLM Reasoning with Reward-guided Tree Search
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7953ac66-43f5-4b25-a25c-99c2f4eace53 · outbound
YuLan-Mini: An Open Data-efficient Language Model TinyBERT: Distilling BERT for Natural Language Understanding
Reference 43
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c751306f-b105-4e1b-a7a1-8fda87d4eb45 · outbound
YuLan-Mini: An Open Data-efficient Language Model Calc-x and calcformers: Empowering arithmetical chain-of-thought through interaction with symbolic systems
Reference 44
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d7630e91-5b85-4337-a9ec-4517ff9cb306 · outbound
YuLan-Mini: An Open Data-efficient Language Model Kaplan, Sam McCandlish, T
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 792d3be0-7377-4567-be23-a8fbd389d9d1 · outbound
YuLan-Mini: An Open Data-efficient Language Model LAMBADA: backward chaining for automated reasoning in natural language
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.
Observation 60c94e68-27d2-4cfe-ae69-1de60d8ecccf · outbound
YuLan-Mini: An Open Data-efficient Language Model Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning
Reference 47
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4057b232-8906-43bd-8b28-ad50ea8af76f · outbound
YuLan-Mini: An Open Data-efficient Language Model Efficient memory management for large language model serving with pagedattention
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1698723c-f8f3-438e-a616-b412cc3819df · outbound
YuLan-Mini: An Open Data-efficient Language Model RACE: Large-scale ReAding Comprehension Dataset From Examinations
Reference 49
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3d73b432-089c-424a-ad9f-463f6bf7e903 · outbound
YuLan-Mini: An Open Data-efficient Language Model Tulu 3: Pushing Frontiers in Open Language Model Post-Training
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e1f626a6-a936-45c9-830e-18f7d7523ff6 · outbound
YuLan-Mini: An Open Data-efficient Language Model To FP8 and Back Again: Quantifying Reduced Precision Effects on LLM Training Stability
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e646169e-494e-4935-aa76-3bc0cb5be7e1 · outbound
YuLan-Mini: An Open Data-efficient Language Model The stability-efficiency dilemma: Investigating sequence length warmup for training GPT models
Reference 52
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ef7c6435-63ab-4922-b7b1-43c270f1fd16 · outbound
YuLan-Mini: An Open Data-efficient Language Model CMMLU: measuring massive multitask language understanding in chinese
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0e8be959-aca8-4043-81cc-e0592cffea2d · outbound
YuLan-Mini: An Open Data-efficient Language Model DataComp-LM: In search of the next generation of training sets for language models
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 200054d4-573d-4a44-9017-415b27af45b3 · outbound
YuLan-Mini: An Open Data-efficient Language Model Numinamath
Reference 55
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a1ecbb9f-8465-4419-9f0f-fc3cf894a521 · outbound
YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work
Reference 56
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ab00372e-7f4b-4e68-9899-323b816fbd19 · outbound
YuLan-Mini: An Open Data-efficient Language Model Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification, 2023
Reference 57
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 51016bb6-ed26-4228-8ce7-e2a0cf89d0a7 · outbound
YuLan-Mini: An Open Data-efficient Language Model Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelis
Reference 58
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 71a195d8-08d9-429f-856f-f4e36eb3087e · outbound
YuLan-Mini: An Open Data-efficient Language Model Let's verify step by step
Reference 59
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1d46ae2a-a2eb-42c1-9a4c-6d00d8b3d451 · outbound
YuLan-Mini: An Open Data-efficient Language Model Lean-STaR: Learning to Interleave Thinking and Proving
Reference 60
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a0730987-ad22-477c-91cb-3dd1f406fe4b · outbound
YuLan-Mini: An Open Data-efficient Language Model Evaluating language models for efficient code generation
Reference 61
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 332f812f-14f7-49cc-8a0b-bc98b5b1a394 · outbound
YuLan-Mini: An Open Data-efficient Language Model Longwanjuan: Towards systematic measurement for long text quality
Reference 62
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 372b526d-e9d4-499b-822f-e2b8c5ae2fc2 · outbound
YuLan-Mini: An Open Data-efficient Language Model Iandola, Chen Lai, Yuandong Tian, Igor Fedorov, Yunyang Xiong, Ernie Chang, Yangyang Shi, Raghuraman Krishnamoorthi, Liangzhen Lai, and Vikas Chandra
Reference 63
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 29198369-d345-492c-8104-5ef371e61085 · outbound
YuLan-Mini: An Open Data-efficient Language Model Decoupled weight decay regularization
Reference 64
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0a8a1e71-1888-423c-b010-e3f41b4cfb23 · outbound
YuLan-Mini: An Open Data-efficient Language Model Fineweb-edu, May 2024 a
Reference 65
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ffbab978-eb00-4886-9b1e-9fa502d20b1e · outbound
YuLan-Mini: An Open Data-efficient Language Model StarCoder 2 and The Stack v2: The Next Generation
Reference 66
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e265e353-5c69-4eb7-8f90-70c410304222 · outbound
YuLan-Mini: An Open Data-efficient Language Model \# instag: Instruction tagging for analyzing supervised fine-tuning of large language models
Reference 67
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ada51368-6dfe-4c1f-85d8-d15a3b00a4aa · outbound
YuLan-Mini: An Open Data-efficient Language Model Gemma: Open Models Based on Gemini Research and Technology
Reference 68
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7682d8df-fb4c-48ac-9114-8ad3e7336eb1 · outbound
YuLan-Mini: An Open Data-efficient Language Model Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems
Reference 69
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2888ad4e-50be-48ba-990a-1fe349f00bc8 · outbound
YuLan-Mini: An Open Data-efficient Language Model AgentInstruct: Toward Generative Teaching with Agentic Flows
Reference 70
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 20006ad7-ff15-436b-b12c-742bebf742df · outbound
YuLan-Mini: An Open Data-efficient Language Model Orca-Math: Unlocking the potential of SLMs in Grade School Math
Reference 71
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c86fb826-818e-46aa-bd8a-a26fc2b0a430 · outbound
YuLan-Mini: An Open Data-efficient Language Model A Theory on Adam Instability in Large-Scale Machine Learning
Reference 72
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 20a028e5-506a-4f8a-b8b4-3fe06c836d58 · outbound
YuLan-Mini: An Open Data-efficient Language Model A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories
Reference 73
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 37f381ee-a220-45c8-b701-6757e7e54e4d · outbound
YuLan-Mini: An Open Data-efficient Language Model Initialization of large language models via reparameterization to mitigate loss spikes
Reference 74
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0d427be1-5e49-4c7f-8999-73dec0ad5d7b · outbound
YuLan-Mini: An Open Data-efficient Language Model GPT-4 Technical Report
Reference 75
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1a62bfcc-d9f6-461c-8325-421f6c18c33f · outbound
YuLan-Mini: An Open Data-efficient Language Model Opencsg/chinese-fineweb-edu Datasets at Hugging Face
Reference 76
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4025dfc6-5705-4989-93c8-9e057f581fd7 · outbound
YuLan-Mini: An Open Data-efficient Language Model Openwebmath: An open dataset of high-quality mathematical web text
Reference 77
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8c045feb-349f-4345-b277-87987db0101a · outbound
YuLan-Mini: An Open Data-efficient Language Model The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale
Reference 78
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b96506b3-2dd9-4ed0-9312-32ccf87930ef · outbound
YuLan-Mini: An Open Data-efficient Language Model Using the output embedding to improve language models
Reference 79
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fb3f90b6-cd61-48ce-88a9-3167d0f6cd56 · outbound
YuLan-Mini: An Open Data-efficient Language Model Bpe-dropout: Simple and effective subword regularization
Reference 80
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dfd598b5-840e-401e-aea0-b701e6d112d4 · outbound
YuLan-Mini: An Open Data-efficient Language Model Qwen2.5: A party of foundation models, September 2024
Reference 81
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cbb74a3b-c0d6-4000-9465-ace5f2b438af · outbound
YuLan-Mini: An Open Data-efficient Language Model Qwq: Reflect deeply on the boundaries of the unknown, November 2024
Reference 82
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 11a5e7c4-1136-4352-8252-4ef5e130d539 · outbound
YuLan-Mini: An Open Data-efficient Language Model Generalized Slow Roll for Tensors
Reference 83
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 98d016bd-757e-40a0-bc69-5d86bb7d5913 · outbound
YuLan-Mini: An Open Data-efficient Language Model Methods of improving LLM training stability
Reference 84
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 15560fa9-2c6a-46c7-85fa-55bd7bea687f · outbound
YuLan-Mini: An Open Data-efficient Language Model Winogrande: an adversarial winograd schema challenge at scale
Reference 85
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 309525be-37af-4878-aa69-f0beef33a369 · outbound
YuLan-Mini: An Open Data-efficient Language Model Analysing mathematical reasoning abilities of neural models
Reference 86
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dd4fec3b-5f25-4c4d-860d-e6cf23ba19dc · outbound
YuLan-Mini: An Open Data-efficient Language Model What Language Model to Train if You Have One Million GPU Hours?
Reference 87
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 50587157-1d42-495a-8d07-2e0c299bd7b7 · outbound
YuLan-Mini: An Open Data-efficient Language Model GLU Variants Improve Transformer
Reference 88
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8730c3b9-df50-4f55-9cd3-42ff5cae83c1 · outbound
YuLan-Mini: An Open Data-efficient Language Model Reflexion: language agents with verbal reinforcement learning
Reference 89
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 49a2a1f1-c421-43ed-bf83-eeefaf70a699 · outbound
YuLan-Mini: An Open Data-efficient Language Model Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism
Reference 90
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 534693d8-74e2-48b1-87d9-c6c9ce775baa · outbound
YuLan-Mini: An Open Data-efficient Language Model Scaling synthetic logical reasoning datasets with context-sensitive declarative grammars
Reference 91
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b8249ded-ee17-4de7-b738-8b9f07ef0f4b · outbound
YuLan-Mini: An Open Data-efficient Language Model Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A
Reference 92
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 067a34e9-01f5-4deb-ad99-eaf1f3bd5113 · outbound
YuLan-Mini: An Open Data-efficient Language Model An integrated data processing framework for pretraining foundation models
Reference 93
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ebafdae7-2f71-4a6e-8c3a-b718eab9b0c1 · outbound
YuLan-Mini: An Open Data-efficient Language Model Spike No More: Stabilizing the Pre-training of Large Language Models
Reference 94
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f6830659-a783-475b-91fb-768d22f64b1c · outbound
YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work
Reference 95
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f0a4b540-0312-49a1-8aa8-e20ccd484eff · outbound
YuLan-Mini: An Open Data-efficient Language Model LLMBox : A Comprehensive Library for Large Language Models
Reference 96
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b99b19bd-383b-440d-bc06-50cc5082675c · outbound
YuLan-Mini: An Open Data-efficient Language Model Mathscale: Scaling instruction tuning for mathematical reasoning
Reference 97
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2e309652-293c-493e-8eba-e2a1cf5f4941 · outbound
YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work
Reference 98
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d2abf91c-b95f-4497-b093-4e5a31d32053 · outbound
YuLan-Mini: An Open Data-efficient Language Model D4: improving LLM pretraining via document de-duplication and diversification
Reference 99
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 743e5dc6-35c4-4390-8c15-ea78498a6d02 · outbound
YuLan-Mini: An Open Data-efficient Language Model Scaling Law with Learning Rate Annealing
Reference 100
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0f838f95-5254-4696-9768-1be08b293133 · inbound
Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance YuLan-Mini: An Open Data-efficient Language Model
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bdd60ec4-fc6d-4569-bebe-949dfecc6068 · inbound
Towards Efficient LLMs Annealing with Principled Sample Selection YuLan-Mini: An Open Data-efficient Language Model
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.