A Survey on LLM Mid-training
https://arxiv.org/abs/2510.23081
A Survey on LLM Mid-training
https://arxiv.org/abs/2510.23081
LinkQA: Synthesizing Diverse QA from Multiple Seeds Strongly Linked by Knowledge Points
https://arxiv.org/abs/2508.01317
LinkQA: Synthesizing Diverse QA from Multiple Seeds Strongly Linked by Knowledge Points
https://arxiv.org/abs/2508.01317
Large-Scale Diverse Synthesis for Mid-Training
https://arxiv.org/abs/2508.01326
Large-Scale Diverse Synthesis for Mid-Training
https://arxiv.org/abs/2508.01326
Enhancing LLMs via High-Knowledge Data Selection
https://arxiv.org/abs/2505.14070
Enhancing LLMs via High-Knowledge Data Selection
https://arxiv.org/abs/2505.14070
FRAMES: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy
https://arxiv.org/abs/2502.05551
FRAMES: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy
https://arxiv.org/abs/2502.05551