#DataEfficient
9/10 Key takeaway: RL shines when defining a reward function is easier than providing training data. #RewardBased #DataEfficient #AITraining
May 2, 2025 at 11:10 AM
Diffusion Language Models are Super Data Learners
Chao Du, Hang Yan et al.
Paper
Details
#DiffusionModels #DataEfficient #LanguageModels
December 11, 2025 at 9:02 AM