#expertmodels
A new study shows cross‑entropy loss follows a power‑law: larger base models lower the baseline and each added expert cuts loss by ~1/k, indicating diminishing returns. Read more: https://getnews.me/scaling-laws-reveal-how-adding-experts-improves-large-language-models/ #scalinglaws #expertmodels
October 3, 2025 at 11:28 AM