Dongxi 东锡 NLP@dongxi_nlp
33AI 编辑部评分,满分 100
2026-08-11 17:46· 26分钟前
AI 导读

新鲜数据是有限的。 下一个缩放定律将找出真正限制学习的因素。 论文: 《弥合计算最优与数据最优的预训练》

Fresh data is finite.

The next scaling law finds what truly limits learning.

Paper:

Bridging Compute- and Data-Optimal Pretraining

Sunny Qin(1/N) 🧵 Chinchilla assumes you'll never run out of fresh data. That era is ending! Compute keeps growing exponentially, but high-quality tokens don't. So what'...

来源:Dongxi 东锡 NLP · x.com

Dongxi 东锡 NLP · @dongxi_nlp · X·2026-08-11 17:46·26分钟前
AI 导读

新鲜数据是有限的。 下一个缩放定律将找出真正限制学习的因素。 论文: 《弥合计算最优与数据最优的预训练》

Fresh data is finite.

The next scaling law finds what truly limits learning.

Paper:

Bridging Compute- and Data-Optimal Pretraining

Sunny Qin(1/N) 🧵 Chinchilla assumes you'll never run out of fresh data. That era is ending! Compute keeps growing exponentially, but high-quality tokens don't. So what'...

来源:Dongxi 东锡 NLP· x.com