GPTProto

Pretraining progress is mostly coming from data

Dwarkesh Patel:Podcast & Blog(RSS)·Sep 9, 2026, 12:10 AM·Research Papers

Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。