DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

来源：来看直播吧 2025-01-28 16:47:35

1月28日讯据钱江晚报报道，此次DeepSeek-V3在AI行业引发关注，关键的原因在于——超低的预训练成本。

“预训练”是AI大模型学习中的一种方法，指的是通过海量的数据，训练一个大模型。训练时需要大量的数据和算力支持，每次迭代可能耗资数百万至数亿美元。

官方技术论文披露，DeepSeek-V3在预训练阶段仅使用2048块GPU训练了2个月，且只花费557.6万美元。这个费用是什么概念？

据报道，GPT-4o的模型训练成本约为1亿美元。简单粗暴地说，这相当于DeepSeek-V3比同等性能的AI大模型，降了十几倍的成本。

早在2024年5月，深度求索发布DeepSeek-V2时，就曾因给模型的定价太过于便宜，开启了中国大模型的价格战，被称之为“AI界的拼多多”。

undefined

“相比于说它是‘拼多多’，它更像小米，贴近成本定价，并且自产自销。”马千里认为，训练成本比较低的原因，离不开深度求索团队自研的架构和算力，他们自身的算力储备可以与大厂比肩，并且更注重底层的模型。

“ChatGPT走的是大参数、大算力、大投入的路子，DeepSeek-V3的路径用了更多的巧思，依托数据与算法层面的优化创新，从而高效利用算力，实现较好的模型效果。”马千里说道。

相关阅读

只送大的！OMG中野迷失送大龙Saber佐伊核弹爆破UP赢首局

主持十月分享与Viper联动视频：积分榜第一太有实力辣

UP拿下涅槃组首场胜利，OMG目前0胜2负小场四连败位列倒数第一

Gumayusi致敬翻山致命白给！GIDEON赵信勇猛无解BRO扳平比分

炸鱼和鱼打的有来有回老T1两哥们频繁开送HLE艰难赢下首局

虽远必诛！Xiaohao皇子毁天灭地Angel三杀收尾EDG赢首局

育碧仍考虑进一步出售资产：多款大作将受影响！

即将推出Ai胸针！苹果首款AI穿戴设备最早或明年发布

赛后采访UP.Saber：目标是进骑士之路

Vampire分享出道礼物返图：出道两周年了非常感谢大家的支持

热门标签

热门录像

查看全部>

01月22日NBA常规赛雷霆雄鹿全场录像

01月21日NBA常规赛湖人掘金全场录像

01月21日NBA常规赛猛龙勇士全场录像

01月20日NBA常规赛步行者76人全场录像

01月20日G联赛常规赛孟菲斯疾行混音全场录像

01月20日NBA常规赛爵士马刺全场录像

01月19日NBA常规赛开拓者国王全场录像

01月18日NBA常规赛湖人开拓者全场录像

01月18日NBA常规赛森林狼马刺全场录像

01月17日WCBA常规赛北京女篮四川女篮全场录像

DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

相关阅读

热门标签

热门新闻