DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

来源：来球网2025-01-28 16:47:28

1月28日讯据钱江晚报报道，此次DeepSeek-V3在AI行业引发关注，关键的原因在于——超低的预训练成本。

“预训练”是AI大模型学习中的一种方法，指的是通过海量的数据，训练一个大模型。训练时需要大量的数据和算力支持，每次迭代可能耗资数百万至数亿美元。

官方技术论文披露，DeepSeek-V3在预训练阶段仅使用2048块GPU训练了2个月，且只花费557.6万美元。这个费用是什么概念？

据报道，GPT-4o的模型训练成本约为1亿美元。简单粗暴地说，这相当于DeepSeek-V3比同等性能的AI大模型，降了十几倍的成本。

早在2024年5月，深度求索发布DeepSeek-V2时，就曾因给模型的定价太过于便宜，开启了中国大模型的价格战，被称之为“AI界的拼多多”。

undefined

“相比于说它是‘拼多多’，它更像小米，贴近成本定价，并且自产自销。”马千里认为，训练成本比较低的原因，离不开深度求索团队自研的架构和算力，他们自身的算力储备可以与大厂比肩，并且更注重底层的模型。

“ChatGPT走的是大参数、大算力、大投入的路子，DeepSeek-V3的路径用了更多的巧思，依托数据与算法层面的优化创新，从而高效利用算力，实现较好的模型效果。”马千里说道。

声明：本站文章版权归原作者及原出处所有，并不代表本站赞同其观点及真实性，如有侵权，请联系删除。

大家都在看

甲亢哥回国后首次直播，给中国打9分，并表示卤鹅大叔几周后会去美国

时隔2211天，IG再次丝血翻盘！iG凭借606点水晶血量翻盘击败JDG

媒体人锐评JDG新教练上场：JDG刚换了教练，这场压力给到上路Ale了

S14冠亚军的羁绊！目前T1和BLG在联赛内的战绩胜负场均为大场3-3、小局8-7

JKL使用女枪击败赵信，以00:43比赛时间刷新本赛季最快一血时间纪录

Oner：相赫哥皮肤最好看，然后是韦鲁斯&纳尔，再是蔚和派克

LPL第二赛段第三周最佳选手：TES.Kanavi

PYL：喷我选人下届GODV打还是选imp，酒囊饭袋下届场馆都进不去

24小时热文

甲亢哥回国后首次直播，给中国打9分，并表示卤鹅大叔几周后会去美国

时隔2211天，IG再次丝血翻盘！iG凭借606点水晶血量翻盘击败JDG

媒体人锐评JDG新教练上场：JDG刚换了教练，这场压力给到上路Ale了

S14冠亚军的羁绊！目前T1和BLG在联赛内的战绩胜负场均为大场3-3、小局8-7

甲亢哥回国后首次直播，给中国打9分，并表示卤鹅大叔几周后会去美国

0 阅读

时隔2211天，IG再次丝血翻盘！iG凭借606点水晶血量翻盘击败JDG

0 阅读

媒体人锐评JDG新教练上场：JDG刚换了教练，这场压力给到上路Ale了

0 阅读

S14冠亚军的羁绊！目前T1和BLG在联赛内的战绩胜负场均为大场3-3、小局8-7

0 阅读

JKL使用女枪击败赵信，以00:43比赛时间刷新本赛季最快一血时间纪录

0 阅读