DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

来源：JRS直播吧 2025-01-28 16:47:46

1月28日讯据钱江晚报报道，此次DeepSeek-V3在AI行业引发关注，关键的原因在于——超低的预训练成本。

“预训练”是AI大模型学习中的一种方法，指的是通过海量的数据，训练一个大模型。训练时需要大量的数据和算力支持，每次迭代可能耗资数百万至数亿美元。

官方技术论文披露，DeepSeek-V3在预训练阶段仅使用2048块GPU训练了2个月，且只花费557.6万美元。这个费用是什么概念？

据报道，GPT-4o的模型训练成本约为1亿美元。简单粗暴地说，这相当于DeepSeek-V3比同等性能的AI大模型，降了十几倍的成本。

早在2024年5月，深度求索发布DeepSeek-V2时，就曾因给模型的定价太过于便宜，开启了中国大模型的价格战，被称之为“AI界的拼多多”。

undefined

“相比于说它是‘拼多多’，它更像小米，贴近成本定价，并且自产自销。”马千里认为，训练成本比较低的原因，离不开深度求索团队自研的架构和算力，他们自身的算力储备可以与大厂比肩，并且更注重底层的模型。

“ChatGPT走的是大参数、大算力、大投入的路子，DeepSeek-V3的路径用了更多的巧思，依托数据与算法层面的优化创新，从而高效利用算力，实现较好的模型效果。”马千里说道。

相关阅读

S15世界赛海外收视峰值前五名：T1目前五场比赛占据热度前五

FNC官宣：19年MSI冠军、S赛亚军辅助选手Mikyx离队

TES蓝色方！明日首发名单：BLG打野shad0wJKL对ELK伟大渺小争八强

ON赛后采访：印象比较深刻的前三辅助是Keria、Ming和BeryL

Elk：对自己的表现不满意，队伍状态没达到100%

不觉得你强！VKS.Trymbi：BLG在优势下并不是非常有统治力

余霜晒照：瑞士轮第八天，忙碌的一天结束啦！！北京真的很冷啊！

外媒统计：S15全球总决赛队伍场均击杀榜前四均为LCK队伍

决赛被BLG经理嘲讽AL经理看瑞士轮TES交手BLG：哎手心手背都是肉

你也想打T1！Elk：对自己的表现不满意，队伍状态没达到100%

热门标签

热门录像

查看全部>

10月25日NBA常规赛勇士开拓者全场录像

10月25日NBA常规赛爵士国王全场录像

10月25日NBA常规赛骑士篮网全场录像

10月24日NBA常规赛雷霆步行者全场录像

10月23日NBA常规赛国王太阳全场录像

10月23日NBA常规赛篮网黄蜂全场录像

10月22日NBA常规赛揭幕战勇士湖人全场录像

10月18日女篮锦标赛三四名决赛山东女篮武汉女篮全场录像

10月18日NBA季前赛国王湖人全场录像

10月18日NBA季前赛篮网猛龙全场录像

DeepSeek被称为AI界拼多多，训练2个月仅花费了557.6万美元！

相关阅读

热门标签

热门新闻