数码影音频道 频道

DeepSeek V4正式版或延至8月中旬,国内大模型竞速格局生变

“AI摘要”

DeepSeek即将启动Harness工具封闭测试,V4正式版发布可能推迟至8月10日至20日。同时,公司已口头通知部分投资者暂停第二轮融资协议签署。过去两个月,DeepSeek经历了密集里程碑:4月发布V4 Preview,6月完成首轮约510亿元融资,但随后API涨价、V4延期及融资暂停。若V4推迟至8月中旬,将面临GPT-6、Kimi K3等更强竞争,其V4-Pro排名已滑落。国内腾讯、智谱等对手也在加速布局。国际市场关注升温,高盛认为中国AI公司可能转向收费模式,马斯克和黄仁勋均对中国AI前景表示乐观。

据报道,DeepSeek即将为自研Harness工具启动封闭测试,封闭测试结束后约1至2周才会开放V4 GA(正式版),这意味着DeepSeek V4正式版发布时间可能推迟至8月10日至20日之间。与此同时,据第 一财经报道,DeepSeek已口头通知部分潜在投资者暂停签署第二轮融资协议。从模型到融资,DeepSeek似乎摁下了"暂停键"。

回顾过去两个月,DeepSeek经历了密集的里程碑。4月24日,DeepSeek-V4 Preview正式发布,推出双模型V4-Pro(总参1.6T MoE、激活49B)和V4-Flash(总参284B、激活13B),全系原生支持100万token超长上下文,并首发深度适配华为昇腾系列芯片。4月26日紧急开启V4-Pro限时2.5折优惠并多次延期,5月22日将折扣价锁定为原价的四分之一。

6月16日,DeepSeek完成首轮外部融资约510亿元人民币,投后估值接近4000亿元,出资方包括创始人梁文锋(200亿)、腾讯(100亿)、宁德时代(50亿)以及京东、网易、IDG(各30亿)等。但6月29日API重新涨价后,7月21日即传出V4正式版延期消息,目标调整至7月底前后,而7月26日彭博报道第二轮融资谈判已临时暂停。此前第二轮融资计划拟募集至少100亿元,目标投前估值超4800亿元。

DeepSeek V4若推迟至8月中旬发布,届时将面临更激烈的竞争格局。GPT-6、Claude Fable 5.1、GLM-5.5等下一代模型可能已进入市场,而当前全局参数规模最大的Kimi K3(2.8万亿参数)已于7月28日凌晨正式开放模型权重。在AA排名等评测榜单上,Kimi K3已呈遥遥领先之势,GLM-5.2也不落下风,而DeepSeek-V4 Pro已滑落至第25位,甚至低于Kimi-K2.7 Code。

国内其他大模型玩家同样动作频频。腾讯方面,姚顺雨上任第201天后,混元Hy3于7月6日正式发布(MoE架构、总参295B、激活21B、256K上下文),7月23日腾讯宣布将大语言模型部与多模态模型部合并组建"基础模型部",由姚顺雨统一负责,标志着腾讯正式加入国产大模型竞速赛。智谱方面,6月17日上线开源GLM-5.2主攻"长程任务",在Code Arena评测中取得全球可用模型第 一,7月底已证实完成对国产AI异构算力软件公司中科加禾的收购,并落地1GW级国产AI算力数据中心。

国际市场对中国AI大模型的关注度持续升温。高盛亚洲互联网研究主管Ronald Keung判断,中国AI公司未来可能不再完全免费开放模型权重,而是向云平台和大型API服务商收取商业许可费。马斯克在《经济学人》访谈中表示,未来某个时刻中国极有可能成为AI领导者。黄仁勋则强调Kimi K3等中国开源模型"非常出色",优秀的开源大模型对整个行业大有裨益,技术将扩散到更多行业并带来巨大增长。

0
相关文章