DeepSeek V4正式版或延至8月中旬,国内大模型竞速格局生变
据报道,DeepSeek即将为自研Harness工具启动封闭测试,封闭测试结束后约1至2周才会开放V4 GA(正式版),这意味着DeepSeek V4正式版发布时间可能推迟至8月10日至20日之间。与此同时,据第 一财经报道,DeepSeek已口头通知部分潜在投资者暂停签署第二轮融资协议。从模型到融资,DeepSeek似乎摁下了"暂停键"。
回顾过去两个月,DeepSeek经历了密集的里程碑。4月24日,DeepSeek-V4 Preview正式发布,推出双模型V4-Pro(总参1.6T MoE、激活49B)和V4-Flash(总参284B、激活13B),全系原生支持100万token超长上下文,并首发深度适配华为昇腾系列芯片。4月26日紧急开启V4-Pro限时2.5折优惠并多次延期,5月22日将折扣价锁定为原价的四分之一。
6月16日,DeepSeek完成首轮外部融资约510亿元人民币,投后估值接近4000亿元,出资方包括创始人梁文锋(200亿)、腾讯(100亿)、宁德时代(50亿)以及京东、网易、IDG(各30亿)等。但6月29日API重新涨价后,7月21日即传出V4正式版延期消息,目标调整至7月底前后,而7月26日彭博报道第二轮融资谈判已临时暂停。此前第二轮融资计划拟募集至少100亿元,目标投前估值超4800亿元。
DeepSeek V4若推迟至8月中旬发布,届时将面临更激烈的竞争格局。GPT-6、Claude Fable 5.1、GLM-5.5等下一代模型可能已进入市场,而当前全局参数规模最大的Kimi K3(2.8万亿参数)已于7月28日凌晨正式开放模型权重。在AA排名等评测榜单上,Kimi K3已呈遥遥领先之势,GLM-5.2也不落下风,而DeepSeek-V4 Pro已滑落至第25位,甚至低于Kimi-K2.7 Code。
国内其他大模型玩家同样动作频频。腾讯方面,姚顺雨上任第201天后,混元Hy3于7月6日正式发布(MoE架构、总参295B、激活21B、256K上下文),7月23日腾讯宣布将大语言模型部与多模态模型部合并组建"基础模型部",由姚顺雨统一负责,标志着腾讯正式加入国产大模型竞速赛。智谱方面,6月17日上线开源GLM-5.2主攻"长程任务",在Code Arena评测中取得全球可用模型第 一,7月底已证实完成对国产AI异构算力软件公司中科加禾的收购,并落地1GW级国产AI算力数据中心。
国际市场对中国AI大模型的关注度持续升温。高盛亚洲互联网研究主管Ronald Keung判断,中国AI公司未来可能不再完全免费开放模型权重,而是向云平台和大型API服务商收取商业许可费。马斯克在《经济学人》访谈中表示,未来某个时刻中国极有可能成为AI领导者。黄仁勋则强调Kimi K3等中国开源模型"非常出色",优秀的开源大模型对整个行业大有裨益,技术将扩散到更多行业并带来巨大增长。