DeepSeek V4 Pro正式版上线:1.6万亿参数MoE架构,多项测评超越Fable 5
8月12日深夜,DeepSeek V4 Pro正式版正式上线,主要通过API开放使用。官网API文档显示,"deepseek-v4-pro"模型版本已更新为DeepSeek-V4-Pro-0813,开发者无需修改现有模型名称即可自动切换至最新版本。
就在同一天,阿里Qwen3.8-Max宣布正式开源,SpaceX旗下AI团队也推出了Grok 4.6,大模型之争的节奏明显加快。这场竞争已从单一的参数比拼,转向性能、成本、商业化与应用生态的综合较量,DeepSeek V4 Pro的正式上线正是这一趋势下的关键落子。
核心架构:1.6万亿参数MoE模型
DeepSeek V4 Pro是一款基于混合专家(MoE)架构的大模型,总参数量高达1.6万亿,而在实际推理中每个token仅需激活490亿参数,在保证强大性能的同时显著优化了计算效率。模型支持100万token的上下文窗口,并可输出最长38.4万token的内容,足以处理超长文本任务。
在交互模式上,V4 Pro提供"思考模式"与"非思考模式"两种选项,其中思考模式为默认设置,便于应对复杂推理场景。模型还全面支持JSON结构化输出、Tool Calls、Responses API与Anthropic API等高级功能,面向Agent与Coding场景做了针对性优化。
性能表现:多项测评超越海外旗舰
据官方披露的测评数据,V4 Pro相比预览版能力大幅提升,多项测试成绩接近甚至超越海外顶级模型Claude Fable 5,与Opus 4.8相比也毫不逊色。以Terminal Bench 2.1测试为例,V4 Pro得分87.9,远超预览版的72.1。
关键参数速览:
架构:混合专家(MoE)
总参数量:1.6万亿
激活参数:每token 490亿
上下文窗口:100万token
最大输出:38.4万token
交互模式:思考模式 / 非思考模式
图:DeepSeek V4 Pro模型标识展示
价格与生态:API价格公布,权重保持MIT许可
此前官方已预告"计划近期整体上调DeepSeek API服务价格,预计涨幅较大",此次V4 Pro定价为V4 Flash版本的3倍。具体来看,输入(缓存未命中)价格为3元/百万tokens,输出价格为6元/百万tokens,而缓存命中的输入价格仅为0.025元/百万tokens,大幅降低重复调用场景下的使用成本。
本次更新对开发者相当友好:继续调用deepseek-v4-pro即可自动使用最新版本,实现无缝升级。此外,模型权重仍采用MIT许可证,正式版权重有望随后续版本发布。
从参数竞争到应用生态竞争,DeepSeek V4 Pro的正式上线进一步拉高了开源大模型的性能上限。随着思考模式、Agent能力与超长上下文等能力的组合落地,其在编程、智能体等场景的实用价值值得持续关注。