数码影音频道 频道

DeepSeek V4 Pro正式版上线:1.6万亿参数MoE架构,多项测评超越Fable 5

“AI摘要”

DeepSeek V4 Pro正式版于8月12日上线,基于MoE架构,总参数1.6万亿,每token激活490亿参数,支持100万token上下文和38.4万token输出。性能上,多项测评超越海外旗舰模型,如Terminal Bench 2.1得分87.9。API定价为输入3元/百万tokens,输出6元/百万tokens,缓存命中输入仅0.025元。模型权重保持MIT许可,开发者可无缝升级。同日,阿里Qwen3.8-Max开源及Grok 4.6发布,大模型竞争转向性能、成本与生态综合较量。

8月12日深夜,DeepSeek V4 Pro正式版正式上线,主要通过API开放使用。官网API文档显示,"deepseek-v4-pro"模型版本已更新为DeepSeek-V4-Pro-0813,开发者无需修改现有模型名称即可自动切换至最新版本。

就在同一天,阿里Qwen3.8-Max宣布正式开源,SpaceX旗下AI团队也推出了Grok 4.6,大模型之争的节奏明显加快。这场竞争已从单一的参数比拼,转向性能、成本、商业化与应用生态的综合较量,DeepSeek V4 Pro的正式上线正是这一趋势下的关键落子。

核心架构:1.6万亿参数MoE模型

DeepSeek V4 Pro是一款基于混合专家(MoE)架构的大模型,总参数量高达1.6万亿,而在实际推理中每个token仅需激活490亿参数,在保证强大性能的同时显著优化了计算效率。模型支持100万token的上下文窗口,并可输出最长38.4万token的内容,足以处理超长文本任务。

在交互模式上,V4 Pro提供"思考模式"与"非思考模式"两种选项,其中思考模式为默认设置,便于应对复杂推理场景。模型还全面支持JSON结构化输出、Tool Calls、Responses API与Anthropic API等高级功能,面向Agent与Coding场景做了针对性优化。

性能表现:多项测评超越海外旗舰

据官方披露的测评数据,V4 Pro相比预览版能力大幅提升,多项测试成绩接近甚至超越海外顶级模型Claude Fable 5,与Opus 4.8相比也毫不逊色。以Terminal Bench 2.1测试为例,V4 Pro得分87.9,远超预览版的72.1。

关键参数速览:

  • 架构:混合专家(MoE)

  • 总参数量:1.6万亿

  • 激活参数:每token 490亿

  • 上下文窗口:100万token

  • 最大输出:38.4万token

  • 交互模式:思考模式 / 非思考模式

图:DeepSeek V4 Pro模型标识展示

价格与生态:API价格公布,权重保持MIT许可

此前官方已预告"计划近期整体上调DeepSeek API服务价格,预计涨幅较大",此次V4 Pro定价为V4 Flash版本的3倍。具体来看,输入(缓存未命中)价格为3元/百万tokens,输出价格为6元/百万tokens,而缓存命中的输入价格仅为0.025元/百万tokens,大幅降低重复调用场景下的使用成本。

本次更新对开发者相当友好:继续调用deepseek-v4-pro即可自动使用最新版本,实现无缝升级。此外,模型权重仍采用MIT许可证,正式版权重有望随后续版本发布。

从参数竞争到应用生态竞争,DeepSeek V4 Pro的正式上线进一步拉高了开源大模型的性能上限。随着思考模式、Agent能力与超长上下文等能力的组合落地,其在编程、智能体等场景的实用价值值得持续关注。

0
相关文章