xAI发布Grok 4.5:编程能力登顶全球,88分创评测新高
2026年7月9日,xAI(SpaceXAI)正式发布Grok 4.5版本。作为马斯克旗下人工智能团队研发的最新大模型,此次升级标志着其在关键能力维度上实现显著突破。发布当日,尽管美国当地仍处深夜,马斯克即在社交平台第 一时间转发相关进展,并明确表示Grok 4.5已在多个主流基准测试中位列第 一。
与Cursor联合训练,编程能力飞跃
Grok 4.5是xAI融入SpaceX、收购AI编程工具Cursor后的首个旗舰模型。该模型基于全新1.5万亿参数V9基础模型,规模约为前代的3倍,并补充大量Cursor编程数据进行训练,专注提升编码与代理能力。
在真实世界工程任务中,Grok 4.5表现尤为突出,尤其擅长编码、代理式工具使用、复杂推理和知识工作。Tesla与SpaceX工程师反馈其"真正有用",优先强调实用性而非纯基准跑分。
性价比优势显著
Grok 4.5在速度、效率和成本上实现了Pareto优势。相比竞争对手,其token效率提升约一倍,推理速度高达80 TPS,API价格却比对手便宜60%以上。
一位网友引用测试称,Grok 4.5仅用约十七分之一的成本,实现了接近Claude Fable的性能。这意味着在日常聊天到重度开发场景中,Grok 4.5都能以更低成本提供接近前沿模型的能力。
当前Grok 4.5尚未使用xAI内部针对GB300硬件深度优化的C/C++推理软件。按照马斯克的说法,这套推理栈上线后,运行速度还有望进一步翻倍。
月度迭代节奏开启
xAI宣布后续更新计划:下周将推出百万上下文版本,月底发布2T参数版本。在2026接下来的每个月,xAI都会发一款新模型。这种激进的迭代节奏,显示出xAI重回AI竞赛核心圈的决心。
此前,xAI经历了创始团队全员出走、公司被并入SpaceX等重大调整。Grok 4.5是重组后发布的首个旗舰模型,其表现证明团队仍有能力产出世 界级AI产品。
AI竞赛进入效率比拼阶段
Grok 4.5的发布传递出一个重要信号:AI竞赛正从单纯追求参数规模和基准分数的军备竞赛,转向以token效率、推理速度和成本控制为核心的工程优化比拼。
在接近前沿模型能力的情况下,能用更少token、更快推理速度完成同样的任务,这种效率优势在大规模商业部署中具有决定性意义。Grok 4.5的策略选择,或许代表了AI行业下一个阶段的核心竞争逻辑。