数码影音频道 频道

国产大模型都选了同一家AI Infra,无问芯穹Agentic Infra浮出水面

“AI摘要”

2026年7月20日,无问芯穹在WAIC论坛上发布“前店后厂一中心”的Agentic Infra战略,获MiniMax、阶跃星辰、Kimi、智谱等四家国产头部基模公司深度合作。该平台被比作“大模型时代的宁德时代”,旨在解决日均Token调用量突破140万亿而算力扩产线性的供需缺口。其准入测试确保模型效果与原厂API无差别,跨集群异构PD分离架构使首Token延迟降低51.5%、成本降低37.5%,智能运维系统提升人效5倍。战略以算力集散中心(37000P算力、16种芯片)为底座,Token工厂(MaaS平台)和AI生产力商店覆盖多行业,形成算力、Token、生产力的闭环,日均Token调用量较去年12月增长40倍。

2026年7月20日,在WAIC论坛上,无问芯穹揭示了其"前店后厂一中心"的Agentic Infra战略全景。引人注目的是,MiniMax和阶跃星辰同时出现在无问芯穹的论坛现场——前者参加战略合作签约,后者发表主旨演讲。加上此前已公开合作的Kimi和智谱,四家国产头部基模公司先后与无问芯穹达成深度合作。这个被业内比作"大模型时代的宁德时代"的AI Infra平台,正在成为大模型厂商的共同选择。

为什么头部模型厂都点了头

Token经济全面爆发以来,中国日均Token调用量已突破140万亿,推理需求呈指数增长,但物理算力的扩产逻辑仍是线性的,缺口在三五年内都填不平。无问芯穹切入的正是这道供需裂缝。在模型效果层面,公司制定了一套准入测试标准,从工具调用一致性到推理模式精度对齐逐项核验,确保客户走无问芯穹或原厂API体验几乎没有差别。在成本层面,其自研的跨集群异构PD分离架构通过首创PDD三级链路,使首Token延迟降低51.5%的同时,单Token成本降低37.5%。在稳定性层面,"智算集群运维智能体系统"实现7×24小时全天候值守,运维人效提升5倍以上,关键故障处理效率提升6倍。

前店后厂一中心:算力、Token、生产力的闭环

无问芯穹的战略以"一中心"(算力集散中心)为底座,已部署触达37000P算力,覆盖接入16种主流芯片,实现跨域强化学习训练连续一周0中断稳定运行。"后厂"(Token工厂)作为日均Token调用量较去年12月涨了40倍的MaaS平台,从网关、路由到底层推理实例构成完整服务技术栈。"前店"(AI生产力商店)则已覆盖文娱游戏、医疗健康、法律终端、能源电力等多个行业,与VAST做3D游戏方案、帮瑞金医院探索医疗大模型落地、为律所打造AI合伙人产品。三块拼在一起,各行业经验反哺后厂推理策略和一中心调度,形成互相促进的飞轮。截至7月,无问芯穹Agentic MaaS平台的日均Token调用量较去年12月涨了40倍。

0
相关文章