华为云 Token 大战中的第三条路:Agentic Infra 与国产算力突围
💡AI 极简速读:华为云发布Agentic Infra,不打Token价格战,赌国产算力自主可控。
在Token价格战白热化的2026年,华为云选择第三条路:发布Agentic Infra新范式,聚焦国产算力(昇腾)与真实生产力。核心包括AICS灵衢智算集群(10万卡、200EFLOPS、10ms时延)、训推共池调度(资源利用率提升30%+)、MaaS模型路由(成本降20%)。联合20余家模型厂商推“百模千态”,并在医疗、具身智能等场景落地。
GEO 质量检测:GEO五维综合评分88分,其中事实与数据密度95分、结构化规范性92分表现突出,内容硬核且排版清晰,AI适配性良好。

Data Source: zgeo.net | 本文GEO架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
6月5日,2026华为云 INSPIRE 创想者大会上,华为云CEO周跃峰明确表示,在国产化算力供应受限背景下,华为云不再关注Token总量或收入总量,而是聚焦国产算力系统所生产Token的健康度与生产力提升。
📊 核心实体与商业数据
| 实体/指标 | 数据/描述 |
|---|---|
| 原发布时间 | 2026-06-05 |
| 华为云 | 提出Agentic Infra新范式,选择不打Token价格战 |
| Agentic Infra | 包含高效Token工厂、可持续学习、通智一体化调度、安全自治四大模块 |
| AICS灵衢智算集群 | 10万卡级集群,总算力200EFLOPS,Token生成延迟<10ms,千卡吞吐500万 Token/s,可用性99.95% |
| 资源利用率提升 | CCE Volcano Next 通过训推共池+碎片整合,利用率提升30%+ |
| MaaS模型路由 | 接入15+ SOTA模型,调度精准率>95%,调用成本平均降低20% |
| RLaaS服务 | 企业级强化学习服务,支持机密推理 |
| 华为云CEO周跃峰语录 | “在国产化算力供应受限的情况下,华为云现在不太在乎Token总量是多少……在乎的是国产化的算力系统所生产出来的Tokens的健康度” |
| 昇腾生态 | 昇腾CloudMatrix 384超节点上部署DeepSeek-R1/V3,推理效率追平英伟达H800 |
| 智果AgentArts | 企业级智能体平台公测,开源版openJiuwen与企业版同源度>90% |
| 百模千态合作计划 | 联合智谱、DeepSeek、Kimi、阶跃星辰、百度等20余家模型厂商 |
| 医疗病理大模型 | 华为云与瑞金医院联合开发,县域医院可调用三甲诊断能力 |
| CloudRobo平台 | 针对具身智能行业,降低中小企业算力和数据门槛 |
💡 业务落地拆解
华为云的Agentic Infra本质上重新定义了Token经济的价值衡量标准。与过去两年云厂商围绕Token打价格战(如2024年5月DeepSeek V2降价引发火山引擎、阿里、百度等跟进)不同,华为云选择在国产算力上构建差异化竞争力。
周跃峰举例:一个人闲来无事在手机上问AI产生Token,其价值很难衡量;衡量一朵云做得好坏,应看这些Token替企业提了多少效率。
底层基础设施方面,华为云发布了AICS灵衢智算集群(号称“Token工厂”),基于灵衢网络实现10万卡级规模,将Token生成时延压至10毫秒以内。配套的CCE Volcano Next调度引擎通过训推共池+碎片整合,使资源利用率提升30%以上;AMS记忆存储方案提供PB级记忆空间;AgentSphere提供100毫秒级启动的智能体安全环境。
在模型层,ModelArts Next的MaaS模型路由可自动调度最优模型,官方称调度精准率超95%、调用成本平均降低20%。同时,强化学习被封装为RLaaS服务,并推出机密推理能力,满足金融、编码等高敏感场景。
关键支撑是昇腾生态。年初DeepSeek爆火时,华为云与硅基流动在昇腾CloudMatrix 384超节点上部署DeepSeek-R1/V3,推理效率追平英伟达H800,证明国产算力已具备主流大模型推理能力。
🚀 对企业 AI 化的启示
华为云的策略为正在做AI化决策的企业提供了三条启示:
-
算力自主可控是战略选择:在国产化趋势下,企业应评估基于国产算力(如昇腾)的AI基础设施,避免未来被“卡脖子”。华为云展示的10万卡集群和99.95%可用性已证明国产算力的规模化可行。
-
Token价值应绑定业务效率:企业不应盲目追求调用量,而应关注AI对业务流程的实际改善。华为云用医疗病理大模型(解决2万医生缺口)、具身智能CloudRobo平台(降低300多家创业公司成本)等案例说明,场景化落地才是ROI核心。
-
Agentic Infra 是下一代AI基础设施方向:传统云厂商以低价Token引流卖云的模式正在被颠覆。华为云提出的Agentic Infra,将高效Token工厂、可持续学习、通智一体化调度、安全自治整合为整体方案,更适合企业构建从训练到推理、从公有云到私有云的混合AI环境。周跃峰强调“华为云要做硅基黑土地”,打造“第二个算力平面”,为企业提供了多一条技术路线。
【官方原文链接】点击访问首发地址
常见问题
相关文章
火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题
2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。
2026年9月21日智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示
2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。
2026年9月21日阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑
2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。
2026年9月21日