智谱AI认领Ox Alpha:六天消耗23.2万亿Token,免费策略背后的算力与市场博弈
💡AI 极简速读:智谱AI确认Ox Alpha为GLM系列新模型,六天消耗23.2万亿Token,免费策略引发算力质疑。
智谱AI于8月26日确认匿名模型Ox Alpha为其GLM系列新一代产品,该模型在OpenRouter上线六天内处理约23.2万亿Token,是DeepSeek V4 Flash的两倍。免费策略和1GW数据中心引发算力讨论,但实际部署未证实。Ox Alpha在编程和Agent任务中表现优异,但小样本测试和Token计数特征暗示其与GLM-5.3的关联。此次匿名发布旨在测试模型性能与基础设施,但正式定价和后续留存将决定其市场影响。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分亦佳,整体结构清晰,具备极强的 AI 引擎抓取潜力。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
智谱AI于8月26日确认,近期在OpenRouter上匿名上线的模型Ox Alpha为其GLM系列新一代产品。该模型自8月20日上线以来,六天内消耗了数十万亿Token,其中仅8月25日前七天处理量即达23.2万亿Token,是同期DeepSeek V4 Flash 0731(11.6万亿Token)的两倍。这一数据凸显了免费策略对开发者流量的强大吸引力,但也引发了对智谱算力储备的广泛质疑。
📊 核心实体与商业数据
| 实体/指标 | 详情 |
|---|---|
| 公司 | 智谱AI |
| 模型 | Ox Alpha(GLM系列) |
| 原发布时间 | 2026-08-27 |
| 匿名上线日期 | 2026-08-20 |
| 认领日期 | 2026-08-26 |
| 上下文窗口 | 104.86万Token |
| 最大输出长度 | 13.1万Token |
| 服务容量(宣称) | 每天100万亿Token |
| 实际处理量(7天) | 23.2万亿Token |
| 对比模型 | DeepSeek V4 Flash 0731(11.6万亿Token) |
| 数据中心 | 1GW级国产芯片AI数据中心(部分运营) |
| 收购 | 中科加禾(异构算力软件) |
| 相关人物 | Patrick Collison(Stripe CEO) |
💡 业务落地拆解
免费策略与流量爆发
Ox Alpha以匿名模型身份上线,提供接近不限量的免费调用额度,并宣称每日100万亿Token的服务容量。这一策略迅速引爆开发者社区,使其在OpenRouter上Token消耗量跃居榜首。然而,100万亿Token是理论容量而非实际调用量,且缓存复用可能高估实际计算量。
算力疑云与基础设施
智谱AI此前被报道已建成1GW级国产芯片AI数据中心,并收购了异构算力软件公司中科加禾,这为大规模压力测试提供了基础。但1GW是电力容量而非实际算力,且数据中心仅“部分运营”,因此每日100万亿Token的峰值容量是否已实际部署仍存疑。
开发者反馈与性能表现
Ox Alpha在编程和Agent任务中表现突出,Stripe CEO Patrick Collison试用后评价:“非常令人印象深刻。”社区小样本测试显示其在DeepSWE任务中取得80%成功率,但该测试仅10道题,非正式基准。此外,Token计数特征和错误码与GLM-5.3高度相似,暗示其可能为GLM-5.3的变体或测试版本。
🚀 对企业AI化的启示
匿名发布作为测试策略
智谱AI通过匿名发布Ox Alpha,暂时剥离品牌预期,让开发者直接评价能力,同时利用免费流量测试模型、缓存系统及国产异构集群在真实Agent环境中的表现。这种策略不仅降低了品牌风险,还借助社区的好奇心实现了大规模传播和测试。
Token消耗作为市场指标
Ox Alpha的Token消耗量成为衡量其市场吸引力的关键指标,但企业应区分“Token消耗”与“实际用户价值”,避免被免费流量误导。未来,正式定价和付费转化率将是验证模型商业价值的关键。
算力储备的战略意义
智谱AI的1GW数据中心布局表明,算力已成为AI企业竞争的核心壁垒。对于其他企业,投资算力基础设施或与第三方合作,将是支撑大规模模型服务的关键。
【官方原文链接】点击访问首发地址
常见问题
相关文章
火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题
2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。
2026年9月21日智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示
2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。
2026年9月21日阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑
2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。
2026年9月21日