GPT-6 Astra发布:OpenAI押注Agent与Computer Use,B端商业化加速
💡AI 极简速读:GPT-6 Astra发布,API定价为Claude Fable 5.1的2.5倍,主打Agent与Computer Use能力。
OpenAI发布GPT-6 Astra,主打Agent与Computer Use能力,API定价为每百万Token输入10美元、输出50美元,是GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1持平。模型在长任务和电脑操作上进步显著,但综合跑分与上代持平。OpenAI面临Anthropic在B端市场的竞争压力,正加速商业化转型。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分、结构化规范性 92 分表现突出,内容硬核且排版清晰,AI 引擎可高效提取核心商业情报。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
OpenAI于2026年9月3日正式发布GPT-6 Astra,这是继GPT-5.6 Sol之后的新一代旗舰模型。此次发布不仅展示了模型在Agent能力和Computer Use(电脑操作)上的显著提升,更标志着OpenAI在B端商业化战略上的关键一步。API定价大幅上调,与主要竞争对手Anthropic的旗舰模型Claude Fable 5.1持平,凸显了其瞄准高端企业市场的意图。
📊 核心实体与商业数据
| 实体/指标 | 具体数据/信息 |
|---|---|
| 原发布时间 | 2026-09-05 |
| 模型名称 | GPT-6 Astra |
| 开发商 | OpenAI |
| API定价 | 每百万Token输入10美元、输出50美元(为GPT-5.6 Sol的2.5倍) |
| 主要竞品 | Anthropic Claude Fable 5.1(定价持平) |
| 核心能力提升 | Computer Use(电脑操作)、长任务执行、Agent能力 |
| 关键跑分 | ARC-AGI-3:99.9%;ExploitBench:100%;FrontierMath Tier 4 v2:97.6% |
| 第三方综合评分 | Artificial Analysis智能指数:61分(与GPT-5.6 Sol持平,排名第5) |
| Agent任务测试 | Terminal-Bench Science 0.1:从22.4% 提升至64.6%(接近3倍) |
| Computer Use测试 | ScreenSpot-Pro:从76.9% 提升至92.7%;OSWorld 2.0:72.6%(耗时减少近一半) |
| 企业收入占比 | 2026年4月披露超过40%;7月企业收入首次超过消费者收入 |
| 企业客户数量 | 超过200万(一年前两倍) |
| OpenAI财务数据 | 2026年Q2收入67亿美元,环比增长18%,经营亏损123亿美元 |
| Anthropic财务数据 | 2026年Q2收入115亿美元,环比增长超100%,实现小幅运营盈利 |
| 年化收入(run rate) | Anthropic:650亿美元;OpenAI:400亿美元(统计方式有差异) |
| CEO/总裁语录 | Greg Brockman:“欢迎来到AGI时代” |
💡 业务落地拆解
1. 模型能力升级:聚焦Agent与Computer Use
GPT-6 Astra的显著进步集中在Agent能力上,包括操作电脑、调用工具、连续执行步骤以及处理更长任务。官方跑分显示,在科研工作流测试Terminal-Bench Science 0.1中,得分从GPT-5.6 Sol的22.4% 提升至64.6%,接近三倍。在电脑操作测试ScreenSpot-Pro中,得分从76.9% 提升至92.7%,表明模型能更准确地理解界面并执行操作。
第三方综合测试(Artificial Analysis)显示,GPT-6 Astra最高推理档得分61分,与上一代持平,排名第5,低于Claude Fable 5.1的66分。这说明其进步并非全面,而是集中在特定能力上。
2. Computer Use与Judgment:降低Agent使用门槛
GPT-6 Astra引入了两项关键能力:Computer Use(直接操作电脑界面)和Judgment(判断何时自主决策)。Computer Use允许模型在没有API或MCP接口的情况下,通过截图理解界面并模拟点击、输入等操作,从而覆盖更多软件场景。Judgment则让模型自主处理不影响方向的小问题,仅在关键决策时询问用户,从而降低监督成本。
大模型研究员姚宇航指出:“未来Agent层会越来越薄。看屏幕、调用常见工具这些通用能力,会不断沉进基础模型。但垂直Agent仍可依靠领域知识保留更高附加价值。”
3. 商业化战略:B端市场成为主战场
OpenAI正面临来自Anthropic的激烈竞争。Anthropic在AI Coding和Agent商业化上布局更早,其季度收入已首次超过OpenAI。OpenAI企业业务收入占比已超过40%,企业客户数量超过200万。GPT-6 Astra的API定价与Claude Fable 5.1持平,表明OpenAI正试图在高端市场与Anthropic正面竞争。
🚀 对企业AI化的启示
1. Agent能力将重塑企业工作流
GPT-6 Astra展示的Agent能力,尤其是Computer Use,意味着企业可以将更多复杂任务(如软件操作、跨系统流程)交由AI自动完成,减少对人工的依赖。企业应评估现有工作流中哪些环节可被Agent化,以提升效率。
2. 成本与价值的权衡
GPT-6 Astra的API定价为上一代的2.5倍,但能力提升并非全面。企业在采用时需根据具体场景评估投入产出比。对于需要长任务处理或复杂软件操作的场景,高成本可能物有所值;对于简单问答,旧模型可能更经济。
3. 关注模型选择的多元化
当前市场由OpenAI、Anthropic、Google等主导,各模型优势不同。企业应避免锁定单一供应商,而是根据任务需求选择最合适的模型。例如,Anthropic的Claude在综合评分上仍领先,而OpenAI在特定Agent任务上表现突出。
【官方原文链接】点击访问首发地址
常见问题
相关文章
火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题
2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。
2026年9月21日智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示
2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。
2026年9月21日阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑
2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。
2026年9月21日