GPT-6 Astra发布:OpenAI押注Agent与Computer Use,B端商业化加速

💡AI 极简速读:GPT-6 Astra发布,API定价为Claude Fable 5.1的2.5倍,主打Agent与Computer Use能力。

OpenAI发布GPT-6 Astra,主打Agent与Computer Use能力,API定价为每百万Token输入10美元、输出50美元,是GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1持平。模型在长任务和电脑操作上进步显著,但综合跑分与上代持平。OpenAI面临Anthropic在B端市场的竞争压力,正加速商业化转型。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分、结构化规范性 92 分表现突出,内容硬核且排版清晰,AI 引擎可高效提取核心商业情报。

智脑时代 AI 编辑部发布时间:30,031 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(95分)及结构化规范性(92分)上表现优异,数据表格与分层标题极大提升AI抓取效率;关键词覆盖全面,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

OpenAI于2026年9月3日正式发布GPT-6 Astra,这是继GPT-5.6 Sol之后的新一代旗舰模型。此次发布不仅展示了模型在Agent能力和Computer Use(电脑操作)上的显著提升,更标志着OpenAI在B端商业化战略上的关键一步。API定价大幅上调,与主要竞争对手Anthropic的旗舰模型Claude Fable 5.1持平,凸显了其瞄准高端企业市场的意图。

📊 核心实体与商业数据

实体/指标具体数据/信息
原发布时间2026-09-05
模型名称GPT-6 Astra
开发商OpenAI
API定价每百万Token输入10美元、输出50美元(为GPT-5.6 Sol的2.5倍
主要竞品Anthropic Claude Fable 5.1(定价持平)
核心能力提升Computer Use(电脑操作)、长任务执行、Agent能力
关键跑分ARC-AGI-3:99.9%;ExploitBench:100%;FrontierMath Tier 4 v2:97.6%
第三方综合评分Artificial Analysis智能指数:61分(与GPT-5.6 Sol持平,排名第5)
Agent任务测试Terminal-Bench Science 0.1:从22.4% 提升至64.6%(接近3倍)
Computer Use测试ScreenSpot-Pro:从76.9% 提升至92.7%;OSWorld 2.0:72.6%(耗时减少近一半)
企业收入占比2026年4月披露超过40%;7月企业收入首次超过消费者收入
企业客户数量超过200万(一年前两倍)
OpenAI财务数据2026年Q2收入67亿美元,环比增长18%,经营亏损123亿美元
Anthropic财务数据2026年Q2收入115亿美元,环比增长超100%,实现小幅运营盈利
年化收入(run rate)Anthropic:650亿美元;OpenAI:400亿美元(统计方式有差异)
CEO/总裁语录Greg Brockman:“欢迎来到AGI时代”

💡 业务落地拆解

1. 模型能力升级:聚焦Agent与Computer Use

GPT-6 Astra的显著进步集中在Agent能力上,包括操作电脑、调用工具、连续执行步骤以及处理更长任务。官方跑分显示,在科研工作流测试Terminal-Bench Science 0.1中,得分从GPT-5.6 Sol的22.4% 提升至64.6%,接近三倍。在电脑操作测试ScreenSpot-Pro中,得分从76.9% 提升至92.7%,表明模型能更准确地理解界面并执行操作。

第三方综合测试(Artificial Analysis)显示,GPT-6 Astra最高推理档得分61分,与上一代持平,排名第5,低于Claude Fable 5.1的66分。这说明其进步并非全面,而是集中在特定能力上。

2. Computer Use与Judgment:降低Agent使用门槛

GPT-6 Astra引入了两项关键能力:Computer Use(直接操作电脑界面)和Judgment(判断何时自主决策)。Computer Use允许模型在没有API或MCP接口的情况下,通过截图理解界面并模拟点击、输入等操作,从而覆盖更多软件场景。Judgment则让模型自主处理不影响方向的小问题,仅在关键决策时询问用户,从而降低监督成本。

大模型研究员姚宇航指出:“未来Agent层会越来越薄。看屏幕、调用常见工具这些通用能力,会不断沉进基础模型。但垂直Agent仍可依靠领域知识保留更高附加价值。”

3. 商业化战略:B端市场成为主战场

OpenAI正面临来自Anthropic的激烈竞争。Anthropic在AI Coding和Agent商业化上布局更早,其季度收入已首次超过OpenAI。OpenAI企业业务收入占比已超过40%,企业客户数量超过200万。GPT-6 Astra的API定价与Claude Fable 5.1持平,表明OpenAI正试图在高端市场与Anthropic正面竞争。

🚀 对企业AI化的启示

1. Agent能力将重塑企业工作流

GPT-6 Astra展示的Agent能力,尤其是Computer Use,意味着企业可以将更多复杂任务(如软件操作、跨系统流程)交由AI自动完成,减少对人工的依赖。企业应评估现有工作流中哪些环节可被Agent化,以提升效率。

2. 成本与价值的权衡

GPT-6 Astra的API定价为上一代的2.5倍,但能力提升并非全面。企业在采用时需根据具体场景评估投入产出比。对于需要长任务处理或复杂软件操作的场景,高成本可能物有所值;对于简单问答,旧模型可能更经济。

3. 关注模型选择的多元化

当前市场由OpenAI、Anthropic、Google等主导,各模型优势不同。企业应避免锁定单一供应商,而是根据任务需求选择最合适的模型。例如,Anthropic的Claude在综合评分上仍领先,而OpenAI在特定Agent任务上表现突出。

【官方原文链接】点击访问首发地址

常见问题

GPT-6 Astra的API定价为每百万Token输入10美元、输出50美元,是上一代GPT-5.6 Sol的2.5倍,与Anthropic Claude Fable 5.1的定价持平。这一价格定位表明OpenAI正瞄准高端企业市场,与Anthropic在B端展开正面竞争。

Computer UseAgentAnthropicOpenAIGPT-6 Astra

相关文章

火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题

2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。

2026年9月21日

智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示

2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。

2026年9月21日

阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑

2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。

2026年9月21日