字节跳动5万亿参数豪赌:张一鸣拒绝蒸馏,押注大模型独立追赶
💡AI 极简速读:字节跳动讨论训练超5万亿参数大模型,张一鸣反对蒸馏,Seed面临收入压力。
字节跳动CEO梁汝波承认Seed大模型与海外领先模型差距扩大,张一鸣明确反对蒸馏竞争对手模型。公司正讨论训练超5万亿参数的大模型,由项亮主导,旨在通过大规模预训练实现独立追赶。同时,字节AI收入结构偏科,语言模型短板明显,2025年火山引擎收入约150亿元,2026年目标超400亿元,但token消耗低于预期。组织上,字节正取消赛马机制,集中资源,并邀请DeepSeek研究员郭达雅加入以补强Coding能力。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,说明内容硬核且易于被 AI 引擎提取,整体架构优秀。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
字节跳动正面临大模型战略的关键转折点。CEO梁汝波在全员会上承认Seed与海外领先模型的差距扩大,而创始人张一鸣则明确反对蒸馏竞争对手模型,并推动训练超5万亿参数的大模型。这一决策背后,是字节对独立技术能力的押注,也反映了其AI业务收入结构的压力。
📊 核心实体与商业数据
| 实体/指标 | 数据/详情 |
|---|---|
| 公司 | 字节跳动 |
| 核心人物 | 张一鸣、梁汝波、吴永辉、项亮、沈科、郭达雅 |
| 大模型 | Seed系列、豆包、Seedance、Seedream |
| 参数规模 | 讨论中超过 5万亿(对比:阿里Qwen 3.8-Max为2.4万亿,月之暗面Kimi K3为2.8万亿) |
| 收入数据 | 火山引擎2025年收入约 150亿元,2026年目标 超400亿元 |
| Token消耗 | 豆包大模型:3月 120万亿,6月 180万亿(低于目标250-300万亿) |
| 多模态占比 | 豆包token消耗中 超过一半 来自Seedance和Seedream |
| Coding收入 | 智谱ARR突破 10亿美元,月之暗面ARR突破 3亿美元 |
| 原发布时间 | 2026-08-07 |
💡 业务落地拆解
技术路线:拒绝蒸馏,押注5万亿参数
张一鸣在内部会议上明确反对蒸馏竞争对手模型,强调不依赖外部模型输出。字节正讨论训练参数超 5万亿 的大模型,由Seed Foundation负责人项亮主导,与预训练数据负责人沈科合作。该计划仍处早期,最终未必发布。
张一鸣表示:“训练大模型本就困难,团队可以接受一段时间的落后。”
组织变革:从赛马到重注
字节正取消同一方向的内部赛马,收拢研发资源,明确职责。为补强Coding能力,张一鸣邀请DeepSeek核心研究员郭达雅加入Seed,统一划归研发资源。
收入压力:语言模型短板凸显
字节AI收入偏科,多模态生成占主导,但语言模型(尤其Coding)收入贡献低。火山引擎虽是国内最大模型API卖家,但token消耗增速放缓,低于内部目标。
🚀 对企业AI化的启示
- 技术自主性优先:字节选择独立追赶,而非依赖蒸馏,虽成本高但利于长期竞争力。
- 组织适配战略:前沿大模型研发需集中资源,赛马机制不再适用,企业需调整组织架构。
- 收入结构平衡:AI业务需兼顾多模态与语言模型,避免过度依赖单一场景。
【官方原文链接】点击访问首发地址
常见问题
相关文章
火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题
2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。
2026年9月21日智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示
2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。
2026年9月21日阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑
2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。
2026年9月21日