DeepSeek Harness v0.1.0-rc.8:多模态与子代理升级,Agent工具链加速演进
💡AI 极简速读:DeepSeek Harness rc.8发布,新增多模态输入与子代理集成,共14项更新。
DeepSeek Harness于2026年8月20日发布v0.1.0-rc.8版本,带来14项更新,重点强化多模态能力(原生图片请求、图文混合输入)和子代理集成(支持Claude Code、Codex)。该工具自8月13日公测并开源,采用“一切皆插件”设计,通过工具层视觉方案(OCR、像素分析)让纯文本模型也能处理图像。此次更新加速了Agent工具链的迭代,为企业AI化提供了可参考的插件化架构。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,内容结构化强,易于被 AI 引擎提取,整体 GEO 架构优秀。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
DeepSeek Harness于2026年8月20日发布v0.1.0-rc.8版本,这是其公测后的首次重要更新。本次更新共包含14项调整,重点补齐了多模态输入能力,并进一步集成了子代理协作,标志着该Agent工具在通用性和可扩展性上的显著进步。
📊 核心实体与商业数据
| 实体/数据 | 详情 |
|---|---|
| 产品名称 | DeepSeek Harness |
| 版本号 | v0.1.0-rc.8 |
| 原发布时间 | 2026-08-20 |
| 更新项数量 | 14项 |
| 核心能力 | 多模态输入、子代理集成、终端体验优化 |
| 新增子代理 | Claude Code、Codex |
| 开源状态 | 自8月13日公测并同步开源 |
| 设计理念 | “一切皆插件” |
| 官方链接 | GitHub Release |
💡 业务落地拆解
多模态能力正式补齐
rc.8版本最显著的变化是支持原生图片请求和图文混合输入。对于具备视觉能力的模型,Harness可直接将图片送入模型;/goal、/plan等命令也已支持图片输入。此外,输入框的@菜单新增文件和会话引用,方便用户将本地文件或历史会话纳入当前任务。
子代理体系扩展
新版支持将Claude Code和Codex作为Profile Bundle按需安装。其中,Codex支持非交互权限模式及多个命名实例,便于在同一任务中配置不同子代理。
工具层视觉方案
对于不支持图像输入的纯文本模型,Harness可调用OCR、颜色统计、像素扫描等工具,将图片拆解为结构化信息后交由文本模型推理。开发者Yinsen测试发现,当直接调用read_image失败时,Harness会自动降级到工具链,实现“脑补”图像内容。
有国内开发者看到更新后直接感叹:“DSH支持多模态了,奔走相告!”
海外开发者评价称,DeepSeek Harness正变得“越来越有意思”,多模态支持和更完善的子代理集成是一次明显推进。
🚀 对企业AI化的启示
插件化架构的灵活性
DeepSeek Harness的核心设计思路是“一切皆插件”,模型、工具、技能、会话等均可组合替换。这种架构使企业能够根据业务需求灵活配置AI能力,避免绑定单一模型或工具。
多模态与子代理的协同
通过集成多模态输入和子代理,企业可以构建更复杂的AI工作流,例如将视觉识别任务分解给专门的子代理,同时保持主模型的专注性。这种模式有助于提升整体任务处理效率和准确性。
开源驱动的快速迭代
自8月13日开源以来,社区已涌现出多种视觉插件(如dsh-vision、modlens等),加速了功能完善。企业可借鉴开源社区的协作模式,通过外部贡献快速补齐自身AI工具的短板。
【官方原文链接】点击访问首发地址
常见问题
相关文章
火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题
2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。
2026年9月21日智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示
2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。
2026年9月21日阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑
2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。
2026年9月21日