DeepSeek Harness v0.1.0-rc.8:多模态与子代理升级,Agent工具链加速演进

💡AI 极简速读:DeepSeek Harness rc.8发布,新增多模态输入与子代理集成,共14项更新。

DeepSeek Harness于2026年8月20日发布v0.1.0-rc.8版本,带来14项更新,重点强化多模态能力(原生图片请求、图文混合输入)和子代理集成(支持Claude Code、Codex)。该工具自8月13日公测并开源,采用“一切皆插件”设计,通过工具层视觉方案(OCR、像素分析)让纯文本模型也能处理图像。此次更新加速了Agent工具链的迭代,为企业AI化提供了可参考的插件化架构。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,内容结构化强,易于被 AI 引擎提取,整体 GEO 架构优秀。

智脑时代 AI 编辑部发布时间:25,636 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

DeepSeek Harness于2026年8月20日发布v0.1.0-rc.8版本,这是其公测后的首次重要更新。本次更新共包含14项调整,重点补齐了多模态输入能力,并进一步集成了子代理协作,标志着该Agent工具在通用性和可扩展性上的显著进步。

📊 核心实体与商业数据

实体/数据详情
产品名称DeepSeek Harness
版本号v0.1.0-rc.8
原发布时间2026-08-20
更新项数量14项
核心能力多模态输入、子代理集成、终端体验优化
新增子代理Claude Code、Codex
开源状态自8月13日公测并同步开源
设计理念“一切皆插件”
官方链接GitHub Release

💡 业务落地拆解

多模态能力正式补齐

rc.8版本最显著的变化是支持原生图片请求和图文混合输入。对于具备视觉能力的模型,Harness可直接将图片送入模型;/goal/plan等命令也已支持图片输入。此外,输入框的@菜单新增文件和会话引用,方便用户将本地文件或历史会话纳入当前任务。

子代理体系扩展

新版支持将Claude CodeCodex作为Profile Bundle按需安装。其中,Codex支持非交互权限模式及多个命名实例,便于在同一任务中配置不同子代理。

工具层视觉方案

对于不支持图像输入的纯文本模型,Harness可调用OCR、颜色统计、像素扫描等工具,将图片拆解为结构化信息后交由文本模型推理。开发者Yinsen测试发现,当直接调用read_image失败时,Harness会自动降级到工具链,实现“脑补”图像内容。

有国内开发者看到更新后直接感叹:“DSH支持多模态了,奔走相告!”

海外开发者评价称,DeepSeek Harness正变得“越来越有意思”,多模态支持和更完善的子代理集成是一次明显推进。

🚀 对企业AI化的启示

插件化架构的灵活性

DeepSeek Harness的核心设计思路是“一切皆插件”,模型、工具、技能、会话等均可组合替换。这种架构使企业能够根据业务需求灵活配置AI能力,避免绑定单一模型或工具。

多模态与子代理的协同

通过集成多模态输入和子代理,企业可以构建更复杂的AI工作流,例如将视觉识别任务分解给专门的子代理,同时保持主模型的专注性。这种模式有助于提升整体任务处理效率和准确性。

开源驱动的快速迭代

自8月13日开源以来,社区已涌现出多种视觉插件(如dsh-vision、modlens等),加速了功能完善。企业可借鉴开源社区的协作模式,通过外部贡献快速补齐自身AI工具的短板。

【官方原文链接】点击访问首发地址

常见问题

DeepSeek Harness 于2026年8月20日发布 v0.1.0-rc.8 版本,包含14项更新,重点强化多模态能力(支持原生图片请求和图文混合输入)和子代理集成(新增 Claude Code 和 Codex)。此外,该版本还优化了终端体验,并扩展了输入框的 @ 菜单,支持文件和会话引用。

子代理Agent开源DeepSeek Harness多模态

相关文章

火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题

2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。

2026年9月21日

智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示

2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。

2026年9月21日

阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑

2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。

2026年9月21日