新闻

昨夜,DeepSeek Harness首发新版本:14项更新,多模态能力拉满!

1 分钟阅读
来源:zhidx.com
智东西 作者 | 江宇 编辑 | 李水青 智东西8月20日报道,昨夜,DeepSeek Harness迎来公测后的首次重要更新。 DeepSeek Harness v0.1.0-rc.8版本上线 , 多模态 能力成为这次更新的重头戏。 此次更新共带来 14项 调整,覆盖多模态输入、子代理协作、终端体验、工具调用和开发者支持等多个方向,既补齐了Agent处理图片等多模态任务的能力,也进一步完善了子代理协作、终端交互和工具调用体验。 新版支持原生图片请求和图文混合输入 ,/goal、/plan等命令也可以直接接收图片;与此同时, Claude Code、Codex进一步接入其子代理体系 , Windows终端体验 以及图片请求、流式生成、自定义网关等一批问题也得到修复。 DeepSeek Harness于8月13日正式开启v0.1版本公测并同步开源。 公测当晚,智东西曾第一时间拉取源码进行实测,用它完成88页论文翻译、贪吃蛇游戏开发等任务。 仅过去不到一周,这套Agent Harness又把多模态补上了。这次更新很快引起了DeepSeek Harness社区讨论。 有国内开发者看到更新后直接感叹:“DSH支持多模态了,奔走相告!” 海外开发者同样把注意力放在这两项能力上。有网友评价称,DeepSeek Harness正变得“越来越有意思”,多模态支持和更完善的子代理集成是一次明显推进。 更有意思的是,有开发者进一步扒出了DeepSeek Harness的“看图”方式:面对本身不支持图像输入的模型,它还能 调用OCR、颜色统计、像素扫描 等工具,把图片拆成结构化信息后再交给文本模型推