}

DeepSeek终于不只是会“聊天”了!

今晚,DeepSeek正式发布首款智能体(Agent)产品DeepSeek Harness,并同步开启开发者预览版公测。

这意味着,那个曾经只会陪你聊天、回答问题的AI,现在能真正自己动手干活了。

从“只动嘴”到“可以动手”

如果把大模型比作一个聪明的大脑,那以前的DeepSeek就像一个“顾问”。你说问题,它给出建议,但具体操作还得你自己来。而Harness就是给这个大脑装上了“手”和“脚”,让它能自己去改代码、查资料、运行测试,甚至完成一整套复杂任务,直到把活干完交给你。

举个简单例子,你告诉它“帮我修复这个GitHub(软件项目托管平台)仓库里的Bug,并提交测试报告”,Harness会自己拉代码、定位问题、修改、运行测试,最后把结果反馈给你,全程不需要你操心。

事实上,官方给出的公式就已经很明确了:模型(大脑)+Harness(身体)=智能体(Agent)。项目管理、长任务协作、多智能体编排、上下文管理、联网搜索、调用外部技能……这些本地智能体工作台该有的功能,DeepSeek Harness全部都有。

像搭积木一样定制AI

DeepSeek Harness还有一个非常独特的设计理念:一切皆插件无论是底层的模型、调用的工具,还是数据存储和交互界面,所有模块都可以自由替换和重组。


这意味着开发者不用被绑死在某一套方案上,你可以用DeepSeek自己的模型,也可以接入Kimi、OpenAI、谷歌等近数十家厂商的大模型;内置了“极简模式”应付日常问答,“代码模式”处理批量搜索和自动化任务;想怎么组合,全凭需求。

这种灵活性让Harness不像一个封闭的产品,更像一个AI能力的乐高工具箱。

由于此前DeepSeek Harness处于保密内测阶段,外界一直只能靠猜测。今晚正式公开后,内测用户纷纷冒了出来。一位参与内测的网友在海外社交平台上感叹:“内测2天之后,我愿称DeepSeek Harness为宇宙最强。”

国内开发者社区也炸开了锅。有用户直言“就在等这个harness,终于来了,狂喜”,也有用户表示“初步给到夯,可能将直接冲击现有的AI编程工具市场”,还有用户将它和DeepSeek的鲸鱼logo联系起来,调侃称“现在终于是完整体鲸鱼侠了”。

团队负责人毕业自浙大

面对海内外开发者和网友们的热情,项目负责人崔添翼显得格外冷静。晚上9点多,他发了条微博:“DeepSeek Harness已经以MIT协议开源发布。目前的版本还很不完善,请大家多提提意见。”


这位浙大计算机学院毕业的工程师,曾在全球顶级量化机构Jane Street工作9年,专攻高难度系统工程。在校学习期间,他6次获得ACM国际大学生程序设计竞赛亚洲分区赛金牌,撰写的《背包九讲》在竞赛圈流传。

今年3月,崔添翼加入DeepSeek。两个月后,Harness在内部正式立项。当时,DeepSeek资深研究员陈德里在X平台上发布了两个岗位:Agent Harness产品经理、Agent Harness研发工程师,工作地点是北京海淀。岗位描述里,还列了一连串竞品名字:Claude Code、Codex、Cursor, GitHub Copilot、Manus、OpenClaw……这在技术圈引发了不少讨论。

此后几个月,崔添翼在社交平台上一边感慨“每天都在面试,到处贴小广告招人”,一边表示:如无专门说明则无硬性学历门槛,高中生也可申请实习,欢迎跨界人才加入。

“最强搭档”一起上线

在DeepSeek Harness亮相之前,DeepSeek V4 Pro正式版模型已率先发布,并同步在App、网页端和API全线更新上线。用户可在App或网页端选择“专家模式”,直接体验全新的V4 Pro正式版模型。

你可以把它理解为Harness的“最强搭档”,一个性能更彪悍的大脑。

相比之前的版本,V4 Pro的核心参数相当能打:拥有100万tokens的超长上下文,能一次性处理《三体》三部曲体量的内容;在衡量AI能否像软件工程师一样持续工作的DeepSWE基准上,得分从预览版的12.8暴涨至62.7。在自动化任务和网络安全攻防两项专项测试中,V4 Pro甚至超越了Anthropic此前备受关注的Claude Fable 5模型。

价格方面,V4 Pro约为V4 Flash的三倍(输入3元/百万tokens,输出6元/百万tokens)。这份底气,来自实打实的性能跨越。

橙柿互动·都市快报 记 者 童蔚

编辑 郭智杰

审核 罗祎 陈欣文

校对 陈震海

BREAK AWAY