我一行代码没写,DeepSeek Harness 自己组队给我造了个错题本插件
假期里试了一个新玩法:需求说出来,插件自己长进软件里。作者拿「错题本」当试验品——拍照导入、自动切题归档、讲解错因并出同类题,从梳理需求到写代码全程旁观。它中途抓出过需求里自相矛盾的地方,也翻过车。

现在用 AI 写代码,已经不算什么新鲜事了。
但大多数时候,我们是让它在自己的项目里写代码,写完了,代码还是我们的项目。
国庆这几天我试了 DeepSeek Harness,玩法有点不一样:你让它做的东西,最后会直接长进它自己的软件里。
它节前刚出了桌面版,这两天我基本都泡在里面。
一开始我也是先看官方演示。官方拿来展示「创造模式」的例子是一个番茄钟:你说一句需求,它自己写个插件,直接出现在软件里。
看完我心里有点痒。番茄钟能做,那更复杂的呢?一个真有人每天在用、环节又多的东西,它能不能做出来?
我想到的是错题本。
孩子错了题,大多数家长当场讲一遍,过几天同类题照样错。传统错题本要手抄,很少有人能坚持下来。
所以我给它提了个需求:家长拍照导入,自动切题归档;点开错题,AI 讲错因、出同类题。

接下来这一路,从梳理需求、画原型到写代码,我基本就是看着它干活。中间它停下来反问过我好几次,有一次还抓出了我需求里自相矛盾的地方。它也翻过车,插件第一次装进去,点开就是一行红字。
需求文档、原型、几千行代码、几十项测试,基本都是它写的。
ㅤ但用下来,我反而越来越确定一件事:以后做软件,最值钱的可能不再是会写代码。
写代码很多时候是在把事情做对,定需求是在决定做什么事。前者有标准答案,AI 越来越擅长;后者没有标准答案,得有人拍板。
先看看最后做出来的效果,再讲它是怎么一步步做出来的。
ㅤ
Harness 和别的 Agent 有什么不一样
这次桌面版是 v0.2 预览版,macOS 和 Windows 都有,登录 DeepSeek 账号就能用。

它最特别的地方是一个设计思路:一切皆插件。工具、技能、界面,连左侧边栏的每个入口,都是插件拼出来的。别的 Agent 像一套装修好的房子,你最多换换家具;Harness 更像毛坯房加一套标准水电接口,房间怎么隔你说了算。
另外交代一下,Harness 支持自定义模型,我手上有 Kimi 的年套餐,所以这次全程用的是 Kimi K3,截图右下角看到不用奇怪。
三条提示词,只说它猜不到的
整个过程拆成三步:梳理需求、设计原型、开发插件,每步一条提示词。

第一步的提示词我本来写得特别细,PRD 的章节、优先级、验收标准全列好了,写完又删了大半。骨架都替它搭好了,它写得再漂亮,也只能说明我会写 PRD。所以我只留了它猜不到的东西:核心差异、目标用户、使用场景、硬约束。
我想在 Harness 里开发一个「错题本工作台」插件,出现在左侧边栏。
它和传统错题本不一样:家长把孩子的错题拍照导入,自动识别切分并按知识点归档;看任意一道错题时,右侧有 AI 讲解错因、生成同类练习题;还能把一段时间的错题组成复习卷打印出来。
用户是小学到初中学生的家长,不一定懂技术,通常是晚上辅导作业时用。数据只存在本地。
你先帮我梳理需求,有不确定的地方先问我,确认后输出一份需求文档,后面的原型设计和开发都以它为准。
最后那句“有不确定的地方先问我”,后来证明是最值钱的一句。
第一步:它先抓住了我需求里的矛盾
它没急着写文档,先摸了一遍 Harness 插件体系能提供什么,然后弹出 6 个问题。
第一个就把我问住了。

它说,你要求“数据只存在本地”,可识别和讲解都得调大模型,照片在推理那一刻会发到模型服务商那边,这条边界怎么定?
我写提示词时完全没意识到,“只存本地”和“调云端模型”放在一起就是自相矛盾。我选了“仅推理时上传”,错题本的价值全压在识别和讲解的质量上,手写体加拍歪的照片,本地小模型扛不住。
科目我选了数学和英语,并要求学科做成可配置的。只做数学,它大概率会把学科写死;加一门性质完全不同的英语,能逼它把结构设计得可扩展。

23 分钟后,需求文档 v1.0 出来了。

文档很扎实,但我挑出三个问题。家长是用手机拍作业的,它却默认“照片先传到电脑”,我要求加上手机扫码直传;它说只上传题目内容,可整页拍照再由 AI 切题,孩子姓名、学校也会跟着发出去;“已掌握”状态得允许家长手动改。

5 分钟后全部改完,还改得很实在,比如把“局域网能不能访问 Harness”列为开发前必须先验证的风险。
有个细节我印象很深。它顺手出的原型设计里,AI 辅导栏没用 Harness 自带的右侧栏,而是做在详情页里。原因是它核查发现,右侧栏是跟着会话走的,不适合一个独立的工作台。
这个判断,不是照着文档逐条执行能得出来的。
第二步:20 分钟,原型全出来了
需求文档 v1.1 没问题。请基于 requirements.md 和 prototype.md,把原型做成可点击的 HTML 静态原型。
要求覆盖需求文档里的所有页面,页面之间能跳转,用贴近真实的示例数据。风格和 Harness 现有界面保持一致。如果做的过程中需要调整 prototype.md 里的设计,同步更新文档。
完成后对照需求文档自检一遍,告诉我有没有遗漏的页面,以及设计过程中发现的需求不清楚的地方。
它动手前先去取了 Harness 真实的主题配色,然后拆了 7 个任务,连我担心会漏掉的手机上传页都单独列了出来。

大约 20 分钟,所有页面交付。示例错题是用 SVG 画的手写体照片,还带老师的红笔批改,挺像那么回事。

第三步:它给自己组了个开发团队
基于需求文档和原型,完成错题本工作台插件的开发,最终出现在 Harness 左侧边栏并能正常使用。
你作为技术负责人,合理安排团队分工,高效完成这个任务。开工前先给我看技术方案和任务拆分,确认后再开发。
先跑通主链路(拍照导入 → 识别入库 → 查看 AI 讲解),再完善其他功能。界面以原型为准,如果开发中需要改动,先说明原因。
完成后给我一份交付报告:需求完成情况、测试结果和已知问题。
它先做技术调研,翻了 Harness 的安装包找官方插件的写法,得出一个关键结论:用动态方式定义的插件,重启就没了,不适合家长长期用,要打包成本地插件装进去。
然后任务列表出来了。

T0 先验证安装和接口通路,T1 把接口契约写成文档冻结,然后后端交给 subagent A、前端交给 subagent B,两条线并行,最后联调主链路。

我只写了一句“合理安排团队分工”,它给出的答案是两个 subagent 加一份冻结的接口契约。前后端能严丝合缝接上,靠的就是先把接口定死,很多真实团队都栽在这一步。
T0 需要我配合,刷新 Harness 看侧边栏。

错题本出现在侧边栏了。点进去,一行红字:API 请求失败。
一半成功,一半翻车。
我把报错发回去,它查日志、加埋点,7 分钟后让我再刷新,通了。

中途我回答问题时,它原来那轮执行被打断了,我一度担心排好的任务白费。结果 Harness 有个“进行中的目标”,我一回复它就自动续上,上下文一点没丢。
我用一张测试卷走了一遍。选好照片,AI 自动找出了 2 道题,在原图上用蓝框标出位置,题目、孩子的答案、考点都识别好了,我只需要核对。漏了题可以自己在照片上框,两道其实是一道的,也能一键合并。

收好之后点开一道错题,右边点「讲错因」。

讲解分成四块:这题考什么、容易错在哪、正确思路、给家长的话。最后这块我挺喜欢,它不只讲题,还会告诉家长下次怎么陪孩子检查。
测试卷毕竟是打印体,我又拍了一张真实的英语作业。手写体歪歪扭扭,还有老师的红笔批改。它照样认出了孩子把 Finally 和 But 填反了,切到「出同类题」,出的也是同类型的语篇填空。孩子写完可以让 AI 判,也可以家长自己点对错,连续两轮全对,这道题会自动标成「已掌握」。

这些识图、讲解、出题的能力,插件自己一个模型都没配,用的就是 Harness 里已经接好的 Kimi K3。插件管功能,模型由宿主统一提供,这也是“一切皆插件”的好处。
最后我去插件管理页看了一眼。错题本安安静静地躺在“已安装”里,和官方插件排在一起。

有意思的是,往上翻,给我组团队开发的“智能体团队”“子智能体”,本身也是官方插件。帮我造插件的,和被造出来的,在 Harness 里是同一种东西。
写在最后
做完这一趟,我印象最深的不是它写了多少代码,而是第一步里的一个小细节。
它能自己去翻 Harness 的插件机制,能发现我需求里“只存本地”和“调云端模型”的矛盾,却默认家长会把照片先传到电脑上。
可现实里,哪个家长不是拿手机拍作业?
这件事挺有代表性。AI 越来越擅长把事情做对,但用的人是谁、在什么场景下用,它常常想当然。
Harness 的“一切皆插件”,让我看到了另一种可能。以后很多小工具,不用等哪家公司来做,你把需求说清楚,它就能长进你自己的软件里。家长要个错题本,做自媒体的要个选题库,都可以自己造一个。
门槛降下来之后,拼的就是谁更清楚自己要什么。
国庆假期还长,如果你手上也有一个一直想要、但市面上没人做的小工具,不妨装上 Harness,试着把需求讲给它听。
讲不清楚也没关系,它会问你的。
如果觉得不错,随手点个「赞」和「在看」,转发给需要的朋友吧~ 第一时间收到推送,记得给我个星标⭐
作者:林月半子的AI笔记 公众号:林月半子的AI笔记
本文由 @林月半子的AI笔记 原创发布于人人都是产品经理。未经作者许可,禁止转载
题图来自 Unsplash,基于CC0协议
- 目前还没评论,等你发挥!

起点课堂会员权益




