豆包工作,一款符合中国宝宝体质的 AI 工具

0 评论 185 浏览 0 收藏 22 分钟

字节豆包工作杀入办公 Agent 战场,低价策略能否撬动中国用户的付费意愿?本文从产品视角深度实测,拆解其侧边工作台、飞书生态联动与 Skill 机制,并与竞品对比,揭示办公 Agent 如何从黑盒执行走向白盒可控,以及大厂生态壁垒下的真实竞争力。

字节八月底发了豆包工作,一个面向办公场景的 Agent 产品。这段时间讨论不少,但多数是通稿式的功能介绍。我自己用了一段时间,又把它近期的深度实测和这些年对 Agent 产品的理解捋了一遍,包括科技媒体智东西的四十八小时体验、36 氪的三强对比,写点产品视角的东西,不吹不黑。

过去几个月,大厂内部原本分散的办公 Agent 正在收拢。七月二十号,腾讯把 QClaw 部分业务和团队调整到 WorkBuddy 所在的云产品六部;七月底,字节把飞书产品团队与豆包产品团队整合;到了八月,产品端开始集中。八月三号,阿里推出由 QoderWork、MuleRun、悟空整合而来的千问办公并开启公测;八月二十五号,字节发布豆包工作。此前跑在前面的 WorkBuddy,则在七月完成了 iOS、Android 和鸿蒙移动端三端同步上线。

看得出来,办公 Agent 这条赛道已经从各家零散试水变成了大厂级别的正面战场。三家背后各自绑着一套企业生态:字节有飞书,腾讯有企业微信和腾讯文档,阿里有钉钉和阿里云。模型能力的领先可能几个月就被追平,但企业内部的数据、权限、业务系统和已经形成的工作流,没那么容易复制。

我自己体验下来的第一印象是,豆包工作确实是一款很符合中国市场的产品。国外的 Agent 能力很强,不管是 ChatGPT 的 Codex 还是 Claude Code,coding 和任务执行都很能打,但它们更多面向深度使用者。对于大部分人来讲,想试试 Agent,但使用频率不高,也不需要深度定制,更不想为低频需求花太多钱。这个中间区域其实一直缺一款合适的产品。而且使用外网的 AI 门槛不小,翻墙、充值、绑卡,每一步都在劝退普通用户。豆包工作正好卡在了这个位置上:想用 Agent,频率不高,预算有限,甚至是学生群体,它都能接住。

中国用户整体付费意愿弱,这是事实。所以一款产品如果定价高了,大部分人直接劝退;定价低了,又容易让人觉得能力不行。豆包工作走的是低价但不缩水的路线,标准套餐连续包月六十八元,办公任务、专家模式等功能额度为免费版五倍以上;加强套餐两百元,额度翻四倍;最高阶五百元,额度翻十倍。基础版完全免费,下载登录还能领三十天订阅。这个价格对学生和轻度用户非常友好,关键是能力居然没有很烂,甚至还挺好。这种定价策略本身就是对中国市场的精准拿捏。

豆包工作的定位很明确,就是把活干完:围绕你的目标拆解任务、调用工具、一步步推进,最后交付文档、表格、PPT、网页这类能直接用的东西。它和豆包普通模式的区别在于,普通模式更像一个聪明的问答助手,你问一句它答一句;工作任务模式则是一个能自己规划、自己执行、自己交付的 Agent,你给一个目标,它自己拆步骤、调技能、跑流程,中间遇到需要确认的地方才找你。

我重点体验了它的 coding 能力。说实话,已经能跟 Cursor、Tree 这类专门的 AIDE 工具大差不差了。写代码、改 bug、跑项目,基本的开发需求都能覆盖,而且它不只是写代码,还能统筹调用不同模型,生成图文并茂的网页。科技媒体智东西那次四十八小时体验里,让它做一个大理旅游规划网站,它先是根据需求调用模型生成 Banner、场景插图和美食特写等图像素材,同时输出结构化文案,最终组装为 HTML 网页,还调用视频模型生成视频嵌入网页首屏做动态背景,大概五分钟完成整个网页开发。对前端开发者来说,这种从素材到页面一条龙的能力,比单纯写代码更省时间。而我的下一篇文章会专门出一次coding网页的评测。

个人场景这块,实测数据挺能说明问题。让它对 AI 办公行业做深度研究,它自己读内置的行研 Skill、定研究框架,最后交了一份约二点五万字的飞书文档,四十七条引用都能溯源;接着让它把内容做成 PPT,它自动选风格出了十四页,每页带判断式标题、数据表格、来源标注和演讲者备注。生成完还会自己校验一遍,排除文字溢出、乱码这类问题,基本能直接交付。

这里有个细节值得说。能交出二点五万字和四十七条可溯源引用,说明它真的去查了资料、做了交叉验证,没在凑字数。对写行业研究的人来说,最头疼的是找资料、核数据、理逻辑,写字反而最轻松。豆包工作把这部分脏活累活接过去了,你只需要在它的框架上做判断和取舍。PPT 那十四页也一样,判断式标题意味着它在给观点,这比那种每页一个名词标题、下面堆三行字的模板 PPT 强不少。

说实话,单论生成质量,现在几家头部办公 Agent 差距没想象中大。真正让我觉得有产品思考的,是它的侧边工作台。任务执行过程和产物同屏显示,你可以中途插话,也可以框选产物的某个局部,直接说这里改成流程图。这有点像 Vibe Coding:不用从头描述需求,对着已经跑起来的成品边看边改。它解决的是 Agent 产品最大的毛病:黑盒执行、错了只能从头再来。

这个设计的价值在于,Agent 执行长任务的时候,用户最焦虑的是不知道它在干嘛、会不会跑偏。侧边工作台把过程摊开给你看,你随时能插手,这就把黑盒变成了白盒。对产品经理来说,这个思路值得借鉴:AI 产品的信任感,很多时候来自过程是否可控。

组织协作是它跟飞书打通后更值得讲的部分。实测有个例子:让它统计一下群里目前的项目推进进展,它先通过企业知识检索引擎做语义解析,判断出这是个跨来源复盘任务,然后自己摸进飞书群聊、拉消息流,找出里面的项目计划文档和选题排期表链接,再把文档拉成结构化内容、把多维表格全量读出来,最后汇总出八篇报道的整体完成度百分之二十八点八,各选题进度也列得清清楚楚。你以为到这就完了?让它把统计整理成周报存到飞书,它复用刚才的数据直接生成文档;再让它催一下进度,它会根据截稿时间和负责人字段自动 @对应的人,催办消息还带着上下文。这套流程要是人来做,光翻群聊、对表格就得耗掉小半天。

讲这个案例的关键在于它读懂了组织上下文。通用 Agent 在企业里不好用,原因很简单:它不知道你公司的项目叫什么、文档存在哪、谁负责什么、截止日期是哪天。这些信息散落在群聊、文档、多维表格里,人能找到是因为人在组织里待久了,Agent 要找到就得有接入权限和检索能力。

我自己感受最深的是它跟飞书的生态联动。豆包工作可以直接调取飞书平台上所有开放的文档,而飞书文档里有大量精品内容,行业报告、产品分析、方法论沉淀,质量都很高。这意味着豆包工作的知识来源不只是互联网公开信息,还有飞书生态里沉淀的高质量企业知识。再加上飞书本身是目前市面上我个人感觉最好的办公软件,文档、表格、多维表格、会议、群聊一体化做得很顺,豆包工作接在这套生态上,相当于站在了一个很高的起点上。这是其他 Agent 很难复制的优势。

这种能力的底子是两层。一是企业上下文,二是 Skill 机制。企业搜索、飞书文档读写这些能力被封装成标准 Skill,企业还能把高频流程沉淀成自定义 Skill,统计项目进展这种经验能变成团队共享资产,即插即用。这意味着好的工作方法可以被固化、被复用,不再只存在于某个老员工的脑子里。对团队来说,这比单个任务的效率提升更有长期价值。

它还会动手。基于视觉 GUI 和 CLI,覆盖本地电脑、云电脑、手机遥控三种形态。典型场景比如批量裁剪发布会照片:把几十张照片丢进文件夹、说清裁剪要求,它每张图重新识别屏幕、自适应裁剪,不用固定坐标硬裁。速度不算快,但完全不用人盯着,也比固定脚本灵活。长任务可以丢给云电脑跑,本机关机云端照跑;通勤路上手机发个找文件解压的指令,到公司就处理好了。

Computer Use 这个方向,产品上有个取舍值得聊。理论上操作软件最干净的方式是调 API,但现实是大量老旧后台、企业内部系统根本没有 API,或者 API 权限拿不到。视觉 GUI 交互相当于用眼睛看、用手点,充当了一个通用接口,代价是速度慢、容易出错。豆包工作选了 GUI 和 CLI 两条腿走路,能调 API 的走 API,调不了的用视觉操作,这个思路是务实的。

三强对比这块,36 氪做过一轮覆盖市场营销、内容运营、产品经理、开发四类真实任务的实测,豆包工作的优势挺清楚,赢在交付完整。

市场营销环节,竞品分析它交网页版和飞书文档两个版本,横向对比图表、时间轴做得最出彩;物料环节它主动调视频和文生图模型,视频有情节线、配了 BGM 和旁白,最像成品预告。

WorkBuddy 则先把调研过程摊开给你看,解释为什么选这三家对标,报告加了目录、附了数据来源和口径说明,胜在过程透明。千问办公交上来的网页信息量偏单薄,每个维度展开不多。

内容运营环节,豆包工作自己开浏览器搜热点、翻了五个网页源,交出一张网页版热点矩阵图加一份完整策划案,从一百三十五篇文章里筛出十八篇,还选了七篇进一步拆解,并且会把已查证的数据和估算分开标注。WorkBuddy 十一分钟就交卷了,热点按模型、资本、政策分类整理,但给出的五个选题有点泛。千问办公直接在对话框里回答,篇幅比较短。

产品经理环节,三家都做了奶茶点单小程序和数据看板加归因分析。小程序方面,WorkBuddy 六分钟交卷最快,功能丰富度最高;豆包工作用了二十分钟,功能同样完整,但审美是三家里最好的,主页 banner 会滑动切换,占位图选的都是同类饮品,塞进页面毫不违和;千问办公花了十五分钟,功能齐全但页面透着一股网页味。数据看板和归因分析方面,WorkBuddy 写得最细,直接原因和根本原因分开讲,建议按优先级排序,还主动交代了结论缺哪些数据验证、各项指标用的什么口径;豆包工作的整体分析结构和 WorkBuddy 很像,亮点在下月目标上,把每个目标为什么定这个数讲得很细,还配套给了辅助监控指标;千问办公的成品比较简单,分析偏简洁,给出下月目标后没有进一步延伸。

开发是最难糊弄的职业。先测了一个骑自行车的鹈鹕 SVG 动画,看三家能不能同时处理代码、动画和物体之间的空间关系。WorkBuddy 想法不少,给鹈鹕系了条红围巾、嘴里衔了条小鱼,角色一下子就活了,可惜细节没兜住,围巾像直接贴在脸上,小鱼隔着长喙能被看穿。豆包工作建模更自然,鹈鹕形象更美观,没有明显物理穿模,骑车速度还分了悠闲、正常、飞驰三档。千问办公这轮有点翻车,鹈鹕没握住车把,两只脚像踩在同侧踏板上,不符合物理规律。

接着上了一个更接近真实工作的需求:一个科技峰会报名网站,要能报名、能管票、管理后台带密码、还能导出名单。豆包工作的审美依旧在线,最像一个真实存在的报名网站,每种票的权益写得清清楚楚,排版是先看完活动信息再选票报名,要求基本全覆盖。WorkBuddy 走赛博霓虹的蓝紫风格,基本功能都能正常使用,但稳定性不足,有巧思但落地不稳。千问办公动用了多人工作台新功能,也采用蓝紫配色,网页支持多人同时打开报名,管理员在后台看名单做统计。这一轮豆包工作取胜。

四轮测下来,豆包工作的优势在综合完成度和多模态生成能力。它做出来的东西更像成品。WorkBuddy 胜在过程透明、方法谨慎,适合对可解释性要求高的场景。千问办公中规中矩,基础任务能完成,但复杂任务的完整度波动较大。

豆包专业版的三级阶梯定价,六十八元起步,这个价格策略有几个信号。第一,六十八元卡在了一个很微妙的位置,比一杯咖啡贵不了多少,降低了个人用户的决策门槛;第二,档位差异核心体现在额度上,没有对基础办公能力做硬性封锁,看得出来字节想先把用户量做起来,再靠重度使用和企业侧变现;第三,真正的钱在企业侧。当写方案、做 PPT、生成网页逐渐成为基础能力,更容易收费的部分会变成企业席位、专业能力、私有数据和业务系统接入,以及由此带来的模型、云和第三方工具调用。这也在挤压通用办公 Agent 创业公司的空间,继续和大厂比入口、免费额度和功能更新,成本会越来越高;法律、金融、医药等需要专业数据和复杂流程的场景,可能留下更多差异化空间。

槽点也得说清楚。一是 GUI 操作速度确实不快,批量场景比较耗时,适合那些不着急但想省人力的活。这是视觉交互的先天局限,短期内很难有质的飞跃。二是复杂任务的稳定性还没经过大规模真实业务检验,公开实测更多是亮点集锦,长链条任务中任何一步出错都可能导致整体返工,用户需要有这个心理预期。三是生成物还是要人打磨,36 氪那轮它的主视觉海报就有一处文字挤在一起,交付的是初稿级,正式用之前得修。AI 生成的东西目前更适合做初稿和草稿,最终成品还是需要人来把关。四是飞书上下文是护城河也是约束,非飞书用户能享受到的上下文优势会大打折扣,跨生态的连接器还在补,比如钉钉、企业微信这些,深度待验证。

用非常“豆包”的语气来总结下结论就是:如果你是飞书用户,或者日常被文档、PPT、周报、调研这类活占掉大量时间,值得用三十天免费期试一轮,重点试试把高频流程沉淀成自己的 Skill。如果你是开发者,想找一个平价又能打的 coding 助手,它的表现已经能跟 Cursor、Tree 这类专门工具掰掰手腕,而且不用翻墙、不用折腾充值,对国内用户太友好了。如果对自动化信任度要求很高、场景又关键,先从低风险任务入手,慢慢建立信任。

再往大了看,办公 Agent 接下来的竞争,核心在谁能接触到更多真实工作的上下文,并且获得权限把任务真正做完。模型能力会趋同,基础功能会趋同,真正的差距在工作环境里。豆包工作背靠飞书,WorkBuddy 背靠腾讯的 IM、文档、邮箱、会议和知识库,千问办公背靠钉钉、阿里云和阿里的企业客户体系,三家各有各的牌。对用户来说这是好事,竞争越激烈,产品迭代越快,免费额度越高。对创业者来说,通用赛道的窗口正在收窄,往行业深处走可能是更现实的选择。

豆包工作要真正走进企业现场,还需要时间,技能生态和企业上下文沉淀的速度会决定它能走多远。但至少,字节这次把帮你干活从口号做成了能跑通的东西。而对中国用户来说,一款不用翻墙、不用折腾充值、价格亲民、能力在线、还能接飞书生态的 Agent,本身就是一种稀缺品。说它是符合中国宝宝体质的 AI 工具,不算夸张。

本文由 @安全沼 原创发布于人人都是产品经理。未经许可,禁止转载。

题图来自作者提供,由AI生成

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
海报
评论
评论请登录
  1. 目前还没评论,等你发挥!