个人随笔 好看的todo页面,为什么救不了你的执行力? 漂亮的界面会让人脑补功能。一个只能记todo的静态页面刷屏,恰恰暴露了效率工具的错觉:记录不等于执行。本文结合作者自建系统的踩坑经历,论证个人工作站的核心是输出结论与优先级建议,而非信息陈列。 产品老高 AgenttodoWorkBuddy
AI,个人随笔 OpenAI开放Codex Harness,Agent产品需要重新设计权限 当AI Agent开始执行真实操作,批准按钮便成为产品设计的关键节点。OpenAI发布Codex Harness,将任务循环与权限控制开放给开发者。本文从Harness视角解析批准请求如何作为运行状态,以及沙箱与批准策略如何共同决定Agent的行动边界。 JC AgentAI产品Codex
AI 从目标到可靠交付:复杂 Agent 的执行、反馈、协作与记忆体系 当Agent被要求完成“读取售后数据、分析问题、生成报告、审批后发送邮件”这类复杂任务时,单一Prompt往往力不从心。本文深入拆解固定工作流、自主规划、多Agent协作、反馈机制与Memory等核心概念,揭示如何通过流程控制与人工审批构建可靠、可控的智能体系统。 Grace AgentHITL反馈机制
AI Agent 能改文件以后,产品经理要补一张执行责任表 DeepSeek Harness 的发布让 Agent 从回答问题走向真实操作,但产品经理真正该关注的是:用户如何知道 Agent 做了什么、为何能做、出问题谁负责?本文拆解 Harness 的执行链路、权限预设与审批设计,为 Agent 产品的责任边界与交互体验提供清晰思路。 AiHanLab AgentAI应用DeepSeek
AI,个人随笔 从22个工具到一次可靠调用:Function Calling、内置工具与 MCP 完整解析 当Agent需要查询数据、生成文件或发送邮件时,大模型并不能直接执行操作,而是依赖应用、Function Calling与工具服务的协同。本文通过统一案例,对比内置工具与MCP两种实现方式,深入解析MCP在工具复用、接口适配与维护成本上的核心优势,并指出其适用边界。 Grace AgentFunction CallingMCP
AI,个人随笔 AI Chat 结束了,今年所有 AI 产品一定要做 Agent Cherry Studio v2 重构后,从 Chat 转向 Agent 产品,重写底层数据与任务体系。本文深入分析 AI 产品价值单位从回答变为结果,Chat 架构的局限,以及为何所有 AI 产品都必须拥抱 Agent 形态,值得每位产品人关注。 AI陆小凤 AgentAI产品Cherry Studio
AI Pi说模型可以更换: AI产品真正该留下的,是Harness吗? Pi 将 Harness 定义为系统提示词、工具、Agent 循环与翻译层的组合,它决定模型如何行动、如何反馈、如何切换。本文从四层定义出发,结合 DeepSeek Harness 与 Codex 的实测对比,探讨 AI 产品真正该积累的,是模型依赖还是执行环境。 清晨ai white AgentAI产品harness
个人随笔 创业2年半后,想跟你分享关于AI组织的这7点心得。 开公司两年半,全员AI化后,公司却变得更“传统”?本文分享了一家小公司如何通过“薄中台、厚一线”的结构,让业务人员用Agent解决实际问题,并强调数据沉淀与治理的重要性。AI没有让团队变成机器,反而让人类回归到真诚交流的本质。 数字生命卡兹克 AgentAI应用创业公司
产品经理 从城乡规划到 AI 产品经理:我重新理解了“规划”这件事 从城乡规划到AI产品经理,看似跨界,实则底层思维相通。本文作者以亲身经历,剖析规划师与产品经理在问题诊断、多目标决策和不确定性应对上的共通之处,并探讨AI时代产品设计从功能到智能系统的转变,为转型者提供独特视角。 木林森f AgentAI产品产品思维
AI,个人随笔 你的Agent耗费词元大,并不是因为模型单价贵 Agent账单居高不下,换便宜模型却只省四分之一?单价差15倍,账单却只降4.5倍。问题不在模型价格,而在任务结构:重复计费、冗长上下文、重试成本才是大头。本文拆解八步任务成本算法,教你从任务设计入手,真正省钱。 兔主任发现 Agent任务设计成本优化
职场攻略 AI产品经理面试时,现场设计 Agent 怎么答 面试官让你现场设计一个 Agent,别急着画架构图。真正的考点在于你是否能判断需求是否适合用 Agent、如何设计决策与执行层、如何规划上线风险,以及上线后如何用指标和 trace 持续优化。本文拆解四段面试应答框架,附场景示例与话术,助你从容应对。 肥源 Agent系统设计经验总结
AI,个人随笔 Agent 评测不能只看回答对不对:从路由、RAG 到工具调用,怎么搭一套上线前评测体系? Agent 评测不能只看最终回复,真正的风险藏在路由、检索、工具调用等中间环节。本文拆解七层评测体系,从输入到轨迹,教你如何识别高风险错误,确保系统上线安全。 葛葛 AgentRAG产品分析