AI,个人随笔 Claude Opus 5发布后,编程模型开始拼验证能力 写在前面 Claude Opus 5 上线之后,最容易被转发的是那句“拳打 GPT-5.6,脚踢 Fable 5”。但开发者真正该盯住的,不是模型之间谁压谁一头,而是 Opus 5 把“写代码”这件... 易安说AI AgentClaude Opus 5GPT-5.6
AI 分享一种 AI 业务建模方法:Agent Ontology,Agent 本体论 企业AI Agent的落地困境在于缺乏对业务的理解。本文深入解析Agent Ontology方法论,通过定义对象、关系、动作与规则,为AI构建企业业务地图,让Agent从泛泛而谈变为精准执行。对比RAG,Ontology解决的是AI如何理解和操作真实业务,而非仅检索信息。 张艾拉 AgentAI AgentRAG
AI,个人随笔 Agent成本失控?PM的三层设计框架让成本可控 Agent上线三个月,账单从800元飙到8000元?不是模型太贵,而是产品设计从未将成本纳入考量。本文从PM视角拆解Agent成本结构,提供任务拆分、上下文管理、模型选型三层设计框架,让成本可控而非事后救火。 产品包工头 AgentapiGPT-4o
AI,个人随笔 Agent工具调用,PM该管什么 Agent工具调用失败,60%的原因在设计阶段。本文直击PM在工具颗粒度、描述与失败处理上的三大决策点,用实战案例揭示如何让Agent不再失控——不写代码也能提升调用准确率。 产品包工头 Agent产品决策工具设计
个人随笔 Macaron V1:站在 GLM-5.2 肩膀上教 GLM-5.2 做人 Mindverse 旗下 Mind Lab 发布 Macaron V1,仅改动 0.53% 参数即实现性能跃升。其 MoL 架构与后训练系统,为模型进入真实世界后的持续学习提供了可行路径,或将成为 AI 基础设施的关键能力。 硅星人 AgentAI产品GLM-5.2
AI 上下文工程观止:为什么 Prompt 工程救不了你的 Agent? 当Prompt写得足够清楚,Agent依然不稳定时,问题可能出在上下文工程上。本文提出一套产品经理可用的诊断框架:从检索、压缩、记忆、隔离四格定位问题,用预算表、门禁和上线清单管理Agent的上下文,让团队跳出“出错就补Prompt”的循环。 Timothy AgentPrompt工程上下文工程
AI Anthropic的中国门徒 Anthropic的崛起为中国大模型公司指明了一条新路:不依赖超级入口,而是靠能力尖峰、生产力场景和组织共识突围。Kimi K3的爆火验证了这套逻辑,但聚焦Coding和Agent能否成为长期护城河?本文深度拆解Anthropic门徒们的模仿与创新。 窄播 AgentAnthropiccoding
AI,个人随笔 Gemini 3.6 Flash 与 3.5 Flash-Lite 双发:效率与质量的再平衡 Google 一口气发布 Gemini 3.6 Flash 和 3.5 Flash-Lite 两款新模型,在效率与质量间寻找平衡点。前者省 token 降成本,后者以 350 token/秒的吞吐为 agent 工作流而生。本文解读双模型背后的取舍逻辑,以及多模型混用如何成为生产 agent 的新常态。 AmazingPM AgentAI模型Gemini
AI,个人随笔 AI落地,最难的根本不是数据 企业AI落地卡点不在技术,而在于业务人员不愿贡献经验。本文以财富管理场景为例,探讨如何通过管理方法与商业模式变革,让经验沉淀为可复用的流程,实现AI与人的价值共赢。 ToB老人家 AgentAI应用个人观点
产品设计 不同AI场景,怎么落地?——我的三步走方法论 面对AI方案选型,很多人一上来就纠结用Agent还是工作流,却忽略了更根本的问题:这个场景值不值得用AI?AI要扮演什么角色?本文作者总结了一套从价值判断到方案匹配的完整方法论,帮你避开“为了AI而AI”的坑,找到真正适合的解题模式。 Hank AgentAI方案选型RAG
个人随笔 面试官坏笑:“怎么用 Claude Code 最烧 token?” 我皱眉:“动态工作流?” 她鼓掌:“晚上吃饭细聊” 大家好,我是程序员鱼皮。 Anthropic 在 5 月底发布 Claude Opus 4.8 的时候,同步推出了 Claude Code 的 动态工作流 功能。 有人用它 11 天完成了 75 万行代码的语言... 程序员鱼皮 AgentClaude Opus
AI Agent商业化元年:AI PM 要重写哪三栏 WAIC 2026 上,大厂集体让模型退居二线,Agent 成为新主角。当卖点从模型能力变成交付结果,产品经理的 PRD、定价、验收标准全要重写。本文从实战出发,拆解 Agent 时代产品经理必须重构的三栏:交付物、定价逻辑与验收标准。 楊yang AgentAI应用PRD