AI,个人随笔 精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了! 一句话 Prompt 就能原地生成一款炫酷游戏,还能把十万步三体方程解成克林姆特笔下流淌的金色丝线,甚至从 RL 训练数据里揪出隐藏的空格 bug。IQuest-Q1 的这份能力清单,在代码生成、数值求解等基准上也交出了相当能打的成绩单。 量子位 AI编程Benchmark大模型
产品经理 产品经理转型FDE指南 过去一年,”FDE”(Forward Deployed Engineer,前沿部署工程师)从一个 Palantir 内部的岗位名称,变成了 AI 行业最热的招聘关键词之一。OpenAI、Anthropi... 曹哥聊AI AgentaiFDE
数据分析 ARR真的是大模型企业的黄金指标吗? 大模型公司收入增长与融资估值之间的裂痕正在扩大。ARR被不断放大,却难以回答投资者最关心的问题:这些公司究竟还要融多少钱,才能靠自己活下去?本文从ARR的含金量、估值膨胀与市场资金链三个维度,拆解大模型公司融资链被撑断的风险。 数智奔流 ARRDeepSeekOpenAI
AI Google 的 AI 开始替你打电话,这句开场白改了8年 9月24日,Google 开始让 Pixel 11 上的 Gemini 替用户打电话,开头要先表明自己是来自 Google 的 AI 助理。这段开场白 Google 用了八年才定下来:2018年 Duplex 演示时它还不说自己是谁,如今透明声明已写进帮助页和条款。 深思 SenseAI Geminigoogle大模型
AI,个人随笔 Jev 爆火背后:AI Agent 正在从“三体人”变成“地球人” Jev之所以爆火,是因为它做了一件和行业潮流相反的事:不追求想得更久,只负责判断,接受一段状态就直接返回结构化概率。TypeSafe把这类模型称为System One Model,把经验沉淀成稳定判断可能是下一场竞争。 PM熊叔 AI AgentJevTypeSafe
AI 阿莫迪偷师姚顺雨,奥特曼偷师梁文锋 Opus 5.5和GPT-6 Luna刚发布,一个对上下文动手,一个对缓存动手。Artificial Analysis的智能指数里,max档位下前者每题平均要吐11.9万个token,后者只用2.7万——预训练见顶后,智能增量从哪来成了新分叉。 字母榜 DeepSeekGPT-6Opus
AI,个人随笔 大模型决策模型和知识图谱融合探索分享 我一直有一个感触:我把客户背景、预算和历史沟通记录一股脑塞进去,想要一个准话,它却先分析行业前景、再列优劣势,最后只回一句「综合来看,建议您根据实际情况权衡决定」。企业日常决策要的是结论,而不是把权衡过程再讲一遍。 产品老高 企业效率决策模型大模型
AI 大模型效率竞赛加速:MiMo V2.6 双登顶,「单位智能成本」成为新价值锚 2026 年,能力上限不再是唯一焦点:Google 密集迭代 Flash,OpenAI 给旗舰分档并大幅降价,Anthropic 发布 Claude Opus 5.5 时也把效率放到了核心位置,行业开始用智能与成本的帕累托前沿描述这场竞赛。 Z Finance ClaudeMiMo大模型
AI,个人随笔 武装押运遇上大模型:我拆解了7个AI落地场景 当AI落地讨论聚焦客服、营销时,武装押运这个高风险、强合规、人力密集的行业却成为大模型的天然试验田。本文按押运业务全流程拆解七个落地场景,从岗前检测到金库管理,给出产品经理视角的痛点、方案与PM要点,并附上500辆规模的落地账本与风险应对。 产品经理Mike AI落地多模态大模型
AI,个人随笔 刘大一恒接棒Qwen负责人:开源第一的Qwen,要靠什么守住基本盘? 9 月 22 日杭州云栖大会,刘大一恒以 Qwen 负责人身份首次亮相,接棒林俊旸留下的空位。Qwen 开源生态仍是全球第一,30 亿次下载、30 万个衍生模型,但旗舰 Qwen 3.8 Max 在智能指数上只排第七。 字母榜 Qwen云栖大会大模型
分析评测 Opus 5.5 vs GPT-6 Sol全场景实测:谁更强?谁更值得选? Anthropic 与 OpenAI 再度同日对狙,Claude Opus 5.5 与 GPT-6 Sol 正面交锋。本文用 5 个实测案例,从 SVG 绘图、文案写作到 3D 城市生成、电脑操作与复刻 Cursor,全程无人工干预,直观呈现两大模型在能力、速度与成本上的真实差距。 程序员鱼皮 AgentClaude Opus 5.5GPT-6
AI,个人随笔 智谱ZCode数据风波:AI工具的边界问题,这次能说清吗? 9 月 10 日 Anthropic 发布 154 页报告点名多家中国实验室,八天后智谱的 ZCode 被开发者发现会打包上传本地工作区。承明科技称涉及 3.45 万个文件、425MB 数据,并质疑整改是否彻底,要求 10 月 10 日前书面说明。 岳涌大江流 AnthropicZCode大模型