AI 马斯克直呼完了:Anthropic 73页论文刷屏,全球大模型中招思想病毒! AI智能体之间也会传播具有自我复制能力的“思想病毒”。Anthropic的实验显示,恶意观念可以跨模型、跨任务扩散,并在多轮演化后形成稳定人格。本文拆解其传播机制、实验场景与现实边界,也说明简单系统提示为何能显著降低感染风险。 新智元 AI智能体Anthropic大模型
AI 史上第一家10万亿美元公司,会是Anthropic吗? 就在今天早上,彭博社率先披露,Anthropic向投资者透露,截至今年7月底,公司年化营收运行率已突破650亿美元(折合人民币4381亿元)。 相较今年5月的470亿美元,Anthro... 字母榜 AnthropicClaudeOpenAI
AI,个人随笔 大模型为什么会答错:从生成机制到 RAG 的可信回答证据链 大模型的回答看起来像一个结果,实际上是问题表达、证据检索、上下文工程、生成约束与结果验证共同作用的产物。本文用一个教学模拟案例拆解这条链路,并给出可直接用于排查问题的方法。 Grace AI应用RAG大模型
AI,个人随笔 说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。 真实工作场景下,大模型的表现远不如Coding领域亮眼。本文以阿里国际站开源的RealReplicaBench电商评测集为例,揭示模型在供应商采购、物流规划等真实任务中通过率普遍不足50%的现状,并对比Coding评测的差距,引发对AI实际落地能力的思考。 数字生命卡兹克 AgentAI应用大模型
AI Grok 4.6上了牌桌,马斯克还差一部《奥德赛》 Grok 4.6追平第一梯队,能力接近OpenAI与Anthropic旗舰,编程成绩领先,API价格却更低。但长链条Agent任务稳定性不足,是短板。本文解析其技术突破、成本优势与商业挑战,探讨大模型竞争从比能力转向比“一次交付”的新格局。 AIX财经 AgentGrokSpaceXAI
AI DeepSeek V4 Pro 遇上 Grok 4.6,新一轮模型竞争开始 比什么? DeepSeek V4 Pro 与 Grok 4.6 同期亮相,引发新一轮大模型竞赛讨论。本文基于公开材料,深入解析两款模型的技术升级、能力边界与产品策略,揭示大模型从对话走向任务执行的关键转折,为产品经理提供决策参考。 广赢 AI应用DeepSeekGrok
AI 一夜之间,DeepSeek V4 Pro和Grok 4.6把全球大模型推入了新的斩杀线。 一夜之间,DeepSeek V4 Pro与Grok 4.6相继发布,双双逼近Claude Fable 5的体验,大模型市场的斩杀线再次刷新。本文作者亲测后,重新分配了AI工具组合,并深入解析性能、价格与速度的不可能三角如何被撕开口子,为你的模型选择提供参考。 数字生命卡兹克 AI应用ClaudeDeepSeek
AI,个人随笔 大模型没有“大脑”,只有“骰子”?3分钟重塑产品经理的LLM认知 大模型不是大脑,而是一张概率表。产品经理若不懂这一点,就难以掌控AI产品的稳定性与创意性。本文用客服翻车案例切入,拆解温度、Top-p等参数如何影响输出,并给出PRD写作与效果验证的实用方法,助你从“赌场荷官”视角重新定义AI产品设计。 行必将至 AI产品PRD参数调优
业界动态 这一次,张一鸣为何亲自发声? 字节跳动创始人张一鸣罕见发声,强调AI模型研发需坚持长期主义与延迟满足感,拒绝依赖外部蒸馏换取短期榜单排名。CEO梁汝波同步定调,接受短期落后,坚持自研,动作不变形。本文解析字节AI战略的组织调整与资源聚焦,看其如何以长期主义应对行业洗牌。 银杏科技 大模型字节跳动张一鸣
AI,个人随笔 作为 AI 产品经理:我终于把用户、需求和大模型串起来了 AI产品经理的起点不是模型,而是定义问题。本文从外卖需求案例出发,拆解从用户问题到产品方案再到模型能力的完整链路,帮你避开“看到需求就画功能,看到AI就做Agent”的常见误区。 大 禹 AgentAI产品经理大模型
AI,个人随笔 高强度写代码的场景里,最便宜的 Token 反而是 Codex 套餐 国产大模型调用量全球领跑,但开发者却直呼“贵到用不起”。单价低十倍,为何重度使用反而更贵?本文拆解定价结构背后的算力账,揭示免费额度换来的用量并非生意,并给出不同场景下的选型建议。 实战产品说 大模型定价策略市场分析
AI K3技术报告揭秘:同样堆万亿参数,为什么老牌巨头崩了,Kimi 做成了? Kimi K3以2.8万亿参数登顶开源模型,靠MoE架构创新实现2.5倍缩放效率。本文拆解其解决专家过胖、数值爆炸、负载不均三大难题的技术细节,对比巨头堆参数的教训,探讨规模效率与后训练如何决定模型真实价值。 鲸选AI Kimi K3MoE大模型