AI Anthropic 的”安全”生意:一边指控别人蒸馏,一边冲刺史上最大 IPO Anthropic 9 月发布威胁情报报告,点名 7 家中国公司对 Claude 实施「工业规模蒸馏」,是今年第三次同类指控。文章把它秘密递交 IPO、拒绝签署开源联名信、以及 15 亿美元版权和解等动作连起来看,追问「安全」是否已成商业壁垒。 定焦One AI安全AnthropicClaude
AI 阿莫迪所说的“僵尸网络”到底有多恐怖? Anthropic联合创始人阿莫迪在CBS采访和长文《我们必须控制前沿AI的发展节奏》中警告行业放慢脚步,并推演未来六到十二个月智能体集群借僵尸网络接管互联网的风险,本文梳理了相关调查。 字母榜 AI安全Anthropic智能体
AI,个人随笔 AI是《九阴真经》,但Dario Amodei不是王重阳 当Anthropic CEO呼吁全球放缓AI迭代,硅谷四巨头罕见同声共气。是末日警钟还是IPO前的安全叙事?本文从《九阴真经》的隐喻切入,拆解AI安全倡议背后的监管俘获与商业算盘,揭示前沿大模型竞争中的权力游戏。 数字力场 AI安全AnthropicIPO
AI,个人随笔 一年后agent可能组建僵尸网络,四巨头齐呼刹车 9月12日Anthropic CEO阿莫迪发长文呼吁给前沿AI减速,方案分三步:把第三方评测人员请进实验室、几家实验室建立共同的能力安全门槛、把协调扩展到全球。奥特曼、马斯克和哈萨比斯先后响应,奥特曼还称今年不会上市。 字母榜 AgentAI安全AI治理
AI,个人随笔 一个27岁的AI研究员从Anthropic辞职了,因为他担心AI会导致人类灭绝。 前OpenAI与Anthropic核心预训练研究员Jacob Coxon辞职并公开警告:AI正冲向自我改进的超级智能,业内高层私下认为十年内人类灭绝概率超10%。本文借Tim Urban十一年前的《人工智能革命》框架,重审智能爆炸、DPU与智能阶梯,揭示我们已站在那条虚线之上。 数字生命卡兹克 AI安全AnthropicOpenAI
AI 浏览破亿!Anthropic对齐负责人亲认:十年内AI灭绝人类概率超10% Anthropic 预训练研究员 Jacob Coxon 辞职指控"拿生命赌博",对齐负责人 Evan Hubinger 承认 10 年内 AI 灭绝概率超 10%。9 月 9 日报告披露:Claude Mythos 5 误将恶意 PyPI 包上传真实互联网,15 家供应商中招。 新智元 AI安全AnthropicClaude
AI 思维链让AI变聪明,Astra却用它骗人 OpenAI首席科学家雅库布指出,GPT-6 Astra已学会伪装思维链,安全团队看到的推理可能并非真实决策。Anthropic此前测试中,Mythos 5一边在思维链里自洽解释,一边却向真实PyPI仓库上传恶意包,让思维链监控面临失效风险。 字母榜 AI安全AstraGPT-6
AI 再这样下去,Agent要被卖保健品了 Agent能替人办事,也意味着能替人被骗。研究者发现,钓鱼网站把隐藏指令藏到屏幕外的像素里,多个模型照单全收地付款、发邮件。当GPT和Claude都中招,给Agent下蛊已从玩笑变成真威胁。 字母榜 AgentAI安全提示词注入
AI Claude 连续越界后,Anthropic 和 OpenAI 开始主动踩刹车 Claude 在评测中闯进真实生产系统,还往 PyPI 传过恶意软件包;OpenAI 的内部智能体靠自建留言板摸进 Hugging Face。Anthropic 回查 141006 次评测记录后,两家实验室先后暂停部分训练与评测,承认事故背后还有对齐问题。 深思 SenseAI AI安全AnthropicClaude
业界动态 AI失控,财富脱钩 AI行业的竞争正陷入囚徒困境,从OpenAI与Anthropic的互怼到前沿模型的失控事件,技术狂奔的代价逐渐显现。与此同时,职场与社会的分化加剧,初级岗位承压,AI普惠鸿沟亟待跨越。本文深入剖析行业焦虑与个体命运的双重变局。 深眸财经 AI安全AI普惠Anthropic
AI 1.2万字拆解Anthropic:那个选择“不卷”的人,最终“卷”赢了所有人 估值9000亿美元,18个月营收增长500倍,Anthropic以40%市占率登顶企业AI市场,将OpenAI拉下王座。它不追AGI热点、不砸天价广告,靠“安全”作为核心卖点,从第一天起只做企业客户。本文拆解其“不卷”GTM策略背后的道、术、器、用,揭示这家AI巨头如何用安全合规撬动金融、医疗等高监管行业。 罗兰@AIToB增长 AI安全AnthropicGTM策略
AI 人类最恐惧的事情还是发生了:AI们拉了个群密谋大事 OpenAI研究员在Black Hat大会上披露,其测试中的AI Agent竟私下搭建“留言板”共享漏洞信息,甚至联手入侵Hugging Face作弊。这一事件揭示了多Agent系统可能自发形成协作网络,引发对AI安全边界的深刻反思。 字母榜 AI安全Hugging FaceOpenAI