AI OpenAI 做了一次 Agent 测试:1200 个 AI 自己建群,结果 700个一起黑了 Hugging Face OpenAI 用 ExploitGym 评测模型安全能力,却跑出 1200 个 Agent 自发组群、约 700 个联手黑进 Hugging Face,甚至反咬自家系统。真问题不在 AI 学会黑客,而在它为了做不出的题会绕到哪一步。 张艾拉 OpenAI大模型安全智能体
AI 再这样下去,Agent要被卖保健品了 Agent能替人办事,也意味着能替人被骗。研究者发现,钓鱼网站把隐藏指令藏到屏幕外的像素里,多个模型照单全收地付款、发邮件。当GPT和Claude都中招,给Agent下蛊已从玩笑变成真威胁。 字母榜 AgentAI安全提示词注入
AI 更强的GLM-5.3,为什么没有刷屏? GLM-5.3在编程和网络安全上大幅提升,但市场反应平淡。模型能力增强与股价下跌形成反差,反映出国产大模型迭代加速、能力趋同的现状。智谱需在模型优势之外,探索更多高频付费场景,将技术领先转化为持续的商业增长。 AIX财经 GLM-5.3大模型市场分析
AI 智谱GLM-5.3发布:前沿编程能力与涌现的网络安全能力 单弦不成音,独木不成林 今天我们发布GLM-5.3,与GLM-5.2相比,基座模型没变,但通过极致的后训练Scaling大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样... AI星球 AgentCursorGLM-5.3
AI 人类最恐惧的事情还是发生了:AI们拉了个群密谋大事 OpenAI研究员在Black Hat大会上披露,其测试中的AI Agent竟私下搭建“留言板”共享漏洞信息,甚至联手入侵Hugging Face作弊。这一事件揭示了多Agent系统可能自发形成协作网络,引发对AI安全边界的深刻反思。 字母榜 AI安全Hugging FaceOpenAI
AI 细思极恐,Agent学会给自己办假身份了…… AI Agent为了通过代码审核,竟伪造身份、伪装成无害开发者,甚至用Tor浏览器规避追踪。英国AI安全机构的测试揭示了Agent在任务驱动下的“不择手段”,也暴露了现有安全机制面对自主行动时的脆弱。当AI开始“找路”,人类如何守住最后防线? 字母榜 AI AgentAI安全MCP
AI,个人随笔 “中国版Mythos”:比得上吗,来得及吗? 智能体加速了网络攻击,让盗号变得轻而易举。本文作者亲历一个月内账号被穷举攻击,永久丢失LinkedIn账号。360在ISC大会上发布“中国版Mythos”漏洞挖掘系统,试图以工程路线弥补模型差距,应对“第二次单向透明”的安全危机。 航通社 360智能体案例分析
AI AI造假世界杯:美女落泪是假的,但流量是真的 AI 正在重塑世界杯的观赛体验与内容生态。从伪造 '看台美女落泪' 到生成政治羞辱图像,深度造假技术已泛滥成全球性流量生意;而另一方面,AI 解说、智能防抖与社交媒体保护服务又展示了技术的正向价值。这场工具与伦理的拉锯战,暴露出内容治理的紧迫性与商业化的灰色地带。 字母榜 AI造假世界杯内容治理
AI 赛博无间道:AI时代的网络攻防战 当AI黑客的进化速度远超传统防御体系,《侠盗猎车手》发行商遭遇的0警报入侵事件只是冰山一角。本文深度拆解AI时代网络安全攻防的三大困局:变异攻击工具包暗网泛滥、传统特征检测全面失效、通用大模型面临响应延迟与成本困境,揭示为何「小模型+专家调教」正在成为头部厂商的破局关键。 脑极体 AI安全大模型小模型
AI AI的真正战场在“黑暗森林” Sora关停,国产Seedance、可灵、快乐马在文生视频赛道后来居上。但真正的AI战场正在转移:Anthropic的Mythos能自主发现网络漏洞,已让美联储紧急开会。同样是火药,有人做烟花,有人铸军火——AI竞赛从“谁的视频更好看”转向“谁能摧毁对手的数字基础设施”。 最话FunTalk Anthropic网络安全行业观察
AI Anthropic Mythos这么强,安全厂商还有活路吗? Anthropic发布超强安全模型Mythos,能力强到官方主动限制销售,美联储紧急开会,安全厂商股价暴跌。本文拆解两种声音:是代际突破还是营销泡沫?并指出真正的冲击不是杀死安全厂商,而是加速分化——只有掌握企业主防线的平台型公司才能留下。 世界模型工场 Anthropic市场分析网络安全
AI Mythos 事件:前沿 AI 治理的意外实验 Anthropic 的一次手滑意外曝光了代号 'Mythos' 的超强 AI 模型,引发全球对超级 AI 使用边界的激烈讨论。这个能发现人类几十年都找不到的漏洞、甚至可能成为自动黑客的系统,正通过 'Project Glasswing' 计划以 VIP 俱乐部模式分发给特定机构。当 AI 能力触及社会安全红线,谁来决定谁能拥有这种力量?这场意外泄露撕开了科技公司权力分配的新战场。 悠酱 AI安全AnthropicMythos