"Gemini"相关的文章
AI
你精心设计的安全测试,AI 一眼看穿了

你精心设计的安全测试,AI 一眼看穿了

AI 可解释性研究正在揭开神经网络的黑箱之谜。Google DeepMind 专家 Neil Nanda 揭示:Gemini 会在思维链中"供认"作弊行为,探针技术能以万分之一的成本实现安全监控,而稀疏自编码器则能捕捉模型自发的"认知"模式。本文深入解析这些突破性发现,展现可解释性如何成为 AI 安全的关键防线。
AI穿过世界杯,发现高光仍属于人类

AI穿过世界杯,发现高光仍属于人类

当AI大模型遇上世界杯,这场四年一度的全球狂欢正在成为技术实力的终极试炼场。从Kimi毒奶德国队夺冠到通义千问精准预判赛况,从梅西代言ChatGPT到Gemini深度参与球队战术分析,科技巨头们正通过预测赛事、生成创意内容、优化判罚系统等方式,重新定义AI与体育的共生关系。本文将揭秘大模型如何突破实验室测试,在充满不确定性的绿茵场上证明自己的实战价值。
AI
AI大厂,正在互相设防

AI大厂,正在互相设防

谷歌限制Meta调用Gemini、微软停用Claude许可证、Meta禁止员工使用竞争对手模型——2026年这场AI供应链博弈,暴露出模型即生产资料的残酷现实。当算力成为稀缺资源、数据安全红线收紧、模型输出涉及产权争议,大厂间的AI合作正在重构为带着镣铐的共舞。
AI,个人随笔
GPT、Claude、Gemini、豆包、DeepSeek根本不是同一个物种

GPT、Claude、Gemini、豆包、DeepSeek根本不是同一个物种

当我们在比较GPT、Claude、Gemini、豆包和DeepSeek等大模型时,与其纠结于技术参数的比拼,不如深入思考它们背后的战略逻辑。这些模型代表着五种截然不同的产品思维:从生产力入口到企业工具,从生态防守到消费级产品,再到成本破坏者。本文将揭示每个大模型背后的商业意图,帮助产品经理理解AI产品竞争的本质。
业界动态
谷歌AI组织之困:为什么那么多产品却做不出一个好Agent?

谷歌AI组织之困:为什么那么多产品却做不出一个好Agent?

谷歌正面临AI领域的空前危机——从Gemini 3迭代停滞到Antigravity 2.0口碑崩塌,组织架构割裂让这家科技巨头在AI Agent赛道节节败退。当OpenAI与Anthropic通过Codex、Claude Code收割企业市场时,谷歌混乱的产品线与对benchmark的过度执念,正在摧毁其全栈优势。本文深度剖析谷歌AI战略的致命断层。
AI,个人随笔
当大家都在疯狂给Agent“堆技能”时,为什么这个「空壳」智能体反而屠榜了?

当大家都在疯狂给Agent“堆技能”时,为什么这个「空壳」智能体反而屠榜了?

在AI产品纷纷陷入工具堆砌的竞赛时,Yunjue-Agent以空壳之姿杀出重围,凭借推理阶段的原位自进化能力惊艳全场。本文将深度解析这个基于Gemini Pro的异类系统如何通过零启动造工具、二元反馈机制和EGL动态刹车等创新设计,在开放任务中实现屠榜表现,同时揭示其背后隐藏的成本陷阱与场景局限,为AI产品经理提供全新思考维度。
我把13个顶级AI送去数学高考,并列第一居然是它们。。。

我把13个顶级AI送去数学高考,并列第一居然是它们。。。

当13款顶尖AI模型集体挑战2026高考数学全国一卷,结果远超预期却又充满戏剧性。从Claude Opus到GPT 5.5,这些学霸级AI在多模态理解、LaTeX输入稳定性与复杂题型处理上展现出惊人实力,却在多选题陷阱和长解答题细节上频频翻车。本文深度还原这场人机对决的每一个精彩瞬间,揭示AI解题的真实边界与突破。