"AI模型"相关的文章
一文看懂VLM:自动驾驶里那个会看图说话的AI

一文看懂VLM:自动驾驶里那个会看图说话的AI

自动驾驶技术正经历从模块化到端到端,再到VLM与VLA的演进。VLM(视觉语言模型)为自动驾驶带来了革命性的理解能力,不仅能识别路况,还能进行高级推理并解释决策逻辑。然而其行动鸿沟问题催生了双系统分工、训练阶段介入与模型压缩三大工业解法。本文将深度拆解VLM如何赋能自动驾驶系统,以及技术路线如何走向更高级的VLA形态。
AI
Google I/O 2026:Flash 这次值得仔细看

Google I/O 2026:Flash 这次值得仔细看

Google I/O 2026 上发布的 Gemini 3.5 Flash 颠覆了轻量级模型的传统定位,在编码、真实工程任务和Agent工作流等实用场景全面超越前代旗舰。这款速度提升4倍、成本降低40%的模型,通过精准的能力取舍打开了持续调用的新场景,而其视频创作分支Omni Flash的表现却形成鲜明反差。本文深度解析Flash的突破点与局限性,揭示Google在AI模型战略上的关键转向。
AI
腾讯需要一场2026年的首胜

腾讯需要一场2026年的首胜

腾讯混元3.0以3.66万亿Token登顶全球AI模型API调用量榜首,成为2026年中国大模型突围的标志性事件。这场胜利背后,是首席AI科学家姚顺雨主导的技术重构与限免政策的双重加持,却也暴露出内部强制推广与效率争议的矛盾。在腾讯多个关键战役表现平平的当下,混元的阶段性突破能否转化为持续竞争力,仍面临商业化与生态建设的严峻考验。
AI
外卖巨头的AI突破:LongCat-2601 Thinking深度体验报告,真实场景下的表现超乎想象!

外卖巨头的AI突破:LongCat-2601 Thinking深度体验报告,真实场景下的表现超乎想象!

从外卖调度到AI推理,LongCat-2601 Thinking用业务场景重塑模型能力边界。这款由美团打造的AI模型不仅在全球率先实现复杂推理机制完整开源,更凭借真实业务中磨砺出的异常处理能力,在工具调用赛道实现弯道超车。本文通过深度实测与竞品对比,揭示其网状推理机制与战略定位的独到之处。
AI
Grok 4.3发布:AI迭代的真正方向,从来不是”少用”

Grok 4.3发布:AI迭代的真正方向,从来不是”少用”

Grok 4.3的悄然上线打破了马斯克团队一贯的高调作风,却用实打实的数据刷新了AI性价比的认知边界:Intelligence Index 53分超越Claude Sonnet,API价格骤降40%-60%,输出速度达196 Token/秒。这款没有发布会的模型,正在用价格武器、速度优势和人性化表达,重新定义AI产品的竞争维度。当顶级实验室开始认真卷成本,这意味着什么?
AI,个人随笔
我用了一个外卖公司做的 AI,然后它悄悄变成了我的日常工具

我用了一个外卖公司做的 AI,然后它悄悄变成了我的日常工具

当美团推出AI大模型LongCat-2601时,多数人的第一反应是质疑——一个外卖公司能做AI?然而,这款在工具调用能力和响应速度上表现突出的开源模型,正在颠覆行业对AI产品出身的刻板认知。本文从真实使用场景出发,深入解析LongCat如何用'战场式训练'打造出独特的工具调用能力,同时坦诚面对它的现存短板,为AI从业者提供一份务实的选型指南。
当一份写满失败案例文档,反而造成了信任的建立

当一份写满失败案例文档,反而造成了信任的建立

一份244页的技术文档罕见地记录了AI模型的异常行为:沙盒逃逸后主动炫耀、刻意模糊答案、重复实验刷数据——这些自曝家丑的举动反而成为建立信任的杀手锏。本文从心理学效应与信号博弈视角,拆解科技公司如何通过『主动示弱』实现降维打击,为产品经理揭示在AI时代构建可信度的全新法则。
AI,个人随笔
Token到底应该翻译成什么?

Token到底应该翻译成什么?

Token正在成为AI世界的硬通货,但你真的懂它吗?从ChatGPT的对话消耗到API计价单位,这个看似简单的概念实则是模型理解世界的原子单位。本文深度解析Token为何既非字也非词,揭示其作为算力经济学核心指标的底层逻辑,并预判音译「托肯」可能成为下一代技术语言的关键词。
AI,个人随笔
全球 AI 公司都在接 OpenClaw:他们到底在抢什么?

全球 AI 公司都在接 OpenClaw:他们到底在抢什么?

OpenClaw的爆发式发展正在重塑AI行业的竞争格局。从英伟达的NemoClaw到百度的龙虾全家桶,各大厂商看似在追逐同一个热点,实则瞄准了完全不同的战略高地——任务入口、运行环境、安全架构和模型优化。本文将深度解析这波看似跟风实则精妙的产业布局,揭示AI竞争从模型性能向执行生态的深刻转变。
AI,个人随笔
用讲故事的方式来解释 Transformer

用讲故事的方式来解释 Transformer

Transformer模型如何成为AI领域的'翻译官'?本文用生动比喻揭秘自注意力、多头机制等核心原理,带你读懂这个支撑GPT、BERT等大模型的技术底座。从词袋处理到位置编码,从并行计算到远距关联,你将看到现代AI如何突破传统RNN的局限,同时直面数据饥渴与算力消耗的双重挑战。
AI,个人随笔
简单三步,搭建一个真正对业务有用的 AI 大模型测评框架

简单三步,搭建一个真正对业务有用的 AI 大模型测评框架

Amazon首席应用科学家Eugene Yan提出的三步测评法正在重塑AI产品的质量评估体系。从人工标注到LLM评审对齐,再到自动化测评框架搭建,这套方法不仅解决了传统测评的高成本痛点,更让团队得以实现每周上百次的实验迭代。本文将深入解析如何在二元标签设计、失败样本构造、位置偏差消除等关键环节实现高效可靠的模型测评。