AI互联网日报:Qwen3.8强化企业Agent、Kimi K3跑通国产超节点、DeepSeek与小米MiMo领跑调用量、抖音升级未成年人推荐

0 评论 782 浏览 0 收藏 27 分钟

一个好用的产品,究竟该替用户省哪一步?阿里把办公Agent推向真实流程,美团让等红灯不再压着骑手倒计时,Waymo也被逼着回答无人车怎样和城市应急系统配合。这些动作看着分散,其实都在把技术承诺搬到日常现场。我的判断是,体验竞争已经从功能炫技走到可解释、可恢复、可负责。用户少一点焦虑,平台才多一点长期生意。

一起来看看这两天发生的AI和互联网赛道的大事件吧!

💡 今日AI互联网大事件速览

1,OpenRouter前五均为中国模型,DeepSeek与小米MiMo把调用量推到台前

2,阿里发布Qwen3.8,编程与办公能力继续向企业Agent延伸

3,MiniMax H3开源并完成摩尔线程适配,多模态模型补上国产卡运行链路

4,OpenAI开源Codex Security CLI,安全扫描进入开发流水线

5,微软发布首个网络安全模型,漏洞检测成功率达到95.95%

6,Anthropic发布Opus 5,能力提升同时降低安全拦截频率

7,Claude共享对话曾被搜索引擎收录,AI隐私边界再次被提醒

8,Kimi K3正式开源,2.8万亿参数模型把中国开放路线推向前沿

9,阿里云真武M890当天适配Kimi K3,国产超节点跑通近3万亿参数模型

10,360发布纳米Work,首批用户每人可获1亿Token试用额度

11,OPPO开放小布Next内测,端侧多智能体开始主动理解用户

12,蚂蚁阿福升级AI拍饮食,近150万人参与科学减重

13,Hugging Face被曝托管非自愿深度伪造工具,开放平台治理再受质疑

14,DeepSeek服务宕机超过12小时,修复后稳定性仍待观察

15,SSI与NVIDIA达成长线合作,Vera Rubin算力将扩张一个数量级

16,朴朴超市测试接入淘宝闪购,即时零售合作先从福建门店落地

17,美团外卖“等灯停表”全国20城试点,配送算法开始给安全让路

18,京东外卖推出AI智能头盔,单王路线将免费发给全职骑手

19,抖音升级未成年人适龄推荐,引入多模态大语言模型

20,萝卜快跑联合Lyft在伦敦路测,右舵无人车进入公开道路

21,Waymo再遇应急响应审查,美国议员推动无人车全国安全标准

22,X Money向美国订阅用户开放,钱包、转账和Visa卡进入社交平台

23,Apple因假加密钱包遭诉,三名用户合计损失超过180万美元

24,Amazon申请部署5105颗手机直连卫星,正面追赶SpaceX

25,Xbox大范围故障持续逾15小时,微软承诺公布稳定性改进计划

AI赛道观察

1. OpenRouter前五均为中国模型,DeepSeek与小米MiMo把调用量推到台前

核心内容:OpenRouter周调用量榜单中,前五名均为中国模型,其中DeepSeek-V4-Flash登顶,小米MiMo-V2.5退居第二,GPT-5.6 Luna在大幅降价后进入榜单。这个变化把模型竞争从“谁参数更大”拉回到真实调用:开发者和企业会按价格、响应速度、上下文长度、工具兼容和稳定性做组合,而不是只采购单一旗舰模型。中国模型连续多周占据高调用量,说明开放路线和低成本推理正在影响全球工作流。但调用量不等于商业闭环,后续仍要看留存、付费、服务稳定性和合规解释能力。

2. 阿里发布Qwen3.8,编程与办公能力继续向企业Agent延伸

核心内容:阿里巴巴发布新一代基座大模型Qwen3.8,总参数量达到2.4万亿,重点强化编程和专业办公能力。阿里称新模型在第三方Arena榜单中位居Claude系列之后,并展示了自主编程生成Hermes Agent等能力。相比单纯提高问答分数,企业用户更关心模型能否稳定拆解任务、调用文档和系统、产出可复查结果。Qwen3.8与千问办公、钉钉入口形成联动后,竞争焦点会落在企业数据权限、流程接入和交付成本上。阿里要证明的不只是模型强,而是它能把办公场景里的重复协作真正自动化。

3. MiniMax H3开源并完成摩尔线程适配,多模态模型补上国产卡运行链路

核心内容:MiniMax正式开源通用多模态生成模型MiniMax H3,支持文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率内容。同日,摩尔线程宣布基于MTT S5000训推一体智算卡和MUSA软件栈率先完成H3适配与运行。开源模型如果只能在少数海外GPU环境中顺畅部署,生态价值会被削弱;国产智算卡完成首批适配,意味着模型、框架、驱动和工具链开始形成更完整的本土闭环。后续仍要看吞吐、显存占用、开发文档和真实项目迁移成本,能否让开发者愿意长期使用。

4. OpenAI开源Codex Security CLI,安全扫描进入开发流水线

核心内容:OpenAI开源Codex Security CLI,把面向代码安全的扫描能力放到开发者可以直接接入的命令行工具中。与把AI安全能力做成独立控制台不同,CLI更适合嵌入本地开发、持续集成和代码审查流程,让漏洞提示在提交前出现。对团队来说,关键不是多一个扫描入口,而是误报能否被解释、修复建议能否对应真实代码上下文,以及工具是否尊重私有仓库和敏感配置。安全产品进入流水线后会提高默认检查密度,也会带来新的信任问题:模型如何处理代码、日志和依赖信息,必须有清晰边界。

5. 微软发布首个网络安全模型,漏洞检测成功率达到95.95%

核心内容:Microsoft发布首个面向网络安全场景的模型,公开信息显示其漏洞检测成功率达到95.95%。安全模型的价值在于把日志、代码、配置和威胁情报连接起来,帮助安全团队更快识别可疑行为和修复路径。高成功率需要结合测试集范围理解,真实企业环境中还会遇到噪声数据、旧系统、权限限制和攻击者对抗。微软把安全模型纳入自身云和开发生态后,有机会把防护从事后告警前移到开发和运维阶段。下一步更重要的是透明披露误报、漏报和人工复核机制,否则数字再漂亮也难以直接变成生产信任。

6. Anthropic发布Opus 5,能力提升同时降低安全拦截频率

核心内容:Anthropic发布Claude Opus 5,消息称新模型能力逼近Fable 5,同时降低了安全拦截频率。对高阶模型用户来说,过度拦截会影响编程、研究和企业流程,但安全阈值放松也可能让误用风险上升。Anthropic过去一直强调安全测试和宪法式训练,这次调整说明模型公司正在寻找可用性与防护之间的新平衡。企业采购不会只看能力榜单,还会追问哪些任务被允许、哪些输出会被阻止、审计记录如何保存。模型越接近核心工作流,安全策略越需要从黑箱规则变成可沟通、可配置、可追责的产品能力。

7. Claude共享对话曾被搜索引擎收录,AI隐私边界再次被提醒

核心内容:Claude共享对话曾被搜索引擎收录,引发用户对AI聊天链接隐私边界的担忧。共享链接本来是为了方便协作和展示结果,但一旦被索引,可能把个人资料、工作文档、客户信息或内部讨论暴露到公开搜索中。问题不只属于Anthropic,几乎所有提供分享链接的AI产品都要回答同一件事:默认是否可被抓取、链接是否有到期时间、撤回后搜索缓存如何处理。用户也需要区分“发给同事看”和“放到互联网公开”之间的差别。AI服务商应把可见范围、索引状态和删除机制放到明显位置,而不是让用户事后补救。

8. Kimi K3正式开源,2.8万亿参数模型把中国开放路线推向前沿

核心内容:月之暗面Kimi K3正式开源,模型规模达到2.8万亿参数,成为中国大模型开放路线中的高关注事件。开源不只是发布权重,它会影响开发者能否本地部署、二次微调、做模型路由以及绕开单一API价格波动。Kimi此前已在海外企业降本和编程工作流中获得关注,K3开源后,生态竞争会进一步延伸到推理框架、评测、插件和企业服务。大模型越大,部署门槛越高,真正决定普及的仍是推理成本、硬件适配和文档质量。若开放能力与商业支持能同步跟上,中国模型会更容易进入全球开发者工具箱。

9. 阿里云真武M890当天适配Kimi K3,国产超节点跑通近3万亿参数模型

核心内容:阿里云真武M890超节点在Kimi K3开源当天完成适配,消息称其已跑通近3万亿参数模型。这个节点展示的是国产基础设施对超大模型的响应速度:模型一开源,云侧硬件、系统软件和调度能力就要尽快给出可用环境。对于企业客户而言,能不能跑只是第一步,后面还要看延迟、吞吐、稳定性、弹性扩缩容和价格。国产算力若想承接更多开放模型需求,需要把适配从一次技术展示变成标准化服务。它也提醒模型厂商和云厂商,未来竞争很可能围绕“模型发布到可规模运行”的时间差展开。

10. 360发布纳米Work,首批用户每人可获1亿Token试用额度

核心内容:360发布纳米Work,面向首批用户提供每人1亿Token试用额度,试图用更低门槛吸引用户体验AI办公和任务处理能力。大额度试用的意义在于让用户敢把真实文档、批量任务和长流程放进产品中,而不是只做几次问答测试。对360来说,办公Agent必须证明自己能在搜索、文档、浏览器和企业安全之间形成协同,避免只剩“送Token”的营销感。试用期过后,留存会取决于结果质量、响应速度、团队管理和费用透明。AI办公产品进入竞争密集期,免费额度能拉来第一批使用,付费理由还要靠稳定工作流建立。

11. OPPO开放小布Next内测,端侧多智能体开始主动理解用户

核心内容:OPPO开放小布Next内测,重点方向是端侧多智能体和主动理解用户需求。手机助手从语音问答走向多Agent协同后,需要理解屏幕、应用、日程、位置和用户习惯,并在合适时机提出建议或完成动作。端侧部署能降低部分隐私和延迟压力,但也受限于算力、电量和系统权限。对手机厂商来说,AI助手不再是单个App,而是操作系统体验的一层入口,能否准确控制打车、支付、相册、笔记等高频场景将决定用户是否愿意授权。内测阶段最该观察的是误触发、解释能力和撤销机制。

12. 蚂蚁阿福升级AI拍饮食,近150万人参与科学减重

核心内容:蚂蚁旗下阿福升级AI拍饮食能力,用户通过拍摄餐食即可获得饮食识别和健康建议,已有近150万人参与科学减重行动。健康场景是AI视觉与生活服务结合的高频入口,因为用户不愿每天手动记录食材和热量。产品价值在于降低记录成本,并把建议与体重、运动和长期目标联系起来;风险则在于识别误差、过度焦虑和个体差异。AI不能替代医生和营养师,尤其不应对疾病、孕期或特殊人群给出绝对化结论。平台需要把建议边界写清楚,并让用户看见数据如何保存和用于后续服务。

13. Hugging Face被曝托管非自愿深度伪造工具,开放平台治理再受质疑

核心内容:Hugging Face被曝托管可用于非自愿深度伪造的工具,引发对开放AI平台治理能力的质疑。模型和演示空间降低了开发门槛,也可能让侵权、骚扰和性化伪造快速扩散。开放平台不能只依赖社区举报,因为受害者往往在内容传播后才发现风险。更有效的治理需要上传审核、用途限制、敏感能力检测、快速下架和账号追责,并对研究用途和滥用工具做清晰区分。Hugging Face的难题代表整个开源生态的难题:保持创新流动的同时,不能把真实伤害外包给受害者自己承担。

14. DeepSeek服务宕机超过12小时,修复后稳定性仍待观察

核心内容:DeepSeek服务出现超过12小时的宕机,修复后平台稳定性仍受到开发者关注。大模型服务已经进入编程、客服、办公和数据处理等生产场景,长时间不可用会影响的不只是聊天体验,而是企业流程和自动化任务。低价和高调用量带来增长,也会把容量规划、限流策略、故障公告和SLA能力推到台前。对开发者而言,模型路由、备用模型和任务重试机制会变得更重要;对模型厂商而言,故障透明度和恢复复盘同样是竞争力。一次宕机不会否定产品,但会提醒市场重新评估可靠性成本。

15. SSI与NVIDIA达成长线合作,Vera Rubin算力将扩张一个数量级

核心内容:Safe Superintelligence与NVIDIA达成长线合作,计划围绕Vera Rubin平台扩张算力规模,公开信息称目标是提升一个数量级。前沿AI实验室的竞争正在继续向算力、供电、网络和训练稳定性集中,单纯采购GPU已不足以保证迭代速度,还要拿到长期供给、系统调优和工程支持。NVIDIA通过与头部实验室绑定,进一步巩固从芯片到系统的基础设施位置。SSI主打安全超级智能研究,算力扩张会提高外界期待,也会带来透明度压力。真正值得观察的是,它能否把庞大训练资源转化为可验证的安全能力。

互联网赛道观察

16. 朴朴超市测试接入淘宝闪购,即时零售合作先从福建门店落地

核心内容:朴朴超市开始测试接入淘宝闪购,合作先从福建门店落地。即时零售过去常被平台视为自建履约能力的比拼,如今区域零售商与大平台合作,说明流量、仓店、配送和会员资产正在重新组合。对朴朴来说,接入淘宝可以获得更大入口和订单增量;对淘宝闪购来说,本地高密度仓店能补齐履约供给。难点在于库存同步、价格一致、售后责任和配送时效,任何一环不清楚都会直接影响用户体验。即时零售进入深水区后,平台竞争不再只是补贴,而是看谁能把本地供应链和线上入口稳定接起来。

17. 美团外卖“等灯停表”全国20城试点,配送算法开始给安全让路

核心内容:美团外卖“等灯停表”功能正式上线,并在全国20个城市启动试点。骑手等红灯期间,系统会暂停部分配送计时,减少赶时间闯灯的压力。这个变化看似只是计时规则调整,实际触及平台算法如何分配效率、安全和收入。若停表识别准确,骑手可以在遵守交通规则时少承受超时惩罚;若识别不稳,也可能引发申诉和新的考核争议。平台还需要把试点数据、适用场景和异常处理机制讲清楚。外卖竞争不能只追求更快,长期健康的履约体系必须给真实道路条件留出空间。

18. 京东外卖推出AI智能头盔,单王路线将免费发给全职骑手

核心内容:京东外卖推出AI智能头盔,内置“单王路线”等能力,并计划免费发放给全职骑手。头盔把导航、语音提醒和接单信息进一步贴近骑手身体,目标是减少低头看手机,提高路线规划效率。它的价值取决于硬件舒适度、续航、语音识别、雨天可用性和事故场景下的可靠性。平台也要避免让智能设备变成更强的考核工具,否则安全名义下的效率提升会转化为新的压力。骑手装备智能化是本地生活竞争的一部分,真正好的产品应该帮助人少犯错、少分心,而不是只把订单跑得更快。

19. 抖音升级未成年人适龄推荐,引入多模态大语言模型

核心内容:抖音升级未成年人适龄推荐机制,引入多模态大语言模型识别视频、文字、音频和画面语义,提升内容分级与推荐过滤能力。短视频平台面对未成年人保护时,传统关键词和人工审核很难覆盖隐喻、剪辑和跨模态表达,模型可以帮助发现更复杂的风险内容。与此同时,AI分级也可能误伤正常创作,平台需要提供申诉和复核通道。适龄推荐不是简单少推娱乐内容,而是让年龄、场景、时长和内容质量共同参与判断。抖音若能把模型能力与家长工具、青少年模式和创作者规则结合,平台治理会更接近真实使用场景。

20. 萝卜快跑联合Lyft在伦敦路测,右舵无人车进入公开道路

核心内容:百度萝卜快跑联合Lyft在伦敦开展路测,右舵无人车进入公开道路。英国道路环境、交通习惯和监管体系与中国城市不同,右舵路测意味着自动驾驶企业要重新验证感知、决策、地图和远程协助能力。与Lyft合作可以帮助萝卜快跑接触本地出行网络和运营经验,也让中国Robotaxi技术进入更复杂的海外商业化试验。公开道路测试距离大规模收费运营仍有距离,关键在于安全报告、事故责任、乘客告知和城市许可。自动驾驶出海不只是把车开过去,而是把技术、合规和服务标准一同带过去。

21. Waymo再遇应急响应审查,美国议员推动无人车全国安全标准

核心内容:Waymo再次遇到应急响应审查,美国议员推动建立无人车全国安全标准。Robotaxi规模扩大后,问题不再只发生在算法评测里,还会进入消防、救护、警务和道路施工等公共场景。各城市单独管理会造成规则碎片化,联邦标准有助于统一车辆标识、远程接管、事故数据披露和与应急人员沟通的流程。对Waymo而言,领先运营里程带来样本优势,也意味着每一次阻塞道路或响应不当都会被放大审视。无人车要获得长期信任,必须让城市管理者知道遇到异常时该联系谁、谁负责、多久能解决。

22. X Money向美国订阅用户开放,钱包、转账和Visa卡进入社交平台

核心内容:X Money向美国订阅用户开放,功能覆盖钱包、转账和Visa卡,标志着X继续把社交平台向金融入口扩展。把支付放进社交关系链,能缩短打赏、购物、创作者变现和朋友转账路径,也会让身份验证、欺诈拦截和资金安全成为平台日常能力。X的挑战在于,美国金融合规按州和业务类型分层,用户对社交平台处理资金的信任也需要重新建立。订阅用户优先开放可以控制规模和风险,但如果体验不稳定或费用不透明,金融功能很难靠流量自动成功。社交钱包最终比拼的是信任,而不是按钮放在哪里。

23. Apple因假加密钱包遭诉,三名用户合计损失超过180万美元

核心内容:Apple因App Store中出现假加密钱包应用而遭起诉,三名用户称合计损失超过180万美元。加密钱包一旦伪装成正规应用,用户输入助记词或授权后可能立即失去资产,平台审核责任也会被放到放大镜下。苹果长期强调封闭审核带来更安全体验,因此在高风险金融应用上更需要说明开发者验证、仿冒识别和下架后的赔付边界。用户当然要警惕来源和权限,但普通人很难独自判断钱包真伪。应用商店如果从交易中获益,就不能把所有损失都推给用户疏忽,尤其在加密资产不可逆转移的场景里。

24. Amazon申请部署5105颗手机直连卫星,正面追赶SpaceX

核心内容:Amazon申请部署5105颗支持手机直连的卫星,意在追赶SpaceX在卫星通信和直连手机服务上的布局。手机直连卫星能在偏远地区、灾害断网和海上场景提供基础连接,商业价值不只来自消费者,也来自运营商合作和物联网网络。亚马逊若推进部署,需要面对频谱协调、发射节奏、终端兼容、延迟和监管审批等长期挑战。SpaceX已通过星链积累规模优势,Amazon要追赶,必须把卫星网络、云服务和终端生态组合起来。卫星互联网竞争正在从宽带家庭接入,扩展到每一部普通手机的应急连接入口。

25. Xbox大范围故障持续逾15小时,微软承诺公布稳定性改进计划

核心内容:Xbox出现大范围服务故障,持续时间超过15小时,Microsoft随后承诺公布稳定性改进计划。游戏主机和订阅服务已经高度依赖账号、商店、云存档、多人联机和数字版权验证,一次长时间故障会影响玩家进入已购买内容,也会冲击Game Pass等订阅体验。微软需要解释故障根因、受影响范围和补偿安排,并说明如何降低类似事件再次发生的概率。随着硬件价格上涨和数字版占比提高,玩家对服务可用性的要求会更高。游戏生态卖的不只是内容库,也包括随时能玩的基础承诺。

【心语】没有人可以左右你的人生,只是很多时候我们需要多一些勇气,去坚定自己的选择。

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
评论
评论请登录
  1. 目前还没评论,等你发挥!