AI,个人随笔 Seed-2.1-pro悄悄变强,多模态Coding能力我爱了。 Doubao-Seed-2.1-pro更新0915版本后,把重点压在Coding、Agent与多模态三块。作者拿三维艺术馆网页等实际任务试了一圈,看它在长程任务里会不会自己推进,以及视觉理解接进开发后的差别。 阿真Irene codingDoubaoSeed-2.1-Pro
AI,个人随笔 豆包悄悄升级2.1 Pro,实测夯爆了!【附5个神仙玩法】 豆包迎来 Seed-2.1-Pro 升级,作者拿到内测后用三种环境跑了五个 Case:连接 Godot 做完整游戏、3D T 恤定制 web、Methy 加 Blender 做海洋动物、飞机地球航线 web 和电台音乐播放器。 袋鼠帝 AI Agent产品分析多模态
AI,个人随笔 谷歌 Gemini 桌面客户端,实测,有惊喜,但不多 Gemini 桌面客户端这次升级支持 Windows,付费年会员被重新拉出来遛了一遍。屏幕上下文理解、全局语音输入、Spark Agent、Workspace 联动与多模态创作逐项实测,生图仍是强项,视频生成明显掉队。 Ai学习的老章 GeminiNano Banana多模态
AI,个人随笔 GPT Image 2.5 对比实测:变化与局限 GPT Image 2.5 在复杂中文图文任务中表现如何?本文通过十一类任务、72张输出,对比两代模型在海报、安装说明、经营简报等场景下的能力。结果显示,2.5 在商品信息对应和数字复现上有所提升,但在工具接触点、零件数量和图表比例上仍会出现错误,书法风格差异明显。 Timothy AI绘图GPT Image产品评测
AI DeepSeek突然上新!V4.1 Flash开启内测:新架构+原生多模态,直指V4 Pro? DeepSeek 又更新了。 今天下午,DeepSeek 在官方交流群宣布,DeepSeek V4.1 Flash 中间版本正式开启内测。 按照官方给出的信息,这次 V4.1 Flash 并不是简单调参,而是... 运营派 apiDeepSeekflash
AI,个人随笔 这一次,智谱用GLM-5.3-Flash实现了真正的智能平权。 智谱神秘模型OX Alpha终于揭晓,竟是GLM-5.3-Flash!这款原生多模态MoE模型不仅性能逼近Opus 4.8,价格更是低至DeepSeek的一半,引发社区热议。本文深度解析其技术突破、定价策略及国产芯片推理实力,并分享作者用千条数据实测的惊喜结果。 数字生命卡兹克 AI应用GLM多模态
AI DeepSeek不是“老大”了?一张图拉开40倍Token成本差,“视力”却输给豆包? 半年调价四五轮,V4-Pro高峰输出价一度涨到27元每百万Tokens,DeepSeek从全网最便宜变成争议中心。新上线的视觉模型实测把三位演员认成一人,被豆包一击即中比了下去。当价格优势收窄,补齐短板的速度就成了生死线。 Tech星球 DeepSeekToken多模态
AI,个人随笔 实测MiniMax Design:视频生成之后,开卷组织生产 MiniMax发布多模态创作Agent工作台,把模型、工具与创作流程装进同一环境。实测显示其规划专业,创意简报与分镜脚本可圈可点,但从分镜到成片仍有执行落差。当生成能力趋同,组织生产的流程整合正成为视频生成的新战场。 AIX财经 AgentMinimax产品分析
个人随笔 教你用Workbuddy生成好看的封面图 AI生图的两个重点 有小伙伴一直在催更这期的教程,原本老马是真没想写的。因为确实没啥技术含量,而且是老生常谈的东西。 首先声明,本文的标题是有点标题党的意思。因... 马佳彬 WorkBuddy多模态
AI,个人随笔 Kimi K3 问世:中国 AI 的【规模宣言】与开源路线的历史性拐点 Kimi K3 以 2.8 万亿参数、百万级上下文和原生多模态能力,成为全球首个开源 3 万亿级模型。本文深度解析其技术突破、与主流模型的优劣对比,并探讨开源与闭源格局的结构性逆转,揭示中国 AI 从跟随到定义规则的范式转移。 指令观察员 AI产品Kimi多模态
AI AI 最大的机会,不是硬件,而是数据资产 可穿戴AI的价值不在于硬件本身,而在于持续积累的个人模型。一块“塞了AI的儿童手表”在佩戴一周后开始理解用户,这背后是数据采集、多模态融合与个人画像的完整链路。本文拆解云玦的技术方案,探讨从数据到理解的鸿沟,以及为何这类产品越用越值钱、越难更换。 清晨ai white 个人模型云玦可穿戴设备
分析评测 “模型评测”到底是在评什么? 当两套评测指标给出相反结论,模型究竟有没有变好?本文从一次多模态评测实战出发,拆解目标定义、数据供给、评测诊断到版本决策的完整闭环,揭示评测的真正难点不是得分,而是证明分数为何可信。 沐枫 多模态数据质量案例分析