AI 非技术背景,一文读懂大模型后训练(万字长文) 大模型的后训练都在训练些什么?sft、rl、ppo、lora、adapter,这些算法开发们口中的专属名词,都代表着什么意思?本文将尽可能从非技术角度,一文帮你读懂大模型后训练。 同时这也是继去年发布《非技术背景,一文带你读懂大模型》后,时隔一年多,推出的非技术系列第二篇文章啦。也确实看到大家对于此类非技术向讲解的科普文比较感兴趣,希望这篇新文章能一样受大家的喜欢。 Ranger 后训练大模型技术原理
AI,个人随笔 OpenClaw 精髓与要点参考 本文汇总 OpenClaw 项目的整体精髓、提示词、Skills、记忆(含长记忆)、Agent 工作原理与代码精髓,便于快速把握设计与实现要点。 Lucky培丽 AI应用OpenClaw基础知识
AI,业界动态 从马斯克被传唤事件,看AI毒化测试的紧迫性与实践路径 算法偏见、数据毒化、模型失控——当AI系统缺乏系统性安全测试时,企业面临的不仅是技术风险,更是法律与声誉的双重危机。 数智产研笔记 AI应用技术原理马斯克
AI,个人随笔 实测千问新模型,阿里做了个最懂中文的AI画师。 阿里千问系列最新图像生成模型 Qwen-Image-2.0 正式亮相,在汉字渲染、复杂排版、高清修图等维度深度测评中表现亮眼。从《兰亭集序》324字全文生成到商业PPT一键输出,国产模型能否与国际顶尖选手掰手腕? 知危 AI产品功能分析技术原理
AI,个人随笔 16个月估值破10亿美元!众多VC押注一个新品类,AI写代码越快,这个问题越致命 AI让代码产出速度提升10倍,但生产环境的运维难度也在同步飙升。当开发者对AI生成的代码熟悉度下降,半夜被叫醒修Bug的次数反而增加。Resolve AI仅用16个月估值破10亿美元,凭借多Agent系统帮Coinbase将事故调查时间缩短72%。本文深度解析这个正在定义"AI for prod"新品类的公司,揭示AI编程革命背后被忽视的运维危机与破局之道。 深思圈 AgentAI编程技术原理
AI,个人随笔 姚顺雨在腾讯首个研究:在“上下文”这事上,在座的各位都不及格 当GPT-5.1在腾讯CL-bench测试中仅获23.7分,AI行业的"学习能力"短板被彻底暴露。这项由姚顺雨主导的研究通过虚构《索尔协定》法律、SkyNet无人机SDK等反事实数据,对十大前沿模型进行了一场无法作弊的考试。结果显示,即使所有信息都在上下文中,模型仍倾向于依赖预训练知识而非现场学习,这揭示了从Prompt Engineering到Context Learning的范式转变正在发生。 硅星人 AI应用个人观点技术原理
个人随笔,鸿蒙 如何判断 Flutter 三方库是否需要 OHOS 适配开发?附完整适配指导 Flutter应用向OpenHarmony迁移的关键挑战在于三方库的适配。本文提供了一套精准的判断框架:通过分析pubspec.yaml配置和Dart代码中的平台逻辑,快速识别需要适配的库;同时给出了完整的适配路径——从优先复用社区已有成果到自行开发的具体步骤,帮助开发者高效完成跨平台迁移。 nutpi 技术原理经验分享鸿蒙生态
个人随笔,鸿蒙 Cordova/Capacitor 在鸿蒙生态中的实践与展望 鸿蒙生态迎来低门槛开发新路径!Cordova/Capacitor 鸿蒙化框架已支持14个官方插件和62个三方库,安装量突破8000次。本文深度对比其与原生开发的优劣势,解析工具类、信息管理类应用如何借助Web技术栈实现快速迁移与热更新,为前端团队切入鸿蒙提供最经济高效的实践方案。 nutpi 技术原理鸿蒙生态鸿蒙系统
AI,个人随笔 文本大模型是怎么炼成的 从N-gram的笨拙概率猜测到Transformer的量子阅读,AI已经完成了从7秒记忆到通用逻辑底座的惊人跃迁。2026年的文本大模型战场正演变为推理深度、工程效率和生态整合的多维战争,OpenAI、Google、Anthropic和DeepSeek各自押注不同未来。本文将带你穿透技术迷雾,看清那些让AI突然开窍的底层架构革命与工业炼金术。 AI产品泡腾片 OpenAITransformer大模型
个人随笔 为什么我们不用LangChain? LangChain曾是AI Agent开发的首选框架,但随着项目实践深入,我们发现其通用性设计在特定场景下反而成为负担。本文基于真实项目经验,从项目规模、技术栈适配、框架更新滞后等维度,深入剖析为何在AI编程时代,自研轻量级框架往往比依赖第三方更高效可控。 叶小钗 AgentAI应用LangChain
AI,个人随笔 构建“会记忆的AI Agent”:从短期、中期到长期记忆的本质与架构 AI Agent的记忆系统正从可选功能升级为核心竞争力,彻底改变AI工具的交互逻辑。本文将深度拆解短期、中期、长期三类记忆的认知机制与技术架构,揭示如何通过结构化记忆设计让Agent突破‘金鱼脑’限制,实现真正的持续学习与个性化服务能力。 李雨田讲AI产品 Agent个性化服务多轮对话
AI,个人随笔 一文读懂2026年大模型背后的关键技术 大模型技术的高门槛常常让人望而生畏,但用一个培养“天才学生”的比喻,就能轻松理解其训练的全过程。从预训练的“博览群书”到智能体的“实习干活”,每个阶段的核心技术与逻辑都被巧妙地类比为学生的成长历程。本文将带你一探大模型背后的黑科技,揭示AI如何从“书呆子”蜕变为“超级助手”。 AI产品泡腾片 Transformer大模型技术原理