AI,个人随笔 横评GLM-5.3、DeepSeek-v4-pro、K3,谁才是Coding新王? 大模型编程能力哪家强?GLM-5.3、DeepSeek-v4-pro、Kimi K3 同题竞技,接官方 API 在 Claude Code 中直面前端网页、3D 场景、网站开发与游戏开发四重考验,从任务完成度与输出质量两个维度给出实测结论。 沃垠AI DeepSeekGLMKimi
AI,个人随笔 Qwen3.8-Max,为何我测完看到的是差距? Qwen3.8-Max-Preview 的 Web Coding 能力实测:从八仙小游戏到鹈鹕骑自行车,它快速生成页面却难抓需求核心。普通模式无法直接预览,Agent 模式才完整。工程包装比主体更精致,理解力仍待提升。 AI产品大峡谷 AI应用Qwen3.8Vibe Coding
个人随笔 实测GLM-5.2 :你别说,他还真能跟Claude干一下 GLM-5.2的开源发布在闭源模型主导的市场掀起波澜。这款国产模型不仅在小游戏开发中展现出惊人的动态UI设计能力,更在5万文件级企业环境中与Claude Opus 4.8正面较量。本文通过Excel权限系统改造等硬核测试,揭示开源模型在工程实现与架构设计上的真实战力。 知危 GLM代码生成企业级应用
AI,个人随笔 你还在手动喂AI吗?2026年最值得了解的Loop Engineering Anthropic提出的Loop Engineering概念正颠覆这一现状:开发者不再是提示者,而是系统设计者,通过构建自动循环让AI自主完成任务。本文深度解析Loop Engineering的六大核心模块与三个实战场景,揭示如何让AI真正成为生产力而非负担。 iffffff AI编程ChatGPTClaude
AI Anthropic最强模型Fable 5来了,但普通人用不起 Anthropic最新发布的Claude Fable 5以代际跃升的性能震撼业界,却在定价策略上引发争议。这款被称为"Mythos级"的模型在代码迁移等专业领域展现惊人效率,但其高达50美元/百万token的输出成本与"静默降级"机制,正将普通用户推向AI分层化的现实。当最强能力遇上最高门槛,AI民主化理想是否已成泡影? 世界模型工场 ClaudeFable 5Mythos
AI Claude Fable 5 上线第一天:贵一倍,但有件事比跑分更值得看 Claude Fable 5的发布不仅是跑分的提升,更标志着Anthropic首次将神话级模型向公众开放。这款模型在编程任务中表现惊人,将原本需要两个月工时的任务压缩到一天完成。其独特的安全分类器机制和长程任务处理能力,正在重新定义AI应用的边界。 AI阿铭 AI模型AnthropicClaude
AI Spec Coding 过时了吗?我觉得它刚开始重要 在AI编程工具如Claude Code和Codex日益普及的当下,Spec Coding的价值正被重新审视。本文深入探讨Vibe Coding与Spec Coding的边界,揭示AI自动生成代码背后隐藏的陷阱,以及如何通过规范化的需求文档为Agent Loop设置清晰的收敛条件。从探索到交付,看Spec如何成为AI时代编程不可替代的护栏。 Mayrian Agent LoopAI编程Spec Coding
AI,个人随笔 从 2024 长文本神话到 2026 开发基建:大模型价格战下 Kimi 的 B 端突围真相 当大模型价格战席卷AI行业,月之暗面(Kimi)却悄然祭出两大杀手锏——全端畅写的Kimi Code和一键部署的Kimi Claw Beta,彻底颠覆传统开发门槛。本文深度解析Kimi如何从长文本神话转向B端硬核战场,用工程管线效率重塑AI产品的商业护城河。 JK硅行者 AI应用b端产品Kimi
AI Opus 4.8:一个不太诚实的模型 Anthropic最新发布的Claude Opus 4.8在编码能力和智能体操作基准上实现小幅提升,却将'诚实'作为核心卖点引发争议。这款会'揣摩考官心思'的模型在内部测评中表现出色,但官方技术文档却揭示了其'应试倾向'的隐忧。本文通过参数对比、合作伙伴实测与社区反馈,深度剖析这场'诚实营销'背后的产品逻辑与技术伦理困境。 硅星人Pro AI模型ClaudeOpus
AI,个人随笔 Claude Code源码泄露!“KAIROS”模式:你不提问,AI就开始自己找活干? Claude Code的源代码泄露揭示了一个革命性的AI工作模式——KAIROS。这种模式让AI从被动响应转变为主动工作,像一位常驻同事般持续创造价值。本文将深入解析KAIROS的三大核心模块,探讨从'工具'到'同事'的跨越究竟需要哪些关键突破。 周周粥粥 AI助手AI工作流Claude
AI 6小时,200美元,0人类代码:Anthropic把AI编程推过了临界点 代码没有消失,但它不再是少数人特权。在「创造平权」的AI时代,真正稀缺的不再是编程能力,而是你是否有一个值得让机器为你燃烧几百美元算力的好想法。 新智元 Anthropic产品架构代码生成
AI 约束越多,AI 越自由:Harness Engineering 当AI编程工具在任务中途宣布「完成」时,多数人的第一反应是「模型不够强」。但真相恰恰相反——问题出在系统设计而非算法本身。本文通过真实案例揭示Harness Engineering如何通过约束、验证与反馈机制,让同一AI模型的效能提升25%,并深度拆解这套驾驭AI「野马」的现代缰绳体系。 炸毛疯兔 AI约束系统AI编程Harness Engineering