AI,个人随笔 Gemini 3.6 Flash 与 3.5 Flash-Lite 双发:效率与质量的再平衡 Google 一口气发布 Gemini 3.6 Flash 和 3.5 Flash-Lite 两款新模型,在效率与质量间寻找平衡点。前者省 token 降成本,后者以 350 token/秒的吞吐为 agent 工作流而生。本文解读双模型背后的取舍逻辑,以及多模型混用如何成为生产 agent 的新常态。 AmazingPM AgentAI模型Gemini