模型迭代被压到周级,选择模型开始同时看速度、开放权重与迁移成本
Gemini 3.7 Flash 在 3.6 Flash 三周后发布;Cerebras 宣布为 GPT-5.6 Sol 提供 Ultrafast 层;GLM-5.3 把编码与网络防御作为发布重点;Qwen3.8-27B 权重进入 Hugging Face。Simon Willison 同日质疑一款生命周期可能只有数月的模型为何设置年底翻倍的入门价。
- 为何入选
- 官方模型入口、开放权重、专用硬件服务层与开发者价格反方同时出现,能改变模型绑定与迁移策略;发布方数字仍保留自述边界。
- 为什么值得看
- 模型选择正在从一次性的能力排行变成持续的组合管理:任务上限、响应速度、开放权重、部署形态、价格承诺和迁移成本要一起核算,绑定单一版本的产品会更快暴露切换风险。
- 最强反方
- Gemini 与 Cerebras 的性能数字、GLM 的能力描述均来自发布方;模型页和速度层出现不等于真实任务质量、稳定性或总成本更优,Qwen 权重也仍需独立评测。