原标题:《Small Models Have Arrived》 评分: 638 | 作者: tosh 💭 既然小模型都够用,谁还在给前沿大模型送钱? 🎯 讨论背景 这条帖子围绕“fast/cheap/good-enough”模型是否已经到来展开,评论者拿本地 7B、32B 模型和各种 API 模型的实际体验来对照 frontier model。讨论不只是比谁更聪明,还在比谁更适合嵌入编辑器、RAG(检索增强生成)、测试流程和工具调用这些外部系统。很多人认为,真正改变生产力的是 harness(外部约束/评测/执行框架)和小步迭代,而不是一次性放任模型自由发挥;也有人坚持更大的模型仍然在多数任务上占优。背景里还穿插了本地 GPU、隐私、rate limits、企业采购和供应链等现实因素,所以“小模型”既是技术判断,也是部署与商业模式判断。 📌 讨论焦点 小模型已足够覆盖大量日常任务 很多评论者认为,小模型已经在文本摘要、邮件回复、简单脚本、基础代码修改等场景里“够用”了。它们未必在绝对能力上胜过 frontier model,但胜在快、便宜、可本地运行,而且在反复试错时几乎没有边际