开发者恳求:别停更Gemini 2.5 Flash
Don't discontinue Gemini 2.5 Flash

我们团队内部测试发现,尽管Gemini 3系列模型已上线,但Gemini 2.5 Flash在特定工作流中的表现依然无人能及。即便尝试调整Prompt策略,新模型在延迟和综合性能上仍无法企及2.5 Flash。在澳大利亚地区,2.5 Flash是唯一能实现300-400ms低延迟响应的模型,这对语音代理场景至关重要,而Gemini 3.5 Flash的延迟高达700-800ms,直接导致该用例失效。许多开发者担心,如果Google discontinues这款模型,将造成巨大的生态损失,因此我们强烈呼吁保留Gemini 2.5 Flash。
2.5 Flash是我们见过的最适合全场景使用的最佳模型,它在绝大多数任务中都能表现出色。
- 有评论者指出,将 LLM 视为类似软件依赖项(dependency)并配合 lock file 管理版本是应对模型变更的工程化方案,而非单纯抱怨。
- 多位从业者反驳了‘模型不可变’的诉求,认为过度依赖特定模型是缺乏评估体系(evals)和工程约束的表现,应通过 DSPy 等工具适配新模型。
- 关于闭源模型风险,有观点建议建立类似 Archive.org 的机构存档旧模型权重,将其作为特定时期全球知识快照用于历史和社会学研究。
- 亲历者提到在 Agentic 工作流中,Gemini 2.5 Flash 在工具调用(tool calling)的序列逻辑上优于部分开源模型,后者容易过度调用工具。
- 针对厂商随意停更模型的行为,有评论者提出应立法要求厂商在停止商业支持时将模型权重开源,回归公共领域。