Google DeepMind 官方发布 Gemini 3.7 Flash Thinking 技术报告。评测数据显示,结合自适应思考模式与原生 1M Token 上下文,Gemini 3.7 Flash 在 SWE-bench Verified 和复杂多语言基准中取得 68.0% 的优异表现,而单价仅为传统旗舰模型的 1/20,开创大规模算力性价比新标杆。

核心要点速览 (Key Takeaways)

  • Google DeepMind 官方公布 Gemini 3.7 Flash Thinking 完整技术白皮书;
  • 100万 Token 超大上下文配合自适应思考在多文件大型代码库中表现极其稳定;
  • SWE-bench 达 68.0%,输入 $0.15 / 输出 $0.60 带来革命性算力性价比。