Google DeepMind 正式推出 Gemini 3.5 Transcribe,专为复杂嘈杂真实场景设计的高精度智能语音转写大模型。自动去除语气词并结构化输出,已全面上线 macOS 版 Gemini、Android Gboard 以及 Google AI Studio / Antigravity。

核心要点速览 (Key Takeaways)

  • 高噪声环境下关键结构化实体(电话号码、邮编、代码片段、订单号)召回率提升显著;
  • 智能过滤口语语气词并支持自定义专业术语表与多语种混杂自动识别(支持超 85 种语言);
  • 首发集成于 macOS Gemini 客户端、Android Gboard 以及 Google AI Studio / Antigravity。