深度求索开启 DeepSeek-V4-Flash 开发者限量内测,专为超低延迟代码补全与大规模代码分析设计,在单卡 A100/H800 上吞吐量达到 180 Tokens/秒,API 输入定价低至 0.10 元/1M。

核心要点速览 (Key Takeaways)

  • 推理速度突破 180 Tokens/秒,比标准模型提速 300%,专为 Tab 实时补全优化
  • 支持 1M 超长上下文,可一次性检索整个巨型工程仓库而不损失局部细节
  • 国内开发者现可通过深度求索开放平台申请免费公测 API Key