深度求索团队通过 𝕏 透露下一代 DeepSeek-V4 的技术细节,采用突破性稀疏激活 MoE 与自研硬件协同对齐,长文本代码推理成本降至 $0.07/1M 起。

核心要点速览 (Key Takeaways)

  • 自研 Multi-head Latent Attention (MLA) 进化版,显存占用降低 60%
  • 长程代码重构与大型工程任务中逻辑错误率较 V3 下降 42%
  • 承诺继续坚持全权重开源并开放无门槛商用许可