深度求索团队通过 𝕏 透露下一代 DeepSeek-V4 的技术细节,采用突破性稀疏激活 MoE 与自研硬件协同对齐,长文本代码推理成本降至 $0.07/1M 起。
核心要点速览 (Key Takeaways)
- ✓自研 Multi-head Latent Attention (MLA) 进化版,显存占用降低 60%
- ✓长程代码重构与大型工程任务中逻辑错误率较 V3 下降 42%
- ✓承诺继续坚持全权重开源并开放无门槛商用许可
深度求索团队通过 𝕏 透露下一代 DeepSeek-V4 的技术细节,采用突破性稀疏激活 MoE 与自研硬件协同对齐,长文本代码推理成本降至 $0.07/1M 起。
阿里云通义千问发布多模态 MoE 模型 Qwen3.8-Flash 并开源权重,仅 6B 激活参数即在 DeepSWE 1.1 拿到 58.7、SWE-bench Pro 拿到 62.5,训练成本仅为 Qwen3.7-Plus 的 1/9,同时放出 Qwen3.8-Flash-Next 作为 Qwen4 架构先行预览。
企业级大模型领军者 Cohere 正式推出针对复杂软件工程微调的 Command R+ 代码专精版,在检索增强生成 (RAG) 场景下可精准引用跨微服务架构代码定义,首字延迟缩短 50%。
Google DeepMind 推出 Gemini 3.5 Transcribe,面向实时语音交互的高精度语音转写模型。Artificial Analysis 测得流式 WER 4.0%、非流式 2.6%,支持 85+ 语言,并可结合 Antigravity 屏幕上下文准确转写文件名、变量与 Agent 思路。