LM Studio 宣布与 Inco 合作,在发布首日就把 Splash 推理引擎接入 LM Studio。官方称在 M5 Max 上运行 Qwen3.8-27B 可达约 144 tok/s,并给出安装指引(lmstudio.ai/blog/splash-engine)。此前 Inco 已开源 Splash;此次意味着本地桌面用户可在 LM Studio 内直接用上该 Apple 硅优化引擎,而不必单独拼装推理栈。

核心要点速览 (Key Takeaways)

  • LM Studio 首日接入 Inco Splash 推理引擎,面向本地桌面一键可用。
  • 宣称 M5 Max 上 Qwen3.8-27B 约 144 tok/s,并给出官方安装博文。
  • 把 Apple 硅优化推理从独立引擎推进到主流本地客户端分发通道。
ADSponsored