LM Studio 宣布与 Inco 合作,在发布首日就把 Splash 推理引擎接入 LM Studio。官方称在 M5 Max 上运行 Qwen3.8-27B 可达约 144 tok/s,并给出安装指引(lmstudio.ai/blog/splash-engine)。此前 Inco 已开源 Splash;此次意味着本地桌面用户可在 LM Studio 内直接用上该 Apple 硅优化引擎,而不必单独拼装推理栈。
核心要点速览 (Key Takeaways)
- ✓LM Studio 首日接入 Inco Splash 推理引擎,面向本地桌面一键可用。
- ✓宣称 M5 Max 上 Qwen3.8-27B 约 144 tok/s,并给出官方安装博文。
- ✓把 Apple 硅优化推理从独立引擎推进到主流本地客户端分发通道。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察