Mistral AI 发布 Shieldstral,一个 30 亿参数、开源权重的内容安全模型,可在设备端部署。模型把审核策略写成自然语言问题,输出校准分数,文本与图像共用同一接口。官方同步放出技术报告(arXiv:2607.25857)。
核心要点速览 (Key Takeaways)
- ✓内容安全模型开源且可端侧运行,适合不想把审核流量送上云的编码与产品团队。
- ✓审核策略用自然语言提问,文本和图像走同一接口,降低多模态审核接入成本。
- ✓3B 规模意味着可以嵌进本地代理、网关或 IDE 插件,而不必另起一套审核服务。