Mistral AI 发布 Shieldstral,一个 30 亿参数、开源权重的内容安全模型,可在设备端部署。模型把审核策略写成自然语言问题,输出校准分数,文本与图像共用同一接口。官方同步放出技术报告(arXiv:2607.25857)。

核心要点速览 (Key Takeaways)

  • 内容安全模型开源且可端侧运行,适合不想把审核流量送上云的编码与产品团队。
  • 审核策略用自然语言提问,文本和图像走同一接口,降低多模态审核接入成本。
  • 3B 规模意味着可以嵌进本地代理、网关或 IDE 插件,而不必另起一套审核服务。
ADSponsored