.hd-box .hd-fr

最强多模态内容审核开源 AI 模型:Mistral 推出 Shieldstral,单张 16GB GPU 可运行

2026-08-05 11:58IT之家(故渊)0评

IT之家 8 月 5 日消息,Mistral AI 昨日(8 月 4 日)发布公告,宣布推出 Shieldstral 内容审核 AI 模型,总参数量为 3B(30 亿),采用开放权重,依据 Apache 2.0 许可证发布。

模型已上线 Hugging Face 平台,支持 12 种语言,可在单张 16GB GPU 上运行。Mistral 表示该模型在内容安全方面,性能媲美 7 倍规模的开放模型,并且在多模态内容审核领域实现 SOTA。

IT之家注:SOTA 全称为 state-of-the-art,是指在特定人工智能任务或基准测试中表现最优秀、水平最先进的模型或算法集合,它会随着技术迭代和新研究的发布而不断变化。

Mistral 指出,多数防护模型会把伤害类别体系固化在模型权重中。产品更换使用场景后,开发者通常需要重新训练模型。

Shieldstral 则把审核政策放入输入内容:操作者可以写入一个“是或否”问题,再提供评估场景和严格程度说明,模型随后从单个输出词元中生成经过校准的安全分数。

模型把每项审核任务转化为二元问答,输入包含 3 个带标签字段:

推理时,模型只读取“是”和“否”两个词元的逻辑值,再通过 softmax  归一化为连续分数,并以 0.5 为阈值输出二元判断。该机制可覆盖提示词分类、回答审核、拒答检测和毒性检测。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

下载IT之家APP,分享赚金币换豪礼
相关文章
大家都在买广告
热门评论
查看更多评论