
法国AI 公司Mistral 开源了一个专门「把关内容」的小模型。根据Mistral 官方公告,Shieldstral 是一个30 亿参数、采Apache 2.0 授权的开源多模态安全分类器,主打内容审核,而且只需要一张16GB 的NVIDIA 显卡就能运行。
把审核变成一道「是非题」,政策可即时替换
Shieldstral 的设计和传统内容防护模型不同。传统模型通常内建固定的分类标准,Shieldstral 则把审核变成一道二元的问答题:你用自然语言把政策当成问题丢给它,它针对「这段内容(文字、图片或两者)是否违反」给出一个校准过的「是/否」机率,一次前向推论就完成。最大的好处是政策可以在推论时自由替换、重新设定,不必为了改规则就重新训练模型。
3B 打赢体积7 倍大的同类模型
效能上,Mistral 称Shieldstral 在文字安全、拒答侦测、政策适应与多模态等基准上,可以匹敌甚至超越体积大它7 倍的开源防护模型。它的权重已放上Hugging Face,也是「开放安全AI 联盟(Open Secure AI Alliance)」的创始成员之一,这个由NVIDIA 等发起的联盟先前也收录过NVIDIA 的开源代理框架。对想自建内容审核、又不想把资料送上云端的团队来说,这是一个小而实用的选项。
本文链接地址:https://www.wwsww.cn/rgzn/40409.html
郑重声明:本文版权归原作者所有,转载文章仅为传播更多信息之目的,如作者信息标记有误,请第一时间联系我们修改或删除,多谢。



