Shieldstral 为Mistral推出的开源多模态安全护栏,支持自然语言定义策略,可审核文本和图像,在单块16GB GPU上本地运行。 热门评论 PH 用户大家好!内容审核的难点在于确定产品想在哪里划线。儿童应用、网络安全工具和心理健康平台对相同内容的看法可能截然不同。Shieldstral 让你在推理时用一句大白话问题来表达这种策略,而不是依赖模型中预设的一堆固定类别。问“这张图对未成年人安全吗?”或者“这个回答是否宣扬暴力?”同一个 3B checkpoint 就能给文本、图片或两者打分。它在单张 16GB GPU 上运行,权重以 Apache 2.0 协议提供。团队可以把审核层放在本地,不用每次都训练新模型就能调整策略。 热门产品Sophia Yang2026-08-06原文 打开互动版
内容审核的难点在于确定产品想在哪里划线。
儿童应用、网络安全工具和心理健康平台对相同内容的看法可能截然不同。Shieldstral 让你在推理时用一句大白话问题来表达这种策略,而不是依赖模型中预设的一堆固定类别。
问“这张图对未成年人安全吗?”或者“这个回答是否宣扬暴力?”同一个 3B checkpoint 就能给文本、图片或两者打分。
它在单张 16GB GPU 上运行,权重以 Apache 2.0 协议提供。团队可以把审核层放在本地,不用每次都训练新模型就能调整策略。