
AI人工智能
bingdada
OpenAI发布gpt-oss-safeguard安全模型:开源AI内容审核新基准
OpenAI发布gpt-oss-safeguard-120b和gpt-oss-safeguard-20b两款开源安全审核模型,基于Apache 2.0许可,支持政策驱动的推理内容分类,具备完整思维链输出和结构化输出能力。
2026-08-0284约 5 分钟阅读
浏览所有关于 SEO、GEO 和搜索优化的技术文章

OpenAI发布gpt-oss-safeguard-120b和gpt-oss-safeguard-20b两款开源安全审核模型,基于Apache 2.0许可,支持政策驱动的推理内容分类,具备完整思维链输出和结构化输出能力。

OpenAI 发布 gpt-oss-safeguard 开源安全推理模型(120b 和 20b 两种规格),支持开发者自定义安全策略并通过链式推理进行分类。该模型基于 Apache 2.0 许可证发布,可动态调整策略,无需重新训练,特别适合快速演变的风险场景。

OpenAI发布基于提示词的青少年安全政策,帮助开发者构建年龄适龄的AI保护机制。这些政策与开源权重安全模型gpt-oss-safeguard配合使用,涵盖暴力、色情、有害身体形象等六大类风险内容。