
OpenAI发布GPT-5.4 Thinking系统卡:网络安全能力新突破
OpenAI发布GPT-5.4 Thinking系统卡,这是首个在网络安全领域实施高能力缓解措施的通用推理模型。本文深入解读其核心特性、技术架构与行业影响。
浏览所有关于 SEO、GEO 和搜索优化的技术文章

OpenAI发布GPT-5.4 Thinking系统卡,这是首个在网络安全领域实施高能力缓解措施的通用推理模型。本文深入解读其核心特性、技术架构与行业影响。

OpenAI 发布 IH-Challenge 训练数据集,通过强化学习优化大模型的指令层级优先级,显著提升对提示注入攻击的鲁棒性和安全可操控性,同时避免过度拒绝。

OpenAI日本发布《日本青少年安全蓝图》,通过年龄感知保护、强化安全政策、家长控制工具和以福祉为中心的设计,为青少年安全使用生成式AI提供全面保障。

OpenAI 发布 GPT-5.4-Cyber 并大幅扩展可信访问计划,通过民主化访问、迭代部署和生态系统投资,为下一时代网络防御提供 AI 驱动的新工具,帮助防御者应对日益复杂的网络威胁。

OpenAI 推出“可信网络访问”计划,联合全球领先企业、安全供应商及开源团队,构建广泛参与的网络防御生态系统。该计划以信任与验证为基础,通过API投资和前沿模型共享,加速防御能力普及,守护关键数字基础设施。

OpenAI发布社区安全承诺声明,详细介绍了如何通过模型训练、自动化检测系统和人工审核来防范暴力与危害内容,包括识别细微风险信号、提供危机资源支持、执行零容忍政策等关键措施。

OpenAI 获得 FedRAMP 20x Moderate 授权,使美国政府机构能够安全使用 ChatGPT Enterprise 和 API 平台,涵盖许可审批、科学研究、公共卫生分析等任务,无需在安全与先进 AI 之间做出选择。

OpenAI发布GPT-5.5 Instant系统卡,这是首个被归类为‘高能力’的即时模型,在网络安全和生物化学准备领域实施严格防护。同时,通过两项设置,模型在ARC-AGI-3基准测试得分提升三倍,标志着即时模型在推理能力上的重大突破。

ChatGPT 推出“信任联系人”功能,允许成年用户指定一位信任的人,在检测到用户可能有自残风险时通知对方,以提供额外的支持层。该功能由心理健康专家指导开发,旨在促进社会联系,降低自杀风险,同时保护用户隐私。

OpenAI发布前沿治理框架,系统阐述其安全实践如何与加州《前沿AI透明度法案》及欧盟AI法案等法律要求对齐。框架覆盖网络攻击、CBRN风险、有害操纵、失控风险等关键领域,并建立模型报告、事件响应、外部专家参与等机制。

OpenAI发布可信第三方评估新标准,强调测试框架选择对评估有效性的关键影响。文章详细介绍了三大评估目标、影响评估有效性的因素,以及如何根据不同评估目标选择合适的测试框架。

OpenAI 发布报告揭露两起疑似源自中国的隐蔽影响力操作,利用 ChatGPT 生成内容干预美国 AI 政策辩论。文章深入分析“数据中心炒作”与“技术与关税”两个账号集群的操作手法、战略意图及对民主 AI 生态系统的威胁。