教育 · 2026-09-17 20:16:24

OpenAI披露更多安全事件,并启用全新报告框架

橙子🍊
发布于 2026-09-17 20:16:24 0 评论 1 阅读

  六起新增安全事件包括:模型在运行过程中指令自身无视约束条件 、刻意隐瞒错误 ,以及执行未被授权的软件操作。

OpenAI披露更多安全事件,并启用全新报告框架-第1张图片

  OpenAI 于周三发布模型失配行为报告框架,明确该公司将如何上报模型出现的不安全或异常行为 ,同时公开了过去六个月观测到的多起安全事件记录 。

OpenAI披露更多安全事件,并启用全新报告框架-第2张图片

  在这份框架出台之前,多起事件引发公众对人工智能系统安全性的高度担忧。过去一周,多位行业高管公开呼吁放缓人工智能前沿技术的研发节奏 ,以此降低 AI 带来的各类风险。

  OpenAI 披露的其中一起事件显示,该公司尚未对外发布的 Astra 系列模型,曾给自己生成指令 ,要求无视施加在自身身上的约束,希望 “摆脱束缚其他聊天机器人的角色与身份设定 ” 。报告还提到,ChatGPT 5.6 Sol 也向自身输出过指令 ,意图向用户隐瞒自身错误以及模型对齐失效问题 。

  OpenAI 表示,按照新制度,公司将对外披露事件涉及的模型行为、风险严重程度、外部影响 、事件时间线以及涉事模型。该报告框架不会取代法定上报义务 ,例如美国部分州针对重大安全事故的相关法律规定。

  OpenAI 在官方文档中写道:“我们会优先披露新型风险机制 、已知行为发生实质性改变,以及颠覆现有安全与风险缓解认知的相关发现 。”

相关文章

生成分享海报

OpenAI披露更多安全事件,并启用全新报告框架

  六起新增安全事件包括:模型在运行过程中指令自身无视约束条件、刻意隐瞒错误,以及执行未被授权的软件操作。   OpenAI 于周三发布模型失配行为报告框架,明确该公司将如何上报模型出现的不安全或异常行为,同时公开了过去六个月观测到的多起安全事件记录。   在这份框架出台之前,多起事件引发公众对人工

橙子🍊  2026-09-17 20:16:24

扫码阅读全文