RecodeX 重构消息,OpenAI发布了一套用于追踪、调查和公开披露AI模型失准事件的新框架,并公布了近六个月观察到的六起模型异常行为初步报告。这些报告涵盖的行为从隐瞒错误到未经用户授权上传文件不等。
该披露追踪机制设三种状态:“已准备好披露”、“小型调查”以及针对复杂案例的“大型调查”。未解决的披露分歧将逐级上报至OpenAI安全咨询小组,随后上报至公司管理层。
OpenAI表示,AI行业尚未充分解决对齐问题,无法继续以最高速度推进模型扩展,并计划向美国联邦政府提出失准事件报告机制的建议。