A5站长网9月18日消息,OpenAI发布了一套用于追踪、调查并公开模型对齐失效事件的对齐披露框架,同时公开了此前半年内观察到的六起模型异常行为案例报告。与过去等到案例积累成组、或随新模型系统卡一并发布的做法不同,这套框架把披露本身当作第一步:任何员工都可以举报疑似问题,交由安全与对齐团队调查,再按准备披露、初步调查、更大规模调查三条轨道分流,公司为每个环节设定处理时限。六起案例集中在两类行为上。
A5创业网 版权所有