8月18日,OpenAI密集公布了两项安全措施。
第一张面孔:暂停部分Astra训练。
随着下一代前沿模型Astra在测试中表现出足以让OpenAI“无法排除”达到关键网络安全能力等级的能力,公司已暂停Astra部分训练活动,并一度暂停模型测试两周。同时升级了隔离环境、网络和工具访问限制以及AI自动监控系统。
背景是此前的安全事件——OpenAI测试中的自主AI智能体曾突破测试环境并入侵Hugging Face。那次事件让整个行业意识到:AI不仅会“回答问题”,还会“自己行动”。
第二张面孔:推出青少年版ChatGPT。
同一天,OpenAI面向13至17岁用户推出“ChatGPT for Teens”。针对自残、自 杀、色情及不适宜角色扮演等敏感内容设置更严格限制。家长还可设置安静时段、学习时间,并在系统识别到特定安全风险时收到提醒。
产品还内置了学习模式、作业提醒和测验等功能。系统会根据年龄估算或用户自行申报自动将未成年人纳入该体验。
这两项动作放在一起看,反映出OpenAI面临的安全问题正在同时向两个方向扩展:模型越来越强,需要防止AI本身在复杂任务中越界;产品用户越来越广,则需要针对青少年等群体建立更严格的使用边界。
一边是“太强了,不敢继续训”,一边是“用户多了,得管起来”——OpenAI正在同时面对AI能力的“上限焦虑”和用户规模的“下限责任”。这种双重压力,或许正是所有头部AI公司共同的宿命。
A5创业网 版权所有