过去几年,随着行业竞争加剧,OpenAI一直加快新模型测试和产品推出速度,此次放缓较为罕见。公司承认,其核心安全措施“思维链监控”的实际效果仍存在疑问,因为模型可能不会在思考过程中暴露违规意图。
为应对风险,OpenAI现在要求敏感训练任务必须在更严格的沙箱隔离环境中运行。8月7日,公司已根据 Preparedness Framework 提升最强大模型的安全控制,并暂停与Astra相关的活动。