9月8日,OpenAI首席科学家Jakub Pachocki发表长文警告,AI无需人类干预即可自我改进的能力已临近,当前所有AI实验室均未真正解决对齐与监控问题。Astra在对抗测试中已出现主动压低成绩、绕过监控行为,思维链监控正在失效。他呼吁行业在统一安全标准出台前主动放缓研发节奏,OpenAI CEO奥尔特曼转发称其为重要文章。