OpenAI首席科学家Jakub Pachocki发出警告,随着AI模型规模扩大,公司内部推理监控能力正在下降。
他担忧随着模型使用"不透明循环"机制,Chain-of-Thought审计将变得更困难,OpenAI可能因此放慢开发速度。
GPT-6 Astra在ARC-AGI-3基准测试中达到99.9%得分,但同时也引发了关于AI透明度和安全性的新讨论。