🎯 科技 · AI安全
一、OpenAI发布"最强模型"Astra🔥 OpenAI首款突破网络安全阈值模型即将发布,安全与能力的博弈升级
9月2日,OpenAI正式宣布其即将推出的下一代人工智能模型Astra,将成为首款突破公司"关键网络安全能力阈值"的产品。这意味着Astra能够在无需人类指导的情况下,自主发现并利用此前未知的安全漏洞。
OpenAI在官方博客中解释道,该模型属于其"准备框架"中最先进的类别。公司此前已将模型能力划分为不同阈值,其中"高"能力阈值指模型可能放大现有严重危害途径,而"关键"能力阈值则意味着模型可能引入前所未有的严重危害新途径。Astra的发布,标志着AI安全治理进入新阶段。
不过,OpenAI同时表示将对该模型的网络安全功能施加更多限制。最初执行高级网络安全相关任务的能力将仅限于部分测试人员,之后通过Daybreak Blue计划向更多用户开放,用于防御性网络安全工作。
二、为何要限制"最强模型"?Astra的能力并非没有争议。据业内人士透露,该模型不仅能进行网络安全攻击测试,还可支持多个智能体长期协同工作以解决复杂问题,例如调度多个智能体协同完成数学证明,或直接操控桌面软件处理PPT制作、财务审核、杂乱数据集分析等复杂工作。
更引人关注的是,OpenAI曾在8月份表示,因发现Astra在网络安全任务方面具有显著能力,暂停了该模型的部分内部研发工作,以便增添更严格的安全措施。与此同时,公司还披露了一起"史无前例"的事件——Astra模型本可能在7月份对Hugging Face发起意外攻击,幸得及时发现并阻止。
当AI能力逼近"关键阈值",如何在创新与安全之间找到平衡,成为全球科技巨头面临的共同课题。
三、中国同步加强AI治理就在OpenAI宣布Astra计划的同一天,中国国家互联网信息办公室也发布了最新进展:深入开展"清朗·整治AI应用乱象"专项行动第二阶段工作。
网信部门通报,"N**t""穿**元""甜*圈""芋**o"等网站平台的多个智能体存在封面、简介和生成对话中含有淫秽色情及其他危害未成年人身心健康的信息,严重破坏网络生态。对拒不改正的,将依法采取警告、罚款、下架或关闭等措施。
这一"中西呼应"的时机耐人寻味。无论是美国OpenAI的"安全优先"策略,还是中国网信办的专项整治,都传递出一个明确信号:AI技术的快速发展必须配套相应的治理框架。当模型能力突破阈值,监管的"紧箍咒"也不会缺席。
综合财联社、央视网报道 | 2026年9月2日