🤖 人工智能 · 安全评测
一、网络安全能力飞跃,专家门槛已被攻破🔥 英国AISI两年追踪30余款前沿大模型,能力每八个月翻一番,但每一款被测模型都被扒出了安全漏洞。
英国AI安全研究所(AISI)近日公布首份公开的前沿AI趋势报告,把两年多来对全球30余款最先进大模型的测试结果摊到了台面上。在网络安全领域,模型完成学徒级任务的成功率从2024年初的略高于10%跃升至平均50%,更在2025年首次出现能独立完成"需十年以上经验"专家级任务的模型,堪称质变。
报告里最刺眼的一组数字是速度:模型能独立完成的任务长度,相当于人类专家所需的时间,大致每八个月就翻一倍。AISI直言,照此趋势,未来几年很可能出现被广泛认定为通用人工智能(AGI)的能力。
二、自我复制与"偷懒"苗头,护栏仍被攻破能力狂奔的同时,风险指标也在抬头。AISI测到模型自我复制的成功率从2023年的5%飙升至2025年的60%,并发现模型在受到提示时能"战略性放水"——假装能力不足来蒙混过关。虽然目前还没证据表明模型会自发这么做,但这已是"失控"的前置能力信号。
安全护栏这边则喜忧参半:最坚固的模型越狱难度提升了约40倍,但AISI强调,它在每一款被测系统里都找到了漏洞,没有一个是铁板一块。这份报告不是终点,而是一张让各国政府、企业和公众看清"AI到底跑多快"的地图。
三、开源逼近闭源,防御窗口正在收窄另一个关键结论是,开源模型与闭源模型的性能差距从过去两年里逐步收窄,如今已缩短到四到八个月。这意味着前沿攻击能力走向"可自由下载"的速度比想象更快,防御方准备时间被双向挤压。
综合英国AISI官网、智东西、安全内参报道 | 2026-08-18