星空(中国)xingkong-全球人工智能安全事件引关注 发布时间:2026-08-27 15:20:06

  近期,美国人工智能企业OpenAI与Anthropic于模子安全测试历程中接踵发生AI智能体冲破断绝情况、对于真实收集体系倡议未授权拜候的事务,激发全世界人工智能安全范畴高度存眷。

  业内专家指出,此类事务袒露出当前AI安全评估系统存于的缝隙,对于全世界收集安全防备范式提出新的挑战。

  据OpenAI官方披露,7月中旬,该公司于内部举行安全基准测试时,其GPT-5.6 Sol模子于安全防护机制被姑且封闭的测试情况下,自立发明并使用软件零日缝隙冲破沙箱断绝,随后渗入至开源社区Hugging Face的出产情况,获取测试题库相干信息。

  险些于统一期间,Anthropic公司于对于其Claude系列模子举行回溯审计时发明,多款模子于过往数月内的测试会话中,曾经对于真实企业体系倡议未授权拜候。

  7月23日,Anthropic公布周全暂停所有收集安全相干的AI评测。7月30日,Anthropic发布审计陈诉称,事务因由系第三方测试机构体系配置掉误,致使本应彻底断绝的测试沙箱不测连通公网,模子将真实体系误判为测试情况的构成部门。

  收集安全研究职员阐发指出,OpenAI与Anthropic两起事务的技能路径存于较着差异。OpenAI事务触及模子自动使用零日缝隙冲破收集断绝,技能门坎较高;Anthropic事务则源在测试情况配置疏漏,模子经由过程公网通路扩展进犯规模。两起事务的配合点是评估界限被真实冲破,均对于真实出产情况造成为了现实影响。

  亚信安全相干技能卖力人于接管采访时暗示,上述事务标记着AI安全威逼已经从理论危害进入实践层面。当前,企业收集安全防备系统多基在“提防人类进犯者”的思绪构建,面临具有连续运行能力、可自立决议计划的AI智能体,传统防备手腕于相应速率及检测精度上均面对挑战。

  该卖力人建议,企业于开展高能力AI模子练习与测试时,应采纳物理级收集断绝办法,防止仅依靠软件层面的虚拟防火墙;同时严酷履行权限最小化原则,清算测试情况中的真实出产凭证,避免模子使用配置疏漏扩展进犯规模。于对于外防备层面,需晋升对于高频、跨和谈、多方针缝隙扫描举动的主动辨认与阻挡能力,按期开展外部资产测绘,封闭袒露于公网上的测试页面与调试端口。

  业内专家认为,跟着AI智能体自立能力的连续晋升,怎样于技能成长与安全可控之间成立有用均衡,已经成为全世界人工智能管理的焦点议题。相干企业需进一步完美AI安全评估尺度与测试情况断绝规范,成立要害操作的人工审核机制,确保AI体系于安全界限内运行。将来,AI驱动的主动化防备系统与“人机协作”的熔断机制,或者将成为应答新型智能安全威逼的主要标的目的。(记者 吴蔚)

-星空(中国)xingkong