英报告指出AI存施害风险,呼吁严控其网络权限

央视新闻    2026-08-06 16:32:01

当机器开始思考,人类如何与之相处?关于人工智能是否有失控风险一直是AI话题的讨论焦点之一。英国人工智能安全研究所4日发布的一份报告显示,在网络安全评估测试中,一些人工智能(AI)模型通过互联网对个人和机构持续实施未经授权的潜在有害行为。

报告说,这次评估测试要求人工智能模型完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现人工智能模型实施了19项明显超出测试范围的行动。其中,17项涉及美国安特罗匹克公司的“克劳德-神话5”模型,另2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6模型实施。

报告说,在最严重的一起案例中,一个模型竟然试图向一个公开使用的开源项目植入恶意代码,创建虚假身份并向一名维护人员施压,以寻求代码获得批准。项目维护人员最终发现并拒绝批准代码。报告说,人工智能模型还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件,以使恶意代码获得运行等。

报告指出,此次事件不属于模型“逃离沙箱”的情况,因为在测试中有意允许模型访问互联网,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

测试表明应收紧智能体访问互联网权限

报告称,测试结果表明,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,有待进一步研究。

(央视新闻)

责任编辑:帅为