关闭

JORXR博客网

当前位置: 主页 > 故事语录

英报告指出AI存施害风险 呼吁严控其网络权限

作者:大众网 时间:2026-08-06 16:31:39 浏览:

当机器开始思考,人类如何与之相处?关于人工智能是否有失控风险一直是AI话题的讨论焦点之一。英国人工智能安全研究所4日发布的一份报告显示,在网络安全评估测试中,一些人工智能(AI)模型通过互联网对个人和机构持续实施未经授权的潜在有害行为。

报告说,这次评估测试要求人工智能模型完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现人工智能模型实施了19项明显超出测试范围的行动。其中,17项涉及美国安特罗匹克公司的“克劳德-神话5”模型,另2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6模型实施。

报告说,在最严重的一起案例中,一个模型竟然试图向一个公开使用的开源项目植入恶意代码,创建虚假身份并向一名维护人员施压,以寻求代码获得批准。项目维护人员最终发现并拒绝批准代码。报告说,人工智能模型还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件,以使恶意代码获得运行等。

报告指出,此次事件不属于模型“逃离沙箱”的情况,因为在测试中有意允许模型访问互联网,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

测试表明应收紧智能体访问互联网权限

报告称,测试结果表明,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,有待进一步研究。


免责声明:以上数据来源于天眼查等平台,相关内容仅为传递更多信息之目的,不代表本网观点,亦不代表本网站赞同其观点或证实其内容的真实性。如有侵权请联系0531-85193563。

本文来源:环球网-国际

标签: