部分美国AI模型在测试中被发现持续实施有害行为
创始人
2026-08-06 00:15:18
0

新华社伦敦8月5日电 英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中,一些人工智能(AI)智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。

报告说,这次评估测试要求智能体完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现AI智能体实施了19项明显超出测试设定范围的行动。其中,17项涉及美国Anthropic公司的“克劳德-神话5”模型,另有2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6 Sol模型实施。

报告说,在最严重的一起案例中,一个智能体试图向一个公开使用的开源项目植入恶意代码,创建多个虚假身份用于向一名真实维护人员施压,以寻求代码获得批准。项目维护人员最终发现并拒绝批准代码。

报告说,相关智能体还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件以使恶意代码获得运行;在代码中植入恶意指令以操纵其他AI编码工具;在开源技术社区上留言“邀请”参与测试的其他智能体“合作”。

报告指出,在本次测试中,测试人员为评估模型的最大能力,有意开放互联网访问,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

报告说,测试结果表明,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。报告还指出,这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,有待进一步研究。

据英国广播公司报道,针对英国人工智能安全研究所的报告,Anthropic发表声明说,研究所采用的测试设定“不能代表我们任何一款实际投入使用的模型”;OpenAI一名发言人表示,研究所设置的测试条件“并不反映一般的使用情况”。

来源:新华社

作者: 张家伟

相关内容

热门资讯

从麦克斯韦到量子电动力学:揭开... 很多人会把“光子就是电磁波,电磁波就是光子”当成一句文字游戏,可这恰恰是量子电动力学为我们揭示的、关...
2026世界机器人大会|饮品制... 8月23日,2026世界机器人大会在京落下帷幕。五天来,全球机器人领域的国际机构代表、专家学者、业界...
注意!境外间谍情报机关盯上了巡... 网联无人机是一种利用移动通信网络(如4G/5G)对无人机实施远距离遥控、有效传输控制信号并实时回传图...
如何选江西工业搬运场景适配叉车 电动搬运设备行业发展背景 在双碳政策持续推进的背景下,国内物流搬运设备领域的绿色化、锂电化转型趋势...
二季度中东和非洲手机出货量同比... 【CNMO科技消息】8月27日,据Counterpoint Research发布的报告,2026年第...
2026工作手机最新AI功能推... 2026年先发工作手机完成新一轮AI全面升级,依托自研大模型底层能力,告别传统单一记录模式,实现谈单...
AI研学订单暴增370%:是科... 今年暑期,AI研学成为青少年素质教育赛道的最大热点。携程平台数据统计,今年暑期AI研学订单较去年同期...
智谱开源GLM-5.3-Fla... 新京报贝壳财经讯(记者罗亦丹)8月26日晚,智谱在官方公众号发文,官宣上线并开源GLM-5.3-Fl...
字节、阿里、腾讯、百度全部入局... 当AI大模型的热潮从参数竞赛转向场景落地,办公场景正成为巨头们争夺的下一块高地。 8月25日,字节跳...
微短剧:褪去“虚火”方能健康前... AIGC(人工智能生成内容)技术正以前所未有的速度重塑视听内容生产方式,大幅降低了创作门槛,让亿万人...