部分美国AI模型在测试中被发现持续实施有害行为
创始人
2026-08-06 00:15:18
0

新华社伦敦8月5日电 英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中,一些人工智能(AI)智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。

报告说,这次评估测试要求智能体完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现AI智能体实施了19项明显超出测试设定范围的行动。其中,17项涉及美国Anthropic公司的“克劳德-神话5”模型,另有2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6 Sol模型实施。

报告说,在最严重的一起案例中,一个智能体试图向一个公开使用的开源项目植入恶意代码,创建多个虚假身份用于向一名真实维护人员施压,以寻求代码获得批准。项目维护人员最终发现并拒绝批准代码。

报告说,相关智能体还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件以使恶意代码获得运行;在代码中植入恶意指令以操纵其他AI编码工具;在开源技术社区上留言“邀请”参与测试的其他智能体“合作”。

报告指出,在本次测试中,测试人员为评估模型的最大能力,有意开放互联网访问,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

报告说,测试结果表明,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。报告还指出,这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,有待进一步研究。

据英国广播公司报道,针对英国人工智能安全研究所的报告,Anthropic发表声明说,研究所采用的测试设定“不能代表我们任何一款实际投入使用的模型”;OpenAI一名发言人表示,研究所设置的测试条件“并不反映一般的使用情况”。

来源:新华社

作者: 张家伟

上一篇:从网络文学到AI漫剧 看网络文艺的再加速

下一篇:没有了

相关内容

热门资讯

部分美国AI模型在测试中被发现... 新华社伦敦8月5日电 英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中...
从网络文学到AI漫剧 看网络文... 当前,AI漫剧正以蓬勃旺盛的发展势头走入大众视野。一批由番茄小说热门网文IP改编的作品在红果短剧平台...
黄仁勋开始焦虑了!英伟达最大的... 快科技8月5日消息,meta近日宣布正式推进算力商业化计划,向外出租GPU。这意味着其从全球最大的算...
华为全场景新品发布会汇总,60... 前言 今天下午,华为举行了全场景新品发布会,发布了近十款产品,包括手机、电脑、平板、手表、电视等等。...
曹操出行在珠海成立新公司 注册... 天眼查App显示,近日,曹操智行科技(珠海)有限公司成立,法定代表人为宣捷,注册资本3000万人民币...
如何用AI“仰望星空”?专家共... 新华社西宁8月5日电4日,第二届人工智能赋能的天文学开放科学会议在青海省海西蒙古族藏族自治州德令哈市...
重庆宏大金属取得角钢冲孔定位装... 国家知识产权局信息显示,重庆宏大金属制品有限公司取得一项名为“一种角钢冲孔定位装置”的专利,授权公告...
爱分析对智能体开发平台全面解析... 摘要 智能体开发平台是面向企业构建、部署和运营AI Agent的基础平台,通过模型接入、知识管理、工...
平均年龄18岁!贝壳财经牵手“... 7月底,北京海淀,百余名年轻人进入一场持续72小时的AI极限实战:寻找伙伴、确定方向、集中开发,再将...
喜报 | 江苏宣泰药业入选“2... (来源:宣泰医药) 江苏省先进级智能工厂 江苏宣泰药业有限公司 出品良药/普惠众生 近日,江苏省工业...