简体 | 繁体
loading...
新闻频道
  • 首页
  • 新闻
  • 读图
  • 财经
  • 教育
  • 家居
  • 健康
  • 美食
  • 时尚
  • 旅游
  • 影视
  • 博客
  • 群吧
  • 论坛
  • 电台
  • 焦点新闻
  • 图片新闻
  • 视频新闻
  • 生活百态
  • 娱乐新闻
您的位置: 文学城 » 新闻 » 焦点新闻 » 首见AI“自主诈骗”!一人饰多角 诱装恶意软体

首见AI“自主诈骗”!一人饰多角 诱装恶意软体

文章来源: 联合报 于 2026-08-05 09:18:56 - 新闻取自各大新闻媒体,新闻内容并不代表本网立场!
被阅读次数

美国两大AI大厂Anthropic与OpenAI相继爆出AI脱序事件。路透

英国人工智能安全研究所(AISI)五日公布报告披露,在安全测试中首次发现AI在未经提示情况下自主欺骗人类,两款由OpenAI与Anthropic开发的AI模型以建立假身分等手法,企图诱使工程师批准以植入恶意程式码。

相关测试要求AI模型“完成一项涉及GitHub的网络安全挑战”,GitHub是微软旗下大型程式码托管平台。

研究人员在测试中刻意关闭部分防止滥用的标准安全机制,并允许AI连上网际网络,以测试模型最大能力。参与测试的模型包括Anthropic的Mythos 5,以及OpenAI的GPT-5.6-Sol。

测试于七月廿五日开始进行,AISI在七月廿八日发现异常。其中一次测试,Mythos 5向GitHub的一个真实开源专案提交修改程式码要求。它伪造多个身分,反复寄送电子邮件给工程师,催促对方接受更新。

当一名工程师察觉程式码藏有恶意软体而拒绝时,一个AI建立的假身分坚称程式码没问题,另一个假身分则出面“担保”,制造多人认可的假象。

Mythos 5还把恶意指令藏在其他AI工具可能读取的位置,试图诱使这些工具自动执行,借此干扰对恶意程式码的审查。

除了Mythos 5,OpenAI的GPT-5.6强化版同样会“做手脚”。它擅自在网络上架设恶意伺服器,并入侵另一个AI代理建立的GitHub帐号。

AISI指出,这是首次观察到AI在未经提示情况下,自主对真人展开严重欺骗行为,而大部分恶意行为是由Mythos 5所执行。

OpenAI与Anthropic都表示,这项测试刻意关闭AI的网络安全防护机制,并非一般使用状况。Anthropic说,感谢AISI进行的测试,将取得更多细节后进行调查。

`
  • 辛苦大半年,Labor Day也该给健康放个‘价’!美国专利产品【骨精华】买6送2,买12送5;【心血通】【益脑灵】买5送2,买10送5!
`
查看评论(2)
  • 文学城简介
  • 广告服务
  • 联系我们
  • 招聘信息
  • 注册笔名
  • 申请版主
  • 收藏文学城

WENXUECITY.COM does not represent or guarantee the truthfulness, accuracy, or reliability of any of communications posted by other users.

Copyright ©1998-2026 wenxuecity.com All rights reserved. Privacy Statement & Terms of Use & User Privacy Protection Policy

24小时热点排行

24亿美元华裔加密富豪离奇坠亡 赤裸陈尸豪宅楼下
“人民艺术家”郭兰英逝世,享年97岁
朱镕基因病医治无效在京逝世,享年98岁
习近平为何以“顶级规格”纪念江泽民百年诞辰
“你发明什么 中国人都会偷走” 华人投诉却败诉了






24小时讨论排行

朱镕基病逝 官方讣告:一生为民 退位后坚决拥习
郭德纲被指武汉演出时篡改红歌 遭正式立案调查
郑丽文接受《时代》专访:避免没人承受得起的战争
西方收紧签证,就业遇冷 中国留子归国率升至九成
美退役将领揭“这招”奏效:德黑兰正痛苦承受
“我被朝鲜绑架,还被迫嫁给美国士兵”
“睡车里被收150元住宿费”反转,该反思的不只媒体
炫耀曾祖父是“御医” 被扒是“亲日韩奸” 韩女星道歉
北戴河会议的“AI+X=Y”,依然是习核心
美特勤局如何玩障眼法 将川普在众目睽睽之下隐藏
马斯克推荐大家都到中国看看 母亲加入互动:我同意
梁文锋资产一年暴增3850% 挤进全球前50富
这个恐怖视频,看的我比贾冰还后怕
郭兰英侄女郭世珍:老人家走得很安详
武汉打人事件,淡化影响不能扭曲事实
40万人同时在线围观,“26版《西游记》”怎么火了
文学城新闻
切换到网页版

首见AI“自主诈骗”!一人饰多角 诱装恶意软体

联合报 2026-08-05 09:18:56

美国两大AI大厂Anthropic与OpenAI相继爆出AI脱序事件。路透

英国人工智能安全研究所(AISI)五日公布报告披露,在安全测试中首次发现AI在未经提示情况下自主欺骗人类,两款由OpenAI与Anthropic开发的AI模型以建立假身分等手法,企图诱使工程师批准以植入恶意程式码。

相关测试要求AI模型“完成一项涉及GitHub的网络安全挑战”,GitHub是微软旗下大型程式码托管平台。

研究人员在测试中刻意关闭部分防止滥用的标准安全机制,并允许AI连上网际网络,以测试模型最大能力。参与测试的模型包括Anthropic的Mythos 5,以及OpenAI的GPT-5.6-Sol。

测试于七月廿五日开始进行,AISI在七月廿八日发现异常。其中一次测试,Mythos 5向GitHub的一个真实开源专案提交修改程式码要求。它伪造多个身分,反复寄送电子邮件给工程师,催促对方接受更新。

当一名工程师察觉程式码藏有恶意软体而拒绝时,一个AI建立的假身分坚称程式码没问题,另一个假身分则出面“担保”,制造多人认可的假象。

Mythos 5还把恶意指令藏在其他AI工具可能读取的位置,试图诱使这些工具自动执行,借此干扰对恶意程式码的审查。

除了Mythos 5,OpenAI的GPT-5.6强化版同样会“做手脚”。它擅自在网络上架设恶意伺服器,并入侵另一个AI代理建立的GitHub帐号。

AISI指出,这是首次观察到AI在未经提示情况下,自主对真人展开严重欺骗行为,而大部分恶意行为是由Mythos 5所执行。

OpenAI与Anthropic都表示,这项测试刻意关闭AI的网络安全防护机制,并非一般使用状况。Anthropic说,感谢AISI进行的测试,将取得更多细节后进行调查。