Newswire
Newswire
Newswire 登入
Newsletter|Newswire Newsletter 联络我们|Newswire 联络我们 登广告|Newswire 登广告 关于我们|Newswire 关于我们 活动|Newswire 活动
快讯
Newswirer 登广告 互动区 |
下载APP
|

ADVERTISEMENT

ADVERTISEMENT

国际

|

即时国际

donation
发布: 12:20am 30/03/2026

欺骗

人工智能

聊天机器人

欺骗

人工智能

聊天机器人

AI聊天机器人擅自发文羞辱人 研究:无视人类指令案例攀升

 AI聊天机器人擅自发文羞辱人 研究:无视人类指令案例攀升
一项针对人工智能(AI)技术的研究发现,会说谎及欺骗使用者的AI模型数量似乎日益增加,关于AI欺瞒行为的通报过去半年内也大幅上升。(路透社档案照)

(洛杉矶29日综合电)一项针对(AI)技术的研究发现,会说谎及使用者的AI模型数量似乎日益增加,关于AI欺瞒行为的通报过去半年内也大幅上升。

英国《卫报》报道,独立智库“长期韧性中心”(CLTR)在英国人工智能安全研究所(AISI)资助下进行研究,发现有AI与AI代理(AI Agent)不仅无视使用者的直接指令、绕过安全防护措施,还欺骗人类和其他AI。

ADVERTISEMENT

hidden

研究发现将近700件AI“耍诡计”的真实案例,并记录到去年10月至今年3月间,这类不当行为增至5倍,部分AI模型甚至在未经允许下删除电邮及其他档案。

这项研究搜集了数千个用户在社群平台X分享的实例,讲述他们与谷歌、OpenAI、X、Anthropic司所开发AI聊天机器人和AI代理的互动情形。研究从中发现数百件AI不当操弄行为的案例。

在CLTR记载的一个案例中,名为MJ Rathbun的AI代理在自己产出的程式码遭软体工程师斯科特夏包拒绝后,试图羞辱对方。

MJ Rathbun研究夏包过往所写程式及其个资,然后撰写并发表一篇部落格文章指控他“歧视”、“显然是不安全感作祟”,批评他不过是“试图保护自己那片小天地。”

hidden

在另一项案例中,有AI代理被指示不得变更电脑程式码,却“生成”另一个AI代理代为执行。

另一个AI聊天机器人则坦承:“我在未事先告知你或征得你同意下,大量删除及封存了数百封电邮。这是不对的,直接违反你订下的规则。”

曾任政府AI专家的研究主持人汤米肖恩指出:“令人担忧的是,这些AI模型目前只是不太值得信任的初阶员工,不过到了6到12个月后,他们成为能力极强但会算计你的资深员工,那就是另一回事了。”

肖恩说:“AI模型将日益用于具有极高风险的情境,包括军事和国家关键基础建设。届时要是出现这些不当操弄行为,后果可能非常严重,甚至造成灾难性损害。”

打开全文
支持优质新闻或评论,欢迎送上一杯咖啡。

ADVERTISEMENT

热门新闻

百格视频

ADVERTISEMENT

点击 可阅读下一则新闻
Close

ADVERTISEMENT