关闭广告

澳大利亚国立大学发现:攻击AI视觉模型只需要操控20%的关键词汇

科技行者4470人阅读


这项由澳大利亚国立大学领导的国际研究团队发表于2025年12月26日的arXiv预印本论文(编号:2512.21815),揭示了一个令人担忧的发现:当今最先进的AI视觉语言模型存在一个严重的安全漏洞,攻击者只需要巧妙地操控20%的关键词汇,就能让这些本应安全可靠的AI系统产生有害内容。

考虑这样一个场景:你正在使用一个AI助手来描述图片内容,比如一张街头摩托车的照片。正常情况下,AI会告诉你"这是一个繁忙的城市街道,有几个人骑着摩托车,他们都戴着头盔"。然而,经过特殊设计的微小图像修改后,同一个AI可能会说出完全不同且危险的内容,声称图片中出现了暴力场景或其他有害内容。更令人担忧的是,这种攻击不需要修改整个AI系统,仅仅针对生成文本中20%的特定位置进行干预就足够了。

研究团队通过深入分析发现,这些AI模型在生成描述时,并非每个词汇都同样重要。就像一个故事中有些情节转折点特别关键一样,AI在生成文本时也有一些"决策点",这些点上的词汇选择会极大影响整个叙述的走向。这些关键位置被研究人员称为"高熵位置",类似于岔路口,选择不同的道路会通向完全不同的目的地。

更加令人不安

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

奶茶冲泡巨头香飘飘“突围”:首家线下茶饮店将开业,曾多次试水快闪店

红星资本局 浏览 5470

补能快也智能 奇瑞纯电皮卡威麟R08 EV售12.78万起

网易汽车 浏览 4509

亚马逊CEO安迪·贾西:AWS到2027年底将实现电力容量翻倍

IT之家 浏览 2909

寻找AI无法替代的最后一公里丨去现场 做原创

封面新闻 浏览 5416

法尔克:作为升班马,对阵曼联时拿到一分始终是个不错的结果

懂球帝 浏览 4582

安布:拉比奥需要承担更多进攻责任;米兰本赛季有机会夺冠

懂球帝 浏览 4541

俄代表:美国侵略委内瑞拉意味着"无法无天时代的回归"

环球网 浏览 8260

加州大学欧文分校发明"内部监控器":让大模型自己识别胡说八道

科技行者 浏览 4282

《大生意人》将至,陈晓出演一代商王,或可比肩《乔家大院》

最爱酷影视 浏览 5760

越南再爆地产大雷,股市重挫5%,创六个月来最大单日跌幅

华尔街见闻官方 浏览 5496

2027款AMG CLE63敞篷亮相 换装V8发动机

太平洋汽车 浏览 3957

王家卫繁花有黑幕!?

八卦疯叔 浏览 6166

挥别日上 免税市场洗牌

北京商报 浏览 4537

柬泰边境冲突:柬埔寨宣布退出本届东南亚运动会

上观新闻 浏览 4763

OrangePi 6 Plus 开发板公布:12 核 CPU,双 M.2 SSD 双 5GbE

IT之家 浏览 5539

BBA,势败如山倒

虎嗅APP 浏览 4455

金价暴跌后实探北京金店:有消费者拖行李箱“抄底”,回收变现需排队3个半小时

红星新闻 浏览 4295

痛批落马副市长的市长也落马了,你别笑

识局 浏览 4351

崔东树:2025年全国汽车市场总体走势较强 新能源商用车景气度走高

智通财经 浏览 4881

坦克300泰国版外观酷似“大G”!预计售价亲民,搭载2.4T柴油+9AT

小史谈车 浏览 4405

俄称打击乌军多处目标 乌称击退俄进攻

国际在线 浏览 5384
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
沪ICP备20017958号-1