关闭广告

东南大学团队首次揭示:视觉欺骗如何让AI"看走眼"

科技行者5627人阅读


这项由东南大学计算机科学与工程学院的陈慧怡、彭佳伟、杨旭等研究人员,联合同济大学国豪学院陈凯杰,以及伊利诺伊大学芝加哥分校的闵德海、孙常昌、严岩、程璐等学者共同完成的突破性研究,于2024年11月发表在arXiv预印本平台(编号:arXiv:2511.14159v1)。研究团队首次创建了专门用于评估大型视觉语言模型(类似于能看图说话的AI系统)在面对视觉误导时表现的综合性测试基准。

要理解这项研究的重要性,我们可以把AI模型比作一个正在学习观察世界的学生。过去,研究人员主要关注的是如何通过文字来"误导"这个学生,就像给他一个包含错误信息的题目。然而,在现实世界中,视觉本身就经常带有欺骗性——就像我们有时会把远处的灯光误认为星星,或者在昏暗的光线下把一把椅子看成人影。这种视觉上的"错觉"对AI来说同样是个挑战,但此前却很少有人系统性地研究过这个问题。

研究团队发现,现有的AI模型评估基准主要集中在两个方面:一是检测AI是否会产生"幻觉"(即编造不存在的内容),二是测试它们对恶意攻击的抵抗能力。然而,这些测试都忽略了一个关键问题:当视觉信息本身就容易产生误解时,AI会如何表现。这就像我们一直在测试学生能否正确回答

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

匿名者向五角大楼捐赠1.3亿美元 支付政府停摆期间美军薪资

澎湃新闻 浏览 6438

年薪300万请来LV高管!泡泡玛特“奢侈品化”的生死赌局

杠杆游戏 浏览 6165

亚马逊AWS将部署英伟达Groq LPU与超百万块GPU

IT之家 浏览 4752

斯卡洛尼:如果处理得更好比赛早结束了;我想尝试532阵型

懂球帝 浏览 6709

端侧AI赋能千行百业 2025 Ceva技术研讨会助力产业升级

爱集微 浏览 6268

347亿市值三一重能,80后出任董事长,身家超过4.7亿

华美财经 浏览 6454

俄乌“和平计划”磋商顿巴斯成焦点

环球网资讯 浏览 6050

美顶级战机制造商干涉台湾被大陆制裁 进入"慢性死亡"

博览历史 浏览 9189

钉钉和AI抢时间

虎嗅APP 浏览 6008

京东11.11购物节官宣:10月9日晚8点正式开启

快科技 浏览 7142

茶里回应欠薪:大部分在职员工欠薪兑付已完成,离职员工欠薪问题正分批解决

红星资本局 浏览 5568

2026开年,就创造了10个“第一”,这国综后劲真大

娱乐圈笔娱君 浏览 5636

人民日报:警惕日本战略走向的危险转向

人民网-人民日报 浏览 47330

河南最大城商行迎博士行长,曾任濮阳副市长、为湖南大学校友

湘财Plus 浏览 6976

NBA战报:雷霆94-91险胜掘金,沃特森15分

懂球帝 浏览 6628

董忠云:保持战略定力,增强必胜信心,A股有望恢复震荡上行趋势

首席经济学家论坛 浏览 6435

2026北京车展,38万平方面的骄傲、焦虑与追问

汽势传媒 浏览 3649

Artificial Analysis评测新鲜出炉:Kimi K2 thinking位居世界第二,开源第一

AI寒武纪 浏览 6474

苹果天气App昨晚出现宕机,目前异常已修复

三言科技 浏览 3694

保壳悬了?*ST赛隆预计2025年营收猛增,审计机构却上任不足半月“闪辞”

时代周报 浏览 5557

文晏回应争奖!直言不认识白百何否认沪圈投资,白百何再次内涵

萌神木木 浏览 6515
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
沪ICP备20017958号-1