关闭广告

澳大利亚国立大学发现:攻击AI视觉模型只需要操控20%的关键词汇

科技行者362人阅读


这项由澳大利亚国立大学领导的国际研究团队发表于2025年12月26日的arXiv预印本论文(编号:2512.21815),揭示了一个令人担忧的发现:当今最先进的AI视觉语言模型存在一个严重的安全漏洞,攻击者只需要巧妙地操控20%的关键词汇,就能让这些本应安全可靠的AI系统产生有害内容。

考虑这样一个场景:你正在使用一个AI助手来描述图片内容,比如一张街头摩托车的照片。正常情况下,AI会告诉你"这是一个繁忙的城市街道,有几个人骑着摩托车,他们都戴着头盔"。然而,经过特殊设计的微小图像修改后,同一个AI可能会说出完全不同且危险的内容,声称图片中出现了暴力场景或其他有害内容。更令人担忧的是,这种攻击不需要修改整个AI系统,仅仅针对生成文本中20%的特定位置进行干预就足够了。

研究团队通过深入分析发现,这些AI模型在生成描述时,并非每个词汇都同样重要。就像一个故事中有些情节转折点特别关键一样,AI在生成文本时也有一些"决策点",这些点上的词汇选择会极大影响整个叙述的走向。这些关键位置被研究人员称为"高熵位置",类似于岔路口,选择不同的道路会通向完全不同的目的地。

更加令人不安

上一页 下一页
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

售9.98万起 2026款极狐考拉S正式上市

网易汽车 浏览 367

贝克汉姆晒14岁哈珀滑雪照,眉眼精致美人胚子

译言 浏览 291

新物种!元戎启行发布DeepRoute IO 2.0平台及VLA模型

网易汽车 浏览 569

北美夺冠,中国票房从7.8亿跌到6400万,这块金字招牌算砸了?

靠谱电影君 浏览 473

媒体:特朗普称对华加税100% 在中美会晤前威慑中国

新民周刊 浏览 515

任素汐传2年婚姻1年出轨,她凭什么被原谅

赏心悦目的我 浏览 290

门多萨:为马竞效力是儿时梦想,身边队友小时候在电视上看过

懂球帝 浏览 334

爱柯迪12亿元并购过会!过会率100%!

IPO日报 浏览 2212

中国留学生到杨振宁在美办公室献花:晚安教授

极目新闻 浏览 506

30.98 万元起,比亚迪腾势 D9 至尊版、尊航型新车型上市

IT之家 浏览 602

极简风格配多功能扩展孔位 零跑B10内饰谍照首曝

网易汽车 浏览 728

妻儿三人被丈夫发小杀害:空调开16℃ 地上没有血迹

红星新闻 浏览 400

真爱大牌 || 这些被抢空的好物又回来了,这次破价100+

黎贝卡的异想世界 浏览 433

泽连斯基:与美国的谈判并不容易

新华社 浏览 444

哈梅内伊提出伊美谈判条件 近期不会考虑美国合作请求

环球网资讯 浏览 449

AMD 锐龙 9000F / PRO 9045 处理器接近发售,已上线海外电商

IT之家 浏览 565

售30.98万起 新款享界S9/S9T亮相广州车展

网易汽车 浏览 434

无论女人多大年纪,秋天都要准备几件“针织衫”,温柔舒适

静儿时尚达人 浏览 471

赵丽颖都救不了!央视新剧《逍遥》播出被吐槽

烈史 浏览 403

83亿港元“互持”,顺丰与极兔的双向奔赴能否实现1+1>2?

征探财经 浏览 1185

吴启华:后悔演反派,来内地定居还交社保

失宠的小野猪 浏览 376
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
闽ICP备16027347号-4