关闭广告

新研究发现 AI 的最大破绽:不是不够聪明,而是不会“骂人”

IT之家2025-11-08 12:00:01563人阅读

IT之家11月8日消息,科技媒体Ars Technica今天(11月8日)发布博文,报道称最新研究称AI模型在社交媒体上极易被识破,其致命弱点竟是“过于礼貌”。

苏黎世大学、阿姆斯特丹大学、杜克大学和纽约大学的研究人员于近日联合发布报告指出,在社交媒体互动中,AI模型因其过于友好的情感基调而极易暴露身份。

研究团队开发的自动化分类器在 Twitter/X、Bluesky 和Reddit三大平台上进行测试,识别AI生成回复的准确率高达70% 至80%。这意味着,当你在网上遇到一个异常礼貌的回复时,对方很可能是一个试图融入人群却以失败告终的AI机器人。

为量化 AI 与人类语言的差距,该研究引入了一种名为“计算图灵测试”的新框架。与依赖人类主观判断的传统图灵测试不同,该框架运用自动化分类器和语言学分析,精准识别机器生成内容与人类原创内容的具体特征。

研究团队负责人、苏黎世大学的尼科洛・帕根(Nicolò Pagan)表示,即便校准相关模型,其输出内容仍在情感基调和情绪表达上与人类文本存在明显区别,这些深层情感线索成为识别AI的可靠依据。

研究的核心发现被称为“毒性特征暴露”。团队测试了包括Llama 3.1、Mistral 7B、Deepseek R1,Qwen 2.5在内的九款主流开源大语言模型。






相关研究内容

当被要求回复真实用户的社交媒体帖子时,这些AI模型始终无法达到人类帖子中常见的那种随意的负面情绪和自发的情感表达水平。在所有三个测试平台上,AI生成内容的“毒性”分数(衡量攻击性或负面情绪的指标)始终显著低于人类的真实回复。

为了弥补这一缺陷,研究人员尝试了多种优化策略,例如提供写作范例或进行上下文检索,以求在句子长度、词汇数量等结构性指标上更接近人类。然而,尽管这些结构差异有所缩小,情感基调上的根本差异依然顽固存在。这表明,让AI学会像人一样“不那么友好”,可能比让它变得更聪明还要困难。

IT之家附上参考地址

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

TVB颁奖礼红毯老龄化严重!50岁佘诗曼压轴,黄宗泽老到认不出

萌神木木 浏览 395 01-05

黄蜂24记三分133-126老鹰,鲍尔28+13,杰伦约翰逊43+11+9,特雷杨复出8+10

懂球帝 浏览 429 12-19

vivo黄韬亲自爆料新机X300:下周一发布,是X200 Pro mini的迭代

IT之家 浏览 532 10-11

美英之后,韩国也对太子集团出手了,陈志到底搞了多少钱?

北向财经 浏览 610 10-26

网友质疑"同享老婆梅"擦边 被发律师函要求公开道歉

封面新闻 浏览 226 05-28

中国公民需谨慎前往日本 四大原因披露

环球网资讯 浏览 458 11-17

演员狗狗“大黄”领奖,主人称其是“专业演员”

韩小娱 浏览 517 11-05

演完《与凤行》演《逍遥》,她减肥50斤

失宠的小野猪 浏览 448 01-07

贝克汉姆夫妇受打击:布鲁克林拿自家事当段子

万国明信片 浏览 171 06-17

vivo Y200「皓夜」图赏:6000mAh 蓝海电池、磐石抗摔结构

IT之家 浏览 16504 06-03

普通人秋天应该怎么穿衣?颜色选对、衣服穿对,简单又大方

静儿时尚达人 浏览 466 11-11

微胖中年女人别乱穿!3个核心搭配技巧,轻松穿出优雅时髦感

静儿时尚达人 浏览 419 12-30

小维阿:马赛的压力不让我意外,我在尤文效力过

懂球帝 浏览 442 11-08

"丑星"在深圳找了3个女友陪睡 还用四五部摄像机录像

文刀万 浏览 2914 02-02

具身智能开启汽车产业万亿新赛道

车质网 浏览 462 11-11

知名汽车智驾企业“停工放假”

电动知家 浏览 637 11-25

营收净利双增、高股息估值,伊利股份进入「戴维斯双击」时刻

节点财经 浏览 276 05-09

极兔速递三季度包裹量76.8亿件,同比增长23.1%

封面新闻 浏览 600 10-14

特斯拉回应停产4680电池:生产正顺利进行中

IT之家 浏览 19488 07-03

TA:弗兰-加西亚本预计将外租樱桃,对皇马放弃交易感到失望

懂球帝 浏览 409 02-03

英国教授来中国考察被震撼:堪称人类史上最伟大功绩

环球时报国际 浏览 208 06-02
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备2023013132号-2