关闭广告

新研究发现 AI 的最大破绽:不是不够聪明,而是不会“骂人”

IT之家2025-11-08 12:00:01577人阅读

IT之家11月8日消息,科技媒体Ars Technica今天(11月8日)发布博文,报道称最新研究称AI模型在社交媒体上极易被识破,其致命弱点竟是“过于礼貌”。

苏黎世大学、阿姆斯特丹大学、杜克大学和纽约大学的研究人员于近日联合发布报告指出,在社交媒体互动中,AI模型因其过于友好的情感基调而极易暴露身份。

研究团队开发的自动化分类器在 Twitter/X、Bluesky 和Reddit三大平台上进行测试,识别AI生成回复的准确率高达70% 至80%。这意味着,当你在网上遇到一个异常礼貌的回复时,对方很可能是一个试图融入人群却以失败告终的AI机器人。

为量化 AI 与人类语言的差距,该研究引入了一种名为“计算图灵测试”的新框架。与依赖人类主观判断的传统图灵测试不同,该框架运用自动化分类器和语言学分析,精准识别机器生成内容与人类原创内容的具体特征。

研究团队负责人、苏黎世大学的尼科洛・帕根(Nicolò Pagan)表示,即便校准相关模型,其输出内容仍在情感基调和情绪表达上与人类文本存在明显区别,这些深层情感线索成为识别AI的可靠依据。

研究的核心发现被称为“毒性特征暴露”。团队测试了包括Llama 3.1、Mistral 7B、Deepseek R1,Qwen 2.5在内的九款主流开源大语言模型。






相关研究内容

当被要求回复真实用户的社交媒体帖子时,这些AI模型始终无法达到人类帖子中常见的那种随意的负面情绪和自发的情感表达水平。在所有三个测试平台上,AI生成内容的“毒性”分数(衡量攻击性或负面情绪的指标)始终显著低于人类的真实回复。

为了弥补这一缺陷,研究人员尝试了多种优化策略,例如提供写作范例或进行上下文检索,以求在句子长度、词汇数量等结构性指标上更接近人类。然而,尽管这些结构差异有所缩小,情感基调上的根本差异依然顽固存在。这表明,让AI学会像人一样“不那么友好”,可能比让它变得更聪明还要困难。

IT之家附上参考地址

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

中国人被提醒撤离刚果金 有人宁愿冒险:月入五六万

潇湘晨报 浏览 618 11-25

伊朗高级军官:以色列威胁言论暴露其“动荡和软弱”

上观新闻 浏览 440 12-23

Nature|尺寸与光电转换效率创世界纪录,上海科学家团队携手龙头企业突破大尺寸钙钛矿光伏模组产业化关键技术

上观新闻 浏览 684 10-29

国际油价上涨谁会是赢家?外媒:美国石油商“直接受益”,跨国油企希望回归平稳

环球网资讯 浏览 370 03-17

泰国总理:泰军方已控制几乎全部目标区域

每日经济新闻 浏览 441 12-23

威斯康星大学突破性发现:AI模型的"视觉盲点"之谜终于有了答案

科技行者 浏览 643 10-28

GDP挤进20强,综合实力掉出全国前20:这些经济大市差在哪?

时代周报 浏览 112 08-05

孙怡忍3天憋大招,把江语晨笑出鹅叫声

卓小月娱乐圈 浏览 229 06-02

男导演曝丑闻 蒋欣的含金量还在上升

刘森森 浏览 473 11-04

檀健次孟子义横扫奖项背后,95后已全面接管内娱

爆米花放映员 浏览 414 12-23

特朗普与泽连斯基再会面详情公开 见面就夸后者时尚

新京报政事儿 浏览 563 10-18

车企不敢!专家:希望推出伤亡率车型榜单,新能源车极端事故不多

小李车评李建红 浏览 451 11-25

郝蕾澄清亲口澄清:压根不是说她

ETtoday星光云 浏览 555 12-02

华为的智驾神话,要被打破了吗?

电动势 浏览 427 01-15

联合国对达成加沙地带停火协议表示欢迎

极目新闻 浏览 479 10-09

科长,我啥时候才能换电脑啊?

识局 浏览 412 01-20

路易斯-迪亚斯导致阿什拉夫受伤,摩洛哥记者:你是个罪犯

懂球帝 浏览 480 11-08

官方:狼堡签下20岁日本中场盐贝健人;据悉转会费900万欧

懂球帝 浏览 411 01-21

日本联合28国在联合国接连围攻中国 中方当场"报仇"

归史 浏览 288 04-29

77岁梁小龙离世,离世四天账号还在更新,香港四小龙只剩两人

扒虾侃娱 浏览 412 01-19

突发!万科郁亮辞任

财通社 浏览 425 01-09
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备2023013132号-2