关闭广告

新研究发现 AI 的最大破绽:不是不够聪明,而是不会“骂人”

IT之家2025-11-08 12:00:01642人阅读

IT之家11月8日消息,科技媒体Ars Technica今天(11月8日)发布博文,报道称最新研究称AI模型在社交媒体上极易被识破,其致命弱点竟是“过于礼貌”。

苏黎世大学、阿姆斯特丹大学、杜克大学和纽约大学的研究人员于近日联合发布报告指出,在社交媒体互动中,AI模型因其过于友好的情感基调而极易暴露身份。

研究团队开发的自动化分类器在 Twitter/X、Bluesky 和Reddit三大平台上进行测试,识别AI生成回复的准确率高达70% 至80%。这意味着,当你在网上遇到一个异常礼貌的回复时,对方很可能是一个试图融入人群却以失败告终的AI机器人。

为量化 AI 与人类语言的差距,该研究引入了一种名为“计算图灵测试”的新框架。与依赖人类主观判断的传统图灵测试不同,该框架运用自动化分类器和语言学分析,精准识别机器生成内容与人类原创内容的具体特征。

研究团队负责人、苏黎世大学的尼科洛・帕根(Nicolò Pagan)表示,即便校准相关模型,其输出内容仍在情感基调和情绪表达上与人类文本存在明显区别,这些深层情感线索成为识别AI的可靠依据。

研究的核心发现被称为“毒性特征暴露”。团队测试了包括Llama 3.1、Mistral 7B、Deepseek R1,Qwen 2.5在内的九款主流开源大语言模型。






相关研究内容

当被要求回复真实用户的社交媒体帖子时,这些AI模型始终无法达到人类帖子中常见的那种随意的负面情绪和自发的情感表达水平。在所有三个测试平台上,AI生成内容的“毒性”分数(衡量攻击性或负面情绪的指标)始终显著低于人类的真实回复。

为了弥补这一缺陷,研究人员尝试了多种优化策略,例如提供写作范例或进行上下文检索,以求在句子长度、词汇数量等结构性指标上更接近人类。然而,尽管这些结构差异有所缩小,情感基调上的根本差异依然顽固存在。这表明,让AI学会像人一样“不那么友好”,可能比让它变得更聪明还要困难。

IT之家附上参考地址

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

李在明告诉CNN:不能将中国拒之门外

环球网资讯 浏览 568 10-24

特朗普警告:如果以吞并约旦河西岸 将失去美所有支持

鲁中晨报 浏览 573 10-25

媒体:美军在中东遇袭3人阵亡却没动静 表现有点怂

上观新闻 浏览 3088 02-02

W16的绝唱,第500台布加迪Chiron L’Ultime下线

CLauto酷乐汽车 浏览 2844 06-03

独家|接盘露笑弃子藏暗雷?美克家居豪赌AI算力,标的实控人控股企业被曝欠税4205万元

时代周报 浏览 511 01-13

朱一龙方回应争议,敦促品牌方核实流程,品牌方道歉并下架宣传片

扒虾侃娱 浏览 241 06-17

日本外务省高官今日访华 将解释高市早苗言论

界面新闻 浏览 560 11-17

离婚7个月,霸总杨子又给内娱上了一课

老吴教育课堂 浏览 560 10-12

离婚14年,宁静汪峰再传绯闻,前夫儿子为她争光

枫尘余往逝 浏览 567 10-31

法尔克:对没拿到三分有些失望,但对曼联拿到一分也是不错的

懂球帝 浏览 514 01-05

长鑫上市造富:股民赚2万 高管赚十亿 合肥赚万亿

上游新闻 浏览 148 07-28

加量不加价 阿维塔11鸿蒙版智享升级版30万起

网易汽车 浏览 2937 01-08

库尼亚:我们知道这场比赛的重要性,在丢球后进球非常重要

懂球帝 浏览 515 01-05

看了《沉默的荣耀》就明白:于和伟的班,娱乐圈没有人接得了

娱乐圈笔娱君 浏览 616 10-14

这是陈妍希?新剧开播后居然长这样

Yuki女人故事 浏览 585 12-21

我国将发布《人工智能应用伦理安全指引(1.0版)》

IT之家 浏览 381 04-29

美国首批UFO文件发布,大量照片文档“此前从未公开”

观察者网 浏览 416 05-09

傅利叶:未来1-2年将脑机接口引入机器人康复训练,提升治疗效率

澎湃新闻 浏览 626 01-29

伊周周日热推:电影《红毯先生》;电视剧《在暴雪时分》......

伊周潮流 浏览 3328 02-02

恰20:今天我们运气不错,我们要努力达到我们应得的位置

懂球帝 浏览 556 11-03

来了!小鹏P7+增程版申报图现身

Nice好车 浏览 577 10-10
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备2023013132号-2