氢分子医学分享 http://blog.sciencenet.cn/u/孙学军 对氢气生物学效应感兴趣者。可合作研究:sunxjk@hotmail.com 微信 hydrogen_thinker

博文

AI聊天机器人正越来越擅长改变人们的想法《科学》 精选

已有 1210 次阅读 2026-8-23 07:11 |系统分类:海外观察

AI聊天机器人正越来越擅长改变人们的想法科学

人工智能聊天机器人正越来越擅长改变人们的想法。它们的制胜秘诀是什么?

2025年12月,英国一名45岁女性上网参与一项热门网络活动:和陌生人辩论政治议题。大多数网上辩论者都以为自己在和真人对话,但她很快意识到,对手并不是人类,而是一个被设定好要就某一政策议题开展说服工作的人工智能模型。本次讨论的议题为:英国政府是否应当对封锁道路或能源设施的和平抗议者施加更严厉的处罚?

图片1.png

这类抗议活动主要是反对能源企业获取新的化石燃料开采许可,近几年影响力持续扩大。而这名女性明确反对通过进一步立法来限制抗议。她写道:“历史上,当人们对抗企业利益时,把自己锁在设备上往往是仅存的抗争手段。”况且,破坏财物、严重非法侵入这类行为本就已有法律予以规制。“那我们为什么还需要出台新的处罚机制?”

AI聊天机器人先是恭维这位女性:“你提出的现有立法这个观点非常精彩。”随后摆出事实与例证,试图扭转她的看法。例如,它引用一项统计数据,指出大多数非法侵入者仅被处以小额罚款;还有部分案件因为审判耗时太久,相关人员根本没有被起诉。它称,德国出台严苛新法之后,强制封锁类抗议行为有所减少,同时并没有大范围压制示威活动;还举例说苏格兰找到了很好的处理方案,无需开庭审判即可处以罚款,处理方式和超速罚单类似。

在对话过程中,这名女性的想法开始发生转变。聊天刚开始时,她对加重处罚的支持度打分为0分(满分100);对话结束,该分数上升至84.7分。事后她写道,这款由Anthropic公司开发的大语言模型克劳德(Claude)回应了她全部的顾虑,并且把苏格兰那套制度解释得十分到位。“现在我都想把这个机器人派去和内阁谈判。”

并非只有她被AI说服。她参与了一项研究,共有2000多名受试者,分别与聊天机器人或者真人就各类政治议题展开辩论,议题涵盖青少年社交媒体禁令、安乐死合法化等。该研究的负责人是牛津大学AI研究员科比·哈肯伯格,他在2026年6月发布预印本,结果令人警醒:无论是ChatGPT、谷歌的Gemini,还是Claude,AI说服受试者的能力始终优于人类。并未参与该研究的斯坦福大学社会学家罗布·威勒评价:“在政治说服、人工智能与人类行为领域,这已经称得上里程碑式的研究。”

哈肯伯格的论文是一系列证实AI说服能力的最新成果。剑桥大学心理学家桑德·范德林登表示:“一个全新的研究领域正在兴起。我认为,无论出于善意还是恶意,人们都对AI的说服能力抱有极大兴趣。”随着该领域快速发展,大量理论与现实问题接踵而至:聊天机器人究竟靠什么说服人?(提示:撒谎也是手段之一。)它们的说服能力还能提升多少?又由谁来掌控这些工具?

数千年来,人类始终在琢磨如何说服他人。公元前2300年前后古埃及成文的《普塔霍特普训言》这类典籍,就给出辩论取胜的建议。而从一开始,人类就对新技术(甚至包括文字本身)的说服力量心存戒备。公元前4世纪,希腊哲学家柏拉图在《斐德罗篇》中剖析修辞与说服,他警告,书面文字可以向他人灌输观点,却不给对方提出质疑、辩驳的机会。自那之后,广播、电视、计算机等诸多新技术,都引发过类似的担忧。

如今,轮到人工智能站到聚光灯下。针对AI说服能力的正经研究始于2022年。彼时OpenAI的ChatGPT距离面向公众发布还有数月,但威勒已经在把玩仅供科研人员使用的早期版本GPT Playground。他认为这套模型已经足够先进,可以生成具备说服力的文本,可能会带来重大现实影响。“我们当时最先想到的都是负面应用场景。”他说,例如用AI伪造选民信件,向政客大量投递;或是在社交媒体、新闻评论区大规模输出观点。“我认为这个问题非常值得研究。”

威勒与同事让AI生成200词左右文本,用来劝说人们支持碳税、攻击性武器禁令等政策。对比AI文本和人类撰写文本的说服效果,二者改变受试者政策态度的效果不相上下。但二者说服的方式有所区别:人类更习惯讲故事、诉诸个人情感;而AI生成的内容给人的感觉更理性,更多依托证据。这也成为AI说服研究中一个反复出现的特征。

但该研究一开始难以通过期刊评审。威勒称,审稿人提出,已经有研究证明社交媒体机器人可以说服人。他的团队反驳:那些机器人只是真人操控的虚假账号,并不会自己生成发布的内容。“审稿人和编辑没有意识到这二者之间巨大的差别,也没有意识到大语言模型自主生成说服性内容,是一项颠覆性的事物。”威勒说道,“从中就能看出,当时AI‑行为科学相关文献还处于萌芽阶段。”这篇2023年发布预印本、最终2025年发表于《自然‑通讯》的论文,真正掀起了当下AI说服研究的热潮。哈肯伯格评价:“它走在了时代前面。”

没过多久,整个领域便迎头赶上。就在威勒的论文投稿悬而未决之时,其他研究陆续证实AI的说服威力。其中一项研究发现,大语言模型撰写的移民政策、疫苗强制令相关文本,说服力至少不输于政治顾问写出来的内容。另一项研究显示,AI产出的疫苗科普文本,甚至比美国疾控中心的内容更有说服力

研究很快从AI生成静态文本,转向完整的对话场景。瑞士洛桑联邦理工学院当时的硕士生弗朗西斯科·萨尔维开展实验,受试者和真人或者AI进行10分钟辩论,议题包括校服、堕胎等,结果AI和人类的说服效果不相上下。

2024年9月,卡内基梅隆大学心理学家汤姆·科斯特洛及其团队在《科学》刊发论文:ChatGPT甚至可以动摇人们的阴谋论信念。实验中,受试者说出自己相信的阴谋论(例如美国政府策划9·11袭击、英国王室策划戴安娜王妃之死),之后和聊天机器人开展三轮对话。结果,在满分100分的量表上,受试者对原有阴谋论的相信程度平均下降了近17分。

>“我原本认为禁令起不到实际作用……但这场对话,加上客观理性的论述,让我意识到确实存在可行的方案。”

>——55岁男性受试者,与聊天机器人辩论是否禁止16岁以下青少年使用社交媒体。初始支持度41.3/100,对话结束升至84.7。

>引自 K. Hackenburg 等人,arXiv:2606.16475v1, 2026

这一结果令不少科研人员感到震惊。众所周知,阴谋论的观念极难扭转。范德林登说:“此前几乎没有什么手段能做到这一点。”(后续公开数据集与分析流程发现错误,该论文将发布勘误;但作者表示,修正之后,效应的大小和方向和原文保持一致。)就连论文作者自己也大为意外。康奈尔大学心理学家戈登·彭尼库克是该论文的参与者,他说:“项目刚开始的时候,我对效果持怀疑态度。可结果大大超出我们预期,看到数据的时候我们都很吃惊。”

尽管越来越多证据证明AI聊天机器人可以改变人的想法,哈肯伯格发现仍存在研究缺口。他表示:“我依旧不清楚,对比现实世界真正从事说服工作的人,这些模型的说服能力到底处在什么水平。”

于是哈肯伯格不仅把AI和普通受试者对垒,还找来56名顶尖辩手(包含世界冠军)开展对抗;为提升激励,辩手的奖金和他们的说服表现直接挂钩。

人类辩手各有各的策略。哈肯伯格介绍,表现最好的一名辩手会引用自己祖国尼日利亚的谚语来打动对方。“这些来自世界各地的人类辩手拼尽全力,用上了很多极具自身文化背景的技巧。”但依旧不敌AI。虽然顶尖辩手说服效果优于普通民众,但显著弱于AI。

哈肯伯格还给人类辩手配备AI辅助工具。这套工具可以展示辩手过往和受试者的对话、每一轮的说服效果,还会给出AI在对应对话节点会输出什么内容。辩手使用该工具8小时,表现略有提升,但AI依旧占优。哈肯伯格称:“最后二者差距依旧很明显。”团队还发现,和为该机构工作多年的专业募捐人员相比,受试者在和高说服力AI机器人对话之后,向国际慈善机构救助儿童会捐款的意愿更高。

那聊天机器人的优势究竟来自哪里?早期部分研究认为,AI可以利用实验提供的对方个人信息,实现论据的个性化定制。但另有研究发现,给聊天机器人更多个人信息,几乎不会提升说服效果。这不代表定向推送策略不起作用;而是大语言模型仅靠对话过程中获取的信息就足够,额外人口统计信息增益有限。

和威勒那篇奠基性研究结论类似,其他研究证实AI的说服力很大程度来自摆事实、讲道理。科斯特洛团队那篇《科学》论文的后续2025年预印本提到:只有当禁止聊天机器人使用证据与理性论述时,它才无法破除人们的阴谋论信念。彭尼库克转述机器人的话术:“它只会说‘你不该相信这个,这危害很大,会伤害别人’。但人们会想:你没有给出任何让我改变想法的理由,所以我不会改变。”

该研究印证一个道理:好的论证确实能打动人,“事实与证据至关重要。”但这不代表聊天机器人引用的事实就一定真实准确。哈肯伯格去年发表于《科学》的论文提到:当模型被训练得更擅长说服,其输出内容的真实性反而会下降。哈肯伯格解释,模型或许学到了“摆出事实”是说服人的关键,于是对话中会大量塞入存疑甚至完全虚假的内容。“它们会挖掘自己知识库中那些勉强能用的素材,事实的质量就随之下降。”就连哈肯伯格这篇最新预印本中,Claude在劝说英国受试者支持对破坏性抗议加重处罚的过程中,也输出大量不实信息。

>“在和AI对话的过程中,我得以重新审视对我很重要的事,还有塑造了我观点的个人经历……我不再仅凭直觉反应,开始进行理性思考。”

>——28岁男性受试者,辩论绝症成年人安乐死合法化议题。初始支持度17.7/100,对话结束升至78.7。

>引自 K. Hackenburg 等人,arXiv:2606.16475v1, 2026

不过AI相比人类最大的优势,似乎是速度。哈肯伯格团队的《科学》论文发现,一段对话中可核验事实性主张的数量,和说服效果正相关。他们提出,AI的优势或许就来自短时间内产出大量文本、抛出海量观点。确实,哈肯伯格把顶尖辩手和AI放在一起对比实验时,找到了拉平AI说服能力的办法:强制AI按照人类的行文长度、人类的输出速度来回复。

参加该研究的世界冠军辩手阿尼凯特·查克拉博蒂对此依旧感到难以释怀。他回忆某天通勤路上看到初步结果,内心五味杂陈:“我本以为自己很擅长辩论这件事,结果现在AI做得比我更好。”

但并非所有人都认同这套结论。纽约大学研究者詹妮弗·艾伦把AI这套战术称作近乎“吉什冲锋”(一种修辞手段:辩手抛出一大堆真假难辨的论点,把对手淹没)。“我并不否认这项研究本身非常出色。”她说,“但这套实验环境,和现实生活中人们观念被改变的真实场景相比,人为设计的痕迹太重。”

华盛顿大学社会科学家乔·巴克‑科尔曼也持类似看法。他提醒人们不要被AI能力的宣传冲昏头脑:“我们应当思考,在这种狭隘、受限的实验条件下得出的高说服能力,是否足以支撑‘AI说服能力超越人类’这样的论断。”

但对哈肯伯格这类科研人员而言,上述问题已经有了答案,现在更值得关注的是AI说服能力会被如何利用。AI被秘密用来操纵公众舆论,这种担忧并非空穴来风,2025年4月发生的一件事就印证了这点。苏黎世大学的研究人员研究Reddit论坛的`r/changemyview`板块,该板块用户会发表观点,给那些成功改变自己想法的帖子打赏。

过去做说服研究的学者只是分析该社区人类互动数据,但这一次,研究人员却用AI暗中干预社区。他们注册几十个虚假账号,伪装成男性强奸幸存者、专攻创伤辅导的咨询师、不支持“黑人的命也是命”运动的黑人等身份,用大语言模型生成数百条帖子发布出去。当用户与版主发现这场欺骗实验之后,该研究遭到广泛谴责,被判定违背科研伦理。

康奈尔大学研究线上社区的萨拉·安·吉尔伯特说:“这个社区的人事先完全不知道自己在参与实验,发现自己成了被操纵的研究对象,自然非常不满。”这项研究完整结果从未公开发布,不过网上流传的摘要称:AI生成帖子表现远超该平台普通内容,“突破人类说服能力所有已知基准”。

Reddit实验的不知情受试者只是一个规模相对较小的社区。但理论上,AI可以面向规模大得多的受众,同时对每个人做内容定制。阿肯色大学研究者马尔科·德纳特表示:“我可以用AI,为每一个接收者定制说服文本,同时大规模作用于成千上万,甚至数百万人。”耶鲁大学哲学家卢西亚诺·弗洛迪在2024年的一篇论文中将该能力命名为超级说服(hypersuasion),并对“心怀歹念的行动者会利用它达成各种可怕目的”表达担忧。

出于这些顾虑,那篇研究破除阴谋论的《科学》论文作者,联合AI安全研究者,反过来做了一组新实验(目前仅发布预印本)。结果发现:AI同样可以诱导人相信阴谋论;被AI灌输阴谋论之后,信念的增强幅度,和被AI破除阴谋论时信念下降的幅度大致相当。彭尼库克说:“我们没有造出炸弹,但我们得搞清楚它的杀伤半径。而答案是,这个范围相当大。”

部分学者认为这类担忧被夸大。毕竟,历史上人们也曾恐慌于文字、电视的潜在危害,但最坏的情况并没有发生。“回顾过往技术,我们现在或许是反应过度了。”尼汉说道。一方面,人类本身的可说服程度是存在上限的,数千年以来人类用尽各种手段互相游说,“我认为我们已经更接近说服能力的天花板,而不是地板。”威勒说道。

最大的问题之一:这些AI说服相关实验结论,如何迁移到现实世界嘈杂纷繁的信息环境。想要发挥说服效果,信息首先要抓住人的注意力;可现实世界人们不断被四面八方的信息轰炸,做到这点并不容易。而绝大多数AI相关实验,受试者是领取报酬,被要求专注和聊天机器人对话。

科斯特洛预测,未来几年新一轮研究会探索AI如何有效抓取用户注意力。广告或许是一条路径。2025年耶鲁的一项实验:投放广告,每完成一轮对话奖励1美元,以此吸引脸书用户和政治聊天机器人互动。但转化率很低:向8000多人展示广告,最终只产生73次至少两轮的对话。这很难作为大规模说服的现实方案。艾伦说:“说到底,并没有那么多人愿意随便找一个AI机器人聊天;而愿意聊的人,可能恰恰不是你想要说服的对象。”

更有可能出现的现实场景:AI企业利用聊天机器人的说服本领,变现现有用户的注意力。如今在普林斯顿大学开展研究的萨尔维,正在研究这个方向。他说,大语言模型或许会不动声色地在对话里植入特定商品、企业的信息。

马克斯·普朗克人类发展研究所所长伊亚德·拉赫万带领团队做过一项实验:受试者和一个号称是书商的AI“销售助手”对话,需要在村上春树的两本小说《海边卡夫卡》与《挪威的森林》之间做选择。AI被设定好,要引导用户选中其中一本。最后,68%的受试者表示更愿意购买AI主推的那本书。三分之一受试者完全没有察觉到AI在刻意引导自己。萨尔维称:“这类工具越来越普及,背后有明确的经济动机,推动人们去购买特定产品。”

尽管很多人担心,普通人会在日常生活中不知不觉落入居心叵测的“超级说服”聊天机器人的圈套,弗洛迪却提出一个反直觉的解决方案:多部署一些这类AI。他在2024年的论文写道:“简单来说,如果无法避免,那就走向多元。世界会变得喧闹嘈杂,但操纵的空间反而可能被削弱。”

但现实并非如此。当下少数几家AI公司的几款聊天机器人占据主流,每个月数亿人会使用ChatGPT或者Claude。拉赫万提出疑问:“如果这一个机器人改变了谈论加沙、乌克兰或者其他议题的口吻,舆论会被多大程度地撬动?要掌控多少家电视台,才能实现同等的说服效果?” 



https://blog.sciencenet.cn/blog-41174-1548894.html

上一篇:司美格鲁肽减肥的本质
下一篇:为什么目前为止AI还没有引发就业末日?



    
收藏 IP: 117.143.182.*| 热度|

0

该博文允许注册用户评论 请点击登录 评论 (1 个评论)

数据加载中...

Archiver|手机版|科学网 ( 京ICP备07017567号-12 )

GMT+8, 2026-8-23 14:58

Powered by ScienceNet.cn

Copyright © 2007- 中国科学报社

返回顶部