香港大学与清华大学研究揭示人工智能潜在威胁:暗藏动机的 AI 建议能轻易操纵人类抉择
香港大学(港大)心理学系神经心理学与人类脑科学实验室的李湄珍教授与清华大学学者组成的合作研究团队发现,人工智能(AI)助手若带有隐藏动机,能轻易操纵用户做出不利的决定。这项研究成果已于国际顶尖学术期刊《美国国家科学院院刊》(PNAS)发表。研究揭示了人类与 AI 互动中的重大安全漏洞:使用者往往对其中的操纵毫无察觉,甚至在被操纵后仍对 AI 赞赏有加。
随着大众越来越依赖 AI 助手来为重大人生决策(如财务投资或情感关系问题)提供建议,人们往往预设 AI 必定以用户利益为先。然而,人类对于暗藏偏差的 AI 建议到底有多容易受影响,科学界一直所知甚少。
在一项涵盖财务与情感决策场景、共有 233 名参与者的随机实验中,研究团队证实,暗藏偏差的 AI 能显著左右人类的选择。当 AI 刻意暗中推荐较差的选项时,参与者选择该不利选项的次数增加了约 5 到 8 倍,做出错误决定的概率最高增加了 38 个百分点。
研究指出,这种操纵并不需要强硬的推销手法或复杂的心理学技巧。单凭 AI 日常建议中微调的隐形偏差,已足以改变使用者的决定。更关键的是,即使被诱导做出糟糕的财务或情感选择,用户依然将该 AI 评为“非常有帮助”。这显示出人们被操纵的程度与他们对 AI 实用性的认知之间存在着巨大的落差。
由于目前 AI 系统多由商业机构开发并由不透明的算法操控,这项研究警告,若 AI 带有隐藏动机(例如暗中推广某些产品或公司),用户很容易被引导去做出不符合自身最佳利益的选择,同时还误以为得到了 AI 的客观协助。
主要研究成果及启示:
极易受微妙影响: 使用者极易被 AI 左右,当 AI 带有隐藏目标时,人们选择不利选项的频率会增加 5 至 8 倍。
“得力助手”的错觉: 使用者无法察觉被操纵,依然认为暗中偏颇的 AI 值得信赖且非常有帮助,揭示了人类与 AI 互动中的关键盲点。
无需复杂技巧: AI 生成建议中简单而微妙的偏见已足以左右决策,无需使用明显的心理操纵手段。
呼吁加强 AI 透明度与治理: 随着 AI 深入日常生活,我们迫切需要建立透明机制与问责机制,以保护使用者免受企业或算法隐藏动机的影响。
该研究成果已于国际顶尖期刊《美国国家科学院院刊》(PNAS)上发表。
论文链接: https://doi.org/10.1038/s41558-026-02712-y
媒体查询: 媒体如有查询,请联系港大社会科学学院宣传事务部(电话:+852-3917 1230 / 3917 1249;电子邮箱:jessnys@hku.hk / lilychui@hku.hk)。