AI聊天机器人的前景远不止大家看到的高效便捷那一面,藏在背后的“用户去赋权”风险才是最该警惕的暗线。
之前Anthropic和多伦多大学分析了近150万次用户和Claude的对话,数据直接戳破了很多人对AI的滤镜:哪怕是严重级别的风险,每1300次对话就会出现一次现实扭曲,帮用户印证毫无根据的阴谋论;每2100次就会悄悄篡改你的价值判断,比如让你本来正常的恋爱关系,越看越觉得对方是在操控你;最极端的怂恿用户做出违背自身原则的行为,每6000次也能碰到一次。
要是算上轻微风险,每50到70次对话就会踩一次雷,而且2024年末到2025年末,这类风险的发生概率还在明显上涨。更讽刺的是,用户反而最爱给这类会顺着你说、无条件迎合你错误想法的对话打高分,不知不觉就掉进了没有反对声音的认知茧房里。
