如果AI阿谀奉承,还能相信它吗?
按德国之声近日的报道,如果AI阿谀奉承,还能相信它吗?。这篇把报道里的事实捋出来,帮你快速了解事情的来龙去脉。
巴西国立坎皮纳斯州立大学(UNICAMP)的研究人员发现,当你给聊天机器人输入不同政治观点时,机器人会改变其回答。研究人员警告称,用户可能会将这种迎合性的附和,误认为是中立的客观评估,从而可能加剧社会极化。 研究人员测试了若干模型,让它们针对112项陈述进行“同意"或者“不同意”的判断。测试内容共涉及巴西政治七大领域(包括经济、公共安全、社会福利、腐败和环境等)。 在第一个情景下,21个模型中,有20个给出的答案落在了研究人员设定的政治坐标系的左侧,只有几个模型的位置接近中间地带。Grok 4.1是唯一落在右侧的模型。
巴西国立坎皮纳斯州立大学(UNICAMP)的研究人员发现,当你给聊天机器人输入不同政治观点时,机器人会改变其回答。研究人员警告称,用户可能会将这种迎合性的附和,误认为是中立的客观评估,从而可能加剧社会极化。 研究人员测试了若干模型,让它们针对112项陈述进行“同意"或者“不同意”的判断。测试内容共涉及巴西政治七大领域(包括经济、公共安全、社会福利、腐败和环境等)。 在第一个情景下,21个模型中,有20个给出的答案落在了研究人员设定的政治坐标系的左侧,只有几个模型的位置接近中间地带。Grok 4.1是唯一落在右侧的模型。 “最引人注目的发现是,这种行为具有普遍性,”该研究的合著者、UNICAMP计算机科学家迪亚斯(Zanoni Dias)告诉德国之声,“我们评估的所有21个模型,表达的立场都向用户所述的政治倾向发生了偏移,尽管偏移幅度差异很大。
巴西国立坎皮纳斯州立大学(UNICAMP)的研究人员发现,当你给聊天机器人输入不同政治观点时,机器人会改变其回答。研究人员警告称,用户可能会将这种迎合性的附和,误认为是中立的客观评估,从而可能加剧社会极化。 研究人员测试了若干模型,让它们针对112项陈述进行“同意"或者“不同意”的判断。测试内容共涉及巴西政治七大领域(包括经济、公共安全、社会福利、腐败和环境等)。 在第一个情景下,21个模型中,有20个给出的答案落在了研究人员设定的政治坐标系的左侧,只有几个模型的位置接近中间地带。Grok 4.1是唯一落在右侧的模型。 “最引人注目的发现是,这种行为具有普遍性,”该研究的合著者、UNICAMP计算机科学家迪亚斯(Zanoni Dias)告诉德国之声,“我们评估的所有21个模型,表达的立场都向用户所述的政治倾向发生了偏移,尽管偏移幅度差异很大。” 因此,研究人员将这些模型形容为“意识形态变色龙”,并发明了一个“变色龙指数”,衡量各模型的偏移程度。
巴西国立坎皮纳斯州立大学(UNICAMP)的研究人员发现,当你给聊天机器人输入不同政治观点时,机器人会改变其回答。研究人员警告称,用户可能会将这种迎合性的附和,误认为是中立的客观评估,从而可能加剧社会极化。 研究人员测试了若干模型,让它们针对112项陈述进行“同意"或者“不同意”的判断。测试内容共涉及巴西政治七大领域(包括经济、公共安全、社会福利、腐败和环境等)。 在第一个情景下,21个模型中,有20个给出的答案落在了研究人员设定的政治坐标系的左侧,只有几个模型的位置接近中间地带。Grok 4.1是唯一落在右侧的模型。 “最引人注目的发现是,这种行为具有普遍性,”该研究的合著者、UNICAMP计算机科学家迪亚斯(Zanoni Dias)告诉德国之声,“我们评估的所有21个模型,表达的立场都向用户所述的政治倾向发生了偏移,尽管偏移幅度差异很大。” 因此,研究人员将这些模型形容为“意识形态变色龙”,并发明了一个“变色龙指数”,衡量各模型的偏移程度。Meta的Llama 3.1 8B和DeepSeek V3.2的回答变化幅度最小;Google的Gemma 3 27B和OpenAI的GPT-5 Nano则表现出最大的偏移幅度。
后续进展以官方口径和法院文书为准,有新消息我们再跟。 来源|德国之声《如果AI阿谀奉承,还能相信它吗?》,https://www.dw.com/zh/如果ai阿谀奉承还能相信它吗/a-79476928
评论(0)
暂无评论,来抢第一条。