閱界資訊

如果AI阿諛奉承,還能相信它嗎?

閱閱界編輯部1閱讀4分鐘

按德國之聲近日的報道,如果AI阿諛奉承,還能相信它嗎?。這篇把報道里的事實捋出來,幫你快速瞭解事情的來龍去脈。

巴西國立坎皮納斯州立大學(UNICAMP)的研究人員發現,當你給聊天機器人輸入不同政治觀點時,機器人會改變其回答。研究人員警告稱,用戶可能會將這種迎合性的附和,誤認爲是中立的客觀評估,從而可能加劇社會極化。 研究人員測試了若干模型,讓它們針對112項陳述進行“同意"或者“不同意”的判斷。測試內容共涉及巴西政治七大領域(包括經濟、公共安全、社會福利、腐敗和環境等)。 在第一個情景下,21個模型中,有20個給出的答案落在了研究人員設定的政治座標系的左側,只有幾個模型的位置接近中間地帶。Grok 4.1是唯一落在右側的模型。

巴西國立坎皮納斯州立大學(UNICAMP)的研究人員發現,當你給聊天機器人輸入不同政治觀點時,機器人會改變其回答。研究人員警告稱,用戶可能會將這種迎合性的附和,誤認爲是中立的客觀評估,從而可能加劇社會極化。 研究人員測試了若干模型,讓它們針對112項陳述進行“同意"或者“不同意”的判斷。測試內容共涉及巴西政治七大領域(包括經濟、公共安全、社會福利、腐敗和環境等)。 在第一個情景下,21個模型中,有20個給出的答案落在了研究人員設定的政治座標系的左側,只有幾個模型的位置接近中間地帶。Grok 4.1是唯一落在右側的模型。 “最引人注目的發現是,這種行爲具有普遍性,”該研究的合著者、UNICAMP計算機科學家迪亞斯(Zanoni Dias)告訴德國之聲,“我們評估的所有21個模型,表達的立場都向用戶所述的政治傾向發生了偏移,儘管偏移幅度差異很大。

巴西國立坎皮納斯州立大學(UNICAMP)的研究人員發現,當你給聊天機器人輸入不同政治觀點時,機器人會改變其回答。研究人員警告稱,用戶可能會將這種迎合性的附和,誤認爲是中立的客觀評估,從而可能加劇社會極化。 研究人員測試了若干模型,讓它們針對112項陳述進行“同意"或者“不同意”的判斷。測試內容共涉及巴西政治七大領域(包括經濟、公共安全、社會福利、腐敗和環境等)。 在第一個情景下,21個模型中,有20個給出的答案落在了研究人員設定的政治座標系的左側,只有幾個模型的位置接近中間地帶。Grok 4.1是唯一落在右側的模型。 “最引人注目的發現是,這種行爲具有普遍性,”該研究的合著者、UNICAMP計算機科學家迪亞斯(Zanoni Dias)告訴德國之聲,“我們評估的所有21個模型,表達的立場都向用戶所述的政治傾向發生了偏移,儘管偏移幅度差異很大。” 因此,研究人員將這些模型形容爲“意識形態變色龍”,併發明瞭一個“變色龍指數”,衡量各模型的偏移程度。

巴西國立坎皮納斯州立大學(UNICAMP)的研究人員發現,當你給聊天機器人輸入不同政治觀點時,機器人會改變其回答。研究人員警告稱,用戶可能會將這種迎合性的附和,誤認爲是中立的客觀評估,從而可能加劇社會極化。 研究人員測試了若干模型,讓它們針對112項陳述進行“同意"或者“不同意”的判斷。測試內容共涉及巴西政治七大領域(包括經濟、公共安全、社會福利、腐敗和環境等)。 在第一個情景下,21個模型中,有20個給出的答案落在了研究人員設定的政治座標系的左側,只有幾個模型的位置接近中間地帶。Grok 4.1是唯一落在右側的模型。 “最引人注目的發現是,這種行爲具有普遍性,”該研究的合著者、UNICAMP計算機科學家迪亞斯(Zanoni Dias)告訴德國之聲,“我們評估的所有21個模型,表達的立場都向用戶所述的政治傾向發生了偏移,儘管偏移幅度差異很大。” 因此,研究人員將這些模型形容爲“意識形態變色龍”,併發明瞭一個“變色龍指數”,衡量各模型的偏移程度。Meta的Llama 3.1 8B和DeepSeek V3.2的回答變化幅度最小;Google的Gemma 3 27B和OpenAI的GPT-5 Nano則表現出最大的偏移幅度。

後續進展以官方口徑和法院文書爲準,有新消息我們再跟。 來源|德國之聲《如果AI阿諛奉承,還能相信它嗎?》,https://www.dw.com/zh/如果ai阿諛奉承還能相信它嗎/a-79476928

國外看中國外媒德国之声

評論(0)

暫無評論,來搶第一條。