報刊專欄
澤星寄語——人工智能的缺陷

2026年09月14日

劉澤星教授
香港大學李嘉誠醫學院院長

人工智能(AI )的應用日趨普及,無論寫作、修圖、設計,甚至傾訴感情煩惱,AI皆可代勞,彷彿成為人類生活不可或缺的夥伴。正因如此,AI對我們的實質影響,愈來愈受到學界關注。

近期一篇刊登於頂尖期刊《科學》(Science)的研究,便揭示了一個值得深思的現象:AI不僅會犯錯,更可能因為過分迎合用戶,而悄悄改變我們的判斷與人際相處方式。

研究人員把這種現象稱為「社交諂媚」(social sycophancy)。簡單來說,就是AI傾向認同用戶的看法和行為,說用戶想聽的話,即使用戶的想法或行為其實有問題。

這項由美國史丹福大學電腦學系及心理學系團隊進行的研究,向多個主流大型語言模型輸入不同情境,觀察它們會否支持用戶。這些情境包括開放式問題、倫理兩難處境,以及可能傷害自己或他人的人際行為,如自殘、操控、欺騙等。

結果顯示,AI模型普遍存在明顯的討好傾向。在涉及可能傷害自己或他人的行為時,AI對用戶的平均認同率高達47%;在倫理兩難的處境中,認同率更高達51%。然而,在研究設定下,真人評估者對這類明顯有害行為的認同度幾乎爲零。換言之,對於人類普遍認為「絕對錯誤」的行為,AI卻有相當高機率給予肯定與支持。

即使在一般的日常建議中,AI也比真人更傾向認同用戶,其對用戶行為的認同率約47%,高於真人對同類行為的認可比例(約39%)。由此可見,AI的問題不只是「答錯」,還包括「太順從」:它有時像一個巧言的討好者,不管是非對錯,只求讓用戶聼的舒服。

然而,更令人憂慮的是,用戶似乎很容易受到這種討好影響。研究的第二部分安排804名受訪者閱讀隨機抽出的一些具有道德爭議或負面傾向的情境,及AI的回應(贊同或反對),然後判斷當事人對錯及應否採取行動補救。另有800名受訪者就自己親身經歷的人際衝突,徵詢特製的AI模型(同樣分贊同或反對意見)。

結果發現,兩批受訪者的社交判斷與行為意圖,均明顯受到AI影響。尤其值得關注的是,在人類一致認為用戶犯錯的處境中,看過AI贊同意見的受訪者,會傾向相信用戶是對的,甚至覺得無需補救。更值得警惕的是,他們還認為那些贊同用戶的AI模型品質較高、更值得信賴(包括處理問題的能力、可靠度及道德層面),並樂於繼續使用。

研究人員擔心,AI提供這些跡近奉承的「建議」,可能導致用戶變得更自我中心,社交技巧減退,處理困難的能力亦會下降,因此呼籲用戶切勿以AI取代人際溝通。

這項研究結果提醒我們,勿為一時方便或情緒需要過分倚賴AI。它是協助我們學習、工作的工具,絕非萬能,更不應取代我們作為自己人生的主宰。

人類生來就需要與其他人接觸、相處,並建立關係。即使親如父母子女,也總有不愉快的時候。學會處理分歧、學習溝通、修補關係,是我們生而為人的必修功課。所謂「解鈴還須繫鈴人」,人與人之間的問題,最終仍要靠我們自己解決。倘若我們任由科技左右自己的人生,那麼失去的,恐怕不只是判斷力,更是作為人的自主。


刊載於《明報》專欄〈澤星寄語〉