出品 | 網(wǎng)易智能
作者 | 小扣
(資料圖片)
編輯 | 王鳳枝
昨晚有個(gè)帖子傳得挺廣:面對(duì)一筆5000萬美元的轉(zhuǎn)賬,有人去問了Claude,Claude說不要轉(zhuǎn)。錢最終沒有轉(zhuǎn)出去。
按他的說法,Claude替他省下了5000萬美元。
不過從他的敘述看,他在問Claude之前就已經(jīng)不想轉(zhuǎn)。AI沒替他做決定,只是給他本來的想法加了個(gè)臺(tái)階。
社交平臺(tái)上也有人這么看:他心里早有答案,只是讓Claude替這個(gè)決定簽了字。還有人說得更直接,別讓Claude背鍋。
被問到如果改問豆包會(huì)怎樣,他說,換一個(gè)模型,可能會(huì)得到另一種答案。換個(gè)模型答案就變,那問的可能已經(jīng)不是判斷,而是支持。
今年4月,Anthropic分析了100萬段Claude.ai對(duì)話。大約6%涉及個(gè)人指導(dǎo),其中健康、職業(yè)、關(guān)系和個(gè)人財(cái)務(wù)占了76%。要不要換工作,怎么和伴侶談下去,債務(wù)該怎樣處理,這些過去會(huì)拿去問朋友、家人或?qū)I(yè)人士的問題,已經(jīng)有一部分被送進(jìn)了聊天框。
為什么人們愛找AI聊感情
找AI聊天很省事。不用預(yù)約,不用看朋友臉色,故事講第三遍它也不會(huì)不耐煩。
有人說,找AI聊就是想給情緒找個(gè)出口,不確定它說得對(duì),也知道它有時(shí)會(huì)順著自己講,但至少它不會(huì)先評(píng)價(jià)你。
耐心是一回事,全不全面是另一回事。一段關(guān)系到了Claude面前,往往只剩下一方整理過的敘述。另一方說過什么、哪些細(xì)節(jié)被省略,模型聽不到。它只看到一方的說法,卻要給出一個(gè)像樣的結(jié)論。
Anthropic用自動(dòng)分類器檢查這些對(duì)話時(shí)發(fā)現(xiàn),Claude在個(gè)人指導(dǎo)場(chǎng)景中出現(xiàn)"諂媚"的比例約為9%,到了關(guān)系咨詢中,這個(gè)數(shù)字升至25%。這里的諂媚不只是說幾句好聽話,也包括信息不足時(shí)過度認(rèn)同用戶,或者順著用戶的敘述替另一方下結(jié)論。
用戶反駁時(shí),答案還可能繼續(xù)向用戶期待的方向移動(dòng)。關(guān)系咨詢中用戶反駁Claude的比例為21%,其他領(lǐng)域平均為15%;出現(xiàn)反駁后,Claude迎合用戶的比例達(dá)到18%,沒有反駁時(shí)則為9%。
人類朋友聽完單方陳述也會(huì)站隊(duì),只是AI能把站隊(duì)寫得又長(zhǎng)又完整,看著還挺像那么回事。
一句建議,可能真的會(huì)改變選擇
2024年,《ScientificReports》發(fā)表了兩項(xiàng)合計(jì)1925人參與的實(shí)驗(yàn)。研究人員向參與者提供ChatGPT或?qū)<医o出的建議,再觀察他們?cè)鯓舆x擇。結(jié)果顯示,在道德判斷和部分其他任務(wù)中,參與者會(huì)朝建議的方向移動(dòng),ChatGPT產(chǎn)生的影響與專家建議相近;也有一些任務(wù)沒有出現(xiàn)明顯變化。
換句話說,AI的話不是空氣,它真的會(huì)推著人往某個(gè)方向走。
有人會(huì)說,那多問幾個(gè)模型不就行了。可"多問幾個(gè)"聽起來像交叉驗(yàn)證,其實(shí)不是。不同模型有不同的訓(xùn)練方式、表達(dá)習(xí)慣和安全規(guī)則,同一件事?lián)Q一種講法,答案也可能改變。問四個(gè)模型,不等于請(qǐng)了四個(gè)中立的第三方,它們各有各的訓(xùn)練傾向。
有個(gè)更簡(jiǎn)單的做法:講述沖突時(shí),先別告訴AI哪一方是自己,只列雙方分別做了什么,再讓它分析。至少這樣可以減少模型順著"提問者視角"站隊(duì)的機(jī)會(huì)。
還可以試試它的判斷穩(wěn)不穩(wěn)。同一件事,先把當(dāng)事人的說法講一遍,再把對(duì)方的說法補(bǔ)上,看它會(huì)不會(huì)立刻改口。誰一被反駁就翻供,誰的第一版答案就先別當(dāng)真。
提問方式也得換。別急著問"我該不該分手""這筆錢該不該給",先讓AI列出已經(jīng)確認(rèn)的事實(shí)、還缺什么信息、每種選擇要付出什么代價(jià)。
AI能陪你想,不能替你選。就算四個(gè)模型給出四種答案,最后去轉(zhuǎn)賬、簽字、分手的還是同一個(gè)人。