AI Index Report 2023

世界對 AI 沒有共識 — 2022 年終於有了數字

AI 指數 2023 第 8 章用四種鏡頭讀民意:IPSOS 對 28 國、19,504 位成人的調查,Lloyd’s Register Foundation 與 Gallup 對 121 國、125,911 人的民調,Pew Research 對 10,260 位美國人的訪問,以及一份 480 位 NLP 研究者填答的問卷;最後再看 2022 年的 274 萬則社群貼文。報告本身也坦承,AI 民意缺乏長期追蹤資料 — 這些是快照,不是趨勢線。先看數字:

78% 中國受訪者認為 AI 產品利大於弊 — 28 國中最高
35% 美國受訪者同意 — 最低的是法國(31%)與加拿大(32%)
27% 全球認為坐自駕車會有安全感的人(65% 認為沒有)
18% 對 AI 興奮多於擔憂的美國人(擔憂多於興奮的有 37%)
73% NLP 研究者同意 AI 可能很快帶來革命性的社會變化
52% 2022 年第 4 季 ChatGPT 佔 AI 社群聲量的比例,從零起跳

8.1 — 人人都預期 AI 會改變生活,只有一半的人信任做這件事的公司

IPSOS 訪問了 28 國、19,504 位 16 至 74 歲的成人。加總起來,答案看起來溫吞;按國家拆開,卻像兩個星球。

全球來看,64% 的受訪者說自己對人工智慧是什麼有不錯的理解,60% 預期 AI 產品與服務會在未來三到五年深刻改變自己的日常生活,60% 說這些產品讓生活更輕鬆。但只有勉強過半的 52% 同意 AI 產品與服務利大於弊 — 而 39% 說它們讓自己感到緊張。

這份調查裡有兩道落差值得挑出來。第一道在未來與現在之間:60% 預期 AI 會在未來三到五年深刻改變日常生活,但說「過去三到五年已經被改變」的只有 49%。第二道在自認懂與實際認得之間:64% 說自己理解 AI 是什麼,卻只有 50% 說得出哪些類型的產品與服務真的用了 AI。至於信任,樣本剛好從中間對半分 — 50% 說他們信任使用 AI 的公司,程度和信任其他公司一樣。

在同一個國家裡,每個答案都同進退

情緒的相關性是「按國家」而不是「按題目」成群移動的。中國受訪者在每一項指標上都名列最正面:87% 說 AI 產品讓生活更輕鬆、76% 對使用 AI 的公司給予和其他公司同等的信任、76% 知道哪些產品用了 AI,而只有 30% 感到緊張。美國受訪者則名列最負面:41% 說 AI 讓生活更輕鬆、35% 信任 AI 公司、39% 知道哪些產品用了 AI,52% 感到緊張。日本是長年的異數 — 只有 42% 認為利大於弊,但僅 20% 說 AI 讓自己緊張,是 28 國中最低的焦慮值。印度則完全相反:71% 認為利大於弊,同時有 53% 感到緊張,是全調查最高的焦慮值。

第一名與最後一名相差 47 個百分點

  • 在「AI 產品與服務是否利大於弊」這一題上,領先的是中國(78%)、沙烏地阿拉伯(76%)與印度(71%)。
  • 墊底的是法國(31%)、加拿大(32%)、荷蘭(33%)與美國(35%);報告特別指出,在 28 個受訪國中,法國與加拿大的看法最負面。
  • 新興經濟體聚在頂端 — 秘魯 70%、墨西哥 65%、馬來西亞 65%、哥倫比亞 64%、智利 63%。富裕的西方國家聚在底部 — 瑞典 40%、比利時 38%、英國 38%、澳洲 37%、德國 37%。
  • 「預期」也照著同一張地圖走。中國與沙烏地阿拉伯各有 80% 預期 AI 會在三到五年內深刻改變日常生活,美國與英國是 46%,加拿大與德國是 44%。
  • 「已經發生」的感受同樣如此:中國有 73% 說 AI 在過去三到五年已深刻改變自己的日常生活,美國是 36%,日本與瑞典則是 30%。

「使用 AI 的產品與服務利大於弊」

同意的受訪者比例,IPSOS 2022。28 個受訪國中的前三名對上後三名 — 從中國到法國相差 47 個百分點。

「使用 AI 的產品與服務利大於弊」中國:7878中國沙烏地:7676沙烏地印度:7171印度美國:3535美國加拿大:3232加拿大法國:3131法國

性別、收入與教育,全指向同一個方向

IPSOS 也把同樣八道題按人口族群拆開;另一份全球民調 — Lloyd’s Register Foundation 與 Gallup 對 121 國、125,911 人的訪問 — 則用更直白的方式問了同一件事。兩邊的圖形彼此押韻。

在 IPSOS 這組題目裡,男性在每一道正面陳述上都高於女性:理解 AI 是什麼(69% 對 60%)、知道哪些產品用了 AI(55% 對 46%)、認為利大於弊(55% 對 49%)、說它讓生活更輕鬆(62% 對 58%)、預期它會改變自己的生活(63% 對 57%),以及信任使用 AI 的公司(53% 對 47%)。只有一道題女性比較高:AI 產品讓我緊張,41% 對 38%。

年齡把這道題切成兩半。35 歲以下的受訪者最常說 AI 產品讓生活更輕鬆(64%,35 至 49 歲為 62%、50 至 74 歲為 54%),但他們認為利大於弊的比例反而低於 35 至 49 歲那一群(47% 對 53%)。方便,和支持,是兩件事。收入、教育與職位則同步往一個方向移動:高收入者有 57% 認為利大於弊,低收入者是 50%;教育程度最高的一群是 59%,最低的是 45%;而在就業身分上,高階主管與決策者以 64% 居首,企業主 63%,一般受僱者 55%,未就業者 47%。

換一份調查、換個更直白的問法,形狀一樣

2021 年,Lloyd’s Register Foundation 與 Gallup 詢問 121 國、125,911 人:未來 20 年 AI 對你的國家是幫助多還是傷害多。39% 說幫助多,28% 說傷害多 — 而 IPSOS 那道性別差距原封不動地再次出現:男性有 42% 說幫助多,女性 35%。以區域來看,東亞每出現 1 個「傷害多」就有 4.4 個「幫助多」,北歐與西歐是 1.8,澳洲與紐西蘭是 1.7。北美與中東剛好落在 1.0 — 一個樂觀對一個悲觀。而東非(0.4)、南非洲(0.6)與北非(0.7),是這道題上全球最悲觀的區域。

沒有人想上那台車

同一份民調也問了自駕車,而答案是全章最不模稜兩可的數字之一:65% 說坐進自駕車不會有安全感,27% 說會,8% 不知道或拒答。Pew 在美國量到同一種直覺 — 只有 26% 的美國人認為無人駕駛的載客車輛對社會是好主意,44% 認為是壞主意,29% 不確定。在 Pew 測試的三個具體 AI 應用中,這是唯一一個「壞主意」勝過「好主意」的。

各區域「幫助多」對「傷害多」的比值

Lloyd’s Register Foundation 與 Gallup,2021:未來 20 年 AI 對你的國家是幫助多還是傷害多?比值大於 1.0 代表希望壓過恐懼。東亞的樂觀程度是東非的 11 倍。

各區域「幫助多」對「傷害多」的比值東亞:4.44.4東亞北歐西歐:1.81.8北歐西歐澳紐:1.71.7澳紐北美:11北美北非:0.70.7北非東非:0.40.4東非

美國人接受 AI 做家事,不接受 AI 做判斷

Pew Research 在 2022 年訪問了 10,260 位樣本成員 — 這是至今最完整的美國 AI 民意調查之一。最主要的答案不是熱情,也不是恐懼,而是矛盾。

對於 AI 程式在日常生活中被越來越多地使用,45% 的美國人說自己既擔憂又興奮,兩者各半。37% 是擔憂多於興奮。只有 18% 是興奮多於擔憂。這個國家最大的一群人,還沒有下定論。

任務越像人做的,興奮度掉得越快

問到六個具體應用時,排序幾乎完全照著「機械的 → 私人的」這條線。對 AI 做家事,57% 感到非常或有些興奮,擔憂的有 19%。重複性的工作任務:興奮 46%、擔憂 26%。診斷醫療問題:興奮 40%、擔憂 35%。到了處理客服來電,正負號翻轉 — 興奮 27%、擔憂 47%。而在最遠的那一端,當任務從「做事」變成「評斷人」,數字整個崩塌:讓 AI 替人做重大人生決定,74% 擔憂、9% 興奮;讓 AI 掌握人的想法與行為,75% 對 9%。

問他們為什麼時,他們會說什麼

  • 在擔憂多於興奮的美國人裡,主要理由是人類工作消失(19%)、監控、駭客與數位隱私(16%),以及失去人際連結與人的特質(12%)。
  • 只有 2% 提到缺乏監督與監管 — 和失去自由、人類偏見被寫進 AI 並列清單最末。大眾擔心的是後果,不是治理。
  • 在興奮多於擔憂的人裡,31% 指向 AI 讓生活與社會變得更好,13% 指向省時與提升效率,10% 認為這是不可避免的進步,7% 說它能處理瑣碎而乏味的雜事。
  • 談到具體部署,46% 的美國人認為警方使用臉部辨識技術對社會是好主意,27% 認為是壞主意;社群媒體公司用 AI 找出不實資訊,則是 38% 好對 31% 壞。

美國人覺得 AI 是照著誰的經驗打造的?

Pew 也問了:設計 AI 系統時,哪些人的經驗與觀點有被納入考量。51% 認為男性的經驗有被好好考量,女性則是 36% — 相差 15 個百分點。白人成年人是 48%;亞裔成年人 33%、黑人成年人 24%、西語裔成年人 23%。而每一列都有 37% 到 43% 的受訪者回答「不確定」,這本身就是一個發現:關於 AI 是為誰而建,最普遍的美國立場是「房間外面的人看不出來」。

% 對各項 AI 應用感到非常或有些擔憂的美國人

Pew Research,2022。分界線幾乎剛好落在機器從「替人做事」轉為「評斷人」的那一刻。

% 對各項 AI 應用感到非常或有些擔憂的美國人掌握想法:7575掌握想法人生決定:7474人生決定客服來電:4747客服來電醫療診斷:3535醫療診斷重複工作:2626重複工作家事:1919家事

真正在做模型的人怎麼想

2022 年 5 月至 6 月,480 位 NLP 研究社群成員填答了一份關於領域現況、AGI 與倫理的問卷 — 其中 68% 在 2019 至 2022 年間發表過至少兩篇 ACL 論文。以下百分比為「同意」或「弱同意」的受訪者比例。

私人企業影響力過大

77% 同意私人企業對這個領域的影響力過大,86% 預期產業界會產出被引用最多的研究。但只有 41% 認為 NLP 應該受到監管。

industry

AGI 已經是正經話題

58% 說 AGI 是重要的議題,57% 認為近期進展正把領域推向 AGI,73% 相信 AI 可能很快帶來革命性的社會變化。

agirisk

規模不是答案

88% 說領域太看重基準測試,72% 說太看重規模。只有 17% 同意「把模型放大幾乎可以解決任何重要問題」。

scale

模型真的懂語言嗎?

51% 同意語言模型理解語言,多模態模型則有 67%。但只有 36% 相信純文字的評測能測出語言理解。

language

對過去有信心,對倫理有分歧

89% 認為 NLP 過去的淨影響是好的,87% 預期未來也會是好的 — 但 74% 說倫理與科學上的考量會互相衝突。

ethics

三分之二的人說自己的領域是可疑的科學

67% 同意 NLP 大部分是可疑的科學。30% 預期十年內會有一次 NLP 寒冬,三十年內則有 62%。

field

8.2 — 整年的討論被一個產品接管的那一年

NetBase Quid 團隊分析了 2022 年 1 月至 12 月間、共 274 萬則關於 AI 模型與新發布的社群貼文。淨情緒分數的範圍從 +100(全部正面)到 -100(全部負面)。

是哪個模型接管了討論?
ChatGPT,而且是從零開始。它在 2022 年第 4 季佔了全部 AI 相關社群討論的 52% — 在這個模型存在的第一個季度,就吃下超過一半的聲量。同季次高的是 Stable Diffusion 的 19% 與 Make-A-Video 的 15%。
關於 ChatGPT 的討論是正面的嗎?
正面,但是最弱的那種正面。ChatGPT 第 4 季的淨情緒分數是 32 — 低於同季的 AlphaTensor(96)、AlphaCode(70)、Whisper(69)、Gato(65)與 Imagen(56)。最初的興奮很快轉為評價分歧,因為人們摸清了它的極限;連 OpenAI 自己的執行長都說它「極其有限」,而且「現在把任何重要的事情押在它身上是個錯誤」。反覆出現的主題包括:它的問世對教育代表什麼、它背後的倫理原則,以及它對特定政治、倫理或文化立場的偏向。
人們真正最喜歡的是哪個模型?
AlphaCode。它在 2022 年四個季度的淨情緒分數分別是 60、79、71、70,是全年最穩定的高分,也拿下全年最高平均;帶動它的是一個具體用途受到的正面報導:把寫程式自動化。而單季最高分屬於 AlphaTensor 的第 4 季 96 分,那也是它在資料中唯一出現的一季。
有模型掉到負分嗎?
LaMDA,而且掉得很戲劇性。它第 1 季拿下 73 分,在一位前 Google 員工描述自己與一個他認為「有感知」的系統互動之後,第 2 季掉到 -9、第 3 季 -11,第 4 季才回到 44。政治與科技領域的意見領袖強力反擊,指出這類沒有真假概念的系統,其回應本質上是「深偽」。LaMDA 在第 2 季也吃下全部 AI 相關社群討論的 35%,是全年僅次於 ChatGPT 的單季聲量。
人們還在吵什麼?
原創性與來源。Stable Diffusion 在第 3、4 季各佔 19% 的聲量,成為兩場爭論的焦點:生成出來的作品算不算原創,以及未經許可抓取的資料集。GLM-130B 的聲量微不足道,卻引來一小群非常負面的討論,主題是它的授權條款限制使用者不得從事可能危害中國國家安全與統一的行為 — 這串討論當時擴散得相當廣。

用五句話看這一章

第 8 章「民意」涵蓋 2022 年的頭條發現。

在 2022 年的 IPSOS 調查中,78% 的中國受訪者同意使用 AI 的產品與服務利大於弊,是所有受訪國中最高的比例。而美國受訪樣本中只有 35% 同意。
— Chapter 8 · Public Opinion
在一份全球調查中,只有 27% 的受訪者說坐自駕車會有安全感。Pew 的資料則顯示,只有 26% 的美國人認為無人駕駛的載客車輛對社會是好主意。
— Chapter 8 · Public Opinion
受訪的 NLP 研究者中,77% 同意或弱同意私人 AI 企業影響力過大,41% 認為 NLP 應該受到監管,73% 覺得 AI 可能很快帶來革命性的社會變化。
— Chapter 8 · Public Opinion
ChatGPT 以極快的速度攻佔消費者的討論,到 2022 年底已佔去超過一半的聲量。
— Chapter 8 · Public Opinion
在 AI 相關的調查中,長期針對同一群人問同一組問題的縱貫性資料相當稀少。
— Chapter 8 · Public Opinion

閱讀第 8 章原文

第 8 章(8.1 至 8.2 各節)連同所有圖表、調查方法說明與引用,皆由史丹佛 HAI 免費提供。或回到報告重點與八大章節總覽。

開啟 AI 指數 2023 →