最近輝達執行長黃仁勳訪台,帶來一陣AI旋風,也帶給台灣不少信心。AI時代台灣硬體產業仍有優勢,但在應用面,台灣可能要擔心「國家級」的AI落差。
5月底,尤其在ChatGPT推出僅供付費會員使用的更新版本,這讓很多人開始擔心「AI落差」的問題。
就像網路時代的數位落差現象,我們會擔心偏鄉兒童沒能力上網,資訊取得不平等;數位經濟時代,電子商務、電子支付興盛,我們擔心台灣產業沒有跟上國際競爭,人類社會不斷被數位轉型,已經來到接近於強AI的時代。
雖然AI能力還會持續發展,它現在就能夠回答多數問題,可是相同的問題,它答案就只有一個,沒有像搜尋一樣給多個選擇,會造成多元化不足的問題。問AI肚子餓吃什麼早餐,它可能只會回答漢堡,不論是用中文或日文。
面對不同語言,它沒有太大的差異化處理,即使你能用中文提問、得到中文答案,但是答案的形成,來自受到訓練資料最多的英語內容影響,文化跟國家的差異會慢慢不見。
在AI時代,很可能會有國家級的AI落差。
首先,「算力」就有差異,不只需要資金、運算能力訓練模型,更需要數據能力。英文的數據量遠遠高過中文,目前全球的數據資料庫,中文數據資料其實只占1.5%,英文超過60%,這是文化強/弱勢問題。如果同一個文化的人大量使用模型,就會引導到該文化偏好的內容,本地文化很難跟國際主流文化競爭。
這可能導致部分國家的公權力被模糊。生成式AI的解釋權來自語言模型本身,而解釋的內容,得看模型是哪個國家、文化、語言開發的?即使內容談的是各國法規、醫學制度,但解釋都來自同個模型。
以中國為例,ChatGPT可能讓中文解釋權被英語系國家占據,所以它們積極發展自己的ChatGPT,避免政府觀點與AI給的答案不同,喪失主導性。
如果繼續發展下去,未來,政府與國家的影響力就變得非常小。
買硬體,有錢的人買iPhone,窮一點可以買Android。生成式AI是種智慧系統,大家都想用智商180的系統,不會有人選擇智商80的,萬一開發智商180系統的國家排他,就變成國安問題,會讓國家間的AI落差越來越大。
有些人開始談台版ChatGPT,做一個世界級系統可能不太實際,因為即使我們有錢買算力,數據量仍遠遠不及英語系世界。我們能做的,是找出哪些資訊是國家價值、文化傳承的必要部分,例如法規解釋權,或本地特有教學內容,這樣的系統由我國掌握,而不是使用別人的系統,才能避免全面性的AI落差。