30 秒看重點
- 事件:iKala 程世嘉倡議以 TMMLU+ 作為台灣衡量「主權 AI」與繁中模型的黃金標準。
- 意義:解決外國大模型「簡轉繁」造成用語不道地、缺乏台灣在地文化與法規脈絡的痛點。
- 影響:台灣企業導入 AI 時,有了客觀的「台味指標」來評估與挑選最合用的模型。
在矽谷科技巨頭大打參數戰爭的當下,台灣 AI 發展正走向一條「文化自主」之路。透過 TMMLU+ 評測標準的確立,我們不再被動接受不貼合台灣社會的 AI 大腦,而是能自主定義、篩選出真正懂台灣法律、民情與核心價值的「在地化 AI」。
矽谷 AI 為什麼考不過台灣的「學測」?
許多台灣企業在導入 ChatGPT、Claude 等國際頂級 AI 模型時,常會遇到尷尬的現象:AI 講話帶著對岸腔調、引用中國的法條,甚至連基本的生活常識(例如台灣開車要考哪種駕照)都答錯。這是因為這些全球化模型在訓練時,繁體中文的資料佔比可能不到 1%,多數時候只是硬生生將簡體中文「簡轉繁」的產物。這種 AI 雖然強大,但「不夠台」成了企業落地應用的致命傷。
為了解決這個文化與語言上的「水土不服」,聯發創新基地(MediaTek Research)主導並協同台大等學術機構,開發了「TMMLU+」這套專為繁體中文設計的多任務語言理解評測資料集。iKala 共同創辦人暨執行長程世嘉近日公開強調,TMMLU+ 正是台灣定義「主權 AI(Sovereign AI)」不可或缺的尺規。它就像是專門給 AI 考的「台灣學測」,測試內容包羅萬象,從台灣的專利法、醫療法規到一般社會常識,唯有通過這項考驗的模型,才稱得上是合格的「繁中 AI」。
這場標準之爭背後,其實是「主權 AI」的保衛戰。如果台灣的企業、政府與學校,未來完全依賴美國或中國定義的模型,我們的歷史記憶、在地文化與法律詮釋權,將在不知不覺中被主流話語權抹滅。透過推廣 TMMLU+,台灣產業界正在合力構築一條文化防火牆,確保生成式 AI 在落地台灣時,能真正說台灣話、懂台灣心。
- 2023-11 聯發創新基地與產學界共同發表 TMMLU+,成為繁體中文 AI 領域最受矚目的開源評測基準。
- 近期 iKala 等本土指標科技企業大力倡議,推動將 TMMLU+ 普及為評估台灣主權 AI 實用性的業界公認標準。
台灣怎麼看這件事?
對於台灣產業界而言,TMMLU+ 標準的確立是一劑強心針。過去台灣企業在採購 AI 服務時,往往只能看國外評測報告(如 MMLU),但那些高分模型一搬到台灣應用就破綻百出。現在,有了這套在地化的評分表,金融、醫療、公部門等高度監管且重視精準度的行業,就能有理有據地篩選出不會「指鹿為馬」的 AI 夥伴。此外,這也為台灣本土的 AI 系統整合商與模型開發商(如 TAIDE 計畫)創造了絕佳的在地優勢,讓國外大廠無法輕易用資源戰碾壓本土市場。
編輯觀點
「誰掌握了考試規則,誰就掌握了發言權。」在 AI 時代,硬體代工是台灣的底氣,但主權 AI 則是台灣的靈魂。如果我們連「什麼是好的繁中 AI」都得聽外國科技巨頭定義,那台灣在軟體生態圈將永遠處於被動。TMMLU+ 的推廣,不僅是技術層面的除錯工具,更是台灣在生成式 AI 戰局中,爭取「文化與知識主權」的關鍵一步。
常見問題
- 什麼是「主權 AI」(Sovereign AI)?
- 指一個國家或地區,能自主控制、訓練並擁有符合自身語言、文化、法律與價值觀的 AI 模型,避免在核心資訊與思想上受制於外國科技巨頭。
- 為什麼 GPT-4 很強,台灣還需要自己的 TMMLU+ 標準?
- GPT-4 雖強,但它是用全球數據訓練的,繁中比例極低。TMMLU+ 專門測試 AI 對台灣在地知識(如台灣專利法、聯考考題)的理解,能精準過濾掉「簡轉繁」的不道地模型。
- TMMLU+ 是由誰開發的?
- 它是由聯發科旗下的聯發創新基地(MediaTek Research)主導,並與台灣學術界(如台灣大學)共同合作開發的開源繁體中文多任務語言理解評測基準。
- 企業在導入 AI 時,該如何運用 TMMLU+?
- 企業在評估採購或訓練 AI 模型時,可要求廠商提供該模型在 TMMLU+ 的學科跑分,以此作為該 AI 是否能勝任繁中客服、法規檢索等在地化業務的依據。
- TMMLU+ 會對台灣的 AI 產業帶來什麼好處?
- 它讓台灣的 AI 新創與學術機構有了客觀的競爭舞台,不再盲目追求參數大小,而是專注於「在地化理解」,協助台灣軟體業在國際巨頭夾擊中找到藍海。
名詞小教室
- 主權 AI
- 就像每個國家要有自己的憲法,主權 AI 就是不依賴外國技術,用自己國家的文化與法律訓練出來的 AI 大腦。
- TMMLU+
- 好比是台灣 AI 的「大考聯招」,透過涵蓋 55 個科目的標準化試卷,判定不同 AI 模型對繁體中文及台灣在地知識的聰明程度。