2023年6月,韓國科學部發起“國產AI模型大賽”,旨在3年內打造效能達OpenAI、谷歌95%水平的“純韓技術”大型AI模型,並承諾為優勝企業提供政府資料、人才及AI晶片資源,以減少對中美技術的依賴。然而,計劃推進不足一年,便因“抄襲”爭議陷入輿論漩渦。
比賽五強企業中,有三家被曝使用中美開原始碼。其中,初創公司Upstage的參賽模型Solar Open 100B被競爭對手Sionic AI CEO高錫賢在LinkedIn公開指控,稱其與智譜AI的GLM 4.5 Air模型相似度達96.8%,且程式碼中殘留版權標記。高錫賢質疑Upstage“用納稅人資金交偽國產作業”,暗示其僅對開源模型進行微調包裝。

面對指控,Upstage立即召開直播驗證會,CEO金聖勳展示訓練日誌,證明核心模型從零開始訓練,僅推理框架採用智譜AI的開源元件。他解釋,模型LayerNorm數值高度相似是因大型語言模型若使用相近的Transformer或MoE架構,並以類似資料訓練,最終統計特徵會自然收斂至近似結果。次日,高錫賢公開道歉,承認未充分驗證便發起指控“欠妥”。
Upstage事件後,其他決賽企業遭深度審查。Naver的視覺與音訊編碼器被指與阿里巴巴“通義千問”設計相似,SK Telecom的推理程式碼則疑似與DeepSeek模型“撞車”。兩家公司均承認使用開源模組,但強調核心訓練引擎自主開發,外部元件僅作標準化處理,屬行業通用做法。
首爾大學AI研究院院長李在儒公開支援涉事企業,稱被質疑模型“均從零開始訓練,未直接複製外國模型權重”。但輿論質疑聲未消:若開原始碼佔比過高,韓國“主權AI”戰略是否名存實亡?

“自主AI是否需完全自寫每行程式碼?”成為學界焦點。哈佛大學教授韋巨賢直言:“要求100%自研不現實,放棄開源等於丟棄技術紅利。”但反對派警告,即使僅使用外圍程式碼,也可能引入後門風險或供應鏈依賴,削弱戰略意義。
目前,比賽規則未明確禁止使用開原始碼,科學部也未出臺新指引。部長裴慶勳僅表示“樂見技術辯論”,稱“韓國AI未來光明”。
評論指出,Upstage風波暴露韓國AI生態兩大問題:一是競賽規則對開源使用的界定模糊,二是政府、企業與學界對“獨立模型”定義缺乏共識。此次爭議或倒逼韓國重新審視“主權AI”戰略,平衡技術自主與國際合作的關係。