政策判断と監査の均衡を表す青い抽象ビジュアル
NAW / GOVERNANCE 07

IMAGE: AI生成ビジュアル

GOVERNANCE / GOVERNANCE

韓国政府、国産AIモデル「독파모」2次評価で3チームに絞り込み — Upstage・SKT・LG AI研究院が進出、Motif Technologies脱落

韓国科学技術情報通信部(MSIT)と情報通信産業振興院(NIPA)は2026年8月18日、国産AI基盤モデル開発プロジェクト「독자 AI 파운데이션 모델(독파모)」2次評価結果を発表した。ベンチマーク(40点)・専門家(35点)・ユーザー(25点)の合計100点による評価で、Upstage(Solar Open2)、SKテレコム(A.X K2)、LG AI研究院(K-EXAONE 2.0)が次段階へ進出。Motif Technologies(Motif 3)が脱落した。4モデルはいずれもEpoch AIの「Notable AI Models」に登録され、AAIIでは国内チーム最高が47点と、米国(Claude Opus 5、63点)との差も16点に縮小した。

韓国科学技術情報通信部(MSIT)と情報通信産業振興院(NIPA)は2026年8月18日、国産AI基盤モデル開発プロジェクト「독자 AI 파운데이션 모델(독파모、独自AIファウンデーションモデル)」の2次評価結果を公表した。1月の1次評価を通過した4チームのうち、Upstage、SKテレコム、LG AI研究院の3チームが次段階へ進出し、Motif Technologiesが脱落した。各チームが開発したモデルは2026年上半期にオープンソースとして公開されており、政府は「4チームすべてが世界的水準の独自AIモデル開発の成果を立証した」と評価している。

2次評価の仕組み — ベンチマーク・専門家・ユーザーの3軸で100点満点

2次評価は、1次評価から評価体系を高度化し、以下の3つの観点で実施された。

  • ベンチマーク評価(配点40点): AIモデル評価プラットフォーム「Artificial Analysis」の総合指標AAII(Artificial Analysis Intelligence Index)ベンチマーク(25点)と、NIA(韓国情報社会振興院)ベンチマーク(15点)で構成。AAIIベンチマークはエージェント(GDPval-AA v2、τ3-Banking)、コーディング(Terminal-Bench v2.1、Scicode)、一般(AA-LCR、AA-Omniscience)、科学的推論(Humanity’s Last Exam、GPQA Diamond、CritPt)の9種の高難度ベンチマークを、Artificial Analysis社が直接評価した
  • 専門家評価(配点35点): 外部専門家10人による評価委員会が、開発戦略・技術(10点)、開発成果・計画(10点)、波及効果・寄与計画(15点)を評価。1次評価では「独創性(独自性)」が主軸だったのに対し、今回は独創性を基にした性能向上と、AI転換(AX)の現場適用・生態系波及の評価比重を拡大した
  • ユーザー評価(配点25点): AI専門ユーザー49人による評価(15点)と、一般国民185人による「国民評価」(10点)の2層構成。ユーザー評価はチーム間比較ではなく絶対評価で行われた

結果は、ベンチマーク評価の4チーム平均が22.5点(1位と4位の差4.0点)、専門家評価の平均が28.8点(差2.4点)、ユーザー評価の平均が17.6点(差5.0点)だった。

4チームのモデルと進出結果

チーム モデル名(パラメータ数) 主な特徴 結果
Motif Technologies Motif 3(314B-A13B) 米・中以外では世界最高性能とされるエージェント特化モデル(AAII基準)。コーディング・エージェント等に特化 脱落
Upstage Solar Open2(250B-A15B) エージェント最適化モデル。コンテキストウィンドウ最大100万トークン、NVIDIA H200 2枚で駆動可能 次段階へ進出
SKテレコム A.X K2(688B-A33B) 韓国語・数学ベンチマークでオープンソース最高水準。IMO 2026問題で金メダル基準、MathArena AIME 2026で97.1% 次段階へ進出
LG AI研究院 K-EXAONE 2.0(750B-A37B) 韓国最大の7,500億パラメータ。Apache 2.0商用ライセンス、10言語対応。前作比10%の性能改善 次段階へ進出
  • AAIIのオープンウェイト(重み公開)モデルランキングでは、韓国チーム最高の47点が世界6位。上位は1位Kimi K3(60点)、2位Qwen3.8 2.4T A95B(58点)、3位GLM 5.2(53点)で、4〜5位は省略(政府資料は「…」表記)
  • 企業別のAAII最高スコアでは、Motif 3(47点)が世界10位にランクインした
  • 4モデルすべてが米非営利AI研究機関Epoch AIの「Notable AI Models」に登録され、同評価で選定国を持つのは米国・中国・韓国の3か国のみとなった

米中との差は縮小 — 次段階ではGPU支援を拡大

MSITは、今回の結果から韓国AIモデルが「米・中に次ぐAI3強」の地位を確かなものにしつつあると評価している。

  • AAIIの国内チーム最高点は、1次評価時の32点(GPT-5.2の51点との差19点)から47点(Claude Opus 5の63点との差16点)へ上昇した(※AAIIの指標変更の影響も含む)
  • 次段階へ進出した3チームには、高性能GPU B200の支援を2026年下半期に768枚から1,000枚へ拡大する計画(2025年下半期は500枚程度)
  • 政府はその他、KT(Omniモデル「Midm K 2.0 Omni Basic」)、カカオ(オンデバイス向け軽量モデル4種)、ネイバー(国防向け「ハイパークローバXシード4B」)、NC AI(3D生成モデル)など、プロジェクト参加チーム以外の韓国AI企業の動きにも言及した

なお、脱落したMotif Technologiesについて、MSITは「アーキテクチャからトークナイザー、オプティマイザー、カーネルまで自社開発し外部依存を排除した」「AAIIで米・中以外では世界最高性能」と評価しており、同社の技術が韓国AI生態系の資産として継続的に貢献するとの見解を示している。

出典