NAW / MODELS 01
IMAGE: AI生成ビジュアル
MODELS / Upstage
Upstageがエージェント特化モデル「Solar Mini 4」を公開 — 35B中3B活性のMoE、512Kコンテキスト
韓国のUpstageはエージェント向け小型モデルSolar Mini 4を公開した。総パラメータ35BのMoEでトークンあたり活性化は3B、512Kトークンのコンテキストと128Kトークンの出力をサポートする。Artificial Analysis Intelligence Index v4.3.2で24.1を記録し、同社によれば3B活性クラスで最高としている。標準API価格は入力100万トークンあたり0.10ドル。
韓国のUpstageは2026年10月2日、エージェント処理に最適化したモデル「Solar Mini 4」を公開した。同社の公式ブログによれば、総パラメータ35BのMixture-of-Experts(MoE)で、トークンあたりに活性化するのは3Bにとどまる。情報検索や構造化出力の生成、ツール利用といった反復的な処理を、より少ない計算量と低コストで回すことを狙ったモデルと位置づけている。
モデルの概要 — 35B中3B活性、512Kコンテキスト
- アーキテクチャ: 総パラメータ35BのMoEで、トークンあたりの活性パラメータは3B。Upstageがゼロから事前学習したエージェント最適化モデルとしている。
- コンテキスト: 最大512Kトークンの入力コンテキスト、最大128Kトークンの出力をサポートする。
- 価格: 標準API価格は100万トークンあたり入力0.10ドル、キャッシュ済み入力0.01ドル、出力0.40ドル。
- 使い方: 既定では推論(reasoning)を使わず、複雑な多段階分析が必要な場合に
reasoning_effortで調整する方式。JSONモードやJSON Schemaに基づく構造化出力、ツール呼び出しと並列ツール呼び出しに対応する。 - 提供形態: Upstage ConsoleのAPI(モデル名
solar-mini4、OpenAI互換クライアントで利用可)で提供し、オンプレミス導入は問い合わせ制としている。
評価 — Intelligence Indexとエージェント系ベンチマーク
- 総合指標: Artificial Analysis Intelligence Index v4.3.2で24.1を記録し、同社によれば比較対象の3B活性モデル群の中で最高としている。
- エージェント処理: 実SaaSワークフローを評価するAutomationBench-AAで22.3%、別途のτ³-Banking評価で47.2と報告している。
- 社内コスト試算: 韓国語の3タスク×各3回実行の社内テストでは、1,000セット完遂コストがSolar Mini 4で1.25ドル、比較対象のMiMo-V2.5で2.20ドルだったとしている。多段階ツール呼び出しタスク(予定確認と出席者への連絡)では1,000回あたり0.36ドル対0.61ドルだった。
- 試算の条件: 同社によれば
temperature=0、プロンプトキャッシュなし、Solar Mini 4はUpstage API直結、MiMo-V2.5は第三者ルーター経由で、遅延は比較外としている。ワークロードや運用環境で結果は変わり得るという留保付きの社内測定であり、独立した第三者評価ではない。

出典: Solar Mini 4: Built for High-Volume Agent Workloads(3B活性モデル群との比較チャート)
導入時の注意 — 反復処理のコスト設計と責任ある運用
- コスト設計: 反復呼び出しが多い環境では、トークン単価だけでなく完遂に要するトークン数やターン数を含めた総コストで検討するよう同社は助言している。
- 使い分け: 定型の情報抽出・分類・JSON化などスキーマが定まった反復処理に向き、複雑な分析は
reasoning_effortを最低限から上げる手順を推奨している。 - 責任ある運用: 実世界の意思決定に影響する用途では、モデル出力を最終決定ではなく別途レビュー工程への入力として使うこと、本番環境を反映したデータで精度と失敗モードを事前評価することを推奨している。