IMAGE: AI生成ビジュアル
MODELS / MODEL WATCH
Qwen、ローカル実行向け「Qwen3.8-27B」をApache 2.0で公開 — 27B密度型VLM、ネイティブ262Kコンテキスト
27Bの密度型モデルで画像・動画をネイティブ理解。思考モード既定オンでreasoning_effortによる調整が可能。SWE-bench Pro 61.7、OSWorld-Verified 84.3(Qwen公称値)。重みは8月13日にアップロードされ、Apache 2.0ライセンスは8月14日に追加された。
Qwenチームは2026年8月13〜14日、27Bパラメータの密度型モデル「Qwen3.8-27B」の重みをHugging Faceで公開した。Qwen3.8世代としては、先にオープンウェイト公開されたMax級モデル(2.4T MoE・独自ライセンス)に続く2本目のリリースで、こちらはローカル実行を想定したコンパクトな構成にApache 2.0ライセンスを組み合わせている。Hugging Faceのコミット履歴によると、重みのアップロードは2026年8月13日 08:23 UTC、Apache 2.0ライセンスの追加は8月14日 04:15 UTCに行われた。
27B密度型のネイティブVLM — ローカル実行向けの設計
Qwen3.8-27Bは、画像と動画をネイティブに理解するビジョン言語モデル(VLM)だ。モデルカードでは、Qwen3.5のアーキテクチャを基盤に、コーディング・専門業務・研究・長期エージェントタスクでの性能向上を謳っている。密度型(dense)の27B構成で、コンシューマー向けGPUでも扱いやすいサイズに収めたのが特徴だ。
- パラメータ: 27B(密度型)、64層
- アーキテクチャ: Gated DeltaNetとGated Attentionを組み合わせたハイブリッド構成(Qwen3.5基盤)
- コンテキスト長: ネイティブ262,144トークン、YaRN適用で最大1,000,000トークンまで拡張可能
- マルチモーダル: 画像・動画入力に対応(STEM図や文書から時間スケールの長い動画まで)
- 思考制御: 思考モード既定オン。
reasoning_effort(xhigh既定/medium/low)で推論量を調整 preserve_thinking: 過去メッセージの思考ブロックを保持し、エージェント用途での文脈一貫性とKVキャッシュ効率を両立(既定オン)- 推論フレームワーク: Hugging Face Transformers、vLLM、SGLang、TokenSpeedに対応
エージェント・コーディング向けの公称ベンチマーク
モデルカードには、前世代のQwen3.6-27Bなどとの比較を含むベンチマークが掲載されている。いずれもQwenチームが提示する公称値であり、多くはClaude Codeハーネス(temp=1.0、top_p=0.95、256Kコンテキスト)で評価された。独立した再現評価は今後を待つ必要がある。
- Terminal Bench 2.1: 73.0(Qwen3.6-27Bは63.4)
- SWE-bench Pro: 61.7(同53.5)
- DeepSWE 1.1: 42.2(同13.3)
- QwenSWEBench(自社ベンチマーク): 79.0(同49.3)
- CoWorkBench(長期オフィスワーク): 70.7(同61.0)
- Agents’ Last Exam: Pass@1 20.4/Score 42.9(同10.6/27.3)
- OSWorld-Verified(コンピュータ操作): 84.3(同63.9)
- WebArena-Verified(ブラウザ操作): 64.8(同48.8)
- AndroidWorld(モバイル操作): 81.9(同70.3)
- Vision2Web(視覚的Web開発): 62.9(同45.0)
表では、27Bというサイズながらエージェント系・マルチモーダル系のベンチマークで前世代から大きくスコアを伸ばしており、特にDeepSWE 1.1(42.2 vs 13.3)やOSWorld-Verified(84.3 vs 63.9)での改善幅が大きい。一方、GPQA Diamond(89.2)やHLE(30.8)など汎用推論では他モデルと拮抗する水準だ。
ライセンスと提供状況
Qwen3.8-27BはApache 2.0ライセンスで公開された。これは、同じQwen3.8世代で先に公開されたMaxオープンウェイト版(2.4T MoE・新設の「qwen3.8-max」ライセンス)とは異なる扱いで、ローカル実行向けモデルには従来の寛容なライセンスを適用する形だ。
- ライセンス: Apache 2.0(商用利用・改変・再配布を広く許容)
- Hugging Face: Qwen/Qwen3.8-27B(2026-08-15時点でLikes約8,900)
- 推論: transformers、vLLM、SGLang、TokenSpeedで利用可能
- Qwen Cloud: ホステッド版は「近日提供開始」。1Mコンテキスト既定、公式ビルトインツールなど生産向け機能を予定
- サンプリング推奨値: 思考モードは temperature=1.0・top_p=0.95、非思考モードは temperature=0.7・top_p=0.80
Qwen3.8-27Bは、クラウドAPI向けのMax級モデルとは別に、ローカル実行でエージェント用途を試したい開発者向けの選択肢として位置づけられる。262KトークンのネイティブコンテキストとApache 2.0の組み合わせは、前世代のQwen3.6-27Bから乗り換える理由として十分に映るが、実際の性能差はコミュニティによる独立評価を待って確認するのが望ましい。
出典: Hugging Faceモデルカード「Qwen/Qwen3.8-27B」、同リポジトリのコミット履歴(いずれも2026-08-15確認)。