IMAGE: AI生成ビジュアル
MODELS / MODEL WATCH
DeepSeek、「V4-Pro」正式版を公開 — エージェント能力を強化し、時間帯別料金へ移行
総パラメータ1.6T・アクティブ49BのMoEモデル。アプリ・Web・APIで提供を開始し、OpenAI Responses APIにネイティブ対応。思考量の3段階制御と、8月16日からのピーク/オフピーク料金も発表。
DeepSeekは2026年8月13日、フラッグシップモデル「DeepSeek-V4-Pro」の正式版(GA)をアプリ・Web・APIで提供開始した。APIの呼び出し方法は従来と変わらず、モデル名を deepseek-v4-pro に指定するだけで最新版が使える。エージェント用途を中心に能力を強化したほか、OpenAIのResponses APIへのネイティブ対応、思考量の3段階制御、そしてピーク/オフピーク制の新料金をあわせて発表している。
エージェント能力の強化(ベンダー公称値)
GA版では、実運用環境でのエージェント性能を中心に改善したとしている。公表された主なベンチマーク値は以下の通り。いずれもDeepSeekが提示する公称値であり、独立した再現評価は今後を待つ必要がある。
- Terminal Bench 2.1: 87.9、Cybergym: 83.3、Toolathlon-Verified: 74.1
- DeepSWE: 62.7、NL2Repo: 61.5、DSBench-FullStack: 71.1
- HLE(ツールなし/あり): 42.7/60.0、Agents’ Last Exam: 25.7
- 対象バージョンは DeepSeek-V4-Pro-0813(V4-Flash は V4-Flash-0731)
API連携と思考量の制御
API周りでは、外部ツールと組み合わせた利用を想定した変更が入った。推論コストをタスクの難しさに応じて調整できる点も特徴だ。
- OpenAI Responses API形式にネイティブ対応し、Codex向けにワンクリック設定スクリプトを用意
- V4-Pro/V4-Flashの思考モードに「低・高・最大」の3段階の思考量を導入
- コンテキスト長は1M、最大出力は384K(仕様上の上限)
ピーク/オフピーク料金への移行
V4ファミリーの正式リリースに伴い、API料金を時間帯別(ピーク/オフピーク)に改定する。オフピークはピークの半額で、負荷を時間帯で平準化する狙いとしている。
- 新料金の適用は2026年8月16日 16:00 UTC(日本時間 8月17日 1:00)から
- ピーク帯は 01:00–04:00 と 06:00–10:00 UTC、それ以外の時間帯はオフピーク
- V4-Pro(1Mトークンあたり): オフピーク 入力$0.66・出力$1.98、ピーク 入力$1.32・出力$3.96
- 現行のフラット料金(V4-Proは入力キャッシュミス$0.435・出力$0.87)と比べ、オフピーク帯でも単価は引き上げられる水準となる
出典: DeepSeek APIドキュメント「Change Log」、DeepSeek APIドキュメント「DeepSeek-V4-Pro GA Release」、DeepSeek APIドキュメント「Models & Pricing」(いずれも2026-08-14確認)。