計算ノードの中心に浮かぶ青い推論コアの抽象ビジュアル
NAW / MODELS 01

IMAGE: AI生成ビジュアル

MODELS / MODEL WATCH

DeepSeek、「V4-Pro」正式版を公開 — エージェント能力を強化し、時間帯別料金へ移行

総パラメータ1.6T・アクティブ49BのMoEモデル。アプリ・Web・APIで提供を開始し、OpenAI Responses APIにネイティブ対応。思考量の3段階制御と、8月16日からのピーク/オフピーク料金も発表。

DeepSeekは2026年8月13日、フラッグシップモデル「DeepSeek-V4-Pro」の正式版(GA)をアプリ・Web・APIで提供開始した。APIの呼び出し方法は従来と変わらず、モデル名を deepseek-v4-pro に指定するだけで最新版が使える。エージェント用途を中心に能力を強化したほか、OpenAIのResponses APIへのネイティブ対応、思考量の3段階制御、そしてピーク/オフピーク制の新料金をあわせて発表している。

エージェント能力の強化(ベンダー公称値)

GA版では、実運用環境でのエージェント性能を中心に改善したとしている。公表された主なベンチマーク値は以下の通り。いずれもDeepSeekが提示する公称値であり、独立した再現評価は今後を待つ必要がある。

  • Terminal Bench 2.1: 87.9、Cybergym: 83.3、Toolathlon-Verified: 74.1
  • DeepSWE: 62.7、NL2Repo: 61.5、DSBench-FullStack: 71.1
  • HLE(ツールなし/あり): 42.7/60.0、Agents’ Last Exam: 25.7
  • 対象バージョンは DeepSeek-V4-Pro-0813(V4-Flash は V4-Flash-0731)

API連携と思考量の制御

API周りでは、外部ツールと組み合わせた利用を想定した変更が入った。推論コストをタスクの難しさに応じて調整できる点も特徴だ。

  • OpenAI Responses API形式にネイティブ対応し、Codex向けにワンクリック設定スクリプトを用意
  • V4-Pro/V4-Flashの思考モードに「低・高・最大」の3段階の思考量を導入
  • コンテキスト長は1M、最大出力は384K(仕様上の上限)

ピーク/オフピーク料金への移行

V4ファミリーの正式リリースに伴い、API料金を時間帯別(ピーク/オフピーク)に改定する。オフピークはピークの半額で、負荷を時間帯で平準化する狙いとしている。

  • 新料金の適用は2026年8月16日 16:00 UTC(日本時間 8月17日 1:00)から
  • ピーク帯は 01:00–04:00 と 06:00–10:00 UTC、それ以外の時間帯はオフピーク
  • V4-Pro(1Mトークンあたり): オフピーク 入力$0.66・出力$1.98、ピーク 入力$1.32・出力$3.96
  • 現行のフラット料金(V4-Proは入力キャッシュミス$0.435・出力$0.87)と比べ、オフピーク帯でも単価は引き上げられる水準となる

出典: DeepSeek APIドキュメント「Change Log」、DeepSeek APIドキュメント「DeepSeek-V4-Pro GA Release」、DeepSeek APIドキュメント「Models & Pricing」(いずれも2026-08-14確認)。