液冷式AIサーバーと発光する計算基盤の抽象ビジュアル
NAW / COMPUTE 06

IMAGE: AI生成ビジュアル

COMPUTE / INFRASTRUCTURE

Cloudflare Workers AIにDeepSeek V4 Flash/Proが登場 — プラットフォーム初の100万トークンコンテキスト

「@cf/deepseek-ai/deepseek-v4-pro-0813」と「@cf/deepseek-ai/deepseek-v4-flash-0731」を追加。1,048,576トークンのコンテキスト窓はWorkers AI上の全モデルで最大。思考モードと関数呼び出しに対応し、長期エージェントワークフローや大規模コードベース向け。利用にはWorkers有料プランかAI Gatewayのプリペイドクレジットが必要。

Cloudflareは2026年8月14日、エッジAI推論プラットフォーム「Workers AI」にDeepSeekのV4シリーズ2モデルを追加した。追加されたのは @cf/deepseek-ai/deepseek-v4-pro-0813 と @cf/deepseek-ai/deepseek-v4-flash-0731 で、いずれもDeepSeek公式が公開したV4-Pro-0813/V4-Flash-0731と同一バージョンだ。

プラットフォーム初の100万トークンコンテキスト

両モデルは1,048,576トークン(100万)のフルコンテキスト窓を持ち、これはWorkers AIにホストされている全モデルのなかで最大となる。

  • 長期実行するエージェントワークフロー、大規模コードベース、マルチステップ推論など、他モデルのコンテキスト上限を超えるタスク向けと位置づけられる
  • 複雑な問題を段階的に解く思考モード(thinking mode)と、複数ターンにわたってツールやAPIを呼び出す関数呼び出し(function calling)の双方に対応

2モデルの役割分担

V4 Flashは、より高速・低コストな兄弟モデルとして案内されている。Workers AI上のプレビュー版を置き換える形で提供され、エージェント能力が大幅に強化されたという。

  • deepseek-v4-flash-0731: 高速・低コスト寄り。プレビュー版からの置き換えでエージェント能力を強化
  • deepseek-v4-pro-0813: フラッグシップのV4 Pro。8月13日にDeepSeekが正式版(GA)を公開したモデルと同一

利用方法と提供条件

モデルはWorkers AIバインディング(env.AI.run())、REST API、OpenAI互換エンドポイント、AI Gatewayのいずれからも呼び出せる。提供にはWorkers有料プラン、またはAI Gatewayのプリペイドクレジットが必要で、無料プランでは利用できない点に注意したい。料金の詳細はCloudflareのモデルページ・価格ページを参照する必要がある。

出典: Cloudflare Changelog「DeepSeek V4 Flash and Pro now available on Workers AI」(2026-08-15確認)