COMPUTE / 06
NVIDIA、Vera Rubin NVL72の実測値を公開 — GB300比でワットあたり最大30倍、トークンコスト35分の1を主張
NVIDIAがVera Rubin NVL72の実シリコンでの推論性能を公開。AgentXによるagenticワークロードでGB300比30倍の電力効率と35分の1のトークンコストを主張、NVL72スケールアップとNVLinkなどプラットフォーム詳細も解説。
TAG / TOPIC
「推論」に関するAIニュースと解説記事の一覧です。
04 STORIES
LATEST STORIES
COMPUTE / 06
NVIDIAがVera Rubin NVL72の実シリコンでの推論性能を公開。AgentXによるagenticワークロードでGB300比30倍の電力効率と35分の1のトークンコストを主張、NVL72スケールアップとNVLinkなどプラットフォーム詳細も解説。
COMPUTE / 06
Cloudflareは2026年8月17日、Workers AIにQwen 3.8 27Bを追加した。Alibaba QwenがApache 2.0で公開した27B密度型VLMが、エッジAI推論プラットフォームで利用可能になる。機能・料金・利用方法を一次情報(Cloudflare公式Changelog・モデルページ)に基づいて整理する。
COMPUTE / 06
Cloudflareは2026年8月14日、Workers AIにDeepSeek V4 FlashとDeepSeek V4 Proを追加した。プラットフォーム初の100万トークンコンテキスト対応モデルで、思考モードと関数呼び出しにも対応する。モデルの特徴、利用方法、提供条件を一次情報(Cloudflare公式Changelog)に基づいて整理する。
MODELS / 01
DeepSeekが2026年8月13日、フラッグシップモデルDeepSeek-V4-Proの正式版(GA)を公開した。エージェント能力の強化、Responses API対応、思考量制御、新料金体系を一次情報に基づいて整理する。