COMPUTE / 06
vLLM v0.31.0が公開 — 717コミット、DeepSeek-V4.1-Flash高速化と再起動高速化・スケジューラ改善が柱
vLLM v0.31.0(2026年10月5日公開、安定版)の内容をGitHubリリースノートの一次情報から整理する。DeepSeek-V4.1-Flash性能改善、Fast restart、Model Runner V2と投機的デコーディング、大規模サービング、破壊的変更を解説。
TAG / TOPIC
「vLLM」に関するAIニュースと解説記事の一覧です。
04 STORIES
LATEST STORIES
COMPUTE / 06
vLLM v0.31.0(2026年10月5日公開、安定版)の内容をGitHubリリースノートの一次情報から整理する。DeepSeek-V4.1-Flash性能改善、Fast restart、Model Runner V2と投機的デコーディング、大規模サービング、破壊的変更を解説。
COMPUTE / 06
vLLM v0.30.0(2026年9月22日公開、安定版)の内容をGitHubリリースノートの一次情報から整理する。新モデル対応、Fast Start、透かし生成、HiSparse、Model Runner V2、破壊的変更を解説。
COMPUTE / 06
vLLM v0.29.0が公開。Model Runner V2の全モデル既定化、新モデル対応、投機的デコーディングとRL重み同期の強化、破壊的変更などを整理。
COMPUTE / 06
vLLM v0.28.0が公開。Kimi-K3の大幅最適化、DeepSeek V4のsparse MLA、投機的デコーディング、Model Runner V2、階層KVキャッシュなどを強化。