TAG / TOPIC

VLM

「VLM」に関するAIニュースと解説記事の一覧です。

05 STORIES

LATEST STORIES

VLMの新着記事

タグ一覧

MODELS / 01

Liquid AI、視覚言語モデル向けDSparkドラフトを公開 — LFM2.5-VL-3Bのデコードを最大3.13倍高速化

Liquid AIは2026年9月24日、VLM「LFM2.5-VL-3B」向け投機的デコーディング用ドラフトモデル「LFM2.5-VL-DSpark」を公開した。4層・約280Mパラメータ(279.5M、+8.9%)の軽量ドラフトで、MLX(M5 Max)でデコード最大3.13倍・end-to-end最大2.62倍、SGLang(H100)でデコード最大2.66倍・end-to-end最大2.27倍を報告。6種のMMSpecタスクで評価。llama.cpp(GGUF)/MLX-VLM/SGLangにday-one対応。Hugging Faceで重みを公開(独自ライセンス)。

MODELS / 01

Alibaba・Qwen、自動運転向け視覚言語基盤モデル「Qwen-Drive-1.0」を公開 — 3D知覚・対話・軌道計画を単一モデルに統合、Apache 2.0

AlibabaのQwenチームと華中科技大学が公開した自動運転向け視覚言語基盤モデルQwen-Drive-1.0を一次情報(GitHub・Hugging Face・技術レポート)に基づき整理。BEV知覚ヘッドと計画エキスパートの構成、NAVSIM・Waymo・NVIDIA PhysicalAIでの計画性能、運転VQAと汎用VQAの評価値を扱う。

COMPUTE / 06

Cloudflare Workers AIにQwen 3.8 27Bが登場 — 262KコンテキストのApache 2.0 VLMをエッジ推論で利用可能に

Cloudflareは2026年8月17日、Workers AIにQwen 3.8 27Bを追加した。Alibaba QwenがApache 2.0で公開した27B密度型VLMが、エッジAI推論プラットフォームで利用可能になる。機能・料金・利用方法を一次情報(Cloudflare公式Changelog・モデルページ)に基づいて整理する。

MODELS / 01

Liquid AI、エッジ向け最上位VLM「LFM2.5-VL-3B」を公開 — 画面理解・物体接地・ツール呼び出しを強化

Liquid AIが2026年8月12日、自社ハードウェアで動かせる最上位の視覚言語モデル「LFM2.5-VL-3B」をHugging Faceで公開した。アーキテクチャと学習方法、公表されたベンチマークと推論速度、提供形態とライセンスを一次情報に基づいて整理する。