MODELS / 01
Cloudflare、マルチモーダル決定モデル「Clef-omni」を公開 — 音声・動画・画像・テキストを単一APIで判定
Cloudflareが2026年10月9日に発表したマルチモーダル決定モデルClef-omniの仕様、価格改定、高速化、ベンダー公称ベンチマークを一次情報に基づき整理。
TAG / TOPIC
「マルチモーダル」に関するAIニュースと解説記事の一覧です。
10 STORIES
LATEST STORIES
MODELS / 01
Cloudflareが2026年10月9日に発表したマルチモーダル決定モデルClef-omniの仕様、価格改定、高速化、ベンダー公称ベンチマークを一次情報に基づき整理。
MODELS / 01
Googleが2026年10月6日に公開したEmbeddingGemma 2を公式開発者ガイドの一次情報から整理する。740Mのマルチモーダル埋め込み、モジュラー構成、Matryoshka次元削減、MTEB (Code) の評価公称値、sentence-transformersでの使い方を解説。
MODELS / 01
Xiaomi MiMoが2026年9月22日にMiMo-V2.6シリーズ(Pro-RL約524B・Flash-RL約159B・Distill-Qwen-9B)をオープンソース公開。AA知能指数46点、6日間のLive RL訓練、DeepSWE v1.1の改善幅、再現用リソースの公開を一次情報から整理。
MODELS / 01
Googleが2026年9月15日に音声会話モデルGemini 3.8 Liveと3.8 Live Extended Thinkingを発表。非同期ツール実行、映像コンテキスト、97言語対応、提供形態(Gemini API・AI Studio・Gemini Enterprise・Geminiアプリ)を公式発表の記載範囲で整理。
MODELS / 01
H Companyが2026年9月3日にマルチモーダル・多言語エンコーダNeoMME(260M/800M)を公開。単一Transformerでテキストと画像を処理し、Apache 2.0でチェックポイントを提供。ViDoReベンチマークでの検索性能と高速化・圧縮の数値を整理する。
MODELS / 01
Z.aiは2026年8月26日、GLM-5.3-Flashを公開した。320B総パラメータ(18Bアクティブ)のネイティブマルチモーダルMoEで、長文推論コストを下げるハイブリッドAttentionとManifold-Constrained Hyper-Connectionsを導入。Hugging FaceでMITライセンスのオープンウェイトとして提供され、1Mコンテキストと推論制御を備える。
MODELS / 01
Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。
MODELS / 01
DeepSeekが2026年8月21日、実験的マルチモーダルモデルDeepSeek-V4-Flash-Vision-ExpをAPIで公開。V4-Flashと同等のテキスト性能を維持しつつマルチモーダルエージェント性能を大幅強化し、Opus-4.8に迫るとするベンダー公称ベンチマークを提示。料金はV4-Flashと同額、Files APIを同時リリース。
MODELS / 01
Xiaohongshu傘下のDots Studioは2026年8月中旬、オープンウェイトモデル「dots3-note Preview」をApache 2.0で公開した。280B総パラメータ/16BアクティブのMoE、512Kコンテキスト、4モダリティ入力など、モデルカード・GitHub README・Hugging Faceで確認できる事実を整理する。
MODELS / 01
Meta Superintelligence Labsが、単一のコンシューマーGPUで動作するオープンウェイトのエージェント特化モデルMuse Glimmer 30BをApache 2.0ライセンスで公開した。仕様と設計意図を整理する。