TAG / TOPIC

マルチモーダル

「マルチモーダル」に関するAIニュースと解説記事の一覧です。

10 STORIES

LATEST STORIES

マルチモーダルの新着記事

タグ一覧

MODELS / 01

H Company、マルチモーダル・多言語エンコーダ「NeoMME」を公開 — 260M/800MをApache 2.0で、文書検索でサイズ別Pareto最前線

H Companyが2026年9月3日にマルチモーダル・多言語エンコーダNeoMME(260M/800M)を公開。単一Transformerでテキストと画像を処理し、Apache 2.0でチェックポイントを提供。ViDoReベンチマークでの検索性能と高速化・圧縮の数値を整理する。

MODELS / 01

Z.ai、320B MoE「GLM-5.3-Flash」をMITで公開 — 18Bアクティブで1Mコンテキスト、“Ox Alpha”の正体

Z.aiは2026年8月26日、GLM-5.3-Flashを公開した。320B総パラメータ(18Bアクティブ)のネイティブマルチモーダルMoEで、長文推論コストを下げるハイブリッドAttentionとManifold-Constrained Hyper-Connectionsを導入。Hugging FaceでMITライセンスのオープンウェイトとして提供され、1Mコンテキストと推論制御を備える。

MODELS / 01

Alibaba Qwen、125B MoE「Qwen3.8-Flash-Next」を公開 — Qwen4アーキテクチャの先行版、6Bアクティブで長文・低遅延を狙う

Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。

MODELS / 01

DeepSeek、マルチモーダル「V4-Flash-Vision-Exp」を公開 — V4-Flash同等のテキスト性能に視覚理解を追加、Files APIも同時提供

DeepSeekが2026年8月21日、実験的マルチモーダルモデルDeepSeek-V4-Flash-Vision-ExpをAPIで公開。V4-Flashと同等のテキスト性能を維持しつつマルチモーダルエージェント性能を大幅強化し、Opus-4.8に迫るとするベンダー公称ベンチマークを提示。料金はV4-Flashと同額、Files APIを同時リリース。

MODELS / 01

Xiaohongshu(RedNote)のDots Studio、初のオープンウェイトモデル「dots3-note Preview」を公開 — 280B MoE・512Kコンテキスト・Apache 2.0

Xiaohongshu傘下のDots Studioは2026年8月中旬、オープンウェイトモデル「dots3-note Preview」をApache 2.0で公開した。280B総パラメータ/16BアクティブのMoE、512Kコンテキスト、4モダリティ入力など、モデルカード・GitHub README・Hugging Faceで確認できる事実を整理する。