MODELS / 01
Reflectionが501B・23BアクティブのMoE「Beam」を発表 — 米オープンウェイトの新鋒、重みは10月中にApache 2.0で公開へ
Reflectionが2026年10月5日に発表したオープンウェイトモデルBeam(501B・23BアクティブMoE)を公式ブログの一次情報から整理する。23.8兆トークンの事前学習、大規模RLの計算規模、ベンチマーク公称値、安全性の取り組み、Apache 2.0での重み公開予定を解説。
TAG / TOPIC
「MoE」に関するAIニュースと解説記事の一覧です。
18 STORIES
LATEST STORIES
MODELS / 01
Reflectionが2026年10月5日に発表したオープンウェイトモデルBeam(501B・23BアクティブMoE)を公式ブログの一次情報から整理する。23.8兆トークンの事前学習、大規模RLの計算規模、ベンチマーク公称値、安全性の取り組み、Apache 2.0での重み公開予定を解説。
PRODUCTS / 03
Hugging Face Transformers v5.19.0(2026年10月6日公開・stable)の内容をGitHubリリースノートに基づき整理。EmbeddingGemma 2の新規統合、MoE・OWL-ViT・連続バッチ関連の破壊的変更、エキスパート並列のトークンディスパッチ既定化、層別キャッシュ設定の対応を扱う。
MODELS / 01
Mistral AIが2026年10月6日に発表したMistral Large 4(Le Chonk)の公開プレビューを公式発表の一次情報から整理する。1T・49BアクティブMoEの仕様、DeepSWE・Terminal-Bench・Cybench等のベンチマーク公称値、料金、欧州データセンターでの学習、月末の重み公開予定を解説。
MODELS / 01
Reflection AIが2026年10月5日に発表したオープンウェイトモデルBeam(501B総パラメーター・23BアクティブのMoE)を公式ブログの一次情報から整理する。ベンチマーク公称値、100Mロールアウトの強化学習、公開スケジュールを解説。
MODELS / 01
Aleph Alphaが2026年10月3日に公開した独英特化MoEモデルKolibri-1を一次情報(公式ブログ・Hugging Faceモデルカード)に基づき解説。78B総・3.46B活性、最大104万トークン、Apache 2.0、vLLM対応、ベンダー報告の評価値と学習・計算資源の詳細を整理。
MODELS / 01
Upstageが2026年10月2日にエージェント特化モデルSolar Mini 4を公開。35B中3B活性のMoE、512Kコンテキスト、Intelligence Index 24.1、AutomationBench-AA 22.3%、API価格、reasoning_effortや構造化出力対応を一次情報に基づき整理する。
COMPUTE / 06
アレンAI研究所(Ai2)が2026年10月1日にMoE学習フレームワーク「Olmo-core 3」を公開した。エキスパート並列・パイプライン並列・分散オプティマイザに加え、GPU常駐ルーティングやMXFP8対応で1兆パラメータ級の学習に対応。次世代Olmoの基盤にもなる完全オープンの学習スタックを一次情報に基づき整理する。
COMPUTE / 06
DeepSeekがGitHubのdeepseek-ai organizationでHuawei Ascend NPU向けのDeepGEMM-AscendとDeepEP-Ascendを9月29〜30日に公開。API互換性、対応精度、ライセンス表示の違いを一次情報に基づき整理する。
MODELS / 01
DeepSeekが2026年9月10日にV4.1-Flashを公開。552BパラメータのMoEとCausal Encoder-Decoder、KVキャッシュ削減、APIモデルID・V4-Pro移行スケジュール・オープンスウェイト公開を公式APIドキュメントから整理。
COMPUTE / 06
vLLM v0.29.0が公開。Model Runner V2の全モデル既定化、新モデル対応、投機的デコーディングとRL重み同期の強化、破壊的変更などを整理。
COMPUTE / 06
高性能LLMサービングフレームワークSGLangが2026年9月5日に安定版v0.5.19を公開。786件のPR・214名のコントリビューターによる大規模リリースで、ビームサーチ対応、DeepEP v2 ElasticBufferバックエンド、統合radix treeの既定化、LayerNorm系列並列、Hopper向けW4A8 MoE、Blackwell既定バックエンドでのDCP、AMD向けLean attention、Qwen3.8・Spark2.5・Granite 4.2など9モデルの新規対応を含む。
MODELS / 01
Tencentが770B総パラメータ・49BアクティブのMixture-of-Experts「Hy4 preview」をApache 2.0でオープンソース公開。100万トークン長文対応、コーディングや科学計算で大幅強化、推論基盤の自己最適化でスループット31.8%向上。
MODELS / 01
Z.aiは2026年8月26日、GLM-5.3-Flashを公開した。320B総パラメータ(18Bアクティブ)のネイティブマルチモーダルMoEで、長文推論コストを下げるハイブリッドAttentionとManifold-Constrained Hyper-Connectionsを導入。Hugging FaceでMITライセンスのオープンウェイトとして提供され、1Mコンテキストと推論制御を備える。
MODELS / 01
Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。
MODELS / 01
Xiaohongshu傘下のDots Studioは2026年8月中旬、オープンウェイトモデル「dots3-note Preview」をApache 2.0で公開した。280B総パラメータ/16BアクティブのMoE、512Kコンテキスト、4モダリティ入力など、モデルカード・GitHub README・Hugging Faceで確認できる事実を整理する。
MODELS / 01
NVIDIAが2026年8月11日、エージェントの実行層に特化したオープンモデル「Nemotron 3.5 Lightning(30B-A3B)」を公開した。アーキテクチャ、速度と精度の両立手法、公表されたベンチマーク、ライセンス、提供形態を一次情報に基づいて整理する。
MODELS / 01
Qwenが初めてMax級モデル「Qwen3.8-2.4T-A95B」をオープンウェイトで公開した。テキスト専用・思考必須という位置づけや、新設ライセンス「qwen3.8-max」の条件を一次情報に基づいて整理する。
MODELS / 01
DeepSeekが2026年8月13日、フラッグシップモデルDeepSeek-V4-Proの正式版(GA)を公開した。エージェント能力の強化、Responses API対応、思考量制御、新料金体系を一次情報に基づいて整理する。