TAG / TOPIC

オープンウェイト

「オープンウェイト」に関するAIニュースと解説記事の一覧です。

33 STORIES

LATEST STORIES

オープンウェイトの新着記事

タグ一覧

MODELS / 01

Liquid AI、エッジ向けオープンウェイト決定モデル「d1-3B」「d1-omni-600M」を公開 — トークン生成なしの単一フォワードパスで回答

Liquid AIが2026年10月7日に公開したオープンウェイト決定モデルd1-3Bとd1-omni-600Mを公式ブログ・Hugging Faceの一次情報から整理。単一フォワードパス回答の設計、Decision Indexや7種テキストベンチマークの公称値、NVIDIA・AMD・Apple・Jetsonでのレイテンシ、llama.cpp対応とライセンス上の注意を扱う。

MODELS / 01

Reflectionが501B・23BアクティブのMoE「Beam」を発表 — 米オープンウェイトの新鋒、重みは10月中にApache 2.0で公開へ

Reflectionが2026年10月5日に発表したオープンウェイトモデルBeam(501B・23BアクティブMoE)を公式ブログの一次情報から整理する。23.8兆トークンの事前学習、大規模RLの計算規模、ベンチマーク公称値、安全性の取り組み、Apache 2.0での重み公開予定を解説。

MODELS / 01

Musubiがモデレーション用小型モデル「PolicyLM-1.7B」をオープンウェイト公開 — 自社ポリシーを読む判定モデル、中央値35ミリ秒

Musubiが2026年10月6日に公開したオープンモデルPolicyLM-1.7Bを一次情報に基づき整理。Apache 2.0のオープンウェイト、ポリシー条件付きの判定方式、速度・精度の公表値、カットオフ設定、19言語評価、制限事項を扱う。

MODELS / 01

Mistral Large 4(Le Chonk)をプレビュー公開 — 1Tパラメーター・49BアクティブのMoE、月末に重み公開へ

Mistral AIが2026年10月6日に発表したMistral Large 4(Le Chonk)の公開プレビューを公式発表の一次情報から整理する。1T・49BアクティブMoEの仕様、DeepSWE・Terminal-Bench・Cybench等のベンチマーク公称値、料金、欧州データセンターでの学習、月末の重み公開予定を解説。

MODELS / 01

Cloudflare、オープンな意思決定モデル「Clef」と「Clef-flash」を公開 — Workers AIで提供、Apache 2.0でオープンソース化

Cloudflareが2026年10月1日に意思決定モデル「Clef」「Clef-flash」を公開した。Qwen3.8-27B/Qwen3.5-9Bをベースに後段学習したマルチモーダルモデルで、Workers AIでホストし、Hugging FaceでApache 2.0ライセンスとして公開。Jev API互換とベンダー公称のベンチマーク結果、新しい強化学習ファインチューニング基盤を一次情報に基づき整理する。

GOVERNANCE / 07

AnthropicのFrontier Red Team、ZhipuのGLM-5.3は「Mythos Preview並みのエクスプロイト能力を実質無制限に提供」と報告

AnthropicのFrontier Red Teamが2026年9月29日に公開したGLM-5.3のサイバー能力分析を一次情報に基づき整理。ExploitBenchと内部ベンチマークの測定値、ブラウザの未知脆弱性を連鎖させた実働エクスプロイト、CVE-2026-11645からのARM64攻撃チェーン構築、安全策の回避率とabliterationのコスト、NIST CAISI評価との整合、防御側への示唆までを解説する。

AGENTS / 02

Hが汎用コンピュータ利用エージェント「Holo4」を公開 — 27Bと35B-A3B、OSWorld 2.0で27Bが61.7%と主張

Hcompanyが2026年9月28日に公開した汎用コンピュータ利用エージェントHolo4を一次情報(Hugging Face Blog)に基づき整理。27Bと35B-A3Bの2サイズ、OSWorld 2.0やAutomationBenchでのベンダー公表性能、Agentic Task Factoryによる約1万タスクでの学習、重み公開とH Models APIでの提供、Holotron4 Nanoを扱う。

MODELS / 01

AlibabaのQwen、画像生成・編集モデル「Qwen-Image-2.1」をオープンウェイト公開 — 7Bで透過PNG生成と最大10枚参照編集に対応

AlibabaのQwenチームが2026年9月20日に画像生成・編集モデルQwen-Image-2.1をオープンウェイト公開。70億パラメータの生成部、透過RGBA対応、最大10枚参照の編集、2K解像度、Qwen Research License、初日対応の推論基盤を一次情報から整理。

MODELS / 01

階躍星辰(StepFun)が「Step 5 Preview」を公開 — 100万トークンのエージェント向けフロンティアモデル、重みもHugging Faceに

中国の階躍星辰(StepFun)がフロンティアモデル「Step 5 Preview」のドキュメントを公開した。モデルIDはstep-5-previewで、テキスト・画像・動画入力、100万トークンのコンテキスト、ツールコールと推論強度の調整に対応する。`stepfun-ai` 名義のアカウントがHugging Faceに safetensors 形式の重みも公開している。

MODELS / 01

AllSpark、オープンウェイトの検索エージェントIris-mini/Iris-proを公開 — Qwen系MoEを探索学習で調整、同規模の公開勢で最高と主張

AllSpark-Researchが2026年9月に公開したオープンウェイト検索エージェントIris-mini/Iris-proを一次情報に基づき整理。Qwen系ベース、SFT-RL climbingによる学習、BrowseComp・HLE等の評価値、Iris-Harnessの同梱、Apache-2.0での重み公開を扱う。

BUSINESS / 05

Mistral AIがシリーズDで30億ユーロ調達、評価額210億ユーロ超 — Samsung主導でソブリン×オープンウェイトを前面に

Mistral AIは2026年9月8日、Samsung Electronics主導のシリーズDで30億ユーロを調達し評価額210億ユーロ超となったと発表。EQT系Scaleup Europe FundとPSG Equityが共同主導。フロンティア研究・計算能力・インフラ拡張と商業成長に充当。20か国展開、125社超支援の一次情報を整理。

MODELS / 01

Z.ai、320B MoE「GLM-5.3-Flash」をMITで公開 — 18Bアクティブで1Mコンテキスト、“Ox Alpha”の正体

Z.aiは2026年8月26日、GLM-5.3-Flashを公開した。320B総パラメータ(18Bアクティブ)のネイティブマルチモーダルMoEで、長文推論コストを下げるハイブリッドAttentionとManifold-Constrained Hyper-Connectionsを導入。Hugging FaceでMITライセンスのオープンウェイトとして提供され、1Mコンテキストと推論制御を備える。

MODELS / 01

Alibaba Qwen、125B MoE「Qwen3.8-Flash-Next」を公開 — Qwen4アーキテクチャの先行版、6Bアクティブで長文・低遅延を狙う

Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。

RESEARCH / 04

Qwen3.8-27B、独立評価のArtificial Analysisインテリジェンス指標で52点 — 27BオープンウェイトがGPT-5.6 Luna級に

第三者のベンチマーク機関Artificial Analysisは2026年8月17日前後、Alibaba Qwen製の27Bオープンウェイトモデル「Qwen3.8-27B」の評価結果を公開した。インテリジェンス指標(9種の評価の複合)で52点を記録し、同指標でGPT-5.6 Luna(max)と同点、GLM-5.2(max)より1点低い水準。小規模なオープンウェイトモデルがフロンティア級のスコアに並んだ点が注目される一方、評価中の出力トークン数は160Mで中央値(43M)の約3.7倍と非常に冗長で、効率面の課題も明らかになった。数値は全てArtificial Analysis(一次情報)および同指標のデータに基づく。

BUSINESS / 05

Vercel AI Gatewayの「2026年8月版Production Index」— Anthropicが支出の65.1%・トークンは30%、平均トークン単価は13.6%下落

Vercelが2026年8月11日に公開した「AI Gateway Production Index」8月版(7月分データ)を一次情報に基づき整理する。毎月数十兆トークンを中継するAI Gatewayの匿名集計データで、トークン量+59%・支出+37%・平均トークン単価-13.6%、DeepSeekのトークン量2位浮上(約25%対Google 11%)、Anthropicが支出65.1%をトークン量30%で獲得(平均単価は他ラボの4.4倍)、Claude Fable 5の7月復帰後の支出13.2%シェア、オープンウェイトの支出シェア倍増(8.6%)などの数値を、測定方法(支出は各社公表リスト価格で評価)とあわせて解説する。

MODELS / 01

Xiaohongshu(RedNote)のDots Studio、初のオープンウェイトモデル「dots3-note Preview」を公開 — 280B MoE・512Kコンテキスト・Apache 2.0

Xiaohongshu傘下のDots Studioは2026年8月中旬、オープンウェイトモデル「dots3-note Preview」をApache 2.0で公開した。280B総パラメータ/16BアクティブのMoE、512Kコンテキスト、4モダリティ入力など、モデルカード・GitHub README・Hugging Faceで確認できる事実を整理する。

AGENTS / 02

Moonshot AIのオープンウェイトモデル「Kimi K3」がGitHub Copilotで利用可能に — Fireworks AIがホスト、全プランに展開

GitHubは2026年8月6日、Moonshot AIのオープンウェイトモデル「Kimi K3」をGitHub Copilotで提供開始した。8月13日公開の週次リリースでも全プランへの展開が言及されている。提供範囲、価格、管理者向けの有効化手順を一次情報(GitHub Changelog)に基づいて整理する。

MODELS / 01

Z.ai、「GLM-5.3」を公開 — コーディング50%改善と「創発したサイバー能力」、重みは約2週間後に公開予定

Z.ai(Zhipu AI)が2026年8月14日、コーディング特化モデル「GLM-5.3」を公開した。GLM-5.2と同じベースモデルから事後学習のみで性能を引き上げ、コーディングと脆弱性発見の両方で大きな改善を報告している。一次情報(Z.ai公式ブログ・公式ドキュメント)に基づき、公表されたベンチマーク、サイバー能力の扱い、提供形態を整理する。

MODELS / 01

NVIDIA、エージェント実行層向けオープンモデル「Nemotron 3.5 Lightning」を公開 — 30B MoE・3Bアクティブで最大4倍の出力速度

NVIDIAが2026年8月11日、エージェントの実行層に特化したオープンモデル「Nemotron 3.5 Lightning(30B-A3B)」を公開した。アーキテクチャ、速度と精度の両立手法、公表されたベンチマーク、ライセンス、提供形態を一次情報に基づいて整理する。

MODELS / 01

Liquid AI、エッジ向け最上位VLM「LFM2.5-VL-3B」を公開 — 画面理解・物体接地・ツール呼び出しを強化

Liquid AIが2026年8月12日、自社ハードウェアで動かせる最上位の視覚言語モデル「LFM2.5-VL-3B」をHugging Faceで公開した。アーキテクチャと学習方法、公表されたベンチマークと推論速度、提供形態とライセンスを一次情報に基づいて整理する。