LATEST / Cloudflare
Cloudflare、マルチモーダル決定モデル「Clef-omni」を公開 — 音声・動画・画像・テキストを単一APIで判定
Cloudflareは2026年10月9日、オープンウェイトの決定モデル群Clefに新モデルClef-omniを追加した。音声と動画をテキスト・画像と合わせて単一API呼び出しで処理し、重みはHugging Faceで公開。同時にClef-flashの値下げとClefの高速化も発表した。
記事を読むSECTION / MODELS
基盤モデル、マルチモーダル、推論能力、オープンモデルなど、AIの能力を更新する中核技術を追います。
81 ARTICLES
LATEST / Cloudflare
Cloudflareは2026年10月9日、オープンウェイトの決定モデル群Clefに新モデルClef-omniを追加した。音声と動画をテキスト・画像と合わせて単一API呼び出しで処理し、重みはHugging Faceで公開。同時にClef-flashの値下げとClefの高速化も発表した。
記事を読むMODELS
MODELS / 01
OpenAIが2026年10月8日のCodex変更履歴で公表したGPT-6.1 Sol UltrafastのCodex・ChatGPT Work対応を一次情報から整理。対象プラン、Enterpriseの既定無効と有効化手順の要否、推論レジデンシーの対応地域を紹介する。
MODELS / 01
UAEのTIIが2026年10月7日に発表した音声認識モデルFalcon-ASRを公式発表の一次情報から整理する。16億パラメーターの構成、アラビア語・首長国方言・英語の公称評価、単語タイムスタンプや5言語同一重み対応を解説。
MODELS / 01
Liquid AIが2026年10月7日に公開したオープンウェイト決定モデルd1-3Bとd1-omni-600Mを公式ブログ・Hugging Faceの一次情報から整理。単一フォワードパス回答の設計、Decision Indexや7種テキストベンチマークの公称値、NVIDIA・AMD・Apple・Jetsonでのレイテンシ、llama.cpp対応とライセンス上の注意を扱う。
MODELS / 01
Anthropicが2026年10月7日に発表したClaude Haiku 5.5を一次情報に基づき整理。ベンチマーク公称値、100kトークンを境とする新料金体系、対応プラットフォーム、安全対策、Sonnet 5.5のキャッシュ値下げとAPIクレジットを扱う。
MODELS / 01
Reflectionが2026年10月5日に発表したオープンウェイトモデルBeam(501B・23BアクティブMoE)を公式ブログの一次情報から整理する。23.8兆トークンの事前学習、大規模RLの計算規模、ベンチマーク公称値、安全性の取り組み、Apache 2.0での重み公開予定を解説。
MODELS / 01
Musubiが2026年10月6日に公開したオープンモデルPolicyLM-1.7Bを一次情報に基づき整理。Apache 2.0のオープンウェイト、ポリシー条件付きの判定方式、速度・精度の公表値、カットオフ設定、19言語評価、制限事項を扱う。
MODELS / 01
Google DeepMindが2026年10月に公開したNano Banana 2.1のモデルカードを一次情報から整理する。Gemini 3.6 Flashベースの仕様、入出力とコンテキスト、6つの提供チャネル、T2I・編集のElo評価公称値、既知の制限と安全性評価を解説。
MODELS / 01
Googleが2026年10月6日に公開したEmbeddingGemma 2を公式開発者ガイドの一次情報から整理する。740Mのマルチモーダル埋め込み、モジュラー構成、Matryoshka次元削減、MTEB (Code) の評価公称値、sentence-transformersでの使い方を解説。
MODELS / 01
Mistral AIが2026年10月6日に発表したMistral Large 4(Le Chonk)の公開プレビューを公式発表の一次情報から整理する。1T・49BアクティブMoEの仕様、DeepSWE・Terminal-Bench・Cybench等のベンチマーク公称値、料金、欧州データセンターでの学習、月末の重み公開予定を解説。
MODELS / 01
UAEのTIIが2026年10月6日に発表した方言特化モデルFalcon-Emirati-7Bを公式発表の一次情報から整理する。Falcon-H1-Arabicベースの構成、3系統のデータ戦略、Alyahベンチマーク84.83%やLLMジャッジ評価の公称結果を解説。
MODELS / 01
Reka AIが2026年10月5日に発表した19Bオムニ推論モデルRho-1(研究プレビュー)を公式発表の一次情報から整理する。単一ネットワークへの統合アーキテクチャ、0.79倍速の動画生成公称値、世界モデル・ロボティクスへの展開、学習規模と提供条件を解説。
MODELS / 01
Reflection AIが2026年10月5日に発表したオープンウェイトモデルBeam(501B総パラメーター・23BアクティブのMoE)を公式ブログの一次情報から整理する。ベンチマーク公称値、100Mロールアウトの強化学習、公開スケジュールを解説。
MODELS / 01
Aleph Alphaが2026年10月3日に公開した独英特化MoEモデルKolibri-1を一次情報(公式ブログ・Hugging Faceモデルカード)に基づき解説。78B総・3.46B活性、最大104万トークン、Apache 2.0、vLLM対応、ベンダー報告の評価値と学習・計算資源の詳細を整理。
MODELS / 01
Upstageが2026年10月2日にエージェント特化モデルSolar Mini 4を公開。35B中3B活性のMoE、512Kコンテキスト、Intelligence Index 24.1、AutomationBench-AA 22.3%、API価格、reasoning_effortや構造化出力対応を一次情報に基づき整理する。
MODELS / 01
Ai2が2026年10月2日に科学レポート生成モデルAstaBrief 8Bをオープンウェイト公開。Qwen3-8B起点のSFT+DPO学習、SQABench-CS2・DeepScholarBenchでの評価、51.1秒 vs 178.5秒の速度比較、Hugging Faceでの公開内容を一次情報に基づき整理する。
MODELS / 01
Microsoft AIは2026年10月1日、初のストリーミング音声認識モデルMAI-Transcribe-2-Streamingと多言語TTSモデルMAI-Voice-2.1/MAI-Voice-2.1-Flashを発表した。60言語のリアルタイム文字起こし、23言語対応の単一ボイス、150ミリ秒の低遅延、料金と提供経路を一次情報に基づき整理する。
MODELS / 01
Black Forest LabsがFLUX 3ファミリーの画像生成・編集を担う「FLUX 3 Image」の提供を開始した。境界ボックスによるレイアウト指定、最大10枚の参照画像合成、画素単位の多段階編集、ネイティブ4K生成を特徴とし、PlaygroundとAPI、商用ウェイトライセンスで提供する。公式モデルページに基づき整理する。
MODELS / 01
Cloudflareが2026年10月1日に意思決定モデル「Clef」「Clef-flash」を公開した。Qwen3.8-27B/Qwen3.5-9Bをベースに後段学習したマルチモーダルモデルで、Workers AIでホストし、Hugging FaceでApache 2.0ライセンスとして公開。Jev API互換とベンダー公称のベンチマーク結果、新しい強化学習ファインチューニング基盤を一次情報に基づき整理する。
MODELS / 01
Ideogramが2026年10月1日ごろに画像編集モデル「Ideogram 4.5」を公開した。繰り返し編集での画質劣化(ドリフト)抑制を前面に出し、GPT Image 2.5 SunburstやNano Banana Pro・Nano Banana 2との同一編集の比較映像、高解像度画像の部分編集機能を示している。公式モデルページに基づき整理する。
MODELS / 01
Tavusが2026年10月1日、初のHuman Interaction Model(HIM)「Griffin」(プレビュー版Griffin-Lite)を発表。会話モデリングと音声・映像生成を並行に動かす全二重video-to-video方式で、VideoFDBの生成・知覚の両部門で既存首位を上回ったとしている。仕組みと評価数値を一次情報に基づき整理する。
MODELS / 01
Google DeepMindが2026年9月30日に次世代フロンティアモデルGemini 4 Argonを発表。長時間・多段階の実務ワークフロー向けに設計され、ソフトウェア工学・法務金融の知識業務・サイバー防御で最高水準の性能をうたう。出力上限100万トークン、導入価格、評価結果、段階公開と安全策、社内活用実績を一次情報に基づき整理する。
MODELS / 01
NVIDIAが表データ向けオープンファウンデーションモデルKumo TabularをHugging Faceで公開。学習・調整・特徴量エンジニアリングなしに分類と回帰を予測し、TabArena、BeyondArena、TALENT、ScoringBenchで1位を報告。3サイズ、合成データ事前学習、OpenMDW-1.1ライセンス、制約を一次情報に基づき整理する。
MODELS / 01
OpenAIが2026年9月29日のDevDay 2026でGPT-6.1 Solを発表。エージェント型コーディング、computer use、専門業務でGPT-6 Astraに迫る性能を標準価格の5分の1で提供する。DeepSWE v1.1、GDP.pdf、AutomationBench、OSWorld 2.0、Terminal-Bench Science 0.1の評価結果、価格、提供形態、安全性評価を一次情報に基づき整理する。
MODELS / 01
Anthropicが2026年9月28日に公開したClaude Sonnet 5.5を一次情報に基づき整理。Sonnet 5比の速度・コスト改善、Terminal-BenchやGDPval-AAなどのベンダー公表評価、初のSonnet向けサイバーセーフガード、GitHub Copilotでの一般提供を含む提供条件を扱う。
MODELS / 01
NVIDIAが2026年9月23日に公開したオープンモデルNemotron 3 Diarizationを一次情報から整理。100Mパラメータ・最大8話者、VoiceArena Diarization-Benchで14.72% DERの1位、前世代比の改善、遅延設定、学習データ、OpenMDW 1.1ライセンスを扱う。
MODELS / 01
PrismMLが2026年9月23日に発表したSnapdragon搭載スマートグラス向け1ビットBonsaiモデルを一次情報に基づき整理。2B視覚言語モデルの構成、メモリ・速度の測定値、ベンチマーク比較の範囲と限界を扱う。
MODELS / 01
Liquid AIは2026年9月24日、VLM「LFM2.5-VL-3B」向け投機的デコーディング用ドラフトモデル「LFM2.5-VL-DSpark」を公開した。4層・約280Mパラメータ(279.5M、+8.9%)の軽量ドラフトで、MLX(M5 Max)でデコード最大3.13倍・end-to-end最大2.62倍、SGLang(H100)でデコード最大2.66倍・end-to-end最大2.27倍を報告。6種のMMSpecタスクで評価。llama.cpp(GGUF)/MLX-VLM/SGLangにday-one対応。Hugging Faceで重みを公開(独自ライセンス)。
MODELS / 01
Black Forest Labsが2026年9月に公開したオープンウェイトの世界行動モデルFLUX 3 Action(7B)を一次情報に基づき整理。RoboLab-120での評価、速度・コストの主張、ハイブリッド構成、重みの入手先を扱う。数値はいずれも同社公称値。
MODELS / 01
Googleが2026年9月23日に発表したGemini 3.8 Flash TTS/Flash-Lite TTSを一次情報に基づき整理。声の設計・複製機能、行単位の演出指定、Hume AI・Voice Arenaのベンダー公表評価、提供形態と安全対策を扱う。
MODELS / 01
AlibabaのQwenチームが音声モデル群Qwen-Audio-3.1を公開。Model Studioの公式ドキュメントで確認できたqwen-audio-3.1-realtime-plusの仕様と、2026年9月22日発効の音声系モデル値下げ通知の内容を一次情報中心に整理する。
MODELS / 01
OpenAIが2026年9月22日に発表したGPT-6 Sol/GPT-6 Lunaを一次情報に基づき整理。API価格、AutomationBench・DeepSWE・OSWorldなどのベンダー公表ベンチマーク、提供形態を扱う。
MODELS / 01
Anthropicが2026年9月22日に公開したClaude Opus 5.5を一次情報に基づき整理。Fable 5.1級の性能とOpus 5比40%のコスト削減、ベンダー公表ベンチマーク、外部評価と行動監査、Fable 5.1相当のセーフガード、提供条件を扱う。
MODELS / 01
xAIが2026年9月21日にAPI提供を開始したGrok 4.7(grok-4.7)の仕様・価格・推論設定を、xAI公式ドキュメントの一次情報から整理する。50万文脈、画像入力、4段階reasoning effort、200K超の2段階料金を解説。
MODELS / 01
TypeSafe AIが新たに公開した新モデルクラスSystem One Modelsと初の決定モデルJevを一次情報に基づき整理。RLCDによる較正済み判断、並列サンプリング、料金、ワークフロー評価、公開ベンチマークを出さない方針を扱う。
MODELS / 01
Xiaomi MiMoが2026年9月22日にMiMo-V2.6シリーズ(Pro-RL約524B・Flash-RL約159B・Distill-Qwen-9B)をオープンソース公開。AA知能指数46点、6日間のLive RL訓練、DeepSWE v1.1の改善幅、再現用リソースの公開を一次情報から整理。
MODELS / 01
AlibabaのQwenチームが2026年9月20日に画像生成・編集モデルQwen-Image-2.1をオープンウェイト公開。70億パラメータの生成部、透過RGBA対応、最大10枚参照の編集、2K解像度、Qwen Research License、初日対応の推論基盤を一次情報から整理。
MODELS / 01
中国の階躍星辰(StepFun)がフロンティアモデル「Step 5 Preview」のドキュメントを公開した。モデルIDはstep-5-previewで、テキスト・画像・動画入力、100万トークンのコンテキスト、ツールコールと推論強度の調整に対応する。`stepfun-ai` 名義のアカウントがHugging Faceに safetensors 形式の重みも公開している。
MODELS / 01
Alibaba Cloudが2026年9月18日更新のModel Studioドキュメントで音声・動画理解モデル「qwen3.8-omni-flash」を掲載。テキスト・画像・音声・動画入力、テキスト出力、100万トークンのコンテキストウィンドウ、既定有効のThinking、Function Calling・Web検索・キャッシュ対応、東京を含む6リージョンで提供。
MODELS / 01
Prism MLが2026年9月17日にBonsai 2 27Bを公開。Qwen3.8 27Bベースの27.8BパラメータTernaryマルチモーダルモデルで、5.9GB・フル精度比9倍超の省メモリ化と20ベンチマーク総合83.9(98.2%維持)を両立。RTX 5090で最大143トークン/秒、Apache 2.0で無償提供。
MODELS / 01
Google DeepMindが2026年9月15日に音声対話モデルGemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを発表。評価スコア、97言語対応やバックグラウンド実行などの機能、提供形態を一次情報に基づき整理する。
MODELS / 01
Googleが2026年9月15日に音声会話モデルGemini 3.8 Liveと3.8 Live Extended Thinkingを発表。非同期ツール実行、映像コンテキスト、97言語対応、提供形態(Gemini API・AI Studio・Gemini Enterprise・Geminiアプリ)を公式発表の記載範囲で整理。
MODELS / 01
AllSpark-Researchが2026年9月に公開したオープンウェイト検索エージェントIris-mini/Iris-proを一次情報に基づき整理。Qwen系ベース、SFT-RL climbingによる学習、BrowseComp・HLE等の評価値、Iris-Harnessの同梱、Apache-2.0での重み公開を扱う。
MODELS / 01
DeepSeekが2026年9月10日にV4.1-Flashを公開。552BパラメータのMoEとCausal Encoder-Decoder、KVキャッシュ削減、APIモデルID・V4-Pro移行スケジュール・オープンスウェイト公開を公式APIドキュメントから整理。
MODELS / 01
IBMが時系列予測の基盤モデルGranite PatchTST-FM-r2を公開。GIFT-EvalでCRPS 0.467・MASE 0.6846、商用利用可ライセンスでは首位。conformer化などの設計変更と学習データの透明性を一次情報で整理。
MODELS / 01
AlibabaのQwenチームと華中科技大学が公開した自動運転向け視覚言語基盤モデルQwen-Drive-1.0を一次情報(GitHub・Hugging Face・技術レポート)に基づき整理。BEV知覚ヘッドと計画エキスパートの構成、NAVSIM・Waymo・NVIDIA PhysicalAIでの計画性能、運転VQAと汎用VQAの評価値を扱う。
MODELS / 01
Google DeepMindとGoogle Researchが全球気象AIモデルWeatherNext 3を発表。毎時の実況衛星モザイクを取り込むFGNメッシュTransformerで、気温・湿度5km、降水はIMERG比CRPS最大60%改善(ベンダー公称)。Search・Gemini・Maps・Cloudで提供。
MODELS / 01
H Companyが2026年9月3日にマルチモーダル・多言語エンコーダNeoMME(260M/800M)を公開。単一Transformerでテキストと画像を処理し、Apache 2.0でチェックポイントを提供。ViDoReベンチマークでの検索性能と高速化・圧縮の数値を整理する。
MODELS / 01
Google DeepMindが2026年9月3日に気象AIモデルWeatherNext 3を発表。毎時更新・最大5km解像度の予報を生成し、Google検索・Geminiアプリ・Maps・Maps Platform・Earth Engineで提供開始。技術構成と提供形態を整理する。
MODELS / 01
OpenAIが2026年9月3日にGPT-6 Astraの提供を開始。Trusted Access Programの企業向けに先行提供し、APIとPlus・Pro・Business・Enterpriseプランへ数日中に拡大。105万トークンコンテキスト、5段階の推論設定、computer use対応などの仕様と、システムカードで示された安全性評価を整理する。
MODELS / 01
Meta Superintelligence LabsがMuse Spark 1.3を2026年9月2日に発表。エージェント/コーディング性能を改善し、長時間タスクでの要求保持や制約順守、自己認識を強化。従来比でツール呼び出し約20%、トークン約25%削減。Muse CodeとMeta Model APIで提供、max reasoningは追加の安全性テスト後に公開。
MODELS / 01
GoogleがGeminiのAgentic Video理解を発表。3.7 Flash等で動画を動的に探索・再視聴することで、標準ベンチマークでトークン最大88%・コスト最大66%削減、精度最大7%向上。APIでprocessingをagenticに設定するだけで利用でき、長尺動画の針穴探索や高速動作のカウントが大幅に効率化する。
MODELS / 01
Anthropicが2026年9月1日にClaude Fable 5.1とClaude Mythos 5.1を発表。同一モデルを一般向けと信頼アクセス向けに分岐し、長時間コーディングでSOTA、タンパク質設計でヒット率50%、金星地形の高精細化、GPUカーネル最大2.5倍高速化などの研究成果と、キャッシュ読み取り75%値下げ、EFSによるゼロ保持、EU AI Act準拠の透かしを明らかにした。
MODELS / 01
Google DeepMindがGemini 3.8 FlashとGemini 3.8 Flash Cyberを発表。3.7 Flashから3週間での更新で、DeepSWEやHLE-Verifiedなどでの性能向上と、サイバー領域での訓練による推論強化、導入価格の維持を明らかにした。
MODELS / 01
World Labsが9月1日に次世代世界モデルAtlasを発表。テキスト・画像・動画・3Dを共有の空間コンテキストに統合するomniモデルで、カメラ制御生成、空間再構築、時空間シミュレーション、画像生成を1モデルで実行。Marbleの次期版の中核として提供予定。
MODELS / 01
AnthropicがClaude Fable 5.1とMythos 5.1を発表。同一基盤モデルを安全対策の違いで2形態提供。キャッシュ読み取り値下げで典型ワークロード25%安、エージェント作業で最大45%削減。科学研究ベンチマークでも大幅向上を報告。
MODELS / 01
GoogleがGemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite向けにエージェント型動画理解を9月1日にリリース。Interactions/GenerateContent APIでタイムラインを動的に探索し、長尺コンテンツで最大88%のトークン削減を実現。
MODELS / 01
Runwayが初のInterface World Model「Solaris」を発表。コードを介さずUIをフレームごとにリアルタイム生成するアーキテクチャ、Gen-4.5/GWM-1からの発展、再構築ベンチマークとユーザースタディの結果、今後の課題と展望を整理。
MODELS / 01
Tencentが770B総パラメータ・49BアクティブのMixture-of-Experts「Hy4 preview」をApache 2.0でオープンソース公開。100万トークン長文対応、コーディングや科学計算で大幅強化、推論基盤の自己最適化でスループット31.8%向上。
MODELS / 01
Googleは2026年8月27日、動画生成モデルGemini Omni 1.1 Flashを発表した。シーン延長、始点・終点フレーム指定、360pドラフト、4Kアップスケール、参照動画入力など制作現場向けの制御機能を強化し、Gemini API(Google AI Studio / Gemini Enterprise Agent Platform)で提供する。
MODELS / 01
Z.aiは2026年8月26日、GLM-5.3-Flashを公開した。320B総パラメータ(18Bアクティブ)のネイティブマルチモーダルMoEで、長文推論コストを下げるハイブリッドAttentionとManifold-Constrained Hyper-Connectionsを導入。Hugging FaceでMITライセンスのオープンウェイトとして提供され、1Mコンテキストと推論制御を備える。
MODELS / 01
Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。
MODELS / 01
Googleは2026年8月26日、音声文字起こし専用モデル Gemini 3.5 Transcribe を発表した。最も高精度な speech-to-text モデルと位置づけ、既に自社プロダクトで稼働。Gemini API経由でGoogle AI StudioとGemini Enterpriseでパブリックプレビューとして提供され、リアルタイムと録音音声の両対応をうたう。
MODELS / 01
IBMが推論特化のGranite 4.2(3B/8B/30B)をApache 2.0で公開。512Kコンテキスト、思考/非思考切替、8B/30BのAgentic RLなどビルド手法を解説。
MODELS / 01
アリババが動画生成モデルWan 3.0を2026年8月24日に正式公開。30秒のネイティブ動画を一括生成、テキスト/画像/映像/音声に加えドキュメント(doc/xls/ppt/pdf)を参照入力できるOmni-Reference、1080p・音声同時生成が特徴。ロイター等が同日報じ、AIBase/QbitAIが詳細を伝えた。
MODELS / 01
DeepSeekが2026年8月21日、実験的マルチモーダルモデルDeepSeek-V4-Flash-Vision-ExpをAPIで公開。V4-Flashと同等のテキスト性能を維持しつつマルチモーダルエージェント性能を大幅強化し、Opus-4.8に迫るとするベンダー公称ベンチマークを提示。料金はV4-Flashと同額、Files APIを同時リリース。
MODELS / 01
Liquid AIは2026年8月20日、Hugging FaceブログでLFM2.5向け投機的デコーディング「LFM2.5-DSpark」を公開した。LFM2.5-1.2B-Instruct/2.6B/8B-A1B向けに各約300Mパラメータ(5層・ブロック9)のアテンション特化ドラフトを提供。DFlash並列バックボーン+マルコフ逐次ヘッド+信頼度スケジュール検証のDSpark構成を採用。llama.cpp(M4 Max MacBook Pro・Metal・FP16 GGUF)とSGLang(H100・BF16)で評価し、H100で最大3.18倍、M4 Maxで最大2.87倍のスループット向上を報告。greedyではターゲットと同一出力のため精度不変、2.6BではBFCL相当の多ツール呼び出しレイテンシを平均57%削減。llama.cppとSGLangにday-one対応。
MODELS / 01
Liquid AIは2026年8月19日、Hugging FaceブログでLFM2.5向けのQ4_0 GGUFをQuantization-Aware Distillation(QAD)で刷新したと発表した。対象はLFM2.5-230M/350M/1.2B-Instruct/2.6B。教師モデルから量子化済み生徒モデルへ蒸留するQADにより、従来のPTQ Q4_0の品質低下を回復し、BF16平均精度の97%前後を維持すると報告。GPQA DiamondやMMLU-Proなど7種のベンチマーク平均(5回平均)で従来Q4_0を大幅に上回り、Q5_K_M/Q4_K_M並みの品質をより高いデコードスループットで達成。MacBook ProやGalaxy S26 Ultraなど4種の実機でも計測し、llama.cppで即利用可能。Hugging Faceで公開中。
MODELS / 01
アリババは2026年8月17日、自社開発のAI音楽生成モデル「HappyShrimp 1.0」(中文名:快乐虾米)を公式チャンネルで発表し、同日から国内版・海外版のPC Webで提供を開始した。「端から端まで(end-to-end)」の整曲生成で、自然言語の意図理解と多次元プロンプト制御を特徴とする(いずれもベンダー公称)。モデルアーキテクチャやベンチマーク数値は未公表で、独立した品質評価は今後の課題。公開初日の太合音楽グループとの戦略提携についても整理する。
MODELS / 01
Xiaohongshu傘下のDots Studioは2026年8月中旬、オープンウェイトモデル「dots3-note Preview」をApache 2.0で公開した。280B総パラメータ/16BアクティブのMoE、512Kコンテキスト、4モダリティ入力など、モデルカード・GitHub README・Hugging Faceで確認できる事実を整理する。
MODELS / 01
Microsoftは2026年8月11日、小型コーディングモデル「MAI-Code-1.1-Flash」をGitHub Copilotで提供開始した。画像理解への対応、性能改善、価格低減、旧モデルMAI-Code-1-Flashの非推奨化スケジュールを一次情報(Microsoft AI・GitHub Changelog)に基づいて整理する。
MODELS / 01
Qwenチームは2026年8月13〜14日、27B密度型のネイティブVLM「Qwen3.8-27B」の重みをApache 2.0ライセンスでHugging Faceに公開した。仕様、ベンチマーク公称値、ライセンス、提供状況を一次情報に基づいて整理する。
MODELS / 01
Z.ai(Zhipu AI)が2026年8月14日、コーディング特化モデル「GLM-5.3」を公開した。GLM-5.2と同じベースモデルから事後学習のみで性能を引き上げ、コーディングと脆弱性発見の両方で大きな改善を報告している。一次情報(Z.ai公式ブログ・公式ドキュメント)に基づき、公表されたベンチマーク、サイバー能力の扱い、提供形態を整理する。
MODELS / 01
NVIDIAが2026年8月11日、エージェントの実行層に特化したオープンモデル「Nemotron 3.5 Lightning(30B-A3B)」を公開した。アーキテクチャ、速度と精度の両立手法、公表されたベンチマーク、ライセンス、提供形態を一次情報に基づいて整理する。
MODELS / 01
Liquid AIが2026年8月12日、自社ハードウェアで動かせる最上位の視覚言語モデル「LFM2.5-VL-3B」をHugging Faceで公開した。アーキテクチャと学習方法、公表されたベンチマークと推論速度、提供形態とライセンスを一次情報に基づいて整理する。
MODELS / 01
Google DeepMindが2026年8月12日、手話からテキストへの翻訳モデル「SL2T」(sign-language-to-text)を発表した。Pixel 11のGboardとLive TranscribeでのASL→英語の手話入力機能、学習データとモデル設計、プライバシー保護の仕組み、公表された評価結果を一次情報に基づいて整理する。
MODELS / 01
Googleが2026年8月13日、Gemini 3.7 Flashの一般提供(GA)を開始した。コーディングとエージェント用途に重点を置いたアップデート内容、導入価格、Gemini Spark・GitHub Copilotへの展開を一次情報に基づいて整理する。
MODELS / 01
xAIが2026年8月12日、フロンティアモデル「Grok 4.6」を公開した。APIの仕様・料金、長期エージェント向けの設計、Cursor/Grok Buildでの提供状況を一次情報に基づいて整理する。
MODELS / 01
Qwenが初めてMax級モデル「Qwen3.8-2.4T-A95B」をオープンウェイトで公開した。テキスト専用・思考必須という位置づけや、新設ライセンス「qwen3.8-max」の条件を一次情報に基づいて整理する。
MODELS / 01
DeepSeekが2026年8月13日、フラッグシップモデルDeepSeek-V4-Proの正式版(GA)を公開した。エージェント能力の強化、Responses API対応、思考量制御、新料金体系を一次情報に基づいて整理する。
MODELS / 01
Meta Superintelligence Labsが、単一のコンシューマーGPUで動作するオープンウェイトのエージェント特化モデルMuse Glimmer 30BをApache 2.0ライセンスで公開した。仕様と設計意図を整理する。