COMPANIES / TRACKED TOPIC

Alibaba

AlibabaおよびQwenチームのモデルとサービスに関する記事。

35 STORIES

COMPANIES

Alibabaの新着記事

企業一覧

MODELS / 01

Cloudflare、オープンな意思決定モデル「Clef」と「Clef-flash」を公開 — Workers AIで提供、Apache 2.0でオープンソース化

Cloudflareが2026年10月1日に意思決定モデル「Clef」「Clef-flash」を公開した。Qwen3.8-27B/Qwen3.5-9Bをベースに後段学習したマルチモーダルモデルで、Workers AIでホストし、Hugging FaceでApache 2.0ライセンスとして公開。Jev API互換とベンダー公称のベンチマーク結果、新しい強化学習ファインチューニング基盤を一次情報に基づき整理する。

MODELS / 01

AlibabaのQwen、画像生成・編集モデル「Qwen-Image-2.1」をオープンウェイト公開 — 7Bで透過PNG生成と最大10枚参照編集に対応

AlibabaのQwenチームが2026年9月20日に画像生成・編集モデルQwen-Image-2.1をオープンウェイト公開。70億パラメータの生成部、透過RGBA対応、最大10枚参照の編集、2K解像度、Qwen Research License、初日対応の推論基盤を一次情報から整理。

MODELS / 01

Alibaba Cloudが「Qwen3.8-Omni-Flash」のドキュメントを公開 — 100万トークンの音声・動画理解モデル

Alibaba Cloudが2026年9月18日更新のModel Studioドキュメントで音声・動画理解モデル「qwen3.8-omni-flash」を掲載。テキスト・画像・音声・動画入力、テキスト出力、100万トークンのコンテキストウィンドウ、既定有効のThinking、Function Calling・Web検索・キャッシュ対応、東京を含む6リージョンで提供。

MODELS / 01

AllSpark、オープンウェイトの検索エージェントIris-mini/Iris-proを公開 — Qwen系MoEを探索学習で調整、同規模の公開勢で最高と主張

AllSpark-Researchが2026年9月に公開したオープンウェイト検索エージェントIris-mini/Iris-proを一次情報に基づき整理。Qwen系ベース、SFT-RL climbingによる学習、BrowseComp・HLE等の評価値、Iris-Harnessの同梱、Apache-2.0での重み公開を扱う。

GOVERNANCE / 07

Anthropicが2026年9月の脅威レポート公開 — 中国7研究所による大規模蒸留攻撃を詳細化、Alibabaは1.5億超の対話を観測

Anthropicが2026年9月に脅威レポートを公開。2025年12月〜2026年8月の悪用阻止事例をサイバー・影響工作・監視・詐欺・生物・通常兵器・不正蒸留の7分野で報告。不正蒸留ではAlibaba(1.51億超)、Moonshot(2300万超)、DeepSeek(14日で1210万超)、Zhipuの活動を帰属つきで記載。

MODELS / 01

Alibaba・Qwen、自動運転向け視覚言語基盤モデル「Qwen-Drive-1.0」を公開 — 3D知覚・対話・軌道計画を単一モデルに統合、Apache 2.0

AlibabaのQwenチームと華中科技大学が公開した自動運転向け視覚言語基盤モデルQwen-Drive-1.0を一次情報(GitHub・Hugging Face・技術レポート)に基づき整理。BEV知覚ヘッドと計画エキスパートの構成、NAVSIM・Waymo・NVIDIA PhysicalAIでの計画性能、運転VQAと汎用VQAの評価値を扱う。

COMPUTE / 06

SGLang v0.5.19公開 — ビームサーチ対応とDeepEP v2、統合radix treeの既定化で786 PR

高性能LLMサービングフレームワークSGLangが2026年9月5日に安定版v0.5.19を公開。786件のPR・214名のコントリビューターによる大規模リリースで、ビームサーチ対応、DeepEP v2 ElasticBufferバックエンド、統合radix treeの既定化、LayerNorm系列並列、Hopper向けW4A8 MoE、Blackwell既定バックエンドでのDCP、AMD向けLean attention、Qwen3.8・Spark2.5・Granite 4.2など9モデルの新規対応を含む。

COMPUTE / 06

llama.cpp v0.4.0公開 — Qwen3.8-Flash-Nextの初期対応と遅延テンソル読み込み、ggml 0.23.0へ更新

ローカルLLM推論エンジンllama.cppが2026年9月4日に安定版v0.4.0を公開。Qwen3.8-Flash-Next(qwen4exp)の初期アーキテクチャ対応、NVIDIA Nemotron-3-Puzzle-75B-A9BとNemotron 3.5のDSpark対応、遅延テンソル読み込み、スロット別コンテキスト上限、動画入力オプション、ggml v0.23.0(スパースflash attention・Apple RDMA)への更新を含む。

RESEARCH / 04

Hugging Face、コードで水彩画を描くモデルをTRLとOpenEnvで再現 — 1.5M回再生のRL水彩を完全オープンに

Hugging FaceのSergio Paniegoが、Surya Narreddi氏のウイルス動画「言語モデルがコードで描く水彩画」をTRLとOpenEnvで再現。p5.brushを用い、HPSv3とQwen3-VLによる pairwise judgeを組み合わせた報酬設計と、178枚の手作業プールを基に3通りの報酬配分で学習。学習レシピ、環境、データ、モデルを全てHubで公開。

RESEARCH / 04

Google Research、エージェントの経験を持続的な知識に編纂する「WikiSkill」を発表 — 永続Wikiでスキル進化と転移を実現

Google ResearchとVirginia TechがAgent Skillsの進化に永続的なWiki層を導入するフレームワークWikiSkill(arXiv:2608.27454)を公開。Raw/Wiki/Skillの3層アーキテクチャとWiki Maintainer/Skill Proposer/Gatingのループで、実行トレースを構造化知識に編纂し再利用。5ベンチマークで既存手法を上回り、モデルスケールとの相補性やモデル間転移も確認。

MODELS / 01

Alibaba Qwen、125B MoE「Qwen3.8-Flash-Next」を公開 — Qwen4アーキテクチャの先行版、6Bアクティブで長文・低遅延を狙う

Alibaba Qwenチームは2026年8月26日、Qwen4アーキテクチャのプレビューとしてQwen3.8-Flash-Nextを公開した。マルチモーダル対応の125B MoE(アクティブ6B)で、Qwen Sparse AttentionやGated Residual、n-gram embeddingを導入。262Kネイティブコンテキスト(最大1M拡張)を備え、HFでオープンウェイト提供される。

MODELS / 01

アリババ、動画生成AI「Wan 3.0」正式公開 — 30秒一括生成とドキュメントからの動画化に対応

アリババが動画生成モデルWan 3.0を2026年8月24日に正式公開。30秒のネイティブ動画を一括生成、テキスト/画像/映像/音声に加えドキュメント(doc/xls/ppt/pdf)を参照入力できるOmni-Reference、1080p・音声同時生成が特徴。ロイター等が同日報じ、AIBase/QbitAIが詳細を伝えた。

BUSINESS / 05

Alibaba、香港で800億香港ドル(約102億米ドル)の新株発行を提案 — 調達資金の100%をフルスタックAIへ投資

Alibaba Groupは2026年8月23日、香港で総額800億香港ドルの新規普通株式のプレースメントを提案したと発表した。手取金の100%をフルスタックAI能力への投資、とりわけAIインフラの拡張・強化に充てるとし、グローバルなAIリーダーシップの拡張を目的と位置づける。米国外の非米国人向けのオフショア取引として実施し、完了は市況等の条件次第とした。

RESEARCH / 04

Inherent、27Bの“AI科学者”エージェント「Faraday」を公開 — Claude Opus 4.8とGPT-5.5を上回る論文再現性能

英Inherent Laboratoriesは2026年8月14日、27BパラメータのAI科学者エージェント「Faraday」を公開した。Qwen3.6-27Bをベースに、100本のML/AI-for-science論文から310の再現タスクで構成される新ベンチマーク「Replica」で長期間の強化学習を実施。論文付随の図を時間・計算資源の制約下で再現するタスクで、Claude Opus 4.8(Claude Codeハーネス)とGPT-5.5(Codexハーネス)を上回る精度を示したと報告。自動生成ルーブリックによるLLMジャッジで報酬を設計し、人手との一致度も検証している。詳細は公式研究ブログとarXiv論文で公開。

COMPUTE / 06

SGLang v0.5.18公開 — 710 PRで起動2.38倍高速化、Muse Glimmerなど新規モデル7種に対応

高性能LLMサービングフレームワークSGLangが2026年8月22日にv0.5.18を公開。710 PR・212 contributorsの大規模リリースで、Muse GlimmerやIntern-S2-Mobius、SANA-Videoなど7モデルを新規対応。Qwen3-32Bの起動を2.38倍高速化するオーバーラップ読み込み、DeepSeek-V4系のLMHead/AllReduce最適化、統合キャッシュディレクトリなど基盤改善を一次情報に基づき整理。

RESEARCH / 04

Qwen3.8-27B、独立評価のArtificial Analysisインテリジェンス指標で52点 — 27BオープンウェイトがGPT-5.6 Luna級に

第三者のベンチマーク機関Artificial Analysisは2026年8月17日前後、Alibaba Qwen製の27Bオープンウェイトモデル「Qwen3.8-27B」の評価結果を公開した。インテリジェンス指標(9種の評価の複合)で52点を記録し、同指標でGPT-5.6 Luna(max)と同点、GLM-5.2(max)より1点低い水準。小規模なオープンウェイトモデルがフロンティア級のスコアに並んだ点が注目される一方、評価中の出力トークン数は160Mで中央値(43M)の約3.7倍と非常に冗長で、効率面の課題も明らかになった。数値は全てArtificial Analysis(一次情報)および同指標のデータに基づく。

MODELS / 01

アリババ、AI音楽モデル「HappyShrimp 1.0(快乐虾米)」公開 — 自然言語1行から作詞・作曲・編曲・歌唱まで生成

アリババは2026年8月17日、自社開発のAI音楽生成モデル「HappyShrimp 1.0」(中文名:快乐虾米)を公式チャンネルで発表し、同日から国内版・海外版のPC Webで提供を開始した。「端から端まで(end-to-end)」の整曲生成で、自然言語の意図理解と多次元プロンプト制御を特徴とする(いずれもベンダー公称)。モデルアーキテクチャやベンチマーク数値は未公表で、独立した品質評価は今後の課題。公開初日の太合音楽グループとの戦略提携についても整理する。

RESEARCH / 04

コンテキスト圧縮でユーザー指示が平均83%消失 — Penn Stateが「Lost in Compaction」で実測、90%超を保持する抽出器も提案(arXiv)

arXiv:2608.11242。ペンシルベニア州立大学のZhiqi Wang氏らが、LLMシステムがコンテキストを圧縮(コンパクション)する際に「セッション制約(Session Constraints, SC)」が消失する問題を定量化した研究。3つの長期コンテキストシナリオ(マルチターンチャット・エージェント軌跡・長時間研究)で12種のコンパクタを評価した結果、注入したSCの平均保持率は17%で、多くのケースで圧縮なしより悪化した。SC認識抽出器(Qwen3.5-9Bベース)をコンパクタと並置するだけで全シナリオで90%超の保持率を記録した。評価スイートと実装はGitHubで公開。

COMPUTE / 06

Cloudflare Workers AIにQwen 3.8 27Bが登場 — 262KコンテキストのApache 2.0 VLMをエッジ推論で利用可能に

Cloudflareは2026年8月17日、Workers AIにQwen 3.8 27Bを追加した。Alibaba QwenがApache 2.0で公開した27B密度型VLMが、エッジAI推論プラットフォームで利用可能になる。機能・料金・利用方法を一次情報(Cloudflare公式Changelog・モデルページ)に基づいて整理する。

RESEARCH / 04

Alibaba Accio、実業務を再現するエージェント用ベンチマーク「RealReplicaBench」公開 — 107タスクで最上位モデルも完遂率は約62%

Alibaba InternationalのAccioチーム(电商AI AgentプラットフォームAccio Workを開発)が、実サービスを再現するローカルレプリカ上でエージェントのタスク完遂能力を評価するRealReplicaBenchをGitHubで公開(v1.3.1)。107タスクは53 CLI・28ブラウザ・16ファイル・10 API/MCPで構成され、65がテキストのみ、20がブラウザ+テキスト、22が視覚情報必須。各タスクはフレッシュなコンテナで実行され、決定論的またはLLM支援の検証器が採点する。12モデルファミリーをOpenClaw/Accioの2ハーネスで評価した結果、最上位はClaude Opus 5の60/107(56.1%, OpenClaw)と66/107(61.7%, Accio)、次いでClaude Opus 4.8(51.4%/55.1%)、GPT-5.6 Sol(49.5%/51.4%)。Qwen 3.8 MaxはAccioハーネスでOpus 4.7と並ぶ56/107(52.3%)。採点ジャッジはgemini-3.1-pro-previewで、スコアはAccio管理の評価エンドポイントによる。ハーネス・コードはApache 2.0、タスクセットはCC BY 4.0で公開され、ライブリーダーボードも運用中。

RESEARCH / 04

Hugging Face「State of Open Models」夏版 — 中国ラボがフロンティアの主役に、Qwenは事実上の標準基盤へ

Hugging Faceが2026年8月14日、半年に一度のオープンモデル生態系レポート「State of Open Models: Summer 2026 Observations」を公開した。フロンティアの重心移動、注目と採用の乖離、ライセンス戦略、Qwenエコシステムの拡大、エージェントトラフィックの急増など、Hub上のデータに基づく観察を一次情報に基づいて整理する。