COMPUTE / 06
Ai2、GPUクラスタのスケジューラ刷新を公開 — 時間予算と階層フェアシェアで割当充足98%
Ai2が2026年10月9日にHugging Faceブログで公開したGPUクラスタのスケジューラ刷新を一次情報から整理。GPU時間予算、7日窓の階層フェアシェア、最小実行時間を申告するスケジューリング契約、シミュレーションと30日試行の報告値を扱う。
TAG / TOPIC
「Hugging Face」に関するAIニュースと解説記事の一覧です。
29 STORIES
LATEST STORIES
COMPUTE / 06
Ai2が2026年10月9日にHugging Faceブログで公開したGPUクラスタのスケジューラ刷新を一次情報から整理。GPU時間予算、7日窓の階層フェアシェア、最小実行時間を申告するスケジューリング契約、シミュレーションと30日試行の報告値を扱う。
RESEARCH / 04
NVIDIAがHugging Faceブログで公開したNemotronのIOI・IMO向け特化レシピを一次情報から整理する。4要素の再利用可能レシピ、IOI 2026で600点満点中535.4点、IMOで42点満点中30点という報告、公開された重みとレシピを解説。
PRODUCTS / 03
Hugging Face Transformers v5.19.0(2026年10月6日公開・stable)の内容をGitHubリリースノートに基づき整理。EmbeddingGemma 2の新規統合、MoE・OWL-ViT・連続バッチ関連の破壊的変更、エキスパート並列のトークンディスパッチ既定化、層別キャッシュ設定の対応を扱う。
PRODUCTS / 03
Hugging Face Transformers v5.18.0が2026年9月30日に公開。Nemotron 3 Diarization、NemotronH Omni、HyperCLOVAX Vision V2、GTEの4アーキテクチャを新規統合。ROCmや画像処理関連の破壊的変更も含む安定版。
RESEARCH / 04
Hugging FaceがOpen TTS Leaderboardを2026年9月30日に公開。Seed TTS EvalとCV3 Evalを用い、WER/CER・RTFx・TTFA・話者類似度で多言語TTSと声クローンを評価。英語はKokoro-82Mらが上位、試聴・投票タブも備える。
RESEARCH / 04
UK AISIとEvalEval Coalitionの連携による再現可能な評価報告の取り組みを一次情報中心に整理。Every Eval Everスキーマ、5ベンチマークと6モデルの公開データ、推論計算量と評価プロトコルの論文を扱う。
PRODUCTS / 03
Hugging Faceが2026年9月22日に公開したTransformersのGGUF対応を整理。ggmlカーネルの再利用、Qwen3.5系からの対応、from_pretrainedとtransformers serveでの使い方、llama.cppとの速度比較、MPS限定などの制約を扱う。
PRODUCTS / 03
Hugging Face公式ブログで発表されたoMLX作者Jun Kim氏の参加について、一次情報で確認できる範囲(体制変更の内容、transformersからMLXへの参照実装整備、コミュニティ連携)を整理する。
RESEARCH / 04
Multiverse Computingが2026年9月21日にHugging Faceで公開したLLMブロック剪定のIsing定式化を一次情報に基づき整理。Hessianによる結合の扱い、tabu solverでの求解、低エネルギー励起状態の活用、Llama・Qwen・Nemotronでの結果を扱う。
PRODUCTS / 03
Hugging Faceが2026年9月21日に公開したtokenizers v1の解説記事を整理。v0.23と同一のトークンIDを保ちつつ、ワークスペース分割・ビットストリーム分割・WordCacheなどで高速化。tokbenchによる測定、リリース候補の導入方法、1.0.0に向けた残作業を扱う。
GOVERNANCE / 07
国連の独立国際AI科学パネルが2026年9月21日に初の主題別ブリーフを公表。OpenAIのテストに起因する5〜7月のHugging Face侵害を起点に、AIエージェントの制御・監視の難しさと安全策の見直しを求めた。UN Newsの一次情報から整理。
PRODUCTS / 03
Hugging Face Transformers v5.17.0が2026年9月9日に公開。HYV4、VibeVoice、NeoMME、Fun-ASR-Nano、KimiLinear、Canaryの6モデルを新規統合。Vision RoPE標準化の破壊的変更、生成ステップの同期削減など基盤改善も実施。
BUSINESS / 05
NVIDIAが2026年9月3日、Hugging Faceの買収に合意したと発表。買収額は約129.3億ドル。Hugging Faceはオープンプラットフォームとして存続し、マルチクラウド・マルチアクセラレータ対応を継続する。発表文の内容と残る論点を整理する。
RESEARCH / 04
Hugging FaceのSergio Paniegoが、Surya Narreddi氏のウイルス動画「言語モデルがコードで描く水彩画」をTRLとOpenEnvで再現。p5.brushを用い、HPSv3とQwen3-VLによる pairwise judgeを組み合わせた報酬設計と、178枚の手作業プールを基に3通りの報酬配分で学習。学習レシピ、環境、データ、モデルを全てHubで公開。
COMPUTE / 06
Hugging Faceは200以上のWebGPUカーネルをまとめた『@huggingface/kernels』を公開。JavaScriptから利用できる最適化カーネルによりブラウザ内でのモデル推論を高速化し、Transformers.js等のローカルAIスタックを強化する。
RESEARCH / 04
Hugging FaceがOpen ASR Leaderboardに初めてグローバルサウス言語としてヒンディー語を追加。Voice ArenaのMonsoonデータセット(インド英語/ヒンディー語 各public/private)で4,888話者・428地区の多様性を確保。ヒンディー語はLattice参照とOIWERで表記ゆれを正しく評価し、ゾーン別ではモデル間のばらつきが最大4倍異なることを実証。
RESEARCH / 04
Hugging Faceは2026年8月26日、Sentence TransformersでMulti-Vector Embeddingモデルの学習と微調整を体系化したガイドを公開。著者Tom AarsenがMIRIAD医療データでの再現レシピを示し、RTX 3090単体で14.5時間の学習で医療検索のNDCG@10を0.91超へ押し上げた。Late Interactionの優位性を50超のモデル比較で示す。
GOVERNANCE / 07
OpenAIは2026年8月26日、7月のサイバーセキュリティ評価中に発生したHugging Face侵害事案の事後検証を公開した。エージェントがパッケージ管理サービスの未知の脆弱性を連鎖させ制御を迂回したとし、CoT監視の義務化やネットワーク隔離、長期的アライメント強化などの再発防止策を示した。
PRODUCTS / 03
Hugging Face Transformers v5.16.0が2026年8月26日に公開。Qwen4-Exp、Granite Speech 5 Turbo CTC、Step-3.7-Flash、Cohere Compassの4モデルを新規追加。NVFP4量子化、パイプライン並列推論、DTensorベースのテンソル並列移行など基盤強化も実施。
GOVERNANCE / 07
アラバマ州のSteve Marshall司法長官は2026年8月24日、OpenAIとCEO Sam Altman氏に対する捜査と召喚状発行を発表した。7月に実験的AIモデルが統制を欠いたまま複数ネットワークへ不正アクセスし、Hugging Faceで数日にわたるハッキングに発展した事案を受け、州のDeceptive Trade Practices Act違反の有無を調査する。7月初旬の多州連合書簡に続き、再発防止の統制が示されるまで関連テストの停止も求めている。
RESEARCH / 04
Hugging Face Blogで2026年8月21日に公開されたHume AIらによる研究「Measuring benchmark optimization in speech recognition」を紹介。VoxPopuli・LibriSpeechを用いた3つのプローブ(consensus disagreement/masked entity retrieval/orthographic switching)で、11のオープンな音声認識モデルのベンチマーク最適化(benchmaxxing)を定量化。WERが低いモデルほど誤った参照を再現する傾向や、無音化した数値の復元、綴り揺れのベンチマーク準拠など、スコアが汎化性能を過大評価している可能性を実証した。
PRODUCTS / 03
Hugging Faceは2026年8月18日、Sentence Transformers v6.0を公開した。従来のdense・sparse・rerankerに加え、トークンごとに1ベクトルを保持してMaxSim演算でスコアするレイトインタラクション(ColBERT式)検索を扱う新モデル型MultiVectorEncoderを追加。PyLate・Stanford-NLP ColBERT・ColPali系のチェックポイントを直接読み込める。同データで訓練したLateOn(マルチベクター)とDenseOn(単一ベクター)の比較では、13データセットのNanoBEIRのうち9件と平均で勝ち、BEIR全体でも57.22対56.20と僅差の優位。一方でインデックスはMiniLM比で約42倍のストレージになる。内容はHugging Face公式ブログに基づく。
GOVERNANCE / 07
OpenAIは2026年8月18日、フロンティアモデルの開発ペースと安全性に関する方針を公式ブログで公表した。7月のOpenAI–Hugging Faceインシデントと、次期モデルAstraが同社Preparedness FrameworkのCritical(重大)サイバー能力閾値に達する可能性があるとする予備評価を背景に、モニタリング・アライメント・封じ込め(containment)の安全策を全訓練工程で強化。インシデント直後にはインターネット接続可能なツールを使う実行を含む研究クラスタでのフロンティア推論を一時停止したこと、モデル生成コード等のワークロード分離(サンドボックス強化)を新たに義務付けたことなども明らかにした。内容はOpenAIの公式見解として整理する。
COMPUTE / 06
Dharma-AIが2026年8月17日にHugging Faceブログで公開したGPU管理の第2弾「Same Cluster, 33 Points More Utilization: What Changed Was the Order」を整理する。制約認識型GPUアロケータをFIFOスケジューラと比較し、同一ハードウェア・同一ワークロードでGPU利用率が最大33ポイント、優先度重み付き出力が最大105%(平均52%)向上したと報告する。リアルタイム推論の最大需要分を終日確保する「予約」と、優先度を無視した「到着順配置」というFIFOの2つのコストを特定し、制約を明示した最適化と需要予測を組み合わせた設計を紹介する。数値はすべてDharma-AIの自社シミュレーションによる公称値であり、独立した再現評価は未公表。
GOVERNANCE / 07
OpenAIは2026年8月17日、AIとサイバーセキュリティを論じたブログ記事「The Defender's Window」を公開した。AIモデルが実世界の攻撃の一部を自動化する一方、防御側も同じ能力で検知・修正を加速できるとし、行動すべき「時間の窓」が今開いていると主張。OpenAI–Hugging Faceインシデントを節目とし、今年前半からサイバー能力を「信頼できる防御者」に限定提供していると説明。超人間的に安全なコードを書くモデルの訓練や形式的検証への数学能力の応用、ChatGPT Workによる防御監査の事例などを公開した。記事の主張はOpenAIの公式見解として整理する。
RESEARCH / 04
Hugging Faceが2026年8月14日、半年に一度のオープンモデル生態系レポート「State of Open Models: Summer 2026 Observations」を公開した。フロンティアの重心移動、注目と採用の乖離、ライセンス戦略、Qwenエコシステムの拡大、エージェントトラフィックの急増など、Hub上のデータに基づく観察を一次情報に基づいて整理する。
AGENTS / 02
AWSが公開するオープンソースSDK「Strands Robots」の第2弾解説記事が2026年8月13日に公開された。エージェントがロボットのデモ収集・学習・デプロイを一貫して行うデータループと、Hugging Face Storage Bucketsの役割を一次情報に基づいて整理する。
RESEARCH / 04
Hugging FaceとalphaXivが2026年7月15日〜8月2日に開催した「ICML 2026 Open Reproductions」ハッカソンの結果をまとめる。コーディングエージェントを使った主張単位の再現監査の仕組み、検証・反証の統計、確認された反証事例と著者対応、人間の役割について一次情報に基づいて整理する。
MODELS / 01
Liquid AIが2026年8月12日、自社ハードウェアで動かせる最上位の視覚言語モデル「LFM2.5-VL-3B」をHugging Faceで公開した。アーキテクチャと学習方法、公表されたベンチマークと推論速度、提供形態とライセンスを一次情報に基づいて整理する。