TAG / TOPIC

蒸留

「蒸留」に関するAIニュースと解説記事の一覧です。

04 STORIES

LATEST STORIES

蒸留の新着記事

タグ一覧

RESEARCH / 04

Runwayが「瞬時の動画生成」への取り組みを解説 — 因果モデル化+蒸留でプロンプトしながらストリーミング生成へ

Runwayが研究ブログ「Towards Instant Video Generation」(2026年9月10日)で、動画モデルをリアルタイム生成化する技術方針を解説した。凍結した双方向TeacherモデルとCriticを用いた2段階蒸留で因果的なフレーム逐次生成器を作り、プロンプトしながらストリーミング出力する。教育・ゲーム・ロボティクス・シミュレーションでの利用を想定している。

GOVERNANCE / 07

Anthropicが2026年9月の脅威レポート公開 — 中国7研究所による大規模蒸留攻撃を詳細化、Alibabaは1.5億超の対話を観測

Anthropicが2026年9月に脅威レポートを公開。2025年12月〜2026年8月の悪用阻止事例をサイバー・影響工作・監視・詐欺・生物・通常兵器・不正蒸留の7分野で報告。不正蒸留ではAlibaba(1.51億超)、Moonshot(2300万超)、DeepSeek(14日で1210万超)、Zhipuの活動を帰属つきで記載。

RESEARCH / 04

4bitが16bitを超える — Multiverse Computingの「Quantization-Aware Healing」で60Bモデルが9ベンチ中7勝

Multiverse Computingは2026年8月25日、構造圧縮+4bit量子化で劣化したモデルを回復する手法 Quantization-Aware Healing(QAH)を公開。GPT-OSS 120Bを60Bへ圧縮しMXFP4化したモデルが、同60Bのbfloat16版に7/9ベンチで勝利。元の120B教師から直接KL蒸留することで、QATと同等のピークに約7倍速く到達し、以降も安定するとしている。成果は論文と同社ブログで一次情報として公開され、60BモデルはHypernova-60Bとしてオープンウェイトで提供。

MODELS / 01

Liquid AI、LFM2.5向けQ4_0 GGUFをQuantization-Aware Distillationで刷新 — BF16の97%を維持しながらエッジでの高速推論を実現

Liquid AIは2026年8月19日、Hugging FaceブログでLFM2.5向けのQ4_0 GGUFをQuantization-Aware Distillation(QAD)で刷新したと発表した。対象はLFM2.5-230M/350M/1.2B-Instruct/2.6B。教師モデルから量子化済み生徒モデルへ蒸留するQADにより、従来のPTQ Q4_0の品質低下を回復し、BF16平均精度の97%前後を維持すると報告。GPQA DiamondやMMLU-Proなど7種のベンチマーク平均(5回平均)で従来Q4_0を大幅に上回り、Q5_K_M/Q4_K_M並みの品質をより高いデコードスループットで達成。MacBook ProやGalaxy S26 Ultraなど4種の実機でも計測し、llama.cppで即利用可能。Hugging Faceで公開中。