TAG / TOPIC

量子化

「量子化」に関するAIニュースと解説記事の一覧です。

02 STORIES

LATEST STORIES

量子化の新着記事

タグ一覧

RESEARCH / 04

4bitが16bitを超える — Multiverse Computingの「Quantization-Aware Healing」で60Bモデルが9ベンチ中7勝

Multiverse Computingは2026年8月25日、構造圧縮+4bit量子化で劣化したモデルを回復する手法 Quantization-Aware Healing(QAH)を公開。GPT-OSS 120Bを60Bへ圧縮しMXFP4化したモデルが、同60Bのbfloat16版に7/9ベンチで勝利。元の120B教師から直接KL蒸留することで、QATと同等のピークに約7倍速く到達し、以降も安定するとしている。成果は論文と同社ブログで一次情報として公開され、60BモデルはHypernova-60Bとしてオープンウェイトで提供。

MODELS / 01

Liquid AI、LFM2.5向けQ4_0 GGUFをQuantization-Aware Distillationで刷新 — BF16の97%を維持しながらエッジでの高速推論を実現

Liquid AIは2026年8月19日、Hugging FaceブログでLFM2.5向けのQ4_0 GGUFをQuantization-Aware Distillation(QAD)で刷新したと発表した。対象はLFM2.5-230M/350M/1.2B-Instruct/2.6B。教師モデルから量子化済み生徒モデルへ蒸留するQADにより、従来のPTQ Q4_0の品質低下を回復し、BF16平均精度の97%前後を維持すると報告。GPQA DiamondやMMLU-Proなど7種のベンチマーク平均(5回平均)で従来Q4_0を大幅に上回り、Q5_K_M/Q4_K_M並みの品質をより高いデコードスループットで達成。MacBook ProやGalaxy S26 Ultraなど4種の実機でも計測し、llama.cppで即利用可能。Hugging Faceで公開中。