NAW / PRODUCTS 03
IMAGE: AI生成ビジュアル
PRODUCTS / PRODUCTS
Ollama v0.40.0 — Apple SiliconでMLX実行が既定に、EmbeddingGemma 2の埋め込みにも対応
Ollamaは2026年10月6日、v0.40.0のリリースノートを公開した。Apple Siliconでは対応アーキテクチャのモデルが自動でMLXランタイムで動作する。qwen3.8・gemma4などの追加モデル、Nimbleなどのdecision modelsのMLX対応、埋め込みモデルembeddinggemma-2のMLX対応を含む。
Ollamaは2026年10月6日(UTC)、v0.40.0 のリリースノートをGitHubで公開した。今回の中心はApple Siliconにおける実行方式の変更で、MLXランタイムに対応したアーキテクチャのモデルは自動でMLX上で動作する。変更差分の起点はv0.35.1とされている。本稿はGitHubのリリースノートで確認できる範囲に限定して整理する。
Apple SiliconではMLX実行が既定に
- 既定の切り替え: Apple Silicon搭載デバイスでは、MLXランタイムに対応したモデルアーキテクチャが自動でMLX上で動作する
- 使い方の変更なし: リリースノートの例では
ollama pull qwen3.8/ollama run qwen3.8の従来手順のまま利用できるとしている - 継続方針: 追加モデルは引き続き検証のうえ有効化していくとしている
対応モデル — 追加・decision models・埋め込み
以下はいずれもリリースノートに記載のモデル名である。
- 追加モデル:
qwen3.8のほか、gemma4・qwen3.6・qwen3.5が挙げられている - decision modelsのMLX対応:
Nimble・tev1・clef・clef-flashがMLX上でも利用可能になったとしている - 埋め込みモデルのMLX対応: 埋め込みモデル
embeddinggemma-2がMLXに対応した - 位置づけ: GoogleによるEmbeddingGemma 2公開と同日に、ローカル実行側の受け皿が整った形だ(時系列の一致であり、両者の提携などを意味しない)
注意点 — 適用範囲と確認事項
- 適用範囲: MLXでの実行は「MLXランタイムに対応したアーキテクチャ」に限られ、全モデルが対象ではない
- 変更規模: リリースノートのFull Changelogはv0.35.1起点であり、マイナー版の幅を超える差分が含まれうる。導入前に差分の確認が必要だ
- モデル名の扱い: 本稿のモデル名はOllamaライブラリ上の名称であり、各モデルの性能・由来はリリースノートの範囲では確認できない