開発ツールのワークフローが立体的につながる抽象ビジュアル
NAW / PRODUCTS 03

IMAGE: AI生成ビジュアル

PRODUCTS / PRODUCTS

Ollama v0.40.0 — Apple SiliconでMLX実行が既定に、EmbeddingGemma 2の埋め込みにも対応

Ollamaは2026年10月6日、v0.40.0のリリースノートを公開した。Apple Siliconでは対応アーキテクチャのモデルが自動でMLXランタイムで動作する。qwen3.8・gemma4などの追加モデル、Nimbleなどのdecision modelsのMLX対応、埋め込みモデルembeddinggemma-2のMLX対応を含む。

Ollamaは2026年10月6日(UTC)、v0.40.0 のリリースノートをGitHubで公開した。今回の中心はApple Siliconにおける実行方式の変更で、MLXランタイムに対応したアーキテクチャのモデルは自動でMLX上で動作する。変更差分の起点はv0.35.1とされている。本稿はGitHubのリリースノートで確認できる範囲に限定して整理する。

Apple SiliconではMLX実行が既定に

  • 既定の切り替え: Apple Silicon搭載デバイスでは、MLXランタイムに対応したモデルアーキテクチャが自動でMLX上で動作する
  • 使い方の変更なし: リリースノートの例では ollama pull qwen3.8 / ollama run qwen3.8 の従来手順のまま利用できるとしている
  • 継続方針: 追加モデルは引き続き検証のうえ有効化していくとしている

対応モデル — 追加・decision models・埋め込み

以下はいずれもリリースノートに記載のモデル名である。

  • 追加モデル: qwen3.8 のほか、gemma4・qwen3.6・qwen3.5 が挙げられている
  • decision modelsのMLX対応: Nimble・tev1・clef・clef-flash がMLX上でも利用可能になったとしている
  • 埋め込みモデルのMLX対応: 埋め込みモデル embeddinggemma-2 がMLXに対応した
  • 位置づけ: GoogleによるEmbeddingGemma 2公開と同日に、ローカル実行側の受け皿が整った形だ(時系列の一致であり、両者の提携などを意味しない)

注意点 — 適用範囲と確認事項

  • 適用範囲: MLXでの実行は「MLXランタイムに対応したアーキテクチャ」に限られ、全モデルが対象ではない
  • 変更規模: リリースノートのFull Changelogはv0.35.1起点であり、マイナー版の幅を超える差分が含まれうる。導入前に差分の確認が必要だ
  • モデル名の扱い: 本稿のモデル名はOllamaライブラリ上の名称であり、各モデルの性能・由来はリリースノートの範囲では確認できない

出典

掲載内容は公開時点の情報に基づきます。重要な判断では、一次情報と最新の提供条件をあわせてご確認ください。