NAW / MODELS 01
IMAGE: AI生成ビジュアル
MODELS / MODELS
Anthropicが「Claude Sonnet 5.5」を公開 — Sonnet 5比で30%以上高速、タスクあたり最大30%低コストと主張
Anthropicは2026年9月28日、Claude 5.5ファミリーの第二弾「Claude Sonnet 5.5」を公開した。Sonnet 5からの明確な向上、30%以上の高速化、タスクあたり最大30%のコスト削減をうたう。価格は据え置きの入力2ドル・出力10ドル/100万トークン。Terminal-Bench 4.0では70.6%とSonnet 5の10.3%を大きく上回ったとしている。
Anthropicは2026年9月28日(米国時間)、新モデル「Claude Sonnet 5.5」を公開した。新ファミリー「Claude 5.5」の第二弾で、複雑な判断を要する仕事向けのOpus 5.5に対する、高速・低コストの補完モデルと位置づけている。日常的な範囲の定まった業務、バグ修正、文書・スライド・表計算の作成、デザイン感覚を要する作業に強いとしている。以下は同社の発表ページの記載内容の整理であり、性能数値はすべてベンダー公表値である。
性能とコスト — 価格据え置きで速度と効率を改善
- 位置づけ: Claude 5.5ファミリーの第二弾。Sonnet 5からの明確な向上(clear upgrade)で、30%以上高速、多くの業務でタスクあたり最大30%低コストとしている
- 価格(100万トークンあたり): 入力2ドル、出力10ドル、キャッシュ読み取り0.20ドルでSonnet 5と同額。同じ仕事に必要なトークンが大幅に少ないため、実質コストが下がると説明している
- 速度: Sonnet 5より30%以上高速に出力し、同社で最速のSonnetモデルとしている。先行テスターからは協働相手としてSonnet 5より優れるとの評価を紹介している(同社発表による利用者の声)
- 文章の明確さ: 前世代より明確に書き、協働に向くとしている。高速な反復作業にも向くという
- 後継: 高ボリューム・コスト感応用途向けのClaude Haiku 5.5が数週間以内にファミリーに加わる予定
ベンダー公表ベンチマーク — Terminal-BenchでSonnet 5の約7倍と主張
- 数値はいずれもAnthropicの公表値で、独立した検証ではない。同社自身、ベンチマークの差は実利用の差の信頼できる指針になりにくいと注意書きしている
- Terminal-Bench 4.0(エージェント系コーディング評価): Sonnet 5.5は70.6%、Sonnet 5は10.3%としている
- GDPval-AA(44職種・9業界の実務タスク評価): Opus 5.5を2ポイント下回るがほぼ同水準で、Sonnet 5を約400ポイント上回るとしている。コンピュータ利用とチャート認識ではOpus 5.5に近いという
- 長時間タスク・画像理解: 長期ホライズンの作業と画像理解に強く、スクリーンショットのみで「Pokémon Red」をクリアした初のSonnetモデルとしている
- effort別の効率: 低・中effortでもSonnet 5の最高スコアを約10分の1のコストで上回り、高effortではOpus 5.5に匹敵する場合もあるとしている。ある評価ではGPT-6 Sol級の最高スコアに約5分の1のコストで並ぶとしている
- 評価条件の注記: GDPval-AAとAA-Briefcaseの計測に使ったリリース前デプロイに構造化出力の応答を劣化させうるバグが見つかり、スコアへの影響は小さく今後の更新で修正予定としている
安全性 — 初のSonnet向けサイバーセーフガード付きで提供
- サイバー: サイバーセキュリティ能力がOpus 5に匹敵するため、Sonnetとして初めて最上位モデル向けと同様のサイバーセーフガードとフォールバック付きで提供する。高リスクのサイバー課題では目に見える形でSonnet 5にフォールバックする。サイバー防御者向けのCyber Verification Programは今後拡大予定としている
- 生物: 生物学のセーフガードはSonnet 5と同等。有害な要求を対象とし、通常の研究・教育・臨床作業の多くは影響を受けないとしている
- 推論抽出対策: 前任より高性能なため、推論抽出を防ぐ安全分類器を搭載して提供する初のSonnetモデルとしている
- アライメント: ほとんどのアライメント指標でSonnet 5を上回るか同等としている
提供形態
- 提供先: Claude Platformを含む全プラットフォーム。Amazon Web Services、Google Cloud、Microsoft Azureでも利用可能。ゼロデータ保持に対応する
- GitHub Copilot: 2026年9月28日(UTC)に一般提供開始。Copilot Pro・Pro+・Max・Business・Enterpriseが対象で、VS Code、Visual Studio、Copilot CLI、コーディングエージェント、Copilotアプリ、github.com、Mobile(iOS/Android)、JetBrains IDE、Xcode、Eclipseのモデルピッカーから選択できる。GitHubの早期テストではSonnet 5と同等のコーディング能力を大幅に少ないステップ・トークン・ツール呼び出しで達成し、顕著に高速に完了したとしている
- 比較画像について: 一次情報の発表ページに他モデル比較の性能チャート画像の掲載は確認できなかったため、本記事では数値をテキストで記載する(比較画像なし)