NAW / MODELS 01
IMAGE: AI生成ビジュアル
MODELS / MODELS
Anthropicが「Claude Opus 5.5」を公開 — Fable 5.1級の性能でOpus 5より40%低コスト、安全性監査は過去最高
Anthropicは2026年9月22日、新ファミリーClaude 5.5の第一弾「Claude Opus 5.5」を公開した。多くの業務でFable 5.1と同水準としながら typical workload のコストはOpus 5比で40%減。入力4ドル・出力20ドル/100万トークン、キャッシュ読み取りは0.20ドル。生物・サイバー領域ではFable 5.1相当のセーフガードを適用する。
Anthropicは2026年9月22日、新モデル「Claude Opus 5.5」を公開した。新ファミリー「Claude 5.5」の第一弾で、同社は多くの業務で「Claude Fable 5.1」と同水準の性能を持ちながら、Opus 5より実行コストが40%低いと説明している。フロンティアのペース配分を呼びかけて以降、初のリリースと位置づけている。以下は同社の発表ページの記載内容の整理であり、性能数値はすべてベンダー公表値である。
性能とコスト — Fable級をOpus 5比40%減で
- 位置づけ: Claude 5.5ファミリーの最初のモデル。多くの業務でFable 5.1と同水準、typical workloadではOpus 5より40%低いコストで動作するとしている
- 価格(100万トークンあたり): 入力4ドル、出力20ドルでOpus 5より20%引き下げ。キャッシュ読み取りは0.20ドルでOpus 5より60%引き下げ、キャッシュ書き込みは5ドル
- 速度: 出力生成はOpus 5より30%以上高速。Claude CodeとClaude Platformでは最大2.5倍速のFast modeも利用でき、価格は入力8ドル・出力40ドル/100万トークン
- 文章の自然さ: 先行テスターからは文面が明確で追いやすく、長いセッションでの作業相手として改善したとの評価を紹介している(同社発表による利用者の声)
- サブスクリプション: Pro・Max・Team・シート制Enterpriseプランで5時間あたりの利用上限を引き上げ、温存して任意のタイミングで使えるレート制限リセットも提供する
- 後継: Claude Sonnet 5.5とClaude Haiku 5.5が数週間以内に続き、同様の性能・効率・安全性の改善を含む予定
ベンダー公表ベンチマーク — エージェント系コーディングを中心に首位と主張
- 数値はいずれもAnthropicの公表値で、独立した検証ではない。同社自身「この能力水準ではベンチマークの差は実利用の差の信頼できる指針になりにくく、Fable 5.1との差はスコアが示すより小さい」と注意書きしている
- Terminal-Bench 4.0: 66.4%(Fable 5.1は55.8%、Opus 5は52.3%、GPT-6 Astraは57.9%、GPT-5.6 Solは37.3%。OpenAI報告値は各社の最高スコア条件)
- FrontierCode v1.1(Main): 54.4%(Fable 5.1は50.3%、Opus 5は48.0%、GPT-6 Astraは53.3%)。既定の effort では約2割のコストでAstraを上回るとしている
- CursorBench 4.0: 57.8%(Fable 5.1は51.8%、Opus 5は46.6%、GPT-5.6 Solは41.7%)
- 知識労働・業務: GDPval-AA v2.1で1846、AutomationBenchで40.0%(Zapier実施の早期アクセス評価。セーフガード介入を失敗扱いのため実利用より低めと注記)
- その他: Humanity’s Last Exam 67.7%(ツール使用)、Terminal-Bench-Science 0.1で58.7%(GPT-6 Astraは64.6%)、OSWorld 2.0で81.8%(partial)、Chartographyで89.0%(ツール使用)
- 評価条件の注記: Opus 5.5は本番セーフガード有効で評価され、介入時はサイバー課題をOpus 4.8、生物・フロンティアLLM開発課題をOpus 5で代替したため、これらのベンチマークでは性能が低めに出ている可能性があるとしている
安全性 — Fable 5.1相当のセーフガード、外部評価を経て公開
- 外部評価: Frontier DesignとMETRを含む外部評価者のテストをリリース前に実施した
- 自動行動監査: 数千の模擬シナリオで評価する同社のアライメントスイートで、同社が評価したモデルの中で過去最高と主張。不可逆な行動や与えられた範囲外の行動の可能性が低下し、プロンプトインジェクション耐性もOpus 5より向上したとしている
- デプロイ条件: 生物・サイバーセキュリティ領域でClaude Mythos 5.1に匹敵するため、Fable 5.1と同様のセーフガードで展開する。生物学研究向けはLife Sciences Verification Programへの申請が可能で、サイバー向けは今後数週間でCyber Verification Programを拡大予定
- コンプライアンス: Opus 5.5はゼロデータ保持に対応。EU AI法対応の透かし措置を含み、「thinking」モードをオフにする提供形態は廃止された
- 文脈編集の制限: Claudeの事前文脈の編集による推論抽出を防ぐ対策が、2026年8月31日以降作成のAPIアカウントに適用される(Fable 5.1とOpus 5.5が対象)
提供形態
- 提供先: Claude Platform(モデルID
claude-opus-5-5)を含む全プラットフォーム。Amazon Web Services、Google Cloud、Microsoft Azureでも利用可能 - 比較画像について: 一次情報の発表ページに他モデル比較の性能チャート画像の掲載は確認できなかったため、本記事では数値をテキストで記載する(比較画像なし)