ニュース

Claude Opus 5.5登場 Fable 5.1並みの性能をOpus 5より40%安価に

Anthropicは22日(米国時間)、最新のAIモデル「Claude Opus 5.5」を提供開始した。ほとんどの作業において最上位モデル「Fable 5.1」と同等の性能を発揮し、コストは現行の「Opus 5」よりも40%安くなるという。Claude上ではすでに利用可能となっているほか、Amazon Web Services、Google Cloud、Microsoft Azureなどでも展開される。

また、Opus 5.5はAnthropicが「フロンティアのペース調整」を呼びかけて以来、初のモデルリリースとなる。リリースに先立ち、Frontier DesignやMETRを含む外部評価機関によるテストが行なわれたほか、同社の包括的なアライメントテストでも高いパフォーマンスを発揮した。

パフォーマンスにおいては、従来モデルの「Opus 5」から大幅に進化。初期テスターによれば、68万行のコードの移行を1日未満で完了させたという。これは、エンジニアリングチームが数週間を要する作業で、Opus 5.5ではソフトウェアの非効率性を発見し、修正する能力に優れているという。Webアプリの全ページで読み込み時間を短縮するよう指示したところ、Opus 5.5は40回中39回成功。一方、Opus 5は改善の幅が小さく、アプリの動作にも変化が生じてしまったという。

ベンチマークでも多くの項目でOpus 5だけでなく、Fable 5.1を越えており、プロンプトからゲームを作成したケースでも、グラフィックと完成度の高さにおいて、他のどのモデルよりも高い評価を得ている。

安全性については、数千のシミュレーションシナリオでClaudeをテストするAnthropicのアライメントスイート「自動行動監査」において、これまでのどのモデルよりも高いスコアを達成。最近のモデルに比べ、元に戻すのが困難な行動をとったり、与えられた境界外で行動したりする可能性が低く、Opus 5よりもプロンプトインジェクションに対する耐性も高いという。

またOpus 5.5は、生物学やサイバーセキュリティの分野においてClaude Mythos 5.1と同等の性能を持つため、Fable 5.1と同様の安全対策を導入した上で展開。審査済みの組織においては、ライフサイエンス検証プログラムに申請し、生物学研究にOpus 5.5を利用できるようになるほか、今後数週間以内にサイバー検証プログラムへのアクセスも拡大予定。検証済みのサイバーセキュリティ担当者に対し、Opus 5.5のサイバー能力を提供する。

コストと速度においても改善。 Opus 5.5はOpus 5よりも少ない計算リソースで動作し、その点を価格設定にも反映した。デフォルト設定では、一般的なワークロードにおいてOpus 5よりも40%低コストとなり、入力トークンは100万トークンあたり4ドル、出力トークンは同20ドルで、Opus 5より20%安くなる。また、キャッシュ読み取り(エージェント処理やコーディング作業コストの大部分を占める)は、100万トークンあたり0.20ドルで、Opus 5より60%安くなる。加えて、Opus 5.5はOpus 5よりも30%以上高速に出力を生成できるという。

価格の引き下げだけでなく、Pro(20ドル~)、Max(100ドル~)、Teamプランの5時間利用制限を拡大。また、サブスクリプションユーザーにはレートリミットのリセット機能を提供しており、好きなタイミングで利用できるようになった。

コミュニケーションも改善し、初期テスターからは、文章がより明確で理解しやすくなったとの声が寄せられているという。これはOpus 5に関して寄せられたフィードバックに対応したもので、重要な情報を冒頭に配置し、そのスタイルにより、長時間のセッションにおいてもより優れた仕事パートナーとなるという。

Opus 5(左)とOpus 5.5(右)。より端的に表現する

なお、Fable、Opusに次ぐモデルのSonnetとHaikuについても、Claude Sonnet 5.5/Haiku 5.5を、今後数週間以内にリリースされる予定としており、パフォーマンス、効率性、安全性において同様の改善を見込んでいる。