クロード オーパス 4.5 が登場: コーディング テストを打ち破り、AI プログラミングの「スーパーマン」時代の到来を告げる
最近、大型モデルのリリースのペースが容赦なく進んでいます。 Gemini 3 Pro が注目を集めていたのと同じように、Anthropic は Claude Opus 4.5 を正式にリリースし、プログラミングとシステム レベルのタスクに重点を置いて再び水準を引き上げました。
Anthropic は、Opus 4.5 は全体的によりスマートで効率的であると主張しています。プログラミング、ビルディング エージェント、コンピューター制御などの「システム レベルのタスク」で最高レベルのパフォーマンスを維持しながら、研究、プレゼンテーション、スプレッドシート分析などの日常タスクでも大幅な向上を示しています。本日より、Opus 4.5 は、Claude アプリ、API、および開発者が「claude-opus-4-5-20251101」 API 呼び出しを通じて使用できる主要なクラウド プラットフォームを通じて広く利用可能になります。

AI デビューの季節に Opus 4.5 が主役に
公式発表とテスターのフィードバックによると、Claude Opus 4.5 はあいまいなリクエストを著しくよく理解し、複雑なバグを自律的に識別する際により安定しています。これは、実際のソフトウェア エンジニアリング ベンチマークである SWE-Bench Verified で 80% を超えるスコアを獲得した最初のモデルとなりました。

モデルのコード品質は包括的にアップグレードされました。 8 つのプログラミング言語を対象とする SWE ベンチ多言語テストでは、Opus 4.5 はそのうち 7 言語で最高スコアを獲得しました。説得力のある例として、Anthropic チームは、パフォーマンス エンジニアの採用に使用される高難易度のテストを Opus 4.5 に課しました。 2 時間の制限時間内で、モデルはすべての人間の候補者を上回りました。ソフトウェア エンジニアリングを超えて、Claude Opus 4.5 は視覚、推論、数学における全面的な改善を実証しています。このモデルの機能は、既存の評価基準をも上回り始めています。あるエージェント ベンチマークでは、このモデルは、ルールには準拠しているものの、テストで期待される答えから外れていた問題に対して賢明な回避策を考案し、その創造的な問題解決能力を実証しました。

Claude Everywhere: デスクトップ、ブラウザ、Excel に統合
Opus 4.5 に加えて、Claude エコシステム全体がアップグレードされました。 Claude Code は、より正確な実行計画を実現する「プラン モード」と、複数のエージェント セッションを同時に実行するための新しいデスクトップ アプリケーションという 2 つの主要なアップデートを受けました。アプリユーザー向けに、要望の多かった「エンドレス会話」機能が利用可能になり、初期の文脈を自動的に要約することで対話を無期限に継続できるようになりました。さらに、Claude for Chrome 拡張機能はすべての Max ユーザーに公開されており、Claude for Excel のベータ版は Max、Team、Enterprise ユーザーに拡張されました。

よりスマートでより経済的: Opus 4.5 の主要な基礎アップグレード
モデルが賢くなるにつれて、問題をより効率的に解決できるようになります。 Claude Opus 4.5 は、以前のバージョンよりも大幅に少ないトークンを使用して、同等以上の結果を達成します。 API の新しい「エフォート」パラメータにより、開発者は速度とコストを優先するか、モデルの機能を最大化するかを選択できます。中程度の労力レベルでは、Opus 4.5 は SWE ベンチ検証済みの Sonnet 4.5 の最高のパフォーマンスに匹敵しますが、出力トークンは 76% 少なくなります。また、Anthropic は、エージェント ワークフローで多数のツールを管理するという課題を解決するための 3 つの新機能、「ツール検索ツール」、「プログラムによるツール呼び出し」、および「ツール使用例」を導入しました。これらの機能は、トークンの使用量を削減し、ツールの選択を改善することで、複雑なマルチツール テストの精度を大幅に向上させました。
このリリースでは、さまざまな AI モデルが異なる「個性」を開発しているという新たなトレンドを浮き彫りにしています。 Opus シリーズはプログラミング、構造化推論、システム操作に優れていますが、Sonnet のようなモデルはクリエイティブな執筆にはコスト効率が高い可能性があります。 Opus 4.5 の発売により、この専門性が裏付けられます。将来的には、AI モデルの選択はリーダーボードのスコアではなく、自分のニーズに合った働き方をする「同僚」を見つけることが重要になるでしょう。
