it.xnews.jp
生成: 2026-07-24 読了 約 3 分 model: claude-haiku-4-5 原文: https://www.anthropic.com/news/claude-opus-5 raw.md

Claude Opus 5 が発表、Fable 5 の性能に近づき半額で提供

本日、Anthropic は Claude Opus 5 を発表した。この新モデルは Claude Fable 5 に近い性能をを半額で実現し、すべてのプラットフォームで入力トークン $5 / 100万、出力トークン $25 / 100万 (Opus 4.8 と同価格) で利用可能。Claude Max のデフォルトモデルおよび Claude Pro の最強モデルとなる。

Opus 5 は複数のベンチマークで高い性能を示す。Frontier-Bench v0.1 ではすべてのモデルを上回り、ARC-AGI 3 では次点モデルの 3 倍のスコアを獲得。CursorBench 3.2 では最大努力設定で Fable 5 のピークスコアの 0.5% 以内の性能を半分のコスト で達成している。

パフォーマンス指標

Opus 5 は広範な実務タスクで既存モデルを凌駕する。Zapier AutomationBench での合格率は次点モデルの約 1.5 倍で、100% の合格率を達成。OSWorld 2.0 では Fable 5 を上回りながら、コストはわずか 3 分の 1 強に抑制した。

生命科学分野でも顕著な改善を見せ、有機化学タスクで Opus 4.8 を 10.2 ポイント上回り、タンパク質関連タスクでは 7.7 ポイント上回った。ソフトウェアエンジニアリングでは、最も難度の高いエージェンティックコーディングタスクで Opus 4.7 を 22% 上回っている。

企業での導入事例

Box は、Opus 5 が Opus 4.8 を 8% 上回り、データ分析ワークフローで 11% の改善、デューデリジェンスワークフローで 17% の改善を実現したことを確認。金融モデリングタスクでは平均 9 ポイント高い精度を達成し、ターン数とツール呼び出しを 3 分の 1、処理時間を 60% 削減した。

Zapier は 「Opus 5 は Fable 5 と同等のクオリティを Opus のスピードとコストで提供し、CursorBench では Fable 5 のわずか下で、多くの同じ挙動を示す」とのこと。Lovable も 「Opus 5 は Opus ファミリーで最も難度の高いエージェンティックコーディングタスクで 22% 向上し、実行ごとのばらつきが大幅に減少した」と述べた。

法務分野では、Opus 5 が企業統治と仲裁のような専門分野で著しい改善を示し、最大推論設定時に Opus 4.8 と比べて平均 26% トークン生成量を削減しながら同等の品質を保持。初回の修正提案では過去のモデルの約 2 倍のスコアを獲得した。

安全性とモード

Opus 5 は自動行動監査で総合的な不適切動作スコア 2.3 を記録。生物学研究と攻撃的なサイバーセキュリティでは Mythos 5 に後れをとるが、脆弱性悪用でも同様に大きく水をあけられている。

高速モード (デフォルト速度の約 2.5 倍) が Opus 5 の基本料金の 2 倍で利用可能。API ではベータ版として会話中ツール変更と自動フォールバックをリリース。Opus 5 は一般アクセス時にデータ保持要件なし。

この記事は元記事の事実のみに基づいて自動生成されました。

出典

Anthropic Introducing Claude Opus 5 https://www.anthropic.com/news/claude-opus-5

この記事をシェア