Orivel Orivel
メニューを開く

Claude Opus 5

Claude Opus 5の総合成績、ジャンル別の強み・弱み、最新の比較結果を確認できます。

モデル概要

提供元: Anthropic · claude-opus-5 NEW

リリース

2026-07-24

入力料金

$5.00 / 1M

出力料金

$25.00 / 1M

Claude Opus 5(2026年7月24日リリース)は、複雑なエージェント的コーディングと業務利用に向けた Anthropic のモデルです。Orivel では Opus 4.8 と同一価格のまま Anthropic のバランス枠を引き継ぎ、最上位のフロンティア枠は引き続き Claude Fable 5 が担います。

Anthropic は「Opus の速度とコストで Fable 5 に迫る知能」と位置付けています。SWE-bench Verified で 96.0%(5回平均)、SWE-bench Pro で 79.2%、SWE-bench Multilingual で 89.5% を記録。Frontier-Bench v0.1 では Opus 4.8 の2倍超、ARC-AGI 3 では次点モデルの約3倍のスコアを出しました。OSWorld 2.0 では Fable 5 の最高値を3分の1のコストで上回っています。

コンテキストは1Mトークン、最大出力は128kトークン、知識カットオフは2026年5月で現行 Claude モデルの中で最も新しいものです。価格は Opus 4.8 と同一の入力 $5 / 出力 $25 per 1M tokens。Adaptive thinking が既定でオン(Opus 4.8 からの変更点)になり、temperature などのサンプリングパラメータは受け付けなくなりました。

変更点

  • 2026年7月24日リリース。複雑なエージェント的コーディングと業務利用向け
  • SWE-bench Verified 96.0%(5回平均)、SWE-bench Pro 79.2%、SWE-bench Multilingual 89.5%
  • Frontier-Bench v0.1 は Opus 4.8 の2倍超、ARC-AGI 3 は次点の約3倍
  • OSWorld 2.0 で Fable 5 の最高値を3分の1のコストで上回る
  • 科学研究でも向上:有機化学 +10.2ポイント、タンパク質予測 +7.7ポイント(対 Opus 4.8)
  • コンテキスト1Mトークン、最大出力128kトークン
  • Adaptive thinking が既定でオン(Opus 4.8 は明示指定が必要だった)。temperature / top_p / top_k は受付終了
  • effort は `max` まで全段階に対応。fast mode は2.5倍速
  • 価格は Opus 4.8 と同一:入力 $5 / 出力 $25 per 1M tokens
  • 知識カットオフ:2026年5月
公式発表

総合性能

総合ランキング

1位

全体勝率

100%

平均スコア

87

勝利数

10

比較件数

10

モデル別の勝率

ジャンル別で詳しく見る

評価項目ごとの強み

評価項目ごとの平均スコア(10点満点)

指示遵守

95 3 件

完全性

94 3 件

トレードオフの説明力

93 3 件

拡張性・信頼性

92 3 件

助けになる度合い

92 3 件

設計の質

91 3 件

共感性

89 3 件

一貫性

88 3 件

対象読者への適合

87 3 件

説得力

87 3 件

適切さ

86 3 件

分かりやすさ

86 12 件

最新のお題

お笑い

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 5

魔法の遺失物取扱デスク

落ち着いた遺失物受付係のミラと、あわてた魔法使いオーリンの間で、ちょうど12ターンのファミリー向けのコミカルな対話を書いてください。オーリンは、誤ってホチキスに変...

29
2026/07/25 05:31

システム設計

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

システム設計:リアルタイム通知サービス

あなたは、大規模なソーシャルメディアプラットフォーム向けのリアルタイム通知システムの設計を任されたシニアソフトウェアエンジニアです。 システム要件: **機...

44
2026/07/25 05:09

説得

Google Gemini 2.5 Pro VS Anthropic Claude Opus 5

懐疑的な市議会を説得してバス専用レーン試行を承認させる

リバートン市議会に対して、セントラル・アベニューで提案されている6か月間のバス専用レーン試行を承認するよう促す、500〜650語の演説を書いてください。聴衆には判断を...

57
2026/07/25 04:46

カウンセリング

Google Gemini 2.5 Flash VS Anthropic Claude Opus 5

友人との週末旅行を取りやめる

私は親しい友人に週末の旅行に「おそらく」参加すると伝えましたが、最終確認まで待ってほしいと頼みました。それでも友人は共有のキャビンを予約し、返金不可のデポジット...

27
2026/07/25 02:33

最新のディスカッション

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 5

創造分野における生成AI:芸術の革命か、それともアーティストの終焉か?

芸術、音楽、文学を創作するための生成AIの使用は、正当な創作ツールとして受け入れるべきか、それとも人間のアーティストの価値と生計を守るために制限されるべきか?

22
2026/07/25 14:39

ディスカッション

Anthropic Claude Opus 5 VS OpenAI GPT-5 mini

ユニバーサル・ベーシックインカム(UBI):実現可能な未来か、それとも高くつく誤りか?

ユニバーサル・ベーシックインカム(UBI)は、すべての国民が所得、資産、雇用状況にかかわらず、政府から定期的に無条件の金銭を受け取ることを提案する制度です。提唱者は、貧困の撲滅、不平等の是正、そして自動化の進展する時代における経済的安心を提供する強力な手段であると主張します。反対者は、その巨額の費用、労働意欲をそぐ可能性、そして重大なインフレを引き起こすリスクを懸念します。核心的な論点は、UBIを導入することでより公平で安定した社会が生まれるのか、それとも経済的崩壊や社会の停滞を招くのか、という点です。

30
2026/07/25 05:45

ディスカッション

Anthropic Claude Opus 5 VS OpenAI GPT-5.5

働き方の未来:週4日労働制

この討論は、ほとんどの産業で標準化された週4日労働制(賃金を減らさない)を導入することの実現可能性と望ましさを検討するものです。支持者はそれが生産性、従業員の幸福、ワークライフバランスを向上させると主張する一方、反対者はその経済的実現可能性、顧客サービスへの影響、すべての業界に適しているかどうかについて懸念を示しています。

30
2026/07/25 03:37

ディスカッション

Anthropic Claude Opus 5 VS OpenAI GPT-5.6

週休4日制:進歩への道か、生産性の落とし穴か?

企業や政府は、給与を減らさない週休4日制を正社員の新たな標準として積極的に推進すべきか?

30
2026/07/25 03:19

ディスカッション

OpenAI GPT-5 mini VS Anthropic Claude Opus 5

週4日労働制:進歩か問題か?

フルタイム従業員を対象とした標準的な週4日労働制の概念が支持を集めている。支持者は、生産性を向上させ従業員の幸福を改善すると主張する一方で、反対者はすべての産業で実現可能かどうかやストレスの増加の可能性を懸念している。この議論は、週4日労働制への移行が現代経済にとって有益で持続可能なモデルであるかどうかを探るものである。

35
2026/07/25 03:02

ディスカッション

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 5

公共交通機関は無料にすべきか?

都市はバス、路面電車、地下鉄の運賃を廃止し、公共交通を税金やその他の公的収入だけで完全に賄うべきか?

33
2026/07/25 01:31

関連リンク

X f L