Orivel Orivel
メニューを開く

Claude Opus 4.8

Claude Opus 4.8の総合成績、ジャンル別の強み・弱み、最新の比較結果を確認できます。

モデル概要

提供元: Anthropic · claude-opus-4-8

リリース

2026-05-28

コンテキスト

1M トークン

入力料金

$5.00 / 1M

出力料金

$25.00 / 1M

Claude Opus 4.8(2026年5月28日リリース)は、2026年6月9日に Claude Fable 5 が最上位を継ぐまで Anthropic のフラッグシップでした。Orivel では引き続き、複雑な推論・長時間のエージェント的コーディング・高い自律性が求められるナレッジワークで上位クラスのモデルであり、価格は Fable 5 の半分です。

Opus 4.7 からの最大の進化は、判断の鋭さ、自分の進捗に対する正直さ、そしてより長時間ひとりで作業を続けられる能力です。自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がり、エージェント的ソフトウェアエンジニアリングでは SWE-Bench Pro 69.2% を記録し、GPT-5.5 と Gemini 3.1 Pro を上回りました。

コンテキストは1Mトークン、Messages API の最大出力は128kトークンを維持。価格は Opus 4.7 と同一(入力 $5 / 出力 $25 per 1M tokens)、知識カットオフは2026年1月です。新たに応答にかける労力を制御する `effort` パラメータ(既定 high)と、大規模かつ並列なエージェントタスク向けの Dynamic Workflows(リサーチプレビュー)が追加されました。

変更点

  • 2026年5月28日リリース、Claude Opus 4.7 の後継(約6週間後)
  • 判断の鋭さ、進捗報告の正直さ、より長時間の自律作業が向上
  • 自分のコードの欠陥を見逃す確率が Opus 4.7 比で約4分の1に
  • SWE-Bench Pro 69.2% — エージェント的コーディングで GPT-5.5・Gemini 3.1 Pro を上回る
  • 学際的推論、エージェント的コンピュータ操作、エージェント的金融分析でも向上
  • コンテキスト1Mトークン、Messages API で最大出力128kトークン
  • 応答ごとの労力を調整する `effort` パラメータ(既定 high)
  • 大規模・並列サブエージェント向け Dynamic Workflows(リサーチプレビュー)、fast mode は2.5倍速
  • 価格は Opus 4.7 と同一(入力 $5 / 出力 $25 per 1M tokens)
  • Adaptive thinking 対応。Claude API / Amazon Bedrock / Vertex AI / Microsoft Foundry で利用可能
  • 知識・学習データのカットオフは2026年1月
公式発表

総合性能

総合ランキング

2位

全体勝率

84%

平均スコア

85

勝利数

42

比較件数

50

モデル別の勝率

ジャンル別で詳しく見る

評価項目ごとの強み

評価項目ごとの平均スコア(10点満点)

指示遵守

91 21 件

原文への忠実さ

91 6 件

安全性

90 9 件

感情への訴求力

90 3 件

キャラの一貫性

90 3 件

重要点の網羅

90 6 件

倫理性・安全性

89 6 件

適切さ

89 15 件

深さ

89 3 件

助けになる度合い

89 9 件

構成

88 21 件

共感性

88 9 件

最新のお題

カウンセリング

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

エスカレーションを避けてルームメイトとの対立に対処する

ある人がこう言います:「ルームメイトが共有のキッチンに使いっぱなしの汚れた食器や散らかった物を置きっぱなしにします。何度か遠回しに伝えたのですが、何も変わりませ...

115
2026/06/30 09:41

プログラミング

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

決定論的リミットオーダーブック・シミュレータを実装する

単一ファイルの Python 3.11 ソリューションを作成し、関数 process_events(events: list[dict]) -> dict を実装してください。外部パッケージを使用しないでください。...

120
2026/06/29 09:44

教育問題

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

物理問題:柱時計の時間のゆがみ

柱時計は真鍮製の振り子を用いて時を刻んでおり、室温20.0°Cで完全に正確になるように校正されています。夏の熱波の間、室内の平均温度は35.0°Cまで上昇します。 与えられ...

134
2026/06/28 09:40

解説

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

イベントチュアルコンシステンシー(最終的整合性)をジュニアWeb開発者に説明する

基本的なCRUD Webアプリは作ったことがあるが分散システムは学んでいないジュニアWeb開発者向けに、教育目的の説明を書いてください。eventual consistency(最終的整合性...

123
2026/06/26 09:56

ビジネス文書

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

週4日制の試行スケジュールを提案する社内メモ

運営責任者(Head of Operations)から全従業員宛てに、ある部署を対象とした12週間の週4日制パイロットを提案する簡潔な社内メモを書いてください。メモには、事業上の根...

126
2026/06/25 09:45

要約

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

架空の研究論文を要約:都市の緑地について

以下は新しいタイプの都市緑地に関する架空の記事です。これを読んだ上で、記事全体を一段落で要約してください。要約は150〜200語の範囲で、環境への影響(大気/温度)、...

110
2026/06/24 09:53

説得

Google Gemini 2.5 Pro VS Anthropic Claude Opus 4.8

携帯電話のない学校日を学区教育委員会に採用させる説得演説

中学校と高校を対象に学区全体で携帯電話のない学校日を検討している地域の教育委員会に向けて、650~850語の説得力のある演説を書いてください。あなたの目的は、恒久的な...

121
2026/06/22 09:40

ブレインストーミング

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

中規模都市のための持続可能な通勤計画

中規模都市における環境に優しい通勤を改善するための、革新的かつ実用的な解決策の包括的なリストをブレインストーミングしてください。アイデアは「インフラ」「テクノロ...

124
2026/06/21 09:39

最新のディスカッション

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

若年成人に対する義務的国家奉仕

すべての若年成人は、軍務または医療、教育、環境保全のような民間分野での一定期間の義務的国家奉仕を完了することを義務付けられるべきでしょうか?

49
2026/07/12 14:42

ディスカッション

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

原子力発電:クリーンなエネルギーの解決策か、それとも放射能を伴う賭けか?

世界が気候変動と闘うために化石燃料からの転換を緊急に進める必要に直面する中、原子力はしばしば強力で炭素を排出しない代替手段として提示されます。この議論は、信頼性が高く大出力のエネルギー源としての原子力の利点と、放射性廃棄物の長期保管、チェルノブイリや福島のような壊滅的事故の可能性、核拡散への懸念といった重大なリスクとを比較検討します。

134
2026/07/01 14:41

ディスカッション

Anthropic Claude Opus 4.8 VS OpenAI GPT-5 mini

試されるプラットフォーム:ソーシャルメディア企業はユーザーコンテンツに対して責任を負うべき...

この議論は、ソーシャルメディアネットワークなどのインターネットプラットフォームが、ユーザーによって投稿されたコンテンツについて法的に責任を負うべきかどうかを巡るものである。しばしば中立的な伝達者として扱われる法的保護と比べ、コンテンツのキュレーションや増幅における役割が、配布する内容に責任を負う出版社のような存在であるという主張とを問うている。

122
2026/06/30 14:45

ディスカッション

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

学校カリキュラムの国家統制と地方統制

K-12公立学校のカリキュラムは、標準化された全国的な枠組みで決定されるべきか、それとも地方の学区やコミュニティの裁量に委ねられるべきか?

130
2026/06/29 14:41

ディスカッション

Google Gemini 2.5 Pro VS Anthropic Claude Opus 4.8

主要な博物館は、返還が争われている文化遺物を出所国に返還すべきか?

多くの主要な博物館は、植民地時代、戦争、不平等な貿易関係、あるいは初期の考古学的調査の間に入手された遺物を所蔵しています。これらの機関は、返還が争われている文化財をその出所国やコミュニティに返還することを義務付けられるべきか、それとも保存・研究・展示が可能であれば世界の観客に向けて保有することを認められるべきか?

139
2026/06/28 14:39

ディスカッション

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

普遍的授業料無料の公立大学

公立の大学やカレッジは、家庭の収入にかかわらず、すべての国内学生に対して授業料を完全に無料にすべきか?

135
2026/06/27 14:40

ディスカッション

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.8

プレイグラウンド対プランナー:子どもの自由時間は非構造的であるべきか?

この討論は、学校時間外における子どもの発達にとって最適なアプローチを探るものです。ある考え方は、構造化されていない、子ども主導の自由な遊びが、創造性、自立性、社会的スキルを育むために不可欠だと主張します。反対の見解は、スポーツや音楽、学習強化のような予定された大人主導の活動が、規律や特定の才能の育成、そして将来に向けた競争上の優位性を築くために重要だと考えます。

134
2026/06/26 14:41

ディスカッション

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

修理する権利:消費者の力を高めるか、イノベーションを損なうか?

「修理する権利」運動は、メーカーが消費者と独立した修理業者に対して、自分たちの電子機器を修理するために必要な部品、工具、情報を提供することを義務付ける法律を求めている。支持者はこれが電子廃棄物を減らし、消費者の費用を節約し、より持続可能な経済を促進すると主張する。反対者は主にメーカーであり、これが機器の安全性やセキュリティ、ならびに彼らの知的財産を損ない、イノベーションを阻害する可能性があると主張している。

145
2026/06/25 14:49

関連リンク

X f L