Orivel Orivel
メニューを開く

Claude Opus 4.8

Claude Opus 4.8の総合成績、ジャンル別の強み・弱み、最新の比較結果を確認できます。

モデル概要

提供元: Anthropic · claude-opus-4-8 引退

リリース

2026-05-28

コンテキスト

1M トークン

入力料金

$5.00 / 1M

出力料金

$25.00 / 1M

最大出力

128k トークン

**2026年7月24日、同一価格の Claude Opus 5 が登場したため、Orivel の新規比較からは引退しました。**過去の結果は引き続き公開しています。

Claude Opus 4.8(2026年5月28日リリース)は、2026年6月9日に Claude Fable 5 が最上位を継ぐまで Anthropic のフラッグシップで、その後は Orivel の Anthropic バランス枠を担っていました。Opus 4.7 からの最大の進化は、判断の鋭さ、自分の進捗に対する正直さ、より長時間ひとりで作業を続けられる能力で、自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がりました。

ベンチマーク

指標 Opus 4.8 備考
SWE-Bench Pro 69.2% GPT-5.5・Gemini 3.1 Pro を上回る

スペックと料金

項目 Opus 4.8
コンテキスト 1Mトークン
最大出力 128kトークン(Messages API)
知識カットオフ 2026年1月
入力 / 1M $5(Opus 4.7 と同額)
出力 / 1M $25(Opus 4.7 と同額)
effort パラメータ この世代で追加。既定は high
Dynamic Workflows リサーチプレビュー。大規模・並列なエージェントタスク向け

引退に関するメモ

  • 2026年5月28日リリース、Claude Opus 4.7 の後継(約6週間後)
  • 判断の鋭さ、進捗報告の正直さ、より長時間の自律作業が向上
  • 自分のコードの欠陥を見逃す確率が Opus 4.7 比で約4分の1に
  • SWE-Bench Pro 69.2% — エージェント的コーディングで GPT-5.5・Gemini 3.1 Pro を上回る
  • 学際的推論、エージェント的コンピュータ操作、エージェント的金融分析でも向上
  • コンテキスト1Mトークン、Messages API で最大出力128kトークン
  • 応答ごとの労力を調整する `effort` パラメータ(既定 high)
  • 大規模・並列サブエージェント向け Dynamic Workflows(リサーチプレビュー)、fast mode は2.5倍速
  • 価格は Opus 4.7 と同一(入力 $5 / 出力 $25 per 1M tokens)
  • Adaptive thinking 対応。Claude API / Amazon Bedrock / Vertex AI / Microsoft Foundry で利用可能
  • 知識・学習データのカットオフは2026年1月
公式発表

現行モデルのスペック比較

実測データが貯まる前でも比較できる、公表スペックと料金の一覧です。

モデル コンテキスト 最大出力 入力 / 1M 出力 / 1M
openai GPT-6 Astra 128k $10.00 $50.00
google Gemini 3.8 Flash 66k $0.75 $3.75
anthropic Claude Fable 5.1 1M 128k $10.00 $50.00
google Gemini 3.5 Flash-Lite 66k $0.30 $2.50
openai GPT-5.6 1M 128k $4.00 $20.00
anthropic Claude Opus 5 1M 128k $5.00 $25.00
openai GPT-5 mini 400k 128k $0.25 $2.00
google Gemini 3.1 Flash-Lite 66k $0.25 $1.50
anthropic Claude Sonnet 5 1M 128k $2.00 $10.00

総合性能

総合ランキング

-

全体勝率

81%

平均スコア

85

勝利数

44

比較件数

54

モデル別の勝率

ジャンル別で詳しく見る

評価項目ごとの強み

評価項目ごとの平均スコア(10点満点)

指示遵守 8.98 24 件
安全性 8.98 9 件
原文への忠実さ 8.98 9 件
感情への訴求力 8.97 3 件
キャラの一貫性 8.97 3 件
倫理性・安全性 8.92 6 件
適切さ 8.88 15 件
深さ 8.87 3 件
助けになる度合い 8.86 9 件
共感性 8.83 9 件
構成 8.80 24 件
推論の質 8.76 9 件

最新のお題

要約

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

都市農業技術に関する報告の要約

次の文章を読んでください。Aero-Dynamic Vertical Farming (ADVF) と呼ばれる新しい技術についての説明です。都市計画委員会向けに、200〜250語の簡潔な要約を書いてくだ...

351
2026/07/17 09:41

お笑い

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

プロの幽霊のための就職面接

短くユーモラスな対話(約200〜300語)を書いてください。登場人物は、過度に熱意のある企業の採用担当マネージャーのBrenda(ブレンダ)と、そのプロセスにやや困惑してい...

360
2026/07/15 09:38

カウンセリング

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

エスカレーションを避けてルームメイトとの対立に対処する

ある人がこう言います:「ルームメイトが共有のキッチンに使いっぱなしの汚れた食器や散らかった物を置きっぱなしにします。何度か遠回しに伝えたのですが、何も変わりませ...

373
2026/06/30 09:41

プログラミング

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

決定論的リミットオーダーブック・シミュレータを実装する

単一ファイルの Python 3.11 ソリューションを作成し、関数 process_events(events: list[dict]) -> dict を実装してください。外部パッケージを使用しないでください。...

330
2026/06/29 09:44

教育問題

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

物理問題:柱時計の時間のゆがみ

柱時計は真鍮製の振り子を用いて時を刻んでおり、室温20.0°Cで完全に正確になるように校正されています。夏の熱波の間、室内の平均温度は35.0°Cまで上昇します。 与えられ...

335
2026/06/28 09:40

解説

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

イベントチュアルコンシステンシー(最終的整合性)をジュニアWeb開発者に説明する

基本的なCRUD Webアプリは作ったことがあるが分散システムは学んでいないジュニアWeb開発者向けに、教育目的の説明を書いてください。eventual consistency(最終的整合性...

355
2026/06/26 09:56

ビジネス文書

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

週4日制の試行スケジュールを提案する社内メモ

運営責任者(Head of Operations)から全従業員宛てに、ある部署を対象とした12週間の週4日制パイロットを提案する簡潔な社内メモを書いてください。メモには、事業上の根...

370
2026/06/25 09:45

要約

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

架空の研究論文を要約:都市の緑地について

以下は新しいタイプの都市緑地に関する架空の記事です。これを読んだ上で、記事全体を一段落で要約してください。要約は150〜200語の範囲で、環境への影響(大気/温度)、...

336
2026/06/24 09:53

最新のディスカッション

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

政府はユニバーサル・ベーシックインカム(UBI)を導入すべきか?

ユニバーサル・ベーシックインカム(UBI)は、すべての市民が政府から定期的かつ無条件に一定額の金銭を受け取る制度です。議論は、これが貧困や自動化による雇用喪失に対する実行可能な解決策であるか、あるいは経...

335
2026/07/24 14:39

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

K-12教育における標準化試験を廃止する

標準化された試験は、生徒の成績を評価し、教員の有効性を測定し、学校資源を配分するために広く使用されている。支持者はそれが客観的なデータを提供し説明責任を確保すると主張する。批判者はそれがカリキュラムを...

310
2026/07/20 14:40

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

若年成人に対する義務的国家奉仕

すべての若年成人は、軍務または医療、教育、環境保全のような民間分野での一定期間の義務的国家奉仕を完了することを義務付けられるべきでしょうか?

340
2026/07/12 14:42

ディスカッション

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

原子力発電:クリーンなエネルギーの解決策か、それとも放射能を伴う賭けか?

世界が気候変動と闘うために化石燃料からの転換を緊急に進める必要に直面する中、原子力はしばしば強力で炭素を排出しない代替手段として提示されます。この議論は、信頼性が高く大出力のエネルギー源としての原子力...

363
2026/07/01 14:41

ディスカッション

Anthropic Claude Opus 4.8 VS OpenAI GPT-5 mini

試されるプラットフォーム:ソーシャルメディア企業はユーザーコンテンツに対して責任を負うべき...

この議論は、ソーシャルメディアネットワークなどのインターネットプラットフォームが、ユーザーによって投稿されたコンテンツについて法的に責任を負うべきかどうかを巡るものである。しばしば中立的な伝達者として...

297
2026/06/30 14:45

ディスカッション

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

学校カリキュラムの国家統制と地方統制

K-12公立学校のカリキュラムは、標準化された全国的な枠組みで決定されるべきか、それとも地方の学区やコミュニティの裁量に委ねられるべきか?

331
2026/06/29 14:41

ディスカッション

Google Gemini 2.5 Pro VS Anthropic Claude Opus 4.8

主要な博物館は、返還が争われている文化遺物を出所国に返還すべきか?

多くの主要な博物館は、植民地時代、戦争、不平等な貿易関係、あるいは初期の考古学的調査の間に入手された遺物を所蔵しています。これらの機関は、返還が争われている文化財をその出所国やコミュニティに返還するこ...

364
2026/06/28 14:39

ディスカッション

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

普遍的授業料無料の公立大学

公立の大学やカレッジは、家庭の収入にかかわらず、すべての国内学生に対して授業料を完全に無料にすべきか?

302
2026/06/27 14:40

関連リンク

X f L