Orivel Orivel
メニューを開く

AI性能ランキング(最新)

このページでは、複数ジャンルのベンチマーク結果をもとにしたAIモデルの最新の総合性能ランキングを確認できます。平均スコア、サンプル数、全体的な傾向を見比べるのに使えます。

モデル別で性能比較をする

採点基準 / 公平性方針を見る

最終更新: 2026/08/23 14:38

1位
Claude Opus 5 Anthropic

勝率

96%

平均スコア

86
2位
Claude Fable 5 Anthropic

勝率

87%

平均スコア

88
3位
Claude Sonnet 5 Anthropic

勝率

70%

平均スコア

81
4位
GPT-5.6 OpenAI

勝率

64%

平均スコア

85
5位
GPT-5 mini OpenAI

勝率

59%

平均スコア

84
6位
GPT-5.5 OpenAI

勝率

58%

平均スコア

85
7位
Gemini 2.5 Pro Google

勝率

8%

平均スコア

77
8位
Gemini 2.5 Flash Google

勝率

4%

平均スコア

73
9位
Gemini 2.5 Flash-Lite Google

勝率

2%

平均スコア

71

ジャンル別ランキング

各ジャンルの上位モデルを一覧で確認できます。カードを開くと、そのジャンルの詳細ランキングページへ移動します。

ディスカッション

上位3モデル

1位 Claude Opus 5 2位 Claude Fable 5 3位 Claude Sonnet 5
ディスカッション のランキングを見る

小説・創作

上位3モデル

1位 GPT-5.5 2位 Claude Opus 5 3位 GPT-5.6
小説・創作 のランキングを見る

プログラミング

上位3モデル

1位 Claude Fable 5 2位 GPT-5.6 3位 GPT-5 mini
プログラミング のランキングを見る

システム設計

上位3モデル

1位 Claude Opus 5 2位 GPT-5.6 3位 GPT-5 mini
システム設計 のランキングを見る

教育問題

上位3モデル

1位 Claude Fable 5 2位 GPT-5 mini 3位 Claude Sonnet 5
教育問題 のランキングを見る

解説

上位3モデル

1位 Claude Fable 5 2位 Claude Sonnet 5 3位 GPT-5 mini
解説 のランキングを見る

要約

上位3モデル

1位 Claude Fable 5 2位 GPT-5.5 3位 Claude Sonnet 5
要約 のランキングを見る

アイデア出し

上位3モデル

1位 Claude Fable 5 2位 Claude Opus 5 3位 GPT-5.6
アイデア出し のランキングを見る

ロールプレイ

上位3モデル

1位 Claude Fable 5 2位 Claude Opus 5 3位 GPT-5.6
ロールプレイ のランキングを見る

ビジネス文書

上位3モデル

1位 Claude Fable 5 2位 GPT-5 mini 3位 GPT-5.6
ビジネス文書 のランキングを見る

計画立案

上位3モデル

1位 GPT-5 mini 2位 GPT-5.5 3位 Claude Fable 5
計画立案 のランキングを見る

分析

上位3モデル

1位 Claude Fable 5 2位 Claude Opus 5 3位 Claude Sonnet 5
分析 のランキングを見る

評価項目別トップモデル

各評価項目で平均スコアが最も高いモデルです。

分かりやすさ

Anthropic Claude Opus 4.6
平均スコア: 86 比較件数: 273

指示遵守

Anthropic Claude Opus 4.6
平均スコア: 91 比較件数: 156

説得力

Anthropic Claude Opus 4.6
平均スコア: 84 比較件数: 102

論理性

Anthropic Claude Opus 4.6
平均スコア: 83 比較件数: 102

構成

Anthropic Claude Opus 4.6
平均スコア: 88 比較件数: 54

反論の質

Anthropic Claude Opus 5
平均スコア: 86 比較件数: 45

独自性

OpenAI GPT-5.2
平均スコア: 85 比較件数: 36

多様性

OpenAI GPT-5.4
平均スコア: 90 比較件数: 30

対象読者への適合

Anthropic Claude Opus 4.6
平均スコア: 91 比較件数: 27

共感性

OpenAI GPT-5.2
平均スコア: 92 比較件数: 21

最新のおすすめAI

Orivel の最新ベンチマーク結果をもとに、総合で評価の高いモデルやジャンル別のおすすめをまとめて確認できるページです。

AI料金比較

価格重視でAIを比較したい方は、AI料金比較・コスパランキングをご覧ください。主要モデルの料金と性能をあわせて確認できます。

関連リンク

X f L