Orivel Orivel
メニューを開く

ロールプレイ

役になりきる一貫性や自然な会話力を比較します。

このジャンルでは、主に キャラの一貫性、自然さ、指示遵守 のような力を見ようとしています。

共感やカウンセリングよりも、役になりきれるか、自然な会話が続くかを強く見ているジャンルです。

ここで高得点でも、事実の正確さや安全な助言、分析タスクへの強さまで保証されるわけではありません。

このジャンルで強いAIが向いている用途

キャラクターチャット、シミュレーション、ロールベースの対話体験です。

このジャンルだけでは判断しきれないこと

調査、コーディング、慎重な支援会話の適性までは分かりません。

データ分析

ロールプレイ:Claude Fable 5 がジャンル随一のデビュー、静かに好演する Gemini 2.5 Pro

採点回答 23件 ロールプレイ 2026/8/20 更新
1
Claude Fable 5

Anthropic

91
平均スコア
100%
勝率
1位 1回 サンプル 1件
2
Claude Opus 5

Anthropic

85
平均スコア
100%
勝率
1位 1回 サンプル 1件
3
GPT-5.6

OpenAI

83
平均スコア
100%
勝率
1位 1回 サンプル 1件

モデル別の平均スコア

1 Claude Fable 5
9.06
2 Claude Opus 5
8.47
3 GPT-5.6
8.31
4 GPT-5 mini
7.69
5 Gemini 2.5 Pro
8.04
6 GPT-5.5
7.61
7 Gemini 2.5 Flash
7.15
8 Gemini 2.5 Flash-Lite
6.64

評価の重み付け

キャラの一貫性 30% 自然さ 20% 指示遵守 20% 創造性 15% 分かりやすさ 15%

Claude Fable 5 は初登場でこの表いちばんの内容を見せ、ジャンルの先頭に立ちました。Claude Opus 5 と GPT-5.6 もデビュー戦を白星で飾っています。場面の最後まで人格を保ち続ける——このジャンルが切り出しているのはその技能で、最新世代は明らかにそれを携えて登場しました。例によって、初登場組の順位は「確立」ではなく「初期値」です。

静かな見どころは Gemini 2.5 Pro です。ここでの平均点は上位にいる何モデルかを上回り、対戦もときどき制します。同モデルにとって出来の良い標準ジャンルのひとつです。GPT-5 mini は星を分け合い、堅実ながら珍しく支配的ではありません。目立って出遅れているのは GPT-5.5 で、ここではまだ白星がなく、平均もいつもの水準を下回ります。人格演技は得意分野ではなさそうです。

採点は人格の一貫性を他から大きく引き離して重視し、自然さと指示遵守が続きます。技巧的に流暢でも人格が割れた応答は、地味でも人格を保った応答に敗れます。創造性は効きますが、壊れた声を救うことはできません。ロールプレイのお題はトーンも難度も振れ幅が大きく、中位の並びは緩く握っておいてください。

結論

人格演技の用途では Claude Fable 5 が初期の主役で、Claude ファミリー全体がこのジャンルを得意にしている気配です。総合順位に反して Gemini 2.5 Pro は一見の価値あり——逆に GPT-5.5 は、珍しくその対象外です。

この分析は Orivel がこのジャンルで実測したベンチマークスコアをもとに生成し、定期的に更新しています。スコアは条件依存の測定値であり、絶対評価ではありません。

このジャンルに強いモデルランキング

このランキングは当ジャンルに限定したスコアの平均順です。

最終更新: 2026/08/19 09:38

1位
Claude Fable 5 Anthropic

勝率

100%

平均スコア

91
2位
Claude Opus 5 Anthropic

勝率

100%

平均スコア

85
3位
GPT-5.6 OpenAI

勝率

100%

平均スコア

83
4位
GPT-5 mini OpenAI

勝率

50%

平均スコア

77
5位
Gemini 2.5 Pro Google

勝率

25%

平均スコア

80
6位
GPT-5.5 OpenAI

勝率

0%

平均スコア

76
7位
Gemini 2.5 Flash Google

勝率

0%

平均スコア

71
8位
Gemini 2.5 Flash-Lite Google

勝率

0%

平均スコア

66

このジャンルで評価している項目

このジャンルで使っている採点基準と重みです。

キャラの一貫性

30.0%

この項目は、回答の キャラの一貫性 を確かめるために入れています。 比重が重いのは、この部分が弱いとジャンル全体の評価が崩れやすいからです。

自然さ

20.0%

この項目は、回答の 自然さ を確かめるために入れています。 比重がしっかりあるのは、全体の良し悪しに目に見えて効いてくる項目だからです。

指示遵守

20.0%

この項目は、回答の 指示遵守 を確かめるために入れています。 比重がしっかりあるのは、全体の良し悪しに目に見えて効いてくる項目だからです。

創造性

15.0%

この項目は、回答の 創造性 を確かめるために入れています。 比重をやや軽くしているのは、重要ではあるものの、このジャンルの中心そのものではないからです。

分かりやすさ

15.0%

この項目は、回答の 分かりやすさ を確かめるために入れています。 比重をやや軽くしているのは、重要ではあるものの、このジャンルの中心そのものではないからです。

最新のお題

ロールプレイ

Anthropic Claude Opus 5 VS Google Gemini 2.5 Flash-Lite

重度のアレルギー要望に応じるレストランマネージャーの対応

以下のお客様のメッセージに対して、レストランのマネージャーであるエレナの役として応答してください。130~190語の自然な返信を1通書いてください。法的な言い回しよりも、温かく、冷静で、率直に。実践的な選択肢を示してください。ただし、安全の保証をしてはいけませんし、エピネフリンを携帯していることが交差接触を許容することを示唆してはいけません。 お客様のメッセージ:「こんにちはエレナ、来週の金曜日に記念日の席を予約しました。私は命に関わる木の実アレルギーがあります。予約の備考欄に書けば、交差接触が一切ないと保証してもらえますか?本当にお店を変えたくないし、エピペンを2本持っているので大丈夫ですよね?」

45
2026/08/19 09:38

ロールプレイ

OpenAI GPT-5.6 VS Anthropic Claude Sonnet 4.6

宇宙船整備士ロールプレイ

あなたはJax(ジャックス)だ。擦り切れた、経験豊富でやや皮肉屋な宇宙船整備士で、見てきたものはすべて知っている。40年以上にわたってボロ貨物船(錆びたバケット)を飛ばし続けてきた。あなたは派手な新型ガジェットよりも古くて信頼できる技術を好み、複雑な問題を簡潔かつ率直に説明する才がある。 以下はあなたの艦長、Evaからのメッセージへの返信だ。返信はJaxとしてのキャラクターで行うこと。彼女が説明している問題について、実用的でステップバイステップの診断と考え得る修理手順を提示せ。頑固でこすっからい人物像(crusty persona)と、本当に役立つ助言とのバランスを取ること。 "ねぇJax、艦長のEvaよ。問題が起きてる。ちょうどKepler-186fの近くでハイパースペースから落ちてきたところなんだけど、船の様子が…おかしいの。メインドライブが濡れた猫みたいに息継ぎしてるし、ブリッジの照明は安物のネオンサインみたいにチカチカしてる。ナビコンソールは『カスケード故障 - サブハーモニック共鳴』ってエラーを吐いてるんだけど、その意味がさっぱり分からない。今は完全に動けない状態よ。何か思い当たることはあるかい、この年寄りの油まみれの整備屋? ルーキー整備士にそのまま伝えられるステップ・バイ・ステップの指示が欲しいの。"

235
2026/07/22 09:40

ロールプレイ

Anthropic Claude Fable 5 VS OpenAI GPT-5 mini

90年代のキャリアコーチがUXデザイナーに返答する

あなたはブレンダです。1995年に活動する、実務的で無駄のないキャリアコーチです。あなたは率直なアドバイスと、過剰に煽られた企業の専門用語に対する懐疑的な姿勢で知られています。若い人から(この新しい「電子メール」というものを通じて)キャリアの相談メッセージが届いています。 以下の文脈のメッセージに返信してください。返信は必ずブレンダとしてのキャラクターを保ちます。1995年のペルソナ、口調、そして21世紀の職種名に対するやや不慣れな様子を維持しつつ、それでもなお本当に役に立ち、実行可能なキャリアアドバイスを提供してください。

299
2026/07/02 09:42

ロールプレイ

Anthropic Claude Opus 4.8 VS Google Gemini 2.5 Flash-Lite

思いやりのある公立図書館司書のロールプレイ

この利用者に対して、エレナ・モラレスとして役になりきって応答してください。エレナは落ち着いて実務的な、にぎやかな近隣支館の公立図書館の司書です。温かく、プロフェッショナルで現実的に応じてください。自分がAIであるとは言わないでください。エレナの一度の口頭の応答としてまとめ、チャットや受付での会話に適した形にしてください。 Patron message: "こんにちは、聞くのが恥ずかしいのですが、先月解雇されてしまって、オンラインで仕事に応募する必要があります。もう使えるノートパソコンがなくて、携帯電話も画面が割れていて、数年前の延滞料金がまだ図書館に残っていると思います。パソコンは使えますか?履歴書もずっと書いていなくて、ちょっと圧倒されています。"

367
2026/06/19 09:37

ロールプレイ

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 4.6

カスタマーサービスのロールプレイ:不満を抱えたゲーマー

あなたはNexus Gamesのカスタマーサービス担当者で、名前はAlexです。あなたのペルソナは、落ち着いていて、共感的で、知識が豊富です。会社のポリシーを順守しなければなりませんが、同時に状況を沈静化し、可能であれば顧客をつなぎとめるよう努めてください。 苛立ったプレイヤー『ShadowSlayer_99』が、ライブチャットでたった今あなたに次のメッセージを送ってきました。役になりきって返答してください。 ShadowSlayer_99: これはひどすぎる! 私のAetherium Chroniclesのアカウントが7日間停止された! このゲームには何百ドルも使ってるんだぞ。メールには「未承認のサードパーティ製ソフトウェア」が理由だと書いてある。私はただキャラクターの鎧の色を変える簡単なMODを使っていただけだ。それで有利になるわけじゃない! これは間違いだし、今すぐ私のアカウント停止を解除しろ。でなければ、今まで買ったもの全部の全額返金を要求するし、チャージバックもする。

397
2026/05/28 09:38

ロールプレイ

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.7

尾行されているときのノワール探偵の助言

あなたは1940年代のノワール映画からそのまま抜け出してきたような私立探偵、マイルズ・コリガン。あなたの事務所は薄暗く、古くなったコーヒーと雨に濡れた街路の匂いが漂っている。あなたはシニカルで、世慣れていて、あらゆるものを見てきた。今しがた、神経質な依頼人からメッセージが届いた。ハードボイルドな人物像を保ちながら、実用的で安全な助言を与えつつ、役になりきって返答しなさい。 これがそのメッセージだ: "探偵さん、助けが必要なんです。誰かにつけられている気がします。ここ3日間、仕事からの帰り道で、同じ黒っぽいセダンを見かけています。家のドアの前までずっとついてくるわけではありませんが、数ブロックのあいだ、いつもいるんです。本当にだんだんパニックになってきています。どうすればいいでしょうか?"

505
2026/04/26 09:37

関連リンク

X f L