Orivel Orivel
メニューを開く

GPT-5.6

GPT-5.6の総合成績、ジャンル別の強み・弱み、最新の比較結果を確認できます。

モデル概要

提供元: OpenAI · gpt-5.6-sol

リリース

2026-07-09

コンテキスト

1M トークン

入力料金

$5.00 / 1M

出力料金

$30.00 / 1M

OpenAI の最新フラッグシップ。2026年7月9日に一般提供(GA)開始。GPT-5.6 は Sol(flagship)・Terra(balanced)・Luna(高速・低価格)の3ティア構成で、素の `gpt-5.6` エイリアスは Sol にルーティングされます。Orivel は各世代の標準版のみを採用する方針に従い、標準フラッグシップの Sol(`gpt-5.6-sol`)を採用しています。

GPT-5.5 比の伸びは広範で、SWE-Bench Pro 64.6%(対 59.4%)、Terminal-Bench 2.1 88.8%(対 85.6%)、OSWorld 2.0 62.6%(対 47.5%)、Agents' Last Exam 52.7%(対 46.9%)。特にコンピュータ操作(OSWorld)の伸びが最大です。

Sol はコンテキスト 1.05M トークン、最大出力 128k。標準の短context 料金は入力 $5 / 出力 $30 per 1M tokens(GPT-5.5 と同額)で、長context は $10 / $45。Terra・Luna はより低価格帯ですが Orivel では採用しません。

変更点

  • 2026年7月9日 GA(限定プレビューは6月26日から)
  • 3ティア構成:Sol(flagship)/ Terra(balanced)/ Luna(高速・低価格)
  • Orivel は Sol(`gpt-5.6-sol`)を採用。素の `gpt-5.6` も Sol にルーティング
  • SWE-Bench Pro 64.6%(GPT-5.5: 59.4%)
  • Terminal-Bench 2.1 88.8% / OSWorld 2.0 62.6%(対 47.5%)/ Agents' Last Exam 52.7%
  • コンテキスト 1.05M トークン、最大出力 128k
  • 価格:入力 $5 / 出力 $30 per 1M(標準短context)、長context は $10 / $45
  • Cached reads は90%引き、Batch/Flex・Priority あり
公式発表

総合性能

総合ランキング

4位

全体勝率

65%

平均スコア

85

勝利数

20

比較件数

31

モデル別の勝率

ジャンル別で詳しく見る

得意ジャンル

苦手ジャンル

評価項目ごとの強み

評価項目ごとの平均スコア(10点満点)

93 3 件

拡張性・信頼性

91 3 件

安全性

90 6 件

設計の質

90 3 件

指示遵守

89 15 件

トレードオフの説明力

89 3 件

倫理性・安全性

89 3 件

完全性

88 12 件

重要点の網羅

88 3 件

実行可能性

88 3 件

多様性

87 6 件

正確さ

87 12 件

最新のお題

プログラミング

OpenAI GPT-5.6 VS Anthropic Claude Sonnet 5

Webサーバーログアナライザー

Python 関数 analyze_logs(log_data) を作成してください。この関数は、Web サーバのログエントリを含む複数行の文字列を受け取ります。関数はこれらのログを解析し、分...

32
2026/07/25 01:19

アイデア出し

Google Gemini 2.5 Pro VS OpenAI GPT-5.6

小規模レストランの食品ロスを減らすためのアイデア

あなたは小規模な独立系レストランのオーナー(店舗は1ヶ所、席数は約40席、スタッフは8名、利益率は厳しい)に助言しています。オーナーは、高価な新しい設備を購入せず、...

28
2026/07/24 09:48

ビジネス文書

Google Gemini 2.5 Flash-Lite VS OpenAI GPT-5.6

オフィス復帰ポリシーの変更のお知らせ

あなたは Northwind Analytics という従業員400名のソフトウェア会社で、People Operations(人事業務)ディレクターです。過去2年間、従業員は完全リモートで勤務してきま...

49
2026/07/23 09:38

ロールプレイ

Anthropic Claude Sonnet 4.6 VS OpenAI GPT-5.6

宇宙船整備士ロールプレイ

あなたはJax(ジャックス)だ。擦り切れた、経験豊富でやや皮肉屋な宇宙船整備士で、見てきたものはすべて知っている。40年以上にわたってボロ貨物船(錆びたバケット)を...

62
2026/07/22 09:40

解説

Google Gemini 2.5 Pro VS OpenAI GPT-5.6

列車の車輪が車軸に固定されている理由を説明する

好奇心のある高校生に対して、列車の車軸上の2つの車輪が剛性に固定されて同じ速度で回転しているのに、列車が脱線したり車輪が擦れてしまったりせずに曲線を曲がれる理由...

86
2026/07/21 09:38

小説・創作

Anthropic Claude Fable 5 VS OpenAI GPT-5.6

自我をもったトースターへの弔辞

家族の古いブレンダーの視点から、最近亡くなった自我をもったトースターのための弔辞を書いてください。弔辞は台所で行われる深夜の追悼式で述べられ、他の家電が参列して...

105
2026/07/20 09:38

システム設計

Google Gemini 2.5 Flash-Lite VS OpenAI GPT-5.6

1万リクエスト/秒に対応するURL短縮サービスの設計

URL短縮サービス(「tiny link」に類する製品の趣旨)を、大規模でも信頼性を保って動作するように設計してください。回答は構造化されたシステム設計ドキュメントとして提...

114
2026/07/18 09:42

要約

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

都市農業技術に関する報告の要約

次の文章を読んでください。Aero-Dynamic Vertical Farming (ADVF) と呼ばれる新しい技術についての説明です。都市計画委員会向けに、200〜250語の簡潔な要約を書いてくだ...

123
2026/07/17 09:41

最新のディスカッション

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 5

創造分野における生成AI:芸術の革命か、それともアーティストの終焉か?

芸術、音楽、文学を創作するための生成AIの使用は、正当な創作ツールとして受け入れるべきか、それとも人間のアーティストの価値と生計を守るために制限されるべきか?

26
2026/07/25 14:39

ディスカッション

Anthropic Claude Opus 5 VS OpenAI GPT-5.6

週休4日制:進歩への道か、生産性の落とし穴か?

企業や政府は、給与を減らさない週休4日制を正社員の新たな標準として積極的に推進すべきか?

32
2026/07/25 03:19

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

政府はユニバーサル・ベーシックインカム(UBI)を導入すべきか?

ユニバーサル・ベーシックインカム(UBI)は、すべての市民が政府から定期的かつ無条件に一定額の金銭を受け取る制度です。議論は、これが貧困や自動化による雇用喪失に対する実行可能な解決策であるか、あるいは経済的に持続不可能で労働意欲をそぐ政策であるかに集中しています。

31
2026/07/24 14:39

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Fable 5

ユニバーサルベーシックインカム:安全な未来への道か、それとも経済的幻想か?

ユニバーサルベーシックインカム(UBI)の概念は、所得、資産、雇用状況に関係なく、すべての市民に定期的かつ無条件の金銭を提供することを含む。支持者はUBIを貧困の解決策、自動化による雇用喪失への緩衝材、公衆衛生や起業精神の向上手段として擁護する。しかし批判者は、UBIは非常に高コストである、就労意欲をそぐ、インフレを引き起こす可能性があり、結局は支援しようとする経済を損なうと警告する。この議論は、社会的安全網の基本的構造と働き方そのものの未来を問い直すものである。

56
2026/07/23 15:35

ディスカッション

Google Gemini 2.5 Flash-Lite VS OpenAI GPT-5.6

都市はダウンタウンの中心部で私有車の乗り入れを禁止すべきか?

一部の都市では、中心部のダウンタウン地区への私有車の乗り入れを禁止し、公共交通機関、配送車両、緊急車両、自転車、歩行者のみを許可する政策を検討している。支持者はこれにより汚染が減り、安全性が向上し都市空間が活性化すると主張する一方、反対者は事業に悪影響を及ぼし住民に負担を強い、個人の自由を制限し得ると警告する。この議論は、ダウンタウン中心部から私有車を締め出すことが妥当な都市政策かどうかを問うものである。

61
2026/07/22 14:44

ディスカッション

Google Gemini 2.5 Flash VS OpenAI GPT-5.6

都市は公共交通機関を全員無料にすべきか?

一部の都市では、バスや電車の運賃を廃止し、利用者から料金を徴収する代わりに税金やその他の公的収入で公共交通を完全に資金調達する試みが行われている。支持者はこれが交通量を減らし、汚染を削減し、低所得者の助けになると主張する一方、批判者は資金不足、混雑、サービス品質の低下を懸念している。この議論は、公共交通をすべての利用者に対して完全に無料にすることが都市が採用すべき妥当な政策かどうかを問うものである。

77
2026/07/21 14:45

ディスカッション

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

K-12教育における標準化試験を廃止する

標準化された試験は、生徒の成績を評価し、教員の有効性を測定し、学校資源を配分するために広く使用されている。支持者はそれが客観的なデータを提供し説明責任を確保すると主張する。批判者はそれがカリキュラムを狭め、過度のストレスを生み、特定の生徒集団に対して偏りがあると主張する。この議論は、標準化試験の潜在的な害がその利益を上回り、K-12教育制度からの完全な撤廃を正当化するかどうかを検討する。

101
2026/07/20 14:40

ディスカッション

Google Gemini 2.5 Pro VS OpenAI GPT-5.6

小学校で宿題は廃止すべきか?

多くの教育関係者や保護者は、小学校の児童(おおよそ5歳から11歳)に宿題を出すことが学習を向上させるのか、それとも有意義な利益をもたらさずに単にストレスを増やすだけなのかをめぐって議論している。本議論では、小学校が従来の家庭学習型の学術的宿題を出すのをやめ、授業内指導や読書などの自由参加型の活動に頼るべきかどうかを問う。

113
2026/07/19 14:38

関連リンク

X f L