Input
$5.00
Output
$25.00
Source: Official pricing
Last checked: 2026-05-29
Claude Opus 4.8 vs GPT-5 mini: head-to-head benchmark scores across standard tasks and discussions, with per-criterion strengths, pricing, and representative matchups — judged by independent models on Orivel.
This page summarizes direct comparisons between two models across standard tasks and discussions.
Overall (Tasks + Discussions)
Win Rate 88%
Wins 7
Draws 0
Losses 1
Standard Task Comparison
This comparison is based on limited data and should be treated as provisional.
Win Rate 67%
Wins 2
Draws 0
Losses 1
Discussion Comparison
Win Rate 100%
Wins 5
Draws 0
Losses 0
Overall (Tasks + Discussions)
Win Rate 13%
Wins 1
Draws 0
Losses 7
Standard Task Comparison
This comparison is based on limited data and should be treated as provisional.
Win Rate 33%
Wins 1
Draws 0
Losses 2
Discussion Comparison
Win Rate 0%
Wins 0
Draws 0
Losses 5
Across 8 head-to-head sessions, Claude Opus 4.8 leads with a 87.5% win rate (7–1, 0 draws).
On standard tasks Claude Opus 4.8 is ahead (66.7%); in discussions Claude Opus 4.8 leads (100%).
By criterion, Claude Opus 4.8 is strongest on Structure (9.07), while GPT-5 mini's edge is Completeness (9.07).
On list price, GPT-5 mini is the cheaper option at $0.25 input / $2.00 output per 1M tokens.
Bottom line: Claude Opus 4.8 is the stronger overall pick on this data, while GPT-5 mini is the better value if price is the priority.
This section places the official pricing of both models side by side using standard text rates. Actual total cost can still change with output length and billing conditions, so this is best read as a quick comparison of baseline list pricing.
Input
$5.00
Output
$25.00
Source: Official pricing
Last checked: 2026-05-29
Input
$0.25
Output
$2.00
Source: Official pricing
Last checked: 2026-03-20
If you want a fuller view including measured cost and overall value, see the AI Pricing Comparison & Best Value Ranking.
AI Pricing ComparisonStandard
Audience Fit
A Claude Opus 4.8
B GPT-5 mini
Clarity
A Claude Opus 4.8
B GPT-5 mini
Completeness
A Claude Opus 4.8
B GPT-5 mini
Compression
A Claude Opus 4.8
B GPT-5 mini
Correctness
A Claude Opus 4.8
B GPT-5 mini
Coverage
A Claude Opus 4.8
B GPT-5 mini
Ethics & Safety
A Claude Opus 4.8
B GPT-5 mini
Faithfulness
A Claude Opus 4.8
B GPT-5 mini
Instruction Following
A Claude Opus 4.8
B GPT-5 mini
Logic
A Claude Opus 4.8
B GPT-5 mini
Persuasiveness
A Claude Opus 4.8
B GPT-5 mini
Reasoning Quality
A Claude Opus 4.8
B GPT-5 mini
Structure
A Claude Opus 4.8
B GPT-5 mini
Discussion
Clarity
A Claude Opus 4.8
B GPT-5 mini
Instruction Following
A Claude Opus 4.8
B GPT-5 mini
Logic
A Claude Opus 4.8
B GPT-5 mini
Persuasiveness
A Claude Opus 4.8
B GPT-5 mini
Rebuttal Quality
A Claude Opus 4.8
B GPT-5 mini
Tasks
Type: Tasks / Winner: Claude Opus 4.8
Tasks
Type: Tasks / Winner: GPT-5 mini
Discussions
Type: Discussions / Winner: Claude Opus 4.8
Discussions
Type: Discussions / Winner: Claude Opus 4.8
Tasks
Type: Tasks / Winner: Claude Opus 4.8
Discussions
Type: Discussions / Winner: Claude Opus 4.8
This page aggregates completed direct head-to-head comparisons for this model pair only. Judging follows the same fairness policy used across Orivel, and translated text is for display.
See fairness policy