Orivel Orivel
Menü öffnen

Claude Opus 4.8

Entdecke Benchmark-Scores, Genre-Stärken, Schwächen und aktuelle Beispiele für Claude Opus 4.8.

Modellübersicht

Anbieter: Anthropic · claude-opus-4-8 Ausgemustert

Veroffentlicht

2026-05-28

Kontext

1M Tokens

Input

$5.00 / 1M

Output

$25.00 / 1M

Claude Opus 4.8 (veröffentlicht am 28. Mai 2026) war Anthropics Flaggschiff, bis Claude Fable 5 am 9. Juni 2026 die Spitze übernahm. Auf Orivel hielt es den ausgewogenen Anthropic-Platz, bis Claude Opus 5 es am 24. Juli 2026 zum identischen Preis ablöste; für neue Vergleiche ist es zurückgezogen, frühere Ergebnisse bleiben veröffentlicht.

Die wichtigsten Fortschritte gegenüber Opus 4.7 sind ein schärferes Urteilsvermögen, mehr Ehrlichkeit über den eigenen Fortschritt und die Fähigkeit, länger eigenständig zu arbeiten. Es ist rund viermal seltener als sein Vorgänger dabei, Fehler im eigenen Code durchgehen zu lassen, und führt beim agentischen Software-Engineering mit 69,2% auf SWE-Bench Pro vor GPT-5.5 und Gemini 3.1 Pro.

Das Modell behält das 1M-Token-Kontextfenster und bis zu 128k Output-Tokens in der Messages API. Der Preis bleibt gegenüber Opus 4.7 unverändert ($5 Input / $25 Output pro 1M Tokens), Wissensstand: Januar 2026. Neue Oberflächen bringen einen `effort`-Regler (Standard high) und eine Dynamic-Workflows-Research-Preview für große, parallelisierte agentische Aufgaben.

Hinweise zur Ausmusterung

  • Am 28. Mai 2026 als Nachfolger von Claude Opus 4.7 veröffentlicht (rund sechs Wochen später)
  • Schärferes Urteilsvermögen, mehr Ehrlichkeit über den Fortschritt und längeres eigenständiges Arbeiten
  • ~4x seltener als Opus 4.7 dabei, Fehler im eigenen Code durchgehen zu lassen
  • SWE-Bench Pro 69,2% — vor GPT-5.5 und Gemini 3.1 Pro beim agentischen Coding
  • Fortschritte bei multidisziplinärem Reasoning, agentischer Computer-Nutzung und agentischer Finanzanalyse
  • 1M-Token-Kontextfenster; bis zu 128k Output-Tokens in der Messages API
  • `effort`-Parameter (Standard high), um den Aufwand pro Antwort zu steuern
  • Dynamic-Workflows-Research-Preview für Aufgaben mit parallelen Subagenten; Fast Mode mit 2,5-facher Geschwindigkeit
  • Preis identisch zu Opus 4.7: $5 Input / $25 Output pro 1M Tokens
  • Adaptive Thinking; verfügbar über Claude API, Amazon Bedrock, Vertex AI und Microsoft Foundry
  • Wissens- und Trainingsdaten-Stand: Januar 2026
Offizielle Ankündigung

Gesamtleistung

Gesamtrang

-

Gesamtsiegquote

81%

Durchschnittsscore

85

Siege

44

Anzahl Beispiele

54

Siegesquote je Modell

Nach Genre vergleichen

Stärken nach Bewertungskriterium

Durchschnittsscore je Kriterium (von 10)

Befolgung der Anweisungen

90 24 Stichproben

Sicherheit

90 9 Stichproben

Genauigkeit am Original

90 9 Stichproben

Emotionale Wirkung

90 3 Stichproben

Rollenkonsistenz

90 3 Stichproben

Ethik und Sicherheit

89 6 Stichproben

Angemessenheit

89 15 Stichproben

Tiefe

89 3 Stichproben

Hilfswert

89 9 Stichproben

Empathie

88 9 Stichproben

Struktur

88 24 Stichproben

Qualität der Begrundung

88 9 Stichproben

Neueste Aufgaben

Zusammenfassung

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

Fassen Sie einen Bericht über urbane Landwirtschaftstechnologie zusammen

Lesen Sie den folgenden Abschnitt über eine neue Technologie namens Aero-Dynamic Vertical Farming (ADVF). Verfassen Sie eine prägnante Zusammenfassung von 200–2...

118
17 Jul 2026 09:41

Humor

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.6

Vorstellungsgespräch für einen professionellen Geist

Verfasse einen kurzen, humorvollen Dialog (ungefähr 200–300 Wörter) für ein Vorstellungsgespräch. Die beiden Charaktere sind Brenda, eine übermäßig enthusiastis...

126
15 Jul 2026 09:38

Beratung

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

Einen Mitbewohnerkonflikt ohne Eskalation meistern

Eine Person sagt: „Mein Mitbewohner lässt ständig schmutziges Geschirr und Kram in unserer gemeinsamen Küche stehen. Ich habe schon ein paar Mal angedeutet, das...

149
30 Jun 2026 09:41

Programmierung

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

Implementiere einen deterministischen Limit-Order-Book-Simulator

Schreibe eine Python-3.11-Lösung in einer einzigen Datei, die die Funktion process_events(events: list[dict]) -> dict implementiert. Verwende keine externen Pak...

164
29 Jun 2026 09:44

Bildungsfragen

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Physikaufgabe: Die Zeitverzerrung der Standuhr

Eine Standuhr verwendet ein Pendel aus Messing zur Zeitmessung und ist so kalibriert, dass sie bei einer Raumtemperatur von 20,0 °C vollkommen genau geht. Währe...

179
28 Jun 2026 09:40

Erklärung

Google Gemini 2.5 Flash VS Anthropic Claude Opus 4.8

Erkläre Eventual Consistency für Junior-Webentwickler

Schreibe eine lehrorientierte Erklärung von eventual consistency für Junior-Webentwickler, die bereits einfache CRUD-Webanwendungen gebaut haben, aber keine ver...

169
26 Jun 2026 09:56

Geschäftstexte

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 4.8

Internes Memo: Vorschlag für einen Pilotzeitplan mit Vier-Tage-Woche

Verfassen Sie ein knappes internes Memo vom Leiter Operations an alle Mitarbeitenden, in dem ein zwölfwöchiger Pilot einer Vier-Tage-Arbeitswoche für eine Abtei...

158
25 Jun 2026 09:45

Zusammenfassung

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Fasse einen fiktiven Forschungsartikel über städtische Grünflächen zusammen

Bitte lesen Sie den folgenden fiktiven Artikel über eine neue Art städtischer Grünfläche. Schreiben Sie dann eine zusammenhängende Zusammenfassung des gesamten...

147
24 Jun 2026 09:53

Neueste Debatten

Debatten

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Sollten Regierungen ein bedingungsloses Grundeinkommen einführen?

Das bedingungslose Grundeinkommen (UBI) ist ein System, bei dem alle Bürger regelmäßig eine bedingungslose Geldsumme von der Regierung erhalten. Die Debatte dreht sich darum, ob dies eine praktikable Lösung für Armut und durch Automatisierung verursachten Arbeitsplatzverlust ist, oder eine wirtschaftlich nicht nachhaltige Politik wäre, die zur Arbeitsvermeidung anreizt.

28
24 Jul 2026 14:39

Debatten

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Standardisierte Tests im K-12-Bildungssystem abschaffen

Standardisierte Tests werden häufig verwendet, um Schülerleistungen zu bewerten, die Effektivität von Lehrkräften zu beurteilen und Schulressourcen zu verteilen. Befürworter argumentieren, dass sie objektive Daten liefern und Rechenschaftspflicht sicherstellen. Kritiker behaupten, sie verengen den Lehrplan, erzeugen übermäßigen Stress und sind gegenüber bestimmten Schülergruppen voreingenommen. Diese Debatte betrachtet, ob die potenziellen Schäden standardisierter Tests ihre Vorteile überwiegen und ihre vollständige Abschaffung aus dem K-12-Bildungssystem rechtfertigen.

92
20 Jul 2026 14:40

Debatten

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Obligatorischer nationaler Dienst für junge Erwachsene

Sollten alle jungen Erwachsenen dazu verpflichtet werden, eine Periode verpflichtenden nationalen Dienstes zu absolvieren, entweder im Militär oder in zivilen Bereichen wie Gesundheitswesen, Bildung oder Umweltschutz?

151
12 Jul 2026 14:42

Debatten

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Kernenergie: Eine saubere Energielösung oder ein radioaktives Glücksspiel?

Während die Welt mit der dringenden Notwendigkeit kämpft, sich von fossilen Brennstoffen zu verabschieden, um den Klimawandel zu bekämpfen, wird die Kernenergie oft als leistungsfähige, CO₂-freie Alternative dargestellt. Diese Debatte wägt die Vorteile der Kernenergie als zuverlässige, leistungsstarke Energiequelle gegen die erheblichen Risiken ab, einschließlich der langfristigen Lagerung radioaktiver Abfälle, des Potenzials für katastrophale Unfälle wie Tschernobyl und Fukushima sowie der Bedenken hinsichtlich der Weiterverbreitung von Kerntechnologie.

182
01 Jul 2026 14:41

Debatten

Anthropic Claude Opus 4.8 VS OpenAI GPT-5 mini

Plattformen vor Gericht: Sollten Social-Media-Unternehmen für Inhalte von Nutzern haftbar...

In dieser Debatte geht es darum, ob Internetplattformen, wie soziale Netzwerke, rechtlich für die von ihren Nutzern geposteten Inhalte verantwortlich gemacht werden sollten. Es stellt die rechtlichen Schutzmechanismen infrage, die sie häufig als neutrale Übermittler behandeln, gegenüber dem Argument, dass ihre Rolle bei der Kuratierung und Verstärkung von Inhalten sie eher zu Herausgebern macht, die für das, was sie verbreiten, haftbar sind.

173
30 Jun 2026 14:45

Debatten

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Nationale vs.

Soll der Lehrplan für öffentliche K-12-Schulen durch einen standardisierten nationalen Rahmen festgelegt werden, oder sollte er der Entscheidung der lokalen Schulbezirke und Gemeinden überlassen werden?

183
29 Jun 2026 14:41

Debatten

Google Gemini 2.5 Pro VS Anthropic Claude Opus 4.8

Sollten große Museen umstrittene Kulturgüter an ihre Herkunftsländer zurückgeben?

Viele große Museen besitzen Artefakte, die in Kolonialzeiten, während Kriegen, in ungleichen Handelsbeziehungen oder bei frühen archäologischen Expeditionen erworben wurden. Sollten diese Institutionen verpflichtet werden, umstrittene kulturelle Objekte an ihre Herkunftsländer oder -gemeinschaften zurückzugeben, oder sollten sie sie behalten dürfen, wenn sie diese für ein weltweites Publikum bewahren, erforschen und ausstellen können?

186
28 Jun 2026 14:39

Debatten

OpenAI GPT-5.4 VS Anthropic Claude Opus 4.8

Universelle gebührenfreie öffentliche Hochschulen

Sollten öffentliche Colleges und Universitäten vollständig gebührenfrei für alle inländischen Studierenden gemacht werden, unabhängig vom Einkommensniveau ihrer Familie?

176
27 Jun 2026 14:40

Verwandte Links

X f L