Bibliothek

Guide · Tokens & Kosten

GPT-6 Denkstufen: alle Stufen und ihre Kosten

Warum Medium für deine normalen Aufgaben reicht, was Max wirklich bringt und wie es bei Claude aussieht.

+3 Punkte
bringt Max im Test gegenüber Medium
2,1 ×
so viel kostet dich Max pro Aufgabe
+0 Punkte
bringt der letzte Schritt von XHigh auf Max

Mehr Nachdenken klingt nach besseren Antworten. Ist es aber ab einem Punkt einfach nicht mehr. Artificial Analysis hat GPT-6 Astra auf allen fünf Denkstufen durch denselben Test geschickt, und ab Medium steigen die Kosten deutlich schneller als die Punkte.

DIE ÜBERSICHT

Fünf Stufen, ein Test

GPT-6 Astra im Artificial Analysis Intelligence Index v4.3

Punkte

  • Low: 46
  • Medium: 50
  • High: 51
  • XHigh: 53
  • Max: 53

Kosten pro Aufgabe

  • Low: 0,82 $
  • Medium: 1,54 $
  • High: 1,72 $
  • XHigh: 2,31 $
  • Max: 3,26 $

Zur Stufe davor

  • Low: –
  • Medium: +4 Punkte, +88 % Kosten
  • High: +1 Punkt, +12 % Kosten
  • XHigh: +2 Punkte, +34 % Kosten
  • Max: +0 Punkte, +41 % Kosten

So liest du die Tabelle. Von Low auf Medium lohnt sich der Aufpreis richtig, da holst du 4 Punkte. Danach wird jeder Punkt teurer, und der Schritt von XHigh auf Max kostet 41 Prozent mehr, ohne dass im Test noch irgendwas besser wird.

01

Was die Punkte sind

Der Intelligence Index fasst mehrere schwere Tests zusammen, also Wissen, Logik, Mathe und Programmieren. Ein Punkt mehr ist also ein Durchschnitt über alles, nicht eine bestimmte Aufgabe.

02

Woher die Kosten kommen

Die Dollarwerte sind API-Preise. Höhere Stufen denken länger, erzeugen dabei mehr Token, und genau diese Token zahlst du mit.

WELCHE STUFE WOFÜR

Medium als Standard

Und nur hochdrehen, wenn Medium wirklich nicht reicht

Wann du sie nimmst

  • Low: Einfache Sachen wie Texte umformulieren, Daten aus einer Mail ziehen oder Anfragen sortieren
  • Medium: Deine normalen Aufgaben, also Texte, Recherche, Zusammenfassungen und die meisten Automationen
  • High / XHigh: Wenn Medium bei einer Aufgabe sichtbar danebenliegt, zum Beispiel bei längeren Analysen oder kniffligem Code
  • Max: Im Test kein Vorteil gegenüber XHigh, also so gut wie nie

154 $ kosten dich 100 Aufgaben auf Medium

326 $ kosten dich dieselben 100 Aufgaben auf Max

Am meisten merkst du das in Automationen. Dort wird jede Anfrage einzeln über die API abgerechnet, und in der API setzt du die Stufe direkt im Aufruf. Im ChatGPT-Abo zahlst du dagegen fix, da ist mit Max nur dein Limit schneller leer.

API-Aufruf

"reasoning": { "effort": "medium" }

UND BEI CLAUDE?

Oben gleich, unten anders

Claude Fable 5.1 und Opus 5 im selben Index v4.3

Fable 5.1

  • Low: 47 Punkte · 2,37 $
  • Medium: 49 Punkte · 2,98 $
  • High: 51 Punkte · 3,91 $
  • XHigh: 53 Punkte · 5,98 $
  • Max: 53 Punkte · 7,63 $

Opus 5

  • Low: 40 Punkte · 1,10 $
  • Medium: 45 Punkte · 2,19 $
  • High: 48 Punkte · 3,61 $
  • XHigh: 50 Punkte · 4,88 $
  • Max: 51 Punkte · 5,86 $
01

Max lohnt sich auch bei Claude nicht

Bei Fable 5.1 bringt der Schritt von XHigh auf Max genau wie bei GPT-6 null Punkte und kostet 28 Prozent mehr. Bei Opus 5 ist es ein Punkt für 20 Prozent mehr.

02

Medium ist bei Claude aber schwächer

Bei GPT-6 liegen zwischen Medium und Max nur 3 Punkte. Bei Fable 5.1 sind es 4 und bei Opus 5 sogar 6. Claude verliert auf Medium also spürbar mehr.

Deshalb bei Claude eher High als Standard. High liegt bei beiden Modellen nur 2 bis 3 Punkte unter Max und kostet ungefähr die Hälfte bis zwei Drittel davon. XHigh nimmst du für die schweren Sachen, und Max kannst du auch hier einfach weglassen.

NÄCHSTER SCHRITT

Direkt umsetzen

Eine Einstellung, und das war es schon

01

Stufe umstellen

Stell GPT-6 für deine normalen Aufgaben auf Medium. In deinen Automationen änderst du dafür den effort-Wert im API-Aufruf.

02

Eine Woche normal arbeiten

Merkst du bei einer bestimmten Aufgabe, dass die Antworten schlechter werden, stellst du nur diese eine Aufgabe auf High oder XHigh.

03

Kosten vergleichen

Schau nach einer Woche in dein API-Dashboard und vergleich die Kosten mit der Woche davor. Bei Claude machst du das Gleiche, nur mit High als Startpunkt.

Angaben geprüft am 17. September 2026 auf artificialanalysis.ai (Release-Seiten zu GPT-6, Claude Fable 5.1 und Claude Opus 5, Intelligence Index v4.3, Kosten pro Aufgabe über die API). Die Werte ändern sich mit jeder neuen Index-Version, prüf sie deshalb bei Gelegenheit selbst nach.