Claude Opus 5 Preise 2026: API-Kosten, Tarife, echte Rechnungen

Rama Adi Nugraha
Geschrieben von

Rama Adi Nugraha

Katelin Teen
Geprüft von

Katelin Teen

Zuletzt bearbeitet July 27, 2026

Expertengeprüft
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens

Claude Opus 5 Preise auf einen Blick

Claude Opus 5 wurde am 24. Juli 2026 gelauncht, von Anthropic beschrieben als ein Modell, das "der Frontier-Intelligenz von Claude Fable 5 zum halben Preis nahekommt". Der API-Satz ist derselbe, den die Opus-Linie seit Opus 4.5 trägt.

Wofür du zahlstClaude-Opus-5-Satz
Input-Tokens$5 pro Million
Output-Tokens (inkl. Thinking)$25 pro Million
5-Minuten-Cache-Write$6,25 pro Million
1-Stunden-Cache-Write$10 pro Million
Cache-Read$0,50 pro Million
Batch-API Input / Output$2,50 / $12,50 pro Million
Fast-Modus Input / Output$10 / $50 pro Million
US-only-Inferenz (inference_geo)1,1x auf jede Tokenkategorie

Alle obigen Zahlen stammen aus Anthropics Preisdokumentation. Ein paar Spezifikationen, die die Rechnung mehr prägen als der Satz selbst:

  • Die Modell-ID lautet claude-opus-5 in der Claude API, anthropic.claude-opus-5 auf Bedrock.
  • Der Kontext umfasst 1M Tokens Input, 128k Tokens Output, steigt auf 300k Output in der Batch API mit einem Beta-Header.
  • Der verlässliche Wissensstichtag ist Mai 2026.
  • Opus 5 hat einen eigenen Rate-Limit-Pool. Opus 4.8, 4.7, 4.6 und 4.5 teilen sich einen gemeinsamen Pool, und Opus 5 zapft ihn nicht an, sodass eine Verlagerung des Traffics keinen Spielraum freimacht.

Wenn du das gegen die Vorgängergeneration abwägst, tragen unser Opus-4.5-Preisleitfaden und die Opus-4.6-Aufschlüsselung denselben Satz, was den Versions-zu-Versions-Vergleich ungewöhnlich sauber macht.

Wofür du wirklich abgerechnet wirst

Hier liegt der Punkt, der Umsteiger von Opus 4.8 überrascht. Bei 4.8 lief eine Anfrage ohne das thinking-Feld ohne Thinking. Bei Opus 5 durchläuft dieselbe Anfrage Adaptive Thinking, und jedes Thinking-Token wird als Output zu $25 pro Million abgerechnet.

Annotated receipt showing the four things billed in a single Claude Opus 5 API call: prompt input, thinking tokens, visible answer, and returned tool results
Annotated receipt showing the four things billed in a single Claude Opus 5 API call: prompt input, thinking tokens, visible answer, and returned tool results

Zwei Folgeeffekte, die man einplanen sollte:

  1. max_tokens deckt jetzt Thinking und Antwort zusammen ab. Ein Limit, das bei 4.8 knapp auf die sichtbare Antwort zugeschnitten war, kann bei Opus 5 mitten in der Antwort abbrechen. Anthropics Migrationsleitfaden empfiehlt mindestens 64k als Ausgangspunkt bei Effort xhigh oder max.
  2. Opus 5 schreibt standardmäßig länger. Der Migrationsleitfaden sagt unverblümt, dass sowohl sichtbare Antworten als auch geschriebene Deliverables länger ausfallen als bei 4.8, und dass niedrigerer Effort das Thinking-Volumen senkt, ohne die sichtbare Antwort zuverlässig zu verkürzen. Länge muss im Prompt gefordert werden, nicht per Regler eingestellt.

Es gibt eine dritte Abrechnungsposition, die in agentischen Loops gerne vergessen wird: Jedes Tool-Ergebnis, das du zurückgibst, geht im nächsten Turn wieder als Input ein. Ein 30-Schritte-Agentenlauf zahlt immer wieder für dasselbe wachsende Transkript, weshalb Caching hier wichtiger ist als im Chat. Wenn dein Loop Kontext über MCP-Tools oder Claude Skills zieht, landet jedes dieser Ergebnisse auf der Input-Seite derselben Rechnung.

Ein Modell, vier Preise

Dieselben Gewichte und dieselbe Modell-ID können vier verschiedene Sätze abrechnen, rein abhängig davon, wie du sie aufrufst.

Price ladder showing four Claude Opus 5 input rates: cache read at fifty cents, batch at $2.50, standard at $5, and fast mode at $10 per million tokens
Price ladder showing four Claude Opus 5 input rates: cache read at fifty cents, batch at $2.50, standard at $5, and fast mode at $10 per million tokens

Prompt-Caching ist der größte Hebel für alles mit einem stabilen Präfix. Writes kosten das 1,25-Fache des Basis-Inputs im 5-Minuten-Cache und das 2-Fache im 1-Stunden-Cache, Reads kosten das 0,1-Fache. Das stille Upgrade bei Opus 5 liegt bei der Untergrenze: Das minimal cachefähige Präfix sinkt auf 512 Tokens, von 1.024 bei 4.8 und 4.096 bei Opus 4.6. System-Prompts, die vorher still nicht cachefähig waren, werden nun ohne Codeänderung gecacht.

Batch nimmt 50 % von beiden Richtungen und lässt sich mit Caching stapeln. Wenn dein Workload eine Warteschlange verträgt, ist das geschenktes Geld.

Der Fast-Modus geht die andere Richtung. Laut Fast-Mode-Dokumentation liefert er bis zu 2,5-fach höhere Output-Tokens pro Sekunde für exakt das Doppelte des Preises, und der Trade lässt sich präzise benennen: Bei $10 und $50 kostet Opus 5 im Fast-Modus pro Token genauso viel wie das reguläre Claude Fable 5. Es ist ebenfalls nur als Research-Preview in der First-Party-API verfügbar und funktioniert nicht mit Batch.

US-only-Inferenz addiert pauschal das 1,1-Fache auf jede Tokenkategorie, was $5,50 und $27,50 ergibt.

Effort ist der eigentliche Preisregler

Das ist der Abschnitt, den ich zweimal lesen würde, wenn ich ein Budget dimensioniere. Opus 5 unterstützt fünf Effort-Stufen, und die Empfehlung hat sich umgekehrt gegenüber der 4.x-Ära: Wo 4.7 und 4.8 rieten, bei agentischer Arbeit mit xhigh zu starten, sagt Opus 5, man solle beim Standard high beginnen und von dort nach unten gehen.

Dial diagram showing the five Claude Opus 5 effort levels from low to max, with high flagged as the recommended starting point
Dial diagram showing the five Claude Opus 5 effort levels from low to max, with high flagged as the recommended starting point

Die Zahlen hinter diesem Rat stammen aus Anthropics eigenem Frontier-Bench v0.1-Lauf, einem 74-Aufgaben-Terminal-Benchmark, der auf Terminal-Bench 2.1 folgte:

EffortFrontier-Bench-ScoreToken-Hinweis
low25 %64 % weniger Output-Tokens
high39 %19 % weniger Output-Tokens
xhigh44,4 %bestes Ergebnis
max~43 %mehr Ausgaben, leicht schlechter

Zwei Dinge fallen auf. Max Effort schnitt schlechter ab als xhigh und kostete dabei mehr, und Low Effort lieferte weit über die Hälfte des Scores für rund ein Drittel der Output-Tokens. Anthropic erklärt den Einbruch bei Max Effort in FrontierCode 1.1 damit, dass das Modell "mehr Änderungen macht, als die Aufgabe erfordert", was der Bewerter bestraft.

Chart plotting Frontier-Bench v0.1 score against cost per attempt for Opus 5, Fable 5, Opus 4.8 and GPT-5.6 Sol, as published by Anthropic
Chart plotting Frontier-Bench v0.1 score against cost per attempt for Opus 5, Fable 5, Opus 4.8 and GPT-5.6 Sol, as published by Anthropic

Lies dieses Diagramm als Preisdiagramm, nicht als Rangliste. Das gesamte Kostenargument von Opus 5 lautet, dass seine Kurve oberhalb und links von der von Fable 5 verläuft: Es erreicht einen höheren Score zu geringeren Kosten pro Versuch. Das ist eine nützlichere Aussage als jede einzelne Benchmark-Zahl, und es ist dieselbe Form, die Anthropic beim CursorBench berichtet, wo Opus 5 "innerhalb von 0,5 % des Spitzenscores von Fable 5 liegt, aber zum halben Preis pro Aufgabe".

Rechne deine eigene monatliche Rechnung durch

Listenpreise werden erst real, wenn du dein eigenes Volumen dagegenhältst. Gib einen Monat an Nutzung ein und sieh, was die Hebel bewirken.

Ein Vorbehalt, den der Rechner nicht abbilden kann: Tokenzahlen sind generationsübergreifend nicht vergleichbar. Anthropic weist darauf hin, dass Claude 4.7 und neuer denselben Text in rund 30 % mehr Tokens zerlegt als Sonnet 4.6 und älter, sodass ein flacher Pro-Million-Vergleich gegen ein älteres Modell die tatsächliche Rechnung unterschätzt.

Wie Opus 5 sich gegen den Rest der Modellreihe schlägt

ModellInput / MTokOutput / MTokKontextWo es passt
Claude Fable 5$10$501MDie Leistungsobergrenze
Claude Opus 5$5$251MAgentisches Coding, Enterprise-Arbeit
Claude Opus 4.8$5$251MPriority Tier, Web Fetch
Claude Sonnet 5$2 (dann $3)$10 (dann $15)1MVolumenarbeit
Claude Sonnet 4.6$3$151MBisheriges Arbeitspferd
Claude Haiku 4.5$1$5200KKlassifizierung, Routing

Anthropics eigene Empfehlung lautet, mit Opus 5 zu starten und nur dann zu Fable 5 hochzustufen, wenn man die Leistungsobergrenze braucht.

Im Vergleich zum übrigen Markt platzieren unsere Vergleiche zu Gemini-Preisen und GPT-5.6-Preisen Opus 5 im Segment "teuer, aber effizient". Die direkten Gegenüberstellungen in Gemini 3 Pro und Codex vs. Opus 4.6 beschreiben nach wie vor die Form dieses Trade-offs, und der Drei-Wege-API-Vergleich ist der schnellste Weg, einen Wechsel zu prüfen.

Zwei Dinge behält Opus 4.8, die Opus 5 verliert, und sie sind planungsrelevant: Laut den Migrationshinweisen ist Web Fetch bei Opus 5 nicht verfügbar, und Priority Tier wird nicht unterstützt. Wer eine Priority-Tier-Verpflichtung hat, dessen Kapazität wandert nicht mit.

Was echte Workloads wirklich kosten

Sätze sind abstrakt. Das hier nicht.

Eine Coding-Session. Anthropics eigenes durchgerechnetes Beispiel setzt eine einstündige Opus-5-Session bei 50.000 Input- und 15.000 Output-Tokens an: $0,25 plus $0,375 plus $0,08 Managed-Agents-Laufzeit, also $0,705. Aktiviert man Caching für 40.000 dieser Input-Tokens, landet dieselbe Session bei $0,525, ein Rückgang von 25 % ohne Verhaltensänderung.

Ein Business-Workflow. Auf Zapiers AutomationBench erzielte Opus 5 bei mittlerem Effort 24 % für $0,89 pro Aufgabe, was laut Anthropic "sowohl Claude Opus 4.8 als auch Fable 5 deutlich übertrifft, bei weniger als der Hälfte der Kosten".

Chart of AutomationBench pass rate against cost per task across four frontier models, as published by Anthropic
Chart of AutomationBench pass rate against cost per task across four frontier models, as published by Anthropic

Eine komplette Evaluations-Suite. Am anderen Extrem veröffentlicht Artificial Analysis, was sie für den Betrieb ihres eigenen Index ausgegeben haben:

"In total, it cost $3835.51 to evaluate Claude Opus 5 (Adaptive Reasoning, Max Effort) on the Intelligence Index."

Diese Zahl ist das ehrliche Gegengewicht zu jedem Kosten-pro-Aufgabe-Diagramm oben. Opus 5 führt denselben Index mit 61 Punkten an, Rang 1 von 190 Modellen, verbrannte dafür aber 100M Output-Tokens gegenüber einem Median von 63M. Effizienz pro abgeschlossener Aufgabe und Gesamtausgaben sind unterschiedliche Fragen, und Opus 5 beantwortet sie unterschiedlich.

Chart of OSWorld 2.0 computer-use score against cost per task by effort level, as published by Anthropic
Chart of OSWorld 2.0 computer-use score against cost per task by effort level, as published by Anthropic

Mehrere Early-Access-Kunden haben denselben Effekt beziffert. Ein Legal-Agent-Team berichtete von 26 % weniger Tokens bei ähnlicher Leistung gegenüber Opus 4.8 bei Max Reasoning, und ein Trading-Benchmark landete bei "rund einem Siebtel der Reasoning-Tokens und weniger als der halben Latenz". Das sind vom Anbieter stammende, anonyme Angaben, die man entsprechend gewichten sollte, aber die Richtung ist über sechs getrennte Berichte hinweg konsistent.

Claude Pro, Max, Team und Enterprise

Nicht jeder greift zur API. Laut dem Launch-Beitrag ist Opus 5 das neue Standardmodell bei Claude Max und das stärkste Modell bei Claude Pro.

TarifMonatlichJährlichOpus-5-Zugang
Free$0$0Nein, nur Sonnet und Haiku
Pro$20$17/Monat, $200 im VorausJa, plus Fable via Guthaben
Max 5x$100Nur monatlichJa, Standardmodell
Max 20x$200Nur monatlichJa, Standardmodell
Team (standard)$25/Sitz$20/SitzJa
Team (premium)$125/Sitz$100/SitzJa, 5x Standardnutzung
Enterprise-$20/Sitz plus NutzungJa, 500k Kontext

Preise stammen von der Claude-Preisseite. Zwei Details, über die Käufer häufig stolpern:

  • Limits sind sitzungsbasiert, nicht nachrichtenbasiert. Sie setzen sich in einem gleitenden Fünf-Stunden-Fenster zurück, dazu kommen wöchentliche Obergrenzen, und Web, Desktop, Mobil und Claude Code schöpfen alle aus einem gemeinsamen Pool. Es gibt keine Nachrichtenzahl, gegen die man planen kann.
  • Kostenpflichtige Tarife schwappen in API-Sätze über. Erreicht man ein Limit, kann man Nutzungsguthaben aktivieren, um zu Standardsätzen weiterzuarbeiten, und genau dort beginnen die oben genannten $5 und $25 für einen Abo-Sitz zu gelten.

Dieses Sitzungsmodell erzeugt bei derselben Veröffentlichung völlig unterschiedliche Erfahrungen, und die Kluft folgt fast perfekt der Tarifstufe. Ein Max-20x-Nutzer:

Reddit

"I have now been using Opus 5 only (since I'm out of Fable) for about 7 hours and it drained about 6% of my weekly usage."

Und ein Pro-Nutzer in derselben Woche:

Reddit

"I'm only on the Pro plan but a single prompt with Opus 5 w/ high thinking used 100% of my 5-hour usage limit."

Beides kann stimmen, weil ein Sitzungslimit ein Tokenpool ist und Opus 5 bei hohem Effort schneller daraus verbraucht. Bei einem $20-Pro-Sitz ist dieser Pool klein genug, dass ein einziger thinking-lastiger Prompt ihn leert. Die praktische Lösung, zu der die Leute gefunden haben, ist kein Tarif-Upgrade: Es ist, den Effort für Routinearbeit zu senken und high für die Aufgaben aufzuheben, die es wirklich brauchen.

Für Teams, die den Abo-Weg gegen reine API-Ausgaben abwägen, decken unser Claude-Code-Preisleitfaden und der Enterprise-Claude-Code-Rundgang die Sitzrechnung ab. Die Modellkonfiguration in Claude Code ist der Ort, an dem man Opus 5 festlegt, statt die automatische Auswahl walten zu lassen, und der Leitfaden zur Modellauswahl behandelt, wann man auf eine günstigere Stufe herunterfallen lässt. Wer noch überlegt, ob das gesamte Ökosystem passt, findet in unserer Claude-Rezension und dem Claude-Cowork-Preisleitfaden die breitere Perspektive.

Bedrock, Vertex, Foundry und die CCU-Eigenheit

Opus 5 ist vom ersten Tag an auf allen Plattformen verfügbar, die Abrechnung ist jedoch nicht identisch.

  • Amazon Bedrock und Google Cloud werden von Partnern betrieben. Der Cloud-Anbieter stellt dir die Rechnung, und Anthropic verweist auf die Bedrock-Preise und die Vertex-AI-Preise als maßgebliche Quelle, statt selbst Sätze zu veröffentlichen.
  • Regionale Endpunkte tragen einen Aufschlag von 10 % gegenüber globalen auf beiden Clouds.
  • Claude Platform auf AWS und Microsoft Foundry rechnen in Claude Consumption Units ab. Diese werden zu Standard-Modellsätzen in USD bewertet und dann bei stündlicher Messung zu $0,01 pro CCU umgerechnet. Deine Rechnung zeigt eine einzige CCU-Position, keine Tokenaufschlüsselung.
  • Der Fast-Modus ist nur First-Party. Er existiert nicht auf Bedrock, Google Cloud oder Foundry.

Wenn dein Finanzteam eine AWS-Rechnung mit einem Pro-Token-Modell abgleicht, ist die CCU-Umrechnung der Punkt, an dem beide nicht mehr zusammenpassen.

Was Entwickler sagen

Die Reaktion der Launch-Woche spaltete sich fast sofort in zwei Lager, und die Spaltung dreht sich ausschließlich um Tokens, nicht um Sätze. Das erste Lager rechnete nach und fand hinter dem flachen Preis eine echte Erhöhung.

Reddit

"At the same levels of thinking it's appears that Opus 5 in it's current form uses about 2x the amount of output tokens to do similar tasks. So per token is the same, but the models don't use the same amount of tokens to do the same task."

Ein Entwickler gab echtes Geld aus, um es zu klären. Beim Durchlaufen derselben Aufgabe über verschiedene Effort-Stufen protokollierte er Opus 5 bei $0,41514 auf low und $0,801965 auf medium, gegenüber $0,210415 für Opus 4.8 auf low:

Reddit

"At matched effort, Opus 5 spends roughly 2x the output tokens of 4.8."

Leaderboards von Drittanbietern griffen dasselbe Signal aus einem anderen Blickwinkel auf:

Hacker News

"Vals Index Opus 4.8 > 5.0 goes from $2.90 to $8.54, for 4% gain ... That is a massive cost increase. Sure, 20% cheaper then Fable, but that is a 3x price increase compared to Opus 4.8 in that test."

Der Mechanismus, den die Leute immer wieder beschreiben, ist Scope Creep, dasselbe Verhalten, vor dem Anthropics eigene Dokumentation warnt, wenn sie rät, übernommene Verifikationsanweisungen zu löschen, weil Opus 5 seine Arbeit unaufgefordert überprüft:

Reddit

"it just reviews every minor change with unnecessary checks that would take a couple minutes to check manually, it wants to spend an hour and spend $25 of tokens"

Das Gegenargument ist fair und hörenswert. Die insgesamt verbrannten Tokens sind der falsche Nenner, wenn das Modell Arbeit fertigstellt, die das günstigere Modell abbricht:

Reddit

"When we look at some benchmarks that publish the cost per successful task, Claude seems to be way cheaper than I expected. For example on https://livebench.ai/

here the cost per successful task for Opus 5 is lower than Sol."

Und etliche Leute sind mit dem Wechsel schlicht zufrieden:

Hacker News

"I switched from 4.8 to 5 yesterday and I'd have to say that I've noticed an improvement, though not hugely perceptible, the model seems to want to do more work per turn, possibly a tiny bit faster, and little less verbose when it isnt necessary to be so."

Meine Einschätzung: Beide Lager haben recht, und die Uneinigkeit dreht sich eigentlich darum, gegen welchen Nenner man abrechnet. Misst man Tokens, wurde Opus 5 teurer. Misst man abgeschlossene Aufgaben, wurde es günstiger. Welche der beiden Sichtweisen dein Geschäft beschreibt, ist die eigentliche Frage, die diese Preisseite dir nicht beantworten kann.

Ist Claude Opus 5 seine $5 und $25 wert?

Für agentische Arbeit mit langem Zeithorizont: ja, und das Argument dreht sich eigentlich gar nicht um den Satz. Opus 5 verlangt, was Opus 4.8 verlangte, während es 96,0 % auf SWE-bench Verified erzielt und 4.8 auf Frontier-Bench mehr als verdoppelt. Wenn ein Lauf $0,89 kostet und fertig wird, statt $0,40 zu kosten und zweimal zu scheitern, war das pro Token günstigere Modell nie wirklich günstiger.

Drei ehrliche Vorbehalte, bevor man es standardisiert:

  • Es ist wortreich, und Wortreichtum wird zu $25 abgerechnet. Artificial Analysis nennt es "besonders teuer im Vergleich zu anderen Modellen ähnlichen Preises" und "auffällig langsam und sehr wortreich". Plane Zeit für Prompt-Engineering zur Längenkontrolle ein, denn Effort allein wird das nicht regeln.
  • Halluzinationen entwickelten sich leicht in die falsche Richtung. Die System Card stellt unumwunden fest, dass das Modell "leicht häufiger faktische Behauptungen halluziniert als Opus 4.8, trotz insgesamt höherer Genauigkeit".
  • Günstigere Modelle gewinnen weiterhin viele Aufgaben. Für Klassifizierung, Routing und Massenentwürfe ist Claude Sonnet 5 zu 40 % des Preises der bessere Kauf, und Haiku ist noch besser. Wer sich umschaut: Unser Opus-4.6-Alternativen-Überblick und die frühere Opus-4.5-Alternativen decken das Feld ab, mit Mistral-Preisen und Groq-Preisen am günstigeren Ende.

Wo das Modell in einer echten Toolchain landet, ist eine andere Frage als die Preistabelle. Unsere Überblicke zu KI-Coding-Assistenten, Claude-Entwickler-Tools und Cursor sind der Ort, wo das in der Praxis entschieden wird.

Fürs Protokoll: Meine eigene Standardeinstellung für interne Tools ist high Effort mit 1-Stunden-Caching auf dem System-Prompt und Batch für alles, was warten kann. Diese Kombination lässt die meisten Aufgaben irgendwo zwischen einem Viertel und der Hälfte der naiven Standard-Satz-Rechnung landen.

Wo die Token-Rechnung aufhört, dein Problem zu sein

All das oben setzt voraus, dass du die Sanitärinstallation selbst besitzen willst: die Retry-Logik, das Effort-Tuning, die Cache-Invalidierung, den Fallback, wenn ein Sicherheitsklassifikator eine Anfrage ablehnt. Das ist ein echtes Engineering-Projekt, und ich habe mehrere technisch versierte Kunden eesel verlassen sehen, um genau das direkt auf der Claude API zu bauen.

Manche von ihnen sind vollkommen zufrieden. Andere landen dort, wo dieser Kunde gelandet ist:

"We could try to write our own LLM application but we didn't want to invest our time into that. We wanted something that we would not have to maintain."

Karel, GENERAL BYTES

Das ist die eigentliche Entscheidung hinter einer Claude-Opus-5-Preisseite. Wenn du ein Frontier-Modell willst, das Support-Tickets beantwortet, ist der Tokensatz vielleicht ein Fünftel der Arbeit. Der Rest besteht darin, es in deinem Helpcenter und vergangenen Tickets zu verankern, es bei Fragen still zu halten, die es nicht anfassen sollte, und zu wissen, was es tun wird, bevor es eine Live-Warteschlange berührt.

The eesel AI helpdesk dashboard, showing AI activity across connected support channels
The eesel AI helpdesk dashboard, showing AI activity across connected support channels

eesel ist genau diese Schicht, verkauft als Preis pro Aufgabe, in dem die Modellkosten bereits enthalten sind, sodass ein arbeitsreicher Monat als mehr bearbeitete Tickets erscheint statt als Token-Rechnung, die man erklären muss. Du kannst es gegen deine eigenen historischen Tickets simulieren, bevor es irgendjemandem antwortet, und es in wenigen Minuten anbinden. Probiere eesel kostenlos aus.

Wenn Content statt Support dein Anwendungsfall ist, treibt dieselbe Logik unseren KI-Blog-Writer an, und die Leitfäden zum besten LLM fürs Blogging und dazu, wie man KI-Content menschlich klingen lässt, sind der richtige Startpunkt.

Häufig gestellte Fragen

Was kostet Claude Opus 5 pro Million Tokens?
Claude Opus 5 kostet in der Claude API $5 pro Million Input-Tokens und $25 pro Million Output-Tokens, derselbe Tarif, den Anthropic seit Opus 4.5 beibehalten hat. Das ist die Hälfte der $10 und $50 von Claude Fable 5, und das volle 1M-Kontextfenster ist ohne Long-Context-Aufschlag enthalten. Zur Vorgängergeneration siehe unsere Opus-4.6-Preisaufschlüsselung.
Ist Claude Opus 5 teurer als Claude Opus 4.8?
Pro Token nicht: Beide kosten $5 und $25 pro Million. In der Praxis kann die Rechnung trotzdem steigen, weil Opus 5 standardmäßig Adaptive Thinking ausführt, was Opus 4.8 nicht tat, und Thinking-Tokens werden zum Output-Satz abgerechnet. Setze die Effort-Einstellung auf medium oder low, wenn du das alte Ausgabeprofil zurückhaben willst.
Wie betreibt man Claude Opus 5 am günstigsten?
Rabatte stapeln. Die Batch API senkt beide Richtungen um 50 % auf $2,50 und $12,50, Prompt-Cache-Reads kosten $0,50 pro Million (10 % des Basis-Inputs), und beides lässt sich kombinieren. Eine niedrigere Effort-Einstellung senkt das Output-Volumen um bis zu 64 %. Unser Claude-Code-Preisleitfaden behandelt stattdessen den Abo-Weg.
Ändert sich der Preis von Claude Opus 5 beim 1M-Kontextfenster?
Nein. Anthropic berechnet eine Anfrage mit 900.000 Tokens bei jedem Claude-4.6-Modell und neuer zum selben Tokenpreis wie eine mit 9.000 Tokens, es gibt also keinen Long-Context-Aufschlag bei Opus 5. Der Leitfaden zur Kontextfenstergröße erklärt, wo diese Grenze bei agentischer Arbeit anfängt spürbar zu werden.
Was kostet Claude Opus 5 im Pro- und Max-Tarif?
Claude Pro kostet $20 pro Monat (oder $17 bei jährlicher Abrechnung), Max kostet $100 oder $200 pro Monat, und Opus 5 ist das Standardmodell bei Max. Limits sind sitzungsbasiert statt nachrichtenbasiert, und sobald man sie erreicht, kann man Nutzungsguthaben aktivieren, die zu Standard-API-Sätzen abgerechnet werden. Details im Claude-Pro-Preisleitfaden.
Was bietet ein besseres Preis-Leistungs-Verhältnis, Claude Opus 5 oder Claude Sonnet 5?
Claude Sonnet 5 kostet bis zum 31. August 2026 $2 und $10 pro Million, danach $3 und $15, also rund 40 % der Kosten von Opus 5. Opus 5 rechtfertigt den Unterschied bei langen agentischen Läufen, wo weniger Wiederholungsversuche einen günstigeren Tokenpreis aufwiegen, und Sonnet gewinnt bei hochvolumiger Klassifizierung und Textentwürfen.
Was ändert der Fast-Modus am Preis von Claude Opus 5?
Der Fast-Modus verdoppelt den Satz auf $10 und $50 pro Million für bis zu 2,5-fach höhere Output-Tokens pro Sekunde. Es handelt sich um eine Research-Preview nur in der First-Party-Claude-API, sie ist nicht mit der Batch API verfügbar und läuft nicht auf Amazon Bedrock, Google Cloud oder Microsoft Foundry.

Share this article

Rama Adi Nugraha

Article by

Rama Adi Nugraha

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Bannerbild für Claude Pro Preise 2026: Alles, was Sie wissen müssen
Guides

Claude Pro Preise 2026: Alles, was Sie wissen müssen

Claudes Preisgestaltung hat sich von einem einfachen 20-Dollar-Abonnement zu einem komplexen gestaffelten Modell mit Max-Plänen für Power-User entwickelt. Hier ist der datengestützte Leitfaden.

Alicia Kirana UtomoAlicia Kirana UtomoApr 30, 2026
Image alt text
Guides

Ein Überblick über die Preise und Funktionen von Claude Opus 4.6

Entdecken Sie unsere detaillierte Analyse der Preise von Claude Opus 4.6. Wir schlüsseln die Kosten, neuen Funktionen und praktischen Anwendungsfälle für das neueste KI-Modell von Anthropic auf.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieFeb 6, 2026
Image alt text
Guides

GPT 5.3 Codex vs. Claude Opus 4.6: Ein Überblick über die neue KI-Frontier

Am 5. Februar 2026 veröffentlichten OpenAI und Anthropic GPT-5.3 Codex und Claude Opus 4.6 und entwickelten die KI von der einfachen Code-Vervollständigung hin zu komplexer, agentenähnlicher Zusammenarbeit weiter. Dieser Artikel schlüsselt die wichtigsten Unterschiede auf.

Katelin TeenKatelin TeenFeb 6, 2026
Ein praktischer Leitfaden zur Perplexity AI API: Was Sie wissen sollten, bevor Sie beginnen zu entwickeln
Guides

Die Perplexity AI API: Was Sie vor dem Bauen wissen sollten (2026)

Die Perplexity AI API bietet Echtzeit-Antworten mit Quellenangaben, aber versteckte Kosten und Zuverlässigkeitsprobleme machen sie für den Support riskant. Erfahren Sie, warum integrierte KI-Plattformen besser funktionieren.

Kenneth PanganKenneth PanganSep 4, 2025
Hero-Banner für Claude Fable 5, Anthropics neues Mythos-Klasse-Modell
Guides

Claude Fable 5 im Test: was es ist und was es für KI-Support bedeutet

Claude Fable 5 ist Anthropics neues Mythos-Klasse-Modell: Agenten mit langem Zeithorizont, tagelanges Coding, 50 $ pro Million Output-Tokens und eine zweistufige Sicherheitsarchitektur, die man verstehen sollte.

Rama Adi NugrahaRama Adi NugrahaJun 10, 2026
Redaktionelle Illustration für einen Erklärartikel über Claude Fable 5, Anthropics leistungsstärkstes KI-Modell
Guides

Was ist Claude Fable 5? Anthropics leistungsstärkstes Modell, erklärt

Claude Fable 5 ist Anthropics Flaggschiff der Mythos-Klasse, eine Stufe über Opus 4.8, gebaut für tagelange autonome Arbeit. Hier erfahren Sie, was es kann, was es kostet und wo der Haken liegt.

Alicia Kirana UtomoAlicia Kirana UtomoJun 17, 2026
Redaktionelle Illustration für einen Leitfaden dazu, was Claude Fable 5, Anthropics leistungsstärkstes KI-Modell, kann
Guides

Was kann Claude Fable 5? Ein Leitfaden Funktion für Funktion

Was kann Claude Fable 5? Tagelang unbeaufsichtigt arbeiten, Code schreiben und ausliefern, Dokumente mit 1 Mio. Tokens lesen und die eigene Arbeit prüfen. Hier erfahren Sie, was das in der Praxis bedeutet.

Riellvriany IndriawanRiellvriany IndriawanJun 17, 2026
Hero-Banner zum Claude Sonnet 5 Test mit dem Anthropic-Logo
Guides

Claude Sonnet 5 im Test: Ist es das Modell, das man wirklich nutzen sollte?

Ein Praxistest von Claude Sonnet 5: die Benchmarks, der Preishaken, wie es sich gegen Opus 4.8 schlägt und ob es das Claude-Modell ist, das du standardmäßig nutzen solltest.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 2, 2026
Claude Sonnet 5 Illustration mit dem Anthropic-Zeichen und einem Support-Workflow
Guides

Claude Sonnet 5: Was das für den Kundensupport bedeutet

Claude Sonnet 5 bietet Coding- und Agenten-Qualität nahe an Opus zu Preisen der mittleren Stufe. Hier ist, was das Modell für Support-Teams tatsächlich ändert, und was nicht.

Rama Adi NugrahaRama Adi NugrahaJul 1, 2026

Bereit, Ihren KI-Teamkollegen einzustellen?

In Minuten eingerichtet. Keine Kreditkarte erforderlich.

Kostenlos starten