Claude Sonnet 5.5 Preise 2026: API-Tarife, Pläne und reale Kosten

Rama Adi
Geschrieben von

Rama Adi

Katelin Teen
Geprüft von

Katelin Teen

Zuletzt bearbeitet September 29, 2026

Expertengeprüft
Handgezeichnete Illustration eines Teams, das eine Kostenanzeige und ein Balkendiagramm zu den Claude Sonnet 5.5 Preisen prüft

Kurzfassung

Claude Sonnet 5.5 kostet 2 $ pro Million Input-Tokens und 10 $ pro Million Output-Tokens, genauso viel wie Sonnet 5 und exakt die Hälfte von Claude Opus 5.5 bei Input, Output, Cache-Schreibvorgängen und Batch. Es gibt keinen Long-Context-Aufschlag im gesamten 1M-Fenster, und das Modell ist im kostenlosen Claude-Plan enthalten.

Der Haken ist die eine Position, die nicht zum halben Preis zu haben ist. Cache-Lesezugriffe kosten bei Sonnet 5.5 und Opus 5.5 gleichermaßen 0,20 $ pro Million. In den Tests von Artificial Analysis machten Cache-Lesezugriffe bei Max-Effort 40 % der Rechnung von Sonnet 5.5 aus, und bei dieser Einstellung kostete es 7,60 $ pro Aufgabe gegenüber 5,98 $ bei Opus 5.5. Bei Low und Medium ist Sonnet 5.5 die günstige, schnelle Option, als die es sich präsentiert. Oberhalb von High erreicht Opus 5.5 bei Medium meist denselben Score für weniger Geld.

Bei eesel schreibe ich den Integrationscode, der diese API-Aufrufe abschickt, deshalb lese ich Preislisten nach der Zeile, die am Ende auf der Rechnung steht. Wenn Sie Sonnet 5.5 für eine Support-Warteschlange kalkulieren: eesel betreibt Modelle wie dieses in einem KI-Helpdesk-Teammitglied, das pro bearbeitetem Ticket abrechnet, sodass der Effort-Regler nie auf Ihrer Rechnung auftaucht.

Claude Sonnet 5.5 Preise im Überblick

Claude Sonnet 5.5 wurde am 28. September 2026 veröffentlicht, und Anthropic hat den Preis gleich gelassen. Das ist die komplette API-Preisliste aus der Claude-Preisdokumentation, pro Million Tokens, neben den zwei nächsten Geschwistern:

Preis pro 1M TokensClaude Sonnet 5.5Claude Opus 5.5Claude Haiku 4.5
Input$2$4$1
Output (inkl. Thinking)$10$20$5
5-Minuten-Cache-Schreibvorgang$2.50$5$1.25
1-Stunden-Cache-Schreibvorgang$4$8$2
Cache-Lesezugriff$0.20$0.20$0.10
Batch Input / Output$1 / $5$2 / $10$0.50 / $2.50
Fast ModeNicht angeboten$8 / $40Nicht angeboten
Kontextfenster1M1M200K
Max. Output128K (300K in der Batch-Beta)128K (300K in Batch)64K
Long-Context-AufschlagKeinerKeinerk. A.
Der API-Tab der Claude-Preisseite mit Sonnet 5.5 zu 2 $ Input, 10 $ Output, 0,20 $ Cache-Lesezugriff und 2,50 $ Cache-Schreibvorgang pro Million Tokens, neben Fable 5.1, Opus 5.5 und Haiku 4.5, aufgenommen von Claudes Preisseite
Der API-Tab der Claude-Preisseite mit Sonnet 5.5 zu 2 $ Input, 10 $ Output, 0,20 $ Cache-Lesezugriff und 2,50 $ Cache-Schreibvorgang pro Million Tokens, neben Fable 5.1, Opus 5.5 und Haiku 4.5, aufgenommen von Claudes Preisseite

Einige Details in dieser Tabelle sind wichtiger, als sie zunächst wirken:

  • Thinking wird als Output abgerechnet. Sonnet 5.5 nutzt adaptives Thinking, daher kostet jeder Reasoning-Token 10 $ pro Million, genau wie die Antwort.
  • Der API-Standard-Effort ist high, laut Modellübersicht. Die Claude-Apps und Claude Code verwenden standardmäßig Medium. Diese eine Einstellung verändert Ihre Rechnung stärker als alles andere auf dieser Seite.
  • Der minimal cachebare Prompt hat 512 Tokens, sodass sich selbst ein kurzer Support-System-Prompt cachen lässt.
  • Der Tokenizer ist gegenüber Sonnet 5 unverändert, derselbe Text ergibt also dieselbe Token-Anzahl. Jede Ersparnis entsteht, weil das Modell weniger schreibt, nicht durch freundlicheres Zählen.

Wenn Sie von der Vorgängergeneration kommen: Am Listenpreis hat sich gegenüber den Sonnet 5 Preisen nichts bewegt, und er liegt weiterhin unter den 3 $ und 15 $ von Claude Sonnet 4.6. Anthropics Argument ist, dass die Rechnung trotzdem sinkt, weil das Modell dieselbe Arbeit mit weniger Tokens erledigt.

Halber Preis von Opus bei jeder Position außer einer

Hier ist der Teil, den die meisten Preiszusammenfassungen auslassen. Sonnet 5.5 kostet bei Input, Output, Cache-Schreibvorgängen und Batch exakt die Hälfte von Claude Opus 5.5. Bei Cache-Lesezugriffen ist es überhaupt nicht günstiger.

Handgezeichneter Vergleich der Tarife von Sonnet 5.5 und Opus 5.5 pro Million Tokens, mit Input, Output, Cache-Schreibvorgang und Batch-Output zum halben Preis und den Cache-Lesezugriffen, eingekreist, beim gleichen Preis von 0,20 $
Handgezeichneter Vergleich der Tarife von Sonnet 5.5 und Opus 5.5 pro Million Tokens, mit Input, Output, Cache-Schreibvorgang und Batch-Output zum halben Preis und den Cache-Lesezugriffen, eingekreist, beim gleichen Preis von 0,20 $

Das kam daher, dass Opus 5.5 einen ungewöhnlich günstigen Cache bekommen hat. Sein Cache-Lese-Multiplikator beträgt 0,05x des Inputs, während Sonnet den üblichen Wert von 0,1x nutzt, laut Prompt-Caching-Tabelle. Opus-Input kostet 4 $, 0,05x ergibt also 0,20 $. Sonnet-Input kostet 2 $, 0,1x ergibt ebenfalls 0,20 $. Dieselbe Zahl auf zwei Wegen.

Für einen Chatbot, der einen Prompt sendet und eine Antwort bekommt, spielt das kaum eine Rolle, für einen Agenten dagegen sehr wohl. Jeder Durchlauf einer Agent-Schleife sendet die gesamte bisherige Unterhaltung erneut, und bei aktiviertem Caching wird der Großteil davon als Cache-Lesezugriff abgerechnet. Je länger die Sitzung läuft, desto größer wird diese Position, und sie ist die eine Position, bei der die Wahl des kleineren Modells nichts spart.

Die Community hat es am Launch-Tag bemerkt:

Hacker News

"Cache read is the same as Opus as well where most agentic workflow cost comes from. Not quite sure where this fits well."

Was ein realer Lauf tatsächlich kostet

Eine Preisliste nennt den Preis eines Tokens. Sie sagt nicht, wie viele Tokens ein Modell braucht, um eine Aufgabe zu erledigen, und genau hier wird Sonnet 5.5 interessant. Artificial Analysis hat seinen Intelligence Index bei jeder Effort-Stufe laufen lassen und die gemessenen Kosten pro Aufgabe veröffentlicht.

Modellseite von Artificial Analysis für Claude Sonnet 5.5 bei Max-Effort mit einem Intelligence Index von 56, 137,6 Output-Tokens pro Sekunde, 7,60 $ Kosten pro Aufgabe und 410M Output-Tokens, aufgenommen von Artificial Analysis
Modellseite von Artificial Analysis für Claude Sonnet 5.5 bei Max-Effort mit einem Intelligence Index von 56, 137,6 Output-Tokens pro Sekunde, 7,60 $ Kosten pro Aufgabe und 410M Output-Tokens, aufgenommen von Artificial Analysis

Die Seite ist bei den Kosten deutlich. Bei Max-Effort erzeugte Sonnet 5.5 über den Index hinweg 410M Output-Tokens gegenüber einem Klassenmedian von 88M, und AAs eigene Zusammenfassung nennt es "very verbose". Hier die komplette Stufenleiter von AAs Sonnet-5.5-Seite, neben den passenden Zeilen von der Opus 5.5 Seite:

EffortSonnet 5.5 ScoreSonnet 5.5 Kosten pro AufgabeOutput-Tokens pro AufgabeOpus 5.5 ScoreOpus 5.5 Kosten pro Aufgabe
Low36$0.4113.9k42$0.55
Medium41$0.5919.5k51$1.34
High47$1.0834.5k54$1.82
Xhigh52$2.7473.7k56$3.46
Max56$7.60192.8k58$5.98

Liest man die Sonnet-Spalte von oben nach unten, verdoppeln sich die Kosten ab Medium ungefähr mit jeder Stufe, und von Xhigh auf Max verdreifachen sie sich fast. Liest man quer, kippt das Muster um High herum. Sonnet 5.5 bei Max-Effort kostet pro Aufgabe 27 % mehr als Opus 5.5 bei Max, und das bei zwei Punkten weniger Score. Es benötigte dort 193k Output-Tokens pro Aufgabe, gegenüber 119k bei Opus.

Handgezeichnete Stufenleiter der Effort-Level mit Scores und Kosten pro Aufgabe von Sonnet 5.5 und Opus 5.5, wobei Sonnet Xhigh mit 52 für 2,74 $ gegen Opus Medium mit 51 für 1,34 $ eingekreist ist
Handgezeichnete Stufenleiter der Effort-Level mit Scores und Kosten pro Aufgabe von Sonnet 5.5 und Opus 5.5, wobei Sonnet Xhigh mit 52 für 2,74 $ gegen Opus Medium mit 51 für 1,34 $ eingekreist ist

Das Paar, das ich mir am genauesten ansehen würde, ist Sonnet Xhigh gegen Opus Medium. Sie erreichen 52 und 51, und Opus kostet 1,34 $ gegenüber 2,74 $ bei Sonnet. Wenn Sie Sonnet 5.5 über High hinaus hochdrehen, um die nötige Qualität zu bekommen, zahlen Sie am Ende mehr, als das größere Modell in seiner Standardeinstellung kosten würde.

Das ist auch die ehrliche Lesart von Anthropics eigener Aussage "bis zu 30 % weniger pro Aufgabe". Der Launch-Beitrag sagt, Sonnet 5.5 "complements Opus 5.5 best when running at lower effort settings, where it costs less per task. At higher settings, it can perform comparably at a similar cost." Die AA-Zahlen bestätigen das genau.

Wohin das Geld bei einer Agent-Rechnung fließt

AA schlüsselt außerdem die Kosten jedes Laufs nach Token-Art auf, und hier hört die Cache-Lese-Position von vorhin auf, theoretisch zu sein. Beim vollständigen Max-Effort-Lauf des Intelligence Index belief sich die Rechnung von Sonnet 5.5 auf 8.977 $:

Handgezeichneter gestapelter Balken, der die Benchmark-Rechnung von Sonnet 5.5 bei Max-Effort über 8.977 $ aufteilt in Cache-Lesezugriffe 3.605 $, Cache-Schreibvorgänge 1.195 $, frischen Input 71 $ und Output plus Thinking 4.106 $, mit dem Hinweis, dass Cache-Lesezugriffe zum Opus-Tarif abgerechnet werden
Handgezeichneter gestapelter Balken, der die Benchmark-Rechnung von Sonnet 5.5 bei Max-Effort über 8.977 $ aufteilt in Cache-Lesezugriffe 3.605 $, Cache-Schreibvorgänge 1.195 $, frischen Input 71 $ und Output plus Thinking 4.106 $, mit dem Hinweis, dass Cache-Lesezugriffe zum Opus-Tarif abgerechnet werden
PositionSonnet 5.5 bei MaxAnteilSonnet 5.5 bei MediumAnteil
Cache-Lesezugriffe$3,60540%$18026%
Cache-Schreibvorgänge$1,19513%$15522%
Frischer Input$711%$7010%
Output und Thinking$4,10646%$29542%
Gesamt$8,977$701

Zwei Dinge fallen daran auf. Frischer Input, die Position, die die meisten meinen, wenn sie "Input-Tokens" hören, ist fast nichts, weil nahezu jeder Input-Token in einem Agent-Lauf ein Cache-Lesezugriff oder ein Cache-Schreibvorgang ist. Und Cache-Lesezugriffe, die Position ohne Sonnet-Rabatt, wachsen von einem Viertel der Rechnung bei Medium auf 40 % bei Max, weil längeres Thinking mehr Durchläufe und mehr erneutes Lesen bedeutet.

Stellt man beide Modelle beim selben Lauf nebeneinander, schließt sich die Lücke, was dieselbe Geschichte ist, die der ältere Vergleich Opus 5 vs Sonnet 5 erzählt hat. Bei Medium kostete der Index-Lauf mit Sonnet 5.5 701 $ gegenüber 1.627 $ bei Opus 5.5, Sonnet lag also bei 43 % der Opus-Rechnung. Bei Max kostete Sonnet 8.977 $ gegenüber 8.708 $ bei Opus. Halber Listenpreis, 3 % mehr auf der Rechnung.

Durchgerechnete Beispiele für drei Workload-Formen

Benchmarks sind die Workload von jemand anderem, deshalb hier die Rechnung nach Preisliste für drei gängige Formen, nur mit den veröffentlichten Preisen. Betrachten Sie die Token-Zahlen als Illustration und setzen Sie im Rechner unten Ihre eigenen ein.

1. Ein Support-Antwort-Bot. Jede Antwort sendet 8.000 Input-Tokens, davon 6.000 als gecachter System-Prompt und Hilfeartikel, und bekommt 1.500 Tokens zurück, Thinking eingeschlossen.

  • Sonnet 5.5: 0,004 $ frischer Input + 0,0012 $ Cache-Lesezugriffe + 0,015 $ Output = etwa 2 Cent pro Antwort, oder 202 $ pro 10.000 Tickets
  • Opus 5.5: 0,008 $ + 0,0012 $ + 0,03 $ = etwa 3,9 Cent, oder 392 $ pro 10.000
  • Haiku 4.5: 0,002 $ + 0,0006 $ + 0,0075 $ = etwa 1 Cent, oder 101 $ pro 10.000

Der Output dominiert hier, deshalb schlägt Sonnets halber Preis beim Output fast vollständig durch. Das ist die Form, bei der Sonnet 5.5 eindeutig der bessere Kauf gegenüber Opus ist. Einen weiteren Blick auf die Kosten von KI-Support jenseits des Modells bietet der Leitfaden zu den Kosten für KI im Kundenservice.

2. Eine lange Agent-Sitzung. Stellen Sie sich einen Coding- oder Ops-Agenten vor, der 30 Durchläufe macht, in jedem einen Kontext von 60.000 Tokens aus dem Cache neu liest, 3.000 frische Tokens hinzufügt und 2.000 schreibt.

  • Sonnet 5.5: 0,36 $ Cache-Lesezugriffe + 0,18 $ frischer Input + 0,60 $ Output = 1,14 $
  • Opus 5.5: 0,36 $ + 0,36 $ + 1,20 $ = 1,92 $

Angenommen, Sonnet braucht nun 40 Durchläufe, wo Opus 25 braucht, was der Richtung der AA-Token-Zahlen bei höherem Effort entspricht. Dann kostet Sonnet 0,48 $ + 0,24 $ + 0,80 $ = 1,52 $ und Opus 0,30 $ + 0,30 $ + 1,00 $ = 1,60 $. Das "halb so teure" Modell liegt jetzt nur noch 8 Cent unter dem teuren.

3. Ein nächtlicher Batch-Job. Sie extrahieren Felder aus 10.000 Dokumenten mit je 20.000 Input-Tokens und 1.000 Output-Tokens, und nichts braucht eine Antwort in Echtzeit.

  • Sonnet 5.5 im Batch: 200 $ Input + 50 $ Output = 250 $
  • Opus 5.5 im Batch: 400 $ + 100 $ = 500 $
  • Haiku 4.5 im Batch: 100 $ + 25 $ = 125 $

Es gibt kein erneutes Lesen aus dem Cache und keine Agent-Schleife, daher gilt das Verhältnis 2:1 ziemlich sauber. Batch lässt sich laut Preisdokumentation außerdem mit Prompt Caching kombinieren.

Berechnen Sie Ihre eigene Monatsrechnung

Legen Sie die Token-Anzahl pro Aufgabe für Ihre Workload fest und sehen Sie, was jedes Modell pro Monat kostet. Cache-Schreibvorgänge sind der Einfachheit halber ausgelassen, da sie bei warmem Cache nur einen kleinen Anteil einer gleichmäßigen Workload ausmachen.

Wenn Sie das Agent-Preset überrascht, ist das die Cache-Lese-Position bei der Arbeit. Bei 1,8M gecachten Tokens pro Sitzung zahlen Sonnet und Opus für das erneute Lesen dieselben 0,36 $, und nur die Output-Position hält sie noch auseinander.

Effort ist der Preisregler, und der API-Standard ist high

Anthropic lässt Sie den Effort pro Anfrage einstellen, und er ist der größte einzelne Hebel bei einer Sonnet-5.5-Rechnung. Simon Willison hat denselben SVG-Prompt bei jeder Stufe laufen lassen und die Kosten im Launch-Thread gepostet:

EffortKosten für einen PromptZeit
Low1,6 Cent10s
Medium1,8 Cent11s
High2,3 Cent17s
Xhigh5,7 Cent41s
Max$1.2815m 40s, und es ist gescheitert

Bei Max hat das Modell in seinen Worten "burned through 128,000 thinking tokens (taking 15 minutes to do that) and ran out before it had produced the final SVG". Das ist ein 80-facher Kostensprung von Low auf Max für ein schlechteres Ergebnis.

Mein praktischer Rat, als jemand, der diese Aufrufe in Produktionscode einbaut:

  1. Setzen Sie den Effort bei jeder Anfrage explizit. Der API-Standard ist high, nicht das Medium aus den Apps, daher startet eine naive Integration eine Stufe oberhalb der günstigen Zone.
  2. Starten Sie bei Low für Routinearbeit wie Klassifizierung, Tagging und kurze Antworten, und gehen Sie nur dort höher, wo Ihre Evals eine echte Lücke zeigen.
  3. Behandeln Sie Xhigh und Max als Signal, das Modell zu wechseln. Oberhalb von High schlägt Opus 5.5 bei Medium Sonnet tendenziell bei Score und Preis.
  4. Wiederholen Sie Ihre Effort-Tests, wenn Sie von Sonnet 5 migrieren. Anthropic hat die Stufen auf der Seite What's new neu kalibriert, alte Einstellungen lassen sich also nicht übertragen.

Der Vorteil ist am unteren Ende des Reglers groß. AA maß Sonnet 5.5 bei Medium mit einem Score von 41 für 0,59 $ pro Aufgabe, gegenüber Claude Sonnet 5 bei Max mit einem Score von 38 für 5,09 $. Das ist ein besseres Ergebnis für etwa ein Neuntel der Kosten, also genau die Upgrade-Geschichte, die Anthropic verkauft, und sie hält stand.

Rabatte, Zusatzoptionen und die kleineren Posten

Neben dem Effort verändern vier Modifikatoren den Preis pro Token, alle aus der Claude-Preisdokumentation:

ModifikatorWirkung auf Sonnet 5.5Hinweise
Prompt CachingLesezugriffe zu $0.20 (0,1x), Schreibvorgänge zu $2.50 (5 Min.) oder $4 (1 Stunde)Lohnt sich nach einem Lesezugriff beim 5-Minuten-Cache
Batch API50 % Rabatt: $1 Input, $5 OutputKombinierbar mit Caching; 300K Output mit Beta-Header
US-only-Inferenz1,1x auf jede Token-KategorieEinstellbar mit inference_geo: "us"
Fast ModeNicht verfügbarNur Opus 5.5, zu $8 / $40

Die Tool-Gebühren kommen zu den Tokens hinzu. Web Search kostet 10 $ pro 1.000 Suchanfragen, Web Fetch kostet nichts extra, und Code Execution ist kostenlos, wenn es zusammen mit Web Search oder Fetch genutzt wird, sonst gibt es 1.550 kostenlose Container-Stunden im Monat und danach 0,05 $ pro Stunde. Sonnet 5.5 fügt 286 System-Prompt-Tokens hinzu, sobald Tools vorhanden sind. Sitzungen mit Claude Managed Agents kosten zusätzlich 0,08 $ pro laufender Sitzungsstunde on top der Standard-Token-Tarife.

Ein leicht zu übersehender Kostenpunkt: Erzwungene Tool-Nutzung (tool_choice auf any oder ein benanntes Tool gesetzt) liefert bei Sonnet 5.5 laut Migrationshinweisen jetzt einen 400-Fehler. Das ist kein Preis, aber wenn Ihr Support-Bot davon abhing, ist der Umbau ein realer Kostenpunkt des Wechsels. Der Hub-Beitrag geht alle fünf Breaking Changes durch.

Claude Free, Pro, Max, Team und Enterprise

Wenn Sie Sonnet 5.5 in den Claude-Apps statt in der API nutzen, zahlen Sie pro Seat, nicht pro Token. Von der Claude-Preisseite:

PlanPreisZugang zu Sonnet 5.5Hinweise
Free$0JaAnthropic sagt "anyone can chat with Claude using Sonnet 5.5"
Pro$17/Monat bei jährlicher Abrechnung, $20 monatlichJaErgänzt Opus und Nutzungs-Credits
Max 5x / 20xAb $100/MonatJa5x oder 20x Pro-Nutzung, bevorzugter Zugang
Team Standard$20/Seat/Monat jährlich, $25 monatlichJaFür 2 bis 150 Personen
Team Premium$100/Seat/Monat jährlich, $125 monatlichJa5x die Nutzung des Standard-Seats
Enterprise$20/Seat/Monat plus Nutzung zu API-TarifenJaDie Nutzung wird zu den oben genannten Token-Tarifen abgerechnet

Zwei Dinge verschieben hier die Rechnung. Bei Free und Pro ist Sonnet das Modell, das die meisten tatsächlich nutzen werden, und kostenlose Nutzer bekommen jetzt Sonnet 5.5. Bei Enterprise ist die Seat-Gebühr nur der Anfang, denn die Nutzung wird zu denselben API-Tarifen abgerechnet wie in diesem gesamten Beitrag. Der Claude-Preisleitfaden und die Claude-Pro-Aufschlüsselung behandeln die Nutzungslimits, und der Leitfaden zu den Claude Code Preisen deckt die Entwicklerseite ab, wo Medium der Standard-Effort ist.

Ein Entwickler hat am Launch-Tag die Aufteilung zwischen Abo und API gut auf den Punkt gebracht:

Hacker News

"Sonnet 5.5 might not be useful or necessary in a Claude Code session but it could be good value in the API when you pay per token."

Bedrock, Google Cloud und Foundry

Sonnet 5.5 wurde am ersten Tag auf allen großen Clouds veröffentlicht, als anthropic.claude-sonnet-5-5 auf Amazon Bedrock und claude-sonnet-5-5 auf Google Cloud und Microsoft Foundry, laut Modellübersicht. Wie abgerechnet wird, hängt davon ab, welchen Zugang Sie nutzen:

  • Amazon Bedrock und Google Cloud werden vom Partner betrieben. Sie stellen Ihnen ihre eigenen veröffentlichten Tarife direkt in Rechnung, prüfen Sie also die Bedrock-Preise, bevor Sie Gleichstand annehmen. Google veröffentlicht ebenfalls eigene Vertex-AI-Tarife.
  • Claude Platform on AWS und Claude in Microsoft Foundry werden von Anthropic betrieben. Sie bewerten Ihre Nutzung zu den Standard-Anthropic-Preisen, wenden einen verhandelten Rabatt an und rechnen in Claude Consumption Units zu je 0,01 $ um, nachträglich stündlich über den Marketplace abgerechnet.
  • US-only-Inferenz trägt denselben 1,1x-Multiplikator bei der First-Party-API, Claude Platform on AWS und Foundrys US-Data-Zone-Deployments.

Wenn Sie Claude bereits über eine Cloud betreiben, decken der Bedrock-Leitfaden und der Vertex-AI-Leitfaden die Einrichtung ab.

Wie sich Sonnet 5.5 preislich gegenüber GPT-6 Sol und Gemini 3.8 Flash schlägt

Der auffälligste Vergleich liegt nicht innerhalb von Anthropics Portfolio. GPT-6 Sol hat eine identische Headline-Preisliste: 2 $ Input, 10 $ Output, 0,20 $ gecachter Input, 2,50 $ Cache-Schreibvorgang, laut der Aufschlüsselung der GPT-6 Sol Preise.

Pro 1M TokensClaude Sonnet 5.5GPT-6 SolGemini 3.8 Flash
Input$2$2$0.75 (steigt am 1. Jan. 2027 auf $1.50)
Output$10$10$3.75 (steigt auf $7.50)
Cache-Lesezugriff$0.20$0.20$0.075
Long-Context-AufschlagKeiner bis 1MHöherer Tarif ab 272K InputKeiner
AA-Kosten pro Aufgabe (Einstellung)$1.08 (high)$1.05 (max)Nicht vergleichbar
AA Intelligence Index47 (high)48 (max)Nicht vergleichbar

Die AA-Zeilen verraten es. Sonnet 5.5 bei High und GPT-6 Sol bei Max landen bei nahezu demselben Score für nahezu dieselben Kosten pro Aufgabe. Der Unterschied liegt eher an den Rändern: Sonnet hat keinen Long-Context-Aufschlag, ein Support-Agent, der eine große Wissensbasis in den Kontext lädt, überschreitet also keine Preisklippe, Sol dagegen ab 272K. Geminis AA-Zahlen stammen aus einer früheren Version des Index, deshalb habe ich sie aus dem direkten Vergleich herausgelassen, und die Gemini 3.8 Flash Preise verdoppeln sich im Januar. Der Drei-Wege-API-Vergleich geht weiter, wenn Sie einen Anbieter statt eines Modells auswählen.

Bei Support-Tickets im Speziellen hängt die Rangfolge weniger vom Preis ab als von der Zuverlässigkeit bei Ihren eigenen Daten, weshalb das Modell-Ranking für Support-Tickets die Genauigkeit an die erste Stelle setzt.

Was Entwickler zum Preis sagen

Die Reaktion am Launch-Tag auf Hacker News drehte sich meist darum, wo es gegenüber Opus liegt. Die skeptische Sicht:

Hacker News

"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."

Die nüchterne Sicht, die zur AA-Stufenleiter oben passt:

Hacker News

"Per the charts, there is largely no point to using Sonnet 5.5 at high+ as opus low generally will give similar performance at similar or lower cost."

Und die begeisterte, von einem Nutzer, der es bei niedrigerer Einstellung mit OpenAIs Flaggschiff vergleicht:

Reddit

"Sonnet 5.5 medium scores better than gpt 5.6 Sol high and is less than 1/5 the cost Absolutely bonkers"

Das Muster, bei dem die Leute immer wieder landeten, war ein geteiltes Setup: Sonnet 5.5 bei Low oder Medium übernimmt als Sub-Agent die Arbeit mit hohem Volumen, während Opus 5.5 orchestriert oder die schwierigen Teile abschließt. Wenn keines von beidem passt, zeigt die Übersicht der Claude-Alternativen andere Wege. Das passt zur Preisgestaltung, denn Sonnets Rabatt ist bei output-lastigen Aufrufen mit kurzem Kontext real und verblasst bei langen, cache-lastigen Schleifen.

Sind 2 $ und 10 $ für Claude Sonnet 5.5 es wert?

Ja, bei Low und Medium Effort, und dort würde ich nicht zögern. Es schlägt den besten Score von Sonnet 5 für einen Bruchteil der Kosten, es kostet bei der Output-Position, die chatartige Workloads dominiert, die Hälfte von Opus, und es hat keinen Long-Context-Aufschlag. Für einen Support-Antwort-Bot, einen Klassifikator, einen Entwurfsschritt oder einen nächtlichen Batch-Job ist es meine Standardwahl.

In zwei Fällen ist es ein schwächerer Kauf. Wenn Ihre Workload eine lange Agent-Schleife ist, fressen Cache-Lesezugriffe den Rabatt auf, weil sie bei beiden Modellen dasselbe kosten. Und wenn Sie Xhigh oder Max brauchen, um die gewünschte Qualität zu erreichen, ist Opus 5.5 bei Medium für denselben Score meist günstiger. Testen Sie Sonnet zuerst bei Low, messen Sie, und entscheiden Sie dann, ob sich die Lücke für 1,34 $ pro Aufgabe lohnt.

Wenn die Aufgabe eine Support-Warteschlange ist, gehört eine weitere Kostenposition in die Rechnung: die Planung von Ausgaben, die sich mit Effort und Volumen verändern. Ein Interessent in den Sales-Calls von eesel erreichte an einem einzigen Testtag 200 Interaktionen und machte sich sofort Sorgen um die Kosten pro Interaktion im großen Maßstab. Token-Rechnungen machen diese Sorge schwerer zu beantworten, weil dasselbe Ticket je nach Einstellung 1,6 Cent oder 1,28 $ kosten kann.

eesel testen, für eine feste Rechnung pro Ticket

Sonnet 5.5 ist der Motor. Wenn Sie beantwortete Tickets wollen, ist eesel der Mitarbeiter: ein KI-Helpdesk-Teammitglied, das sich in Zendesk, Freshdesk, Gorgias und Ihre anderen Tools einklinkt, aus Ihren früheren Tickets und Ihrem Help Center lernt und sich an historischen Tickets simulieren lässt, bevor es einem echten Kunden antwortet. Sie wählen nie eine Effort-Stufe und beobachten keine Cache-Lesezugriffe. Die eesel Preise sind ein fester monatlicher Credit-Plan, bei dem ein bearbeitetes Ticket oder ein Chat einen Credit kostet, ab 299 $ für 500 Credits, mit einer kostenlosen Stufe von 100 Credits zum Ausprobieren.

Wenn Sie im Terminal arbeiten, steuert das eesel CLI dasselbe Teammitglied. Sie können Integrationen verbinden und seine Standardanweisungen bearbeiten sowie Aktionen genehmigen oder ablehnen und sein Aktivitätsprotokoll als JSON lesen. Coding-Agenten wie Claude Code können es über den MCP-Server des Workspace ebenfalls ausführen.

eesel Dashboard mit der Zendesk-Ticket-Aktivität des KI-Helpdesk-Teammitglieds
eesel Dashboard mit der Zendesk-Ticket-Aktivität des KI-Helpdesk-Teammitglieds

eesel testen und sehen, was Ihre Warteschlange pro Ticket statt pro Token kostet.

Häufig gestellte Fragen

Was kostet Claude Sonnet 5.5 pro Million Tokens?
Claude Sonnet 5.5 kostet in der Claude API 2 $ pro Million Input-Tokens und 10 $ pro Million Output-Tokens. Cache-Lesezugriffe kosten 0,20 $, 5-Minuten-Cache-Schreibvorgänge 2,50 $ und 1-Stunden-Schreibvorgänge 4 $. Thinking-Tokens werden als Output abgerechnet. Die vollständige Liste steht im Leitfaden zur Anthropic API-Preisgestaltung.
Ist Claude Sonnet 5.5 teurer als Claude Sonnet 5?
Nein. Die Preisliste ist identisch mit den Sonnet 5 Preisen, nämlich 2 $ und 10 $, mit demselben Tokenizer. Laut Anthropic kostet es bis zu 30 % weniger pro Aufgabe, weil es mit weniger Tokens fertig wird, und Artificial Analysis hat gemessen, dass Sonnet 5.5 bei mittlerem Effort Sonnet 5 bei Max schlägt, und das für etwa ein Neuntel der Kosten pro Aufgabe.
Kostet Claude Sonnet 5.5 die Hälfte von Claude Opus 5.5?
Bei Input, Output, Cache-Schreibvorgängen und Batch ja. Bei Cache-Lesezugriffen nein: beide kosten 0,20 $ pro Million. Agent-Workloads geben einen großen Teil ihrer Rechnung für Cache-Lesezugriffe aus, deshalb ist der reale Abstand pro Aufgabe meist kleiner als Faktor 2. Die Gegenseite des Vergleichs finden Sie unter Claude Opus 5.5 Preise.
Wie betreibe ich Claude Sonnet 5.5 am günstigsten?
Halten Sie den Effort bei Low oder Medium, cachen Sie Ihren stabilen System-Prompt und schicken Sie alles, was warten kann, über die Batch API für 1 $ und 5 $. Diese drei Hebel senken die Kosten von Claude Sonnet 5.5 weit stärker als jede Planwahl. Für einfachere Tickets ist Haiku 4.5 nochmal halb so teuer.
Kann ich Claude Sonnet 5.5 kostenlos nutzen?
Ja, in den Claude-Apps. Sonnet ist im Free-Plan enthalten, und laut Anthropic kann jeder auf Claude.ai mit Sonnet 5.5 chatten. Bezahlte Pläne bieten mehr Nutzung, beginnend mit Pro für 17 $ im Monat bei jährlicher Abrechnung. Der Leitfaden zu den Claude Pro Preisen behandelt die Limits.
Berechnet Claude Sonnet 5.5 Aufpreise für langen Kontext?
Nein. Das volle Kontextfenster von 1M Tokens wird zum Standardtarif abgerechnet, eine Anfrage mit 900k Tokens zahlt also pro Token dasselbe wie eine mit 9k. Das unterscheidet sich von den GPT-6 Sol Preisen, die ab 272K Input-Tokens auf einen höheren Long-Context-Tarif wechseln.
Was kostet Claude Sonnet 5.5 auf Amazon Bedrock oder Google Cloud?
Sonnet 5.5 ist ab dem ersten Tag auf Bedrock, Google Cloud und Microsoft Foundry verfügbar, aber die Partner-Clouds stellen ihre eigenen veröffentlichten Tarife in Rechnung. Claude Platform on AWS und Claude in Foundry rechnen zu Standard-Anthropic-Tarifen ab, umgerechnet in Verbrauchseinheiten zu je 0,01 $. US-only-Inferenz erhöht den Preis um den Faktor 1,1. Der Bedrock-Setup-Leitfaden erklärt die technische Einrichtung.
Was würde Claude Sonnet 5.5 für einen Kundensupport-Bot kosten?
Bei einem Prompt mit 8.000 Tokens (davon 6.000 gecacht) und 1.500 Output-Tokens kostet eine Antwort etwa 2 Cent, also rund 200 $ pro 10.000 Tickets vor Cache-Schreibvorgängen. Die Effort-Stufe verändert diese Zahl stärker als alles andere. Wenn Sie lieber pro Ticket statt pro Token zahlen möchten: Die eesel Preise rechnen jedes bearbeitete Ticket als einen Credit ab.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens
Guides

Claude Opus 5 Preise 2026: API-Kosten, Tarife, echte Rechnungen

Anthropic hat Opus 5 bei den Preisen von Opus 4.8 belassen, aber Thinking ist jetzt standardmäßig aktiviert. So viel kostet ein Claude-Opus-5-Lauf wirklich, sobald Effort und Caching mit ins Spiel kommen.

Rama AdiRama AdiJul 27, 2026
Eine Illustration, die Claude Mythos 5.1 und Fable 5.1 als dasselbe zugrunde liegende Modell hinter unterschiedlichen Sicherheitsschichten vergleicht
Trending

Claude Mythos 5.1 im Test: Lohnt sich Anthropics gesperrtes Frontier-Modell?

Ein Praxistest von Claude Mythos 5.1: was es ist, wie es sich mit Fable 5.1 vergleicht, die tatsächlichen Cache-Read-Preise, wer wirklich Zugriff bekommt und was ich statt dessen einsetzen würde.

Kurnia KharismaKurnia KharismaSep 8, 2026
Eine Illustration einer Tresortür, die von einer kleinen, freigegebenen Liste von Forschern geöffnet wird – ein Sinnbild für den Zugang zu Claude Mythos 5.1 nur auf Einladung
Trending

Claude Mythos 5.1: was es ist, wer Zugang erhält und was du stattdessen nutzen solltest

Claude Mythos 5.1 ist am 1. September 2026 erschienen, und fast niemand kann es nutzen. Hier ist das echte Datenblatt, die beiden Zugangsprogramme und das Modell, das du eigentlich einsetzen solltest.

KiraKiraSep 2, 2026
Zwei Personen prüfen Token-Zähler, Preistabellen pro Million Token und eine lange ausgedruckte Rechnung
Trending

Anthropic-API-Preise 2026: alle Tarife und die echten Kostenhebel

Die vollständige Anthropic-API-Preistabelle für jedes Claude-Modell, plus die vier Multiplikatoren, die über Ihre tatsächliche Rechnung entscheiden: Caching, Batch, Effort und zwei Aufschläge.

Kurnia KharismaKurnia KharismaAug 13, 2026
Handgezeichnete Illustration eines Support-Mitarbeiters am Laptop, der schnell einen Stapel Tickets abarbeitet, zu einem Beitrag über Claude Sonnet 5.5
Trending

Claude Sonnet 5.5: gleicher Preis, weniger Tokens und 5 Breaking Changes

Claude Sonnet 5.5 behält den Preis von Sonnet 5 (2 $/10 $), erledigt dieselbe Arbeit aber mit deutlich weniger Tokens. Was sich geändert hat, was kaputtgeht und was das für den Support bedeutet.

Riellvriany IndriawanRiellvriany IndriawanSep 29, 2026
Bannerbild für Claude Sonnet 4.6 Testbericht: Der Sweet Spot zwischen Leistung und Preis
Guides

Claude Sonnet 4.6 Testbericht: Der Sweet Spot zwischen Leistung und Preis

Claude Sonnet 4.6 von Anthropic übertrifft seine Gewichtsklasse mit erstklassiger Programmierleistung, einem 1-Millionen-Token-Kontextfenster und deutlichen Verbesserungen gegenüber Sonnet 4.5.

Stevia PutriStevia PutriFeb 26, 2026
Ein praktischer Leitfaden zur Perplexity AI API: Was Sie wissen sollten, bevor Sie beginnen zu entwickeln
Guides

Die Perplexity AI API: Was Sie vor dem Bauen wissen sollten (2026)

Die Perplexity AI API bietet Echtzeit-Antworten mit Quellenangaben, aber versteckte Kosten und Zuverlässigkeitsprobleme machen sie für den Support riskant. Erfahren Sie, warum integrierte KI-Plattformen besser funktionieren.

Kenneth PanganKenneth PanganSep 4, 2025
Handgezeichnete Illustration von zwei Personen, die eine Preisaufschlüsselung mit Dollarzeichen durchgehen
Trending

Grok 4.5 Preise: API-Tarife, SuperGrok-Kosten und versteckte Gebühren

Grok 4.5 kostet 2 $/6 $ pro 1 Million Tokens über die API und 30-300 $/Monat als Verbraucher-Abo. Hier ist die komplette Aufschlüsselung, die versteckten Gebühren und was das für Ihr Budget bedeutet.

Kurnia KharismaKurnia KharismaJul 9, 2026
Image alt text
Guides

Ein Überblick über die Preise und Funktionen von Claude Opus 4.6

Entdecken Sie unsere detaillierte Analyse der Preise von Claude Opus 4.6. Wir schlüsseln die Kosten, neuen Funktionen und praktischen Anwendungsfälle für das neueste KI-Modell von Anthropic auf.

Kurnia KharismaKurnia KharismaFeb 6, 2026

Bereit, Ihren KI-Teamkollegen einzustellen?

In Minuten eingerichtet. Keine Kreditkarte erforderlich.

Kostenlos starten