Gemini 3.5 Pro Preise: die Kosten (und was noch fehlt)

Kurnia Kharisma Agung Samiadjie
Geschrieben von

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Geprüft von

Katelin Teen

Zuletzt bearbeitet July 21, 2026

Expertengeprüft
Illustriertes Hero-Banner für einen Leitfaden zu Google Gemini 3.5 Pro Preisen und API-Kosten

Gemini 3.5 Pro ist noch nicht live, und das ist wichtig

Klären wir das zuerst, denn die Hälfte der Seiten, die für "Gemini 3.5 Pro Preise" ranken, lässt das still unter den Tisch fallen.

Die Gemini-3.5-Familie ist gestartet, nur nicht das Pro-Mitglied. Gemini 3.5 Flash ist live und stabil, ebenso Gemini 3.5 Live Translate. Aber die Pro-Stufe hinkt eine Version hinterher. Auf der DeepMind-Gemini-Übersicht zeigt die Pro-Karte ein "3.5 Pro coming soon"-Badge über einem Modell, das noch "Gemini 3.1 Pro" heißt. Es gibt keine gemini-3.5-pro-Modell-ID in den API-Dokumenten, und keine 3.5-Pro-Zeile auf der Preisseite.

Wo die Gemini-3.5-Familie gerade steht: 3.5 Flash ist erschienen, 3.5 Pro kommt bald, und 3.1 Pro ist das Pro-Modell, das du heute tatsächlich nutzt
Wo die Gemini-3.5-Familie gerade steht: 3.5 Flash ist erschienen, 3.5 Pro kommt bald, und 3.1 Pro ist das Pro-Modell, das du heute tatsächlich nutzt

Warum die Verzögerung? Google hat öffentlich gesagt, dass 3.5 Pro länger dauert, weil an den Fähigkeiten des Modells gearbeitet wird, insbesondere beim Coding. Auf Hacker News ist die Verzögerung der lauteste Thread im Raum:

Hacker News

"Gegen Ende 2025 war Google an der Spitze - bestes LLM (Gemini 3 Pro), bestes Videomodell (Veo 3.1) und bestes Bildmodell (Nano Banana). Sie schienen unaufhaltsam. Und dann haben sie aufgehört."

Die praktische Erkenntnis: Wenn eine Seite dir einen exakten Gemini-3.5-Pro-Preis oder eine Benchmark-Tabelle liefert, ist das eine Vermutung. Die einzigen Zahlen, die es heute wert sind, für ein Budget herangezogen zu werden, sind die aktuellen Gemini 3.1 Pro-Sätze. Also werde ich diese verwenden und klar kennzeichnen, wo 3.5 Pro voraussichtlich landen wird.

Gemini 3.1 Pro Ankündigungsgrafik, das aktuelle Pro-Flaggschiff bis 3.5 Pro erscheint, entnommen von Google DeepMind
Gemini 3.1 Pro Ankündigungsgrafik, das aktuelle Pro-Flaggschiff bis 3.5 Pro erscheint, entnommen von Google DeepMind

Der aktuelle Pro-Preis: Gemini 3.1 Pro API-Sätze

Hier ist das Modell, für das du heute tatsächlich bezahlen würdest, wenn du auf der Pro-Stufe entwickelst. Gemini 3.1 Pro ist das einzige Familienmitglied mit kontextlängen-gestaffelten Preisen: Prompts bis 200k Tokens sind günstiger als Prompts darüber. Jedes Modell veröffentlicht außerdem vier Service-Stufen, sodass der "Pro-Preis" davon abhängt, wie du ihn aufrufst.

StufeInput ≤200kInput >200kOutput ≤200kOutput >200kCached InputCache-Speicher
Standard$2.00$4.00$12.00$18.00$0.20 / $0.40$4.50 /1M/Std.
Batch$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/Std.
Flex$1.00$2.00$6.00$9.00$0.20 / $0.40$4.50 /1M/Std.
Priority$3.60$7.20$21.60$32.40$0.36 / $0.72$8.10 /1M/Std.

Alle Zahlen sind pro 1 Mio. Tokens, in USD, aus dem Abschnitt Gemini 3.1 Pro Preview von Googles Preisseite. Es gibt keine kostenlose Stufe für Pro, was erwähnenswert ist: Die kostenlose API-Stufe deckt nur Flash und Flash-Lite ab.

Ein paar Dinge, über die Leute stolpern:

  • Output umfasst Thinking. Gemini 3.1 Pro ist ein Reasoning-Modell, daher werden die Tokens, mit denen es "denkt", zum Output-Satz abgerechnet. Bei einem schwierigen Prompt kann das Thinking die sichtbare Antwort in den Schatten stellen, weshalb Output das 6-Fache des Input-Preises kostet.
  • Batch und Flex halbieren deine Rechnung, wenn du eine Verzögerung tolerieren kannst. Batch läuft asynchron; Flex ist für Traffic mit niedrigerer Priorität. Beide senken die Standard-Sätze von 2 $/12 $ auf 1 $/6 $.
  • Priority kostet 80 % mehr für garantiert niedrige Latenz. Wenn du Live-Nutzer bedienst, bist du wahrscheinlich hier und nicht bei Standard.

Am günstigeren Ende der Familie kostet Gemini 3.5 Flash 1,50 $ Input / 9,00 $ Output auf Standard, und Gemini 3.1 Flash-Lite ist mit 0,25 $ Input / 1,50 $ Output die Budget-Option. Wenn du das komplette Raster über alle Modelle willst, hält unser Gemini-Preisvergleich die vollständige Tabelle aktuell.

Wie die Gemini 3.5 Pro Preise vermutlich aussehen werden

Google hat sie nicht veröffentlicht, also erfinde ich sie nicht. Aber das Muster über die letzten Pro-Releases hinweg war stabil: kontextgestaffelte Preise in derselben Größenordnung wie das vorherige Pro-Modell, wobei das neue Modell das alte zu ähnlichen oder leicht höheren Sätzen ersetzt. Folgt 3.5 Pro diesem Muster, ist etwas nahe der aktuellen Spanne von 2 $ bis 4 $ Input und 12 $ bis 18 $ Output zu erwarten, möglicherweise mit einem Aufschlag für eine stärkere Reasoning-Stufe. Wer gerade eine präzise 3.5-Pro-Zahl nennt, liest aus dem Kaffeesatz.

Gemini-Verbraucherpreise: die Google-AI-Pläne

Wenn du nicht auf der API entwickelst und einfach nur Gemini in der App, in Gmail und in Docs willst, bist du auf einem Google-One-AI-Plan. Google hat diese nach der I/O 2026 umbenannt, ignoriere also ältere Artikel, die "7,99 $ AI Premium" zitieren. Hier sind die aktuellen Zahlen von one.google.com:

PlanPreisSpeicherWas du bekommst
Free0 $15 GBGemini 3.5 Flash, begrenztes 3.1 Pro, Bilderzeugung, Deep Research
Google AI Plus4,99 $/Monat400 GBHöhere Limits, Gemini 3.1 Pro, YouTube Premium Lite
Google AI Pro19,99 $/Monat5 TB4x höhere Limits, 10 $/Monat Cloud-Guthaben, Jules, Antigravity
Google AI Ultra (5x)99,99 $/Monat20 TB5x Nutzung gegenüber Pro, Deep Think, 40 $/Monat Cloud-Guthaben
Google AI Ultra (20x)199,99 $/MonatAm höchsten20x Nutzung, überall die höchsten Limits, 100 $/Monat Cloud-Guthaben

Was auffällt: Mehr zu zahlen kauft dir vor allem mehr Nutzung desselben Pro-Modells, nicht ein klügeres. AI Plus und AI Ultra laufen beide auf Gemini 3.1 Pro; Ultra lässt dich es nur weit häufiger nutzen und schaltet Deep-Think-Reasoning frei. Wenn du ein Einzelnutzer bist, der gelegentlich an Limits stößt, ist AI Pro für 19,99 $ der Sweet Spot. Wenn du ein Team bist, das echte Arbeit kalkulieren will, sind die Verbraucherpläne nicht deine Antwort, und ich komme gleich dazu, warum.

Wie sich diese Pläne im Vergleich zum Rest des Marktes schlagen, haben wir in direkten Vergleichen aufgearbeitet: Gemini vs. Perplexity, ChatGPT vs. Gemini und eine breitere Auswahl an Gemini-Alternativen.

Gemini unternehmensweit auszurollen wird wieder anders bepreist. Wenn dein Team auf Google Workspace läuft, sind die Workspace-Preise die richtige Lektüre, und unser Gemini-3-Preisvergleich deckt die Zahlen auf Generationsebene ab.

Die API-Rechnung, die deine Kosten wirklich bestimmt

Das ist der Teil, den die meisten Preis-Beiträge auslassen, und der Teil, der zählt. Ein Preisschild von 2 $ / 1 Mio. Input-Tokens fühlt sich günstig an. Dann gehst du live, und die Rechnung sieht deiner Schätzung überhaupt nicht ähnlich. Hier kommt die Lücke her.

Preisschild-Tokenpreis versus deine echten Kosten: Thinking-Tokens, Search Grounding und Wiederholungen liegen alle dazwischen
Preisschild-Tokenpreis versus deine echten Kosten: Thinking-Tokens, Search Grounding und Wiederholungen liegen alle dazwischen

Gib deine eigenen Zahlen ein. Dieser Rechner nutzt die aktuellen Gemini-3.1-Pro-Standard-Sätze (die derzeitige Pro-Stufe), damit du siehst, wie Token-Volumen zu einer monatlichen Rechnung wird:

Lässt man die Standardwerte laufen mit einer support-großen Auslastung (10.000 Konversationen, ~6k Input- und ~1,5k Output-Tokens je Konversation), landet man bei etwa 440 $/Monat an Tokens und Grounding. Das ignoriert bereits die teuren Teile:

  • Thinking-Tokens sind unvorhersehbar. Du kontrollierst nicht, wie lange das Modell nachdenkt, und jeder dieser Tokens wird zu Output-Sätzen abgerechnet.
  • Grounding summiert sich schnell. Search Grounding ist für die ersten 5.000 Prompts pro Monat über die gesamte Gemini-3-Familie kostenlos, danach 14 $ pro 1.000 Anfragen. Eine Suche pro Ticket bei entsprechendem Volumen ist ein echter Posten.
  • Wiederholungen und fehlgeschlagene Tool-Aufrufe. Das ist derjenige, der wirklich wehtut. Auf Hacker News gibt es konkrete Beschwerden zur agentischen Nutzung von Gemini:
Hacker News

"Es ist nicht nur unterdurchschnittlich, es ist nicht mal unter-unterdurchschnittlich. Es gerät in Schleifen und schließt eine Aufgabe 8 von 10 Malen, die ich es genutzt habe, nie ab."

Jede Schleife wird abgerechnet. Der Preisschild-Preis geht von einem sauberen Durchlauf aus; die Produktion liefert selten nur einen.

Wie Gemini 3.1 Pro abschneidet (da du dafür bezahlst)

Preis bedeutet nur etwas neben Fähigkeit. Gemini 3.1 Pro ist bei den Zahlen, die Google veröffentlicht, wirklich stark, und die Community bestätigt vieles davon für Nicht-Coding-Arbeit.

Googles eigene Benchmark-Tabelle für die Gemini-3.5-Familie mit hervorgehobenem 3.5 Flash und Gemini 3.1 Pro daneben, entnommen von Google DeepMind
Googles eigene Benchmark-Tabelle für die Gemini-3.5-Familie mit hervorgehobenem 3.5 Flash und Gemini 3.1 Pro daneben, entnommen von Google DeepMind

Bei Googles eigenen Evals führt Gemini 3.1 Pro (Thinking High) bei GPQA Diamond (94,3 %), Humanity's Last Exam (44,4 %), ARC-AGI-2 (77,1 %), LiveCodeBench Pro (2887 Elo) und BrowseComp (85,9 %). Bei SWE-Bench Verified gibt es den Spitzenplatz ab, mit 80,6 % gegenüber Claude Opus 4.6 mit 80,8 %. Das ist bei jeder Betrachtung ein starkes Flaggschiff, und das verzögerte 3.5 Pro soll es noch weiter voranbringen.

Die gelebte Erfahrung ist gemischter, und ehrlich. Nutzer bewerten Gemini für schnellen, faktenbasierten Chat sehr gut:

Hacker News

"Nach meiner Erfahrung ist Gemini 3.0 Pro deutlich besser als ChatGPT 5.2 bei Nicht-Coding-Aufgaben. Letzteres gibt mir ständig eindeutig falsche Informationen, ersteres sehr selten."

Aber der wiederkehrende Kritikpunkt, und der Grund, warum der 3.5-Pro-Umbau so lange dauert, ist die Zuverlässigkeit unter Last:

Hacker News

"Man wird von den Halluzinationen gebrannt, die Gemini täglich beiläufig ausspuckt. Man entwickelt die Gewohnheit, jede einzelne Antwort faktenzuchecken."

Diese Lücke zwischen Benchmark und Verhalten ist genau der Grund, warum die reine Modellwahl die falsche erste Frage für ein Support-Team ist. Für ausführlichere Vergleiche siehe unsere Gegenüberstellungen Gemini 3 Pro vs. Claude Opus 4.6 und Gemini vs. Mistral.

Welcher Gemini-Preis wirklich auf dich zutrifft

Drei unterschiedliche Käufergruppen landen auf dieser Seite, und sie brauchen drei unterschiedliche Antworten.

Entscheidungsbaum dafür, welcher Gemini-Preis zutrifft: Chatten in der App führt zu Google-AI-Plänen, Entwickeln auf der API führt zu Preis pro Token, Support automatisieren führt zu Preis pro Lösung
Entscheidungsbaum dafür, welcher Gemini-Preis zutrifft: Chatten in der App führt zu Google-AI-Plänen, Entwickeln auf der API führt zu Preis pro Token, Support automatisieren führt zu Preis pro Lösung
  • Du willst einfach nur chatten. Wähle einen Google-AI-Plan. Free reicht für gelegentliche Nutzung; AI Pro für 19,99 $ deckt die meisten Power-User ab; Ultra ist für intensive tägliche Nutzung.
  • Du baust ein Produkt auf dem Modell auf. Du bist bei Preis-pro-Token-API-Preisen, und der Rechner oben ist dein Freund. Budgetiere für Thinking-Tokens und Grounding, nicht nur für den Input-Satz.
  • Du willst damit Kundensupport betreiben. Hier wird Preis-pro-Token still zu einer schlechten Passform, und das ist der Punkt, bei dem ich am stärksten widersprechen würde. Ein zweckgebautes KI-Kundenservice-Tool oder ein KI-Helpdesk-Chatbot passt dafür besser als rohe Tokens.

Hier liegt das Problem. Wenn du rohe Modell-Tokens für den Support kaufst, baust du alles obendrauf: die Retrieval-Pipeline, die Guardrails, die Eskalationslogik, das Monitoring, die Retry-Handhabung. Deine Rechnung skaliert mit dem Token-Volumen, was bedeutet, dass ein arbeitsreicher Support-Monat auch ein teurer, unvorhersehbarer ist. Das ist das Gegenteil dessen, was ein Support-Budget will. Wir haben den echten Kostenvergleich aufgeschrieben, wenn du das vollständige Bild willst, und die Kennzahlen, die wirklich zählen, um zu beurteilen, ob es funktioniert.

Probiere eesel AI für den Support statt Tokens zu bepreisen

Wenn du hier gelandet bist, weil du Gemini für den Kundensupport evaluierst, ist die Token-Rechnung die falsche Tabelle. Ich habe die letzten Jahre damit verbracht, KI-Agenten zu bauen, die auf laufenden Support-Queues sitzen, und die Lektion, die sich immer wiederholt, ist diese: das Modell ist der billige Teil, und die Pipeline drumherum ist dort, wo die echten Kosten und Risiken liegen.

eesel AI geht einen anderen Weg. Es läuft auf Frontier-Modellen (derselben Stufe wie Gemini Pro), aber du zahlst nicht pro Token oder pro Sitzplatz, sondern pro Lösung, sodass die Rechnung Ergebnissen folgt statt Nutzung, die du nicht kontrollieren kannst. Es klinkt sich in dein bestehendes Helpdesk ein und trainiert in Minuten auf deinen vergangenen Tickets und deiner Wissensdatenbank, und weil wir gesehen haben, wie selbstbewusste Bots falsche Antworten geben, wird jeder Rollout zuerst gegen deine historischen Tickets simuliert, sodass du die Lösungsrate siehst, bevor sie je einen Kunden erreicht.

eesel AI Reports-Dashboard mit Lösungs- und Nutzungsanalysen für Support-Automatisierung
eesel AI Reports-Dashboard mit Lösungs- und Nutzungsanalysen für Support-Automatisierung

Das ist der Unterschied zwischen der Bepreisung eines Modells und der Bepreisung eines Ergebnisses. Du kannst eesel kostenlos testen und die Preise in Einheiten sehen, in denen du wirklich budgetierst, oder eintauchen in wie diese Agenten in der Praxis aussehen.

Häufig gestellte Fragen

Wie viel kostet Gemini 3.5 Pro?
Es gibt noch keinen Gemini 3.5 Pro Preis, weil das Modell noch nicht erschienen ist. Googles eigene Pro-Seite zeigt weiterhin ein "3.5 Pro coming soon"-Badge, und die aktuelle Pro-Stufe bleibt Gemini 3.1 Pro zu 2 $ pro Million Input-Tokens und 12 $ pro Million Output-Tokens auf der Standard-API-Stufe. Die vollständige Aufschlüsselung der restlichen Familie findest du in unserem Gemini-Preisvergleich.
Ist Gemini 3.5 Pro bereits verfügbar?
Nicht Mitte 2026. Die 3.5-Generation ist als Gemini 3.5 Flash und Live Translate erschienen, aber das Pro-Mitglied wird noch als "coming soon" geführt, während das aktuelle Flaggschiff, das du wirklich nutzt, Gemini 3.1 Pro (Preview) ist.
Wie werden die API-Preise von Gemini 3.5 Pro voraussichtlich aussehen?
Google hat sie nicht veröffentlicht. Folgt es dem jüngsten Pro-Muster, sind kontextgestaffelte Preise nahe den aktuellen 3.1-Pro-Sätzen zu erwarten (2 $ bis 4 $ Input, 12 $ bis 18 $ Output pro Million Tokens). Behandle jede konkrete 3.5-Pro-Zahl, die du woanders siehst, bis zur Veröffentlichung auf der offiziellen Preisseite als Vermutung.
Wie viel kostet Gemini für den privaten Gebrauch pro Monat?
Die Google-AI-Pläne reichen von 4,99 $/Monat (AI Plus) über 19,99 $/Monat (AI Pro) bis 99,99 $ und 199,99 $/Monat (AI Ultra), zusätzlich gibt es eine kostenlose Stufe. Höhere Pläne kaufen vor allem mehr Nutzung desselben Pro-Modells, nicht ein anderes. Für Teams lohnt sich stattdessen ein Vergleich mit den ergebnisbasierten Kosten.
Lohnen sich Gemini 3.5 Pro Preise für den Kundensupport?
Der Token-Preis ist nur ein Teil der Rechnung. Sobald du Thinking-Tokens, Search Grounding zu 14 $ pro 1.000 Anfragen, Wiederholungen und Engineering dazurechnest, liegen die realen Kosten weit über dem Preisschild. Ein Tool mit Preis pro Lösung wie eesel AI bepreist das Ergebnis statt der Tokens, was sich leichter für Support-Automatisierung budgetieren lässt.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Gemini 3.5 Pro Test Hero-Banner in Google-Blau
Trending

Gemini 3.5 Pro im Test: der ehrliche Stand von Googles Flaggschiff

Ein ehrlicher Gemini 3.5 Pro Test: Es ist noch nicht erschienen. Hier ist, was Google bestätigt hat, warum es sich verzögert, welche Benchmarks es wirklich gibt und was du heute nutzen solltest.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 21, 2026
Image alt text
Guides

Gemini 3 Pro vs. Claude Opus 4.6: Ein praktischer Vergleich

Dieser Leitfaden bietet einen direkten, praktischen Einblick in Gemini 3 Pro und Claude Opus 4.6. Wir lassen den Hype beiseite und konzentrieren uns auf die realen Unterschiede, die zählen, wenn Sie diese Tools einsetzen.

Stevia PutriStevia PutriFeb 6, 2026
GPT-5.6 gegen Gemini 3 Vergleichs-Hero-Illustration, zwei KI-Modellfamilien im Gleichgewicht gegeneinander
Trending

GPT-5.6 vs Gemini 3: welches KI-Modell gewinnt 2026?

GPT-5.6 vs Gemini 3 im Vergleich: Sol, Terra und Luna gegen Gemini 3.5 Flash und 3.1 Pro bei Preis, Benchmarks, Kontext und Eignung für KI-Support-Agenten.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Gemini vs Claude: Welches KI-Modell ist 2025 das richtige für Sie?
Guides

Gemini vs Claude: Welches KI-Modell ist 2025 das richtige für Sie?

Gemini vs Claude: Erforschen Sie die Stärken, Unterschiede und Hauptmerkmale jedes KI, um herauszufinden, welche am besten zu Ihren Bedürfnissen passt.

Stevia PutriStevia PutriAug 22, 2025
Editorial-Illustration, die einen Vergleich von KI-Modellen als Alternativen zu Inkling darstellt
Trending

8 beste Inkling-Alternativen 2026

Inkling ist offen und interessant, aber für ein Open-Weights-Modell teuer und nicht das klügste Modell, das du betreiben kannst. Hier sind die 8 Alternativen, die ich tatsächlich ausprobieren würde, mit echten Preisen und dem jeweiligen Vorteil.

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
Illustration von Inkling, dem im Test befindlichen offenen KI-Modell von Thinking Machines Lab
Trending

Inkling im Test: Lohnt sich das offene Modell von Thinking Machines?

Ein ehrlicher Inkling-Test: Wofür das erste offene Modell von Thinking Machines Lab wirklich gut ist, wo Preis und Benchmarks enttäuschen, und wer es tatsächlich einsetzen sollte.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Illustration von Inkling, dem Open-Weights-KI-Modell von Thinking Machines Lab
Trending

Inkling erklärt: Thinking Machines' Open-Weights-KI-Modell

Was Inkling wirklich ist: das erste Open-Weights-Modell von Thinking Machines Lab, seine echten Benchmarks, was der Betrieb kostet und ob es überhaupt etwas in einer Support-Queue zu suchen hat.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Illustration von Google NotebookLM, das Dokumente in eine kurze vertikale Videoübersicht verwandelt
Trending

NotebookLM Kurzvideo-Übersichten: das 60-Sekunden-Format erklärt

NotebookLMs neue Short Video Overviews verwandeln deine Quellen in einen 60-sekündigen vertikalen Clip. Hier ist, was das Format kann, wie es gebaut ist und wo es an seine Grenzen stößt.

Alicia Kirana UtomoAlicia Kirana UtomoJul 11, 2026
PromptQL-Alternativen Titelbild auf indigofarbenem Hintergrund
Trending

Die 8 besten PromptQL-Alternativen 2026

Die 8 besten PromptQL-Alternativen 2026, von Databricks Genie bis zum Open-Source-Tool Wren AI, mit echten Preisen, Stärken und dazu, für wen sich jede Option wirklich eignet.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026

Bereit, Ihren KI-Teamkollegen einzustellen?

In Minuten eingerichtet. Keine Kreditkarte erforderlich.

Kostenlos starten