Exa Agent Ultra Preise: Was Deep Research 2026 wirklich kostet

Rama Adi
Geschrieben von

Rama Adi

Katelin Teen
Geprüft von

Katelin Teen

Zuletzt bearbeitet September 27, 2026

Expertengeprüft
Illustration des Deep-Research-Agenten von Exa, der strukturierte Daten aus dem gesamten Web zusammenträgt

Was Exa Agent Ultra eigentlich ist

Exa begann als Metaphor, ein YC-S21-Unternehmen, das embeddingsbasierte Websuche baute, und wuchs zu einer Websuche- und Crawling-API heran, die KI-Produkte im Hintergrund aufrufen. Cursor etwa nutzt Exa, um die neuesten Dokumentationen in seinen Coding-Agenten zu holen. Der Exa Agent ist die Schicht über der reinen Suche: ein asynchroner Endpunkt, der eine Anfrage in natürlicher Sprache plus ein Ausgabeschema entgegennimmt, dann eigene Suchen auffächert, die dahinterliegenden Seiten liest, Kandidaten verifiziert und strukturiertes, mit Quellen belegtes JSON zurückgibt.

Ultra ist kein eigenes Produkt. Es ist die oberste Stufe des effort-Reglers von Exa Agent. Mit effort: "ultra" koordiniert der Agent viele Subagenten über Tausende von Quellen und setzt Frontier-Modelle dort ein, wo die Aufgabe schwierig ist, und schnellere, wo sie ausreichen. Exa positioniert es für Aufgaben, die bis zur Erschöpfung laufen müssen: eine vollständige Marktlandkarte erstellen, jede Zeile einer Liste anreichern oder ein schwer prüfbares Kriterium über Einreichungen, Presse und Behördenseiten hinweg verifizieren.

Die Launch-Botschaft war unverblümt: "Frontier-Qualität zu einem Bruchteil der Kosten". Das ist ebenso eine Preisaussage wie eine Qualitätsaussage, und genau deshalb ist die Abrechnung nach Nutzung wichtig.

Was kostet Exa Agent Ultra also?

Hier die ehrliche Antwort, die Exas Marketingseite auf eine Spanne verkürzt: Die Agent API hat sieben Effort-Stufen, und nur fünf davon haben einen festen Preis. auto und ultra werden nutzungsbasiert abgerechnet.

Die Effort-Leiter von Exa Agent, vom Festpreis minimal mit 0,012 $ pro Anfrage bis zur nutzungsbasierten Ultra-Stufe mit 20-$-Standardlimit
Die Effort-Leiter von Exa Agent, vom Festpreis minimal mit 0,012 $ pro Anfrage bis zur nutzungsbasierten Ultra-Stufe mit 20-$-Standardlimit
Effort-StufePreisAm besten für
minimal0,012 $ / AnfrageEnge Faktenabfragen, kurze Antworten
low0,025 $ / AnfrageEinfache Abfragen, leichte Recherche
medium0,10 $ / AnfrageStandard für normale Recherche
high0,50 $ / AnfrageSchwierigere Recherche, strengere Vollständigkeit
xhigh1,00 $ / AnfrageHochwertige Aufgaben, komplexe Schemas
autoNutzungsbasiert, bis zu einem Standardlimit von 5 $Aufgaben mit variablem Umfang, wenn Sie den Schwierigkeitsgrad nicht kennen
ultraNutzungsbasiert, bis zu einem Standardlimit von 20 $Umfangreiches Listenaufbauen, erschöpfende Recherche

Die ehrliche Schlagzeile für Ultra lautet also "nutzungsbasiert, standardmäßig auf 20 $ pro Lauf begrenzt". Das Limit ist eine Obergrenze, keine feste Gebühr: Ein Lauf, der früh endet, kostet weniger, und Sie legen Ihr eigenes Limit mit budget.maxCostDollars fest (zulässiger Bereich 1 $ bis 100 $). Die Agent-Dokumentation bestätigt dieselben Zahlen, es handelt sich also nicht um Marketing-Rundung.

Die Designentscheidung verdient Beachtung. Jede andere Effort-Stufe berechnet eine Pauschale, egal ob die Aufgabe trivial oder knifflig war. Ultra berechnet, wie auto, nur die Rechenleistung und Werkzeuge, die ein Lauf tatsächlich verbraucht. Bei den erschöpfenden Aufgaben, auf die Ultra zielt und bei denen eine Anfrage Dutzende Subagenten starten kann, macht dieses nutzungsbasierte Modell den Unterschied zwischen planbar und schmerzhaft.

Der nutzungsbasierte Teil in klaren Zahlen

Wenn ein Lauf nutzungsbasiert abgerechnet wird, bestimmen zwei Komponenten die Rechnung, mit der Anreicherung als optionaler dritter Position.

Wofür ein Lauf von Exa Agent Ultra berechnet wird: Compute Units zu je 0,10 $, Suchaufrufe zu je 0,005 $, E-Mail- und Telefon-Anreicherung, alles unter einem 20-$-Standardlimit
Wofür ein Lauf von Exa Agent Ultra berechnet wird: Compute Units zu je 0,10 $, Suchaufrufe zu je 0,005 $, E-Mail- und Telefon-Anreicherung, alles unter einem 20-$-Standardlimit
KomponenteSatzWas gemessen wird
Agent Compute Units (ACU)0,10 $ / ACUModellberechnung über den gesamten Lauf
Suchaufrufe0,005 $ / SucheJede Websuche, die der Agent auslöst
E-Mail-Anreicherung0,02 $ / E-MailAbfragen von Kontakt-E-Mails
Telefon-Anreicherung0,07 $ / TelefonnummerAbfragen von Kontakttelefonnummern

Die tragende Kennzahl ist usage.agentComputeUnits. Exa stellt klar, dass komplexe Anfragen, besonders mit einem großen input.data-Feld, mehr Denkschritte brauchen und mehr ACUs verbrauchen. Eine breite, urteilsintensive Anreicherung ("verkauft dieses Unternehmen an Krankenhäuser, mit einer URL als Beleg") verbrennt also weit mehr als eine gezielte Faktenabfrage.

Ein paar durchgerechnete Beispiele:

  • Ein mittlerer Ultra-Lauf mit 60 ACUs und 80 Suchen kostet 60 x $0.10 + 80 x $0.005 = $6.40. Deutlich unter dem 20-$-Limit.
  • Ein umfangreicher Listenaufbau mit 150 ACUs und 300 Suchen kostet 150 x $0.10 + 300 x $0.005 = $16.50, noch unter dem Limit, vor jeglicher Anreicherung.
  • Fügen Sie diesem umfangreichen Lauf 200 E-Mail-Abfragen hinzu, landen Sie bei $16.50 + $4.00 = $20.50, das 20-$-Limit würde ihn also kappen (die Anreicherung liegt außerhalb des Kernzählers, prüfen Sie hier also Ihre Budgeteinstellungen).

Setzen Sie unten Ihre eigenen Zahlen ein.

Wo Ultra in Exas übrigem Preisgefüge steht

Exa Agent ist ein Produkt auf einer breiteren Speisekarte. Wenn Sie Ultra durchrechnen, hilft ein Blick auf die Nachbarn, denn viele Teams greifen zur günstigeren Search API und orchestrieren ihre eigene Schleife, statt Agent dafür zu bezahlen.

EndpunktBasispreis (bis zu 10 Ergebnisse)Pro zusätzlichem ErgebnisKI-Seitenzusammenfassungen
Search7 $ / 1k Anfragen1 $ / 1k+1 $ / 1k Seiten
Deep Search12 $ / 1k Anfragen1 $ / 1k+1 $ / 1k Seiten
Deep-Reasoning Search15 $ / 1k Anfragen1 $ / 1k+1 $ / 1k Seiten
Contents1 $ / 1k Seiten-+1 $ / 1k Seiten
Monitors15 $ / 1k Anfragen1 $ / 1k-
Answer5 $ / 1k Anfragen--

Der Kompromiss ist die klassische Abwägung zwischen Selbstbauen und Kaufen. Die reine Suche für 7 $ pro 1.000 Anfragen ist günstig, aber Sie schreiben die Schleife selbst: die Suchen, das Lesen der Seiten, die Verifizierung, die Schemavalidierung. Agent Ultra bündelt all das in einem nutzungsbasierten Aufruf. Sie bezahlen für Orchestrierung, nicht nur für Retrieval.

Auf der Kontoseite regeln drei Tarife den Zugang:

TarifPreisHighlights
StarterKostenlos10 $ Guthaben/Monat + 10 $ Onboarding-Bonus, keine Karte, 10 Such-QPS, 50 Agent-Parallelität
DeveloperPay as you goNutzungsbasierte Abrechnung, bis zu 25 Such-QPS, SOC 2 Type II
EnterpriseIndividuellZero Data Retention, HIPAA, SSO/SCIM, bis zu 1.000 Ergebnisse pro Suche

Das kostenlose Guthaben reicht, um Ultra ein paar Mal auszuführen, bevor Sie sich festlegen. Das ist der richtige Weg, Ihren eigenen ACU-Verbrauch abzuschätzen, bevor Sie dem Rechner oben vertrauen.

Exa Connect: das Add-on, das obendrauf kommt

Ein leicht zu übersehender Punkt: Wenn Ihr Ultra-Lauf über Exa Connect auf Premium-Datenpartner zugreift, wird das zusätzlich zur Agent-Nutzung berechnet. Zu den Self-Serve-Anbietern gehören Similarweb, Financial Datasets und Fiber.ai, ZoomInfo, Crunchbase und Harmonic sind auf Anfrage verfügbar.

Für ein Go-to-Market-Team, das eine angereicherte Account-Liste aufbaut, kann hier der echte Preis eines Laufs über den Basiszähler hinausdriften, weil Sie nun Exas Rechenleistung und den Datentarif eines Dritten bezahlen. Bring-your-own-key wird für jeden Anbieter unterstützt. Wenn Sie also bereits ZoomInfo bezahlen, zahlen Sie die Daten selbst nicht doppelt. Es lohnt sich, das durchzurechnen, bevor Sie annehmen, das 20-$-Limit sei Ihre Obergrenze.

Lohnt sich Ultra?

Exas gesamtes Argument lautet, dass das nutzungsbasierte Modell Ihnen Frontier-Qualität günstiger bietet als der Agent eines Frontier-Modells selbst. Beim WANDR-Benchmark (Wide And Deep Research, angelehnt an Due-Diligence- und Rechtsrecherche-Anreicherung) beansprucht Ultra den Stand der Technik.

Exas Benchmark-Tabelle, die Agent Ultra mit Opus 5.5, GPT-6 Astra und Perplexity Agent bei WANDR, DeepSearchQA, WideSearch und Find-All Company vergleicht
Exas Benchmark-Tabelle, die Agent Ultra mit Opus 5.5, GPT-6 Astra und Perplexity Agent bei WANDR, DeepSearchQA, WideSearch und Find-All Company vergleicht

Die konkreten Behauptungen, jeweils gemessen an der maximalen Effort-Einstellung des Konkurrenten:

  • WANDR: +12,6 % gegenüber Opus 5.5, bei halben Kosten pro Aufgabe von Opus 5.5.
  • DeepSearchQA: +21,0 % gegenüber Opus 5.5 und +10,1 % gegenüber GPT-6 Astra, bei 46 % niedrigeren Kosten pro Aufgabe als GPT-6 Astra.
  • WideSearch: +14,1 % gegenüber Opus 5.5, bei den niedrigsten Kosten pro Aufgabe der vier Systeme.
  • Find-All Company: +1579 % gegenüber Opus 5.5 bei gefundenen bestandenen Entitäten, bei den niedrigsten Kosten pro Entität.
Exas WANDR-Diagramm, das Soft Recall gegen die durchschnittlichen Kosten pro Aufgabe aufträgt, wobei Exa Agent von Auto bis Ultra Opus 5.5, GPT-6 Astra und Perplexity Agent schlägt
Exas WANDR-Diagramm, das Soft Recall gegen die durchschnittlichen Kosten pro Aufgabe aufträgt, wobei Exa Agent von Auto bis Ultra Opus 5.5, GPT-6 Astra und Perplexity Agent schlägt

Zwei ehrliche Vorbehalte. Das sind Exas eigene Zahlen auf Exas eigenem Testaufbau. Exa sagt, es nenne veröffentlichte Werte, wo Konkurrenten welche hatten, und habe den Benchmark sonst selbst ausgeführt, und es habe ein günstigeres Bewertungsmodell (gpt-6-luna) eingesetzt. All das ist vernünftig, bleibt aber herstellergeführt. Besonders die Abstände bei Find-All Company sind so groß, dass sie mehr darüber aussagen, wie schlecht universelle Agenten mit erschöpfendem Listenaufbau umgehen, als über einen Qualitätsvorsprung im direkten Vergleich. Lesen Sie sie als "Ultra ist wirklich für breite Recherche gebaut, und allgemeine Chat-Agenten sind es nicht", was ein fairer und nützlicher Schluss ist.

Was Entwickler über Exas Kosten sagen

Die Preisdebatte um Exa gab es schon vor Ultra. Beim Launch HN des Unternehmens (412 Punkte, 133 Kommentare) war Gründer Will Bryk offen, warum das umfangreichere Produkt hinter einem Login liegt statt kostenlos zu sein:

Hacker News

"we'd love to make the product as accessible and cheap as possible, but as of state of AI costs of 2025, it's a very expensive product to run and so we have it login gated."

Das ist der nützliche Kontext für Ultras Abrechnung. Tiefe, erschöpfende Webrecherche ist teuer im Betrieb, und Exas Antwort ist, diese Kosten offen zu zeigen und zu begrenzen, statt sie hinter einer Pauschale zu verstecken, die entweder Wenignutzer überzahlen lässt oder bei Vielnutzern Verlust bringt. Das 20-$-Limit leistet dabei viel im Stillen: Es ist das Versprechen, dass "bis zur Erschöpfung laufen" nicht "bis zur Erschöpfung abrechnen" bedeutet.

eesel: ein Teammitglied, keine Engine zum Anbinden

Zum Schluss ein Perspektivwechsel. Exa Agent Ultra ist Infrastruktur. Es ist eine wirklich starke Deep-Research-Engine, gibt Ihnen aber eine API und ein Schema und erwartet, dass Sie die Pipeline bauen, die Läufe abfragen, die Ausgabe validieren und alles dort anbinden, wo die Arbeit tatsächlich stattfindet. Das ist das richtige Werkzeug, wenn Sie Entwickler sind und Listenaufbau oder Anreicherung in Ihr eigenes Produkt einbauen.

Das eesel-Onboarding-Dashboard zeigt, wie ein Helpdesk-KI-Teammitglied für den Einsatz in Zendesk, Slack und über einen teilbaren Chat-Link eingerichtet wird, aufgenommen aus eesel
Das eesel-Onboarding-Dashboard zeigt, wie ein Helpdesk-KI-Teammitglied für den Einsatz in Zendesk, Slack und über einen teilbaren Chat-Link eingerichtet wird, aufgenommen aus eesel

Wenn Sie eigentlich das Ergebnis wollen, verkauft eesel die andere Hälfte der Gleichung: einsatzbereite KI-Teammitglieder, die Sie für eine Aufgabe einstellen, keine Engine, die Sie zusammenbauen. Das KI-Helpdesk-Teammitglied steigt in Ihre bestehende Warteschlange ein, lernt am ersten Tag aus Ihren bisherigen Tickets und dem Help Center und entwirft oder versendet automatisch Antworten in Zendesk, Freshdesk oder Slack. Der KI-Blog-Autor macht dasselbe für Content. Jeder kommt mit den Fähigkeiten, Integrationen und dem Unternehmenskontext für seine Rolle, sodass kein Schema zu entwerfen ist.

Exa Agent ist eine Recherche-Engine, die Sie selbst anbinden; eesel ist ein einsatzbereites Teammitglied, das in Minuten eingestellt ist und in Ihrem Helpdesk arbeitet
Exa Agent ist eine Recherche-Engine, die Sie selbst anbinden; eesel ist ein einsatzbereites Teammitglied, das in Minuten eingestellt ist und in Ihrem Helpdesk arbeitet

Und wenn Sie tatsächlich im Terminal leben, holt eesel Sie auch dort ab. Das eesel CLI steuert dasselbe Teammitglied wie das Dashboard: npx @eesel/cli init chat-bubble --site https://your-site.com richtet einen Workspace ein, und jeder Befehl gibt JSON mit einem hint-Feld aus, das einem Agenten sagt, was als Nächstes auszuführen ist. Dadurch ist es nicht nur von Menschen, sondern auch von Coding-Agenten wie Claude Code, Cursor und Codex steuerbar, und jeder Workspace ist über eesel mcp token zugleich ein MCP-Server. Sie erhalten also dieselbe agentische, skriptbare Kontrolle, die Ihnen Exas API bietet, nur dass das, was Sie skripten, ein Teammitglied ist, das Ihr Geschäft schon kennt, und keine Recherche-Pipeline, die Sie erst noch bauen müssen. Es ist kostenlos testbar, ohne Karte.

Häufig gestellte Fragen

Was kostet ein Lauf von Exa Agent Ultra?
Es gibt keinen festen Preis pro Lauf. Exa Agent Ultra wird nutzungsbasiert abgerechnet: Sie zahlen 0,10 $ pro Agent Compute Unit und 0,005 $ pro Suchaufruf, die Kontaktanreicherung wird separat berechnet. Ein Standardlimit von 20 $ pro Lauf verhindert, dass ein einzelner Ultra-Lauf ausufert, und Sie können Ihre eigene Obergrenze zwischen 1 $ und 100 $ festlegen.
Was ist der Unterschied zwischen den Effort-Stufen von Exa Agent?
Effort ist ein Regler von minimal bis ultra. Die festen Stufen haben Pauschalpreise pro Anfrage (von 0,012 $ bei minimal bis 1,00 $ bei x-high). auto und ultra werden stattdessen nach Nutzung abgerechnet, mit Standardlimits von 5 $ bzw. 20 $. Ultra ist die höchste Einstellung und dafür gebaut, eine Aufgabe bis zur Erschöpfung auszuführen.
Ist Exa Agent Ultra teurer als ein Frontier-Modell?
Im eigenen WANDR-Benchmark von Exa lag Ultra bei der Hälfte der Kosten pro Aufgabe von Opus 5.5 und erzielte dabei eine höhere Qualität. Das ist Exas veröffentlichte Zahl, also als Herstellerangabe zu verstehen, aber das nutzungsbasierte Modell bedeutet, dass einfache Läufe günstig enden und nur schwierige, erschöpfende Aufgaben das Limit von 20 $ erreichen.
Hat Exa Agent Ultra einen kostenlosen Tarif?
Der Starter-Tarif von Exa bietet jeden Monat 10 $ Guthaben plus einen Onboarding-Bonus von 10 $ ohne Karte, genug, um Ultra in einer Handvoll Läufen zu testen. Danach wechseln Sie zu Pay-as-you-go im Developer-Tarif.
Was ist der günstigste Weg, agentische Recherche über meine eigenen Tickets zu betreiben?
Wenn Ihr Ziel Kundensupport oder Content statt reines Listenaufbauen ist, brauchen Sie womöglich gar keine Recherche-Pipeline. Ein KI-Helpdesk-Teammitglied lernt bereits aus Ihren Tickets und Dokumenten und arbeitet direkt in Ihrem Helpdesk, sodass Sie die API-Anbindung sparen, die Exa Agent Ihnen selbst überlässt.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Handgezeichnete Illustration eines Entwicklers am Laptop, von dem Exa-Suchergebnisse und strukturierte Daten ausgehen
Trending

Exa Agent Ultra: Was es kann, wie es funktioniert und was es kostet

Ein verständlicher Blick auf Exa Agent Ultra: die Deep-Research-API mit Subagenten-Schwarm, die Benchmark-Angaben, die Preise pro Durchlauf und wo sie sich für Recherche und Support eignet.

Rama AdiRama AdiSep 27, 2026
Illustration eines Entwicklers, der über Chat, Multimodal- und API-Oberflächen auf Alibabas Qwen 3.8 Max zugreift
Trending

Zugang zu Qwen 3.8 Max: 5 Wege und was jeder kostet

Fünf echte Wege zu Alibabas 2,4-Billionen-Parameter-Flaggschiff, vom kostenlosen Chat bis zur $2/$6-API, plus die Abrechnungsfallen, die dabei zuschnappen.

Rama AdiRama AdiAug 3, 2026
Illustration zur Preisaufschlüsselung von Skywork AI
Trending

Skywork AI Preise: Was es 2026 wirklich kostet

Eine klare Aufschlüsselung der Skywork AI Preise: die 1-Dollar-Testphase, das Credit-System, der 19,99-Dollar-Pro-Plan und die Abrechnungsfallen, auf die man vor dem Bezahlen achten sollte.

Kurnia KharismaKurnia KharismaJul 20, 2026
Illustration zum Skywork-AI-Test: ein Super-Agent verwandelt einen einzigen Prompt in Folien, Dokumente und Websites
Trending

Skywork AI im Test (2026): starker Agent, chaotische Abrechnung

Ein ehrlicher Skywork-AI-Test: Der Super-Agent erstellt echte Folien, Dokumente und Websites, aber bei der Abrechnung vom Test- zum Bezahltarif werden Nutzer über den Tisch gezogen.

Kurnia KharismaKurnia KharismaJul 20, 2026
Illustration zur Aufschlüsselung der PromptQL-Preise
Trending

PromptQL-Preise: Was es 2026 wirklich kostet

Eine Aufschlüsselung der PromptQL-Preise: die abrechenbare OLU-Einheit, der Einführungspreis von 0,14 $, kostenloses Guthaben, der Modell-Multiplikator, der die Rechnung wirklich bestimmt, und durchgerechnete Kosten.

Kurnia KharismaKurnia KharismaJul 10, 2026
Illustration einer startenden Rakete als Sinnbild für die Veröffentlichung des Modells MiniMax M3.1 Flash
Trending

MiniMax M3.1 Flash: Specs, Preise und wie du die Preview testest

MiniMax M3.1 Flash ist ein Coding-Modell mit 1M Kontext, das ohne Preisangabe in MiniMax Code aufgetaucht ist. Was es wirklich ist und wie du es ausprobierst.

Rama AdiRama AdiSep 28, 2026
Illustration zur Ankündigung von Claude Fable 5.1, Anthropics neuestem Spitzenmodell
Trending

Claude Fable 5.1 im Test: Preise, Fähigkeiten und was das für Ihr Team bedeutet

Claude Fable 5.1 ist Anthropics bisher leistungsfähigstes Modell. Hier sind die echten Preise, was sich seit Fable 5 geändert hat und wo es für Support- und Content-Teams passt.

KiraKiraSep 2, 2026
Illustration eines humanoiden Robotersteuerungsmodells, das Gemini Robotics 2 darstellt
Trending

Gemini Robotics 2: Was DeepMinds eigene Zahlen zeigen

Gemini Robotics 2 bringt drei Modelle und eine Tabelle mit Erfolgsraten pro Aufgabe, in der die meisten Werte unter 80% liegen. Diese Tabelle ist das Nützlichste an der ganzen Veröffentlichung.

KiraKiraAug 4, 2026
Illustration eines kompakten Modell-Chips, der ein Token entlang zweier erleuchteter Expertenpfade unter vielen dunklen leitet, für einen Inkling-Small-Erklärartikel
Trending

Inkling-Small erklärt: ein 276B-Modell, bei dem 12B die Arbeit machen

Was Inkling-Small wirklich ist: ein 276B/12B Open-Weights-MoE von Thinking Machines, das Kontextfenster, über das sich Dokumentation und Anbieter uneinig sind, was eine Million Tokens wirklich kostet und wo es in einen Support-Stack passt.

Rama AdiRama AdiAug 4, 2026

Bereit, Ihren KI-Teamkollegen einzustellen?

In Minuten eingerichtet. Keine Kreditkarte erforderlich.

Kostenlos starten