
Was Exa Agent Ultra eigentlich ist
Exa begann als Metaphor, ein YC-S21-Unternehmen, das embeddingsbasierte Websuche baute, und wuchs zu einer Websuche- und Crawling-API heran, die KI-Produkte im Hintergrund aufrufen. Cursor etwa nutzt Exa, um die neuesten Dokumentationen in seinen Coding-Agenten zu holen. Der Exa Agent ist die Schicht über der reinen Suche: ein asynchroner Endpunkt, der eine Anfrage in natürlicher Sprache plus ein Ausgabeschema entgegennimmt, dann eigene Suchen auffächert, die dahinterliegenden Seiten liest, Kandidaten verifiziert und strukturiertes, mit Quellen belegtes JSON zurückgibt.
Ultra ist kein eigenes Produkt. Es ist die oberste Stufe des effort-Reglers von Exa Agent. Mit effort: "ultra" koordiniert der Agent viele Subagenten über Tausende von Quellen und setzt Frontier-Modelle dort ein, wo die Aufgabe schwierig ist, und schnellere, wo sie ausreichen. Exa positioniert es für Aufgaben, die bis zur Erschöpfung laufen müssen: eine vollständige Marktlandkarte erstellen, jede Zeile einer Liste anreichern oder ein schwer prüfbares Kriterium über Einreichungen, Presse und Behördenseiten hinweg verifizieren.
Die Launch-Botschaft war unverblümt: "Frontier-Qualität zu einem Bruchteil der Kosten". Das ist ebenso eine Preisaussage wie eine Qualitätsaussage, und genau deshalb ist die Abrechnung nach Nutzung wichtig.
Was kostet Exa Agent Ultra also?
Hier die ehrliche Antwort, die Exas Marketingseite auf eine Spanne verkürzt: Die Agent API hat sieben Effort-Stufen, und nur fünf davon haben einen festen Preis. auto und ultra werden nutzungsbasiert abgerechnet.

| Effort-Stufe | Preis | Am besten für |
|---|---|---|
minimal | 0,012 $ / Anfrage | Enge Faktenabfragen, kurze Antworten |
low | 0,025 $ / Anfrage | Einfache Abfragen, leichte Recherche |
medium | 0,10 $ / Anfrage | Standard für normale Recherche |
high | 0,50 $ / Anfrage | Schwierigere Recherche, strengere Vollständigkeit |
xhigh | 1,00 $ / Anfrage | Hochwertige Aufgaben, komplexe Schemas |
auto | Nutzungsbasiert, bis zu einem Standardlimit von 5 $ | Aufgaben mit variablem Umfang, wenn Sie den Schwierigkeitsgrad nicht kennen |
ultra | Nutzungsbasiert, bis zu einem Standardlimit von 20 $ | Umfangreiches Listenaufbauen, erschöpfende Recherche |
Die ehrliche Schlagzeile für Ultra lautet also "nutzungsbasiert, standardmäßig auf 20 $ pro Lauf begrenzt". Das Limit ist eine Obergrenze, keine feste Gebühr: Ein Lauf, der früh endet, kostet weniger, und Sie legen Ihr eigenes Limit mit budget.maxCostDollars fest (zulässiger Bereich 1 $ bis 100 $). Die Agent-Dokumentation bestätigt dieselben Zahlen, es handelt sich also nicht um Marketing-Rundung.
Die Designentscheidung verdient Beachtung. Jede andere Effort-Stufe berechnet eine Pauschale, egal ob die Aufgabe trivial oder knifflig war. Ultra berechnet, wie auto, nur die Rechenleistung und Werkzeuge, die ein Lauf tatsächlich verbraucht. Bei den erschöpfenden Aufgaben, auf die Ultra zielt und bei denen eine Anfrage Dutzende Subagenten starten kann, macht dieses nutzungsbasierte Modell den Unterschied zwischen planbar und schmerzhaft.
Der nutzungsbasierte Teil in klaren Zahlen
Wenn ein Lauf nutzungsbasiert abgerechnet wird, bestimmen zwei Komponenten die Rechnung, mit der Anreicherung als optionaler dritter Position.

| Komponente | Satz | Was gemessen wird |
|---|---|---|
| Agent Compute Units (ACU) | 0,10 $ / ACU | Modellberechnung über den gesamten Lauf |
| Suchaufrufe | 0,005 $ / Suche | Jede Websuche, die der Agent auslöst |
| E-Mail-Anreicherung | 0,02 $ / E-Mail | Abfragen von Kontakt-E-Mails |
| Telefon-Anreicherung | 0,07 $ / Telefonnummer | Abfragen von Kontakttelefonnummern |
Die tragende Kennzahl ist usage.agentComputeUnits. Exa stellt klar, dass komplexe Anfragen, besonders mit einem großen input.data-Feld, mehr Denkschritte brauchen und mehr ACUs verbrauchen. Eine breite, urteilsintensive Anreicherung ("verkauft dieses Unternehmen an Krankenhäuser, mit einer URL als Beleg") verbrennt also weit mehr als eine gezielte Faktenabfrage.
Ein paar durchgerechnete Beispiele:
- Ein mittlerer Ultra-Lauf mit 60 ACUs und 80 Suchen kostet
60 x $0.10 + 80 x $0.005 = $6.40. Deutlich unter dem 20-$-Limit. - Ein umfangreicher Listenaufbau mit 150 ACUs und 300 Suchen kostet
150 x $0.10 + 300 x $0.005 = $16.50, noch unter dem Limit, vor jeglicher Anreicherung. - Fügen Sie diesem umfangreichen Lauf 200 E-Mail-Abfragen hinzu, landen Sie bei
$16.50 + $4.00 = $20.50, das 20-$-Limit würde ihn also kappen (die Anreicherung liegt außerhalb des Kernzählers, prüfen Sie hier also Ihre Budgeteinstellungen).
Setzen Sie unten Ihre eigenen Zahlen ein.
Wo Ultra in Exas übrigem Preisgefüge steht
Exa Agent ist ein Produkt auf einer breiteren Speisekarte. Wenn Sie Ultra durchrechnen, hilft ein Blick auf die Nachbarn, denn viele Teams greifen zur günstigeren Search API und orchestrieren ihre eigene Schleife, statt Agent dafür zu bezahlen.
| Endpunkt | Basispreis (bis zu 10 Ergebnisse) | Pro zusätzlichem Ergebnis | KI-Seitenzusammenfassungen |
|---|---|---|---|
| Search | 7 $ / 1k Anfragen | 1 $ / 1k | +1 $ / 1k Seiten |
| Deep Search | 12 $ / 1k Anfragen | 1 $ / 1k | +1 $ / 1k Seiten |
| Deep-Reasoning Search | 15 $ / 1k Anfragen | 1 $ / 1k | +1 $ / 1k Seiten |
| Contents | 1 $ / 1k Seiten | - | +1 $ / 1k Seiten |
| Monitors | 15 $ / 1k Anfragen | 1 $ / 1k | - |
| Answer | 5 $ / 1k Anfragen | - | - |
Der Kompromiss ist die klassische Abwägung zwischen Selbstbauen und Kaufen. Die reine Suche für 7 $ pro 1.000 Anfragen ist günstig, aber Sie schreiben die Schleife selbst: die Suchen, das Lesen der Seiten, die Verifizierung, die Schemavalidierung. Agent Ultra bündelt all das in einem nutzungsbasierten Aufruf. Sie bezahlen für Orchestrierung, nicht nur für Retrieval.
Auf der Kontoseite regeln drei Tarife den Zugang:
| Tarif | Preis | Highlights |
|---|---|---|
| Starter | Kostenlos | 10 $ Guthaben/Monat + 10 $ Onboarding-Bonus, keine Karte, 10 Such-QPS, 50 Agent-Parallelität |
| Developer | Pay as you go | Nutzungsbasierte Abrechnung, bis zu 25 Such-QPS, SOC 2 Type II |
| Enterprise | Individuell | Zero Data Retention, HIPAA, SSO/SCIM, bis zu 1.000 Ergebnisse pro Suche |
Das kostenlose Guthaben reicht, um Ultra ein paar Mal auszuführen, bevor Sie sich festlegen. Das ist der richtige Weg, Ihren eigenen ACU-Verbrauch abzuschätzen, bevor Sie dem Rechner oben vertrauen.
Exa Connect: das Add-on, das obendrauf kommt
Ein leicht zu übersehender Punkt: Wenn Ihr Ultra-Lauf über Exa Connect auf Premium-Datenpartner zugreift, wird das zusätzlich zur Agent-Nutzung berechnet. Zu den Self-Serve-Anbietern gehören Similarweb, Financial Datasets und Fiber.ai, ZoomInfo, Crunchbase und Harmonic sind auf Anfrage verfügbar.
Für ein Go-to-Market-Team, das eine angereicherte Account-Liste aufbaut, kann hier der echte Preis eines Laufs über den Basiszähler hinausdriften, weil Sie nun Exas Rechenleistung und den Datentarif eines Dritten bezahlen. Bring-your-own-key wird für jeden Anbieter unterstützt. Wenn Sie also bereits ZoomInfo bezahlen, zahlen Sie die Daten selbst nicht doppelt. Es lohnt sich, das durchzurechnen, bevor Sie annehmen, das 20-$-Limit sei Ihre Obergrenze.
Lohnt sich Ultra?
Exas gesamtes Argument lautet, dass das nutzungsbasierte Modell Ihnen Frontier-Qualität günstiger bietet als der Agent eines Frontier-Modells selbst. Beim WANDR-Benchmark (Wide And Deep Research, angelehnt an Due-Diligence- und Rechtsrecherche-Anreicherung) beansprucht Ultra den Stand der Technik.

Die konkreten Behauptungen, jeweils gemessen an der maximalen Effort-Einstellung des Konkurrenten:
- WANDR: +12,6 % gegenüber Opus 5.5, bei halben Kosten pro Aufgabe von Opus 5.5.
- DeepSearchQA: +21,0 % gegenüber Opus 5.5 und +10,1 % gegenüber GPT-6 Astra, bei 46 % niedrigeren Kosten pro Aufgabe als GPT-6 Astra.
- WideSearch: +14,1 % gegenüber Opus 5.5, bei den niedrigsten Kosten pro Aufgabe der vier Systeme.
- Find-All Company: +1579 % gegenüber Opus 5.5 bei gefundenen bestandenen Entitäten, bei den niedrigsten Kosten pro Entität.

Zwei ehrliche Vorbehalte. Das sind Exas eigene Zahlen auf Exas eigenem Testaufbau. Exa sagt, es nenne veröffentlichte Werte, wo Konkurrenten welche hatten, und habe den Benchmark sonst selbst ausgeführt, und es habe ein günstigeres Bewertungsmodell (gpt-6-luna) eingesetzt. All das ist vernünftig, bleibt aber herstellergeführt. Besonders die Abstände bei Find-All Company sind so groß, dass sie mehr darüber aussagen, wie schlecht universelle Agenten mit erschöpfendem Listenaufbau umgehen, als über einen Qualitätsvorsprung im direkten Vergleich. Lesen Sie sie als "Ultra ist wirklich für breite Recherche gebaut, und allgemeine Chat-Agenten sind es nicht", was ein fairer und nützlicher Schluss ist.
Was Entwickler über Exas Kosten sagen
Die Preisdebatte um Exa gab es schon vor Ultra. Beim Launch HN des Unternehmens (412 Punkte, 133 Kommentare) war Gründer Will Bryk offen, warum das umfangreichere Produkt hinter einem Login liegt statt kostenlos zu sein:
"we'd love to make the product as accessible and cheap as possible, but as of state of AI costs of 2025, it's a very expensive product to run and so we have it login gated."
Das ist der nützliche Kontext für Ultras Abrechnung. Tiefe, erschöpfende Webrecherche ist teuer im Betrieb, und Exas Antwort ist, diese Kosten offen zu zeigen und zu begrenzen, statt sie hinter einer Pauschale zu verstecken, die entweder Wenignutzer überzahlen lässt oder bei Vielnutzern Verlust bringt. Das 20-$-Limit leistet dabei viel im Stillen: Es ist das Versprechen, dass "bis zur Erschöpfung laufen" nicht "bis zur Erschöpfung abrechnen" bedeutet.
eesel: ein Teammitglied, keine Engine zum Anbinden
Zum Schluss ein Perspektivwechsel. Exa Agent Ultra ist Infrastruktur. Es ist eine wirklich starke Deep-Research-Engine, gibt Ihnen aber eine API und ein Schema und erwartet, dass Sie die Pipeline bauen, die Läufe abfragen, die Ausgabe validieren und alles dort anbinden, wo die Arbeit tatsächlich stattfindet. Das ist das richtige Werkzeug, wenn Sie Entwickler sind und Listenaufbau oder Anreicherung in Ihr eigenes Produkt einbauen.

Wenn Sie eigentlich das Ergebnis wollen, verkauft eesel die andere Hälfte der Gleichung: einsatzbereite KI-Teammitglieder, die Sie für eine Aufgabe einstellen, keine Engine, die Sie zusammenbauen. Das KI-Helpdesk-Teammitglied steigt in Ihre bestehende Warteschlange ein, lernt am ersten Tag aus Ihren bisherigen Tickets und dem Help Center und entwirft oder versendet automatisch Antworten in Zendesk, Freshdesk oder Slack. Der KI-Blog-Autor macht dasselbe für Content. Jeder kommt mit den Fähigkeiten, Integrationen und dem Unternehmenskontext für seine Rolle, sodass kein Schema zu entwerfen ist.

Und wenn Sie tatsächlich im Terminal leben, holt eesel Sie auch dort ab. Das eesel CLI steuert dasselbe Teammitglied wie das Dashboard: npx @eesel/cli init chat-bubble --site https://your-site.com richtet einen Workspace ein, und jeder Befehl gibt JSON mit einem hint-Feld aus, das einem Agenten sagt, was als Nächstes auszuführen ist. Dadurch ist es nicht nur von Menschen, sondern auch von Coding-Agenten wie Claude Code, Cursor und Codex steuerbar, und jeder Workspace ist über eesel mcp token zugleich ein MCP-Server. Sie erhalten also dieselbe agentische, skriptbare Kontrolle, die Ihnen Exas API bietet, nur dass das, was Sie skripten, ein Teammitglied ist, das Ihr Geschäft schon kennt, und keine Recherche-Pipeline, die Sie erst noch bauen müssen. Es ist kostenlos testbar, ohne Karte.
Häufig gestellte Fragen
Was kostet ein Lauf von Exa Agent Ultra?
Was ist der Unterschied zwischen den Effort-Stufen von Exa Agent?
auto und ultra werden stattdessen nach Nutzung abgerechnet, mit Standardlimits von 5 $ bzw. 20 $. Ultra ist die höchste Einstellung und dafür gebaut, eine Aufgabe bis zur Erschöpfung auszuführen.Ist Exa Agent Ultra teurer als ein Frontier-Modell?
Hat Exa Agent Ultra einen kostenlosen Tarif?
Was ist der günstigste Weg, agentische Recherche über meine eigenen Tickets zu betreiben?

Article by
Rama Adi
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.








