
Qué es realmente Exa Agent Ultra
Exa nació como Metaphor, una empresa de YC S21 que construía búsqueda web basada en embeddings, y creció hasta convertirse en una API de búsqueda y rastreo web que los productos de IA llaman por debajo. Cursor, por ejemplo, usa Exa para traer la documentación más reciente a su agente de programación. Exa Agent es la capa por encima de la búsqueda pura: un endpoint asíncrono que recibe una consulta en lenguaje natural más un esquema de salida, y luego despliega sus propias búsquedas, lee las páginas que hay detrás, verifica candidatos y devuelve JSON estructurado y con citas.
Ultra no es un producto aparte. Es el peldaño más alto del dial effort de Exa Agent. Con effort: "ultra", el agente coordina muchos subagentes a través de miles de fuentes, usando modelos de frontera donde la tarea es difícil y modelos más rápidos donde bastan. Exa lo posiciona para trabajos que deben ejecutarse hasta agotarse: construir un mapa de mercado completo, enriquecer cada fila de una lista o verificar un criterio difícil de comprobar en registros, prensa y sitios de reguladores.
El mensaje del lanzamiento fue directo: "calidad de frontera a una fracción del costo". Eso es tanto una afirmación de precio como de calidad, y por eso importa la medición por uso.
Entonces, ¿cuánto cuesta Exa Agent Ultra?
Esta es la respuesta honesta que la página de marketing de Exa comprime en un rango: la Agent API tiene siete niveles de esfuerzo, y solo cinco tienen precio fijo. auto y ultra se miden por uso.

| Nivel de esfuerzo | Precio | Ideal para |
|---|---|---|
minimal | 0,012 $ / solicitud | Consultas factuales acotadas, respuestas cortas |
low | 0,025 $ / solicitud | Consultas simples, investigación ligera |
medium | 0,10 $ / solicitud | Predeterminado para investigación estándar |
high | 0,50 $ / solicitud | Investigación más difícil, mayor exigencia de exhaustividad |
xhigh | 1,00 $ / solicitud | Tareas de alto valor, esquemas complejos |
auto | Medido por uso, hasta un tope predeterminado de 5 $ | Trabajo de alcance variable cuando no conoces la dificultad |
ultra | Medido por uso, hasta un tope predeterminado de 20 $ | Creación de listas grandes, investigación exhaustiva |
Así que el titular honesto para Ultra es "medido por uso, con tope de 20 $ por ejecución de forma predeterminada". El tope es un techo, no un cargo fijo: una ejecución que termina pronto cuesta menos, y tú fijas tu propio límite con budget.maxCostDollars (rango aceptado de 1 $ a 100 $). La documentación de Agent confirma las mismas cifras, así que no es un redondeo de marketing.
Vale la pena destacar la decisión de diseño. Todos los demás niveles de esfuerzo cobran una tarifa plana, ya sea que la tarea fuera trivial o complicada. Ultra, igual que auto, solo cobra el cómputo y las herramientas que una ejecución realmente consume. Para las tareas exhaustivas a las que apunta Ultra, donde una sola consulta puede lanzar decenas de subagentes, ese modelo basado en uso es la diferencia entre predecible y doloroso.
La parte medida, en cifras claras
Cuando una ejecución se mide por uso, la factura depende de dos componentes, con el enriquecimiento como tercera línea opcional.

| Componente | Tarifa | Qué mide |
|---|---|---|
| Agent Compute Units (ACU) | 0,10 $ / ACU | Cómputo del modelo a lo largo de toda la ejecución |
| Llamadas a la herramienta de búsqueda | 0,005 $ / búsqueda | Cada búsqueda web que lanza el agente |
| Enriquecimiento de correo | 0,02 $ / correo | Búsquedas de correos de contacto |
| Enriquecimiento de teléfono | 0,07 $ / número de teléfono | Búsquedas de teléfonos de contacto |
La métrica clave es usage.agentComputeUnits. Exa es explícita en que las consultas complejas, sobre todo las que tienen un campo input.data grande, requieren más pasos de razonamiento y consumen más ACU. Así que un enriquecimiento amplio y basado en juicio ("¿vende esta empresa a hospitales, con una URL citada como evidencia?") gastará mucho más que una consulta factual concreta.
Un par de ejemplos prácticos:
- Una ejecución moderada de Ultra que usa 60 ACU y 80 búsquedas cuesta
60 x $0.10 + 80 x $0.005 = $6.40. Muy por debajo del tope de 20 $. - Una creación de lista pesada que alcanza 150 ACU y 300 búsquedas cuesta
150 x $0.10 + 300 x $0.005 = $16.50, aún bajo el tope, antes de cualquier enriquecimiento. - Si añades 200 búsquedas de correo a esa ejecución pesada, llegas a
$16.50 + $4.00 = $20.50, así que el tope de 20 $ la recortaría (el enriquecimiento queda fuera del medidor principal, así que revisa aquí tu configuración de presupuesto).
Introduce tus propias cifras a continuación.
Dónde encaja Ultra en los precios más amplios de Exa
Exa Agent es un producto dentro de un menú más amplio. Si estás calculando el costo de Ultra, ayuda ver los vecinos, porque muchos equipos recurren a la Search API, más barata, y orquestan su propio bucle en lugar de pagar a Agent para que lo haga.
| Endpoint | Precio base (hasta 10 resultados) | Por resultado extra | Resúmenes de página con IA |
|---|---|---|---|
| Search | 7 $ / 1k solicitudes | 1 $ / 1k | +1 $ / 1k páginas |
| Deep Search | 12 $ / 1k solicitudes | 1 $ / 1k | +1 $ / 1k páginas |
| Deep-Reasoning Search | 15 $ / 1k solicitudes | 1 $ / 1k | +1 $ / 1k páginas |
| Contents | 1 $ / 1k páginas | - | +1 $ / 1k páginas |
| Monitors | 15 $ / 1k solicitudes | 1 $ / 1k | - |
| Answer | 5 $ / 1k solicitudes | - | - |
La disyuntiva es la clásica entre construir y comprar. La búsqueda básica a 7 $ por 1.000 solicitudes es barata, pero tú escribes el bucle: las búsquedas, la lectura de páginas, la verificación, la validación del esquema. Agent Ultra reúne todo eso en una sola llamada medida. Pagas por la orquestación, no solo por la recuperación.
Del lado de la cuenta, tres planes controlan el acceso:
| Plan | Precio | Aspectos destacados |
|---|---|---|
| Starter | Gratis | 10 $ de créditos/mes + 10 $ de bono de incorporación, sin tarjeta, 10 QPS de búsqueda, 50 de concurrencia de agentes |
| Developer | Pago por uso | Facturación basada en uso, hasta 25 QPS de búsqueda, SOC 2 Type II |
| Enterprise | Personalizado | Retención cero de datos, HIPAA, SSO/SCIM, hasta 1.000 resultados por búsqueda |
Los créditos gratuitos alcanzan para ejecutar Ultra unas cuantas veces antes de comprometerte, que es la forma correcta de dimensionar tu propio consumo de ACU antes de confiar en la calculadora de arriba.
Exa Connect: el complemento que se suma encima
Una línea fácil de pasar por alto: si tu ejecución de Ultra obtiene datos de socios premium a través de Exa Connect, eso se factura además del uso de Agent. Los proveedores de autoservicio incluyen Similarweb, Financial Datasets y Fiber.ai, y ZoomInfo, Crunchbase y Harmonic están disponibles bajo solicitud.
Para un equipo go-to-market que arma una lista de cuentas enriquecida, aquí es donde el costo real de una ejecución puede superar el medidor base, porque ahora pagas el cómputo de Exa y la tarifa de datos de un tercero. Se admite traer tu propia clave (bring-your-own-key) para cualquier proveedor, así que si ya pagas ZoomInfo, no pagas dos veces por los datos en sí. Conviene modelarlo antes de asumir que el tope de 20 $ es tu techo.
¿Vale la pena el gasto en Ultra?
Todo el argumento de Exa es que el modelo medido te da calidad de frontera más barata que ejecutar el propio agente de un modelo de frontera. En su benchmark WANDR (Wide And Deep Research, modelado sobre enriquecimiento de due diligence e investigación legal), Ultra afirma establecer el estado del arte.

Las afirmaciones concretas, todas medidas frente al ajuste de esfuerzo máximo de cada competidor:
- WANDR: +12,6 % sobre Opus 5.5, con la mitad del costo por tarea de Opus 5.5.
- DeepSearchQA: +21,0 % sobre Opus 5.5 y +10,1 % sobre GPT-6 Astra, con un costo por tarea 46 % menor que GPT-6 Astra.
- WideSearch: +14,1 % sobre Opus 5.5, con el menor costo por tarea de los cuatro sistemas.
- Find-All Company: +1579 % sobre Opus 5.5 en entidades válidas encontradas, con el menor costo por entidad.

Dos salvedades honestas. Son cifras propias de Exa en su propio entorno de pruebas. Exa dice que reporta cifras publicadas cuando los competidores las tenían y que ejecutó el benchmark ella misma en otro caso, y que cambió a un modelo juez más barato (gpt-6-luna). Todo eso es razonable, pero sigue siendo ejecutado por el proveedor. Las brechas en Find-All Company en particular son tan grandes que dicen más sobre lo mal que los agentes de propósito general manejan la creación exhaustiva de listas que sobre una ventaja de calidad en igualdad de condiciones. Léelas como "Ultra está realmente hecho para investigación amplia, y los agentes de chat generales no", que es una conclusión justa y útil.
Qué dicen los desarrolladores sobre el costo de Exa
El debate sobre precios en torno a Exa es anterior a Ultra. En el Launch HN de la empresa (412 puntos, 133 comentarios), el fundador Will Bryk fue franco sobre por qué el producto más completo está tras un inicio de sesión en lugar de ser gratuito:
"we'd love to make the product as accessible and cheap as possible, but as of state of AI costs of 2025, it's a very expensive product to run and so we have it login gated."
Ese es el contexto útil para el medidor de Ultra. La investigación web profunda y exhaustiva es cara de ejecutar, y la respuesta de Exa es exponer ese costo con honestidad y ponerle tope, en lugar de esconderlo tras una tarifa fija que o cobra de más a los usuarios ligeros o pierde dinero con los intensivos. El tope de 20 $ hace mucho trabajo silencioso: es la promesa de que "ejecutar hasta agotar" no signifique "facturar hasta agotar".
eesel: un compañero, no un motor que hay que conectar
Aquí va el replanteamiento con el que conviene cerrar. Exa Agent Ultra es infraestructura. Es un motor de investigación profunda realmente sólido, pero te entrega una API y un esquema y espera que construyas la canalización, consultes las ejecuciones, valides la salida y lo conectes a donde realmente ocurre el trabajo. Es la herramienta correcta si eres desarrollador y quieres integrar la creación de listas o el enriquecimiento en tu propio producto.

Si lo que realmente quieres es el resultado, eesel vende la otra mitad de la ecuación: compañeros de IA listos para trabajar que contratas para un puesto, no un motor que ensamblas. El compañero de IA para el helpdesk se une a tu cola actual, aprende de tus tickets pasados y de tu centro de ayuda desde el primer día, y redacta o envía respuestas automáticamente dentro de Zendesk, Freshdesk o Slack. El redactor de blog con IA hace lo mismo con el contenido. Cada uno llega con las habilidades, integraciones y contexto de empresa para su puesto, así que no hay esquema que diseñar.

Y si sí vives en una terminal, eesel también te acompaña ahí. La CLI de eesel maneja el mismo compañero que el panel: npx @eesel/cli init chat-bubble --site https://your-site.com crea un espacio de trabajo, y cada comando imprime JSON con un campo hint que le dice a un agente qué ejecutar a continuación. Eso lo hace manejable no solo por una persona sino por agentes de programación como Claude Code, Cursor y Codex, y cada espacio de trabajo funciona además como servidor MCP mediante eesel mcp token. Así obtienes el mismo control agéntico y programable que te da la API de Exa, salvo que lo que programas es un compañero que ya conoce tu negocio, no una canalización de investigación que aún tienes que construir. Puedes probarlo gratis, sin tarjeta.
Preguntas frecuentes
¿Cuánto cuesta cada ejecución de Exa Agent Ultra?
¿Cuál es la diferencia entre los niveles de esfuerzo de Exa Agent?
auto y ultra se miden por uso, con topes predeterminados de 5 $ y 20 $ respectivamente. Ultra es el ajuste máximo, diseñado para llevar una tarea hasta agotarla.¿Es Exa Agent Ultra más caro que un modelo de frontera?
¿Tiene Exa Agent Ultra un plan gratuito?
¿Cuál es la forma más barata de hacer investigación con agentes sobre mis propios tickets?

Article by
Rama Adi
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







