
O que o Exa Agent Ultra realmente é
A Exa começou como Metaphor, uma empresa da YC S21 que criava busca na web baseada em embeddings, e cresceu até virar uma API de busca e rastreamento da web que produtos de IA chamam por baixo dos panos. O Cursor, por exemplo, usa a Exa para trazer a documentação mais recente para seu agente de programação. O Exa Agent é a camada acima da busca bruta: um endpoint assíncrono que recebe uma consulta em linguagem natural mais um esquema de saída, e então dispara suas próprias buscas, lê as páginas por trás delas, verifica candidatos e devolve JSON estruturado e com citações.
O Ultra não é um produto separado. É o degrau mais alto do seletor effort do Exa Agent. Com effort: "ultra", o agente coordena muitos subagentes em milhares de fontes, usando modelos de fronteira onde a tarefa é difícil e modelos mais rápidos onde bastam. A Exa o posiciona para trabalhos que precisam ir até a exaustão: montar um mapa de mercado completo, enriquecer cada linha de uma lista ou verificar um critério difícil de checar em registros, imprensa e sites de reguladores.
O enquadramento do lançamento foi direto: "qualidade de fronteira por uma fração do custo". Isso é tanto uma afirmação de preço quanto de qualidade, e é exatamente por isso que a medição importa.
Então, quanto custa o Exa Agent Ultra?
Esta é a resposta honesta que a página de marketing da Exa comprime em uma faixa: a Agent API tem sete níveis de esforço, e só cinco deles têm preço fixo. auto e ultra são medidos por uso.

| Nível de esforço | Preço | Ideal para |
|---|---|---|
minimal | US$ 0,012 / solicitação | Consultas factuais restritas, respostas curtas |
low | US$ 0,025 / solicitação | Consultas simples, pesquisa leve |
medium | US$ 0,10 / solicitação | Padrão para pesquisa comum |
high | US$ 0,50 / solicitação | Pesquisa mais difícil, exigência maior de completude |
xhigh | US$ 1,00 / solicitação | Tarefas de alto valor, esquemas complexos |
auto | Medido por uso, até um limite padrão de US$ 5 | Trabalho de escopo variável quando você não sabe a dificuldade |
ultra | Medido por uso, até um limite padrão de US$ 20 | Montagem de listas grandes, pesquisa exaustiva |
Então a manchete honesta para o Ultra é "medido por uso, com limite de US$ 20 por execução por padrão". O limite é um teto, não uma cobrança fixa: uma execução que termina cedo custa menos, e você define seu próprio limite com budget.maxCostDollars (faixa aceita de US$ 1 a US$ 100). A documentação do Agent confirma os mesmos números, então não é arredondamento de marketing.
A decisão de design merece destaque. Todos os outros níveis de esforço cobram uma taxa fixa, quer a tarefa fosse trivial ou complicada. O Ultra, como o auto, só cobra a computação e as ferramentas que uma execução realmente consome. Para as tarefas exaustivas que o Ultra mira, em que uma única consulta pode disparar dezenas de subagentes, esse modelo baseado em uso é a diferença entre previsível e doloroso.
A parte medida, em números claros
Quando uma execução é medida por uso, dois componentes determinam a fatura, com o enriquecimento como terceira linha opcional.

| Componente | Taxa | O que mede |
|---|---|---|
| Agent Compute Units (ACU) | US$ 0,10 / ACU | Computação do modelo ao longo de toda a execução |
| Chamadas da ferramenta de busca | US$ 0,005 / busca | Cada busca na web que o agente dispara |
| Enriquecimento de e-mail | US$ 0,02 / e-mail | Consultas de e-mails de contato |
| Enriquecimento de telefone | US$ 0,07 / número de telefone | Consultas de telefones de contato |
A métrica principal é usage.agentComputeUnits. A Exa é explícita ao dizer que consultas complexas, especialmente com um campo input.data grande, precisam de mais etapas de raciocínio e consomem mais ACUs. Então um enriquecimento amplo e baseado em julgamento ("esta empresa vende para hospitais, com uma URL citada como evidência?") vai gastar muito mais que uma consulta factual direta.
Alguns exemplos práticos:
- Uma execução moderada do Ultra que usa 60 ACUs e 80 buscas custa
60 x $0.10 + 80 x $0.005 = $6.40. Bem abaixo do limite de US$ 20. - Uma montagem pesada de lista que atinge 150 ACUs e 300 buscas custa
150 x $0.10 + 300 x $0.005 = $16.50, ainda abaixo do limite, antes de qualquer enriquecimento. - Adicione 200 consultas de e-mail a essa execução pesada e você chega a
$16.50 + $4.00 = $20.50, então o limite de US$ 20 a cortaria (o enriquecimento fica fora do medidor principal, então confira aqui suas configurações de orçamento).
Coloque seus próprios números abaixo.
Onde o Ultra se encaixa nos preços mais amplos da Exa
O Exa Agent é um produto dentro de um cardápio maior. Se você está calculando o Ultra, ajuda ver os vizinhos, porque muitas equipes recorrem à Search API, mais barata, e orquestram o próprio laço em vez de pagar o Agent para fazer isso.
| Endpoint | Preço base (até 10 resultados) | Por resultado extra | Resumos de página com IA |
|---|---|---|---|
| Search | US$ 7 / 1k solicitações | US$ 1 / 1k | +US$ 1 / 1k páginas |
| Deep Search | US$ 12 / 1k solicitações | US$ 1 / 1k | +US$ 1 / 1k páginas |
| Deep-Reasoning Search | US$ 15 / 1k solicitações | US$ 1 / 1k | +US$ 1 / 1k páginas |
| Contents | US$ 1 / 1k páginas | - | +US$ 1 / 1k páginas |
| Monitors | US$ 15 / 1k solicitações | US$ 1 / 1k | - |
| Answer | US$ 5 / 1k solicitações | - | - |
O dilema é o clássico entre construir e comprar. A busca bruta a US$ 7 por 1.000 solicitações é barata, mas você escreve o laço: as buscas, a leitura das páginas, a verificação, a validação do esquema. O Agent Ultra reúne tudo isso em uma única chamada medida. Você paga pela orquestração, não só pela recuperação.
Do lado da conta, três planos controlam o acesso:
| Plano | Preço | Destaques |
|---|---|---|
| Starter | Grátis | US$ 10 em créditos/mês + US$ 10 de bônus de integração, sem cartão, 10 QPS de busca, 50 de concorrência de agentes |
| Developer | Pague conforme usar | Cobrança baseada em uso, até 25 QPS de busca, SOC 2 Type II |
| Enterprise | Personalizado | Retenção zero de dados, HIPAA, SSO/SCIM, até 1.000 resultados por busca |
Os créditos gratuitos bastam para executar o Ultra algumas vezes antes de se comprometer, que é a forma certa de dimensionar seu próprio consumo de ACU antes de confiar na calculadora acima.
Exa Connect: o complemento que se soma por cima
Uma linha fácil de perder: se sua execução do Ultra puxa dados de parceiros premium pelo Exa Connect, isso é cobrado além do uso do Agent. Os provedores de autoatendimento incluem Similarweb, Financial Datasets e Fiber.ai, com ZoomInfo, Crunchbase e Harmonic disponíveis sob solicitação.
Para uma equipe go-to-market montando uma lista de contas enriquecida, é aqui que o custo real de uma execução pode passar do medidor base, porque agora você paga a computação da Exa e a taxa de dados de um terceiro. Traga sua própria chave (bring-your-own-key) é aceito para qualquer provedor, então se você já paga a ZoomInfo, não paga duas vezes pelos dados em si. Vale modelar isso antes de assumir que o limite de US$ 20 é seu teto.
Vale a pena gastar com o Ultra?
Todo o argumento da Exa é que o modelo medido entrega qualidade de fronteira mais barato do que rodar o agente de um modelo de fronteira. No seu benchmark WANDR (Wide And Deep Research, modelado em enriquecimento de due diligence e pesquisa jurídica), o Ultra afirma estabelecer o estado da arte.

As afirmações específicas, todas medidas contra a configuração de esforço máximo de cada concorrente:
- WANDR: +12,6% sobre o Opus 5.5, com metade do custo por tarefa do Opus 5.5.
- DeepSearchQA: +21,0% sobre o Opus 5.5 e +10,1% sobre o GPT-6 Astra, com custo por tarefa 46% menor que o do GPT-6 Astra.
- WideSearch: +14,1% sobre o Opus 5.5, com o menor custo por tarefa entre os quatro sistemas.
- Find-All Company: +1579% sobre o Opus 5.5 em entidades válidas encontradas, com o menor custo por entidade.

Duas ressalvas honestas. Esses são números da própria Exa no seu próprio ambiente de testes. A Exa diz que reporta números publicados quando os concorrentes os tinham e que executou o benchmark ela mesma nos demais casos, e que trocou por um modelo juiz mais barato (gpt-6-luna). Tudo isso é razoável, mas ainda é conduzido pelo fornecedor. As diferenças no Find-All Company em particular são tão grandes que dizem mais sobre o quanto agentes de uso geral lidam mal com a montagem exaustiva de listas do que sobre uma vantagem de qualidade em condições iguais. Leia como "o Ultra é genuinamente feito para pesquisa ampla, e agentes de chat genéricos não são", que é uma conclusão justa e útil.
O que os desenvolvedores dizem sobre o custo da Exa
O debate sobre preços em torno da Exa é anterior ao Ultra. No Launch HN da empresa (412 pontos, 133 comentários), o fundador Will Bryk foi franco sobre por que o produto mais completo fica atrás de um login em vez de ser gratuito:
"we'd love to make the product as accessible and cheap as possible, but as of state of AI costs of 2025, it's a very expensive product to run and so we have it login gated."
Esse é o contexto útil para o medidor do Ultra. Pesquisa profunda e exaustiva na web é cara de operar, e a resposta da Exa é expor esse custo com honestidade e limitá-lo, em vez de escondê-lo atrás de uma taxa fixa que ou cobra demais de usuários leves ou perde dinheiro com os pesados. O limite de US$ 20 faz muito trabalho silencioso: é a promessa de que "executar até a exaustão" não vai significar "faturar até a exaustão".
eesel: um colega, não um motor para conectar
Aqui vai o reenquadramento para terminar. O Exa Agent Ultra é infraestrutura. É um motor de pesquisa profunda genuinamente forte, mas entrega uma API e um esquema e espera que você construa o pipeline, consulte as execuções, valide a saída e conecte tudo ao lugar onde o trabalho realmente acontece. É a ferramenta certa se você é desenvolvedor e quer embutir montagem de listas ou enriquecimento no seu próprio produto.

Se o que você quer de fato é o resultado, a eesel vende a outra metade da equação: colegas de IA prontos para trabalhar que você contrata para uma função, não um motor que você monta. O colega de IA para helpdesk entra na sua fila atual, aprende com seus tickets antigos e sua central de ajuda desde o primeiro dia, e redige ou envia respostas automaticamente dentro do Zendesk, Freshdesk ou Slack. O redator de blog com IA faz o mesmo com conteúdo. Cada um chega com as habilidades, integrações e contexto da empresa para sua função, então não há esquema para desenhar.

E se você vive no terminal, a eesel também te atende ali. A CLI da eesel conduz o mesmo colega que o painel: npx @eesel/cli init chat-bubble --site https://your-site.com cria um workspace, e cada comando imprime JSON com um campo hint dizendo a um agente o que executar em seguida. Isso o torna controlável não só por uma pessoa, mas por agentes de programação como Claude Code, Cursor e Codex, e cada workspace também funciona como servidor MCP via eesel mcp token. Assim você tem o mesmo controle agêntico e programável que a API da Exa oferece, só que o que você programa é um colega que já conhece o seu negócio, não um pipeline de pesquisa que você ainda precisa construir. Dá para testar de graça, sem cartão.
Perguntas frequentes
Quanto custa cada execução do Exa Agent Ultra?
Qual é a diferença entre os níveis de esforço do Exa Agent?
auto e ultra são medidos por uso, com limites padrão de US$ 5 e US$ 20, respectivamente. O Ultra é a configuração máxima, feita para levar uma tarefa até a exaustão.O Exa Agent Ultra é mais caro que um modelo de fronteira?
O Exa Agent Ultra tem plano gratuito?
Qual é a forma mais barata de fazer pesquisa com agentes sobre meus próprios tickets?

Article by
Rama Adi
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







