Preços do Exa Agent Ultra: quanto a pesquisa profunda realmente custa em 2026

Rama Adi
Escrito por

Rama Adi

Katelin Teen
Revisado por

Katelin Teen

Última edição September 27, 2026

Verificado por especialista
Ilustração do agente de pesquisa profunda da Exa extraindo dados estruturados de toda a web

O que o Exa Agent Ultra realmente é

A Exa começou como Metaphor, uma empresa da YC S21 que criava busca na web baseada em embeddings, e cresceu até virar uma API de busca e rastreamento da web que produtos de IA chamam por baixo dos panos. O Cursor, por exemplo, usa a Exa para trazer a documentação mais recente para seu agente de programação. O Exa Agent é a camada acima da busca bruta: um endpoint assíncrono que recebe uma consulta em linguagem natural mais um esquema de saída, e então dispara suas próprias buscas, lê as páginas por trás delas, verifica candidatos e devolve JSON estruturado e com citações.

O Ultra não é um produto separado. É o degrau mais alto do seletor effort do Exa Agent. Com effort: "ultra", o agente coordena muitos subagentes em milhares de fontes, usando modelos de fronteira onde a tarefa é difícil e modelos mais rápidos onde bastam. A Exa o posiciona para trabalhos que precisam ir até a exaustão: montar um mapa de mercado completo, enriquecer cada linha de uma lista ou verificar um critério difícil de checar em registros, imprensa e sites de reguladores.

O enquadramento do lançamento foi direto: "qualidade de fronteira por uma fração do custo". Isso é tanto uma afirmação de preço quanto de qualidade, e é exatamente por isso que a medição importa.

Então, quanto custa o Exa Agent Ultra?

Esta é a resposta honesta que a página de marketing da Exa comprime em uma faixa: a Agent API tem sete níveis de esforço, e só cinco deles têm preço fixo. auto e ultra são medidos por uso.

A escala de esforço do Exa Agent, do minimal a preço fixo de US$ 0,012 por solicitação até o nível Ultra medido por uso com limite padrão de US$ 20
A escala de esforço do Exa Agent, do minimal a preço fixo de US$ 0,012 por solicitação até o nível Ultra medido por uso com limite padrão de US$ 20
Nível de esforçoPreçoIdeal para
minimalUS$ 0,012 / solicitaçãoConsultas factuais restritas, respostas curtas
lowUS$ 0,025 / solicitaçãoConsultas simples, pesquisa leve
mediumUS$ 0,10 / solicitaçãoPadrão para pesquisa comum
highUS$ 0,50 / solicitaçãoPesquisa mais difícil, exigência maior de completude
xhighUS$ 1,00 / solicitaçãoTarefas de alto valor, esquemas complexos
autoMedido por uso, até um limite padrão de US$ 5Trabalho de escopo variável quando você não sabe a dificuldade
ultraMedido por uso, até um limite padrão de US$ 20Montagem de listas grandes, pesquisa exaustiva

Então a manchete honesta para o Ultra é "medido por uso, com limite de US$ 20 por execução por padrão". O limite é um teto, não uma cobrança fixa: uma execução que termina cedo custa menos, e você define seu próprio limite com budget.maxCostDollars (faixa aceita de US$ 1 a US$ 100). A documentação do Agent confirma os mesmos números, então não é arredondamento de marketing.

A decisão de design merece destaque. Todos os outros níveis de esforço cobram uma taxa fixa, quer a tarefa fosse trivial ou complicada. O Ultra, como o auto, só cobra a computação e as ferramentas que uma execução realmente consome. Para as tarefas exaustivas que o Ultra mira, em que uma única consulta pode disparar dezenas de subagentes, esse modelo baseado em uso é a diferença entre previsível e doloroso.

A parte medida, em números claros

Quando uma execução é medida por uso, dois componentes determinam a fatura, com o enriquecimento como terceira linha opcional.

O que uma execução do Exa Agent Ultra fatura: unidades de computação a US$ 0,10 cada, chamadas de busca a US$ 0,005 cada, enriquecimento de e-mail e telefone, tudo sob um limite padrão de US$ 20
O que uma execução do Exa Agent Ultra fatura: unidades de computação a US$ 0,10 cada, chamadas de busca a US$ 0,005 cada, enriquecimento de e-mail e telefone, tudo sob um limite padrão de US$ 20
ComponenteTaxaO que mede
Agent Compute Units (ACU)US$ 0,10 / ACUComputação do modelo ao longo de toda a execução
Chamadas da ferramenta de buscaUS$ 0,005 / buscaCada busca na web que o agente dispara
Enriquecimento de e-mailUS$ 0,02 / e-mailConsultas de e-mails de contato
Enriquecimento de telefoneUS$ 0,07 / número de telefoneConsultas de telefones de contato

A métrica principal é usage.agentComputeUnits. A Exa é explícita ao dizer que consultas complexas, especialmente com um campo input.data grande, precisam de mais etapas de raciocínio e consomem mais ACUs. Então um enriquecimento amplo e baseado em julgamento ("esta empresa vende para hospitais, com uma URL citada como evidência?") vai gastar muito mais que uma consulta factual direta.

Alguns exemplos práticos:

  • Uma execução moderada do Ultra que usa 60 ACUs e 80 buscas custa 60 x $0.10 + 80 x $0.005 = $6.40. Bem abaixo do limite de US$ 20.
  • Uma montagem pesada de lista que atinge 150 ACUs e 300 buscas custa 150 x $0.10 + 300 x $0.005 = $16.50, ainda abaixo do limite, antes de qualquer enriquecimento.
  • Adicione 200 consultas de e-mail a essa execução pesada e você chega a $16.50 + $4.00 = $20.50, então o limite de US$ 20 a cortaria (o enriquecimento fica fora do medidor principal, então confira aqui suas configurações de orçamento).

Coloque seus próprios números abaixo.

Onde o Ultra se encaixa nos preços mais amplos da Exa

O Exa Agent é um produto dentro de um cardápio maior. Se você está calculando o Ultra, ajuda ver os vizinhos, porque muitas equipes recorrem à Search API, mais barata, e orquestram o próprio laço em vez de pagar o Agent para fazer isso.

EndpointPreço base (até 10 resultados)Por resultado extraResumos de página com IA
SearchUS$ 7 / 1k solicitaçõesUS$ 1 / 1k+US$ 1 / 1k páginas
Deep SearchUS$ 12 / 1k solicitaçõesUS$ 1 / 1k+US$ 1 / 1k páginas
Deep-Reasoning SearchUS$ 15 / 1k solicitaçõesUS$ 1 / 1k+US$ 1 / 1k páginas
ContentsUS$ 1 / 1k páginas-+US$ 1 / 1k páginas
MonitorsUS$ 15 / 1k solicitaçõesUS$ 1 / 1k-
AnswerUS$ 5 / 1k solicitações--

O dilema é o clássico entre construir e comprar. A busca bruta a US$ 7 por 1.000 solicitações é barata, mas você escreve o laço: as buscas, a leitura das páginas, a verificação, a validação do esquema. O Agent Ultra reúne tudo isso em uma única chamada medida. Você paga pela orquestração, não só pela recuperação.

Do lado da conta, três planos controlam o acesso:

PlanoPreçoDestaques
StarterGrátisUS$ 10 em créditos/mês + US$ 10 de bônus de integração, sem cartão, 10 QPS de busca, 50 de concorrência de agentes
DeveloperPague conforme usarCobrança baseada em uso, até 25 QPS de busca, SOC 2 Type II
EnterprisePersonalizadoRetenção zero de dados, HIPAA, SSO/SCIM, até 1.000 resultados por busca

Os créditos gratuitos bastam para executar o Ultra algumas vezes antes de se comprometer, que é a forma certa de dimensionar seu próprio consumo de ACU antes de confiar na calculadora acima.

Exa Connect: o complemento que se soma por cima

Uma linha fácil de perder: se sua execução do Ultra puxa dados de parceiros premium pelo Exa Connect, isso é cobrado além do uso do Agent. Os provedores de autoatendimento incluem Similarweb, Financial Datasets e Fiber.ai, com ZoomInfo, Crunchbase e Harmonic disponíveis sob solicitação.

Para uma equipe go-to-market montando uma lista de contas enriquecida, é aqui que o custo real de uma execução pode passar do medidor base, porque agora você paga a computação da Exa e a taxa de dados de um terceiro. Traga sua própria chave (bring-your-own-key) é aceito para qualquer provedor, então se você já paga a ZoomInfo, não paga duas vezes pelos dados em si. Vale modelar isso antes de assumir que o limite de US$ 20 é seu teto.

Vale a pena gastar com o Ultra?

Todo o argumento da Exa é que o modelo medido entrega qualidade de fronteira mais barato do que rodar o agente de um modelo de fronteira. No seu benchmark WANDR (Wide And Deep Research, modelado em enriquecimento de due diligence e pesquisa jurídica), o Ultra afirma estabelecer o estado da arte.

Tabela de benchmark da Exa comparando o Agent Ultra com Opus 5.5, GPT-6 Astra e Perplexity Agent em WANDR, DeepSearchQA, WideSearch e Find-All Company
Tabela de benchmark da Exa comparando o Agent Ultra com Opus 5.5, GPT-6 Astra e Perplexity Agent em WANDR, DeepSearchQA, WideSearch e Find-All Company

As afirmações específicas, todas medidas contra a configuração de esforço máximo de cada concorrente:

  • WANDR: +12,6% sobre o Opus 5.5, com metade do custo por tarefa do Opus 5.5.
  • DeepSearchQA: +21,0% sobre o Opus 5.5 e +10,1% sobre o GPT-6 Astra, com custo por tarefa 46% menor que o do GPT-6 Astra.
  • WideSearch: +14,1% sobre o Opus 5.5, com o menor custo por tarefa entre os quatro sistemas.
  • Find-All Company: +1579% sobre o Opus 5.5 em entidades válidas encontradas, com o menor custo por entidade.
Gráfico WANDR da Exa mostrando o soft recall contra o custo médio por tarefa, com o Exa Agent de Auto a Ultra superando Opus 5.5, GPT-6 Astra e Perplexity Agent
Gráfico WANDR da Exa mostrando o soft recall contra o custo médio por tarefa, com o Exa Agent de Auto a Ultra superando Opus 5.5, GPT-6 Astra e Perplexity Agent

Duas ressalvas honestas. Esses são números da própria Exa no seu próprio ambiente de testes. A Exa diz que reporta números publicados quando os concorrentes os tinham e que executou o benchmark ela mesma nos demais casos, e que trocou por um modelo juiz mais barato (gpt-6-luna). Tudo isso é razoável, mas ainda é conduzido pelo fornecedor. As diferenças no Find-All Company em particular são tão grandes que dizem mais sobre o quanto agentes de uso geral lidam mal com a montagem exaustiva de listas do que sobre uma vantagem de qualidade em condições iguais. Leia como "o Ultra é genuinamente feito para pesquisa ampla, e agentes de chat genéricos não são", que é uma conclusão justa e útil.

O que os desenvolvedores dizem sobre o custo da Exa

O debate sobre preços em torno da Exa é anterior ao Ultra. No Launch HN da empresa (412 pontos, 133 comentários), o fundador Will Bryk foi franco sobre por que o produto mais completo fica atrás de um login em vez de ser gratuito:

Hacker News

"we'd love to make the product as accessible and cheap as possible, but as of state of AI costs of 2025, it's a very expensive product to run and so we have it login gated."

Esse é o contexto útil para o medidor do Ultra. Pesquisa profunda e exaustiva na web é cara de operar, e a resposta da Exa é expor esse custo com honestidade e limitá-lo, em vez de escondê-lo atrás de uma taxa fixa que ou cobra demais de usuários leves ou perde dinheiro com os pesados. O limite de US$ 20 faz muito trabalho silencioso: é a promessa de que "executar até a exaustão" não vai significar "faturar até a exaustão".

eesel: um colega, não um motor para conectar

Aqui vai o reenquadramento para terminar. O Exa Agent Ultra é infraestrutura. É um motor de pesquisa profunda genuinamente forte, mas entrega uma API e um esquema e espera que você construa o pipeline, consulte as execuções, valide a saída e conecte tudo ao lugar onde o trabalho realmente acontece. É a ferramenta certa se você é desenvolvedor e quer embutir montagem de listas ou enriquecimento no seu próprio produto.

O painel de integração da eesel mostrando um colega de IA para helpdesk sendo configurado para trabalhar no Zendesk, no Slack e em um link de chat compartilhável, a partir da eesel
O painel de integração da eesel mostrando um colega de IA para helpdesk sendo configurado para trabalhar no Zendesk, no Slack e em um link de chat compartilhável, a partir da eesel

Se o que você quer de fato é o resultado, a eesel vende a outra metade da equação: colegas de IA prontos para trabalhar que você contrata para uma função, não um motor que você monta. O colega de IA para helpdesk entra na sua fila atual, aprende com seus tickets antigos e sua central de ajuda desde o primeiro dia, e redige ou envia respostas automaticamente dentro do Zendesk, Freshdesk ou Slack. O redator de blog com IA faz o mesmo com conteúdo. Cada um chega com as habilidades, integrações e contexto da empresa para sua função, então não há esquema para desenhar.

O Exa Agent é um motor de pesquisa que você mesmo conecta; a eesel é um colega pronto para trabalhar, contratado em minutos, que atua dentro do seu helpdesk
O Exa Agent é um motor de pesquisa que você mesmo conecta; a eesel é um colega pronto para trabalhar, contratado em minutos, que atua dentro do seu helpdesk

E se você vive no terminal, a eesel também te atende ali. A CLI da eesel conduz o mesmo colega que o painel: npx @eesel/cli init chat-bubble --site https://your-site.com cria um workspace, e cada comando imprime JSON com um campo hint dizendo a um agente o que executar em seguida. Isso o torna controlável não só por uma pessoa, mas por agentes de programação como Claude Code, Cursor e Codex, e cada workspace também funciona como servidor MCP via eesel mcp token. Assim você tem o mesmo controle agêntico e programável que a API da Exa oferece, só que o que você programa é um colega que já conhece o seu negócio, não um pipeline de pesquisa que você ainda precisa construir. Dá para testar de graça, sem cartão.

Perguntas frequentes

Quanto custa cada execução do Exa Agent Ultra?
Não há preço fixo por execução. O Exa Agent Ultra é medido por uso: você paga US$ 0,10 por Agent Compute Unit e US$ 0,005 por chamada da ferramenta de busca, com o enriquecimento de contatos cobrado à parte. Um limite padrão de US$ 20 por execução impede que uma única execução do Ultra saia do controle, e você pode definir seu próprio teto entre US$ 1 e US$ 100.
Qual é a diferença entre os níveis de esforço do Exa Agent?
O esforço é um seletor que vai de minimal a ultra. Os níveis fixos têm preços fixos por solicitação (de US$ 0,012 no minimal até US$ 1,00 no x-high). auto e ultra são medidos por uso, com limites padrão de US$ 5 e US$ 20, respectivamente. O Ultra é a configuração máxima, feita para levar uma tarefa até a exaustão.
O Exa Agent Ultra é mais caro que um modelo de fronteira?
No benchmark WANDR da própria Exa, o Ultra custou metade por tarefa do Opus 5.5 e teve qualidade maior. Esse é um número publicado pela Exa, então trate como uma afirmação do fornecedor, mas o modelo medido significa que execuções simples terminam baratas e só tarefas difíceis e exaustivas se aproximam do limite de US$ 20.
O Exa Agent Ultra tem plano gratuito?
O plano Starter da Exa dá US$ 10 em créditos por mês mais um bônus de integração de US$ 10 sem cartão, o suficiente para testar o Ultra em algumas execuções. Depois disso, você passa para o pagamento por uso no plano Developer.
Qual é a forma mais barata de fazer pesquisa com agentes sobre meus próprios tickets?
Se o seu objetivo é suporte ao cliente ou conteúdo, e não montar listas em massa, talvez você nem precise construir um pipeline de pesquisa. Um colega de IA para o helpdesk já aprende com seus tickets e documentos e trabalha dentro do seu helpdesk, então você evita a integração via API que o Exa Agent espera que você faça sozinho.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Ilustração desenhada à mão de um desenvolvedor diante de um laptop com resultados de busca do Exa e dados estruturados se espalhando
Trending

Exa Agent Ultra: o que faz, como funciona e quanto custa

Um olhar direto sobre o Exa Agent Ultra: a API de pesquisa profunda com enxame de subagentes, os resultados de benchmarks, o preço por execução e onde ele se encaixa em pesquisa e suporte.

Rama AdiRama AdiSep 27, 2026
Banner ilustrado para um guia sobre os preços e custos de API do Google Gemini 3.5 Pro
Trending

Preços do Gemini 3.5 Pro: quanto custa (e o que ainda falta)

Uma resposta direta sobre os preços do Gemini 3.5 Pro: ele ainda não está disponível. Veja quanto custa o nível Pro atual, os planos para consumidores e a conta real da API.

Kurnia KharismaKurnia KharismaJul 21, 2026
Ilustração do detalhamento de preços do Skywork AI
Trending

Preço do Skywork AI: quanto custa de verdade em 2026

Um resumo claro do preço do Skywork AI: o teste de $1, o sistema de créditos, o plano Pro de $19,99 e as armadilhas de cobrança a observar antes de pagar.

Kurnia KharismaKurnia KharismaJul 20, 2026
Ilustração do detalhamento de preços do PromptQL
Trending

Preço do PromptQL: quanto custa de verdade em 2026

Um detalhamento do preço do PromptQL: a unidade cobrável OLU, a tarifa promocional de US$ 0,14, créditos gratuitos, o multiplicador de modelo que realmente define sua fatura e exemplos reais de custo.

Kurnia KharismaKurnia KharismaJul 10, 2026
Ilustração de um foguete decolando, representando o lançamento do modelo MiniMax M3.1 Flash
Trending

MiniMax M3.1 Flash: especificações, preços e como testar a preview

O MiniMax M3.1 Flash é um modelo de programação com 1M de contexto que chegou ao MiniMax Code sem preço. O que ele realmente é e como testá-lo.

Rama AdiRama AdiSep 28, 2026
Ilustração anunciando o Claude Fable 5.1, o novo modelo de fronteira da Anthropic
Trending

Claude Fable 5.1: preços, capacidades e o que isso significa para sua equipe

Claude Fable 5.1 é o modelo mais capaz da Anthropic até agora. Aqui estão os preços reais, o que mudou em relação ao Fable 5 e onde ele se encaixa para equipes de suporte e conteúdo.

KiraKiraSep 2, 2026
Ilustração de um modelo de controle de robô humanoide, representando o Gemini Robotics 2
Trending

Gemini Robotics 2: o que os números da DeepMind mostram

Gemini Robotics 2 lança três modelos e uma tabela de sucesso por tarefa em que a maioria das pontuações fica abaixo de 80%. Essa tabela é a parte mais útil de todo o lançamento.

KiraKiraAug 4, 2026
Ilustração de um chip de modelo compacto direcionando um token por dois caminhos de especialistas iluminados entre muitos apagados, para um artigo explicativo sobre o Inkling-Small
Trending

Inkling-Small explicado: um modelo de 276B em que 12B fazem o trabalho

O que o Inkling-Small realmente é: um MoE de pesos abertos 276B/12B da Thinking Machines, a janela de contexto em que a documentação e os provedores discordam, quanto custa de fato um milhão de tokens e onde ele se encaixa numa stack de suporte.

Rama AdiRama AdiAug 4, 2026
Ilustração de um chip de modelo compacto a encaminhar um token por dois caminhos de especialistas iluminados entre muitos apagados, para uma explicação do Inkling-Small
Trending

Inkling-Small explicado: um modelo de 276B com 12B fazendo o trabalho

O que Inkling-Small realmente é: um MoE de pesos abertos de 276B/12B da Thinking Machines, a janela de contexto em que a documentação e os provedores discordam, o que um milhão de tokens realmente custa, e onde ele se encaixa em uma stack de suporte.

Rama AdiRama AdiAug 4, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis