
O que o Exa Agent Ultra realmente é
Primeiro, a empresa. A Exa é uma API de busca feita para agentes de IA, dando aos modelos acesso em tempo real à web com resultados estruturados e citados. Ela também não é pequena: a Exa diz que 500.000 desenvolvedores constroem sobre ela, com um índice que ela calcula em 100 bilhões de documentos. O Devin da Cognition, o Cursor e o Firefox dependem dela para recuperação de informação.
O Agent Ultra fica em cima desse índice. A Exa Agent API é a "API única para pesquisa web de fronteira" da Exa, e o esforço é o controle que você gira para decidir o quanto ela trabalha. Os níveis são minimal, low, medium, high, xhigh, auto e ultra, com auto como padrão. O Ultra é o topo dessa escada, e o changelog o data em 24 de setembro de 2026.
O modelo mental que me ajudou: os níveis fixos respondem a uma pergunta, o Ultra conclui uma investigação. A Exa o descreve como o modo "feito para a pesquisa mais difícil, onde completude e precisão importam mais", ou seja, pesquisa profunda, montagem de listas e enriquecimento de entidades, qualquer tarefa que precise rodar até a exaustão.

Na prática, isso significa tarefas como "toda empresa dos EUA que faz ferramentas de automação de navegador", ou "toda fintech de Série A a C que contratou um Head of Risk nos últimos 12 meses", ou enriquecer uma lista com um campo que exige um julgamento, como "esta empresa vende para hospitais?", cada resposta trazendo uma URL citada como evidência. Se você já tentou montar uma dessas listas à mão, sabe exatamente qual tarefa a Exa está mirando.
Como o Agent Ultra funciona por baixo dos panos
A parte interessante é a orquestração, não um modelo isolado. Quando você envia uma consulta, o Exa Agent divide a tarefa em subtarefas e atribui subagentes para pesquisar vários domínios ao mesmo tempo. O Ultra apenas aumenta muito o número de subagentes e de fontes.
Duas decisões de design fazem tudo funcionar junto. A primeira é uma mistura de modelos: a Exa diz que coloca "inteligência de fronteira onde a tarefa precisa e modelos mais rápidos onde eles bastam", então você não paga preço de fronteira por cada subpasso trivial. A segunda é o modelo de highlights eficiente em tokens da Exa, que extrai os trechos mais relevantes de uma página em vez de enfiar tudo no contexto, com reduções declaradas de até 94% no uso de tokens. É daí que vem boa parte da vantagem de custo.

Você recebe a pesquisa montada como um único resultado fundamentado, em vez de orquestrar cada chamada de /search e /contents por conta própria. Uma execução concluída traz output.text para uma resposta em linguagem natural, output.structured para JSON validado por esquema quando você passa um outputSchema, e output.grounding para as citações em nível de campo. Você também pode controlar tudo pelo servidor MCP da Exa usando a ferramenta agent_run, o que significa que um agente de programação como o Claude Code ou o Cursor pode chamá-lo diretamente.
As alegações dos benchmarks e como lê-las
Aqui a Exa vai alto. O Agent Ultra, segundo ela, supera o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em suas configurações de esforço máximo em quatro benchmarks. Os números brutos:
| Benchmark | O que mede | Agent Ultra | Opus 5.5 | GPT-6 Astra | Perplexity Agent |
|---|---|---|---|---|---|
| WANDR | Pesquisa profunda (soft recall) | 81.4% | 72.3% | 26.0% | 40.1% |
| DeepSearchQA | Pesquisa web em várias etapas (F1) | 93.9% | 77.6% | 85.3% | 89.7% |
| WideSearch | Coleta ampla de informação (F1 por linha) | 58.9% | 51.6% | 54.7% | 56.0% |
| Find-All Company | Inteligência GTM (entidades aprovadas/tarefa) | 2,451 | 146 | 113 | 98 |
A linha Find-All Company é a que faz você parar: uma média de 2.451 entidades aprovadas por tarefa contra 146 do segundo melhor sistema. É o design "roda até a exaustão" aparecendo como número. O gráfico WANDR da Exa conta a história do custo ao lado, com o Ultra chegando a cerca de 81% de soft recall por aproximadamente US$ 18 por tarefa, enquanto o Opus 5.5 alcança cerca de 72% por quase US$ 38.

Agora a leitura honesta. Essas são execuções de benchmark da própria Exa, em uma estrutura de testes mantida pela Exa, julgadas por um modelo escolhido pela Exa (ela usa o gpt-6-luna como avaliador). A Exa é transparente sobre a metodologia, o que conta a favor, e informa números publicados dos concorrentes onde existem. Mas benchmarks de fornecedor favorecem o fornecedor por construção, então a posição justa é: impressionante, plausível e não verificado. Do lado da comunidade, o lançamento foi barulhento no X, embora mais como empolgação do que como prova prática.
"So perplexity is dead 2x now"
Essa resposta ficou no topo das respostas ao post de lançamento da Exa, que por si só somou quase 2.000 curtidas. Alguns profissionais comentaram que estavam "testando agora", que é mais ou menos onde está a verificação independente dois dias depois. É realmente cedo, e eu esperaria testes externos antes de tratar o ranking como definitivo.
Quanto custa o Exa Agent Ultra
A Exa é pay-as-you-go sem licenças por usuário, e os níveis de esforço do Agent correspondem diretamente ao preço. Os níveis fixos são previsíveis por solicitação, e o Ultra é a exceção medida por consumo.

| Nível de esforço | Preço | Ideal para |
|---|---|---|
| minimal | $0.012 / solicitação | Consultas leves, menor custo |
| low | $0.025 / solicitação | Tarefas factuais simples e restritas |
| medium | $0.10 / solicitação | O ponto de partida padrão |
| high | $0.50 / solicitação | Pesquisa mais difícil, completude mais rigorosa |
| xhigh | $1.00 / solicitação | Tarefas de alto valor, com muita verificação |
| ultra | Por consumo, limite padrão de $20 | Montagem exaustiva de listas e pesquisa |
Por baixo das execuções medidas, a Exa cobra as Agent Compute Units a US$ 0,10 cada, as chamadas de ferramenta de busca a US$ 0,005, o enriquecimento de e-mail a US$ 0,02 e o de telefone a US$ 0,07. O parâmetro budget.maxCostDollars define o teto das execuções auto e ultra, aceitando de US$ 1 a US$ 100, e budget.maxDurationSeconds permite limitar a duração de 5 minutos a 3 horas. Uma execução que termina antes custa menos que o teto, e você pode interromper uma no meio e ficar com o que ela encontrou.
O limite padrão de US$ 20 é o número para se deter. Para um mapa de mercado realmente exaustivo, US$ 20 por uma tarefa de pesquisa que levaria um dia inteiro de uma pessoa é uma pechincha. Para um fluxo de trabalho disparado centenas de vezes, o mesmo limite é dinheiro de verdade, e é por isso que a Exa oferece os controles de orçamento. Há também um nível Starter gratuito com US$ 10 em créditos mensais e sem cartão, para que você teste com as suas próprias tarefas antes de se comprometer.
Onde se encaixa: infraestrutura de pesquisa, não uma contratação para o suporte
Esta é a parte que mais quero deixar clara, porque o enquadramento "IA que pesquisa por você" convida a uma suposição errada. O Exa Agent Ultra é infraestrutura. É um motor fantástico para um pipeline de GTM que enriquece leads, um fluxo de due diligence que mapeia um mercado ou um agente de pesquisa que você mesmo constrói. Em todos esses casos, você escreve o código, define o esquema e é dono do fluxo de trabalho em torno da API.
Isso é um trabalho completamente diferente de colocar uma IA na sua fila de suporte, e a diferença confunde equipes o tempo todo.

Trabalho no lado de produto da eesel, e passamos anos colocando IA em filas de suporte reais, em milhares de tickets reais e implantações com clientes. A lição que ficou: a qualidade bruta de recuperação não é a parte difícil da automação de suporte. O difícil é a confiança, as integrações de tickets, o embasamento no conhecimento interno e saber quando passar para uma pessoa. Uma API de pesquisa, por melhor que seja, não entrega nada disso de fábrica. Você teria de construir por conta própria a conexão com o helpdesk, a lógica de escalonamento e as verificações de segurança por cima dela.
Essa é a linha entre infraestrutura e um colega, e é por isso que pensamos na eesel como uma plataforma de colegas de IA e não como uma API. Você contrata um colega para uma função definida, e ele chega pronto para trabalhar.
Experimente a eesel
Se o trabalho que você realmente tem é suporte, e não um pipeline de pesquisa, é exatamente para isso que um agente de IA da eesel foi feito. Ele se conecta ao Zendesk, ao Freshdesk ou ao Gorgias, aprende com seus tickets antigos e documentos de ajuda, e rascunha ou envia respostas desde o primeiro dia, sem código de integração de API. E como bots confiantes podem estar confiantemente errados, cada implantação é simulada primeiro com seus tickets históricos, para que você veja a taxa de resolução antes de um único cliente ver.

Se você gostou da ideia de controlar a Exa por um terminal ou um agente de programação, a eesel também encontra você aí. A CLI da eesel opera o mesmo colega e o mesmo workspace do painel, e imprime JSON, de modo que uma pessoa pode executá-la manualmente, um script pode automatizá-la e agentes de programação como Claude Code, Codex e Cursor podem controlá-la diretamente. Você pode inspecionar as instruções de um colega, enviar um prompt de teste fictício, revisar a resposta exata e as fontes que ele usou, e depois propor uma mudança de instrução pontual para um responsável aprovar. É o mesmo controle sem interface e amigável a agentes que atrai as pessoas a uma API como a da Exa, voltado ao trabalho real de operar o suporte em vez de montar uma stack de pesquisa. Você pode experimentar a eesel grátis e ver funcionando nos seus próprios tickets.
Perguntas frequentes
O que é o Exa Agent Ultra?
O Exa Agent Ultra é o nível de esforço mais alto da Exa Agent API, um endpoint de pesquisa profunda que divide uma solicitação em subagentes paralelos, lê milhares de fontes e devolve um resultado estruturado e citado. Ele é feito para montar listas exaustivas e enriquecer entidades, não para consultas rápidas. Se você quer esse tipo de pesquisa empacotado como um agente de IA de suporte, em vez de chamadas brutas de API, isso é outra categoria de produto.
Quanto custa o Exa Agent Ultra?
O Ultra é medido pelo preço pay-as-you-go da Exa, cobrado pelas tarifas padrão de uso do Agent até um limite padrão de US$ 20 por execução. Você pode mover o teto com budget.maxCostDollars, de US$ 1 a US$ 100. Os níveis de esforço fixos são mais baratos e previsíveis: de minimal a US$ 0,012 até xhigh a US$ 1,00 por solicitação. Ferramentas de suporte como os preços da eesel cobram por resolução, o que se encaixa melhor em uma fila de tickets.
Como o Agent Ultra é diferente dos outros níveis de esforço da Exa?
O esforço é um único controle no Exa Agent: minimal, low, medium, high, xhigh, auto e ultra. Os níveis fixos têm um preço definido por solicitação, enquanto o ultra é medido por consumo e executa uma tarefa até a exaustão. Aumentar o controle compra mais subagentes, mais fontes e mais verificação, com maior custo por tarefa.
O Exa Agent Ultra é bom para atendimento ao cliente?
Ele é infraestrutura de recuperação de informação, então é excelente para reunir pesquisa citada da web, mas não se conecta ao seu helpdesk, não aprende seus documentos internos nem envia respostas sozinho. Para o suporte de linha de frente, você quer um colega que se conecte à sua fila de tickets e responda com o seu próprio conhecimento, que é o que um agente de IA da eesel faz.
Quais são os resultados do Exa Agent Ultra nos benchmarks?
A Exa informa que o Agent Ultra supera o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em quatro benchmarks de pesquisa: 81,4% de soft recall no WANDR, 93,9% de F1 no DeepSearchQA, 58,9% de F1 por linha no WideSearch e uma média de 2.451 entidades aprovadas por tarefa no Find-All Company. Essas são execuções de benchmark da própria Exa, então trate-as como números do fornecedor até que apareçam testes independentes. Para qualquer agente de IA que você implante, testar com os seus próprios dados importa mais do que o ranking.

Article by
Rama Adi
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.






