Exa Agent Ultra: o que faz, como funciona e quanto custa

Rama Adi
Escrito por

Rama Adi

Katelin Teen
Revisado por

Katelin Teen

Última edição September 27, 2026

Verificado por especialista
Ilustração desenhada à mão de um desenvolvedor diante de um laptop com resultados de busca do Exa e dados estruturados se espalhando

O que o Exa Agent Ultra realmente é

Primeiro, a empresa. A Exa é uma API de busca feita para agentes de IA, dando aos modelos acesso em tempo real à web com resultados estruturados e citados. Ela também não é pequena: a Exa diz que 500.000 desenvolvedores constroem sobre ela, com um índice que ela calcula em 100 bilhões de documentos. O Devin da Cognition, o Cursor e o Firefox dependem dela para recuperação de informação.

O Agent Ultra fica em cima desse índice. A Exa Agent API é a "API única para pesquisa web de fronteira" da Exa, e o esforço é o controle que você gira para decidir o quanto ela trabalha. Os níveis são minimal, low, medium, high, xhigh, auto e ultra, com auto como padrão. O Ultra é o topo dessa escada, e o changelog o data em 24 de setembro de 2026.

O modelo mental que me ajudou: os níveis fixos respondem a uma pergunta, o Ultra conclui uma investigação. A Exa o descreve como o modo "feito para a pesquisa mais difícil, onde completude e precisão importam mais", ou seja, pesquisa profunda, montagem de listas e enriquecimento de entidades, qualquer tarefa que precise rodar até a exaustão.

Tabela de benchmarks do Exa Agent Ultra mostrando o Agent Ultra contra o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em WANDR, DeepSearchQA, WideSearch e Find-All Company, conforme divulgado pela Exa
Tabela de benchmarks do Exa Agent Ultra mostrando o Agent Ultra contra o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em WANDR, DeepSearchQA, WideSearch e Find-All Company, conforme divulgado pela Exa

Na prática, isso significa tarefas como "toda empresa dos EUA que faz ferramentas de automação de navegador", ou "toda fintech de Série A a C que contratou um Head of Risk nos últimos 12 meses", ou enriquecer uma lista com um campo que exige um julgamento, como "esta empresa vende para hospitais?", cada resposta trazendo uma URL citada como evidência. Se você já tentou montar uma dessas listas à mão, sabe exatamente qual tarefa a Exa está mirando.

Como o Agent Ultra funciona por baixo dos panos

A parte interessante é a orquestração, não um modelo isolado. Quando você envia uma consulta, o Exa Agent divide a tarefa em subtarefas e atribui subagentes para pesquisar vários domínios ao mesmo tempo. O Ultra apenas aumenta muito o número de subagentes e de fontes.

Duas decisões de design fazem tudo funcionar junto. A primeira é uma mistura de modelos: a Exa diz que coloca "inteligência de fronteira onde a tarefa precisa e modelos mais rápidos onde eles bastam", então você não paga preço de fronteira por cada subpasso trivial. A segunda é o modelo de highlights eficiente em tokens da Exa, que extrai os trechos mais relevantes de uma página em vez de enfiar tudo no contexto, com reduções declaradas de até 94% no uso de tokens. É daí que vem boa parte da vantagem de custo.

Infográfico mostrando como uma consulta de pesquisa se abre pelo orquestrador do Ultra em subagentes paralelos que leem milhares de fontes e depois converge em um único resultado estruturado e citado
Infográfico mostrando como uma consulta de pesquisa se abre pelo orquestrador do Ultra em subagentes paralelos que leem milhares de fontes e depois converge em um único resultado estruturado e citado

Você recebe a pesquisa montada como um único resultado fundamentado, em vez de orquestrar cada chamada de /search e /contents por conta própria. Uma execução concluída traz output.text para uma resposta em linguagem natural, output.structured para JSON validado por esquema quando você passa um outputSchema, e output.grounding para as citações em nível de campo. Você também pode controlar tudo pelo servidor MCP da Exa usando a ferramenta agent_run, o que significa que um agente de programação como o Claude Code ou o Cursor pode chamá-lo diretamente.

As alegações dos benchmarks e como lê-las

Aqui a Exa vai alto. O Agent Ultra, segundo ela, supera o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em suas configurações de esforço máximo em quatro benchmarks. Os números brutos:

BenchmarkO que medeAgent UltraOpus 5.5GPT-6 AstraPerplexity Agent
WANDRPesquisa profunda (soft recall)81.4%72.3%26.0%40.1%
DeepSearchQAPesquisa web em várias etapas (F1)93.9%77.6%85.3%89.7%
WideSearchColeta ampla de informação (F1 por linha)58.9%51.6%54.7%56.0%
Find-All CompanyInteligência GTM (entidades aprovadas/tarefa)2,45114611398

A linha Find-All Company é a que faz você parar: uma média de 2.451 entidades aprovadas por tarefa contra 146 do segundo melhor sistema. É o design "roda até a exaustão" aparecendo como número. O gráfico WANDR da Exa conta a história do custo ao lado, com o Ultra chegando a cerca de 81% de soft recall por aproximadamente US$ 18 por tarefa, enquanto o Opus 5.5 alcança cerca de 72% por quase US$ 38.

Soft recall do WANDR em relação ao custo médio por tarefa, mostrando o Exa Agent Ultra mais alto e mais barato que o Opus 5.5, o GPT-6 Astra e o Perplexity Agent, conforme divulgado pela Exa
Soft recall do WANDR em relação ao custo médio por tarefa, mostrando o Exa Agent Ultra mais alto e mais barato que o Opus 5.5, o GPT-6 Astra e o Perplexity Agent, conforme divulgado pela Exa

Agora a leitura honesta. Essas são execuções de benchmark da própria Exa, em uma estrutura de testes mantida pela Exa, julgadas por um modelo escolhido pela Exa (ela usa o gpt-6-luna como avaliador). A Exa é transparente sobre a metodologia, o que conta a favor, e informa números publicados dos concorrentes onde existem. Mas benchmarks de fornecedor favorecem o fornecedor por construção, então a posição justa é: impressionante, plausível e não verificado. Do lado da comunidade, o lançamento foi barulhento no X, embora mais como empolgação do que como prova prática.

"So perplexity is dead 2x now"

Essa resposta ficou no topo das respostas ao post de lançamento da Exa, que por si só somou quase 2.000 curtidas. Alguns profissionais comentaram que estavam "testando agora", que é mais ou menos onde está a verificação independente dois dias depois. É realmente cedo, e eu esperaria testes externos antes de tratar o ranking como definitivo.

Quanto custa o Exa Agent Ultra

A Exa é pay-as-you-go sem licenças por usuário, e os níveis de esforço do Agent correspondem diretamente ao preço. Os níveis fixos são previsíveis por solicitação, e o Ultra é a exceção medida por consumo.

Infográfico dos níveis de esforço do Exa Agent como uma escada ascendente: minimal US$ 0,012, low US$ 0,025, medium US$ 0,10, high US$ 0,50, xhigh US$ 1,00 e um nível ultra destacado, medido até um teto de US$ 20, que roda até a exaustão
Infográfico dos níveis de esforço do Exa Agent como uma escada ascendente: minimal US$ 0,012, low US$ 0,025, medium US$ 0,10, high US$ 0,50, xhigh US$ 1,00 e um nível ultra destacado, medido até um teto de US$ 20, que roda até a exaustão
Nível de esforçoPreçoIdeal para
minimal$0.012 / solicitaçãoConsultas leves, menor custo
low$0.025 / solicitaçãoTarefas factuais simples e restritas
medium$0.10 / solicitaçãoO ponto de partida padrão
high$0.50 / solicitaçãoPesquisa mais difícil, completude mais rigorosa
xhigh$1.00 / solicitaçãoTarefas de alto valor, com muita verificação
ultraPor consumo, limite padrão de $20Montagem exaustiva de listas e pesquisa

Por baixo das execuções medidas, a Exa cobra as Agent Compute Units a US$ 0,10 cada, as chamadas de ferramenta de busca a US$ 0,005, o enriquecimento de e-mail a US$ 0,02 e o de telefone a US$ 0,07. O parâmetro budget.maxCostDollars define o teto das execuções auto e ultra, aceitando de US$ 1 a US$ 100, e budget.maxDurationSeconds permite limitar a duração de 5 minutos a 3 horas. Uma execução que termina antes custa menos que o teto, e você pode interromper uma no meio e ficar com o que ela encontrou.

O limite padrão de US$ 20 é o número para se deter. Para um mapa de mercado realmente exaustivo, US$ 20 por uma tarefa de pesquisa que levaria um dia inteiro de uma pessoa é uma pechincha. Para um fluxo de trabalho disparado centenas de vezes, o mesmo limite é dinheiro de verdade, e é por isso que a Exa oferece os controles de orçamento. Há também um nível Starter gratuito com US$ 10 em créditos mensais e sem cartão, para que você teste com as suas próprias tarefas antes de se comprometer.

Onde se encaixa: infraestrutura de pesquisa, não uma contratação para o suporte

Esta é a parte que mais quero deixar clara, porque o enquadramento "IA que pesquisa por você" convida a uma suposição errada. O Exa Agent Ultra é infraestrutura. É um motor fantástico para um pipeline de GTM que enriquece leads, um fluxo de due diligence que mapeia um mercado ou um agente de pesquisa que você mesmo constrói. Em todos esses casos, você escreve o código, define o esquema e é dono do fluxo de trabalho em torno da API.

Isso é um trabalho completamente diferente de colocar uma IA na sua fila de suporte, e a diferença confunde equipes o tempo todo.

Infográfico contrastando infraestrutura de pesquisa, onde você chama a API e constrói o fluxo de trabalho, com um colega pronto para trabalhar que se conecta ao seu helpdesk, já conhece seus documentos e responde tickets desde o primeiro dia
Infográfico contrastando infraestrutura de pesquisa, onde você chama a API e constrói o fluxo de trabalho, com um colega pronto para trabalhar que se conecta ao seu helpdesk, já conhece seus documentos e responde tickets desde o primeiro dia

Trabalho no lado de produto da eesel, e passamos anos colocando IA em filas de suporte reais, em milhares de tickets reais e implantações com clientes. A lição que ficou: a qualidade bruta de recuperação não é a parte difícil da automação de suporte. O difícil é a confiança, as integrações de tickets, o embasamento no conhecimento interno e saber quando passar para uma pessoa. Uma API de pesquisa, por melhor que seja, não entrega nada disso de fábrica. Você teria de construir por conta própria a conexão com o helpdesk, a lógica de escalonamento e as verificações de segurança por cima dela.

Essa é a linha entre infraestrutura e um colega, e é por isso que pensamos na eesel como uma plataforma de colegas de IA e não como uma API. Você contrata um colega para uma função definida, e ele chega pronto para trabalhar.

Experimente a eesel

Se o trabalho que você realmente tem é suporte, e não um pipeline de pesquisa, é exatamente para isso que um agente de IA da eesel foi feito. Ele se conecta ao Zendesk, ao Freshdesk ou ao Gorgias, aprende com seus tickets antigos e documentos de ajuda, e rascunha ou envia respostas desde o primeiro dia, sem código de integração de API. E como bots confiantes podem estar confiantemente errados, cada implantação é simulada primeiro com seus tickets históricos, para que você veja a taxa de resolução antes de um único cliente ver.

Visão geral do painel do helpdesk de IA da eesel mostrando conversas de suporte conectadas
Visão geral do painel do helpdesk de IA da eesel mostrando conversas de suporte conectadas

Se você gostou da ideia de controlar a Exa por um terminal ou um agente de programação, a eesel também encontra você aí. A CLI da eesel opera o mesmo colega e o mesmo workspace do painel, e imprime JSON, de modo que uma pessoa pode executá-la manualmente, um script pode automatizá-la e agentes de programação como Claude Code, Codex e Cursor podem controlá-la diretamente. Você pode inspecionar as instruções de um colega, enviar um prompt de teste fictício, revisar a resposta exata e as fontes que ele usou, e depois propor uma mudança de instrução pontual para um responsável aprovar. É o mesmo controle sem interface e amigável a agentes que atrai as pessoas a uma API como a da Exa, voltado ao trabalho real de operar o suporte em vez de montar uma stack de pesquisa. Você pode experimentar a eesel grátis e ver funcionando nos seus próprios tickets.

Perguntas frequentes

O que é o Exa Agent Ultra?

O Exa Agent Ultra é o nível de esforço mais alto da Exa Agent API, um endpoint de pesquisa profunda que divide uma solicitação em subagentes paralelos, lê milhares de fontes e devolve um resultado estruturado e citado. Ele é feito para montar listas exaustivas e enriquecer entidades, não para consultas rápidas. Se você quer esse tipo de pesquisa empacotado como um agente de IA de suporte, em vez de chamadas brutas de API, isso é outra categoria de produto.

Quanto custa o Exa Agent Ultra?

O Ultra é medido pelo preço pay-as-you-go da Exa, cobrado pelas tarifas padrão de uso do Agent até um limite padrão de US$ 20 por execução. Você pode mover o teto com budget.maxCostDollars, de US$ 1 a US$ 100. Os níveis de esforço fixos são mais baratos e previsíveis: de minimal a US$ 0,012 até xhigh a US$ 1,00 por solicitação. Ferramentas de suporte como os preços da eesel cobram por resolução, o que se encaixa melhor em uma fila de tickets.

Como o Agent Ultra é diferente dos outros níveis de esforço da Exa?

O esforço é um único controle no Exa Agent: minimal, low, medium, high, xhigh, auto e ultra. Os níveis fixos têm um preço definido por solicitação, enquanto o ultra é medido por consumo e executa uma tarefa até a exaustão. Aumentar o controle compra mais subagentes, mais fontes e mais verificação, com maior custo por tarefa.

O Exa Agent Ultra é bom para atendimento ao cliente?

Ele é infraestrutura de recuperação de informação, então é excelente para reunir pesquisa citada da web, mas não se conecta ao seu helpdesk, não aprende seus documentos internos nem envia respostas sozinho. Para o suporte de linha de frente, você quer um colega que se conecte à sua fila de tickets e responda com o seu próprio conhecimento, que é o que um agente de IA da eesel faz.

Quais são os resultados do Exa Agent Ultra nos benchmarks?

A Exa informa que o Agent Ultra supera o Opus 5.5, o GPT-6 Astra e o Perplexity Agent em quatro benchmarks de pesquisa: 81,4% de soft recall no WANDR, 93,9% de F1 no DeepSearchQA, 58,9% de F1 por linha no WideSearch e uma média de 2.451 entidades aprovadas por tarefa no Find-All Company. Essas são execuções de benchmark da própria Exa, então trate-as como números do fornecedor até que apareçam testes independentes. Para qualquer agente de IA que você implante, testar com os seus próprios dados importa mais do que o ranking.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Banner principal de alternativas ao Grok 4.7 com o logotipo do Grok sobre um fundo abstrato escuro de computação
Trending

Alternativas ao Grok 4.7: 6 modelos que vale a pena comparar em 2026

As melhores alternativas ao Grok 4.7 em 2026, comparadas em preço, contexto, pesos abertos e no que cada uma é realmente boa, além de como saber quando você quer um modelo, afinal.

Kurnia KharismaKurnia KharismaSep 23, 2026
Banner principal da análise do Grok 4.7 com o logotipo do Grok sobre um fundo escuro e abstrato de computação
Trending

Análise do Grok 4.7: o modelo de ponta barato da xAI é realmente bom?

Uma análise prática do Grok 4.7: em que se destaca, onde ainda perde para o Fable 5.1 e o GPT-5.6 Sol, os preços reais, a sobretaxa da variante Fast, e quem deveria realmente usá-lo.

Rama AdiRama AdiSep 23, 2026
Banner principal dos preços do Grok 4.7 com o logotipo do Grok e uma tabela de custos de tokens da API
Trending

Preços do Grok 4.7: custos de tokens da API, níveis e a taxa Fast

Uma análise completa dos preços do Grok 4.7: as taxas de $2 / $6 por token, o precipício de contexto longo em 200k, os medidores de chamadas de ferramentas que a maioria dos modelos de custo ignora, a taxa Fast, onde é possível comprar de fato, e como ele se compara ao GPT-6 Sol e ao Fable 5.1.

Kurnia KharismaKurnia KharismaSep 23, 2026
Banner de lançamento do Grok 4.7 com o logotipo do Grok em um fundo escuro e abstrato de computação
Trending

Grok 4.7: o que o novo modelo de ponta da xAI realmente muda

Um olhar claro sobre o Grok 4.7: o que há de novo em relação ao Grok 4.6, as especificações, os preços reais e a taxa da variante Fast, como ele se compara ao GPT-5.6 Sol e ao Fable 5.1, e para quem ele serve.

KiraKiraSep 23, 2026
Banner principal ilustrado do TypeSafe Jev, o primeiro modelo de IA System One
Trending

TypeSafe Jev: o primeiro modelo System One, explicado

Um guia claro sobre o TypeSafe Jev, o modelo System One que transforma estado não estruturado em decisões tipadas de sim/não, escolha única e pontuação em que o seu código pode confiar.

KiraKiraSep 21, 2026
Ilustração do agente de pesquisa profunda da Exa extraindo dados estruturados de toda a web
Trending

Preços do Exa Agent Ultra: quanto a pesquisa profunda realmente custa em 2026

O Exa Agent Ultra não tem preço de tabela. Veja como funciona o custo medido por uso, quanto uma execução real fatura e onde entra o limite de US$ 20 por execução.

Rama AdiRama AdiSep 27, 2026
Ilustração do detalhamento de preços do Skywork AI
Trending

Preço do Skywork AI: quanto custa de verdade em 2026

Um resumo claro do preço do Skywork AI: o teste de $1, o sistema de créditos, o plano Pro de $19,99 e as armadilhas de cobrança a observar antes de pagar.

Kurnia KharismaKurnia KharismaJul 20, 2026
Ilustração de um foguete decolando, representando o lançamento do modelo MiniMax M3.1 Flash
Trending

MiniMax M3.1 Flash: especificações, preços e como testar a preview

O MiniMax M3.1 Flash é um modelo de programação com 1M de contexto que chegou ao MiniMax Code sem preço. O que ele realmente é e como testá-lo.

Rama AdiRama AdiSep 28, 2026
Ilustração do workspace super-agente da Skywork AI
Trending

O que é a Skywork AI? O workspace "super-agente" explicado

Skywork AI é um super-agente de IA de propósito geral que cria slides, documentos, planilhas, sites e vídeos. Veja o que ela faz, como funciona e quanto custa.

KiraKiraJul 20, 2026

Pronto para contratar seu colega de IA?

Configure em minutos. Sem cartão de crédito necessário.

Comece grátis