Logo
Decide better.Live better.
Logo
Decide better.Live better.

Nimble lança Web Search Agents. Veja como reduzir custos de IA em até 51%. A nova infraestrutura permite extrações mais precisas com menos tokens para empresas

Nimble lança Web Search Agents. Veja como reduzir custos de IA em até 51%

Para profissionais e desenvolvedores que gerenciam IA corporativa, a tecnologia da Nimble significa menores custos operacionais e dados mais confiáveis. Ao cortar o uso de tokens pela metade e aumentar a acurácia, ela torna a pesquisa automatizada mais acessível para decisões críticas.

banner

A Nimble lançou os Web Search Agents em 3 de março de 2026 para tornar pesquisas de IA mais precisas e econômicas. A startup de Nova York criou o sistema para navegar na web em tempo real e devolver dados em JSON estruturado, um formato organizado que outros programas conseguem ler diretamente.

O problema que a empresa quer resolver é o desperdício de tokens. Tokens são as unidades de texto que os modelos de linguagem processam e pelas quais muitos serviços de IA calculam seus custos. APIs de busca genéricas podem devolver grandes volumes de páginas e arquivos pouco relevantes. O agente precisa então gastar mais processamento para separar o que é útil do que é ruído.

A proposta da Nimble é adaptar a recuperação ao domínio de cada cliente. Em vez de aplicar uma única estratégia a todas as tarefas, os agentes usam características específicas do setor, das fontes preferidas e dos critérios de confiança de cada operação. Uri Knorovich, CEO e cofundador da Nimble, diz que a empresa constrói modelos de recuperação especializados para tornar o processo mais rápido, barato e preciso.

Segundo a Nimble, os principais ganhos divulgados são:

1. Mais precisão na pesquisa. A empresa afirma que os Web Search Agents melhoram em 21% a precisão da pesquisa na web em comparação com a referência usada no teste. A Nimble não divulgou publicamente a metodologia completa nem a lista de concorrentes avaliados, portanto esse número ainda não foi validado de forma independente.

2. Menos tokens consumidos. A empresa afirma usar 51% menos tokens do que alternativas líderes de busca com IA em comparações equivalentes. Ao evitar páginas irrelevantes e etapas repetidas de pesquisa, a ferramenta pode reduzir o processamento exigido antes de o modelo produzir uma resposta.

3. Economia em operações de alto volume. A empresa Rox, cliente da Nimble, relatou uma redução de 20 vezes nos custos de tokens após adotar a infraestrutura. Como não foram divulgados detalhes completos do fluxo de trabalho e da linha de base, o resultado deve ser visto como um caso relatado pelo cliente, não como uma garantia para toda operação.

A diferença aparece principalmente quando os agentes trabalham por horas ou executam muitas tarefas. Em uma pergunta simples, uma busca mais eficiente pode ter efeito limitado. Em pesquisas de inteligência competitiva, conformidade, geração de leads ou monitoramento contínuo, evitar chamadas e análises desnecessárias pode reduzir custos e tornar os resultados mais consistentes.

A plataforma funciona como uma camada pronta para integrar a aplicações de IA. A Nimble oferece uma API, que é uma interface para conectar sistemas, e um SDK, um conjunto de ferramentas para desenvolvedores. A documentação também apresenta endpoints para agentes de pesquisa e extração. O resultado pode ser entregue em formato estruturado para uso em outros fluxos de trabalho.

A empresa diz que a infraestrutura suporta mais de 90 milhões de buscas por dia. O sistema combina índices próprios, acesso à web ao vivo, navegação, extração, validação e memória específica do domínio. Na prática, isso reduz a necessidade de as equipes montarem manualmente cada etapa do pipeline de recuperação.

A memória exige atenção especial de quem trabalha com dados empresariais. A Nimble afirma operar com retenção zero de dados por padrão e diz que, quando o cliente ativa memória semântica e modelos de aprendizado contínuo, esse conhecimento permanece no ambiente do próprio cliente. Essa descrição não equivale, por si só, a uma garantia completa de privacidade. Empresas devem verificar nos termos e na documentação técnica os controles de retenção, isolamento entre clientes, criptografia, uso para treinamento e certificações de segurança aplicáveis.

O preço oferece dois caminhos de entrada. A API de Agentes começa em US$ 0,025 por solicitação no modelo de pagamento conforme o uso. Para operações que preferem configuração e gestão personalizadas, os planos anuais gerenciados começam em US$ 2.500 por mês.

A Nimble também anunciou execuções agendadas para manter pesquisas atualizadas. A atualização Agent Jobs, publicada em 19 de maio de 2026, permite executar Web Search Agents em horários definidos e inclui uma galeria de agentes gerenciados. Esse tipo de automação pode ser útil para acompanhar concorrentes, alterações regulatórias ou mudanças em páginas públicas sem depender de consultas manuais.

O posicionamento é diferente do ChatGPT Deep Research e de serviços semelhantes. Ferramentas como ChatGPT Deep Research, Google Gemini Deep Research e Perplexity se concentram na experiência de pesquisa para o usuário final. A Nimble tenta ocupar uma camada anterior, fornecendo a recuperação de informações para agentes e aplicações empresariais desenvolvidos por outras equipes.

Para decidir se a tecnologia faz sentido, olhe primeiro para o volume e para o custo da sua operação. Se seus agentes fazem pesquisas repetidas, consultam páginas extensas ou precisam de dados externos atualizados, uma camada de recuperação especializada pode reduzir o trabalho de engenharia e o gasto com processamento. O caminho mais seguro é testar a API ou o SDK em um fluxo real, comparar precisão, latência e custo e só depois considerar um plano gerenciado. Leia também: A nova startup Prentis quer automatizar o seu escritório. Veja se vale a pena esperar por esses agentes.

Feed