Inteligência artificial, sem ruído.
Agentes de IA3 min

NVIDIA Nemotron 3 Ultra atinge desempenho de ponta com LangChain Deep Agents

Modelo aberto da NVIDIA alcança precisão próxima ao Claude Opus 4.8 em tarefas de agente, com custo 10x menor, usando o harness de Deep Agents da LangChain.

NVIDIA Nemotron 3 Ultra atinge desempenho de ponta com LangChain Deep Agents

A NVIDIA anunciou que o Nemotron 3 Ultra, seu modelo de linguagem aberto mais avançado, atingiu desempenho de ponta em benchmarks de agentes quando combinado com o harness de Deep Agents da LangChain. O resultado é notável: o modelo aberto chegou muito perto do desempenho de modelos fechados de fronteira como o Claude Opus 4.8, mas com custo aproximadamente 10 vezes menor por execução.

O que torna isso relevante

Até recentemente, o desenvolvimento de agentes de IA de alta qualidade exigia o uso de APIs de modelos fechados — com custos elevados e dependência de fornecedor. O Nemotron 3 Ultra, combinado com o orquestrador de agentes open-source mais adotado do mercado (LangChain), demonstra que modelos abertos já são viáveis para workloads agentivas sérias em produção.

O Nemotron 3 Ultra foi especificamente pós-treinado pela NVIDIA para se comportar de forma consistente em harnesses de agentes — não apenas em chat de turno único. Isso significa que o modelo foi otimizado para tarefas que envolvem uso de ferramentas, múltiplas etapas e contexto prolongado, exatamente o tipo de cenário que define o trabalho agentivo real.

Deep Agents: o harness que faz a diferença

O LangChain Deep Agents é um framework de orquestração que gerencia o ciclo completo de um agente: raciocínio, chamada de ferramentas, observação e iteração. A LangChain ajustou especificamente o harness para o Nemotron 3 Ultra — o que incluiu refinamentos no system prompt, descrições de ferramentas e middleware entre o modelo e as chamadas de função.

O resultado foi a maior precisão entre modelos abertos no benchmark de Deep Agents. A combinação alcançou 0.86 de score, contra 0.87 do Claude Opus 4.8 — uma diferença mínima, mas com custo de execução de aproximadamente US$ 4,48 contra US$ 43,48 no benchmark completo.

Performance e custo na prática

A NVIDIA reporta que o Nemotron 3 Ultra oferece desempenho líder com latência equiparável à de modelos fechados, mas com custo significativamente menor. Como o modelo é aberto, organizações também podem hospedá-lo em sua própria infraestrutura, eliminando custos de API e ganhando controle total sobre dados e latência.

O modelo está disponível para uso via APIs de diversos provedores de nuvem e também pode ser baixado para implantação on-premise — uma flexibilidade que modelos fechados simplesmente não oferecem.

O ecossistema aberto de agentes amadurece

Este anúncio marca um ponto de inflexão para o ecossistema de agentes de IA. A combinação de um modelo aberto de alta capacidade (Nemotron 3 Ultra) com uma plataforma de orquestração madura (LangChain) e benchmarks rigorosos cria uma alternativa real aos stacks proprietários. Para empresas que priorizam soberania de dados, controle de custos e independência de fornecedor, o caminho está cada vez mais pavimentado.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.