Inteligência artificial, sem ruído.
Modelos e LLMs2 min

NVIDIA aposta em modelos abertos para levar agentes de IA do data center ao PC local

Com o Nemotron 3.5 Lightning e NeMo Switchyard, a NVIDIA quer que agentes rodem localmente em RTX, combinando privacidade, baixa latência e custo zero de API.

NVIDIA aposta em modelos abertos para levar agentes de IA do data center ao PC local

NVIDIA aposta em modelos abertos para IA local

A NVIDIA está celebrando agosto como o mês da IA local, destacando parceiros e comunidades open source que estão levando modelos e agentes inteligentes para rodar diretamente em PCs, workstations e dispositivos Edge — sem depender da nuvem.

O movimento inclui o lançamento dos novos modelos abertos Nemotron, software para desenvolvedores, bibliotecas de computação acelerada e recursos educacionais para quem quer começar. A empresa trata agentes como o centro da estratégia: modelos menores, especializados e rodando localmente, em vez de um único modelo gigante na nuvem.

Nemotron 3.5 Lightning: o modelo eficiente para agentes

A principal novidade é o Nemotron 3.5 Lightning, um modelo aberto de 30 bilhões de parâmetros com arquitetura Mixture-of-Experts (MoE). Ele promete geração de tokens até 4× mais rápida e tempo de conclusão 30% menor comparado a modelos abertos da mesma classe.

Por ter pesos abertos, entusiastas e desenvolvedores podem fazer fine-tuning com exemplos próprios para estilos específicos de escrita, domínios especializados como fotografia ou design 3D, e convenções de código personalizadas.

NeMo Switchyard: roteamento inteligente

Junto com o modelo, a NVIDIA lançou o NeMo Switchyard, uma biblioteca open source para roteamento dentro de ferramentas de agentes. Em vez de um modelo único fazer tudo, o Switchyard direciona cada requisição para o modelo mais adequado — um conceito chamado de “sistema de modelos”.

Modelos de raciocínio como o Nemotron 3 Ultra ou GPT-5.6 planejam e orquestram; modelos menores como o Lightning executam tarefas específicas como code review, uso de ferramentas, monitoramento de segurança e atendimento de dúvidas.

Por que isso importa agora

Para o mercado brasileiro, a tendência de IA local resolve três problemas práticos: latência (modelos rodando no dispositivo respondem mais rápido), privacidade (dados não saem da máquina) e custo (sem cobrança por token). Com a alta do dólar e os preços de APIs subindo, rodar modelos localmente em hardware NVIDIA RTX se torna uma alternativa real para pequenas empresas e desenvolvedores independentes.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.