
Nem toda chamada do seu agente precisa de um modelo de fronteira: NVIDIA mostra que 93% podem usar modelos menores
NVIDIA NeMo Switchyard reduziu em 74% o custo de agentes de IA ao rotear 93% das chamadas para modelos menores, mantendo 93%…
Acompanhe os acontecimentos mais recentes da inteligência artificial, em ordem cronológica.

NVIDIA NeMo Switchyard reduziu em 74% o custo de agentes de IA ao rotear 93% das chamadas para modelos menores, mantendo 93%…

Pesquisadores usaram IA para descobrir vulnerabilidade crítica no Zoom que permitia controle total de dispositivos. A falha foi corrigida e afeta Windows,…

Pesquisadores compararam dois sistemas de memória para agentes: o ALTK-Evolve atinge 89,3% de precisão usando 263K tokens — 40% do custo do…

Fire-and-forget, scatter-gather, semáforos, pipelines e outros padrões asyncio para evitar deadlocks e erros em cascata ao orquestrar múltiplos agentes simultaneamente.

Desenvolvedor testou 27 tarefas reais de agente com modelos locais: com 3 RTX 3090, modelo de 122B marcou 80/100 contra 89,4 do…

Com arquitetura MoE, o novo modelo aberto entrega tokens 4× mais rápidos e se integra ao Switchyard para roteamento inteligente entre modelos…

Com o Nemotron 3.5 Lightning e NeMo Switchyard, a NVIDIA quer que agentes rodem localmente em RTX, combinando privacidade, baixa latência e…

Em setembro, a plataforma começa a aplicar selo ‘AI Persona’ e remove essas músicas de playlists algorítmicas, protegendo artistas humanos.

A partir de 2 de agosto de 2026, todos os modelos Claude passam a aplicar marcas d’água C2PA em texto e imagens…

Técnica revela traços de raciocínio de modelos de fronteira, expõe possível destilação por IA chinesa e descobre vazamento de senhas e chaves…

Modelo Astra da OpenAI solucionou uma década de problemas em aberto, da codificação de dados à cibersegurança pós-quântica. Matemáticos celebram o avanço…

Pesquisadores usaram IA para mapear 766 genes ligados à esquizofrenia, dos quais 641 são inéditos. Estudo na Nature Genetics analisou dados de…

Tutorial prático: monte um pipeline completo de geração multimodal com MiniMax-H3 via APIs HTTP/WebSocket do ComfyUI, sem interface gráfica.

Nova família de modelos de raciocínio lógico-formal roda em hardware local com apenas 1.06 GB e supera modelos 40x maiores em tarefas…

OpenAI expande o Daybreak com novo modelo de IA treinado para cibersegurança, em resposta ao aumento de ataques conduzidos por agentes autônomos.

OpenAI concluiu recompra de US$ 7 bi em ações de funcionários, mantendo valuation de US$ 852 bi. Empresa também protocolou IPO confidencial…

Aprenda a processar 1 milhão de documentos com batch inference: pipeline completo, código testado e custo real de US$ 387,50 — metade…

Pesquisadores do MIT CSAIL criaram o GeoPT, método que pré-treina IAs em dinâmica sintética para simular física com 60% menos dados e…