
Nemotron 3.5 Lightning: NVIDIA lança modelo MoE aberto de 30B com 3B de parâmetros ativos
NVIDIA liberou o Nemotron 3.5 Lightning, modelo MoE de 30B com apenas 3B ativos por token, e a NeMo Switchyard para roteamento…
4363 publicações encontradas

NVIDIA liberou o Nemotron 3.5 Lightning, modelo MoE de 30B com apenas 3B ativos por token, e a NeMo Switchyard para roteamento…

Framework da Xiaomi aceito na ACM MM 2026 introduz métricas RC-S e RC-T que avaliam remoção de objetos sem vídeo de referência,…

NVIDIA anuncia parcerias com Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs e KKR para mobilizar mais de US$ 500 bilhões em capital para…

CEO da Saber afirma que nenhum roteirista foi trocado por IA, mas ex-líder de narrativa contesta: “fui substituída pelo ChatGPT no meio…

Modelos Daybreak Red (GPT-5.6 Cyber) e Daybreak Blue (GPT-5.6 Sol) chegam ao Amazon Bedrock com Zero-Operator Access no chip, criptografia KMS e…

Google confirma que Gemini atingiu 1 bilhão de usuários mensais, igualando marca do ChatGPT. App gera 150 milhões de imagens por dia…

App chega com suporte a Ubuntu, Debian e Fedora, incluindo ChatGPT, ChatGPT Work e Codex. Anthropic havia lançado app do Claude para…

Novo modelo de pesos abertos da LTX roda localmente em GPUs NVIDIA RTX, gera clipe de 10s mais rápido que o próprio…

Startup de Igor Babuschkin (ex-DeepMind, OpenAI, xAI) quer reconstruir a stack de IA do zero. Rodada teve Nvidia, AMD Ventures, Y Combinator…

Novo modelo aberto da NVIDIA usa arquitetura MoE com 1M de contexto e até 4x mais throughput. Roda localmente em RTX, DGX…

Executivo que construiu as operações da OpenAI desde 2018 sai em meio a reorganização do alto escalão às vésperas do IPO. Fidji…

Modelo experimental coordenou 650 ideias em 36 horas com 31 milhões de tokens. Resultado foi confirmado por matemáticos e formalizado no assistente…

Aplicativo do Google ultrapassa marca histórica com 63% dos usuários interagindo por voz, 150 milhões de imagens geradas por dia e 100…

Polars oferece execução paralela e lazy, mas Pandas ainda reina em compatibilidade. Guia prático para decidir qual usar em cada etapa do…

NVIDIA, Google e Microsoft desenvolvem padrão 800 VDC para alimentar a próxima geração de datacenters de IA. Arquitetura aberta com 80+ fabricantes…

NVIDIA NeMo Switchyard reduziu em 74% o custo de agentes de IA ao rotear 93% das chamadas para modelos menores, mantendo 93%…

Pesquisadores usaram IA para descobrir vulnerabilidade crítica no Zoom que permitia controle total de dispositivos. A falha foi corrigida e afeta Windows,…

Pesquisadores compararam dois sistemas de memória para agentes: o ALTK-Evolve atinge 89,3% de precisão usando 263K tokens — 40% do custo do…

Fire-and-forget, scatter-gather, semáforos, pipelines e outros padrões asyncio para evitar deadlocks e erros em cascata ao orquestrar múltiplos agentes simultaneamente.

Desenvolvedor testou 27 tarefas reais de agente com modelos locais: com 3 RTX 3090, modelo de 122B marcou 80/100 contra 89,4 do…

Com arquitetura MoE, o novo modelo aberto entrega tokens 4× mais rápidos e se integra ao Switchyard para roteamento inteligente entre modelos…

Com o Nemotron 3.5 Lightning e NeMo Switchyard, a NVIDIA quer que agentes rodem localmente em RTX, combinando privacidade, baixa latência e…

Em setembro, a plataforma começa a aplicar selo ‘AI Persona’ e remove essas músicas de playlists algorítmicas, protegendo artistas humanos.

A partir de 2 de agosto de 2026, todos os modelos Claude passam a aplicar marcas d’água C2PA em texto e imagens…