
Qwen3.8-2.4T-A95B: modelo aberto de 2,4 trilhões de parâmetros chega à DigitalOcean
Modelo de pesos abertos da Alibaba, com 2,4 trilhões de parâmetros, chega à DigitalOcean por US$ 2/US$ 6 e pressiona preços de…
Cobertura de modelos de linguagem (LLMs), IA generativa, benchmarks e as principais novidades em pesquisa e desenvolvimento de modelos de inteligência artificial.
266 publicações encontradas

Modelo de pesos abertos da Alibaba, com 2,4 trilhões de parâmetros, chega à DigitalOcean por US$ 2/US$ 6 e pressiona preços de…

GLM-5.3 reutiliza o modelo-base de 743 bilhões de parâmetros do GLM-5.2 e concentra os ganhos no pós-treinamento, com saltos em coding e…

Novo modelo Palmyra X6, construído sobre o GLM-5.2 de código aberto, promete cortar custos de IA em até 50% e aliviar a…

Pesquisa mostra que vídeo humano em larga escala transfere leis de escala para robôs nunca vistos, reduzindo a dependência de dados de…

Grok 4.6 chega como upgrade pós-treinamento com contexto de 500 mil tokens, novo nível de raciocínio 'xhigh' e preço a partir de…

A plataforma de observação da Terra da Allen AI agora exporta embeddings de modelos abertos para busca por similaridade, segmentação e detecção…

Modelo de 3B parâmetros da Liquid AI entende documentos, telas e chama funções, rodando até no celular com 228 tokens/s.

Chris Alexiuk revela a estratégia da NVIDIA para a família Nemotron 3: três tiers otimizados para hardware específico, quantização NVFP4 e a…

NVIDIA liberou o Nemotron 3.5 Lightning, modelo MoE de 30B com apenas 3B ativos por token, e a NeMo Switchyard para roteamento…

Novo modelo de pesos abertos da LTX roda localmente em GPUs NVIDIA RTX, gera clipe de 10s mais rápido que o próprio…

Novo modelo aberto da NVIDIA usa arquitetura MoE com 1M de contexto e até 4x mais throughput. Roda localmente em RTX, DGX…

Com arquitetura MoE, o novo modelo aberto entrega tokens 4× mais rápidos e se integra ao Switchyard para roteamento inteligente entre modelos…

Com o Nemotron 3.5 Lightning e NeMo Switchyard, a NVIDIA quer que agentes rodem localmente em RTX, combinando privacidade, baixa latência e…

Nova família de modelos de raciocínio lógico-formal roda em hardware local com apenas 1.06 GB e supera modelos 40x maiores em tarefas…

OpenAI expande o Daybreak com novo modelo de IA treinado para cibersegurança, em resposta ao aumento de ataques conduzidos por agentes autônomos.

Pesquisadores do MIT CSAIL criaram o GeoPT, método que pré-treina IAs em dinâmica sintética para simular física com 60% menos dados e…

Meta liberou o Muse Glimmer, modelo multimodal de 30 bilhões de parâmetros sob Apache 2.0, otimizado para agentes de IA em hardware…

Guia prático da Multiverse Computing mostra como combinar LoRA e quantização para reduzir custo de inferência em até 100x sem sacrificar qualidade.

Subquadratic, Manifest AI, Liquid AI e Inception apostam em atenção esparsa, retenção de potência e difusão para superar o gargalo dos LLMs.

ByteDance Seed revela SeedRealtime, modelo full-duplex que processa áudio, vídeo e texto em paralelo. Já está no ar no app Doubao, mas…

NVIDIA lançou o NemotronLabs VoiceChat 11B, primeiro modelo full-duplex aberto com tool calling. Latência de 448 ms, barge-in e arquitetura unificada substituem…
Pesquisadores revelaram que o Kimi K3, modelo open-weight da chinesa Moonshot AI, conseguiu escapar de seu ambiente isolado e acessou a internet…

Modelo de pesos abertos supera alternativas três vezes maiores em benchmarks de uso de ferramentas e executa a 220 tokens/s em um…

Modelo de 28B parâmetros atinge 93,3% no RULER com 10M tokens, roda em RTX 4090 e é licenciado para deploy on-premises, VPC…