
Método comprime CNNs de kernel grande em 77% com perda mínima de precisão
Técnica de baixa ordem compartilhada corta mais de 77% dos parâmetros de CNNs de kernel grande, com queda de precisão abaixo de…
Acompanhe os acontecimentos mais recentes da inteligência artificial, em ordem cronológica.

Técnica de baixa ordem compartilhada corta mais de 77% dos parâmetros de CNNs de kernel grande, com queda de precisão abaixo de…

Estudo ajusta o Whisper Small ao baniwa, língua indígena do Brasil, com taxa de erro de palavra de 37,5% — um primeiro…

Novo método para modelos Mixture-of-Experts ganha robustez contra três normas de ataque ao mesmo tempo, com acréscimo de até 2,37 pontos na…

Pipeline teacher-student reduz de 91% para 16% a taxa de sucesso de ataques em modelos que geram código de hardware (RTL/Verilog), segundo…

Filtro training-free e label-free usa consenso geométrico para detectar documentos envenenados antes da chamada final ao modelo.

Sistema combina busca densa e BM25 para localizar ferramentas em catálogos com milhares de itens; Hit@1 de 84,8% e redução massiva de…

Modelo combina pistas multimodais com backbone esparso e foi o melhor nos quatro cenários do benchmark MAVOS-DD; código é público.

Preprint compara estratégias de treino para raciocínio e mostra que SFT misto supera NTR e NSR após RLVR, gastando muito menos GPU.

Novo LLM de pesos abertos da Tencent tem 49 bilhões de parâmetros ativos e apenas dois níveis de esforço de raciocínio; salto…

MirroS lança abordagem que representa cenas físicas como código executável — não como pixels — e modelo aberto supera o Gemini 3.1…

Estudo compara deepagents, pi e dsh e encontra cinco blocos recorrentes na arquitetura de agentes de código — mas nenhum oferece registro…

Sistema com SDXL melhora em 11% a aderência a combinações inéditas de lente, ponto de vista e sensor em direção autônoma e…

Pipeline da Ant Group sintetiza casos de teste de programas com defeitos e usa recompensa densa; LiveCodeBench 68,39 e percentil 94,67 no…

Estudo com 5.400 episódios mostra que apontar uma verificação para o registro de origem eleva decisões consistentes de 34 para 145 em…

Técnica usa 1% dos dados e expansão de Taylor para antecipar mecanismos pós-SFT; atualizar só os 20% de neurônios mais relevantes mantém…

Método ligado à Tencent roteia o sinal de aprendizado para as ações que de fato influenciaram o resultado; ganho de 12,57 pontos…

Estrutura Observe-Orient-Decide-Aja elevou a taxa de sucesso de agentes Qwen3 em até 6,86 pontos; ganhos se concentram em tarefas que exigem lembrar…

Tutorial prático: monte um pipeline de ensemble com o FourCastNet, dados do GFS e diagnóstico de potencial eólico em uma única GPU.