
Nem todas as cabeças de atenção importam: estudo acelera modelos de visão-linguagem
ProViP poda tokens visuais e cabeças de atenção sem treino, acelerando modelos de visão-linguagem em 1,62x e mantendo 95,9% do desempenho.
Acompanhe os acontecimentos mais recentes da inteligência artificial, em ordem cronológica.

ProViP poda tokens visuais e cabeças de atenção sem treino, acelerando modelos de visão-linguagem em 1,62x e mantendo 95,9% do desempenho.

Runtime Metis transforma chamadas de ferramentas em eventos tipados e acelera a execução, mas testes de falha expõem limites de segurança em…

Técnica de inferência cortou viés em até 96% em teste de gênero e preservou a precisão no MMStar, segundo preprint publicado no…

Robô de 25 cm da Pollen Robotics treina cada movimento com aprendizado por reforço em simulador, tem software Apache-2.0 e pré-venda aberta…

Estudo combina 371 mil notícias, 1,4 milhão de tuítes e 57 entrevistas para organizar o debate público sobre IA em quatro áreas.

Técnica rastreia cada fato atômico até os tokens de origem e usa verificação para guiar o aprendizado, superando baselines de factualidade.

Controlador sem treino atua no fluxo residual do modelo para reduzir reflexão desnecessária, com economia que chega a 23% em matemática.

Preprint usa transformer para recuperação em recomendação e reporta ganho de receita de 2,53% em teste online de um mês.

Método quebra documentos em triplas verificáveis para combater informação enganosa em respostas RAG de múltiplas etapas, com melhores pontuações.

Framework combina descrições de movimento geradas por IA com um codificador visual para reconhecer e localizar sinais em vídeo, liderando quatro benchmarks.

Preprint aponta que a estrutura do ajuste de desaprendizado prevê melhor a robustez contra o retorno do conhecimento do que a distância…

A OpenAI decidiu encerrar o fornecimento de modelos de IA para a Cursor, editor de código agora controlado pela SpaceX. O acesso…

Preprint revela que a maioria das métricas automáticas de criatividade tem correlação fraca com o julgamento humano, e juízes-LLM apresentam efeito teto.

Agentes de IA tornaram a exploração de falhas tão rápida que um simples rumor de bug pode virar exploit em minutos, alertam…

Sistema descentralizado de agentes de IA apresentou resultados novos em 5 dos 12 problemas do AlphaEvolve, incluindo avanços em Kakeya e números…

Modelo leve estima tempo de execução, vazão por GPU e gargalos de treinamento sharded, com erro mediano abaixo de 15% nos testes…

Pré-print apresenta o Self-Reflective Policy Optimization, que converte feedback esparso em supervisão por token e supera o GRPO com fração do custo…

Novas APIs resolvem a baixa vazão da escrita um a um e a falta de visibilidade sobre registros no armazenamento em memória…