
oMLX: auditando a promessa de cortar latência de agentes de 90s para 5s
Servidor local de LLMs para Mac promete ganho de 18x em latência de agentes. Uma auditoria detalhada mostra quando o número se…
4267 publicações encontradas

Servidor local de LLMs para Mac promete ganho de 18x em latência de agentes. Uma auditoria detalhada mostra quando o número se…

Greg Abbott congelou gastos estaduais com as câmeras de IA da Flock após investigação revelar US$ 30 milhões investidos e uma onda…

Com 1,6 milhão de ativos conectados e 16 petabytes de dados, a gigante industrial usa IA para assistentes de campo, gêmeos digitais…

A Anthropic divulgou novas diretrizes de engenharia de contexto para a geração Claude 5, e elas transformam a forma como cientistas de…

Estudo com 12 benchmarks de IA física mostra que testes sobrepostos distorcem rankings: 22 de 51 modelos mudaram de posição após agrupar…

Apenas 18 imagens de pessoas e mãos foram consideradas perfeitas em estudo com 651 imagens geradas por IA.

MAGNITUDE, WANDA ou SparseGPT? Estudo mede qual método de poda preserva a interpretabilidade dos modelos de linguagem.

Autodestilação pode inflar o pass@1 e esconder a perda de diversidade funcional. Revisão mapeia as três alavancas do problema.

Avaliação em 4 benchmarks mostra que nenhum sistema de checagem de fatos domina todos os cenários — e que a evidência importa…

Reexecutar um agente de IA até ele acertar não é corrigir. Estudo mede quando o reparo guiado de fato conserta a falha…

Erros de digitação, ruído de transcrição e OCR quebram buscas em RAG. Veja quando o corretor clássico resolve — e quando só…

Estudo testou como empacotar o texto em grafos de conhecimento multimodais e descobriu que contexto no nível da frase supera parágrafos completos.

Abordagem guiada por lesões alcançou 97,56% de precisão em ultrassom ovariano exigindo menos anotação manual do que métodos por contorno.

O modelo PANDA combina MRI, tabelas clínicas, PET e caligrafia para separar Alzheimer de casos saudáveis — mesmo com dados incompletos e…

Rastreadores sem tela como Fitbit Air e Whoop prometem coletar seus dados de saúde sem disputar sua atenção. A IA é causa…

Humanos e modelos de linguagem reagem de forma diferente a erros conceituais e referenciais, revelando onde a máquina diverge da cognição.

Políticas aprendidas por imitação guiam a busca de provas e resolvem até 46% mais teoremas com uma ordem de magnitude menos passos.

Fusão por atenção de sinais cardíacos alcançou o menor erro médio geral, mas perdeu vantagem quando o ECG falha por completo.

Difusão guiada por incerteza restaura detalhe só onde a reconstrução é duvidosa, melhorando o equilíbrio entre fidelidade e qualidade.

Sistema de memória de voz em streaming lidera benchmarks usando 4,4 vezes menos tokens e 134 ms de recuperação.

Sistema de síntese de dados que se autoavalia em loop fechado elevou o Qwen3.5-4B no benchmark MM-IFEval sem anotação humana.

Memória externa de regras que evolui em tempo de teste reduz a taxa de sucesso de ataques de jailbreak para perto de…

Método de decodificação especulativa reduz o custo computacional de LLMs agentivos a 20–30% mantendo cerca de 90% da precisão.

Preprint mostra que renomear identificadores, sem alterar a função do código, derruba em até 77% o ranqueamento de busca de código por…