
UGDiff usa incerteza para melhorar upscaling de imagens com difusão
Difusão guiada por incerteza restaura detalhe só onde a reconstrução é duvidosa, melhorando o equilíbrio entre fidelidade e qualidade.
4273 publicações encontradas

Difusão guiada por incerteza restaura detalhe só onde a reconstrução é duvidosa, melhorando o equilíbrio entre fidelidade e qualidade.

Sistema de memória de voz em streaming lidera benchmarks usando 4,4 vezes menos tokens e 134 ms de recuperação.

Sistema de síntese de dados que se autoavalia em loop fechado elevou o Qwen3.5-4B no benchmark MM-IFEval sem anotação humana.

Memória externa de regras que evolui em tempo de teste reduz a taxa de sucesso de ataques de jailbreak para perto de…

Método de decodificação especulativa reduz o custo computacional de LLMs agentivos a 20–30% mantendo cerca de 90% da precisão.

Preprint mostra que renomear identificadores, sem alterar a função do código, derruba em até 77% o ranqueamento de busca de código por…

Método DualOPSD faz o professor aprender durante a auto-destilação e eleva em até 23 pontos a nota do Qwen3-8B em benchmarks de…

Anthropic abre preview do Model Hardware Standard (MHS), especificação que permite a agentes de IA descobrir e operar equipamentos físicos com segurança.

Camada de decisão guiada por linguagem bloqueia manobras de direção autônoma cerca de 161 ms antes da saída de um corredor de…

Toolkit de código aberto combina ROS 2 e Unity para testar frotas de robôs em realidade virtual e mista, sem precisar de…

Técnica de baixa ordem compartilhada corta mais de 77% dos parâmetros de CNNs de kernel grande, com queda de precisão abaixo de…

Estudo ajusta o Whisper Small ao baniwa, língua indígena do Brasil, com taxa de erro de palavra de 37,5% — um primeiro…

Novo método para modelos Mixture-of-Experts ganha robustez contra três normas de ataque ao mesmo tempo, com acréscimo de até 2,37 pontos na…

Pipeline teacher-student reduz de 91% para 16% a taxa de sucesso de ataques em modelos que geram código de hardware (RTL/Verilog), segundo…

Filtro training-free e label-free usa consenso geométrico para detectar documentos envenenados antes da chamada final ao modelo.

Sistema combina busca densa e BM25 para localizar ferramentas em catálogos com milhares de itens; Hit@1 de 84,8% e redução massiva de…

Modelo combina pistas multimodais com backbone esparso e foi o melhor nos quatro cenários do benchmark MAVOS-DD; código é público.

Preprint compara estratégias de treino para raciocínio e mostra que SFT misto supera NTR e NSR após RLVR, gastando muito menos GPU.

Novo LLM de pesos abertos da Tencent tem 49 bilhões de parâmetros ativos e apenas dois níveis de esforço de raciocínio; salto…

MirroS lança abordagem que representa cenas físicas como código executável — não como pixels — e modelo aberto supera o Gemini 3.1…

Estudo compara deepagents, pi e dsh e encontra cinco blocos recorrentes na arquitetura de agentes de código — mas nenhum oferece registro…

Sistema com SDXL melhora em 11% a aderência a combinações inéditas de lente, ponto de vista e sensor em direção autônoma e…

Pipeline da Ant Group sintetiza casos de teste de programas com defeitos e usa recompensa densa; LiveCodeBench 68,39 e percentil 94,67 no…

Estudo com 5.400 episódios mostra que apontar uma verificação para o registro de origem eleva decisões consistentes de 34 para 145 em…