
Google lança Gemini Omni 1.1 Flash com extensão de cena de 40 segundos e upscale 4K
Atualização do modelo de vídeo do Google analisa 10 segundos de contexto, controla primeiro e último quadro e renderiza rascunhos em 360p…
Modelos de IA, LLMs, agentes, IA generativa e pesquisa em inteligência artificial
4437 publicações encontradas

Atualização do modelo de vídeo do Google analisa 10 segundos de contexto, controla primeiro e último quadro e renderiza rascunhos em 360p…

Não existe agente melhor em tudo: Codex conduz tarefas difíceis até o fim; Claude Code orquestra dezenas de pequenos ajustes em paralelo.

Antes de empilhar LLM com recuperação vetorial, pergunte se a tarefa não é classificação, correspondência ou leitura de tabela. Guia das técnicas…

Produtores de EDM expõem faixas geradas por ferramentas como a Suno e denunciam o impacto da IA na indústria musical. A disputa…

Depois de dominar o mercado de GPUs, a Nvidia aposta na orquestração de dados e em sistemas completos. Entenda a nova camada…

Método de visão computacional inverte a hierarquia de processamento e reduz o erro em super-resolução de profundidade a 32×.

Método que combina LLM e PySR recupera 95% das fórmulas exatas no benchmark Feynman, com R² médio de 0,9999.

Novo benchmark testa se LLMs conseguem induzir estratégias de raciocínio; método combinado com CoT liderou, mas a estratégia sozinha não superou.

OpenAI, Anthropic e mais de 100 empresas assinam carta alertando que o mundo tem poucos meses para se preparar para ciberataques habilitados…

Aprenda a rodar um chatbot de IA localmente: privacidade, acesso offline e custo zero. Requisitos, passo a passo no LM Studio e…

Modelo de visão-linguagem detecta malignidade em biópsias de próstata com 97,6% de acurácia, mas a graduação detalhada ainda fica abaixo.

LiteraryBigFive representa o estilo de um autor em cinco dimensões interpretáveis e ajusta as ativações do modelo para imitá-lo.

TrustDABench avalia oito LLMs em análise de tabelas e revela que 74,8% das falhas são respostas silenciosas sem evidência suficiente.

PaSta combina auto-treinamento e rótulos parciais para classificar nós em grafos com rótulos ruidosos, superando métodos tradicionais.

ProViP poda tokens visuais e cabeças de atenção sem treino, acelerando modelos de visão-linguagem em 1,62x e mantendo 95,9% do desempenho.

Runtime Metis transforma chamadas de ferramentas em eventos tipados e acelera a execução, mas testes de falha expõem limites de segurança em…

Técnica de inferência cortou viés em até 96% em teste de gênero e preservou a precisão no MMStar, segundo preprint publicado no…

Robô de 25 cm da Pollen Robotics treina cada movimento com aprendizado por reforço em simulador, tem software Apache-2.0 e pré-venda aberta…

Estudo combina 371 mil notícias, 1,4 milhão de tuítes e 57 entrevistas para organizar o debate público sobre IA em quatro áreas.

Técnica rastreia cada fato atômico até os tokens de origem e usa verificação para guiar o aprendizado, superando baselines de factualidade.

Controlador sem treino atua no fluxo residual do modelo para reduzir reflexão desnecessária, com economia que chega a 23% em matemática.

Preprint usa transformer para recuperação em recomendação e reporta ganho de receita de 2,53% em teste online de um mês.

Método quebra documentos em triplas verificáveis para combater informação enganosa em respostas RAG de múltiplas etapas, com melhores pontuações.

Framework combina descrições de movimento geradas por IA com um codificador visual para reconhecer e localizar sinais em vídeo, liderando quatro benchmarks.