
Esquecimento em LLMs: o padrão do ajuste importa mais que o tamanho
Preprint aponta que a estrutura do ajuste de desaprendizado prevê melhor a robustez contra o retorno do conhecimento do que a distância…
Modelos de IA, LLMs, agentes, IA generativa e pesquisa em inteligência artificial
4437 publicações encontradas

Preprint aponta que a estrutura do ajuste de desaprendizado prevê melhor a robustez contra o retorno do conhecimento do que a distância…

A OpenAI decidiu encerrar o fornecimento de modelos de IA para a Cursor, editor de código agora controlado pela SpaceX. O acesso…

Preprint revela que a maioria das métricas automáticas de criatividade tem correlação fraca com o julgamento humano, e juízes-LLM apresentam efeito teto.

Agentes de IA tornaram a exploração de falhas tão rápida que um simples rumor de bug pode virar exploit em minutos, alertam…

Sistema descentralizado de agentes de IA apresentou resultados novos em 5 dos 12 problemas do AlphaEvolve, incluindo avanços em Kakeya e números…

Modelo leve estima tempo de execução, vazão por GPU e gargalos de treinamento sharded, com erro mediano abaixo de 15% nos testes…

Pré-print apresenta o Self-Reflective Policy Optimization, que converte feedback esparso em supervisão por token e supera o GRPO com fração do custo…

Novas APIs resolvem a baixa vazão da escrita um a um e a falta de visibilidade sobre registros no armazenamento em memória…

O Monsoon traz hindi e inglês indiano ao ranking de reconhecimento de fala, expondo como a métrica única de WER esconde desigualdades…

Neocloud capta US$ 1 bilhão em dívida de curto prazo via J.P. Morgan para comprar GPUs da Nvidia que serão cedidas em…

Z.ai e Alibaba lançaram, com um dia de diferença, modelos de código aberto com receitas quase idênticas: atenção híbrida 3:1, indexador de…

Substitua a fila de aprovação que escala mal por um roteador de risco: menos revisões, mais segurança e zero espera para a…

De rumores de US$ 13 bilhões pela Hugging Face a negócios bilionários de Poolside e OpenRouter, modelos abertos atraem gigantes como Nvidia…

Artigo da Anthropic mostra pesquisadores automatizados melhorando o alinhamento em 10 de 10 benchmarks — e superando humanos em seis horas.

Coleção de implementações de referência da NVIDIA roda modelos abertos no TensorRT em aplicações C++ nativas.

Agência americana planeja revogar regra de 1970 que obriga notificação e comentário público em licenças de poluição do ar.

Novo algoritmo distribui cópias de modelos entre zonas de disponibilidade no SageMaker, eliminando pontos únicos de falha.

Varejista testou modelos de séries temporais em 25 mil produtos; o Chronos-2 ajustado venceu e cortou a implantação de 6 para 2…

Guia prático mostra como definir agentes especialistas e coordenar o trabalho deles no Codex CLI para tarefas complexas.

Biblioteca TypeScript da Vercel trata arquivos .wgsl como módulos importáveis e roda o mesmo shader em navegador, Node.js e CI.

Agentes de código dão estimativas calibradas para humanos, não para LLMs. Duas técnicas para obter prazos mais precisos do Claude Code.

Como testar o backend Postgres de um agente LangGraph de agendamento com Docker ou em serviço hospedado, e por que a persistência…

Guia prático para montar uma stack de IA local produtiva: do serviço de modelo à recuperação de contexto, com Ollama, Cline, Aider…

Artigo no Journal of the American Medical Association defende que IA autônoma superará médicos até 2030 em cinco tarefas fundamentais.