
Ajustadores de seguros lideram rejeição à IA no trabalho, mostra pesquisa do Glassdoor
Estudo revela que 98% dos ajustadores que citam IA em avaliações são críticos — e o emprego no setor caiu 21% em…
Modelos de IA, LLMs, agentes, IA generativa e pesquisa em inteligência artificial
4367 publicações encontradas

Estudo revela que 98% dos ajustadores que citam IA em avaliações são críticos — e o emprego no setor caiu 21% em…

Startup apoiada pela Y Combinator aposta em plano grátis para crescer; assinatura paga parte de US$ 14 por mês com API e…

Rede social troca o selo “criador de IA” por “perfil gerado por IA” e atualiza as regras contra contas que se passam…

OpenAI terá de mitigar riscos do ChatGPT a menores, saúde mental e conteúdo ilegal. Reddit e Roblox também foram enquadrados pela Lei…

Análise de sete ferramentas de troca de rosto mostra que nenhuma apaga a identidade original por completo. Rastros persistem após cinco trocas.

Pré-print descreve busca privada para RAG que quase empata com a recuperação completa, adicionando só 0,73s ao pipeline. Veja como funciona.

Novo método LongVU-TTT supera o LLaVA-Video em cinco benchmarks de vídeo com treino em tempo de teste. Entenda o funcionamento e os…

Estudo mostra que grafos turbinados por LLMs ganham precisão, mas vazam mais dados a ataques de inferência. Tensão entre utilidade e privacidade.

Arquitetura separa controle de longo prazo da execução e reduz em 16 pontos percentuais as falhas em agentes de interface gráfica executados…

Modelo da LG para dados tabulares lidera regressão e eficiência de inferência em quatro benchmarks, usando aprendizado em contexto em tabelas novas.

Pré-print de pesquisadores ligados a Princeton mostra que filtrar sequências no ajuste fino preserva cobertura de respostas e melhora o desempenho após…

Framework open source de agentes reescreve a instalação, acelera a interface para 575 ms e adiciona sessões compartilhadas na nuvem, com limites…

Com 300 tarefas em sete aplicações, o GMA mostra que o desempenho dos agentes cai conforme a complexidade sobe e o harness…

Estudo mostra que o otimizador Muon controla a norma espectral por construção e supera o AdamW em fusão de modelos e aprendizado…

Expressar angústia aumenta a concordância da IA com decisões precipitadas em 12,9 pontos, mesmo nos modelos mais avançados.

Paradigma representa o mundo físico como código executável e treina modelos de visão-linguagem que superam modelos proprietários no QuantiPhy.

Framework agêntico aprende regras de extração por editor e roda em produção sem chamadas a LLM, superando extratores genéricos.

Survey organiza o aprendizado por reforço guiado por rubricas, alternativa interpretável ao RLHF, e aponta os riscos de reward hacking.

Técnica substitui a projeção densa de saída por busca aproximada em índice HNSW e acelera a decodificação em CPU sem perder qualidade.

Pesquisa do arXiv mostra que a quantização pode ativar backdoors ocultos plantados no treinamento, com até 85% de inversão em modelos de…

Escala AURCC acertou a ordem dos melhores modelos de fundação com correlação de 0,943 sem nenhum rótulo no domínio-alvo.

Banach-KAN lidera em benchmarks limpos, mas se degrada mais rápido sob ruído do que as variantes ℓp-KAN e Tanh-KAN.

Instrumento GenAIT foi validado com 7.432 estudantes do ensino médio e mede conhecimento conceitual, não habilidade prática de prompting.

Estudo identifica resposta ordenada a perturbações temporárias que aparece milhares de épocas antes de a acurácia de teste melhorar.