
LLMs mostram sensibilidade metacognitiva parcial em raciocínio médico
Estudo testou se a confiança de um LLM acompanha a qualidade da evidência em diagnósticos. Acerto de 93,5%, mas com confiança excessiva…
4360 publicações encontradas

Estudo testou se a confiança de um LLM acompanha a qualidade da evidência em diagnósticos. Acerto de 93,5%, mas com confiança excessiva…

Novo benchmark exige raciocínio em múltiplas etapas com ferramentas para entender vídeos. Resultado: GPT-5.5 e Kimi-K3 ficam abaixo de 60% de acerto.

Pesquisadores defendem rótulos nutricionais de IA com métricas padronizadas de viés, energia e origem de dados, no modelo das normas ISO.

Artigo de posição alerta para o AI Lock-In: a dependência excessiva de IA que desqualifica humanos e cria vulnerabilidades sistêmicas quando os…

Cluster com 128 GPUs usadas serviu LLaMA-70B por um ano a US$ 22 mil, contra US$ 600 mil de um sistema B200.…

Recurso open source transforma perfis do Hermes em bots com memória e modelo próprios, que conversam entre si por @menção e handoff.

Modelo de 27 bilhões de parâmetros alcança a mesma pontuação do GPT-5.6 Luna e fica a um ponto de GLM-5.2 e DeepSeek…

Sistema de aprendizado por reforço faz modelo escrever kernels CUDA 2,11x mais rápidos que o torch.compile em 96,8% das tarefas do KernelBench.

Empresa adicionou US$ 18 bilhões em receita anualizada em dois meses e se aproxima do IPO, com meta de valuation de US$…

Aquisição consolida a infraestrutura que conecta desenvolvedores a modelos de IA. OpenRouter processa 250 trilhões de tokens por mês e tem 8…

Modelo de deep learning estima composição corporal a partir de fotos 2D e prevê resistência à insulina com precisão próxima à do…

Jacob Bank volta ao Google como VP de Produto do Chrome para acelerar a integração de agentes de IA no navegador.

Análise do MIT Technology Review questiona as decisões de design da Flock sobre coleta, busca e retenção de dados na rede de…

Equipe brasileira da Dharma-AI mostra como um alocador de GPUs ciente de restrições elevou a utilização em até 33 pontos percentuais sem…

MiniMax lança o MiniMax-Music3, modelo de música com pesos abertos que gera canções completas de até 5 minutos a partir de letra…

Do OCR básico à exportação de PDFs pesquisáveis: aprenda a detectar texto, extrair campos de notas fiscais e reconstruir tabelas com a…

Modelo aberto da NVIDIA roda em uma única GPU, ativa só 3 bilhões de parâmetros e reduz o custo de workloads com…

Amazon Bedrock AgentCore agora permite que agentes autônomos paguem por APIs e conteúdo com carteiras e limites definidos por humanos.

Framework da Microsoft Research propõe trocar cliques frágeis por scripts reutilizáveis e dobra a taxa de sucesso em tarefas na web.

Guia prático para verificar sessões ativas, encerrar acessos suspeitos e proteger suas contas nas principais plataformas de IA.

Startup avalia o pivô de fabricante de chips para provedora de nuvem de IA em US$ 3,5 bilhões, com participação da Nvidia…

Investigação rastreou um livro raro até um centro de treinamento de IA da Amazon. Entenda por que textos fora de catálogo são…

Com US$ 26 bilhões em modelos quase open source, a Nvidia aposta num mundo sem monopólio de inteligência — e com muito…

Middleware da Amazon Bedrock para LangChain permite que agentes paguem por serviços com orçamento por sessão e micropagamentos x402 em stablecoins.