
Feyn AI lança SQRL: modelos que inspecionam o banco de dados antes de gerar SQL
Feyn AI lança SQRL, família de modelos text-to-SQL que inspeciona o banco antes de escrever a query, alcançando 70,6% no BIRD Dev…
Cobertura de modelos de linguagem (LLMs), IA generativa, benchmarks e as principais novidades em pesquisa e desenvolvimento de modelos de inteligência artificial.
271 publicações encontradas

Feyn AI lança SQRL, família de modelos text-to-SQL que inspeciona o banco antes de escrever a query, alcançando 70,6% no BIRD Dev…

Coleção aberta com três checkpoints lidera o benchmark RTEB com 78,46 pontos. Modelo de 1B é 8× menor com pipeline de compressão;…

Comparação completa dos três modelos MoE de escala trilhária que dominam o ranking open-weight: benchmarks, licenças, custo de API e self-hosting. DeepSeek…

PrismML lança Bonsai 27B: modelo de 27 bilhões de parâmetros comprimido para 3,9 GB que roda em laptops e celulares. Retém 89,5%…

Primeiro modelo de navegação incorporada da Mistral atinge 76,6% de sucesso no benchmark R2R-CE usando apenas uma câmera RGB, superando sistemas com…

Anthropic lança Claude Sonnet 5 com benchmarks que batem o antecessor em todas as categorias. Preço introdutório de $2/$10 por MTok promete…

Nova família de modelos da OpenAI já está disponível no Amazon Bedrock com três níveis de capacidade, prompt caching com 90% de…

O abismo entre benchmarks de LLMs e a realidade da produção: por que seu agente de SRE com IA pode falhar quando…

Pipeline determinístico de três passagens elimina contexto expirado e duplicado de prompts de LLMs preservando dependências. Redução chega a 34% em agentes…

Em junho de 2026, os modelos mais avançados ainda alucinam com confiança. De bots de suporte que inventam políticas a agentes que…

NVIDIA Nemotron 3 chega ao SageMaker AI com fine-tuning serverless: arquitetura híbrida Mamba-Transformer MoE com até 1M de tokens de contexto e…

Unsloth Dynamic quantiza modelos de IA com perda de apenas 14% de acurácia sendo 86% menor — veja 4 padrões de deploy…

Artigo do Towards Data Science argumenta que RAG é uma camada de tradução, não um sistema de memória. O futuro está no…

Robbyant, unidade do Ant Group, lançou o LingBot-World-Infinity, um modelo de 14B parâmetros que gera vídeo interativo quadro a quadro. O diferencial…

Novo modelo híbrido MoE da NVIDIA reduz parâmetros de 120,7B para 75,3B, mantém a arquitetura Mamba-Transformer e entrega 2,03x mais throughput em…

Novo modelo híbrido MoE da NVIDIA reduz parâmetros de 120,7B para 75,3B, mantém a arquitetura Mamba-Transformer e entrega 2,03x mais throughput em…

OpenAI recebeu aval do governo Trump para lançar o GPT-5.6, seu modelo mais avançado, e anunciou o ChatGPT Work, agente que combina…

Novo modelo da Meta compete diretamente em codificação, oferece percepção multimodal nativa e chega com API pública e US$ 20 em créditos…

Elas não são projetadas, mas você não consegue deixar de percebê-las. De onde vem a personalidade de uma IA e por que…

NVIDIA comprime Nemotron-3-Super de 120,7B para 75,3B parâmetros com 2,03x mais throughput. Modelo está disponível no Hugging Face em BF16, FP8 e…

SpaceXAI libera Grok 4.5 com o dobro de eficiência em tokens, preço competitivo de US$ 2 por milhão de tokens de entrada…

OpenAI lança GPT-Live e GPT-Live-1 mini, modelos de voz full-duplex que delegam raciocínio profundo ao GPT-5.5 enquanto mantêm conversas naturais e interrupções…

Enquanto a indústria corre para construir chips mais rápidos, o verdadeiro gargalo dos modelos de IA está na movimentação de dados —…

NVIDIA libera o Audex, LLM unificado de áudio-texto com 30B parâmetros que gera fala e sons sem sacrificar a qualidade do raciocínio…