
Liquid AI lança Antidoom: método open-source reduz ‘doom loops’ em modelos de raciocínio em até 95%
Liquid AI libera Antidoom como open source. O método FTPO reduz loops repetitivos em modelos de raciocínio de 22,9% para 1% no…
Cobertura de modelos de linguagem (LLMs), IA generativa, benchmarks e as principais novidades em pesquisa e desenvolvimento de modelos de inteligência artificial.
270 publicações encontradas

Liquid AI libera Antidoom como open source. O método FTPO reduz loops repetitivos em modelos de raciocínio de 22,9% para 1% no…

A história real da destilação de conhecimento é mais silenciosa e pragmática do que se imagina. As bases conceituais que definem como…

Tencent lança Hy3, modelo MoE de 295B com 21B ativos, 256K de contexto e licença Apache 2.0. Benchmark competitivo em código, STEM…

Meituan lança LongCat-2.0, modelo MoE de 1,6 trilhão de parâmetros com janela de 1 milhão de tokens e atenção esparsa, treinado inteiramente…

Mistral AI disponibiliza Leanstral 1.5 sob licença Apache 2.0, um modelo de 119B especializado em provas matemáticas com Lean 4 que satura…

Estudo com experimentos controlados mostra que o que importa não é o tamanho do documento, mas onde a informação está localizada. E…

Testes mostram que LLMs convergem para as mesmas respostas: '7' como número aleatório, 'Time is a river' como metáfora. A startup Springboards…

Parceria entre Hugging Face e Cerebras combina Gemma 4 com inferência ultrarrápida para criar assistentes de voz speech-to-speech totalmente open source e…

Novo modelo open-weight da NVIDIA separa contexto e difusão em duas torres, retendo 98,7% da qualidade autorregressiva com o dobro da vazão…

Após suspensão por controles de exportação dos EUA, o Claude Fable 5 retorna em 1º de julho com classificador de segurança aprimorado…

A AWS anunciou que os modelos Claude Fable 5 da Anthropic voltarão a estar disponíveis no Amazon Bedrock a partir de amanhã,…

Anthropic lança Claude Sonnet 5 com benchmarks próximos ao Opus 4.8 por um terço do preço: 63,2% no SWE-bench Pro, 81,2% no…

A extração automatizada de dados de e-mails é um desafio comum para empresas que processam milhões de mensagens diariamente. Modelos de linguagem…

Claude Sonnet 5 chega a todos os planos com capacidades agentivas próximas ao Opus 4.8 e preços a partir de US$ 2…

A avaliação de modelos de IA é um campo notoriamente fragmentado. Um mesmo modelo pode apresentar pontuações radicalmente diferentes no mesmo…

A destilação de conhecimento permite que modelos de IA pequenos aprendam com o comportamento de modelos gigantes — em vez de apenas…

Startup adquirida pela Wix por US$ 80 milhões aposta em modelo proprietário treinado com milhões de interações reais para reduzir custos e…

Cinco forças transformaram Small Language Models de curiosidade de hobby para a escolha pragmática em produção: hardware, ferramental, custo, regulação e cultura.…

DeepSeek confirma lançamento oficial do V4 para meados de julho e introduz precificação dinâmica: preços dobram nos horários de pico (9h-12h e…

Montadora recontrata 350 engenheiros veteranos após sistemas de IA não conseguirem garantir qualidade — e projeta economia de US$ 1 bilhão com…

Liquid AI lança o LFM2.5-230M, modelo open-weight de 230M parâmetros otimizado para tool use e extração de dados em dispositivos. Roda a…

DeepSeek libera DSpark, framework de decodificação especulativa que acelera a geração do V4 em até 85% em produção, com código aberto sob…

Junho de 2026 será lembrado como o momento em que ficou claro que modelos fechados podem ser retirados do ar . Com…

A startup americana Subquadratic saiu do modo stealth no mês passado com uma afirmação ambiciosa: resolveram o gargalo matemático que tem limitado…