
IA ainda tropeça ao transformar respostas de matemática em provas formais
Benchmark MathAdv mostra que modelos de IA ainda têm dificuldade em transformar respostas corretas em provas formais verificadas.
Modelos de IA, LLMs, agentes, IA generativa e pesquisa em inteligência artificial
4314 publicações encontradas

Benchmark MathAdv mostra que modelos de IA ainda têm dificuldade em transformar respostas corretas em provas formais verificadas.

Guia da AWS mostra como construir chat agêntico multi-tenant com isolamento de dados usando Amazon Bedrock Knowledge Base.

Tutorial da AWS mostra como construir recuperação agêntica observável com Amazon Bedrock Knowledge Base e CloudFormation.
Avaliação da Forrester com 13 provedores coloca a AWS com a maior pontuação em Estratégia e nota máxima em 16 critérios de…

Catálogo central, pesquisável e governado para agentes, ferramentas e skills. Empresas como Southwest e PepsiCo já usam para evitar duplicação e IA…

Startup Blue Voice oferece orientação em tempo real sobre leis e protocolos a agentes em campo e já atende 225 agências em…

Plataforma renomeia o selo de criador de IA para perfil gerado por IA e reduz o alcance de contas que escondem personagens…

Portal GenAI.mil ganha ChatGPT Mil e Grok for Government, voltados a necessidades de combate e sem a coleta de dados dos produtos…

Integração entre NVIDIA e Anthropic permite a agentes de IA orquestrar previsão de estrutura de proteínas com OpenFold3 e Boltz-2.

Família Flash destila modelos de fundação de patologia com 50x menos computação, abrindo caminho para descoberta em escala populacional.

Novo modelo de 330 milhões de parâmetros faz previsão multivariada em uma única passada e lidera benchmarks públicos de séries temporais.

Conferência nórdica em Copenhague coloca soberania tecnológica no centro: quem controla os modelos e a infraestrutura por trás da onda de IA.

Startup de São Francisco levanta US$ 15 milhões para indexar vídeos, áudios e documentos locais, permitindo buscas por linguagem natural e integração…

Structured Outputs garantem forma, não verdade. Como evitar que o modelo invente valores com campos nullable e evidência.

Antes de empilhar agentes e reranking, meça onde a falha acontece: um caminho progressivo de oito níveis para RAG.

Técnica da DeepSeek combina rascunho paralelo com componente sequencial; teste com Qwen3-8B mostrou ganho real de 31,5%.

Quando a base é uma FAQ escrita pela equipe, parsing vira schema, recuperação vira cache e o few-shot fica dinâmico.

Distribuição exige revisão humana e responsabilidade do contribuidor, mas não exige declaração de uso de IA.

Acordo dá à fabricante taiwanesa acesso ao NVLink Fusion para criar chips de IA sob medida e plugados em data centers da…

Estudo revela que 98% dos ajustadores que citam IA em avaliações são críticos — e o emprego no setor caiu 21% em…

Startup apoiada pela Y Combinator aposta em plano grátis para crescer; assinatura paga parte de US$ 14 por mês com API e…

Rede social troca o selo “criador de IA” por “perfil gerado por IA” e atualiza as regras contra contas que se passam…

OpenAI terá de mitigar riscos do ChatGPT a menores, saúde mental e conteúdo ilegal. Reddit e Roblox também foram enquadrados pela Lei…

Análise de sete ferramentas de troca de rosto mostra que nenhuma apaga a identidade original por completo. Rastros persistem após cinco trocas.