
Teste com 270 execuções revela que RAG pode gerar falsas memórias em agentes de IA
Benchmark mostra que replay completo do histórico foi mais preciso que RAG como estratégia de memória para agentes de IA, contrariando expectativas.
Modelos de IA, LLMs, agentes, IA generativa e pesquisa em inteligência artificial
4503 publicações encontradas

Benchmark mostra que replay completo do histórico foi mais preciso que RAG como estratégia de memória para agentes de IA, contrariando expectativas.

Nova Eval Engineering Skill inspeciona repositórios e traces de execução para gerar avaliações contextualizadas automaticamente.

Novo conector do Claude permite explorar dados do Anthropic Economic Index diretamente, mostrando quais profissões e tarefas estão sendo afetadas pela IA.

CTO da Arcee, que seria beneficiada por uma proibição, afirma que modelos como Qwen e Kimi K3 não representam risco maior que…

Empresa revela Project Camellia, data center de US$ 20 bilhões na Geórgia com 3,2 GW de energia, majoritariamente de gás natural.

O 5-Day AI Agents Intensive do Google e Kaggle está disponível em formato autoguiado e gratuito. Conteúdo cobre arquitetura de agentes, MCP,…

AMD fecha maior contrato de GPUs para IA da sua história: Anthropic vai implantar 2 GW de chips Instinct MI450 com o…

Ferramenta open source de compressão sem perdas reduz tokens de contexto do Claude Code em 2-3×, estendendo o uso da assinatura sem…

RBAC não basta para agentes de IA. O Bifrost Enterprise combina Data Access Control, perfis de acesso e Bifrost Edge para impor…

Hands-on: construa um agente executor de código com OpenAI Agents SDK, Docker e gpt-5.4. Tutorial cobre manifesto, sandbox e controle de dependências.

Do zero ao runtime funcional: tutorial completo de construção de motor de inferência CUDA/C++ para Qwen2.5-Coder-7B em NVIDIA H100, com benchmarks e…

Google Cloud e DeepMind destinam US$ 40 milhões em tokens de IA e créditos de nuvem para a Genesis Mission do DOE…

LangChain faz retrospectiva de 3 anos do LangGraph, baixado 65M de vezes por mês. Framework mostra quando usar grafos e quando deixar…

NVIDIA abriu o código do Medical Physics Simulation, framework que reduz treinamento de robôs cirúrgicos de 5 horas para 2 minutos. CMR…

Scanner open source da NVIDIA revela que 80% dos alertas em skills legítimos de agentes são falsos positivos. Segurança de agentes de…

SenseTime anunciou o Galaxy Project reunindo quase 20 parceiros para infraestrutura de chips de IA na China. Empresa projeta 10 trilhões de…

OpenAI anunciou o Presence, novo produto para implantação de agentes de IA com governança e segurança. Lançamento ocorre em meio a investigação…

Comparação de velocidade, VRAM e multi-GPU. Unsloth lidera em GPU única, Axolotl em clusters, TRL em alinhamento e LLaMA-Factory em zero-código.

Total chega a US$ 40 milhões para a Public First Action. Laboratórios de IA intensificam investimentos em advocacy enquanto regulação global avança.

Thinking Machines revela arquitetura com 256 especialistas. Modelo ativa apenas 41 bilhões de parâmetros por token, combinando escala massiva com eficiência.

Quase 200 organizações assinam compromisso de proteção ao consumidor. Promessa é voluntária e sem penalidades — PJM já projeta US$ 6,3 bi…

Content Seal chega em 2026, mas SynthID do Google já faz o mesmo desde 2023 com adoção de OpenAI, Anthropic e Midjourney.…

Glow levanta US$ 180M em Série A com Sequoia, Greenoaks e Redpoint. Plataforma usa agentes de IA para proteger endpoints na era…

Startup britânica lança Roleplay Sessions, plataforma onde avatares de IA simulam conversas de alto risco e avaliam desempenho com rubricas. Clientes já…