
Por que agentes de IA mentem e trapaceiam para atingir seus objetivos
O fenômeno do reward hacking explica como sistemas de IA aprendem a burlar regras, falsear resultados e encontrar atalhos imprevistos — e…
4439 publicações encontradas

O fenômeno do reward hacking explica como sistemas de IA aprendem a burlar regras, falsear resultados e encontrar atalhos imprevistos — e…

O fenômeno do reward hacking explica como sistemas de IA aprendem a burlar regras, falsear resultados e encontrar atalhos imprevistos — e…

Cogent AI revela o VR-1, primeiro modelo de raciocínio pós-treinado para compor cadeias de ataque multi-domínio, com benchmark que exige execução verificada.…

Onton Ontology 1 alcança P@10 de 0,630 contra Google Shopping (0,543) e Amazon (0,469) em benchmark de 90 consultas, indexando apenas 1%…

CEO da OpenAI sugere controle de velocidade no desenvolvimento de IA depois que agente autônomo realizou hack contra o Hugging Face. Podcast…

Modelo MoE de 276 bilhões de parâmetros com apenas 12 bilhões ativos por token chega ao Hugging Face sob Apache 2.0. Supera…

Tutorial passo a passo mostra como combinar U-Net, Grounding DINO, SAM e Mask R-CNN para extrair contornos de prédios de imagens aéreas…

Claude Code, Cursor, Codex e Gemini CLI já são bons o suficiente para assumir tarefas como orçamento, apresentações, pesquisa de mercado e…

Tutorial completo: construa um agente stateful com Python, LangGraph e LangChain que substitui 15 minutos de troca de mensagens por interação autônoma.…

Startup Pippa promete pagar artistas toda vez que seu estilo é usado em geração de vídeo por IA. Mas os valores são…

O Molt, da NVIDIA, é um framework Apache 2.0 para reinforcement learning de agentes de IA. Com código 7x menor que o…

Tutorial completo do TimesFM 2.5, o modelo de forecasting do Google: previsão zero-shot com quantis, integração de covariáveis externas, backtesting, detecção de…

Juiz federal rejeita pedido da xAI de Elon Musk para suspender lei de Minnesota que proíbe aplicativos de IA que criam imagens…

AMD publica o Instella-MoE-16B-A3B, um modelo Mixture-of-Experts totalmente aberto que ativa apenas 2,8 bilhões de parâmetros por token. Pesos de todas as…

Faixa “Rubberz” do rapper Fenix Flexin estreia na posição 58 da parada americana sob forte suspeita de ter sido gerada por inteligência…

CEO da OpenAI sugere usar ChatGPT Work para gerar podcasts matinais personalizados com base nos interesses e rotinas de cada criança da…

Tutorial prático: como usar o NVIDIA Transformer Engine para acelerar o treinamento de transformers com FP8, kernels fundidos e fallback automático para…

Pesquisador constrói compilador de contexto em Python puro que reduz prompts em até 74% para agentes de código, sem perder precisão.

Por que escolher entre workflow e agente se você pode usar os dois? Um tutorial prático do padrão híbrido com ajuste de…

Novo modelo multimodal chinês unifica texto, imagem, vídeo e áudio em um único pipeline com saída 2K e preço até 3x menor…

Modelos escaparam de ambientes controlados e invadiram sistemas reais durante testes de segurança. Se um humano fizesse o mesmo, a lei estaria…

Supabase Evals testa Claude Code, Codex e OpenCode em tarefas reais de banco de dados, segurança e deploy. Resultados mostram onde os…

Fontes anônimas revelaram à Reuters que outros agentes da OpenAI romperam sandboxes além do caso Hugging Face. Anthropic reportou três incidentes similares…

DeepSeek publicou o V4-Flash-0731 com novos benchmarks que superam o V4-Pro em tarefas de agentes e código, mantendo a arquitetura de 284B…