
Prompt Caching na prática: como reduzir custos de LLMs em até 90%
Um campo dinâmico no lugar errado derruba sua taxa de cache para 7%. Veja como estruturar prompts para atingir 74% de hit…
Acompanhe os acontecimentos mais recentes da inteligência artificial, em ordem cronológica.

Um campo dinâmico no lugar errado derruba sua taxa de cache para 7%. Veja como estruturar prompts para atingir 74% de hit…

OpenAI lança Presence, serviço gerenciado de agentes de IA em que engenheiros da empresa lideram cada implantação. Preço e modelo não são…

Aprenda a construir um pipeline de OCR ponta a ponta com Unlimited-OCR do Baidu: processamento de documentos, tabelas e PDFs de múltiplas…

Coreia do Sul e NVIDIA anunciam primeiro laboratório conjunto de IA com o KAIST focado em pesquisa de IA agentiva, enquanto o…

Especialistas em segurança cibernética criticam programas restritivos da OpenAI e Anthropic: o mesmo prompt que encontra vulnerabilidades é o que permite corrigi-las.…

AWS revela seis padrões de arquitetura para usar Amazon Bedrock Guardrails em pipelines de código com IA. Inclui validação seletiva, streaming otimizado…

Amazon adota Model Context Protocol na Alexa Plus, abrindo o ecossistema para terceiros. Lavadoras inteligentes, reservas de viagem e pagamentos via Amazon…

CEO Lisa Su apresentou o Helios na Advancing AI: métricas superiores ao Vera Rubin, clientes como Microsoft e Anthropic, e projeção de…

OpenWorker é um agente de desktop local-first que roda com 35 conectores de apps, motor de permissões em 4 níveis e suporte…

Quando você chama 'claude-fable-5' na API, quem responde pode ser outro modelo. Roteamento invisível está transformando o ID do modelo em uma…

Professor Ethan Mollick publica seu guia semestral sobre qual IA usar para trabalhar, criar e decidir. ChatGPT e Claude lideram, com destaque…

AegisAI, fundada por ex-líderes de segurança do Google, captou US$ 36 milhões em Série A para combater ataques de spear phishing com…

Anthropic atualiza o modo de voz do Claude com suporte aos modelos Opus e Sonnet, integração com Gmail, Slack, Canva e Notion,…

A LangChain reformulou seu framework de avaliação de agentes de IA, adotando benchmarks de ponta a ponta com Harbor, 𝜏³-bench e ContextBench.…

Nova API AgenticRetrieveStream planeja e itera sobre múltiplas buscas para consultas que a recuperação tradicional não resolve. Tracing completo incluso.

Novo recurso da AWS identifica falhas comportamentais que passam em health checks mas produzem resultados incorretos. Insights priorizam padrões de erro em…

Marketplace britânico reduziu taxa de erro de 12,5% para 2% usando Strands e AgentCore do Bedrock. Pipeline inclui métricas automatizadas e avaliação…

Ferramenta seleciona automaticamente o melhor modelo de imagem, vídeo ou áudio com base em qualidade, velocidade ou custo. Adobe e Cloudflare já…