
Loop Engineering: a técnica que ensina RAG a ler documentos longos pelo sumário
Pesquisador propõe recuperação hierárquica que navega pelo índice em vez de buscar no documento inteiro. Técnica reduz tokens e aumenta precisão em…
4446 publicações encontradas

Pesquisador propõe recuperação hierárquica que navega pelo índice em vez de buscar no documento inteiro. Técnica reduz tokens e aumenta precisão em…

Tutorial completo: do zero a um assistente de pesquisa privado no Telegram, Web e Discord rodando com Ollama local. Configure contexto, canal,…

Nova versão da DAW permite que o assistente Gopher execute ações reais no projeto: criar batidas, adicionar efeitos e configurar canais por…

Startup lança três séries originais com produção por IA e permite que usuários interajam com personagens via chat. Recurso faz parte da…

Novo recurso Reflect do Claude analisa padrões de uso, mostra temas mais frequentes e permite configurar horários de silêncio. Recurso gratuito disponível…

Novo modelo da Meta compete diretamente em codificação, oferece percepção multimodal nativa e chega com API pública e US$ 20 em créditos…

Ferramenta open source que simplifica a execução de modelos de IA no PC capta US$ 88M no total com Benchmark, Theory Ventures…

Pare de escrever mean() e std() para cada coluna. Aprenda a automatizar estatísticas descritivas em Python com 7 ferramentas que geram tabelas…

Elas não são projetadas, mas você não consegue deixar de percebê-las. De onde vem a personalidade de uma IA e por que…

NHS adota exame de sangue com IA que identifica câncer uterino com 99,1% de precisão, evitando exames invasivos em 18 mil mulheres…

NVIDIA comprime Nemotron-3-Super de 120,7B para 75,3B parâmetros com 2,03x mais throughput. Modelo está disponível no Hugging Face em BF16, FP8 e…

Datalab lança o Lift, modelo de visão de 9B que extrai campos de PDFs e imagens via JSON Schema em uma única…

Desenvolvedor revela por que mantém o Claude mesmo após migrar agentes para modelos mais baratos: o 'cockpit' do Remote Control + sessões…

Ant Group libera LingBot-VLA 2.0 com licença Apache 2.0: modelo VLA de 6B que unifica 20 configurações robóticas em um único espaço…

Startup sueca de vibe coding negocia US$ 300 milhões com Menlo Ventures, dobrando valuation em 7 meses e atingindo US$ 500M em…

Pesquisadores do MIT descobriram que o raciocínio lógico opera independentemente da linguagem no cérebro humano. O estudo desafia décadas de debate e…

A AWS anunciou o Claude Apps Gateway, um plano de controle auto-hospedado que centraliza acesso, custos e políticas para times que usam…

Experimentos mostram que qualquer pessoa pode construir um sistema de IA que se autoaperfeiçoa. O futuro da IA não pertence apenas aos…

O SynthID do Google foi usado para desmascarar uma imagem deepfake do senador Mitch McConnell que viralizou no Reddit e X. A…

SpaceXAI libera Grok 4.5 com o dobro de eficiência em tokens, preço competitivo de US$ 2 por milhão de tokens de entrada…

Análise técnica mostra que quantização INT4 + KV Cache FP8 multiplica capacidade de serving de LLMs por 8x. Por que escolher entre…

Tutorial completo: construa um pipeline de RAG Semântico com LangChain, Pinecone e FastAPI. Upload de PDFs, embeddings, busca vetorial e chatbot interativo.

Tutorial completo: construa um servidor MCP de ecommerce com Amazon Bedrock AgentCore e conecte ao Mistral AI Studio. Autenticação JWT, DynamoDB e…

NVIDIA defende que dados abertos são tão importantes quanto modelos abertos para construir agentes de IA confiáveis, com dados sintéticos como caminho…