LLMs locais já conseguem substituir o Claude?
Um desenvolvedor colocou seu assistente pessoal de IA — chamado Jarvis, um agente LangGraph com ~90 ferramentas conectadas a e-mail, calendário, notas, arquivos, Office, WhatsApp, Discord e geração de imagens — para rodar com modelos locais e comparou o desempenho contra o Claude. O resultado em duas versões de hardware conta uma história reveladora.
Primeira tentativa: RTX 3090 única, 16K de contexto
Com um modelo de 30B de parâmetros rodando em uma única RTX 3090 e limite de contexto de 16K tokens, o agente local marcou 22,8 de 100 contra 89,4 do Claude. Pior: um quarto das respostas continham sintaxe quebrada de chamadas de ferramentas — simplesmente não funcionava. Não era “pior”, era quebrado.
Segunda tentativa: 3× RTX 3090, 256K de contexto
Com três RTX 3090 e 256K de contexto, o cenário mudou. Um modelo de 122B marcou 80,0 de 100, eliminou completamente as chamadas malformadas (zero em 27 tarefas), e custou US$ 0,000969 por tarefa contra US$ 0,763 do Claude — cerca de 787× mais barato.
O desenvolvedor cancelou a assinatura Claude Max e manteve apenas o Pro. O agente agora roda no modelo local para as tarefas diárias.
A ressalva honesta
O autor é transparente: tamanho do modelo e orçamento de contexto mudaram juntos, sem grupo de controle isolado. O experimento mede uma atualização de sistema, não o efeito isolado de um parâmetro. Mas o achado prático é claro: com hardware suficiente (3 GPUs e contexto grande), modelos locais já são competitivos para tarefas reais de agente.
O que isso significa para o mercado brasileiro
Para desenvolvedores e pequenas empresas no Brasil, o custo é o dado mais relevante. Rodar 1.000 tarefas de agente por mês no Claude custaria ~US$ 763; no modelo local, ~US$ 0,97 — praticamente o custo da energia elétrica. Com GPUs usadas (RTX 3090) disponíveis no mercado brasileiro por valores entre R$ 4.000 e R$ 7.000, o investimento se paga em meses para workloads pesados.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



