Inteligência artificial, sem ruído.
Agentes de IA2 min

Teste real: assistente pessoal de IA roda com modelo local e é 787× mais barato que o Claude

Desenvolvedor testou 27 tarefas reais de agente com modelos locais: com 3 RTX 3090, modelo de 122B marcou 80/100 contra 89,4 do Claude — mas custou US$ 0,000969 por tarefa.

Teste real: assistente pessoal de IA roda com modelo local e é 787× mais barato que o Claude

LLMs locais já conseguem substituir o Claude?

Um desenvolvedor colocou seu assistente pessoal de IA — chamado Jarvis, um agente LangGraph com ~90 ferramentas conectadas a e-mail, calendário, notas, arquivos, Office, WhatsApp, Discord e geração de imagens — para rodar com modelos locais e comparou o desempenho contra o Claude. O resultado em duas versões de hardware conta uma história reveladora.

Primeira tentativa: RTX 3090 única, 16K de contexto

Com um modelo de 30B de parâmetros rodando em uma única RTX 3090 e limite de contexto de 16K tokens, o agente local marcou 22,8 de 100 contra 89,4 do Claude. Pior: um quarto das respostas continham sintaxe quebrada de chamadas de ferramentas — simplesmente não funcionava. Não era “pior”, era quebrado.

Segunda tentativa: 3× RTX 3090, 256K de contexto

Com três RTX 3090 e 256K de contexto, o cenário mudou. Um modelo de 122B marcou 80,0 de 100, eliminou completamente as chamadas malformadas (zero em 27 tarefas), e custou US$ 0,000969 por tarefa contra US$ 0,763 do Claude — cerca de 787× mais barato.

O desenvolvedor cancelou a assinatura Claude Max e manteve apenas o Pro. O agente agora roda no modelo local para as tarefas diárias.

A ressalva honesta

O autor é transparente: tamanho do modelo e orçamento de contexto mudaram juntos, sem grupo de controle isolado. O experimento mede uma atualização de sistema, não o efeito isolado de um parâmetro. Mas o achado prático é claro: com hardware suficiente (3 GPUs e contexto grande), modelos locais já são competitivos para tarefas reais de agente.

O que isso significa para o mercado brasileiro

Para desenvolvedores e pequenas empresas no Brasil, o custo é o dado mais relevante. Rodar 1.000 tarefas de agente por mês no Claude custaria ~US$ 763; no modelo local, ~US$ 0,97 — praticamente o custo da energia elétrica. Com GPUs usadas (RTX 3090) disponíveis no mercado brasileiro por valores entre R$ 4.000 e R$ 7.000, o investimento se paga em meses para workloads pesados.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.