Inteligência artificial, sem ruído.
Open Source2 min

Occamy-1.0: modelo aberto de 35B chega ao ponto de menor custo da fronteira de agentes de co-work

Occamy-1.0, modelo aberto de 35B para agentes de co-work, fica no ponto de menor custo da fronteira de desempenho e libera pesos.

Occamy-1.0: modelo aberto de 35B chega ao ponto de menor custo da fronteira de agentes de co-work

O que é

Agentes de co-work — sistemas que combinam busca de informações, uso de ferramentas, programação e manipulação de arquivos em múltiplas invocações de modelo — têm seu valor prático definido não apenas pela capacidade de pico, mas pela eficiência com que entregam essa capacidade. Custo e latência se acumulam ao longo de todo o episódio de trabalho.

É esse o alvo do Occamy-1.0: um modelo aberto de 35 bilhões de parâmetros (arquitetura MoE com cerca de 3 bilhões ativos) especializado em co-work, obtido a partir de pós-treinamento adicional do checkpoint Qwen3.6-35B-A3B. Os pesos do modelo e parte dos dados de treinamento foram liberados.

Como foi construído

A equipe construiu dados e ambientes fundamentados na execução real, capturou trajetórias de longo horizonte reproduzíveis em múltiplos harnesses e usou pós-treinamento em estágios para desenvolver e consolidar capacidades complementares de execução.

Resultados e posicionamento

Na suíte de benchmarks de co-work, o Occamy-1.0 se mantém consistentemente entre os modelos mais fortes de tamanho comparável e segue competitivo com sistemas de fronteira muito maiores em várias tarefas. Sob o protocolo de avaliação e precificação declarado, seu desempenho agregado em quatro benchmarks representativos o coloca no “joelho de baixo custo” da fronteira de Pareto custo-desempenho — o ponto onde se ganha mais desempenho por unidade de custo investida.

Avaliações de apoio em tool calling, programação e seguimento de instruções mostram que a especialização preserva a capacidade agêntica ampla.

Por que importa

O lançamento reforça uma tendência importante para 2026: a corrida deixa de ser apenas por “o modelo mais inteligente” e passa a incluir modelos especializados e baratos para tarefas de trabalho contínuo. Para empresas que rodam agentes em produção, cada invocação conta, e um modelo 35B aberto e eficiente pode reduzir custos de forma expressiva em relação a sistemas de fronteira de centenas de bilhões de parâmetros.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.