Inteligência artificial, sem ruído.
Ferramentas e Apps3 min

Startup francesa ZML lança servidor gratuito de inferência que roda em Nvidia, AMD, TPU e Apple Metal

Endossada por Yann LeCun, a ZML lança o LLMD, servidor gratuito que executa LLMs em múltiplos chips — de Nvidia a Apple Metal — mirando o fim do vendor lock-in na inferência de IA.

Startup francesa ZML lança servidor gratuito de inferência que roda em Nvidia, AMD, TPU e Apple Metal

A startup francesa ZML, endossada pelo vencedor do Prêmio Turing Yann LeCun, acaba de lançar o ZML/LLMD — um servidor gratuito de inferência que promete rodar modelos de linguagem de código aberto em uma variedade impressionante de chips: Nvidia, AMD, Google TPU, Apple Metal e Intel Arc.

O anúncio chega em um momento em que a corrida da inferência ultrapassou o treinamento de modelos em importância estratégica. À medida que a IA se integra ao cotidiano, o gargalo não está mais em criar modelos maiores, mas em processar prompts de forma eficiente e sem dependência de um único fornecedor de hardware.

Quebrando o vendor lock-in

O fundador Steeve Morin explicou ao TechCrunch que a ambição do ZML/LLMD é “quebrar os silos existentes” e permitir que diferentes chips sejam usados em sua velocidade máxima — e às vezes até mais rápido. A promessa é de desempenho de pico em múltiplas arquiteturas, algo que Morin descreve como “coisas que nunca foram feitas antes em lugar nenhum do mundo”.

Para empresas e provedores de nuvem, isso significa a possibilidade de montar infraestruturas heterogêneas, misturando chips mais baratos ou que consomem menos energia. “A ideia é devolver às pessoas o poder de criar seu próprio sistema e alcançar ganhos reais de eficiência”, afirmou Morin.

Concorrência pesada na corrida do ouro da inferência

O mercado de inferência está aquecido — apelidado de “corrida do ouro da inferência”. A ZML enfrenta concorrentes de peso:

  • Baseten: recentemente avaliada em US$ 13 bilhões
  • Inferact: criada pelos autores do projeto open source vLLM
  • RadixArk: empresa comercial por trás do SGLang

Morin, no entanto, tem ambições que vão além da competição direta. “Chegamos ao ponto de estarmos co-desenhando silício”, revelou. A equipe enxuta de 20 pessoas em Paris é apontada como vantagem competitiva: “Não conseguiria fazer a ZML em outro lugar que não Paris”, disse o fundador.

Apoio de peso e ecossistema europeu

A ZML levantou US$ 20 milhões de fundos como 20VC (Harry Stebbings), Kima Ventures (Xavier Niel), Kindred Capital e LocalGlobe. Sua tabela de capitalização inclui nomes como Solomon Hykes (fundador do Docker e Dagger), Clément Delangue e Julien Chaumond (Hugging Face), além do próprio Yann LeCun.

O software também pode impulsionar fabricantes europeus de chips de IA como Axelera, Fractile, Kalray, SiPearl e VSORA — startups que Morin citou nominalmente como parceiros em potencial para “coisas que nunca foram feitas antes”.

Gratuito — por enquanto

Diferente do framework ML que a ZML lançou em 2024 como open source, o ZML/LLMD não é aberto, mas está sendo lançado como produto gratuito. A estratégia é aprender com o uso antes de monetizar: “Prefiro medir e depois gerar receita onde for mais efetivo, sem atrapalhar meu crescimento por ganância precoce”, explicou Morin.

Ainda não há data para quando o ZML/LLMD se tornará pago, mas o movimento sinaliza uma tendência importante: o ecossistema de inferência está se diversificando rapidamente, e a Europa está determinada a não ficar de fora.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.