ZML lança software de inferência compatível com chips da Nvidia, AMD e Google, prometendo reduzir custos de IA e eliminar a dependência de um único fornecedor de hardware.
Home » Startup francesa ZML lança software para otimizar inferência de IA em múltiplos chips
ZML lança software de inferência compatível com chips da Nvidia, AMD e Google, prometendo reduzir custos de IA e eliminar a dependência de um único fornecedor de hardware.
A startup francesa ZML, apoiada pelo vencedor do Prêmio Turing Yann LeCun, lançou o ZML/LLMD, um servidor de inferência de código aberto projetado para executar grandes modelos de linguagem em uma ampla variedade de chips. A solução é compatível com hardwares da Nvidia, AMD, Google TPU, Apple Metal e Intel Arc, com o objetivo de maximizar a velocidade de processamento e eliminar as barreiras de arquitetura que atualmente limitam o desempenho da inteligência artificial.
Segundo Steeve Morin, fundador da empresa, a otimização da inferência — o processamento de prompts — tornou-se mais crítica do que o próprio treinamento de modelos. No entanto, o ecossistema atual é fragmentado, com barreiras de software que frequentemente resultam em dependência exclusiva de um único fornecedor. O novo produto busca reverter esse cenário, permitindo que empresas e provedores de nuvem combinem diferentes processadores para obter ganhos reais de eficiência e reduzir custos operacionais.
A iniciativa também representa um impulso para fabricantes emergentes de chips de IA, muitos dos quais baseados na Europa, como Axelera, Kalray e SiPearl. Ao garantir que seus hardwares possam operar no desempenho máximo, a ZML oferece uma alternativa viável ao domínio do mercado, embora Morin ressalte que a empresa mantém uma boa relação com a Nvidia, que também está intensificando seus investimentos na infraestrutura de inferência.
O lançamento ocorre em meio à chamada corrida do ouro da inferência, um setor que atrai bilhões em investimentos e consolida novos concorrentes. A ZML entra em um mercado já disputado por players como a Baseten, avaliada em 13 bilhões de dólares, e iniciativas como Inferact e RadixArk. A proposta da startup francesa, contudo, destaca-se ao devolver o controle da infraestrutura aos desenvolvedores, promovendo uma disseminação mais ampla e economicamente sustentável da inteligência artificial.
Paulo Júnio de Lima é Administrador com MBA em Marketing Digital e especialista em estratégia, inovação e gestão de projetos. Na Comunicação e Relações Públicas da Grande Loja Maçônica de Minas Gerais, desenvolve soluções para fortalecimento institucional. Com passagens por ORO, Agência Open, Brasil84 e VTIC, acumula experiência em marketing digital, branding e transformação digital. Certificado pelo IA Lab do Estúdio Kimura, aplica inteligência artificial em design, automação e comunicação. Membro ativo da Ordem DeMolay há mais de 18 anos, atua também em projetos sociais e educacionais.
O futuro acontece aqui: esteja entre os primeiros a receber insights, tendências e oportunidades que moldam o mercado.
Receba em primeira mão os movimentos do mercado da inteligência artificial
em nossa newsletter com nossa curadoria e conteúdos autorais: notícias mais relevantes,
destaques da semana, análises de nossos especialistas e colunas recomendadas.
+15.587 profissionais já assinaram