Fish Audio capta US$ 52 milhões para democratizar vozes de IA
A startup Fish Audio anunciou uma rodada seed de US$ 52 milhões para expandir sua plataforma de modelos de voz baseados em IA, voltada tanto para criadores de conteúdo quanto para empresas. A rodada foi liderada pela Greenoaks, com participação de investidores estratégicos do setor de áudio e IA.
Fundada há pouco mais de um ano, a Fish Audio já acumula 8 milhões de usuários entre a versão open-source e a hospedada de seus modelos, com receita anual recorrente (ARR) de US$ 21 milhões — números impressionantes para uma startup em estágio seed.
Tecnologia e diferenciação
A Fish Audio desenvolve modelos de síntese de voz (TTS) e clonagem de voz com apenas alguns segundos de áudio de referência. O diferencial técnico está na arquitetura dual-track: modelos base totalmente open-source (disponíveis no Hugging Face) e uma versão hospedada com qualidade de estúdio, latência ultrabaixa e suporte multilíngue.
Diferente de concorrentes como ElevenLabs, que focam em vozes profissionais e dublagem, a Fish Audio mira o mercado de criadores independentes — YouTubers, podcasters, desenvolvedores de jogos e produtores de audiolivros — oferecendo preços mais acessíveis e maior controle sobre o timbre e a expressividade.
Concorrência e cenário
O mercado de voice AI está em ebulição: ElevenLabs captou US$ 80 milhões em 2024, a OpenAI expandiu o Advanced Voice Mode, e a Meta lançou modelos de voz open-source. A Fish Audio se posiciona na interseção entre qualidade profissional e acessibilidade open-source, um espaço ainda pouco explorado.
Com o novo capital, a startup planeja dobrar o time de engenharia, expandir o suporte para mais de 40 idiomas (incluindo português brasileiro com entonação natural) e lançar uma API empresarial com garantias de latência sub-100ms — essencial para aplicações em tempo real como assistentes virtuais e call centers.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



