Skip to main content
Áudio
Áudio (Imagem: Canva)

A disputa pelo mercado de inteligência artificial voltada à geração de voz ganhou novos contornos nos últimos tempos. O avanço do setor tem sido marcado por movimentações de grandes players, a exemplo da Meta ter comprado a startup WaveForms em agosto de 2025 para reforçar sua divisão de IA com modelos de voz, e da OpenAI ter adquirido e encerrado as operações da Weights.gg, plataforma focada na clonagem e no treinamento de modelos de voz personalizados.

Agora, uma nova startup de Palo Alto acaba de ganhar apoio para competir nesse mercado. A Fish Audio, focada em conversão de texto em fala e clonagem rápida de voz, levantou US$ 52 milhões em uma rodada Seed liderada pela Coreline Ventures e Capital Today. O aporte contou também com a participação da 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners e HF0.

Fundada em 2024 pelo ex-pesquisador da NVIDIA Shijia Liao e pela ex-Meta e IBM Rissa Cao, a empresa possui mais de 15.000 controles de linguagem natural, e afirma já ter mais de 8 milhões de usuários e uma receita recorrente anual de US$ 21 milhões.

No último ano, a Fish Audio lançou cinco modelos de inteligência artificial, sendo quatro voltados à geração de fala e um de conversão de fala em texto. Três deles permanecem disponíveis em código aberto, enquanto o modelo mais recente, o S2.1 Pro, é oferecido exclusivamente por meio de uma API paga.

Além dos planos por assinatura voltados a criadores e equipes, que oferecem minutos de geração de áudio e recursos de clonagem de voz, a Fish Audio também comercializa APIs e soluções corporativas para empresas.

Entre as companhias que já utilizam a tecnologia estão a HeyGen, que cria, traduz e personaliza vídeos corporativos e de marketing, e a LiveKit, plataforma e infraestrutura de código aberto voltada para comunicação em tempo real via WebRTC e agentes de IA multimodal (voz, vídeo e robótica).

Com o novo aporte, a Fish Audio pretende acelerar o desenvolvimento de novos modelos de IA. Entre os projetos anunciados estão um modelo de compreensão de áudio e outro voltado à conversão direta de fala em fala. A empresa disputa espaço em um mercado cada vez mais competitivo, que reúne nomes como ElevenLabs, WellSaid e Cartesia.

O post Na corrida por IA de áudio, startup de Palo Alto capta US$ 52M em Seed apareceu primeiro em Startups.