Skip to main content
Treble levanta US$ 18M para treinar e simular voz e sons com IA | Foto: divulgação
Treble levanta US$ 18M para treinar e simular voz e sons com IA | Foto: divulgação

Enquanto o dinheiro grande do mercado de IA de voz corre para quem faz a máquina falar, uma startup islandesa resolveu apostar na pergunta seguinte: saber se ela escuta direito. Com essa tese, a Treble levantou US$ 18 milhões em uma rodada Série A-2 liderada pela Paladin Capital Group.

Fundada em 2020 e com cerca de US$ 40 milhões captados desde o início da operação, a Treble apostou na IA para abordar o som por outro viés: ela constrói a plataforma de simulação que testa a dos outros, e vende para quem está com pressa de lançar produto. Amazon e Logitech estão entre os clientes.

Segundo a empresa destacou em comunicado, os recursos vão para o avanço no mercado de produtos com áudio embarcado, tanto em aplicações de consumo quanto corporativas, e para a expansão em IA física. De acordo com o CEO Finnur Pind, a deep tech está de olho em setores como robótica, automotivo e drones.

“A interação por áudio e voz está se tornando uma interface fundamental para a próxima geração de produtos inteligentes, mas o mundo físico é acusticamente complexo”, pontua o CEO.

Para explicar melhor o que a Treble faz, o fundador divide a atuação em três frentes. A primeira é geração de dados sintéticos para treinar modelos de supressão de ruído e realce de fala. A segunda é avaliação de modelos de voz sob diferentes condições realistas, com o retorno indo direto para os laboratórios que os desenvolvem — em junho, a empresa lançou com a Hugging Face o Far-Field ASR Leaderboard, benchmark de reconhecimento de fala em cenários variados.

A terceira é prototipagem virtual de hardware: simular como um fone vai soar antes de existir, ou se um smart speaker entende o comando conforme a posição em que foi instalado. Recentemente, a lista passou a incluir óculos inteligentes e outros dispositivos de IA.

“A Treble dá às equipes de desenvolvimento dos maiores fabricantes de dispositivos do mundo uma forma mais rápida e escalável de modelar essas condições, gerar os dados de que precisam e testar produtos para garantir que funcionem de forma confiável nos ambientes onde as máquinas operam e as pessoas interagem com elas”, completa o executivo.

Mercado aquecido

Os números do mercado de inteligência artificial por voz tornam os US$ 40 milhões da Treble um detalhe. Diversas empresas estão se capitalizando na corrida para aprimorar seus modelos de geração e reconhecimento de fala. Um dos exemplos mais recentes é o da ElevenLabs, que anunciou em fevereiro uma captação de US$ 500 milhões a um valuation de US$ 11 bilhões, liderada pela Sequoia, mais que triplicando os US$ 3,3 bilhões que valia em janeiro de 2025, e fechou 2025 com mais de US$ 330 milhões em receita recorrente anual.

No mesmo trimestre, a Deepgram levantou US$ 130 milhões em Série C a US$ 1,3 bilhão, e o período foi o maior da história do setor, com US$ 559 milhões em dez rodadas, alta de 68% sobre o ano anterior. Em julho, a Fish Audio, de Palo Alto, levantou US$ 52 milhões em uma Seed liderada por Coreline Ventures e Capital Today para disputar com ElevenLabs, WellSaid e Cartesia. Antes disso, a Meta comprou a WaveForms, e a OpenAI adquiriu e encerrou a Weights.gg.

Só que quase todo esse dinheiro está na mesma prateleira: geração de fala, transcrição e agentes que atendem telefone. É uma camada que vem se comoditizando rápido, com modelos abertos e APIs de laboratório grande apertando as margens de quem só entrega voz sintética. Quando o modelo deixa de ser diferencial, a disputa migra para dado de treino e para avaliação, onde a Treble se instalou.

A análise é compartilhada por François Ruether, VP da Paladin. Segundo ele, à medida que mais produtos dependem de entender som, essa infraestrutura fica mais valiosa em voz, vestíveis, robótica e IA física — e o cliente mantém a propriedade dos próprios modelos enquanto ganha uma base compartilhada de infraestrutura acústica nativa de simulação.

“A Paladin prevê que a robótica vai impulsionar uma onda profunda de automação no mundo físico. Só que os robôs de hoje estão em grande parte limitados à percepção visual: podem detectar o que está à frente deles, mas não conseguem interpretar sons críticos, como alguém caindo em outro cômodo ou uma batida virando a esquina”, avalia.

O post Treble levanta US$ 18M para treinar e testar IA de voz dos outros apareceu primeiro em Startups.