Suno
Músicas inteiras a partir de uma descrição
Gera a faixa com voz, letra e arranjo a partir de um prompt curto. Dá para definir gênero e clima ou subir a sua própria letra.
audioFreemium
Síntese de voz com latência muito baixa
A voz começa a soar quase na hora, então serve para conversa ao vivo e não só para narrar uma gravação. Clona vozes a partir de uma amostra curta.
02Músicas inteiras a partir de uma descrição
Gera a faixa com voz, letra e arranjo a partir de um prompt curto. Dá para definir gênero e clima ou subir a sua própria letra.
A síntese de voz mais natural
Narra textos com voz viva, clona a sua própria voz e dubla vídeos para dezenas de idiomas. Tem API para integração.
Síntese e reconhecimento de fala em tempo real para apps
Modelos rápidos de TTS e STT e inferência de modelos de linguagem por APIs modulares. Feito para apps de massa em que latência e custo da voz importam.