Whisper

Modelo aberto de reconhecimento de fala

github.com/openai/whisper ↗
01

O que é

Passa áudio para texto em dezenas de idiomas, funciona local e é gratuito. É a base de um monte de serviços de transcrição.

02

Etiquetas

  • transcrever
  • transcrição
  • reconhecimento de fala
  • legendas
  • rodar local
03

Parecidas

Hugging Face

O grande hub dos modelos abertos

001

Centenas de milhares de modelos e datasets, demos no Spaces e bibliotecas de treinamento. É o ponto de partida de qualquer trabalho com código aberto.

codingFreemium

Suno

Músicas inteiras a partir de uma descrição

002

Gera a faixa com voz, letra e arranjo a partir de um prompt curto. Dá para definir gênero e clima ou subir a sua própria letra.

audioFreemium

ElevenLabs

A síntese de voz mais natural

003

Narra textos com voz viva, clona a sua própria voz e dubla vídeos para dezenas de idiomas. Tem API para integração.

audioFreemium