Suno
Canciones enteras a partir de una descripción
Genera la pista con voz, letra y arreglo desde un prompt corto. Puedes fijar el género y el ánimo o subir tu propia letra.
Síntesis de voz, música, limpieza de sonido y transcripción.
91 herramientas
Canciones enteras a partir de una descripción
Genera la pista con voz, letra y arreglo desde un prompt corto. Puedes fijar el género y el ánimo o subir tu propia letra.
La síntesis de voz más natural
Locuta textos con voz viva, clona tu propia voz y dobla vídeos a decenas de idiomas. Tiene API para integrarlo.
Síntesis y reconocimiento de voz en tiempo real para apps
Modelos rápidos de TTS y STT e inferencia de modelos de lenguaje mediante APIs modulares. Pensado para apps masivas donde importan la latencia y el coste de la voz.
Transcripción de reuniones y audio en 58 idiomas
Graba llamadas en Zoom, Meet y Teams, transcribe identificando hablantes, traduce y redacta un resumen.
Texto a voz con ajuste fino de la voz
Cientos de voces en varios idiomas con control de velocidad, tono, pausas y efectos. Popular entre youtubers para la voz en off.
Locución con emociones de actor
Cientos de voces-personaje que susurran, gritan o se ponen tristes. Para vídeos, audiolibros y juegos, con entonación ajustable por frase.
Operadores de IA para llamadas masivas
Plataforma corporativa donde los agentes llaman a clientes y atienden entrantes según un guion, integrados con el CRM.
De la grabación al material listo para redacciones
Transcribe entrevistas y permite montar citas, historias y cortes desde la transcripción. La usan redacciones de noticias.
De pensamientos hablados y desordenados a texto limpio
Dices la idea tal cual y AudioPen la convierte en una nota estructurada, un post o un correo en el estilo elegido.
Vídeos con voz a partir de presentaciones y texto
Convierte diapositivas de PowerPoint o un guion en un vídeo con locutor en 100 idiomas. Práctico para cursos y guías internas.
Actas de reuniones y tareas tras las llamadas
El bot entra en la llamada, graba, destaca decisiones y tareas y las envía al CRM, Slack o el gestor de tareas.
Canciones y rap con voz de IA
Escribes la letra o subes un beat y Uberduck genera la voz y temas completos, con biblioteca de voces y API para desarrolladores.
Plataforma de agentes de voz telefónicos
Creas un agente que recibe y hace llamadas: citas médicas, calificación de leads o encuestas. Baja latencia y pago por minuto.
Audio y vídeo a texto en cien idiomas
Subes un archivo o enlace y obtienes el texto con marcas de tiempo, que puedes editar, traducir y exportar como subtítulos.
Texto a voz gratis online
Pegas el texto, eliges idioma y voz y descargas el MP3. Tiene voces en ruso, español y portugués, y permite uso comercial.
Servicio europeo de transcripción con protección de datos
Transcripción y subtítulos en servidores europeos según el RGPD, automáticos o revisados. Para universidades, administración y medios.
Grabadora de bolsillo con resúmenes de IA
Un dispositivo fino graba reuniones y llamadas del móvil, y la app hace la transcripción, el resumen y mapas mentales.
Transcripción y análisis de pruebas para abogados
Transcribe declaraciones, llamadas y vídeos y convierte las pruebas digitales en hallazgos verificados y citables para el caso. También mantiene transcripción y subtítulos generales.
Transcripción rápida y casi ilimitada
Transcribe archivos de hasta 10 horas con el modelo Whisper. Unos pocos archivos gratis al día y sin límites en el plan de pago.
Notas de reuniones con IA y transcripción en 150 idiomas
Graba y transcribe llamadas, las convierte en notas y decisiones, y el archivo de conversaciones se vuelve base de conocimiento. Empresa europea, RGPD.
Dictado en cualquier app de Mac y iPhone
Pulsas una tecla y hablas: el texto aparece donde está el cursor, ya con puntuación. Puede funcionar en local sin internet.
Transcripción para periodistas e investigadores
Transcripción automática precisa con editor sincronizado con el audio, búsqueda en las grabaciones y traducción. Se integra con Zoom y Premiere.
Pista instrumental y a capela de cualquier canción
Subes una canción y obtienes por separado voz, batería, bajo y el resto. Útil para karaoke, covers y remixes.
Separación de voz gratis en tu ordenador
Programa abierto con los mejores modelos de separación: voz, instrumentos y coros. Funciona sin conexión y sin límites.
Graba pódcasts y entrevistas con calidad de estudio
Graba a cada participante en local sin pérdidas, y la IA quita pausas, limpia el audio, transcribe y corta clips para redes.
Canciones con voz a partir de letra y referencia
Crea canciones completas en varios idiomas: puedes dar tu letra, el estilo o subir un tema de referencia para un sonido parecido.
Masterización automática y distribución de temas
Subes la mezcla y la IA la masteriza con el estilo y el volumen deseados. Además, samples, plugins y distribución a plataformas.
Separación de pistas en stems para profesionales
Separa voz, batería, bajo y diálogos de la música y los efectos. La usan discográficas, estudios de cine y equipos de doblaje.
Masterización de creadores que trabajaron con artistas Grammy
Masterización online en un par de minutos, ajustando el resultado a un tema de referencia y comparando antes y después.
Música para marcas y creadores
Crea música para la marca y el contenido: temas, sonidos de marca y pistas de fondo con licencia de uso comercial.
Música y efectos de sonido de Stability AI
Genera pistas y sonidos a partir de una descripción y continúa un fragmento subido. El modelo se entrenó con una biblioteca con licencia.
Plugins de mezcla, masterización y limpieza de audio
Ozone, Neutron y RX con asistentes que analizan la pista y proponen ajustes. Un estándar en estudios de grabación y posproducción.
Traducción y doblaje de vídeo a 130 idiomas
Traduce el habla conservando la voz del orador y ajusta el movimiento de los labios al nuevo idioma. Para canales de YouTube y vídeos formativos.
Doblaje rápido de vídeos con IA
Subes el vídeo, eliges idiomas y voces y obtienes una versión doblada con subtítulos que puedes retocar en el editor.
Subtítulos, transcripción y locución de vídeo
Transcribe el habla automáticamente, crea subtítulos y los traduce a decenas de idiomas, y luego pone voz con IA.
Agentes de voz que contestan el teléfono
Atienden llamadas con voz natural: reservan mesas y habitaciones, toman pedidos y resuelven dudas sin esperas en línea.
Un vídeo locutado a partir de texto o artículo
Convierte un texto, un post o un enlace en vídeo con metraje de stock y una voz de su gran biblioteca. Muchos idiomas.
Agentes de voz para llamadas sin código
Monta un bot que recibe y hace llamadas: citas, calificación de clientes, respuestas a dudas.
Lee en voz alta libros y artículos
La app de ElevenLabs narra PDF, artículos y libros con voces naturales. Cómodo para escuchar de camino.
Grabación de reuniones con cortes de los momentos clave
Graba la llamada, hace el resumen y permite recortar un fragmento importante y compartirlo por enlace. Popular en ventas e investigación.
Graba llamadas de ventas y rellena el CRM
Graba y resume la reunión, detecta objeciones y próximos pasos, y pasa las conclusiones al CRM por su cuenta.
Resumen de llamadas de ventas en varios idiomas
Graba reuniones y llamadas telefónicas, hace el resumen y rellena el CRM. Su punto fuerte son los idiomas europeos, incluidos francés y español.
Resúmenes de reuniones, correos y chats en un sitio
Resume las llamadas y condensa la correspondencia de correo y mensajería, mostrando qué importa y qué espera respuesta.
Grabación de llamadas con marcas y cortes
Graba Zoom, Meet y Teams, marca los momentos importantes y envía las conclusiones al CRM. Plan gratuito generoso.
Modulador de voz y panel de sonidos
Cambia la voz en Discord, juegos y directos, y añade efectos de sonido con atajos de teclado.
Música sin reclamaciones de derechos para tu vídeo
Genera una pista según el ánimo y la duración, y permite cambiar la estructura por secciones. Licencia para YouTube y publicidad.
Un bot que graba y resume las llamadas
Se conecta a Zoom, Meet y Teams, transcribe y resume, y permite buscar y preguntar en el histórico de reuniones.
Efectos de audio en el navegador
Cambia tono y tempo, añade reverberación y 8D, quita la voz, sin instalar y gratis. Para retoques rápidos.
Del pódcast a artículo, posts y newsletter
Transcribe el episodio y saca de él un artículo, notas, citas para redes y un correo para la newsletter.
Cambia la voz en tiempo real
Modulador de voz gratuito para juegos, directos y llamadas, con una gran biblioteca de voces de la comunidad.
El estudio musical con IA de Google (antes Riffusion)
Crea y remezcla canciones con calidad de estudio, ayuda a dirigir videoclips y a crear tus propios instrumentos. El proyecto nació de Riffusion.
Lee en voz alta documentos y webs
Narra PDF, libros y páginas web con voces naturales, con extensión para el navegador y aplicación.
Música, sonidos y metraje para vídeo
Banco con licencia para vídeos: pistas, efectos de sonido, metraje y plantillas. Ha sumado locución e imágenes con IA.
Transcripción y traducción de voz por API
Transcribe grabaciones y flujo en directo separando por hablante y traduciendo sobre la marcha. Está orientado a integrarse en productos europeos.
Música según la escena y el ánimo del vídeo
Eliges escena, género y ánimo y recibes una pista de la duración necesaria con derecho de uso comercial. La apuesta es la sencillez, no el ajuste fino.
Limpia el pódcast de la basura del habla
Quita los «eh», chasquidos, respiraciones y silencios largos de una grabación de conversación. Muestra cuánto tiempo de montaje te ha ahorrado.
Compone bandas sonoras para vídeo y videojuegos
Genera música instrumental según el género y el ánimo, y la partitura se puede retocar en su editor. La licencia permite usar las pistas en piezas comerciales.
Música de fondo según el ánimo del vídeo
Arma la pista para una emoción y una duración concretas, de forma que no tape la voz. La licencia es limpia y sirve para YouTube y publicidad.
Voces con entonación viva para llamadas
Síntesis de voz pensada para telefonía: entonación coloquial, pausas y titubeos que suenan naturales. Latencia baja.
Reconocimiento de voz por API
Pasa audio a texto separando por hablante, con marcas de tiempo y detección de temas. Lo usan desarrolladores que integran transcripción en su producto.
Reconocimiento de voz en muchos idiomas
Pasa habla a texto detectando el idioma sobre la marcha y funciona en flujo continuo. Orientado a integrarse por API.
Cambia la voz del actor en la grabación
Sustituye la voz de una grabación por otra del catálogo conservando la entonación y la interpretación. Se usa en doblaje, videojuegos y audiolibros.
Separa la canción en pistas para músicos
Aísla voz, batería y bajo, cambia tempo y tonalidad, y muestra los acordes. Hecho para ensayar y sacar canciones.
Modelos de voz para músicos
Cambia la voz del vocal y quita el fondo de la grabación para montar una versión. Puedes entrenar un modelo con tu propia voz.
Nivela el volumen y limpia el sonido
Ajusta los niveles de forma automática, quita ruido y deja la grabación en los estándares de emisión. Los podcasters lo usan desde hace años para el acabado final.
Limpia una grabación de voz hasta dejarla de estudio
Quita ruido, eco y reverberación de una grabación casera y la acerca al sonido de estudio. Funciona gratis en el navegador y trae aparte un editor de pódcast.
Música ajustada a la duración exacta del vídeo
Arma la pista con los segundos justos, adaptando la estructura al montaje. La licencia permite uso comercial.
Un flujo infinito de música a medida
Genera una pista continua para trabajar, para un directo o para una app, en lugar de un archivo suelto. Tiene API para integrarlo en productos.
La interpretación de un actor con otra voz
Traslada la actuación a otra voz conservando la interpretación; se usa en cine y televisión. Trabaja con contratos de licencia con los actores.
Transcripción con foco en los acentos
Entiende bien el habla con acentos y dialectos distintos, incluso en grabaciones con ruido. Se puede desplegar en tu propia red.
Reconocimiento de voz para productos de voz
Pasa habla a texto en tiempo real y con poca latencia, así que sirve para llamadas y bots de voz. También trae síntesis de voz en la misma cadena.
Agentes personales de voz para mentes curiosas
Un conjunto de agentes personales con los que hablas por voz: pensar una idea, entender un tema o descubrir algo nuevo. Vista previa en iOS y, más adelante, gafas inteligentes.
Quita la voz de una canción gratis
Separa la pista en voz y karaoke en el propio navegador, sin registro. Incluye cambio de tempo, tonalidad y un editor sencillo.
Una pista en dos clics, sin saber música
Arma una composición completa por estilo en segundos, y luego se puede retocar y publicar en streaming. Está orientado a principiantes.
Voces de locutor para formación y publicidad
Biblioteca de voces de estudio con control fino de acentos y pausas. Las voces están grabadas con actores bajo contrato.
Síntesis y clonación de voz de código abierto
Modelo de pesos abiertos: locuta texto y reproduce una voz a partir de una muestra corta, en muchos idiomas. Se puede ejecutar en local.
Evaluación humana de IA de voz por API
Ofrece a los equipos que crean asistentes de voz y síntesis de habla valoraciones rápidas de personas reales: naturalidad, emoción y calidad del diálogo con una sola llamada a la API.
Síntesis de voz con latencia muy baja
La voz empieza a sonar casi al instante, así que sirve para conversación en vivo y no solo para locutar una grabación. Clona voces a partir de una muestra corta.
Detección de deepfakes y marcas de agua para empresas
Verifica en tiempo real voz, vídeo e imágenes en busca de falsificaciones y marca el contenido generado con marcas de agua. En la nube o en tus servidores.
Lee documentos y artículos en voz alta
Convierte PDF, libros y páginas web en audio con voz natural y hasta 4,5 veces más rápido. También escribe al dictado.
Elimina el ruido en videollamadas
Limpia el ruido de fondo y el eco del micrófono en cualquier aplicación, graba la reunión y hace el resumen. Funciona sobre Zoom, Meet y Teams.
Transcripción y resumen de audio y vídeo
Convierte audio y vídeo en transcripciones, subtítulos, resúmenes y mapas mentales. Sirve para reuniones, entrevistas, clases y pódcast.
Dictado en lugar de teclado
Dictas y recibes el texto ya limpio en cualquier aplicación, con la puntuación puesta y sin muletillas. Funciona en Mac y Windows.
Agentes de voz para telefonía
Monta un bot de voz que recibe y hace llamadas: reconocimiento, modelo y síntesis en una sola cadena de baja latencia.
Graba y resume tus reuniones online
Se conecta a Zoom, Meet y Teams: graba, transcribe y entrega un resumen con las tareas. El plan gratuito no limita el número de reuniones.
Transcripción y resumen de reuniones
Se conecta a Zoom, Meet y Teams, transcribe en directo y entrega las conclusiones con las tareas. Se puede buscar en el histórico de todas las llamadas.
Separar una canción en pistas
Extrae voz, batería y bajo de una grabación ya terminada y limpia ruido y eco. Cómodo para versiones, karaoke y pódcast.
Música con foco en la calidad del sonido
Competidor de Suno con control fino de la estructura del tema: la composición se puede ir construyendo por partes y editar cada sección.
Modelo abierto de reconocimiento de voz
Pasa audio a texto en decenas de idiomas, funciona en local y es gratis. Es la base de un montón de servicios de transcripción.
Locución para presentaciones y publicidad
Biblioteca de voces de locutor con ajuste de ritmo y entonación, y editor con línea de tiempo para acompañar el vídeo.
Editar vídeo corrigiendo el texto
Transcribe la grabación y deja montar el vídeo borrando palabras en el texto. Quita muletillas y silencios con un botón.