🎙️ ¿Qué es Altered y por qué no es “otro cambiador de voz más”?
Altered es una herramienta de creación de contenido de voz que lleva años en el mercado, aunque no ha tenido la misma exposición mediática que otras startups de IA. La empresa detrás, Altered, se fundó en 2018 en Londres, Reino Unido, y tiene su sede en West End Lane, en el barrio de Camden. No es una empresa gigante: según los datos más recientes, tiene alrededor de 14 empleados y ha levantado unos 3,4 millones de dólares en varias rondas de financiación, incluyendo una ronda semilla de 1,3 millones en 2019 y otra de 1,17 millones en 2020. Es un proyecto con respaldo de capital riesgo pero sin el respaldo de una gran corporación.
La propuesta de valor de Altered es bastante específica y, en mi opinión, es lo que la hace interesante. No es un generador de voz a partir de texto (Text-to-Speech) al uso, ni un simple cambiador de tono. Su tecnología central es Speech-to-Speech, o lo que ellos llaman “Performance-to-Performance Voice Morphing”. La diferencia es clave: en lugar de generar voz desde cero a partir de un texto, Altered toma una grabación de voz humana real y transforma sus características vocales (el timbre, el acento, la identidad) manteniendo intactas la emoción, el ritmo, la entonación y la intención de la interpretación original. Es decir, si tú grabas una frase con miedo, la voz resultante sonará con miedo. Si la grabas con ironía, la ironía se mantiene. Eso es algo que el TTS tradicional no puede hacer con la misma naturalidad.
El problema que resuelve es el de la producción de audio profesional sin necesidad de un estudio ni de un elenco de actores de doblaje. Si eres un desarrollador de videojuegos indie, un podcaster o un creador de vídeo, Altered te permite generar múltiples voces de personajes a partir de una sola actuación. Puedes convertir tu voz en la de un anciano, en la de una mujer joven o en la de un narrador con acento americano, sin haber contratado a nadie más.

⚙️ Funciones principales: lo que realmente hace Altered
He revisado su documentación y he visto varios análisis de usuarios, y estas son las funciones que considero más relevantes. No están todas, pero sí las que justifican su uso:
- Speech-to-Speech Voice Morphing: El núcleo del producto. Transforma tu voz en cualquier voz de su biblioteca (o en una clonada) preservando la emoción y el fraseo de tu interpretación original. Es lo que ellos llaman “Performance Voice Morphing” en el plan Professional.
- Biblioteca de voces amplia: Incluye 20 voces profesionales grabadas por actores, más de 800 voces “comunes” de personas reales para personajes secundarios o multitudes, y la posibilidad de clonar tu propia voz. En total, una biblioteca que cubre desde narración profesional hasta extras para juegos.
- Local Voice Cloning: Esta es una de las funciones más interesantes para quien le preocupa la privacidad. El proceso de entrenamiento del modelo de voz se ejecuta localmente en tu ordenador, no en servidores de Altered. Con entre 20 minutos y una hora de grabaciones, puedes crear un clon de voz de alta calidad sin enviar tus datos a la nube.
- Text-to-Speech con estilos de habla: Aunque su fuerte es el Speech-to-Speech, también tienen TTS. La diferencia es que ofrecen “Speaking Styles” predefinidos para cada voz profesional: narración, estilo declarativo, estilo noticias, y 10 estilos emocionales (susurro, grito, agresivo, etc.). No es TTS plano; tiene intención.
- Transcripción y traducción: Soporta transcripción y traducción en más de 75 idiomas. Esto es útil para doblaje: grabas en español, transcribes, traduces al inglés, generas una nueva pista de voz en inglés con otra voz, y sincronizas.
- AI Voice Cleaner y Denoiser: Limpia grabaciones eliminando ruido de fondo, muletillas y artefactos de micrófono con un solo clic. Para quien graba en casa sin tratamiento acústico, esto salva tomas.
- Real-Time Voice Changer (RealTime Pro): Una aplicación de escritorio separada que cambia tu voz en tiempo real durante partidas, streams o videollamadas. Usa un dispositivo de audio virtual y consume pocos recursos de CPU (1-4 núcleos). Requiere Windows.
- Editor de audio integrado con mezclador: No solo cambias la voz. Puedes editar, aplicar efectos DSP, normalizar volumen y hacer crossfading dentro de la misma plataforma.
✨ Lo que la diferencia de ElevenLabs, Murf y compañía
Aquí hay que ser claro, porque la comparación es inevitable y a menudo injusta. Altered no compite directamente con ElevenLabs en el terreno del TTS puro. ElevenLabs es mejor generando voz desde texto de forma natural y rápida. Altered es mejor cuando ya tienes una actuación grabada y quieres transformarla en otra voz sin perder la interpretación.
La preservación de la performance es su ventaja técnica. Si grabas a un actor diciendo una línea con una emoción específica, Altered la mantiene. ElevenLabs y la mayoría del TTS generan una interpretación “plana” a menos que uses marcado o prompts muy específicos. Para doblaje, videojuegos y cualquier contenido donde la actuación importe, Speech-to-Speech gana.
El clonado local es una característica que pocos ofrecen. La mayoría de herramientas de clonado de voz envían tus datos a sus servidores. Altered te permite entrenar el modelo en tu propio PC, con tus propios recursos. Para estudios con acuerdos de confidencialidad o para cualquiera que no quiera su voz en una base de datos ajena, esto es un diferenciador real.
La licencia de atribución en el plan gratuito. Esto no es exactamente una “ventaja” en términos de libertad, pero sí es una diferencia. El plan Free de Altered te obliga a dar atribución y limita el uso comercial. Para probar la tecnología está bien, pero si vas a usar el audio en un proyecto comercial, necesitas pasar por caja.
No es un producto para “escribir y generar”. Si lo que quieres es escribir un guion y obtener una voz hablándolo, Altered no es la herramienta más directa. Su flujo natural es grabar (o subir) audio, luego transformarlo. Eso lo hace más lento para ciertos casos de uso, pero más preciso para otros.
🎯 Dónde se usa de verdad: casos reales
Altered no es una herramienta para todo el mundo, y quienes la usan saben exactamente por qué la usan. Estos son los casos donde tiene más sentido:
Desarrollo de videojuegos: Es probablemente su nicho más fuerte. Los estudios indie pueden generar voces para NPCs y personajes secundarios a partir de un solo actor. Un desarrollador puede hacer una sesión de grabación y luego crear 20 voces distintas para 20 personajes diferentes, todo con la misma actuación base. También se usa para prototipado rápido: generar diálogos placeholder antes de contratar actores finales.
Podcasting: Si haces un podcast narrativo o de ficción sonora, Altered te permite interpretar varios personajes tú mismo. También sirve para limpiar grabaciones caseras y hacer que suenen más profesionales.
Doblaje y contenido multilingüe: Grabas una voz en español, la transcribes, traduces el texto al inglés, y generas una nueva pista de voz en inglés con la misma actuación emocional. Para creadores que quieren doblar contenido a otros idiomas sin pagar actores por cada idioma, esto es muy útil.
Streamers y gamers: Con RealTime Pro pueden cambiar su voz en directo. Algunos lo usan para crear una “personalidad” de stream distinta, otros para juegos de rol o para no ser reconocidos en voz.
Voces para asistentes y aplicaciones de voz: Altered también se posiciona como herramienta para diseñadores de VUI (Voice User Interface). En lugar de usar un TTS genérico para los prompts de tu asistente, puedes grabar los diálogos con la entonación correcta y luego morphearlos a la voz que quieras.
Lo que NO es: No es una herramienta de generación de voz desde texto para crear audiolibros o narraciones largas automáticamente. Para eso, ElevenLabs o Murf son más directos. Tampoco es una herramienta de diseño de sonido general. No genera música ni efectos.
🚀 Cómo empezar a usarlo (sin perderte)
El proceso es más directo de lo que parece, pero hay dos productos distintos que conviene no confundir: Altered Studio (producción de audio) y RealTime Pro (cambio de voz en vivo).
Paso 1: Registro. Entras en altered.ai y creas una cuenta. No necesitas tarjeta para probar. El plan gratuito te da 3 minutos de morphing al mes y 10.000 tokens de IA, con licencia de atribución.
Paso 2: Grabación o subida. Puedes grabar directamente desde el navegador o subir un archivo de audio. La calidad de la grabación importa: cuanto más limpia sea, mejor será el resultado. Para el morphing de rendimiento, la emoción de tu grabación se preservará.
Paso 3: Elegir el modelo de morphing. Altered tiene tres modelos: Timbre (cambia la voz pero mantiene tu acento), Clone (cambia voz y acento), y Speaking Style (cambia voz, acento y forma de hablar). Para empezar, Timbre es el más seguro porque preserva tu acento natural.
Paso 4: Seleccionar la voz objetivo. Puedes elegir de la biblioteca de 20 voces profesionales o 800+ comunes. Si has entrenado un clon local, también aparecerá aquí.
Paso 5: Procesar y ajustar. Aplicas el morphing y escuchas el resultado. Puedes ajustar pitch, género y edad percibida. Si no te gusta, cambias de voz o de modelo. El consumo de cuota se calcula por la longitud del audio de entrada, así que puedes experimentar con distintas voces sin gastar más.
Paso 6: Exportar. Una vez satisfecho, exportas el audio. En el plan gratuito con atribución; en los planes de pago, sin restricciones comerciales.
💡 Trucos para que no suene artificial
La calidad del resultado depende mucho más de tu grabación que de la IA. He aquí lo que he visto que funciona:
- Graba con intención. Altered preserva la emoción, así que si tu grabación es plana, el resultado será plano. Interpreta. Si el personaje está enfadado, grábate enfadado. La IA lo mantendrá.
- Usa el modelo Timbre para preservar acento. Si quieres sonar como otra persona pero mantener tu acento (por ejemplo, un personaje español que habla inglés con acento español), usa Timbre. Si quieres cambiar el acento, usa Clone.
- Limpia antes de morphear. Si tu grabación tiene ruido de fondo o plosivas, pásala primero por el AI Voice Cleaner. El morphing amplifica los defectos de la entrada.
- Ajusta la edad y el género con moderación. Puedes cambiar la edad percibida, pero si exageras demasiado, el resultado suena procesado. Prueba valores intermedios primero.
- Para clonado local, usa grabaciones diversas. Si vas a entrenar tu propia voz clonada, no uses solo una frase leída. Usa diferentes tonos, ritmos y emociones. El modelo aprenderá un rango más amplio.
- Prueba RealTime con pocos núcleos. RealTime Pro está optimizado para consumir 1-4 núcleos de CPU. Si tu PC tiene 8 núcleos o más, no debería afectar al rendimiento de tu juego o stream.
📱 Dónde lo puedes usar
Altered tiene dos productos con disponibilidad distinta:
- Altered Studio (producción): Disponible en web (navegador). También hay una aplicación de escritorio para Windows y Mac, que es recomendable si vas a usar clonado local, porque el entrenamiento requiere recursos de tu máquina.
- RealTime Pro (cambio en vivo): Solo Windows. Es una aplicación de escritorio que instala un dispositivo de audio virtual. No hay versión Mac ni Linux.
- iOS / Android: No hay aplicaciones móviles oficiales para ninguno de los dos productos.
- Extensiones de navegador: No tiene.
- API: Disponible en el plan Enterprise, para integración en aplicaciones propias.
💰 Cuánto cuesta (y los costes ocultos que no te dicen)
El precio de Altered es una de las cosas que más confunde, porque hay datos contradictorios en distintas fuentes. La página oficial de precios es la referencia más fiable:
Free ($0): 3 minutos de morphing al mes, 10.000 tokens de IA, clonado local. Licencia de atribución: puedes usarlo pero debes dar crédito a Altered. No vale para uso comercial sin atribución.
Creator ($30/mes con pago anual, aprox. $33 mensual): 60 minutos de morphing al mes, 325.000 tokens de IA, clonado local, morphing de acento y morphing de estilo de habla. Licencia de creador.
Professional ($90/mes con pago anual, aprox. $99 mensual): 180 minutos de morphing al mes, 1.000.000 de tokens, morphing local ilimitado, morphing flexible y de rendimiento, salida a 48kHz. Licencia comercial.
Enterprise (contactar): Morphing ilimitado, tokens ilimitados, modelos de voz personalizados, API, multiusuario, protección de datos comercial.
Lo que no te cuentan: los tokens se consumen rápidamente con TTS, traducción y transcripción. Un plan Creator tiene 325.000 tokens, pero si usas mucho TTS, se agotan antes de lo que esperas. Además, hay indicios de que el coste real de implementación para equipos puede ser significativamente superior al precio de licencia, con estimaciones que añaden un 50-70% por encima del coste base en formación, soporte e implementación.
🧑🎓 ¿Para quién es esto?
Para quien SÍ es:
- Desarrolladores de videojuegos indie: El caso de uso estrella. Puedes crear un elenco entero de voces a partir de uno o dos actores.
- Podcasters de ficción y narrativa: Si interpretas varios personajes tú mismo, Altered multiplica tu rango vocal sin multiplicar tu trabajo.
- Creadores de contenido multilingüe: Para doblar vídeos a otros idiomas manteniendo la actuación original.
- Streamers y gamers: Con RealTime Pro, si quieres una voz diferente en directo y usas Windows.
- Estudios con requisitos de privacidad: El clonado local permite entrenar voces sin enviar datos a servidores externos.
Para quien NO es:
- Quien necesita TTS puro desde texto: Para generar voz desde un guion escrito, ElevenLabs o Murf son más directos y, probablemente, mejores en ese terreno.
- Usuarios de Mac que quieran cambio en vivo: RealTime Pro es solo Windows. No hay versión Mac.
- Quien busca una herramienta sencilla y barata: Altered tiene una curva de aprendizaje, y los planes de pago empiezan en $30. Para un uso ocasional y simple, hay alternativas más baratas.
- Quien no quiera pagar por probar: El plan gratuito es muy limitado y obliga a atribución. Para saber si vale la pena, tendrás que pagar al menos un mes.
🌍 Cuánta gente lo usa
Altered no publica cifras de usuarios activos ni de visitas mensuales de forma visible. Lo que sí sabemos es que es una empresa pequeña, con 14 empleados y 3,4 millones de dólares levantados, lo que sugiere una base de usuarios profesional pero no masiva.
Lo que sí se sabe es que tiene clientes de perfil medio-alto. Medios como Gimlet (el estudio de podcast de Spotify), y estudios de videojuegos como Ninja Theory y Neon Giant, han usado sus herramientas. Eso indica que no es una herramienta de consumo masivo, sino una herramienta profesional adoptada por equipos de producción de audio.
En términos de tráfico y presencia geográfica, no hay datos públicos fiables sobre distribución por países. Dado que la empresa está en Londres y tiene clientes mencionados en el ámbito anglosajón, es probable que su base principal esté en Reino Unido y Estados Unidos, con presencia en el resto de Europa.
⚖️ Lo bueno y lo no tan bueno
Lo que me convence:
- La calidad del Speech-to-Speech es genuinamente buena. Los análisis profesionales la califican como “top-tier” o “best-in-class” en preservación de performance. No es marketing: la emoción de la interpretación original se mantiene.
- El clonado local es un diferenciador real. Pocas herramientas de voz te permiten entrenar un modelo sin que tus datos salgan de tu ordenador. Para estudios con NDA o para quien le importe la privacidad, es un argumento de peso.
- La biblioteca de voces es amplia. 20 voces profesionales + 800 comunes + clonado propio. Cubre desde narración de alta gama hasta personajes secundarios y multitudes.
- Integra un flujo de postproducción completo. No solo morphea: limpia, transcribe, traduce, edita y exporta. Para podcasters y creadores de audio, ahorra tener que usar varias herramientas.
Lo que no me convence:
- El plan gratuito es demasiado limitado. 3 minutos al mes y atribución obligatoria. No sirve para probar en serio. Para evaluar si la herramienta vale la pena, tienes que pagar al menos un mes de Creator.
- RealTime Pro es solo Windows. Para usuarios de Mac que quieran cambiar la voz en vivo, no hay opción. Eso limita su alcance en el sector creativo, donde Mac tiene presencia importante.
- El sistema de tokens puede ser confuso y limitante. Los tokens de IA se consumen con TTS, traducción y transcripción. Si usas mucho estas funciones, 325.000 tokens se agotan antes de lo que esperas. No es transparente desde el principio.
- La curva de aprendizaje existe. No es una herramienta de “abrir y usar”. Los modelos de morphing (Timbre, Clone, Speaking Style) tienen diferencias que hay que entender para sacarles partido. Los usuarios lo describen como “no la más fácil de aprender”.
🔍 Comparativa con alternativas
vs. ElevenLabs: ElevenLabs es la referencia en TTS. Si tu flujo es escribir un guion y obtener una voz natural, ElevenLabs gana en calidad y facilidad. Altered gana si tienes una actuación grabada y quieres transformarla preservando la emoción. Son herramientas para flujos distintos. Muchos profesionales usan ambas: TTS para borradores y masa, morphing para escenas finales.
vs. Murf: Murf es muy fácil de usar y se integra bien en flujos de vídeo y presentaciones. Para voiceovers rápidos y TTS estándar, es más directo. Altered es más potente pero también más complejo. Si lo que necesitas es un voiceover sencillo para un vídeo corporativo, Murf puede ser suficiente. Si necesitas personajes con emoción y variaciones vocales, Altered.
vs. All Voice Lab: Es una alternativa más económica (plan Creator desde $15/mes). Ofrece TTS, clonado y cambio de voz, pero no tiene la misma especialización en Speech-to-Speech que Altered. Para presupuestos ajustados y necesidades generales, All Voice Lab puede ser una opción. Para producción profesional de voces de personaje, Altered sigue teniendo ventaja.
vs. Revoicer: Revoicer es puro TTS con énfasis en marketing y e-learning. No compite en morphing ni en preservación de performance. Para vídeos de ventas o contenido educativo generado desde texto, Revoicer es más directo. Para cualquier cosa que requiera actuación, no es la misma liga.
🎯 Veredicto final: ¿Merece la pena?
Mi respuesta honesta: depende enteramente de si tu flujo de trabajo encaja con Speech-to-Speech.
Si eres desarrollador de videojuegos indie y quieres generar un elenco de voces a partir de pocas grabaciones, Altered es una de las mejores opciones del mercado. No hay muchas alternativas que hagan lo que hace con la misma calidad. Si eres podcaster de ficción y quieres interpretar varios personajes sin contratar actores, también. Si necesitas doblar contenido manteniendo la actuación original, es una herramienta muy potente.
Pero si lo que necesitas es TTS puro desde texto, o si eres usuario de Mac y quieres cambio en vivo, o si tu presupuesto es muy ajustado y no quieres pagar por experimentar, hay opciones mejores o más adecuadas.
Cuándo merece la pena: Tienes un flujo de producción de audio donde ya grabas voces humanas. Necesitas multiplicar esas voces sin perder la interpretación. Trabajas en videojuegos, podcast de ficción, doblaje o contenido multilingüe. Usas Windows si quieres el cambio en vivo. Valoras la privacidad y quieres clonado local.
Cuándo no: Solo necesitas TTS desde texto. Usas Mac para cambio en vivo. Tu presupuesto no permite $30/mes para probar. No necesitas preservar la emoción porque tu contenido es informativo y plano. Buscas una herramienta “gratis y fácil” sin compromiso.
Altered es una herramienta profesional con un nicho claro. No intenta ser todo para todos, y eso es precisamente lo que la hace buena en lo que hace. Si encajas en su caso de uso, la recomiendo. Si no, no te forces: hay herramientas mejores para otros flujos.

Comentarios