En el mundo digital estamos acostumbradas a escuchar voces digitales o sintéticas. Voces cuya identidad ha sido generada artificialmente o son clones de voz que replican la identidad de alguna persona.
Voces digitales estereotipadas
La mayoría de esas voces digitales son normativas. Por ejemplo, tienen un acento “neutro”, representando el estándar del habla de un país o región pero asociado a un área geográfica concreta. También sucede con el género, nos encontramos con voces estereotípicamente masculinas o femeninas y nada fuera de ese rango.
Son voces que se utilizan para dar voz, nunca mejor dicho, a la tecnología con la que interactuamos: asistentes de voz como ChatGPT, Alexa, Google Assistant o Siri. También son utilizadas en contenidos que escuchamos y en herramientas de accesibilidad web.
Para crear estas voces, se entrenan modelos de síntesis de voz con voces de personas reales. El problema es que estas voces suelen grabarse con acento estándar y con una dicción perfecta y ya sabemos que la realidad no sigue la norma.
Rompiendo la norma en cuanto a género y acento
Nuestra voz nos identifica y la nuestra es una sociedad diversa. ¿Dónde están esas voces digitales que representan la diversidad de nuestro habla? Voces con acentos de diferentes regiones, que tengan otras formas de hablar, y que suenen con tonos variados más allá del estereotipo femenino (tonos muy agudos) y masculino (tonos muy graves).
Para crear voces diversas que rompan esos estereotipos es necesario incluir a personas diversas y entrenar modelos de voz donde se las escuche. Voces que estén a disposición de todos, todas y todes.
Desde Monoceros Labs, llevamos meses trabajando con orgullo en voces con diversidad de género y acento para la creación de contenido y su integración en asistentes de voz. Voces cuyas identidades han sido creadas gracias a nuestra tecnología de Inteligencia Artificial Generativa y que desde hoy puedes utilizar de manera gratuita en Fonos.
Es más, hoy compartimos la iniciativa «Free the voices» en colaboración con LLYC, donde personas del colectivo LGTBIQ+ han donado su voz para crear la voz de Libertas, una voz diversa con acento de español de México. También sumamos por nuestra parte nuestras primeras voces prediseñadas diversas en español de España: Cástor, Fulu y Hatysa.
Voces diversas en Fonos
Escucha a continuación las voces diversas en cuanto a género y acento que hemos creado.
Hatysa (Español de España)
Hola, soy Hatysa. Soy una voz diversa de tono medio. Hablo español del centro norte de España. Mi voz es expresiva, y puedo ayudarte a crear contenidos informativos y narrativos.
Cástor (Español de España)
¡Hola! mi nombre es Cástor. Soy una voz diversa con tono medio, y hablo español con acento de la región central de España. Puedo ayudarte a crear cualquier tipo de contenido.
Fulu (Español de España)
Hola, me llamo Fulu. Soy una voz diversa con tono medio, con acento del centro de España. Puedo ayudarte a crear contenido de estilo generalista.
Libertas (Español de México)
Buenas, soy Libertas, la primera voz diversa en colaboración con LLYC (Llorente y Cuenca) para el proyecto «Free the voices». Soy una voz diversa de tono medio. Hablo español de México. Mi voz es algo versátil, y puedo ayudarte a crear contenidos de todo tipo.
Izar, diversidad de acento (Español de Andalucía)
Buenas, soy Izar. Soy la primera voz digital andaluza disponible en plataformas. Soy una voz con tono agudo, y hablo español con acento de Andalucía, España. Puedo ayudarte a crear contenido de todo tipo: desde narrativo a informativo. Soy bastante expresiva, mostrando entusiasmo y enfado.
Voces para crear contenido
Por ahora, estas son las nuevas identidades, y seguimos trabajando en crear más voces diversas. Esperamos aportar así nuestro grano de arena para un mundo digital más diverso e inclusivo.
Crea ahora tu cuenta en Fonos, y empieza a usar estas voces prediseñadas de manera gratuita para tus vídeos y creaciones sonoras.
Más sobre la IA y los sesgos de género
Estas son algunos enlaces de lecturas sobre la Inteligencia Artificial y los sesgos de género:
- Here’s how Generative AI depicts queer people (Wired, 02/04/2024)
- Computers are binary, people are not: how AI systems undermine LGBTQ identity (EDRi / Acessnow, 13/01/2023)
- Free the voices – LLYC ideas (19/06/2024)
- Project Q, the genderless voice (TechCrunch, 2019)

