Categories: Open SourceSoftware

Mozilla lanza un gran repositorio de voz de dominio público

Mozilla ha estado recabando muestras de voz a través de su proyecto Common Voice. Y, ahora, ha decidido lanzar la primera versión de una gran colección de voces que se caracteriza por ser de dominio público.

De hecho, sus responsables dicen que “ya es el segundo mayor conjunto de datos de voz disponible para el público que conocemos”. Y a esto habría que añadir que “personas de todo el mundo están añadiendo y validando nuevas muestras todo el tiempo”. Aunque de momento las muestras que se ofrecen están en inglés, Mozilla asegura que pronto se seguirá con “todos los idiomas”.

El repositorio actual cuenta con unas 400.000 grabaciones que pertenecen a 20.000 personas distintas. En total serían 500 horas de discurso.

El objetivo de Mozilla con Common Voice es ayudar a desarrolladores, fabricantes, empresas e investigadores a la hora de trabajar con tecnología habilitada por voz.

“La mayoría de nosotros solamente tenemos acceso a una colección bastante limitada de datos de voz”, explican desde Mozilla, añadiendo que esto es “un componente esencial para crear motores de reconocimiento de voz de alta calidad”. Además, “estos datos de voz pueden costar más de decenas de miles de dólares y su escala es insuficiente para crear un reconocimiento de voz a un nivel que espera la gente”.

“Al proporcionar este nuevo conjunto de datos públicos”, concluye Mozilla, “queremos ayudar a superar estas barreras y facilitar la creación de nuevos y mejores sistemas de reconocimiento de voz”. Entre ellos, su propio Deep Speech.

Mónica Tilves

Licenciada en Xornalismo por la Universidad de Santiago de Compostela en la especialidad de Periodismo Electrónico y Multimedia. Apasionada de los gadgets, la fotografía digital, el diseño web y el arte. Tras un primer contacto con el mundo de la prensa escrita y con la suficiencia investigadora debajo del brazo, me decanto por los medios online. Cubro la actualidad informativa en Silicon Week desde 2011, además de colaborar en otras publicaciones del grupo NetMediaEurope en España como Silicon News. Ahora en Silicon.es.

Recent Posts

Silicon Pulse: Titulares de la semana T3E21

Bienvenido a un nuevo episodio del podcast semanal Silicon Pulse, un espacio en el que…

3 horas ago

Slack integra la IA en cada elemento central de la experiencia de usuario

El autodenominado “sistema operativo de trabajo” busca ser más que una plataforma de colaboración y…

13 horas ago

Zoho lanza su propio modelo de lenguaje de gran tamaño: Zia LLM

Su propuesta consta de tres modelos, con 1.300, 2.600 y 7.000 millones de parámetros.

14 horas ago

EnGenius introduce switches de la serie Cloud-Lite

Los modelos ECS205L y ECS208L, en formatos de 5 y 8 puertos, se caracterizan por…

15 horas ago

El correo electrónico, principal vector de ataque a las empresas

Durante 2024 esta categoría rebasó a la de servidores corporativos en la nube comprometidos.

16 horas ago

Infobip implementa WhatsApp Business Calling

Con esta función, las empresas pueden realizar y recibir llamadas de voz con sus números…

17 horas ago