Escuchar "Latxa, la inteligencia artificial generativa vasca entrenada con datos en euskera"
Síntesis del Episodio
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
Más episodios del podcast Enrique Rodal
La alimentación del futuro
29/09/2025
ZARZA Somos ZARZA, la firma de prestigio que esta detras de los grandes proyectos en tecnología de la información.