Investigadores lanzan MameLoshnLM para yidis
El modelo abierto de 8B incorpora un corpus en yidis y un benchmark para evaluar lenguas de bajos recursos.
Por qué importa
El lanzamiento pone de relieve cómo los datos multilingües ruidosos a escala web pueden rendir peor en lenguas de bajos recursos. Ofrece a los investigadores un modelo, un corpus y una suite de evaluación más específicos para la tecnología lingüística en yidis.
Puntos clave
- 1.Primer modelo abierto de 8B creado específicamente para el yidis.
- 2.Oytser combina fuentes de yidis nativas de la web y literarias.
- 3.Kashes evalúa traducción, análisis, extracción y comprensión.
Investigadores presentaron MameLoshnLM, un modelo de lenguaje abierto de 8.000 millones de parámetros creado específicamente para el yidis mediante la continuación del preentrenamiento a partir de Llama 3.1 8B. El trabajo también presenta Oytser, un corpus de preentrenamiento en yidis de alta calidad, y Kashes, un benchmark multitarea que abarca traducción, análisis lingüístico, extracción de información y comprensión del lenguaje. El paper informa que MameLoshnLM supera a las bases abiertas de escala similar en todo el benchmark y capta mejor los patrones léxicos y morfológicos del yidis que los modelos multilingües de propósito general.
⚡ Pruébalo hoy
Usa Kashes para evaluar modelos capaces de trabajar con yidis antes de depender de benchmarks multilingües generales.
Fuentes y cobertura original
Este resumen sintetiza y enlaza la cobertura de los medios siguientes.
¿Te gustó este resumen? Recibe el próximo en tu correo.
Más en Investigación
Google DeepMind presenta un modelo de lengua de señas a texto
SL2T de DeepMind impulsa nuevas funciones de lengua de señas para personas sordas y con dificultades auditivas.
El equipo de MiLMMT lanza modelos de traducción sin referencias
MiLMMT-46-v1.0 usa GRPO e interpolación de checkpoints para mejorar la traducción multilingüe abierta.
DistilVDR comprime la recuperación de documentos visuales
El recuperador de 524 millones de parámetros usa destilación bilateral a partir de un modelo docente de visión-lenguaje de 8B.