AAI News Hub
InvestigaciónTue, August 4, 2026·Aug 42 sources corroborating

Investigadores apuntan a la ineficiencia de MoE en modelos de lenguaje de difusión

Nuevos artículos proponen ajustes de enrutamiento y asignación de cómputo mientras LLaDA MoE v2 prueba el escalado.

Por qué importa

El trabajo sugiere que las técnicas MoE de los LLM autoregresivos no se trasladan limpiamente a los modelos de lenguaje de difusión. Un mejor enrutamiento y una mejor asignación de cómputo podrían hacer que los modelos de generación de texto en paralelo sean más prácticos para casos de uso de alto rendimiento o sensibles a la latencia.

Puntos clave

  • 1.Los LMs de difusión MoE enfrentan un desajuste entre las demandas de eliminación de ruido y presupuestos fijos de expertos.
  • 2.REFLEX reasigna el cómputo de inferencia sin reentrenar ni sustituir el router predeterminado.
  • 3.LLaDA MoE v2 informa resultados de escalado para un modelo diffusion MoE 30B-A3B.

Varios artículos nuevos y actualizados examinan cómo deberían adaptarse los sistemas mixture-of-experts a los modelos de lenguaje de difusión, que generan texto mediante eliminación iterativa de ruido en lugar de decodificación autoregresiva. REFLEX propone un método de inferencia sin entrenamiento que reasigna el cómputo de expertos en torno a los estados de refinamiento de tokens, manteniendo sin cambios el router predeterminado. Trabajos relacionados sostienen que el enrutamiento expert-choice, la capacidad dependiente del timestep y la activación de expertos guiada por consistencia pueden mejorar el balanceo de carga, la convergencia o la eficiencia de inferencia, mientras LLaDA MoE v2 presenta hallazgos de escalado de un modelo diffusion MoE 30B-A3B entrenado con 23,5T tokens.

Pruébalo hoy

Si evalúas LMs de difusión, mide las estrategias de enrutamiento y asignación de expertos por separado de los supuestos de MoE autoregresivos.

Fuentes y cobertura original

Este resumen sintetiza y enlaza la cobertura de los medios siguientes.

¿Te gustó este resumen? Recibe el próximo en tu correo.

Más en Investigación