LG AI Research divulga relatório do K-EXAONE 2.0
O modelo MoE multilíngue de pesos abertos tem 750 bilhões de parâmetros no total e aceita contextos de 256 mil tokens.
Por que importa
O K-EXAONE 2.0 acrescenta ao mercado mais um grande modelo multilíngue de pesos abertos, com ênfase especial em recuperação em contexto longo, codificação e segurança sociocultural coreana. O lançamento sob licença Apache 2.0 dá a pesquisadores e desenvolvedores mais margem para avaliar e adaptar sistemas MoE em escala de fronteira.
Pontos-chave
- 1.MoE de 750 bilhões de parâmetros ativa cerca de 37 bilhões de parâmetros por token.
- 2.O suporte de contexto chega a 256 mil tokens.
- 3.A licença Apache 2.0 permite ampla avaliação e adaptação.
A LG AI Research publicou um relatório técnico do K-EXAONE 2.0, um modelo-base multilíngue de pesos abertos desenvolvido a partir do K-EXAONE. O modelo usa uma arquitetura Mixture-of-Experts, com 750 bilhões de parâmetros no total e cerca de 37 bilhões ativados por token, aceita contextos de até 256 mil tokens e amplia a cobertura linguística de seis para dez idiomas. Segundo o relatório, o K-EXAONE 2.0 supera seu antecessor em nove categorias de avaliação, com os maiores avanços em codificação agentiva e compreensão de contexto longo.
⚡ Experimente hoje
Avalie o K-EXAONE 2.0 em cargas de trabalho de recuperação em contexto longo, multilíngues e de codificação antes de considerar seu uso em produção.
Fontes e reportagens originais
Este resumo sintetiza e linka a cobertura dos veículos abaixo.
Gostou deste resumo? Receba o próximo no seu e-mail.
Mais em Modelos
Meta lança modelo de IA Glimmer com pesos abertos
O modelo pode ser baixado e executado localmente, enquanto a Meta mantém o Muse Spark restrito a APIs.
Marca d'água em textos de IA volta ao centro do escrutínio
Novos materiais explicativos analisam como funcionam as marcas em textos gerados por modelos e por que reescritas podem enfraquecê-las.
Hugging Face diz que uso de modelos abertos migrou para Qwen
Relatório do Hub afirma que derivados de Qwen, modelos pequenos e tráfego de agentes moldaram a IA aberta em 2026.