Forscher veröffentlichen MameLoshnLM für Jiddisch
Das quelloffene 8B-Modell ergänzt ein jiddisches Korpus und einen Benchmark zur Bewertung ressourcenarmer Sprachen.
Warum es wichtig ist
Die Veröffentlichung zeigt, dass verrauschte mehrsprachige Daten im Webmaßstab bei ressourcenarmen Sprachen schwächer abschneiden können. Sie gibt Forschern ein gezielteres Modell, Korpus und Evaluationspaket für jiddische Sprachtechnologie an die Hand.
Die Kernpunkte
- 1.Erstes quelloffenes 8B-Modell, das speziell für Jiddisch entwickelt wurde.
- 2.Oytser kombiniert webnative und literarische jiddische Quellen.
- 3.Kashes testet Übersetzung, Analyse, Extraktion und Verständnis.
Forscher haben MameLoshnLM vorgestellt, ein quelloffenes Sprachmodell mit 8 Milliarden Parametern, das speziell für Jiddisch entwickelt wurde, indem das Pretraining von Llama 3.1 8B fortgesetzt wurde. Die Arbeit führt außerdem Oytser ein, ein hochwertiges jiddisches Pretraining-Korpus, sowie Kashes, einen Multi-Task-Benchmark für Übersetzung, linguistische Analyse, Informationsextraktion und Sprachverständnis. Dem Paper zufolge übertrifft MameLoshnLM offene Baselines ähnlicher Größe über den Benchmark hinweg und erfasst jiddische lexikalische und morphologische Muster besser als allgemeine mehrsprachige Modelle.
⚡ Heute ausprobieren
Nutzen Sie Kashes, um jiddischfähige Modelle zu evaluieren, bevor Sie sich auf allgemeine mehrsprachige Benchmarks verlassen.
Quellen & Originalberichte
Dieser Brief fasst die Berichterstattung der folgenden Medien zusammen und verlinkt sie.
Hat dir dieses Briefing gefallen? Erhalte das nächste per Mail.
Mehr in Forschung
MiLMMT-Team veröffentlicht referenzfreie Übersetzungsmodelle
MiLMMT-46-v1.0 nutzt GRPO und Checkpoint-Interpolation, um offene mehrsprachige Übersetzung zu verbessern.
DistilVDR komprimiert die visuelle Dokumentensuche
Der Retriever mit 524 Millionen Parametern nutzt bilaterale Destillation von einem 8B-Vision-Language-Lehrmodell.
Google testet AMIE für medizinische Videokonsultationen in Echtzeit
Das auf Gemini basierende Forschungssystem wurde in simulierten Telemedizin-Konsultationen evaluiert.