MiLMMT-Team veröffentlicht referenzfreie Übersetzungsmodelle
MiLMMT-46-v1.0 nutzt GRPO und Checkpoint-Interpolation, um offene mehrsprachige Übersetzung zu verbessern.
Warum es wichtig ist
Die Arbeit deutet darauf hin, dass referenzfreie Belohnungssignale mehrsprachige Übersetzung verbessern können, ohne für jedes Sprachpaar auf menschliche Referenzübersetzungen angewiesen zu sein. Zudem stellt sie Forschern offene Modelle und Code bereit, um RL-basierte Post-Training-Methoden für Übersetzung zu testen.
Die Kernpunkte
- 1.Referenzfreies GRPO verbesserte MiLMMT über 46 Sprachen hinweg.
- 2.Checkpoint-Interpolation schnitt in der Studie besser ab als On-Policy-Distillation.
- 3.Modelle und Code wurden für Forschungszwecke veröffentlicht.
Forscher haben MiLMMT-46-v1.0 veröffentlicht, eine offene Familie mehrsprachiger maschineller Übersetzungsmodelle, die auf MiLMMT-46-v0.1 aufbaut und mit referenzfreiem Post-Training weiterentwickelt wurde. Die Methode setzt GRPO ein, mit Belohnungssignalen aus zwei referenzfreien Modellen zur Qualitätsschätzung, die über Spracherkennung gesteuert werden, und interpoliert anschließend SFT- und RL-Checkpoints linear. Über 46 Sprachen hinweg verbesserten sich die Modelle gegenüber ihren SFT-Pendants, übertrafen genannte offene Baselines wie Seed-X, HY-MT2 und TranslateGemma und erzielten führende referenzfreie Werte gegenüber den evaluierten proprietären Systemen.
⚡ Heute ausprobieren
Prüfen Sie MiLMMT-46-v1.0 und den veröffentlichten Code, bevor Sie eine offene mehrsprachige Übersetzungs-Baseline auswählen.
Quellen & Originalberichte
Dieser Brief fasst die Berichterstattung der folgenden Medien zusammen und verlinkt sie.
- arXiv cs.AIWhen the API Speaks the Wrong Language: Revisiting Post-Training for Multilingual Tool UseAug 13, 12:00 PM↗
- arXiv cs.CLWhen the API Speaks the Wrong Language: Revisiting Post-Training for Multilingual Tool UseAug 13, 12:00 PM↗
- arXiv cs.AIReference-Free Post-Training of Open Large Language Models for Multilingual Machine TranslationAug 12, 12:00 PM↗
- arXiv cs.CLReference-Free Post-Training of Open Large Language Models for Multilingual Machine TranslationAug 12, 12:00 PM↗
- arXiv cs.CLReference-Free Post-Training of Open Large Language Models for Multilingual Machine TranslationAug 12, 12:00 PM↗
- arXiv cs.CLEmbedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English TranslationAug 11, 12:00 PM↗
- arXiv cs.LGEmbedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English TranslationAug 11, 12:00 PM↗
- HF Daily PapersReference-Free Post-Training of Open Large Language Models for Multilingual Machine TranslationAug 11, 4:00 AM↗
Hat dir dieses Briefing gefallen? Erhalte das nächste per Mail.
Mehr in Forschung
Forscher nehmen Lücken im räumlichen Schlussfolgern von VLMs ins Visier
Neue Arbeiten schlagen Speicher, RL und Benchmarks für räumliche Intelligenz in Vision-Language-Systemen vor.
Neue Studien untersuchen räumliche Intelligenz in Vision AI
SpaRRTa, SMA und PinpointQA testen oder verbessern räumliches Schlussfolgern für visuelle und verkörperte KI-Systeme.
CW-BASS v2 zielt mit DINOv2 auf die Auswahl von Pseudo-Labels
Die Methode passt das Filtern für semi-supervisierte Segmentierung unter Foundation-Model-Teachers an.