RESEARCH27

Raon-Speech Technical Report

arXiv CS.CL·26 mai 2026

Raon-Speech est un modèle de langage vocal (SpeechLM) de 9 milliards de paramètres très performant pour la compréhension, la réponse et la génération de la parole en anglais et en coréen, obtenant d'excellents résultats sur 42 benchmarks. Il transforme avec succès un LLM pré-entraîné en un SpeechLM tout en préservant de solides capacités textuelles grâce à des étapes d'entraînement spécifiques.

multimodal AI Benchmarking Natural Language Processing large language models Speech Recognition

Lire l'original ↗