Tencent выпустил крошечную модель перевода: 1.8B параметров, 440 МБ и рекордная скорость на устройствах.
Tencent Hunyuan открыли Hy-MT2 — серию моделей перевода нового поколения
Команда Tencent Hunyuan представила Hy-MT2 — мультиязычные модели перевода с архитектурами Dense и Mixture of Experts (MoE). Главная особенность не в том, что это очередная мощная модель, а в крошечной версии на 1,8 миллиарда параметров.
Эту версию сжали с помощью метода AngelSlim до представления 1,25 бита, благодаря чему модель занимает всего 440 МБ. При этом на процессоре Apple A15 она работает в 1,5 раза быстрее, чем стандартный 4-битный инференс. Теперь полноценный перевод на устройстве без ущерба для скорости или размера становится реальностью.
Разработчики заявляют следующие характеристики моделей:
- Поддержка 33 языков и 5 китайских диалектов.
- Версия 1.8B превосходит Microsoft Translate и другие коммерческие API в тесте FLORES-200.
- Версии 7B и 30B-A3B обходят DeepSeek-V4-Pro.
- Модель 7B достигает 97,9% от уровня Gemini 3.1 Pro Think.
- 30B-A3B достигает 98,6% от уровня Gemini 3.1 Pro Think.
- Все три модели демонстрируют 96–99% от метрик Gemini 3.1 Pro Think на реальных и специализированных бенчмарках.
Также Tencent открыли IFMTBench — бенчмарк для оценки того, насколько хорошо переводческие модели следуют инструкциям. Ознакомиться с моделями можно на modelscope.ai.

