Tencent ha abierto el código de Hy-MT2, una familia de modelos de traducción automática pensada para funcionar en escenarios reales. Lo interesante no es solo la calidad, sino que incluye un modelo de 1.8B parámetros que puede ejecutarse directamente en tu dispositivo.
Gracias a la cuantización extrema de 1,25 bits con AngelSlim, ese modelo de 1.8B ocupa apenas 440 MB y corre hasta 1,5× más rápido. Sin nube, sin API keys, sin límites de uso.
Por qué esto importa en local:
- 🔒 Privacidad total. Tus textos nunca salen del equipo. Ideal para documentación legal, médica o interna de empresa.
- ✈️ Funciona offline. Avión, sótano, red corporativa restringida… da igual.
- 💸 Coste cero por token. Nada de facturación por volumen ni sorpresas de final de mes.
- ⚡ Latencia mínima. Sin ida y vuelta al servidor; la respuesta es inmediata.
- 🛠️ Integrable donde quieras. GGUF para llama.cpp, FP8, vLLM, SGLang y hasta pipeline de fine-tuning (LoRA incluido).
¿Qué traduce? 33 idiomas, del chino al catalán… bueno, euskera no, pero sí árabe, hindi, ucraniano, tibetano, cantonés y compañía. Y soporta instrucciones afinadas: glosarios de terminología, estilo concreto, preservación de placeholders, etiquetas HTML/JSON y separadores intactos. Eso último es oro para quien traduce archivos de apps.
En benchmarks, el 1.8B supera por término medio a APIs comerciales como las de Microsoft o Doubao, y los tamaños 7B y 30B-A3B (MoE) dejan atrás a otros abiertos tipo DeepSeek o Kimi.
📦 Todo en GitHub + HuggingFace, con licencia abierta y un benchmark propio (IFMTBench) para medir seguimiento de instrucciones.
Si llevabas tiempo queriendo un traductor serio en local sin comprar un A100, este es el momento de probarlo.
🐱 https://github.com/Tencent-Hunyuan/Hy-MT2
@todoIA