La unidad de investigación de IA de Tether acaba de lanzar algo que no tiene nada que ver con stablecoins y todo que ver con el hecho de que la mayoría de los idiomas del mundo son esencialmente invisibles para la IA moderna. La empresa lanzó una familia de modelos de traducción automática neural de código abierto llamada TranslatePsy-AfriSLM, que cubre 19 idiomas del África subsahariana con un conjunto de datos de aproximadamente 215 millones de ejemplos de entrenamiento bidireccionales emparejados con inglés.
Los modelos son diminutos. Hablamos de 21 a 35 MB por par de idiomas, lo suficientemente pequeños como para ejecutarse directamente en un teléfono sin necesidad de comunicarse con ningún servidor. Ese es el objetivo: traducción que funciona sin conexión, mantiene los datos privados y no requiere la clase de infraestructura en la nube que rara vez existe en las regiones donde realmente se hablan estos idiomas.
Lo que realmente construyó Tether
El proyecto, desarrollado por la división QVAC de Tether, incluye tanto el conjunto de datos como los propios modelos de traducción. El conjunto de datos, llamado TranslatePsy-AfriSLM-Synthetic-Mix, está alojado en Hugging Face bajo una licencia CC BY-NC 4.0, lo que significa que los investigadores y desarrolladores pueden usarlo libremente con fines no comerciales.
Los idiomas cubiertos incluyen suajili, yoruba y amárico, entre un total de 19 idiomas del África subsahariana.
Los modelos están diseñados para ser compatibles con Bergamot, lo cual es importante porque Bergamot es el motor de traducción de código abierto que Mozilla utiliza en la función de traducción integrada de Firefox. La compatibilidad con ese ecosistema significa que estos modelos pueden integrarse en la infraestructura existente sin que los desarrolladores necesiten reconstruir desde cero.
La velocidad es el otro número destacado. Los modelos procesan una oración en aproximadamente 46 milisegundos, lo que, según QVAC, los hace hasta 78 veces más rápidos que modelos más grandes como Salamandra-2B.
El SDK de QVAC y la cobertura de idiomas europeos
Junto con los modelos de lenguaje africano, Tether lanzó el QVAC SDK, un kit de desarrollo de software que integra diversos modelos de IA en un marco de despliegue unificado. El soporte para idiomas europeos se proporciona a través de este SDK, en lugar de mediante conjuntos de datos dedicados separados, ofreciendo a los desarrolladores un único punto de integración para la traducción multilingüe.
Según la documentación de QVAC, el SDK puede ampliar la cobertura a docenas e incluso cientos de idiomas utilizando aproximadamente 50 pares de idiomas para cubrir 26 idiomas.
El artículo de investigación adjunto ha sido enviado a EMNLP 2026 y está disponible en arXiv (arXiv:2608.18655). El código y los modelos están documentados en GitHub bajo la organización de investigación de IA de Tether en tether-ai-research/qvac-translatepsy-afri-slm.
¿Por qué una empresa de stablecoins está desarrollando una IA de traducción
La stablecoin de Tether experimenta una adopción masiva en África, Sudeste Asiático y América Latina, regiones donde las monedas locales son volátiles, la infraestructura bancaria es limitada y donde se hablan muchos de los idiomas de bajos recursos del mundo. Desarrollar herramientas de IA que funcionen en esos idiomas, en dispositivos comunes en esos mercados y sin requerir conexiones a internet constantes es una estrategia que refuerza la presencia de Tether precisamente en las comunidades donde su stablecoin ya tiene aceptación.
Al liberar todo bajo licencias permisivas y someter la investigación a revisión académica, Tether está posicionando a QVAC como una entidad legítima de investigación en IA. Si esta percepción persistirá dependerá de si los modelos realmente funcionan bien en implementaciones del mundo real, algo que la comunidad de investigación en NLP evaluará ahora que los pesos están disponibles públicamente.

