A unidade de pesquisa em IA da Tether acaba de lançar algo que não tem nada a ver com stablecoins e tudo a ver com o fato de que a maioria das línguas do mundo é essencialmente invisível para a IA moderna. A empresa lançou uma família de modelos de tradução automática neural de código aberto chamada TranslatePsy-AfriSLM, cobrindo 19 línguas da África Subsaariana com um conjunto de dados de aproximadamente 215 milhões de exemplos de treinamento bidirecionais emparelhados com o inglês.
Os modelos são minúsculos. Estamos falando de 21 a 35 MB por par de idiomas, pequenos o suficiente para serem executados diretamente em um telefone sem jamais se conectar a um servidor. Esse é o ponto: tradução que funciona off-line, mantém os dados privados e não exige a infraestrutura em nuvem que raramente existe nas regiões onde esses idiomas são realmente falados.
O que o Tether realmente construiu
O projeto, desenvolvido pela divisão QVAC da Tether, inclui tanto o conjunto de dados quanto os próprios modelos de tradução. O conjunto de dados, chamado TranslatePsy-AfriSLM-Synthetic-Mix, está hospedado no Hugging Face sob licença CC BY-NC 4.0, o que significa que pesquisadores e desenvolvedores podem usá-lo livremente para fins não comerciais.
Os idiomas cobertos incluem suahili, iorubá e amárico, entre um total de 19 línguas da África Subsaariana.
Os modelos são construídos para serem compatíveis com o Bergamot, o que é importante porque o Bergamot é o mecanismo de tradução de código aberto que o Mozilla utiliza no recurso de tradução integrado do Firefox. A compatibilidade com esse ecossistema significa que esses modelos podem ser integrados à infraestrutura existente sem que os desenvolvedores precisem reconstruir do zero.
A velocidade é o outro número-chave. Os modelos processam uma frase em aproximadamente 46 milissegundos, o que, segundo a QVAC, os torna até 78 vezes mais rápidos que modelos maiores como o Salamandra-2B.
O SDK QVAC e a cobertura de idiomas europeus
Juntamente com os modelos de linguagem africanos, a Tether lançou o QVAC SDK, um kit de desenvolvimento de software que agrupa diversos modelos de IA em um framework de implantação unificado. O suporte a idiomas europeus é fornecido por meio desse SDK, e não por conjuntos de dados dedicados separados, oferecendo aos desenvolvedores um único ponto de integração para tradução multilíngue.
De acordo com a documentação do QVAC, o SDK pode expandir a cobertura para dezenas ou até centenas de idiomas usando aproximadamente 50 pares de idiomas para cobrir 26 idiomas.
O artigo de pesquisa acompanhante foi submetido ao EMNLP 2026 e está disponível no arXiv (arXiv:2608.18655). O código e os modelos estão documentados no GitHub sob a organização de pesquisa em IA da Tether em tether-ai-research/qvac-translatepsy-afri-slm.
Por que uma empresa de stablecoin está desenvolvendo IA de tradução
A stablecoin da Tether experimenta grande adoção na África, Sudeste Asiático e América Latina, regiões onde as moedas locais são voláteis, a infraestrutura bancária é limitada e onde muitas das línguas de baixo recurso do mundo são faladas. Desenvolver ferramentas de IA que funcionem nesses idiomas, em dispositivos comuns nesses mercados e sem exigir conexão à internet contínua é uma estratégia que reforça a presença da Tether exatamente nas comunidades onde sua stablecoin já tem adesão.
Ao liberar tudo sob licenças permissivas e submeter a pesquisa para revisão acadêmica, a Tether está posicionando o QVAC como uma entidade legítima de pesquisa em IA. Se essa percepção persistirá dependerá de os modelos realmente apresentarem bom desempenho em implementações do mundo real, algo que a comunidade de pesquisa em PNL testará agora que os pesos estão públicos.

