Le 17 juillet, Moonshot AI a lancé le grand modèle Kimi K3, doté de 2,8 billions de paramètres, une fenêtre de contexte de 1 million de tokens et une compréhension visuelle native, intégrant l'algorithme d'attention KDA développé en interne. Musk a immédiatement commenté : « Impressionnant », mais il a annoncé le lendemain que xAI formait un nouveau modèle de 2 billions de paramètres visant à dépasser Kimi. Face à ce défi, Moonshot AI a répondu avec humour : « Bienvenue dans le club des 2 billions + », soulignant son avance précoce avec ses 2,8 billions de paramètres. Cette interaction à distance met en lumière la bataille technologique entre ces deux entreprises d'IA et reflète l'émergence de la puissance chinoise dans la compétition mondiale des grands modèles.Auteur et source de l'article : Wall Street Journal
Le 17 juillet à minuit, Moonshot a officiellement lancé son nouveau modèle de grande taille, Kimi K3. Ce modèle possède une échelle de 2,8 billions de paramètres, une fenêtre de contexte de 1 million de tokens et prend en charge nativement la compréhension visuelle. Moonshot le qualifie de « modèle le plus puissant à ce jour ».

Plusieurs classements internationaux d'évaluation d'IA indiquent que Kimi K3 se classe parmi les meilleurs dans les tests de génération de code, de raisonnement logique sur de longs textes et de traitement de plusieurs documents. Selon les informations officielles, Kimi K3 intègre l'algorithme d'attention KDA développé en interne, dispose de 896 modules experts indépendants et active 16 unités lors d'un seul calcul, ce qui améliore l'efficacité d'utilisation des ressources de calcul de 2,5 fois par rapport à la génération précédente. L'entreprise prévoit de publier intégralement les poids du modèle Kimi K3 en open source le 27 juillet, en ouvrant les droits commerciaux à tous les développeurs du monde entier.
Le jour de la publication des articles concernant Kimi K3, Musk a laissé un commentaire sur la section des commentaires, qualifiant le modèle de « impressionnant ».
C'est la deuxième fois cette année que Musk affirme publiquement les compétences techniques de l'équipe Kimi. En mars, Moonshot AI a publié l'article « Attention Residuals », qui introduit un mécanisme de « résidus d'attention » destiné à remplacer les connexions résiduelles dans les architectures Transformer traditionnelles afin de résoudre le problème de dilution de l'information dans les réseaux profonds.
À l'époque, Musk a partagé cet article sur X et a commenté : « Le travail de Kimi est impressionnant ». En réponse, l'équipe officielle de Moonshot AI a ironiquement répliqué : « Tu as aussi fait un très bon fusée ! » Cette interaction à distance a été perçue comme un signe d'admiration mutuelle entre des experts de haut niveau, ouvrant la voie à des échanges futurs constructifs.
Cependant, peu après avoir exprimé son appréciation pour Kimi K3, Musk a commencé à lancer des déclarations fermes à distance, démontrant la compétitivité de ses produits.
Le 18 juillet, Musk a publié un message sur la plateforme sociale X, révélant le plan de développement de xAI : le modèle de grande taille Grok 4.6, actuellement entraîné avec 2 000 milliards de paramètres, devrait terminer sa première session d'entraînement complète dans la semaine. La nouvelle version offre des performances supérieures à celles de Grok 4.5, qui compte 1 500 milliards de paramètres. Musk mentionne dans son message que ce modèle a le potentiel de dépasser les performances de Kimi.
Musk a fondé l'entreprise d'IA xAI en 2023 ; les membres de l'équipe proviennent principalement d'OpenAI, de Google DeepMind, de Meta, etc. Le développement de la série de grands modèles Grok a été lancé en parallèle, avec une intégration approfondie dans l'écosystème de la plateforme sociale X, de Tesla et de SpaceX.
En août 2023, xAI a terminé l'entraînement du modèle de base de première génération, Grok-0, avec 33 milliards de paramètres ; le 5 novembre de la même année, la première version de Grok destinée aux utilisateurs a été officiellement lancée, intégrée au système Premium + abonnement payant de la plateforme X, permettant d'accéder en ligne au flux d'informations en temps réel de X, avec un style de conversation dépourvu de contraintes excessives.
En mars 2024, xAI a lancé Grok-1, un modèle de 314 milliards de paramètres, dont les poids complets ont été open-sourcés sous la licence Apache 2.0 ; le même mois, une mise à jour a été publiée avec Grok-1.5, étendant la fenêtre de contexte à 128K tokens et optimisant les capacités d'inférence pour les textes longs ; en avril, Grok-1.5V a été déployé, ajoutant la capacité de traitement d'images. En août de la même année, la version multimodale Grok 2 a été lancée, accompagnée de la version allégée Grok 2 mini, couvrant les scénarios de conversation générale, d'écriture de code et d'analyse image-texte ; simultanément, xAI a mis en service son propre supercalculateur Colossus pour l'entraînement des modèles.
En février 2025, xAI a lancé Grok 3, formé avec une puissance de calcul de 100 000 puces NVIDIA H100 ; l'entreprise a révélé une amélioration significative des performances d'inférence et multimodales. En juillet, Grok 4 a été introduit, disponible en version standard et en version Grok 4 Heavy multi-agents, avec une fenêtre de contexte maximale de 256K, ainsi que de nouvelles fonctionnalités d'interaction vocale à plusieurs voix et une capacité de compréhension de base des vidéos. Le plan initial de la version Grok 3.5 a été annulé, et sa feuille de route technique a été intégrée à la série Grok 4.
En 2026, Grok entre dans la phase de développement de modèles à mille milliards de paramètres. En mai, xAI a terminé l'entraînement du modèle de base V9-Medium de 1,5 billion de paramètres, en intégrant des données industrielles de l'outil de code Cursor, avec une accentuation sur l'optimisation pour les scénarios de programmation technique ; le 28 juin, Grok 4.5, basé sur ce modèle de base, a lancé un test interne fermé chez Tesla et SpaceX, et le 8 juillet, le service d'API a été ouvert à tous les développeurs et utilisateurs payants.
Face à la « déclaration de guerre » à distance de Musk, le compte officiel Weibo de Moonshot, « Moonshot Kimi », a directement mentionné @ElonMusk et publié : « Bienvenue dans le club des 2 000 milliards + ». Cette réponse concise de Moonshot utilise le terme « club » pour afficher une posture d'ouverture à la concurrence, tout en sous-entendant que Kimi K3 possède déjà 2,8 billions de paramètres, mettant clairement en avant son avance pionnière. Un internaute a commenté : « Lorsque Musk dit qu’il pourrait dépasser Kimi, le gagnant est déjà Kimi. »
Ce « appel à distance » reflète également l'évolution du paysage concurrentiel mondial de l'IA. Initialement, les références technologiques pour les grands modèles étaient longtemps dominées par des entreprises de la Silicon Valley comme OpenAI et Anthropic, mais ces deux dernières années, des grands modèles nationaux tels que DeepSeek, GLM et Kimi ont continué à se mettre à jour et à se hisser au cœur de la compétition technologique mondiale.
Les informations publiques indiquent que l'entité commerciale de Moon Shadow est Beijing Moon Shadow Technology Co., Ltd., avec pour nom de marque à l'étranger Moonshot AI, enregistrée à Pékin en 2023. Le représentant légal et PDG est Yang Zhilin. Yang Zhilin détient un diplôme de licence de l'Université Tsinghua et un doctorat en informatique de l'Université Carnegie Mellon. Il est l'un des principaux inventeurs des deux cadres de pré-entraînement classiques Transformer-XL et XLNet, et a précédemment travaillé dans les départements de recherche en intelligence artificielle de Google Brain et Meta AI.
Après sa création, l'entreprise a successivement réalisé plusieurs rounds de financement importants, avec des investisseurs tels que Alibaba, Tencent, Meituan Dragon Boat, Sequoia China et Gao榕 Capital.
En octobre 2023, Moonshot a lancé son premier assistant intelligent grand public, Kimi Chat, ainsi que son premier modèle de base avec un contexte de 8K, accompagné de la fonction de lecture de textes ultra-longs de 200 000 caractères chinois ; en janvier 2025, l'entreprise a publié le modèle de base K1.5, avec des améliorations en calcul mathématique, génération de code et raisonnement multimodal ; en avril de la même année, elle a open-sourcé le modèle multimodal Kimi-VL de 16 milliards de paramètres ; en juillet, elle a lancé la série de modèles de base K2 à architecture mixte d'experts avec un trillion de paramètres, offrant une fenêtre de contexte de 256K tokens et l'ayant également open-sourcée. En janvier 2026, Moonshot a publié le modèle multimodal open-source K2.5, intégrant des capacités visuelles, de code et d'agent, tout en lançant simultanément l'outil de programmation Kimi Code ; le 17 juillet, elle a officiellement lancé son modèle de base phare actuel, Kimi K3.
Le 17 juillet, Moonshot AI a lancé le grand modèle Kimi K3, doté de 2,8 billions de paramètres, une fenêtre de contexte de 1 million de tokens et une compréhension visuelle native, intégrant l'algorithme d'attention KDA développé en interne. Musk a immédiatement commenté : « Impressionnant », mais il a annoncé le lendemain que xAI formait un nouveau modèle de 2 billions de paramètres visant à dépasser Kimi. Face à ce défi, Moonshot AI a répondu avec humour : « Bienvenue dans le club des 2 billions + », soulignant son avance précoce avec ses 2,8 billions de paramètres. Cette interaction à distance met en lumière la bataille technologique entre ces deux entreprises d'IA et reflète l'émergence de la puissance chinoise dans la compétition mondiale des grands modèles.Source : Jiemian News
