La startup d'inférence IA Wafer conclut un tour de financement Série A de 40 millions de dollars, avec une évaluation dépassant 200 millions de dollars.

icon MarsBit
Partager
AI summary iconRésumé
Le média d'actualités AI + crypto MarsBit rapporte que la startup d'inférence AI Wafer a levé 40 millions de dollars lors d'une série A, faisant passer sa valorisation au-delà de 200 millions de dollars. Avec seulement 8 employés, l'entreprise a atteint 8 millions de dollars de revenus annuels récurrents en trois mois. Elle utilise des agents IA pour optimiser les puces existantes afin d'exécuter plus rapidement et à moindre coût des modèles sur du matériel comme NVIDIA et AMD. Les tests ont montré que GLM 5.2 sur AMD MI355X atteignait 80 % du débit du NVIDIA B200 à moitié prix. Les clients incluent Vercel et Inworld AI. Vercel a confirmé que le débit de GLM 5.2 de Wafer était deux fois supérieur à celui des autres fournisseurs serverless. Les nouvelles concernant le financement du projet indiquent que l'entreprise recrute actuellement dans les domaines de la technologie, de la croissance, du bureau du PDG et des fonctions GTM à San Francisco.

Découverte Beating AI : la startup d'IA Wafer, composée de seulement 8 personnes, a levé 40 millions de dollars en série A, avec une valorisation dépassant 200 millions de dollars. L'entreprise a précédemment refusé plusieurs offres d'acquisition de fournisseurs de cloud et de services d'inférence. Le chiffre d'affaires annuel récurrent (ARR) de l'activité d'inférence de Wafer a atteint 8 millions de dollars en seulement trois mois. Elle ne fabrique pas de puces, mais aide les modèles à fonctionner plus rapidement et à moindre coût sur les puces existantes. Wafer permet aux agents IA d'ajuster automatiquement les modèles, les moteurs d'inférence, les noyaux, les caches, la quantification et l'ordonnancement, puis trouve la solution optimale pour différents matériels tels que NVIDIA et AMD. Autrefois, ces tâches nécessitaient des ingénieurs en performance d'inférence pour des réglages manuels ; Wafer souhaite automatiser cette partie grâce à l'IA. Dans ses tests internes, GLM 5.2 exécuté sur AMD MI355X atteint environ 80 % du débit du NVIDIA B200, à moins de la moitié du coût. Les clients actuels incluent Vercel et Inworld AI. Vercel a également publié indépendamment des tests indiquant que le débit de GLM 5.2 sur Wafer est environ deux fois supérieur à celui d'autres fournisseurs Serverless. Après cette levée de fonds, Wafer a immédiatement lancé un recrutement massif. Elle propose actuellement quatre postes : technique, croissance, bureau du PDG et GTM, tous exigeant une présence en personne cinq jours par semaine à San Francisco. Le salaire de base pour les postes techniques s'élève à 250 000 dollars, auxquels s'ajoutent des actions.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.