Selon les nouvelles de ME, le 17 avril (UTC+8), selon les données de Beating, PrismML a lancé la série de modèles linguistiques Ternary Bonsai, utilisant la technologie de 1,58 bit (poids ternaires) pour réduire la consommation de mémoire GPU à un neuvième de celle des modèles de 16 bits, tout en conservant des performances élevées. La série comprend trois tailles de paramètres : 8B, 4B et 1,7B, et est désormais open source sur Hugging Face, avec une prise en charge native sur les appareils Apple. Un modèle de 1,58 bit signifie que les poids du réseau neuronal sont limités aux trois valeurs {-1, 0, +1}. Contrairement aux modèles de 1 bit précédents, qui ne permettaient que {-1, +1} pour une compression extrême, l’introduction de la valeur « 0 » permet d’éliminer efficacement les connexions redondantes, conservant ainsi une capacité d’inférence complexe malgré un volume extrêmement réduit. Le fichier de poids Ternary Bonsai 8B ne pèse que 1,75 Go et obtient une moyenne de 75,5 sur les tests de référence, dépassant de 5 points la version de 1 bit de l’entreprise et surpassant largement en « densité intelligente » (performance par Go de mémoire GPU) des modèles denses similaires comme Qwen3. L’efficacité énergétique et la vitesse d’exécution constituent un autre avantage central de cette série. Sur l’iPhone 17 Pro Max, la version 8B atteint une vitesse de 27 tok/s, avec une amélioration d’environ 3 à 4 fois de l’efficacité énergétique. Pour les développeurs qui doivent déployer des IA hautes performances sur des appareils embarqués tels que des téléphones ou des ordinateurs portables, cela signifie qu’ils peuvent obtenir des performances proches de celles des modèles à pleine précision avec un coût mémoire minimal. Actuellement, les modèles Ternary Bonsai sont pris en charge nativement sur les appareils Apple via le framework MLX. Les poids des modèles sont distribués sous licence Apache 2.0. (Source : BlockBeats)
PrismML lance le modèle ternaire Bonsai 1,58-bit avec 9 fois moins de paramètres et une intelligence supérieure
KuCoinFlashPartager
Les données on-chain montrent que PrismML a lancé le modèle Ternary Bonsai de 1,58 bit le 17 avril, réduisant l'utilisation de la mémoire à un neuvième de celle des modèles 16-bit. La version 8B fonctionne à 27 tok/s sur l'iPhone 17 Pro Max et obtient un score de 75,5 sur les benchmarks. Disponible sur Hugging Face, le modèle prend en charge les appareils Apple et est open-source sous licence Apache 2.0. Les observateurs du marché notent que ce lancement pourrait influencer l'indice de peur et de cupidité à mesure que l'adoption de l'IA légère augmente.
Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.