माइक्रोसॉफ्ट ने उच्च समानांतरता और कम लागत वाले AI इमेज जनरेशन के लिए हल्के MAI-Image-2.6-Flash को लॉन्च किया

iconMetaEra
साझा करें
AI summary iconसारांश
माइक्रोसॉफ्ट ने MAI-Image-2.6-Flash लॉन्च किया है, एक हल्का AI इमेज जनरेशन मॉडल जो अब Microsoft Foundry के माध्यम से उपलब्ध है। यह मॉडल GPT-Image-2-Medium की तुलना में 2.8x तेजी से जनरेशन प्रदान करता है और 72% अधिक कुशलता देता है। यह उच्च-सटीक टेक्स्ट-टू-इमेज और ऑब्जेक्ट-लेवल एडिटिंग का समर्थन करता है, साथ ही लेटेंसी और लागत में कमी करता है। फ्लैश संस्करण में पाँच रेफरेंस इमेजेस, बिंग सर्च एकीकरण और डायनामिक एस्पेक्ट रेशियो का समर्थन जोड़ा गया है। कीमत में 50% से अधिक की कमी हुई है, जिसमें टेक्स्ट इनपुट $1.75, इमेज इनपुट $2.50, और इमेज आउटपुट $19 प्रति मिलियन टोकन है। यह AI + क्रिप्टो समाचार अपडेट डेवलपर्स और ट्रेडर्स के लिए लागत-प्रभावी इमेज जनरेशन में एक प्रमुख परिवर्तन को दर्शाता है।
गति और कीमत को एक साथ प्राप्त करना, जनरेटिव इमेज मॉडल की प्रतिस्पर्धा का एक नया क्षेत्र बन रहा है।

लेखक, स्रोत: AIBase

प्रकाशन का पृष्ठभूमि

माइक्रोसॉफ्ट ने सितंबर में अपने स्वयं विकसित इमेज जनरेशन मॉडल का हल्का संस्करण MAI-Image-2.6-Flash लॉन्च किया है, और इसे Microsoft Foundry के माध्यम से सार्वजनिक प्रीव्यू के लिए उपलब्ध करा दिया गया है। पिछले महीने टेक्निकल रैंकिंग में शीर्ष पर पहुंचे MAI-Image-2.6 के उच्च दक्षता वाले संस्करण के रूप में, इस मॉडल का लॉन्च माइक्रोसॉफ्ट द्वारा AI इमेज जनरेशन क्षेत्र में हाई-कंकरेंसी, लो-लेटेंसी और कॉस्ट-सेंसिटिव इंडस्ट्रियल एप्लीकेशन्स के लिए समग्र रणनीति की शुरुआत को दर्शाता है।

Performance

टेस्ट डेटा के अनुसार, MAI-Image-2.6-Flash की छवि उत्पादन गति GPT-Image-2-Medium की तुलना में 2.8 गुना है, और कुल समग्र कार्यक्षमता में 72% की वृद्धि हुई है। निष्कर्षण लेटेंसी और कैलकुलेशन ओवरहेड को बहुत कम करते हुए, यह संस्करण मुख्य मॉडल की मूल उत्पादन और संपादन क्षमताओं को पूरी तरह से विरासत में प्राप्त करता है, जो उच्च सटीकता के साथ टेक्स्ट-टू-इमेज जनरेशन और स्थानीय ऑब्जेक्ट-लेवल इमेज एडिटिंग को सपोर्ट करता है।

आर्किटेक्चर अपग्रेड

इसके अलावा, MAI-Image-2.6 श्रृंखला ने एकाधिक चित्रों के लिए किरदारों और उत्पादों की सुसंगठितता सुनिश्चित करने के लिए अधिकतम 5 रेफरेंस इमेजेज का समर्थन, वास्तविक दुनिया की छवि सूचनाओं को पूरक करने के लिए बिंग सर्च के साथ नेटवर्क लोकेशन फीचर का एकीकरण, और डायनामिक अनुपात और उच्चतर रिज़ॉल्यूशन आउटपुट के लिए मूल समर्थन जोड़ा।

व्यावसायिक मूल्य निर्धारण रणनीति पर, फ्लैश संस्करण टेक्स्ट इनपुट, इमेज इनपुट और इमेज आउटपुट के प्रति मिलियन टोकन की कीमत क्रमशः 1.75 डॉलर, 2.50 डॉलर और 19 डॉलर तक घटा देता है, जो मुख्य मॉडल की तुलना में 50% से अधिक की महत्वपूर्ण लागत कमी प्राप्त करता है।

माइक्रोसॉफ्ट द्वारा सुझाव दिया गया है कि मुख्य मॉडल का उपयोग उच्च गुणवत्ता वाले ग्राफिक्स और टेक्स्ट रेंडरिंग की आवश्यकता वाले व्यावसायिक डिजाइन और अंतिम उत्पादन संपत्तियों के लिए किया जाए, जबकि फ्लैश संस्करण को इंटरैक्टिव एप्लिकेशन, त्वरित क्रिएटिव इटरेशन और बड़े पैमाने पर स्वचालित प्रक्रियाओं के लिए सटीक रूप से लक्षित किया जाए। चरम प्रदर्शन और चरम कीमत-प्रदर्शन दोनों को संतुलित करने वाली इस बहु-मोडल मॉडल मैट्रिक्स, वर्तमान में जनरेटिव AI की एकल तकनीकी क्रांति से उच्च थ्रूपुट, कम लागत वाले इंजीनियरिंग लागूकरण की ओर बढ़ने की उद्योग की प्रवृत्ति को दर्शाती है।

डिस्क्लेमर: इस पेज पर दी गई जानकारी थर्ड पार्टीज़ से प्राप्त की गई हो सकती है और यह जरूरी नहीं कि KuCoin के विचारों या राय को दर्शाती हो। यह सामग्री केवल सामान्य सूचनात्मक उद्देश्यों के लिए प्रदान की गई है, किसी भी प्रकार के प्रस्तुतीकरण या वारंटी के बिना, न ही इसे वित्तीय या निवेश सलाह के रूप में माना जाएगा। KuCoin किसी भी त्रुटि या चूक के लिए या इस जानकारी के इस्तेमाल से होने वाले किसी भी नतीजे के लिए उत्तरदायी नहीं होगा। डिजिटल संपत्तियों में निवेश जोखिम भरा हो सकता है। कृपया अपनी वित्तीय परिस्थितियों के आधार पर किसी प्रोडक्ट के जोखिमों और अपनी जोखिम सहनशीलता का सावधानीपूर्वक मूल्यांकन करें। अधिक जानकारी के लिए, कृपया हमारे उपयोग के नियम और जोखिम प्रकटीकरण देखें।