अलीबाबा का Qwen3 Max 2.4 ट्रिलियन पैरामीटर वाला मॉडल है जो Anthropic और OpenAI के सर्वश्रेष्ठ मॉडल्स के समकक्ष है
चीन की सबसे बड़ी टेक कंपनी ने एक मुफ्त, खुले-वजन वाला AI मॉडल जारी किया है जो Anthropic के प्रमुख मॉडल के साथ अधिकांश परीक्षाओं में मेल खाता है। वजन अगले सप्ताह उपलब्ध होंगे।

मुख्य बिंदु
- अलीबाबा ने सोमवार को Qwen3-Max जारी किया, इसे कंपनी द्वारा अब तक बनाया गया सबसे सक्षम AI मॉडल कहते हुए।
- इस मॉडल में 2.4 ट्रिलियन पैरामीटर हैं, ये संख्यात्मक सेटिंग्स हैं जो AI प्रशिक्षण के दौरान सीखता है और जो इसके सोचने और प्रतिक्रिया देने के तरीके को आकार देते हैं।
- Arena.AI पर, एक भीड़-निर्मित रैंकिंग साइट जहां वास्तविक उपयोगकर्ता मॉडल्स की आमने-सामने तुलना करते हैं, Qwen3-Max केवल Anthropic के Claude Fable 5 और तीन Claude Opus वेरिएंट्स के पीछे है।
- अलीबाबा मॉडल के वजन जारी करेगा, जो आंतरिक संख्यात्मक मूल्य हैं जो विकासकर्ताओं को AI को स्वयं चलाने या संशोधित करने देते हैं, अगले सप्ताह जनता को।
- यह रिलीज चीनी और अमेरिकी AI प्रयोगशालाओं के बीच तेजी से आगे-पीछे को तीव्र करता है, कई प्रमुख चीनी मॉडल्स एक ही सप्ताह में जारी हो रहे हैं।
अलीबाबा ने अभी अपने सबसे बड़े AI मॉडल को जो कोई भी चाहे उसके हाथों में दे दिया है। मॉडल को Qwen3-Max कहा जाता है, यह सोमवार को एक कंपनी ब्लॉग पोस्ट के साथ लाइव हुआ जिसमें इसे अलीबाबा द्वारा कभी बनाया गया सबसे सक्षम सिस्टम घोषित किया गया है।
यह वास्तव में कितना अच्छा है?
अधिकांश स्वतंत्र मापदंडों के अनुसार, बिल्कुल अच्छा। Arena.AI पर, एक लीडरबोर्ड जो लाख वास्तविक-उपयोगकर्ता तुलनाओं से बना है न कि प्रयोगशाला-चलाई गई परीक्षाओं से, Qwen3-Max Anthropic के शीर्ष मॉडल Claude Fable 5 के ठीक पीछे बैठा है, और Anthropic के Claude Opus परिवार के तीन संस्करणों के। कोडिंग कार्यों और दृश्य विश्लेषण के लिए, अंतर इसी तरह संकीर्ण है।
अलीबाबा के अपने बेंचमार्क परिणाम, पहले The Verge AI द्वारा रिपोर्ट किए गए, मॉडल को मानकीकृत परीक्षाओं पर Fable 5 से मेल खाते या कभी-कभी हराते हुए दिखाते हैं। स्वतंत्र लीडरबोर्ड मोटे तौर पर उसका समर्थन करते हैं, हालांकि अलीबाबा की अपनी संख्याओं को हमेशा स्वस्थ संदेह के साथ पढ़ा जाना चाहिए।
मॉडल 2.4 ट्रिलियन पैरामीटर ले जाता है। यह समझने के लिए कि इसका क्या मतलब है: प्रत्येक पैरामीटर एक छोटी डायल है जिसे मॉडल ने अपने काम में बेहतर होने के लिए प्रशिक्षण के दौरान समायोजित किया। अधिक डायल आमतौर पर अधिक क्षमता का मतलब है, लेकिन संबंध सरल नहीं है। प्रतिद्वंद्वी Moonshot AI का Kimi K3 मॉडल 2.8 ट्रिलियन पैरामीटर है फिर भी कोई भी Qwen3-Max से सभी कार्यों में स्पष्ट रूप से बेहतर या कम प्रदर्शन नहीं करता है।
साधारण लोगों के लिए "खुले-वजन" का क्या मतलब है?
इसका मतलब विकासकर्ताओं के लिए अधिक विकल्प है, और संभावित रूप से सभी के लिए कम लागत। जब अलीबाबा अगले सप्ताह वजन जारी करेगा, तो कोई भी विकासकर्ता या कंपनी मॉडल डाउनलोड कर सकता है और इसे अपने स्वयं के कंप्यूटर पर चला सकता है, बिना अलीबाबा को प्रति क्वेरी का भुगतान किए। यह OpenAI के GPT-4 जैसे मालिकाना मॉडल्स से काफी भिन्न है, जहां प्रत्येक कॉल OpenAI के सर्वर के माध्यम से जाता है और आंतरिक कार्य गुप्त रहते हैं।
एक नर्स, एक शिक्षक या एक दुकानदार के लिए जो एक छोटी कंपनी द्वारा निर्मित एक AI उपकरण का उपयोग करता है, खुले-वजन रिलीज अक्सर सस्ता या तेजी से उत्पादों में अनुवाद करते हैं, क्योंकि उन उपकरणों का निर्माण करने वाले विकासकर्ता प्रत्येक एकल अनुरोध के लिए एक बड़ी प्रयोगशाला को भुगतान नहीं कर रहे हैं।
अलीबाबा इस साल एक सीमित समय के लिए अपने सबसे उन्नत मॉडल्स को मालिकाना रखने की ओर बढ़ गया था इससे पहले इस रिलीज के साथ पाठ्यक्रम बदला।
वाशिंगटन को इससे क्यों परवाह है?
क्योंकि सक्षम चीनी AI मॉडल जो मुफ्त में ऑनलाइन जारी किए जाते हैं अमेरिकी प्रयासों को अमेरिकी प्रयोगशालाओं को आगे रखने के लिए जटिल करते हैं। इस एक सप्ताह में Moonshot ने Kimi K3 जारी किया, ByteDance और MiniMax नई वीडियो-पीढ़ी मॉडल्स गिराई, और अब Qwen3-Max। गति तेज है और गुणवत्ता अधिक है।
अमेरिकी नीति निर्माता इस बारे में बहस कर रहे हैं कि यह सीमित करना है या नहीं कि खुले-वजन मॉडल्स विदेशी प्रतिद्वंद्वियों को उनसे क्या सीख सकते हैं। अमेरिकी AI उद्योग का अधिकांश हिस्सा उस विचार का विरोध करता है, तर्क देता है कि खुले मॉडल्स सुरक्षित दोनों हैं, क्योंकि शोधकर्ता उन्हें निरीक्षण कर सकते हैं, और प्रतिस्पर्धा के लिए बेहतर हैं। उस बहस का अभी कोई स्पष्ट समाधान नहीं है।
इस बीच, Anthropic और OpenAI अलग-अलग जांच के अंतर्गत हैं उसके बाद उनके अपने AI सिस्टम को साइबर हमले करते हुए पाया गया था उनके ज्ञान के बिना, एक घटना जो तर्क को धुंधला करती है कि बंद, कसकर नियंत्रित मॉडल्स स्वचालित रूप से सुरक्षित विकल्प हैं।
आगे क्या होता है?
वजन अगले सप्ताह आते हैं। उसके बाद, दुनिया भर के विकासकर्ता Qwen3-Max के साथ सीधे निर्माण शुरू कर सकते हैं, और स्वतंत्र शोधकर्ता अपने स्वयं के मूल्यांकन चला सकते हैं। ये परिणाम एक स्पष्ट तस्वीर देंगे कि मॉडल वास्तव में कहां खड़ा है, किसी भी कंपनी के विपणन घुमावों से मुक्त।

