OpenAI द्वारा अपने gpt-oss मॉडल के लॉन्च के साथ—जो GPT-2 के बाद उनकी पहली ओपन-वेट रिलीज़ है—हम डेवलपर्स और बड़े उद्यमों को एक अभूतपूर्व अवसर और क्षमता प्रदान कर रहे हैं। अब वे OpenAI मॉडल को पूरी तरह से अपनी शर्तों पर चला सकते हैं, उन्हें अपनी ज़रूरतों के अनुसार ढाल सकते हैं और तैनात कर सकते हैं। यह पहली बार संभव हुआ है कि आप gpt-oss-120b जैसे शक्तिशाली OpenAI मॉडल को एक सिंगल एंटरप्राइज GPU पर चला सकते हैं, या gpt-oss-20b को स्थानीय रूप से (locally) अपने डिवाइस पर ही रन कर सकते हैं।
AI अब केवल टेक्नोलॉजी स्टैक की एक परत नहीं है – बल्कि यह स्वयं ही पूरा स्टैक बनता जा रहा है। इस नए युग में ऐसे उपकरणों की आवश्यकता है जो खुले हों, अनुकूलनीय हों, और जहाँ भी आपके विचार जन्म लें—क्लाउड से लेकर एज डिवाइस तक, पहले प्रयोग से लेकर बड़े पैमाने पर तैनाती तक—चलने के लिए तैयार हों। Microsoft में, हम एक संपूर्ण AI ऐप और एजेंट फैक्ट्री का निर्माण कर रहे हैं जो हर डेवलपर को न केवल AI का उपयोग करने, बल्कि इसके साथ कुछ नया बनाने के लिए सशक्त बनाती है।
क्लाउड से लेकर एज तक फैले हमारे AI प्लेटफ़ॉर्म के पीछे यही दृष्टिकोण है। Azure AI Foundry विश्वास के साथ इंटेलिजेंट एजेंट्स के निर्माण, फाइन-ट्यूनिंग और तैनाती के लिए एक एकीकृत मंच प्रदान करता है, जबकि Foundry Local ओपन-सोर्स मॉडल को एज डिवाइस तक लाता है—जिससे अरबों उपकरणों पर लचीला, ऑन-डिवाइस अनुमान (on-device inferencing) सक्षम होता है। Windows AI Foundry इसी नींव पर बनता है, जो Foundry Local को Windows 11 में एकीकृत करता है ताकि विंडोज प्लेटफॉर्म के साथ गहराई से जुड़े एक सुरक्षित, कम-विलंबता (low-latency) वाले स्थानीय AI विकास जीवनचक्र का समर्थन किया जा सके।
gpt-oss मॉडल के लॉन्च के साथ, डेवलपर्स और व्यवसायों को अब अपने हिसाब से OpenAI मॉडल चलाने, उन्हें अनुकूलित करने और तैनात करने की बेजोड़ शक्ति मिल रही है। ये मॉडल कोई साधारण प्रतिकृति नहीं हैं – ये तेज़, सक्षम और वास्तविक दुनिया में तैनाती को ध्यान में रखकर डिज़ाइन किए गए हैं: चाहे क्लाउड में बड़े पैमाने पर तर्क (reasoning) करना हो या एज डिवाइस पर एजेंटिक कार्य करना हो।
और चूँकि ये ओपन-वेट हैं, इन मॉडलों को फाइन-ट्यून करना, डिस्टिल करना और ऑप्टिमाइज़ करना भी आसान है। चाहे आप किसी डोमेन-विशिष्ट कोपायलट के लिए मॉडल को अनुकूलित कर रहे हों, ऑफ़लाइन अनुमान के लिए इसे कंप्रेस कर रहे हों, या उत्पादन में बड़े पैमाने पर तैनात करने से पहले स्थानीय रूप से प्रोटोटाइप बना रहे हों, Azure AI Foundry और Foundry Local आपको यह सब करने के लिए टूलिंग प्रदान करते हैं – सुरक्षित, कुशलतापूर्वक और बिना किसी समझौते के।
ओपन मॉडल्स, असली गति
ओपन मॉडल अब हाशिये से मुख्यधारा में आ गए हैं। आज, वे स्वचालित एजेंटों (autonomous agents) से लेकर डोमेन-विशिष्ट कोपायलट तक सब कुछ शक्ति प्रदान कर रहे हैं – और AI के निर्माण और तैनाती के तरीके को फिर से परिभाषित कर रहे हैं। Azure AI Foundry के साथ, हम आपको उस गति के साथ आगे बढ़ने के लिए आवश्यक बुनियादी ढाँचा दे रहे हैं:
- पैरामीटर-कुशल विधियों का उपयोग: ओपन वेट के साथ, टीमें पैरामीटर-कुशल तरीकों (जैसे LoRA, QLoRA, PEFT) का उपयोग करके फाइन-ट्यूनिंग कर सकती हैं, मालिकाना डेटा को शामिल कर सकती हैं, और हफ्तों के बजाय घंटों में नए चेकपॉइंट शिप कर सकती हैं।
- मॉडल ऑप्टिमाइज़ेशन: आप एज GPU और यहाँ तक कि हाई-एंड लैपटॉप के लिए सख्त मेमोरी सीमाओं को पूरा करने के लिए मॉडल को डिस्टिल या क्वांटाइज़ कर सकते हैं, संदर्भ लंबाई को कम कर सकते हैं, या संरचित विरलता (structured sparsity) लागू कर सकते हैं।
- पूर्ण पहुँच और नियंत्रण: पूर्ण वेट एक्सेस का यह भी अर्थ है कि आप सुरक्षा ऑडिट के लिए अटेंशन पैटर्न का निरीक्षण कर सकते हैं, डोमेन एडेप्टर इंजेक्ट कर सकते हैं, विशिष्ट परतों को फिर से प्रशिक्षित कर सकते हैं, या Azure Kubernetes Service (AKS) या Foundry Local पर कंटेनरीकृत अनुमान के लिए ONNX/Triton में निर्यात कर सकते हैं।
संक्षेप में, ओपन मॉडल केवल फीचर-पैरिटी वाले प्रतिस्थापन नहीं हैं—वे प्रोग्राम करने योग्य सब्सट्रेट हैं। और Azure AI Foundry आपको उन सभी संभावनाओं का फायदा उठाने और AI अनुकूलन की सीमाओं को आगे बढ़ाने के लिए प्रशिक्षण पाइपलाइन, वेट प्रबंधन और कम-विलंबता वाला सर्विंग बैकप्लेन प्रदान करता है।
मिलिए gpt-oss से: दो मॉडल, अनंत संभावनाएँ
आज, gpt-oss-120b और gpt-oss-20b Azure AI Foundry पर उपलब्ध हैं। gpt-oss-20b Windows AI Foundry पर भी उपलब्ध है और जल्द ही Foundry Local के माध्यम से MacOS पर भी आने वाला है। चाहे आप संप्रभुता (sovereignty), प्रदर्शन या पोर्टेबिलिटी के लिए ऑप्टिमाइज़ कर रहे हों, ये मॉडल एक नए स्तर का नियंत्रण प्रदान करते हैं।
- gpt-oss-120b: यह एक तर्क-शक्ति का पावरहाउस है। 120 बिलियन मापदंडों और वास्तुशिल्प विरलता (architectural sparsity) के साथ, यह बहुत कम आकार में o4-मिनी स्तर का प्रदर्शन प्रदान करता है, जो गणित, कोड और डोमेन-विशिष्ट প্রশ্নোত্তর जैसे जटिल कार्यों में उत्कृष्टता प्राप्त करता है – फिर भी यह इतना कुशल है कि इसे एक सिंगल डेटासेंटर-क्लास GPU पर चलाया जा सकता है। यह उन सुरक्षित, उच्च-प्रदर्शन वाली तैनाती के लिए आदर्श है जहाँ विलंबता या लागत मायने रखती है।
- gpt-oss-20b: यह टूल-प्रेमी और हल्का है। कोड निष्पादन और टूल उपयोग जैसे एजेंटिक कार्यों के लिए अनुकूलित, यह 16GB+ VRAM वाले असतत GPU सहित विंडोज हार्डवेयर की एक श्रृंखला पर कुशलता से चलता है, और जल्द ही और भी उपकरणों के लिए समर्थन आने वाला है। यह स्वायत्त सहायकों के निर्माण या कम बैंडविड्थ वाले वातावरण में भी AI को वास्तविक दुनिया के वर्कफ़्लो में एम्बेड करने के लिए एकदम सही है।
दोनों मॉडल जल्द ही सर्वव्यापी रिस्पॉन्स API के साथ API-संगत होंगे। इसका मतलब है कि आप उन्हें न्यूनतम परिवर्तनों और अधिकतम लचीलेपन के साथ मौजूदा ऐप्स में स्वैप कर सकते हैं।
gpt-oss को क्लाउड और एज पर लाना
Azure AI Foundry सिर्फ एक मॉडल कैटलॉग से कहीं बढ़कर है—यह AI बिल्डरों के लिए एक मंच है। 11,000 से अधिक मॉडलों के साथ और लगातार बढ़ते हुए, यह डेवलपर्स को एंटरप्राइज-ग्रेड विश्वसनीयता और सुरक्षा के साथ मॉडलों का मूल्यांकन, फाइन-ट्यून और उत्पादन करने के लिए एक एकीकृत स्थान देता है।
आज, कैटलॉग में gpt-oss के साथ, आप यह कर सकते हैं:
- क्लाउड में gpt-oss का उपयोग करके कुछ ही CLI कमांड के साथ अनुमान एंडपॉइंट (inference endpoints) बना सकते हैं।
- अपने स्वयं के डेटा का उपयोग करके मॉडल को फाइन-ट्यून और डिस्टिल कर सकते हैं और विश्वास के साथ तैनात कर सकते हैं।
- कार्य-विशिष्ट आवश्यकताओं से मेल खाने के लिए ओपन और मालिकाना मॉडल मिला सकते हैं।
उन संगठनों के लिए जो केवल क्लाइंट डिवाइस पर संभव परिदृश्यों का विकास कर रहे हैं, Foundry Local प्रमुख ओपन-सोर्स मॉडल को Windows AI Foundry पर लाता है, जो आपके अपने हार्डवेयर पर अनुमान के लिए पूर्व-अनुकूलित हैं, और एक सरल CLI, API और SDK के माध्यम से CPU, GPU और NPU का समर्थन करते हैं।
चाहे आप ऑफ़लाइन सेटिंग में काम कर रहे हों, एक सुरक्षित नेटवर्क में निर्माण कर रहे हों, या एज पर चल रहे हों—Foundry Local और Windows AI Foundry आपको पूरी तरह से क्लाउड-वैकल्पिक (cloud-optional) होने की सुविधा देते हैं। आधुनिक उच्च-प्रदर्शन वाले विंडोज पीसी पर gpt-oss-20b को तैनात करने की क्षमता के साथ, आपका डेटा वहीं रहता है जहाँ आप चाहते हैं—और फ्रंटियर-क्लास मॉडल की शक्ति आप तक पहुँचती है।
यह हाइब्रिड AI का एक जीवंत उदाहरण है: मॉडल को मिलाने और मिलाने की क्षमता, प्रदर्शन और लागत को अनुकूलित करने की क्षमता, और आपके डेटा से वहीं मिलने की क्षमता जहाँ वह मौजूद है।
निर्माताओं और निर्णयकर्ताओं को सशक्त बनाना
Azure और Windows पर gpt-oss की उपलब्धता बिल्डरों और व्यावसायिक नेताओं दोनों के लिए शक्तिशाली नई संभावनाओं को खोलती है। डेवलपर्स के लिए, ओपन वेट का अर्थ है पूर्ण पारदर्शिता। मॉडल का निरीक्षण करें, अनुकूलित करें, फाइन-ट्यून करें और अपनी शर्तों पर तैनात करें। gpt-oss के साथ, आप विश्वास के साथ निर्माण कर सकते हैं, यह समझते हुए कि आपका मॉडल ठीक से कैसे काम करता है और इसे आपके उपयोग के मामले के लिए कैसे बेहतर बनाया जाए।
निर्णयकर्ताओं के लिए, यह नियंत्रण और लचीलेपन के बारे में है। gpt-oss के साथ, आपको प्रतिस्पर्धी प्रदर्शन मिलता है – बिना किसी ब्लैक बॉक्स के, कम समझौतों के साथ, और परिनियोजन, अनुपालन और लागत में अधिक विकल्पों के साथ।
भविष्य के लिए एक दृष्टिकोण: खुला और जिम्मेदार AI, एक साथ
gpt-oss की रिलीज़ और Azure और Windows में इसका एकीकरण एक बड़ी कहानी का हिस्सा है। हम एक ऐसे भविष्य की कल्पना करते हैं जहाँ AI सर्वव्यापी हो—और हम इन नवीन तकनीकों को अपने ग्राहकों तक, हमारे सभी डेटा केंद्रों और उपकरणों पर लाने के लिए एक खुला मंच बनने के लिए प्रतिबद्ध हैं।
Enjoying this post?
Subscribe to Bolbindas to get deep dives like this delivered directly to your inbox .