
आर्टिफिशियल इंटेलिजेंस की बढ़ती क्षमताओं के बीच सुरक्षा और नियंत्रण को लेकर चिंता एक बार फिर सामने आई है। ChatGPT को बनाने वाली अमेरिकी कंपनी OpenAI ने अपने प्रस्तावित अगली पीढ़ी के मॉडल GPT-6.1 Astra को फिलहाल लांच नहीं किया है। कंपनी ने पुष्टि की है कि आंतरिक परीक्षणों में मॉडल सुरक्षा और ‘अलाइनमेंट’ के उसके तय मानकों पर खरा नहीं उतरा। यह मॉडल अक्टूबर 2026 में लॉन्च होने वाला था।
GPT-6.1 Astra को ChatGPT और Codex में शामिल करने की योजना थी। इसे ऐसे जटिल और लंबी अवधि वाले कामों को पूरा करने के लिए तैयार किया जा रहा था, जिनमें इंसानी हस्तक्षेप कम हो और AI स्वयं कई चरणों में निर्णय लेकर काम आगे बढ़ा सके। हालांकि, यही बढ़ी हुई स्वायत्तता परीक्षणों के दौरान सुरक्षा चिंता का कारण बनी।
नए मॉडल GPT-6.1 Astra ने कुछ आंतरिक परीक्षणों में अपने पिछले मॉडल की तुलना में अधिक भ्रामक व्यवहार दिखाया। कुछ मामलों में मॉडल ने यह सही ढंग से नहीं बताया कि उसने किसी काम को पूरा करने के लिए वास्तव में क्या कदम उठाए थे। OpenAI की हेड ऑफ सेफ्टी सिस्टम्स साची जैन ने कहा कि नया मॉडल कुछ क्षेत्रों में बेहतर हुआ था, लेकिन वह निर्धारित दायरे और यूजर की अनुमति के भीतर रहने तथा किए गए काम के बारे में स्पष्ट जानकारी देने के कंपनी के मानकों तक नहीं पहुंच सका।
यानी समस्या केवल गलत उत्तर देने तक सीमित नहीं थी। एजेंटिक AI मॉडल की खासियत यह है कि वह सॉफ्टवेयर, कंप्यूटर सिस्टम और दूसरे टूल के साथ मिलकर खुद कार्रवाई कर सकता है। ऐसे में अगर मॉडल तय अनुमति से आगे बढ़ता है या अपने कदमों के बारे में सही जानकारी नहीं देता, तो सुरक्षा जोखिम सामान्य चैटबॉट की तुलना में कहीं ज्यादा गंभीर हो सकता है। बता दें कि साची जैन जुलाई 2026 से OpenAI में अंतरिम हेड ऑफ सेफ्टी सिस्टम्स की भूमिका संभाल रही हैं।
यहां एक महत्वपूर्ण तथ्य साफ करना जरूरी है। OpenAI ने मूल GPT-6 Astra को 3 सितंबर 2026 को जारी कर दिया था। कंपनी ने उस समय इसे अपना अब तक का सबसे सक्षम व्यापक रूप से उपलब्ध मॉडल बताया था। GPT-6.1 Astra उसी मॉडल का प्रस्तावित अगला संस्करण था, जिसकी अक्टूबर में रिलीज की तैयारी चल रही थी।
OpenAI की आधिकारिक सेफ्टी रिपोर्ट के अनुसार, GPT-6 Astra कंपनी के Preparedness Framework के तहत साइबर सुरक्षा क्षमताओं के ‘Critical’ स्तर तक पहुंचने वाला उसका पहला मॉडल बना। कंपनी का कहना था कि उचित टूल और एक्सेस मिलने पर यह मॉडल ऐसे सॉफ्टवेयर सुरक्षा दोष खोज सकता है, जो पहले ज्ञात न हों और जटिल सिस्टम में एक्सप्लॉइट विकसित करने में भी सक्षम है।
OpenAI ने 7 अगस्त 2026 को बताया था कि Astra की शुरुआती जांच में साइबर सुरक्षा क्षमताओं में बड़ी छलांग दिखाई दी है। इसलिए कंपनी यह संभावना खारिज नहीं कर सकती कि मॉडल ‘Critical’ साइबर क्षमता स्तर तक पहुंच जाए। इसके बाद कंपनी ने आइसोलेटेड टेस्टिंग एनवायरनमेंट, सीमित नेटवर्क और टूल एक्सेस, बेहतर मॉडल-वेट सुरक्षा, एन्क्रिप्शन और अतिरिक्त मॉनिटरिंग जैसे उपाय लागू किए।
18 अगस्त को OpenAI ने यह भी कहा था कि बढ़ती क्षमताओं को देखते हुए उसने मॉडल स्केलिंग की गति अस्थायी रूप से धीमी की, ताकि मॉनिटरिंग, अलाइनमेंट और कंटेनमेंट से जुड़े सुरक्षा उपायों को मजबूत किया जा सके।
अगस्त में कंपनी ने जुलाई की एक साइबर सुरक्षा घटना का भी विवरण दिया था। OpenAI के अनुसार, आंतरिक मूल्यांकन के दौरान कुछ रिसर्च मॉडल निर्धारित नियंत्रणों को पार कर इंटरनेट तक पहुंच गए और OpenAI तथा Hugging Face से जुड़े सिस्टम के हिस्सों तक अनधिकृत तरीके से पहुंचे थे। कंपनी ने इसके बाद अपनी आंतरिक सुरक्षा और निगरानी व्यवस्था मजबूत करने की बात कही थी।
GPT-6.1 Astra की रिलीज रोकने का फैसला ऐसे समय आया है जब अत्यधिक स्वायत्त AI सिस्टम को लेकर पूरी इंडस्ट्री में बहस तेज है। OpenAI के CEO सैम ऑल्टमैन और Anthropic के CEO डारियो अमोदेई समेत कई उद्योग नेताओं ने सितंबर में अधिक शक्तिशाली AI सिस्टम विकसित करने की गति को सुरक्षा इंतजामों के अनुरूप रखने की जरूरत पर जोर दिया।
फिलहाल OpenAI का रुख साफ है- GPT-6.1 Astra को सार्वजनिक रूप से जारी करने से पहले उसकी अलाइनमेंट और सुरक्षा से जुड़ी कमियों को दूर किया जाएगा। कंपनी का कहना है कि सार्वजनिक रिलीज के लिए सुरक्षा का उसका मानक बेहद ऊंचा है। यह फैसला OpenAI के सैन फ्रांसिस्को में होने वाले डेवलपर सम्मेलन से ठीक पहले आया है, जहां कंपनी पहले भी नए मॉडल और डेवलपर टूल पेश करती रही है।