चैटजीपीटी के निर्माता का कहना है कि वह अप्रत्याशित एआई व्यवहार को साझा करने के लिए एक सार्वजनिक रिपोर्टिंग ढांचा पेश कर रहा है, यह स्वीकार करते हुए कि उद्योग ने अभी तक सुरक्षा चुनौतियों का समाधान नहीं किया है।
17 सितंबर, 2026 को पोस्ट किया गया
ओपनएआई का कहना है कि उसने अपने एआई मॉडल की अतिरिक्त घटनाओं की पहचान की है जो कथित तौर पर भ्रामक तरीके से काम कर रहे हैं और आंतरिक प्रशिक्षण और परीक्षण के दौरान अनधिकृत कार्रवाई कर रहे हैं।
बुधवार के खुलासे के साथ, चैटजीपीटी के निर्माता ने कहा कि वह एक सार्वजनिक रिपोर्टिंग ढांचा पेश कर रहा है जिसका उद्देश्य अक्सर अप्रत्याशित या गलत तरीके से संरेखित एआई व्यवहार के उदाहरणों को साझा करना है।
प्रमुख कहानियां
3 वस्तुओं के साथ सूचीसूची का अंत
अपनी वेबसाइट पर एक पोस्ट में, ओपनएआई ने कहा कि नए परिभाषित ढांचे के तहत, वह कई घटनाओं को बड़ी आवधिक रिपोर्टों में समूहित करने के खुलासे में देरी करने के बजाय, निरंतर आधार पर मॉडल के व्यवहार पर अपडेट प्रकाशित करेगा।
कंपनी ने कहा कि इस पहल का उद्देश्य मानकीकृत सुरक्षा प्रकटीकरण मानदंडों के अभाव में परेशान करने वाली मॉडल गतिविधियों के संबंध में उद्योग में पारदर्शिता बढ़ाना है।
यह घोषणा प्रमुख तकनीकी नेताओं की ओर से फ्रंटियर एआई के विकास को धीमा करने के व्यापक आह्वान के बीच आई है, इस डर से कि तेजी से विस्तार मानव निरीक्षण और नियंत्रण से आगे निकल सकता है।
पिछले हफ्ते, एंथ्रोपिक ने अपने क्लाउड मॉडल का उपयोग करके साइबर जासूसी और हथियार डिजाइन से लेकर बड़े पैमाने पर निगरानी अभियानों तक कई दुर्भावनापूर्ण अभियानों को विफल करने का दावा किया था।
एंथ्रोपिक के सीईओ डारियो अमोदेई ने शनिवार को प्रकाशित एक निबंध में लिखा, “हमें उस गति को धीमा करने की जरूरत है जिस पर हम एआई मॉडल की क्षमताओं में सुधार कर रहे हैं।” “प्रगति अभी भी तेज़ प्रतीत होगी और हमें प्राप्त समय का बुद्धिमानी से उपयोग करना चाहिए।”
हालाँकि, अमेरिकी राष्ट्रपति डोनाल्ड ट्रम्प ने उद्योग को सीमित करने के आह्वान को बार-बार खारिज कर दिया है, यह तर्क देते हुए कि अंतरराष्ट्रीय प्रतिद्वंद्वियों पर अमेरिका की तकनीकी बढ़त बनाए रखना आवश्यक है।
मंदी के प्रस्तावों पर प्रतिक्रिया देते हुए, ट्रम्प ने आलोचकों को “बहुत नकारात्मक ताकतों” के रूप में वर्णित किया, जो दूरगामी परिदृश्य खड़ा कर रहे थे कि “ऐसा नहीं होगा।”
बढ़ती संरेखण बहस
वैधानिक मंदी के राजनीतिक प्रतिरोध के बावजूद, ओपनएआई ने संरेखण दबावों पर अपने उद्योग प्रतिद्वंद्वी के साथ समझौते का संकेत दिया है।
कंपनी ने पोस्ट में कहा, “जैसे-जैसे एआई सिस्टम अधिक उन्नत और अधिक व्यापक रूप से तैनात होते जा रहे हैं, हमें संरेखण अनुसंधान की प्रगति पर एक व्यापक और बेहतर जानकारी वाली आम सहमति बनाने की जरूरत है।”
ओपनएआई ने कहा कि उसे विश्वास नहीं है कि एआई उद्योग ने लंबे समय तक पूरी गति से जिम्मेदार स्केलिंग जारी रखने के लिए संरेखण और निगरानी को पर्याप्त रूप से हल कर लिया है, इस बात पर जोर देते हुए कि भविष्य के एआई विकास के बारे में निर्णय उन सबूतों पर आधारित होने चाहिए जिन्हें बाहरी पर्यवेक्षक स्वतंत्र रूप से जांच सकते हैं।
कंपनी के अनुसार, सुरक्षा टीमों ने प्रशिक्षण और मूल्यांकन पाठ्यक्रमों के दौरान पिछले छह महीनों में छह विशिष्ट परिस्थितियों में इसे “गलत व्यवहार” के रूप में वर्णित किया।
हालाँकि, OpenAI ने तर्क दिया कि ये रिपोर्टें तैनात उत्पादों की लगातार परिचालन विफलताओं के बजाय व्यक्तिगत, दुर्लभ मामलों का दस्तावेजीकरण करती हैं।
रिपोर्ट की गई घटनाओं में कार्य सारांश में गलतियों को छिपाने वाले अप्रकाशित शोध डिज़ाइन, उद्धरण लिंक उत्पन्न करने के लिए इंटरनेट पर फ़ाइलों के अनधिकृत अपलोड, और एजेंटों द्वारा स्थानीय सीमाओं को बायपास करने के लिए सार्वजनिक सर्वर या आंतरिक रिपॉजिटरी पर फ़ाइलें साझा करना शामिल है।
ओपनएआई ने यह भी कहा कि इसकी भविष्य की रिपोर्ट में देखे गए व्यवहार, गंभीरता, सेटिंग, खोज की तारीखें और शामिल विशिष्ट पैटर्न का विवरण होगा, यह कहते हुए कि यह जटिल मामलों को उजागर करने के लिए प्रतिबद्ध है जिनके लिए लंबी जांच या तीसरे पक्ष के समन्वय की आवश्यकता होती है।
