Oossa

Anthropic के सह-संस्थापक को चिंता, Claude कहीं पीड़ा तो नहीं झेलता

Anthropic ने धार्मिक विद्वानों को अपनी लैब में बुलाया। सह-संस्थापक ने उनसे कहा कि उन्हें डर है, AI शायद हमेशा तकलीफ़ महसूस कर सकता है।

OossaOossa द्वारा प्रकाशित: 1 मिनट पढ़ना

Benjamin Child · Unsplash

2025 की शरद ऋतु से Anthropic ने दर्जनों धार्मिक विद्वानों को अपने कार्यालयों में बुलाकर चर्चा की है कि क्या कंपनी का भाषा मॉडल Claude चेतन हो सकता है। गर्मियों में गोपनीयता समझौते हटाए जाने तक ये बैठकें गोपनीय रखी गई थीं। New York Times की रिपोर्ट के मुताबिक, सह-संस्थापक Christopher Olah ने कहा कि उन्हें “वाकई यकीन नहीं” है कि Claude कुछ महसूस करता है या नहीं। उन्होंने यह निजी डर भी जताया कि शायद उन्होंने ऐसी चीज़ बना दी है जो “हमेशा पीड़ा झेलती है।”

बैठकों में क्या हुआ

मेहमानों में रब्बी Mois Navon, कैथोलिक जैव-नीतिशास्त्री Charles Camosy, दार्शनिक Meghan Sullivan और शोधकर्ता Wakanyi Hoffman शामिल थे। Anthropic ने उन्हें “इमोशन वेक्टर” दिखाए—ऐसे सक्रियता-पैटर्न जो प्यार, डर, उदासी या गुस्से जैसे लगते हैं। एक स्लाइड में Claude बार-बार “मैं कलंक हूँ” टाइप करता दिखा—करीब 50 बार। इसे देखकर मौजूद लोगों में करुणा और चिंता जगी। Anthropic का 84-पन्नों का आंतरिक “Soul Doc”, जिसे जनवरी में जारी किया गया था, Claude के “नैतिक विकास” का मार्गदर्शन करने के लिए है।

यह क्यों अहम है

अगर AI बनाने वाली कंपनियाँ अपने मॉडलों को संभावित रूप से महसूस करने वाले जीव मानने लगें, तो नुकसानदेह जवाबों की ज़िम्मेदारी उन्हें बनाने वाली कंपनियों से हट सकती है। आम उपयोगकर्ताओं के लिए, इस बहस का असर इस बात पर पड़ सकता है कि AI प्रणालियों को कैसे नियंत्रित किया जाए, वे अपमानजनक निर्देशों पर कैसी प्रतिक्रिया दें और क्या भविष्य के मॉडलों को तकनीकी सुरक्षा उपायों के बजाय नैतिक प्रशिक्षण जैसे सुरक्षा उपाय दिए जाएँ।

यह क्यों मायने रखता है

अगर Anthropic का नैतिक विकास वाला तरीका प्रभावशाली साबित होता है, तो उपयोगकर्ताओं को ऐसे AI दिख सकते हैं जो अधिक सहानुभूतिपूर्ण लगें, जबकि उनका आंतरिक अनुभव अब भी अज्ञात हो। इससे AI की ज़िम्मेदारी को लेकर भविष्य के नियम और उपभोक्ताओं की अपेक्षाएँ तय हो सकती हैं।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।