OpenAI ChatGPT और Codex के आउटपुट के लिए textGrain नाम का अदृश्य वॉटरमार्क ला रहा है, जो यूरोपीय संघ के उपयोगकर्ताओं के लिए सक्रिय होगा। कंपनी का कहना है कि EU AI Act की उस शर्त को पूरा करने के लिए यह सुविधा अगले कुछ हफ्तों में चालू कर दी जाएगी, जिसके तहत AI से तैयार किए गए टेक्स्ट पर मशीन-पठनीय तरीके से लेबल लगाया जा सके। OpenAI के API का इस्तेमाल करने वाले डेवलपर चाहें तो वॉटरमार्क चालू या बंद कर सकते हैं। यह Anthropic के तरीके से अलग है, जो दुनिया भर में Claude के सभी आउटपुट पर वॉटरमार्क अनिवार्य करता है।
वॉटरमार्क कैसे काम करता है और इसकी सीमाएं
textGrain मॉडल के शब्द-चयन में एक सांख्यिकीय पैटर्न जोड़ता है। यह Anthropic के Claude में इस्तेमाल होने वाले Google के SynthID जैसा है। OpenAI के आंतरिक परीक्षणों के मुताबिक, डिटेक्टर 400-token (करीब 300 शब्दों) के मनोविज्ञान से जुड़े अंशों में लगभग 95 % मामलों में पैटर्न पहचान लेता है, लेकिन उतनी ही लंबाई के गणित के अंशों में यह आंकड़ा लगभग 60 % है। टेक्स्ट के छोटे से हिस्से को बदलने पर भी पहचान की दर घट जाती है: 10 % शब्दों को समानार्थी शब्दों से बदलने पर यह दर लगभग 92 % से घटकर 66 % हो जाती है, जबकि एक चौथाई शब्द बदलने पर यह करीब 17 % रह जाती है।
डिटेक्टर तक पहुंच
फिलहाल OpenAI आवेदन प्रक्रिया के जरिए केवल चुने हुए शोधकर्ताओं और विशेषज्ञ संगठनों को डिटेक्टर का इस्तेमाल करने देगा। यह टूल सिर्फ बताएगा कि OpenAI का वॉटरमार्क मौजूद है या नहीं; यह नहीं बताएगा कि टेक्स्ट किसने लिखा या इसके लिए कौन-से प्रॉम्प्ट इस्तेमाल किए गए।
यह क्यों मायने रखता है
EU के उपयोगकर्ताओं को ChatGPT के आउटपुट पर एक छिपा संकेत दिखेगा, जिसे नियामक पढ़ सकेंगे। इससे लेबलिंग के नए नियमों को पूरा करने में मदद मिलेगी। डेवलपर इस संकेत को छिपाने का विकल्प चुन सकते हैं, जिससे तीसरे पक्ष के लिए AI-जनित टेक्स्ट पहचानना आसान या मुश्किल हो सकता है। संपादन के बाद पहचान की दर कम होने का मतलब है कि सामग्री को थोड़ा दोबारा लिखकर वॉटरमार्क हटाया जा सकता है।