OpenAI ने अपने ChatGPT और Codex मॉडल के लिए एक अदृश्य, मशीन-पठनीय टेक्स्ट वॉटरमार्किंग प्रणाली शुरू कर दी है, जिसका लक्ष्य शुरुआत में यूरोपीय संघ के भीतर के उपयोगकर्ता हैं। टेकक्रंच के अनुसार, सोमवार, 5 अक्टूबर, 2026 को घोषित यह कदम यूरोपीय संघ के एआई अधिनियम का पालन करने के उद्देश्य से है।

द वर्ज की रिपोर्ट के अनुसार, कंपनी की टेक्स्टग्रेन वॉटरमार्किंग तकनीक आने वाले हफ्तों में यूरोपीय संघ में सभी योजनाओं के योग्य ChatGPT और Codex उपयोगकर्ताओं के लिए पेश की जाएगी। OpenAI ने कहा कि वह लॉन्च के समय टेक्स्ट वॉटरमार्किंग को वैश्विक डिफ़ॉल्ट नहीं बना रहा है, बल्कि वास्तविक दुनिया के उपयोग और प्रतिक्रिया से सीखने के लिए एक क्षेत्रीय दृष्टिकोण अपना रहा है।

द वर्ज के अनुसार, दुनिया भर के डेवलपर्स के लिए, OpenAI अपने एपीआई के माध्यम से चुनिंदा मॉडलों के लिए एक ऑप्ट-इन वॉटरमार्किंग सुविधा को तत्काल प्रभाव से सक्षम कर रहा है। यह एपीआई ग्राहकों को यह तय करने की अनुमति देता है कि वॉटरमार्किंग उनकी पारदर्शिता जिम्मेदारियों और उनके द्वारा प्रदान किए जाने वाले उपयोगकर्ता अनुभवों के साथ कैसे संरेखित होती है। OpenAI आने वाले हफ्तों में अपनी सेवाओं के माध्यम से एक्सेस किए गए मॉडल आउटपुट के लिए वॉटरमार्किंग उपलब्ध कराने के लिए क्लाउड भागीदारों के साथ भी सहयोग कर रहा है।

टेक्स्टग्रेन वॉटरमार्किंग प्रणाली का विवरण

टेक्स्टग्रेन वॉटरमार्क एक दृश्यमान प्रतीक नहीं है। इसके बजाय, यह मॉडल के शब्द विकल्पों को सूक्ष्मता से आकार देता है, एक ऐसा पैटर्न बनाता है जो मानव पाठकों के लिए अगोचर होता है लेकिन एक विशेष उपकरण द्वारा पता लगाया जा सकता है, टेकक्रंच ने समझाया। चूंकि वॉटरमार्क टेक्स्ट के भीतर ही एम्बेडेड होता है, इसलिए इसे कॉपी और पेस्ट करने पर भी यह सामग्री के साथ बना रहता है।

द वर्ज के अनुसार, OpenAI का दावा है कि इसकी टेक्स्टग्रेन वॉटरमार्किंग ने अन्य दृष्टिकोणों को 'बराबर या उससे बेहतर' प्रदर्शन किया है, जिसमें टेक्स्ट के लिए Google DeepMind का SynthID भी शामिल है, जो अगस्त में एंथ्रोपिक द्वारा घोषित एक वॉटरमार्किंग प्रणाली का आधार भी बनता है। टेकक्रंच ने बताया कि OpenAI ने अपनी टेक्स्टग्रेन विधि पर एक तकनीकी रिपोर्ट भी प्रकाशित की है, जिसे यूनिवर्सिटी ऑफ पेन्सिलवेनिया और येल के शोधकर्ताओं के साथ मिलकर लिखा गया है। रिपोर्ट में बताया गया है कि यह प्रणाली अगले-शब्द की भविष्यवाणियों को सॉर्ट करने के लिए एक गुप्त कुंजी का उपयोग कैसे करती है, जिसमें ऐसे सैकड़ों संकेत एक डिटेक्टर को केवल टेक्स्ट और कुंजी का उपयोग करके एआई-जनित सामग्री की पहचान करने की अनुमति देते हैं।

टेकक्रंच ने बताया कि कंपनी ने कहा कि वॉटरमार्क उपयोगकर्ता की पहचान नहीं करता है, और इसके परीक्षणों से पता चला है कि जब वॉटरमार्किंग सक्रिय थी तब मॉडल के प्रदर्शन में कोई महत्वपूर्ण बदलाव नहीं आया। द वर्ज ने यह भी बताया कि एआई बेंचमार्क ने वॉटरमार्क वाले और बिना वॉटरमार्क वाले टेक्स्ट दोनों से समान प्रदर्शन का संकेत दिया।

सीमाएँ और डिटेक्टर तक पहुँच

अपनी क्षमताओं के बावजूद, OpenAI अपनी टेक्स्टग्रेन प्रणाली की कई सीमाओं को स्वीकार करता है। द वर्ज के अनुसार, कंपनी ने बताया कि टेक्स्टग्रेन 'विश्वसनीय पहचान की गारंटी नहीं देता है,' और टेक्स्ट वॉटरमार्क सटीकता को सत्यापित नहीं करते हैं, स्वामित्व निर्धारित नहीं करते हैं, मानवीय योगदान को मापते नहीं हैं, या मानवीय लेखन को साबित नहीं करते हैं।

OpenAI के अपने परीक्षणों से संकेत मिलता है कि संपादन अदृश्य निशानों का पता लगाना कठिन बना सकता है। उदाहरण के लिए, टेकक्रंच ने बताया कि एक परीक्षण में 10% शब्दों को पर्यायवाची शब्दों से बदलने पर पहचान दर लगभग 92% से घटकर 66% हो गई। कंपनी ने यह भी पाया कि छोटे अंश, गणितीय उत्तर और अनुवादित टेक्स्ट को डिटेक्टर के लिए पहचानना अधिक चुनौतीपूर्ण होता है।

इन सीमाओं और छूटे हुए वॉटरमार्क और गलत सकारात्मक परिणामों के जोखिम को देखते हुए, OpenAI लॉन्च के समय अपने डिटेक्टर को सार्वजनिक रूप से उपलब्ध नहीं करा रहा है। इसके बजाय, द वर्ज ने कहा कि अनुमोदित शोधकर्ता और विशेषज्ञ संगठन आज से पहुँच के लिए आवेदन कर सकते हैं। टेक्स्ट के स्रोत के मूल्यांकन और सुधार का समर्थन करने के लिए, आचार संहिता के अनुसार, पहुँच मामले-दर-मामले आधार पर प्रदान की जाएगी। यह उपकरण उपयोगकर्ता की पहचान किए बिना या उनकी प्रॉम्प्ट या बातचीत का खुलासा किए बिना OpenAI वॉटरमार्क की पहचान की रिपोर्ट करेगा।

टेकक्रंच ने बताया कि OpenAI ने चेतावनी दी कि एक गुम वॉटरमार्क मानवीय लेखन को साबित नहीं करता है, क्योंकि टेक्स्ट बहुत छोटा हो सकता है, भारी संपादित हो सकता है, या किसी अन्य कंपनी के एआई द्वारा उत्पन्न किया गया हो सकता है। कंपनी ने आगे कहा कि वॉटरमार्क 'यह संकेत दे सकते हैं कि एक OpenAI प्रणाली ने किसी अंश का हिस्सा उत्पन्न या संसाधित किया है, लेकिन इसमें कितना मानवीय निर्णय, संपादन या रचनात्मकता शामिल थी, यह नहीं।'

संदर्भ और पृष्ठभूमि

टेकक्रंच ने बताया कि OpenAI की वॉटरमार्किंग प्रणाली का रोलआउट यूरोपीय संघ के एआई अधिनियम के पारदर्शिता नियमों के जवाब में आया है, जो 2 अगस्त को प्रभावी हुए थे। ये नियम अनिवार्य करते हैं कि एआई कंपनियाँ एआई-जनित सामग्री को इस तरह से चिह्नित करें जिसे अन्य प्रणालियाँ पहचान सकें।

टेकक्रंच ने बताया कि यह घोषणा एंथ्रोपिक द्वारा इसी तरह के कदम के बाद आई है, जिसने अगस्त में कहा था कि वह अपने क्लाउड मॉडल द्वारा उत्पन्न टेक्स्ट को वॉटरमार्क करेगा, इस उपाय को दुनिया भर में लागू करेगा। एंथ्रोपिक के फैसले ने कुछ क्लाउड उपयोगकर्ताओं की आलोचना को आकर्षित किया, जिन्होंने तर्क दिया कि उन्होंने 'निर्देश, संदर्भ, निर्णय' प्रदान किए जबकि क्लाउड ने केवल 'उपकरण' के रूप में कार्य किया।

टेकक्रंच द्वारा उद्धृत द वॉल स्ट्रीट जर्नल ने 2024 में रिपोर्ट किया था कि OpenAI ने पहले एक टेक्स्ट वॉटरमार्क विकसित किया था लेकिन इसे जारी नहीं करने का विकल्प चुना, आंशिक रूप से इस चिंता के कारण कि उपयोगकर्ता प्रतिद्वंद्वी प्लेटफार्मों पर स्विच कर सकते हैं जिन्होंने ऐसी सुविधाओं को लागू नहीं किया था। हालांकि, टेकक्रंच ने बताया कि OpenAI, एंथ्रोपिक, Google, मेटा और माइक्रोसॉफ्ट के साथ उन कंपनियों में से हैं जिन्होंने एआई-जनित सामग्री पर यूरोपीय संघ की आचार संहिता का पालन करने के लिए प्रतिबद्धता जताई है।