OpenAI EU में ChatGPT टेक्स्ट पर Watermark लगाएगा

मूल शीर्षक: OpenAI will start watermarking ChatGPT’s text in the EU

यह क्यों महत्वपूर्ण है

AI-निर्मित सामग्री की पहचान के लिए यह तकनीकी और नियामक दोनों दृष्टि से एक अहम कदम है।

OpenAI ने सोमवार को घोषणा की कि EU AI Act के तहत वह ChatGPT और Codex द्वारा उत्पन्न टेक्स्ट में अदृश्य Watermark जोड़ेगा। यह सुविधा आने वाले हफ्तों में EU के सभी प्लान उपयोगकर्ताओं को मिलेगी।

EU AI Act की पारदर्शिता संबंधी नियम 2 अगस्त से लागू हुए हैं, जिनके अनुसार AI कंपनियों को AI-निर्मित सामग्री को इस तरह चिह्नित करना होगा कि अन्य सिस्टम उसे पहचान सकें। OpenAI का यह Watermark कोई दृश्य प्रतीक नहीं है — यह मॉडल के शब्द-चयन को सूक्ष्म रूप से प्रभावित करता है, जिससे एक ऐसा पैटर्न बनता है जो पाठक नहीं देख सकते, लेकिन एक Detector पकड़ सकता है। चूँकि यह Watermark शब्दों में ही समाया होता है, Copy-Paste करने पर भी यह टेक्स्ट के साथ बना रहता है।

OpenAI ने University of Pennsylvania और Yale के शोधकर्ताओं के साथ मिलकर 'textGrain' नामक अपनी तकनीकी विधि का एक रिपोर्ट भी प्रकाशित किया। इसमें एक गुप्त Key से अगले शब्द के पूर्वानुमानों को क्रमबद्ध करने की प्रक्रिया बताई गई है। कंपनी ने कहा कि Watermark चालू करने से मॉडल के प्रदर्शन में कोई उल्लेखनीय बदलाव नहीं आया।

हालाँकि, इसकी सीमाएँ भी हैं। OpenAI के परीक्षणों में पाया गया कि 10% शब्दों को Synonym से बदलने पर Detection दर 92% से घटकर 66% रह गई। छोटे अनुच्छेद, गणितीय उत्तर और अनुवादित टेक्स्ट को पहचानना भी कठिन है। इसीलिए Detector की पहुँच फिलहाल केवल अनुमोदित शोधकर्ताओं और विशेषज्ञ संगठनों तक सीमित रखी गई है। OpenAI ने यह भी स्पष्ट किया कि Watermark का न होना मानव-लेखन का प्रमाण नहीं है। दुनिया भर में API उपयोगकर्ता इसे आज से चुनिंदा मॉडल पर सक्रिय कर सकते हैं, पर यह डिफ़ॉल्ट रूप से बंद रहेगा।

स्रोत

techcrunch.com — मूल लेख पढ़ें →