OpenAI یورپی یونین میں ChatGPT اور Codex سے تیار بعض متن میں پوشیدہ واٹرمارک شامل کرے گی، جس سے AI تحریر کی شناخت میں مدد ملے گی۔
یہ نشان عام آنکھ کو نظر نہیں آئے گا بلکہ الفاظ کے انتخاب میں ایک شماریاتی پیٹرن ہوگا۔
تاہم زیادہ ایڈیٹنگ، ترجمہ یا الفاظ بدلنے سے اس کی شناخت مشکل ہوسکتی ہے، اور اس کا مطلب یہ نہیں کہ AI سے تیار مواد ممنوع ہوگیا ہے۔
مصنوعی ذہانت سے لکھی گئی تحریر کی شناخت کا مسئلہ اب ایک نئے مرحلے میں داخل ہوگیا ہے۔
OpenAI نے اعلان کیا ہے کہ یورپی یونین میں ChatGPT اور Codex سے تیار ہونے والے اہل متون میں ایک پوشیدہ واٹرمارک شامل کیا جائے گا تاکہ مشینی نظام یہ جان سکیں کہ کسی متن کی تیاری میں OpenAI کے ماڈلز استعمال ہوئے تھے۔
🔍 پوشیدہ واٹرمارک اصل میں کیا ہے؟
یہ متن کے اندر کوئی خفیہ لوگو، علامت یا پوشیدہ اسپیس نہیں ہوگی۔
OpenAI کا textGrain نظام الفاظ اور لفظی ٹکڑوں کے انتخاب میں باریک شماریاتی پیٹرن شامل کرتا ہے۔
عام قاری کو متن معمول کے مطابق نظر آتا ہے، لیکن مخصوص سافٹ ویئر اس پیٹرن کو تلاش کرسکتا ہے۔
یہ تبدیلی یورپی یونین کے AI Act کی شفافیت سے متعلق شرائط کے تحت کی جارہی ہے۔ کمپنی کے مطابق آنے والے ہفتوں میں یورپی یونین میں تمام پلانز کے اہل ChatGPT اور Codex صارفین کے متن پر یہ نظام بتدریج نافذ ہوگا۔
البتہ فی الحال اسے پوری دنیا میں ChatGPT کا ڈیفالٹ فیچر نہیں بنایا جارہا۔
مزید پڑھیں
واٹرمارک نظر کیسے آئے گا؟
دلچسپ بات یہ ہے کہ یہ واٹرمارک عام معنی میں کوئی چھوٹا نشان، خفیہ لفظ، پوشیدہ اسپیس یا ایسا کوڈ نہیں ہوگا جسے صارف متن کاپی کرکے دیکھ سکے۔
OpenAI نے اپنی ٹیکنالوجی کا نام textGrain رکھا ہے۔
یہ نظام ماڈل کے الفاظ اور لفظی ٹکڑوں کے انتخاب کے انداز میں
انتہائی باریک شماریاتی پیٹرن پیدا کرتا ہے۔
عام قاری کو تحریر بالکل معمول کے متن کی طرح دکھائی دیتی ہے، لیکن مخصوص ڈیٹیکٹر پورے متن میں موجود اس شماریاتی سگنل کو تلاش کرکے اندازہ لگاتا ہے کہ تحریر میں OpenAI کا واٹرمارک موجود ہے یا نہیں۔
🇪🇺 یہ نظام کہاں نافذ ہوگا؟
ابتدائی نفاذ یورپی یونین میں ہوگا اور اس کا تعلق EU AI Act کی شفافیت سے متعلق شرائط سے ہے۔
OpenAI کے مطابق یہ اہل ChatGPT اور Codex متون پر بتدریج نافذ ہوگا۔
اسے فی الحال پوری دنیا کے ہر ChatGPT متن کے لیے لازمی عالمی نظام قرار نہیں دیا گیا۔
یعنی محض متن کو کاپی کرنے، فونٹ تبدیل کرنے یا فارمیٹنگ ختم کرنے سے ضروری نہیں کہ یہ نشان ختم ہوجائے کیونکہ یہ فارمیٹنگ کے بجائے الفاظ کے انتخاب کے انداز میں شامل ہوتا ہے۔
کیا ChatGPT سے لکھی ہر تحریر پکڑی جائے گی؟
یہاں سب سے اہم نکتہ یہی ہے کہ جواب نہیں ہے۔
OpenAI خود واضح کرتی ہے کہ یہ نظام سو فیصد درست نہیں۔
کمپنی کے تجربات میں تقریباً 200 ٹوکن طویل بعض متون میں، ایک فیصد false-positive شرح کے ہدف پر، واٹرمارک کی شناخت تقریباً 80 فیصد رہی، جبکہ 400 ٹوکن کے متن میں یہ شرح تقریباً 95 فیصد تک پہنچی۔
📊 کیا ہر AI تحریر پکڑی جائے گی؟
نہیں۔ OpenAI خود کہتی ہے کہ یہ نظام سو فیصد درست نہیں۔
تقریباً 200 ٹوکن کے بعض متون میں شناخت کی شرح قریب 80 فیصد اور 400 ٹوکن کے متن میں قریب 95 فیصد تک دیکھی گئی۔
مختصر متن، محدود الفاظ والے موضوعات اور زیادہ ایڈیٹنگ کے بعد شناخت مشکل ہوسکتی ہے۔
تاہم ریاضی جیسے موضوعات میں، جہاں الفاظ منتخب کرنے کی آزادی کم ہوتی ہے، نتائج اس سے کمزور ہوسکتے ہیں۔
اس کا مطلب ہے کہ ایک طویل مضمون کو پہچاننا نسبتاً آسان ہوسکتا ہے، جبکہ مختصر جواب، عنوان، سوشل میڈیا پوسٹ یا محدود انداز میں لکھی تحریر کی شناخت زیادہ مشکل ہوسکتی ہے۔
الفاظ بدل دیے جائیں تو کیا ہوگا؟
یہ اس ٹیکنالوجی کی سب سے بڑی کمزوری ہے۔
OpenAI کے تجربے میں 400 ٹوکن کے متن کے صرف 10 فیصد الفاظ مترادفات سے بدلنے پر شناخت کی شرح تقریباً 92 فیصد سے کم ہوکر 66 فیصد رہ گئی۔
جب 25 فیصد الفاظ بدل دیے گئے تو یہ شرح صرف 17 فیصد تک گر گئی۔
✍️ الفاظ بدلنے سے کیا ہوگا؟
یہی اس ٹیکنالوجی کی سب سے بڑی کمزوری ہے۔
OpenAI کے تجربے میں 400 ٹوکن کے متن کے صرف 10 فیصد الفاظ مترادفات سے بدلنے پر شناخت کی شرح واضح طور پر کم ہوگئی۔
بڑے پیمانے کی ایڈیٹنگ، ترجمہ یا مکمل دوبارہ تحریر واٹرمارک کے سگنل کو مزید کمزور کرسکتی ہے۔
ترجمہ، بڑے پیمانے پر ایڈیٹنگ یا عبارت کو دوبارہ لکھنا بھی واٹرمارک کے سگنل کو کمزور کرسکتا ہے۔
اسی لیے کسی متن میں واٹرمارک نہ ملنے کا مطلب یہ نہیں ہوگا کہ اسے لازماً کسی انسان نے لکھا ہے۔
کیا استاد، ادارہ یا ویب سائٹ فوراً چیک کرسکے گی؟
فی الحال نہیں۔
OpenAI اپنے textGrain ڈیٹیکٹر کو عام صارفین کے لیے فوری طور پر کھول نہیں رہی۔ ابتدائی مرحلے میں اس تک رسائی منظور شدہ محققین اور ماہر اداروں کو دی جائے گی تاکہ حقیقی دنیا میں اس کی قابلِ اعتماد کارکردگی کا جائزہ لیا جاسکے۔
🚫 کیا AI سے تیار مواد منع ہوگیا؟
بالکل نہیں۔ واٹرمارک کا مقصد AI مواد پر پابندی لگانا نہیں بلکہ شفافیت اور شناخت میں مدد دینا ہے۔
AI کو تحقیق، مسودہ، ترجمہ، خلاصہ یا ایڈیٹنگ کے لیے استعمال کرنا بذاتِ خود ممنوع نہیں ہے۔
البتہ بعض اداروں، تعلیمی پلیٹ فارمز یا قانونی حالات میں AI کے استعمال کی وضاحت یا disclosure ضروری ہوسکتی ہے۔
کمپنی کا کہنا ہے کہ false positives اور false negatives کے خدشات کی وجہ سے اسے ایسا آلہ نہیں بنانا چاہئے جس کے ایک نتیجے کی بنیاد پر کسی طالب علم، صحافی، ملازم یا مصنف کے خلاف حتمی فیصلہ کردیا جائے۔
کیا واٹرمارک سے معلوم ہوگا کس نے ChatGPT استعمال کیا؟
نہیں۔
OpenAI نے خاص طور پر واضح کیا ہے کہ واٹرمارک کسی صارف، اکاؤنٹ، پرامپٹ یا چیٹ کی شناخت نہیں کرتا۔
یہ بھی معلوم نہیں کرسکتا کہ تحریر میں انسان نے کتنی محنت یا ایڈیٹنگ کی، مواد کا مالک کون ہے یا متن میں لکھی معلومات درست ہیں یا غلط۔
🧾 واٹرمارک کیا ثابت نہیں کرتا؟
واٹرمارک یہ نہیں بتاتا کہ متن کس صارف، کس اکاؤنٹ یا کس پرامپٹ سے تیار ہوا۔
یہ بھی طے نہیں کرتا کہ تحریر میں انسانی محنت کتنی ہے، معلومات درست ہیں یا غلط، یا مواد کا قانونی مالک کون ہے۔
اس لیے واٹرمارک کو کسی شخص کے خلاف اکیلا اور حتمی ثبوت نہیں سمجھا جانا چاہئے۔
مثلاً کسی صحافی نے ChatGPT سے ابتدائی مسودہ لیا، پھر مکمل تحقیق، نئے حقائق اور اپنی زبان شامل کی تو واٹرمارک محض OpenAI کے نظام کے کسی کردار کی طرف اشارہ کرسکتا ہے، وہ انسانی محنت کی مقدار طے نہیں کرسکتا۔
یہ تبدیلی کیوں اہم ہے؟
AI سے تیار مواد تیزی سے تعلیمی اداروں، میڈیا، مارکیٹنگ، سرکاری دستاویزات اور سوشل میڈیا تک پہنچ رہا ہے۔
اسی کے ساتھ یہ سوال بھی بڑھ رہا ہے کہ اصل انسانی تحریر اور مصنوعی ذہانت کی تیار کردہ تحریر میں فرق کیسے کیا جائے۔
📰 صحافیوں اور ویب سائٹس کے لیے کیا مطلب؟
AI سے مسودہ بنوانا یا متن بہتر کرانا ممکن رہے گا، لیکن ادارتی ذمہ داری انسان کی ہی رہے گی۔
خبر کے حقائق، اصل ذرائع، نام، اعداد و شمار اور حوالوں کی جانچ ضروری ہوگی۔
اہم فرق یہ ہوگا کہ مستقبل میں AI سے تیار متن کی provenance جانچنے کے لیے اضافی تکنیکی اشارہ دستیاب ہوسکتا ہے۔
OpenAI پہلے ہی اپنی بعض تصاویر اور آڈیو میں provenance signals اور SynthID جیسے طریقے استعمال کرتی ہے۔ اب متن کو بھی اسی سمت میں لایا جارہا ہے۔
تاہم textGrain سے یہ مسئلہ مکمل طور پر حل نہیں ہوتا۔
اس کا سب سے اہم فائدہ یہ ہوسکتا ہے کہ پلیٹ فارمز اور تحقیقاتی اداروں کے پاس AI مواد کی شناخت کے لیے ایک اضافی اشارہ موجود ہوگا، لیکن اسے کسی تحریر کے AI سے بننے کا ناقابلِ تردید ثبوت قرار نہیں دیا جاسکے گا۔
اصل سوال اب یہ نہیں کہ ChatGPT کی تحریر پر نشان ہوگا یا نہیں، بلکہ یہ ہے کہ وہ نشان انسانی ایڈیٹنگ، ترجمے اور دوبارہ تحریر کے بعد کتنی دیر باقی رہتا ہے۔
🔗 اصل ذرائع اور مزید مطالعہ
OpenAI — EU Text Provenance:
یورپی یونین میں textGrain واٹرمارک، شناخت کی حدود اور نفاذ کی تفصیل۔
اصل اعلان کھولیں
OpenAI — Advancing Content Provenance:
AI سے تیار مواد کی شناخت اور provenance ٹیکنالوجیز کے بارے میں OpenAI کی وضاحت۔
مزید تفصیل کھولیں
TechCrunch:
یورپی یونین میں ChatGPT متن کی watermarking پر رپورٹ۔
رپورٹ کھولیں