واترمارک غیرقابل مشاهده ChatGPT در اروپا راهاندازی شد؛ آیا امکان پاک کردن آن وجود دارد

قوانین شفافیت مربوط به قانون هوش مصنوعی اتحادیه اروپا که از تاریخ دوم آگوست (یازدهم مرداد) به مرحله اجرا درآمد، شرکتهای فعال در حوزه هوش مصنوعی را موظف میسازد تا محتوای تولیدی خود را به نحوی علامتگذاری کنند که برای دیگر سیستمها قابل شناسایی باشد.
OpenAI اعلام کرد که این واترمارک در هفتههای پیش رو برای کاربران واجد شرایط ChatGPT و Codex در تمامی طرحها، البته صرفاً در اتحادیه اروپا، فعال خواهد شد. توسعهدهندگانی که از API OpenAI در سراسر جهان بهره میبرند، میتوانند از امروز این قابلیت را برای مدلهای انتخابی خود فعال نمایند؛ با این حال، این ویژگی به طور پیشفرض غیرفعال است. OpenAI تاکید کرد که واترمارک متن را به عنوان یک تنظیمات پیشفرض جهانی عرضه نخواهد کرد.
این واترمارک به طور فیزیکی قابل مشاهده نیست، بلکه با اثرگذاری نامحسوس بر روی انتخاب کلمات مدل، الگویی را به وجود میآورد که قابل رؤیت نیست، اما یک آشکارساز میتواند آن را شناسایی کند. از آنجایی که این واترمارک در خود کلمات و جملات جای دارد، در هنگام کپی و پیست کردن متن، به همراه آن منتقل میشود. OpenAI خاطرنشان کرد که این واترمارک به شناسایی کاربر منجر نمیشود و با فعال بودن آن، هیچ تغییر قابل توجهی در عملکرد مدلها مشاهده نشده است.
در کنار این اعلان، OpenAI گزارشی فنی با عنوان textGrain را نیز منتشر کرد. این گزارش که به همکاری محققان دانشگاه پنسیلوانیا و ییل به نگارش درآمده است، نمونهای از استفاده یک کلید مخفی برای دستهبندی پیشبینیهای کلمه بعدی به منظور تکمیل جملات را توضیح میدهد. یک آشکارساز میتواند تنها با استفاده از متن و کلید، محتوای تولید شده توسط هوش مصنوعی را شناسایی کند اگر صدها نشانه به هم افزوده شوند.
آیا میتوان با ویرایش، واترمارک را حذف کرد؟ نتایج آزمایشات OpenAI به این سوال پاسخ مثبت میدهد. یکی از آزمایشها نشان داد که با جایگزینی ۱۰٪ از کلمات با مترادفها، دقت تشخیص از حدود ۹۲٪ به ۶۶٪ کاهش پیدا میکند. همچنین این شرکت اعلام کرد که شناسایی متون کوتاه، پاسخهای ریاضی و متون ترجمه شده دشوارتر است.
این شرکت تصریح کرد: «این محدودیتها در تصمیم ما برای ارائه دسترسی اولیه به آشکارساز تنها به محققان و سازمانهای معتبر که میتوانند در ارزیابی قابلیت اطمینان و استفادههای مسئولانه به ما کمک کنند، تأثیرگذار است.»
OpenAI همچنین اشاره کرد که عدم وجود واترمارک دلیلی بر اثبات تالیف انسانی نیست. متنها ممکن است خیلی کوتاه یا به شدت ویرایش شده باشند و یا اینکه ممکن است از هوش مصنوعی دیگر شرکتها حاصل آمده باشند.
این شرکت اعلام کرد: «واترمارکها قادر به نمایش این موضوع هستند که یک سیستم OpenAI بخشی از یک متن را تولید یا پردازش کرده است، اما نمیتوانند نشان دهند که تا چه اندازه قضاوت، ویرایش یا خلاقیت انسانی در آن دخیل بوده است.»
براساس گزارشی از Techcrunch، این اعلامیه به فاصله دو ماه از زمانی به وقوع میپیوندد که شرکت Anthropic اعلام کرد که واترمارکهایی برای متنهای تولید شده توسط کلود ایجاد خواهد کرد، اقدامی که در سطح جهانی اجرایی میشود. این تصمیم با واکنش منفی برخی از کاربران کلود مواجه شد که معتقد بودند آنها «دستورالعملها، زمینه و تصمیمات» را ارائه کردهاند در حالی که کلود صرفاً «ابزار» بوده است.
در سال ۲۰۲۴، وال استریت ژورنال گزارش داد که OpenAI قبلاً یک واترمارک متنی ایجاد کرده، اما به خاطر نگرانیهای مربوط به اینکه کاربران ممکن است به رقبایی با واترمارکهای غیر وجود جذب شوند، انتشار آن را به تأخیر انداخت.
شرکتهایی نظیر آنتروپیک، گوگل، متا، مایکروسافت و اوپنایآی از جمله سازمانهایی هستند که متعهد به رعایت آییننامه اتحادیه اروپا در خصوص محتوای تولید شده توسط هوش مصنوعی شدهاند.



