واترمارک غیرقابل مشاهده ChatGPT در اروپا راه‌اندازی شد؛ آیا امکان پاک کردن آن وجود دارد

در روز دوشنبه، شرکت OpenAI طی یک پست وبلاگی از آغاز فرآیند افزودن یک واترمارک نامرئی به متن‌های تولید شده توسط ChatGPT و Codex در منطقه اتحادیه اروپا خبر داد.

قوانین شفافیت مربوط به قانون هوش مصنوعی اتحادیه اروپا که از تاریخ دوم آگوست (یازدهم مرداد) به مرحله اجرا درآمد، شرکت‌های فعال در حوزه هوش مصنوعی را موظف می‌سازد تا محتوای تولیدی خود را به نحوی علامت‌گذاری کنند که برای دیگر سیستم‌ها قابل شناسایی باشد.

OpenAI اعلام کرد که این واترمارک در هفته‌های پیش رو برای کاربران واجد شرایط ChatGPT و Codex در تمامی طرح‌ها، البته صرفاً در اتحادیه اروپا، فعال خواهد شد. توسعه‌دهندگانی که از API OpenAI در سراسر جهان بهره می‌برند، می‌توانند از امروز این قابلیت را برای مدل‌های انتخابی خود فعال نمایند؛ با این حال، این ویژگی به طور پیش‌فرض غیرفعال است. OpenAI تاکید کرد که واترمارک متن را به عنوان یک تنظیمات پیش‌فرض جهانی عرضه نخواهد کرد.

این واترمارک به طور فیزیکی قابل مشاهده نیست، بلکه با اثرگذاری نامحسوس بر روی انتخاب کلمات مدل، الگویی را به وجود می‌آورد که قابل رؤیت نیست، اما یک آشکارساز می‌تواند آن را شناسایی کند. از آنجایی که این واترمارک در خود کلمات و جملات جای دارد، در هنگام کپی و پیست کردن متن، به همراه آن منتقل می‌شود. OpenAI خاطرنشان کرد که این واترمارک به شناسایی کاربر منجر نمی‌شود و با فعال بودن آن، هیچ تغییر قابل توجهی در عملکرد مدل‌ها مشاهده نشده است.

در کنار این اعلان، OpenAI گزارشی فنی با عنوان textGrain را نیز منتشر کرد. این گزارش که به همکاری محققان دانشگاه پنسیلوانیا و ییل به نگارش درآمده است، نمونه‌ای از استفاده یک کلید مخفی برای دسته‌بندی پیش‌بینی‌های کلمه بعدی به منظور تکمیل جملات را توضیح می‌دهد. یک آشکارساز می‌تواند تنها با استفاده از متن و کلید، محتوای تولید شده توسط هوش مصنوعی را شناسایی کند اگر صدها نشانه به هم افزوده شوند.

آیا می‌توان با ویرایش، واترمارک را حذف کرد؟ نتایج آزمایشات OpenAI به این سوال پاسخ مثبت می‌دهد. یکی از آزمایش‌ها نشان داد که با جایگزینی ۱۰٪ از کلمات با مترادف‌ها، دقت تشخیص از حدود ۹۲٪ به ۶۶٪ کاهش پیدا می‌کند. همچنین این شرکت اعلام کرد که شناسایی متون کوتاه، پاسخ‌های ریاضی و متون ترجمه شده دشوارتر است.

 




این شرکت تصریح کرد: «این محدودیت‌ها در تصمیم ما برای ارائه دسترسی اولیه به آشکارساز تنها به محققان و سازمان‌های معتبر که می‌توانند در ارزیابی قابلیت اطمینان و استفاده‌های مسئولانه به ما کمک کنند، تأثیرگذار است.»

OpenAI همچنین اشاره کرد که عدم وجود واترمارک دلیلی بر اثبات تالیف انسانی نیست. متن‌ها ممکن است خیلی کوتاه یا به شدت ویرایش شده باشند و یا اینکه ممکن است از هوش مصنوعی دیگر شرکت‌ها حاصل آمده باشند.

این شرکت اعلام کرد: «واترمارک‌ها قادر به نمایش این موضوع هستند که یک سیستم OpenAI بخشی از یک متن را تولید یا پردازش کرده است، اما نمی‌توانند نشان دهند که تا چه اندازه قضاوت، ویرایش یا خلاقیت انسانی در آن دخیل بوده است.»

براساس گزارشی از Techcrunch، این اعلامیه به فاصله دو ماه از زمانی به وقوع می‌پیوندد که شرکت Anthropic اعلام کرد که واترمارک‌هایی برای متن‌های تولید شده توسط کلود ایجاد خواهد کرد، اقدامی که در سطح جهانی اجرایی می‌شود. این تصمیم با واکنش منفی برخی از کاربران کلود مواجه شد که معتقد بودند آنها «دستورالعمل‌ها، زمینه و تصمیمات» را ارائه کرده‌اند در حالی که کلود صرفاً «ابزار» بوده است.

در سال ۲۰۲۴، وال استریت ژورنال گزارش داد که OpenAI قبلاً یک واترمارک متنی ایجاد کرده، اما به خاطر نگرانی‌های مربوط به اینکه کاربران ممکن است به رقبایی با واترمارک‌های غیر وجود جذب شوند، انتشار آن را به تأخیر انداخت.

شرکت‌هایی نظیر آنتروپیک، گوگل، متا، مایکروسافت و اوپن‌ای‌آی از جمله سازمان‌هایی هستند که متعهد به رعایت آیین‌نامه اتحادیه اروپا در خصوص محتوای تولید شده توسط هوش مصنوعی شده‌اند.

مشاهده بیشتر

نوشته های مشابه

دکمه بازگشت به بالا