واترمارک نامرئی ChatGPT؛ OpenAI متن‌های اروپا را با textGrain نشان‌گذاری می‌کند

اخبار · هوش مصنوعی

شرکت OpenAI اعلام کرد در اتحادیه اروپا متن‌های ChatGPT و Codex را با یک امضای نامرئی به نام textGrain نشان‌گذاری می‌کند؛ امضایی که در خودِ انتخاب واژه‌ها پنهان است و با کپی و پیست هم از بین نمی‌رود.

چکیده. طبق گزارش TechCrunch، شرکت OpenAI از واترمارک متنی textGrain رونمایی کرده است. این سیستم برای همه‌ی پلن‌های ChatGPT و برای Codex در اتحادیه اروپا فعال می‌شود و توسعه‌دهندگان API هم می‌توانند آن را به‌صورت اختیاری برای برخی مدل‌ها روشن کنند. دلیل اصلی، قوانین شفافیت اتحادیه اروپا در قانون هوش مصنوعی است که از دوم اوت ۲۰۲۶ اجرایی شده است. این واترمارک بی‌نقص نیست: با جایگزینی ده درصد از واژه‌ها، نرخ تشخیص از حدود ۹۲ درصد به ۶۶ درصد می‌رسد.
واترمارک نامرئی textGrain در متن‌های ChatGPT و Codex شرکت OpenAI برای اتحادیه اروپا

بخش اول — ماجرا چیست و چه چیزی اعلام شد؟

شرکت OpenAI اعلام کرده است که به‌زودی روی متن‌هایی که ChatGPT و Codex در اتحادیه اروپا تولید می‌کنند، یک نشانه‌ی نامرئی قرار می‌دهد. نام این روش textGrain است و نشانه‌ی آن مثل یک برچسب یا حروف مخفی درون متن دیده نمی‌شود. این امضا در الگوی انتخاب واژه‌ها پنهان شده و فقط یک الگوریتم تشخیص، همراه با کلید مخصوص، می‌تواند آن را بخواند.

اجرای این طرح مرحله‌ای است. برای کاربران واجد شرایط ChatGPT و Codex در اروپا، فعال‌سازی طی هفته‌های پیش رو انجام می‌شود. اما توسعه‌دهندگانی که از API استفاده می‌کنند، از همین امروز می‌توانند برای برخی مدل‌ها آن را روشن کنند. نکته‌ی مهم این است که در سطح جهانی، این قابلیت پیش‌فرض نیست و حالت اختیاری دارد.

این خبر برای کسانی که خبرهای قبلی را دنبال می‌کردند، تازگی کامل ندارد. چند ماه پیش شرکت آنتروپیک هم از نشانه‌گذاری متن‌های کلود خبر داده بود و ما در مطلب واترمارک نامرئی کلود و بخش اخبار آن ماجرا را پوشش داده‌ایم. حالا OpenAI هم عملاً وارد همین مسیر شده است.

بخش دوم — واترمارک متنی دقیقاً چطور کار می‌کند؟

برای فهمیدن textGrain اول باید بدانیم یک مدل زبانی چطور می‌نویسد. مدل در هر مرحله، برای کلمه‌ی بعدی میان چندین گزینه‌ی محتمل یکی را انتخاب می‌کند. مثلاً بعد از جمله‌ای درباره‌ی هوا، ممکن است «آفتابی»، «صاف» یا «روشن» همگی منطقی باشند. در واترمارک متنی، این انتخاب‌ها کمی و با یک کلید مخفی هدایت می‌شوند.

طبق توضیح گزارش، textGrain صدها «هل‌دادن» بسیار ریز در پیش‌بینی کلمه‌ی بعدی ایجاد می‌کند. هر هل‌دادن به‌تنهایی بی‌اثر و غیرقابل‌تشخیص است، اما وقتی صدها مورد کنار هم قرار بگیرند، یک الگوی آماری شکل می‌گیرد که فقط با دانستن کلید قابل شناسایی است. خواننده‌ی عادی هیچ تفاوتی در کیفیت یا لحن متن حس نمی‌کند.

چرا با کپی و پیست از بین نمی‌رود؟

چون نشانه در خود واژه‌ها نشسته است، نه در قالب‌بندی، فونت یا کاراکتر پنهان. وقتی متن را از ChatGPT کپی می‌کنید و در ورد، ایمیل یا وب‌سایت می‌گذارید، همان واژه‌ها منتقل می‌شوند و الگو هم همراهشان می‌آید. تشخیص‌دهنده فقط به خودِ متن و کلید مربوط نیاز دارد و به فایل یا فراداده‌ای وابسته نیست.

نحوه کار واترمارک متنی هوش مصنوعی با هدایت ریز انتخاب واژه‌ها و کلید مخفی

بخش سوم — چرا OpenAI حالا این کار را می‌کند؟

دلیل رسمی، مقررات اتحادیه اروپاست. بر اساس گزارش، قوانین شفافیت قانون هوش مصنوعی اتحادیه اروپا از دوم اوت ۲۰۲۶ اجرایی شده‌اند و شرکت‌های سازنده‌ی هوش مصنوعی را ملزم می‌کنند محتوای تولیدشده را به شکلی قابل‌شناسایی نشان‌گذاری کنند. بنابراین این حرکت بیشتر یک واکنش انطباقی است تا ابتکار داوطلبانه.

جالب اینکه OpenAI این فناوری را قبلاً هم ساخته بود، اما انتشارش را به تأخیر انداخته بود. طبق گزارش، بخشی از نگرانی شرکت این بود که کاربران به رقبایی مهاجرت کنند که متن‌هایشان واترمارک ندارد. این تردید نشان می‌دهد که واترمارک متنی فقط یک موضوع فنی نیست و روی رقابت تجاری هم اثر دارد.

اگر می‌خواهید زمینه‌ی کلی‌تر شرکت و مسیر رشدش را بشناسید، مطلب OpenAI چیست؟ نقطه‌ی شروع خوبی است.

بخش چهارم — محدودیت‌ها؛ واترمارک چقدر قابل اعتماد است؟

خود OpenAI هم اعتراف کرده که این روش بی‌نقص نیست. مهم‌ترین عدد این گزارش همین است: اگر ده درصد از واژه‌های یک متن با مترادف‌هایشان عوض شوند، نرخ تشخیص از حدود ۹۲ درصد به ۶۶ درصد کاهش پیدا می‌کند. یعنی با کمی بازنویسی، اطمینان تشخیص به‌شکل محسوسی پایین می‌آید.

چند محدودیت دیگر هم وجود دارد. متن‌های کوتاه به‌سختی تشخیص داده می‌شوند، چون الگوی آماری برای ساخته‌شدن به تعداد کافی واژه نیاز دارد. پاسخ‌های ریاضی و متن‌هایی که ترجمه شده‌اند هم کمتر قابل شناسایی‌اند. شرکت تصریح کرده که بازنویسی یا ترجمه می‌تواند واترمارک را کاملاً حذف کند.

نبودِ واترمارک یعنی نوشته‌ی انسان؟

خیر. این یکی از مهم‌ترین نکته‌هاست. اگر در متنی واترمارک پیدا نشود، نمی‌توان نتیجه گرفت که انسان آن را نوشته است. ممکن است متن با مدلی دیگر ساخته شده باشد، ویرایش سنگین شده باشد یا کوتاه‌تر از آن باشد که تشخیص‌پذیر باشد. برای همین واترمارک را باید یک قرینه دانست و نه حکم قطعی.

بخش پنجم — چه کسی می‌تواند متن را بررسی کند؟

برخلاف تصور بسیاری، فعلاً هر کسی نمی‌تواند متن را در یک سایت بیندازد و بفهمد واترمارک دارد یا نه. شرکت گفته به‌دلیل همین محدودیت‌ها، دسترسی اولیه به تشخیص‌دهنده را فقط به پژوهشگران تأییدشده و سازمان‌های متخصص می‌دهد. یعنی مدرسه، دانشگاه یا کارفرما در مرحله‌ی اول ابزار عمومی در اختیار ندارند.

این تصمیم هم مزیت دارد و هم ایراد. مزیتش این است که از اتهام‌زنی هیجانی و اشتباه به دانشجویان و نویسندگان جلوگیری می‌کند. ایرادش این است که شفافیتی که قانون دنبالش بود، فعلاً برای مردم عادی کامل نیست. باید دید در ماه‌های آینده دسترسی گسترده‌تر می‌شود یا نه.

افت نرخ تشخیص واترمارک متنی هوش مصنوعی پس از جایگزینی ده درصد واژه‌ها با مترادف

بخش ششم — برای کاربران عادی و تولیدکنندگان محتوا چه تغییری می‌کند؟

کسانی که در اروپا از ChatGPT برای نوشتن ایمیل، مقاله یا کد استفاده می‌کنند، بعد از فعال‌شدن این سیستم متنی تحویل می‌گیرند که از نظر ظاهری هیچ فرقی ندارد. هیچ هشدار یا برچسبی در صفحه نمایش داده نمی‌شود. تغییر در لایه‌ی آماری متن است و برای چشم دیده نمی‌شود.

برای تولیدکنندگان محتوا یک اصل ساده همچنان برقرار است: هوش مصنوعی ابزار نوشتن است، نه جایگزین قضاوت نویسنده. اگر برای ایده‌پردازی یا پیش‌نویس از آن کمک می‌گیرید، بازنویسی و افزودن تجربه‌ی شخصی کیفیت کار را بالا می‌برد. برای آموزش درست پرامپت‌نویسی می‌توانید مطلب آموزش نوشتن پرامپت برای مبتدیان را بخوانید و مجموعه‌ی آموزش‌های ChatGPT را هم دنبال کنید.

برای کاربران ایرانی که مشمول مقررات اروپا نیستند، فعلاً تغییر مستقیمی در تجربه‌ی استفاده ایجاد نمی‌شود. اما روند جهانی روشن است: شفافیت درباره‌ی محتوای تولیدشده توسط هوش مصنوعی به یک الزام قانونی تبدیل می‌شود و احتمالاً ابزارهای بیشتری به آن می‌پیوندند.

بخش هفتم — تأثیر روی کسب‌وکار و توسعه‌دهندگان

برای شرکت‌هایی که محتوا یا خدمات خودکار تولید می‌کنند، این خبر یک هشدار عملی است. اگر مخاطبان شما در اروپا هستند، باید بدانید که متن‌های تولیدشده توسط این مدل‌ها ممکن است قابل نشان‌گذاری باشند و رعایت شفافیت از طرف خود شما هم اهمیت دارد. درباره‌ی نقش هوش مصنوعی در کسب‌وکار، مطلب اهمیت هوش مصنوعی در کسب‌وکار دید کلی‌تری می‌دهد.

توسعه‌دهندگان API نیز گزینه‌ی روشن‌کردن واترمارک را دارند. این گزینه برای محصولاتی که می‌خواهند منشأ متن را بعدها اثبات کنند یا از مقررات پیش‌رو عقب نمانند، می‌تواند مفید باشد. با این حال چون هنوز فقط برای برخی مدل‌ها در دسترس است و محدودیت‌های تشخیص دارد، نباید تنها لایه‌ی راستی‌آزمایی باشد.

در نگاه کلان‌تر، این ماجرا یادآور محدودیت‌های واقعی هوش مصنوعی است؛ موضوعی که در مطلب پتانسیل و محدودیت‌های واقعی هوش مصنوعی به آن پرداخته‌ایم. هیچ فناوری‌ای، حتی واترمارک، جادو نیست و هر ابزاری نقاط ضعف خودش را دارد.

بخش هشتم — تحلیل؛ آیا واترمارک متنی آینده‌ی اعتماد را می‌سازد؟

به‌نظر می‌رسد دو شرکت بزرگ، OpenAI و آنتروپیک، حالا مسیر مشابهی را انتخاب کرده‌اند. این هم‌راستایی مهم است، چون اگر فقط یک شرکت واترمارک بگذارد، کاربرانی که نمی‌خواهند نشانه‌گذاری شوند به سراغ رقیب می‌روند. حالا که قانون اروپا الزام ایجاد کرده، این رقابت منفی تا حدی خنثی می‌شود.

اما چالش اصلی همچنان باقی است: هر کسی که بخواهد، با بازنویسی، ترجمه یا عبور متن از مدل دیگر می‌تواند اثر واترمارک را کم کند. بنابراین واترمارک بیشتر به درد شناسایی استفاده‌ی عادی و بدون دقت می‌خورد و جلوی کاربر عمدی را نمی‌گیرد. این یک واقعیت است که خود OpenAI هم آن را پنهان نکرده.

در نهایت، ارزش واقعی این حرکت شاید در همین صداقت باشد: شرکت از ابتدا محدودیت‌ها را اعلام کرده و دسترسی را فقط به متخصصان داده است. اگر این رویکرد ادامه پیدا کند، می‌تواند پایه‌ای برای اعتماد تدریجی میان کاربران، دانشگاه‌ها و رسانه‌ها باشد.

پرسش‌های متداول (FAQ)

textGrain چیست؟

روشی از OpenAI برای قراردادن امضای نامرئی در متن‌های تولیدشده توسط هوش مصنوعی است که از طریق هدایت ریز انتخاب واژه‌ها و با یک کلید مخفی کار می‌کند.

آیا واترمارک روی کیفیت پاسخ‌ها اثر می‌گذارد؟

بر اساس توضیحات منتشرشده، تغییرات بسیار ریز هستند و خواننده‌ی عادی تفاوتی در متن حس نمی‌کند.

آیا این قابلیت در ایران هم فعال است؟

اعلام رسمی درباره‌ی اتحادیه اروپاست. در سطح جهانی فقط توسعه‌دهندگان API می‌توانند آن را به‌صورت اختیاری برای برخی مدل‌ها فعال کنند.

آیا می‌توان واترمارک را حذف کرد؟

خود شرکت می‌گوید بازنویسی یا ترجمه می‌تواند آن را کاملاً از بین ببرد و جایگزینی ده درصد از واژه‌ها نرخ تشخیص را از حدود ۹۲ به ۶۶ درصد می‌رساند.

نبودِ واترمارک ثابت می‌کند متن را انسان نوشته است؟

خیر. نبودن واترمارک نه اثبات نویسنده‌ی انسانی است و نه اثبات اینکه هوش مصنوعی استفاده نشده است.

چه کسانی می‌توانند متن را بررسی کنند؟

فعلاً دسترسی اولیه به تشخیص‌دهنده فقط برای پژوهشگران تأییدشده و سازمان‌های متخصص است.

جمع‌بندی. رونمایی از textGrain نشان می‌دهد نشان‌گذاری محتوای هوش مصنوعی از بحث نظری به واقعیت قانونی رسیده است. این سیستم هنوز محدودیت‌های جدی دارد و جایگزین قضاوت انسان نیست، اما قدمی به‌سوی شفافیت بیشتر است. برای دنبال‌کردن داغ‌ترین اخبار هوش مصنوعی، کانال @MrChatGPT_IR را در تلگرام دنبال کنید و برای خبرهای بیشتر به بخش اخبار سر بزنید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

— (0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *