ردپای نوشتاری هوش مصنوعی؛ کلود و جی‌پی‌تی چطور لو می‌روند؟

اخبار · هوش مصنوعی

یک پژوهش تازه نشان داده مدل‌های بزرگ زبانی، از کلود گرفته تا جی‌پی‌تی، هرکدام یک «لهجهٔ» نوشتاری مخصوص خودشان دارند که حتی با بازنویسی هم پاک نمی‌شود.

چکیده. شرکت بازاریابی Graphite با مقایسهٔ ده‌هزار مقالهٔ انسانی پیش از دوران چت‌جی‌پی‌تی با بازنویسی همان متن‌ها توسط مدل‌های مختلف، فهرستی از حدود ۱۳هزار عبارت پیدا کرده که در متن‌های هوش مصنوعی دست‌کم دو برابر پرتکرارتر از نوشتار انسانی هستند. کلود Opus 5.5 عاشق جملهٔ «این مهم است» و کلمهٔ «قابل‌اعتماد» شده، مدل Astra اوپن‌ای‌آی به عبارت «یک بُعد دیگر» و قیدوشرط‌های فراوان علاقه دارد، و خط‌تیرهٔ بلند که زمانی نشانهٔ کلاسیک متن‌های تولیدشده با هوش مصنوعی بود، تقریباً از نسخه‌های جدید کلود حذف شده است. این یافته‌ها هم برای کسانی که دنبال تشخیص محتوای هوش مصنوعی هستند کاربردی است و هم برای کسانی که با این ابزارها می‌نویسند و می‌خواهند لحن طبیعی‌تری داشته باشند.
نمودار ردپاهای نوشتاری کلود Opus 5.5 در پژوهش Graphite دربارهٔ تشخیص متن هوش مصنوعی

۱. یک پژوهش عجیب دربارهٔ لحن هوش مصنوعی

فرض کنید هزاران مقاله را به چند مدل هوش مصنوعی بدهید تا دوباره بنویسند، بعد متن‌های تازه را با نسخهٔ اصلیِ انسانی مقایسه کنید. دقیقاً همین کار را شرکت بازاریابی Graphite انجام داد. آن‌ها ده‌هزار مقالهٔ متعلق به دوران پیش از چت‌جی‌پی‌تی را به‌عنوان نمونهٔ «نوشتار خالص انسانی» کنار گذاشتند، همان متن‌ها را به چند مدل بزرگ زبانی دادند تا بازنویسی کنند، و بعد فراوانیِ کلمه‌به‌کلمهٔ هر دو نسخه را با هم مقایسه کردند.

نتیجه برایشان هم تا حدی غافلگیرکننده بود: با وجود همهٔ ادعاهای شرکت‌های هوش مصنوعی دربارهٔ «نوشتن کاملاً طبیعی و انسانی»، هر مدل یک دسته عبارت و کلمهٔ مشخص دارد که به‌طرز عجیبی بیشتر از حد معمول استفاده می‌کند؛ درست مثل لهجه‌ای که هرچقدر هم تلاش کنی پنهانش کنی، باز لو می‌رود. این موضوع به‌خصوص برای خواننده‌های فارسی‌زبانی که روزانه با متن‌های تولیدشده توسط هوش مصنوعی سروکار دارند، نکتهٔ تازه و کاربردی‌ای به‌حساب می‌آید.

۲. چطور Graphite این ردپاها را پیدا کرد

روش کار این پژوهش زیاد پیچیده نبود، اما مقیاسش بزرگ بود. تیم Graphite با مقایسهٔ فراوانی عبارت‌ها در دو مجموعهٔ متن (نسخهٔ انسانی در برابر نسخهٔ بازنویسی‌شده توسط هوش مصنوعی)، هر عبارتی را که دست‌کم دو برابر بیشتر در متن‌های هوش مصنوعی ظاهر می‌شد، ثبت کردند. در نهایت فهرستی نزدیک به ۱۳هزار عبارت به دست آمد که می‌توان آن‌ها را «امضای زبانی» هر مدل دانست؛ فهرستی که به گفتهٔ محققان، دقیق‌تر از هر حدس‌وگمان کلی دربارهٔ لحن هوش مصنوعی است.

گرگ دراک، مسئول هوش مصنوعی Graphite، دربارهٔ این یافته گفته با وجود تلاش زیاد آزمایشگاه‌های هوش مصنوعی برای طبیعی‌تر کردن لحن مدل‌ها، کنترل کامل میلیاردها پارامتر هنوز ممکن نیست و همیشه چیزی از زیر دستشان در می‌رود. به بیان او، «چیزهایی همیشه از لابه‌لای مدل بیرون می‌زنند»، حتی وقتی تیم‌های مهندسی تلاش زیادی برای حذف آن‌ها کرده باشند.

۳. عبارت‌های محبوب کلود Opus 5.5

در میان همهٔ مدل‌های بررسی‌شده، کلود Opus 5.5 شاید عجیب‌ترین و در عین حال قابل‌پیش‌بینی‌ترین الگو را داشته باشد. طبق دادهٔ Graphite، این مدل عبارت «این مهم است» را ۱۱۶ برابر بیشتر از یک نویسندهٔ معمولی انسانی به‌کار می‌برد. ساختار مشابه «چرا X مهم است» هم با فاصلهٔ کمی پشت سر آن، ۹۲ برابر پرتکرارتر از نوشتار انسانی ظاهر می‌شود؛ انگار این مدل همیشه نگران است که خواننده اهمیت موضوع را درک نکند.

کلمهٔ «قابل‌اعتماد» هم یکی دیگر از نشانه‌های کلود Opus 5.5 است؛ این مدل آن را حدود ۲۳ برابر بیشتر از حد معمول به‌کار می‌برد. یک ساختار جمله‌ای دیگر هم در متن‌های این مدل زیاد دیده می‌شود: «X چیزی بیش از یک Y نیست، بلکه یک Z است»، الگویی که به‌خصوص در توضیح مفاهیم انتزاعی و جمع‌بندی بخش‌های پایانی زیاد سراغش می‌رود.

۴. مدل Astra اوپن‌ای‌آی و لحن خاص خودش

مدل Astra از اوپن‌ای‌آی هم لحن مخصوص به خودش را دارد، فقط با عبارت‌های کاملاً متفاوت. این مدل عاشق اشاره به «یک بُعد دیگر» است و از قیدوشرط‌های احتیاط‌آمیزی مثل «می‌تواند ارائه دهد» یا «شاید ارائه دهد» زیاد استفاده می‌کند؛ لحنی که بیشتر شبیه گزارش رسمی و محتاطانه است تا نوشتار روان و مستقیم.

نشانهٔ دیگر Astra چیزی است که محققان آن را «قاب‌بندی اصلاحی» نامیده‌اند: جمله‌هایی که یک مفهوم را با رد کردن معنای ساده‌ترش تعریف می‌کنند، مثلاً «این فقط X نیست» پیش از رسیدن به توضیح اصلی. این الگو بیش از صد برابر بیشتر از نوشتار انسانی در متن‌های Astra دیده می‌شود و یکی از پرتکرارترین نشانه‌های شناسایی‌شده در کل این پژوهش است.

۵. خط‌تیرهٔ بلند؛ نشانه‌ای که دیگر کار نمی‌کند

تا همین چند فصل پیش، خط‌تیرهٔ بلند (—) یکی از شناخته‌شده‌ترین نشانه‌های متن تولیدشده با هوش مصنوعی بود؛ آن‌قدر که خیلی از کاربران صرفاً با دیدن همین علامت، یک متن را «مشکوک» می‌دانستند و حتی در شبکه‌های اجتماعی هم به شوخی دربارهٔ آن صحبت می‌شد. اما طبق دادهٔ Graphite، این نشانه دیگر چندان قابل‌اعتماد نیست؛ کلود Opus 5.5 نسبت به نسخهٔ قبلی خودش استفاده از خط‌تیرهٔ بلند را نزدیک به ۹۹ درصد کاهش داده است.

این موضوع نشان می‌دهد آزمایشگاه‌های هوش مصنوعی به‌طور فعال روی نشانه‌های شناخته‌شده کار می‌کنند و آن‌ها را اصلاح می‌کنند؛ اما همزمان، چون کنترل کامل هزاران پارامتر دیگر عملاً غیرممکن است، نشانه‌های تازه‌ای مثل همین «این مهم است» یا «یک بُعد دیگر» جای آن‌ها را می‌گیرند. به عبارت دیگر، بازی موش‌وگربهٔ تشخیص متن هوش مصنوعی هیچ‌وقت واقعاً تمام نمی‌شود، فقط نشانه‌ها عوض می‌شوند.

۶. چرا کنترل کامل لحن هوش مصنوعی این‌قدر سخت است

شاید این سؤال پیش بیاید که چرا شرکت‌هایی با این حجم از منابع و مهندس، نمی‌توانند جلوی تکرار چند عبارت ساده را بگیرند. پاسخ به ماهیت خود مدل‌های زبانی برمی‌گردد: این مدل‌ها بر اساس الگوهای آماری در داده‌های آموزشی‌شان پاسخ تولید می‌کنند، نه با قوانین دستی و ثابت. وقتی مدلی روی مقدار زیادی متن با یک لحن خاص (مثلاً توضیحی و آموزشی) تنظیم دقیق می‌شود، همان لحن به‌صورت ناخواسته در عبارت‌های تکراری هم بروز پیدا می‌کند. اگر به منطق آماری پشت این مدل‌ها علاقه دارید، در مقالهٔ آشنایی با اوپن‌ای‌آی و فناوری پشت آن به زبان ساده توضیح داده‌ایم.

این موضوع یک بار دیگر محدودیت‌های واقعی هوش مصنوعی امروز را یادآوری می‌کند؛ ابزاری قدرتمند اما نه بی‌نقص و نه قابل کنترل صددرصدی. برای نگاهی دقیق‌تر به این محدودیت‌ها و در کنارش توانایی‌های واقعی هوش مصنوعی، پتانسیل واقعی و محدودیت‌های هوش مصنوعی را هم بخوانید.

مقایسه عبارت‌های تکراری مدل Astra اوپن‌ای‌آی و کلود در نوشتار هوش مصنوعی

۷. این یافته‌ها برای نویسنده‌ها و کسب‌وکارها چه معنایی دارد

اگر از هوش مصنوعی برای نوشتن محتوای سایت، شبکه‌های اجتماعی یا حتی ایمیل‌های کاری استفاده می‌کنید، این فهرست عملاً یک چک‌لیست رایگان برای ویرایش نهایی است. حذف یا کم‌کردن عبارت‌هایی مثل «این مهم است»، «قابل‌اعتماد» یا جمله‌های «X چیزی بیش از Y نیست» می‌تواند متن را طبیعی‌تر و کمتر «ماشینی» نشان دهد؛ نکته‌ای که به‌خصوص برای کسب‌وکارهایی که به اعتبار برندشان در محتوا اهمیت می‌دهند حیاتی است. دربارهٔ اهمیت هوش مصنوعی در فضای کسب‌وکار امروز، چرا هوش مصنوعی برای کسب‌وکار ۲۰۲۵ مهم است را از دست ندهید.

از طرف دیگر، این یافته‌ها به تیم‌های محتوا، ناشران و حتی موتورهای جست‌وجو کمک می‌کند تشخیص دهند یک متن احتمالاً با چه مدلی نوشته شده، بدون نیاز به ابزارهای پیچیده و گاه غیردقیق تشخیص هوش مصنوعی که این روزها زیاد شده‌اند.

تفاوت لحن کلود و جی‌پی‌تی در عمل

اگر تا امروز هم کلود و هم جی‌پی‌تی را برای نوشتن امتحان کرده باشید، احتمالاً به‌طور ناخودآگاه همین تفاوت لحن را حس کرده‌اید، حتی اگر نمی‌توانستید دقیقاً بگویید چیست. برای مقایسه‌ای کاربردی‌تر از عملکرد این دو مدل در یک زمینهٔ کاملاً متفاوت، مقایسهٔ چت‌جی‌پی‌تی و دیپ‌سیک در شطرنج هم نمونهٔ جالبی از تفاوت «شخصیت» مدل‌های مختلف در میدانی کاملاً متفاوت است.

۸. چطور خودمان جلوی لحن ماشینی در نوشته‌هایمان را بگیریم

خبر خوب این است که با کمی دقت در پرامپت‌نویسی می‌توان بسیاری از این ردپاهای تکراری را کم کرد. مثلاً می‌توانید مستقیماً در پرامپت از مدل بخواهید از عبارت‌های کلیشه‌ای مثل «این مهم است» یا ساختارهای «X نه، بلکه Y» پرهیز کند، یا از او بخواهید لحنش را به سبک نوشتاری خودتان نزدیک‌تر کند. اگر تازه‌کار پرامپت‌نویسی هستید، راهنمای نوشتن پرامپت برای مبتدیان نقطهٔ شروع خوبی است.

برای یادگیری عمیق‌تر و دنبال‌کردن چنین نکته‌های کاربردی دربارهٔ پرامپت‌نویسی و تکنیک‌های نوشتن بهتر با هوش مصنوعی، سری آموزشی ما در بخش آموزش چت‌جی‌پی‌تی به‌صورت منظم به‌روزرسانی می‌شود.

مرز بین کمک گرفتن و جایگزین شدن

نکتهٔ مهم دیگر این است که هدف از این پژوهش، ترساندن از استفاده از هوش مصنوعی نیست، بلکه کمک به استفادهٔ هوشمندانه‌تر از آن است. استفاده از هوش مصنوعی به‌عنوان دستیار نویسندگی، با جایگزین کردن کامل آن به‌جای تفکر و تخصص انسانی فرق دارد؛ تفاوتی که در توهم هوش مصنوعی؛ توسعه‌دهندهٔ تنها در برابر مهندس واقعی هم از زاویه‌ای دیگر بررسی شده است و ارزش خواندن دارد.

راهنمای تشخیص متن نوشته‌شده با هوش مصنوعی بر اساس پژوهش Graphite

سوالات متداول

آیا می‌توان با دیدن همین عبارت‌ها مطمئن شد یک متن را هوش مصنوعی نوشته؟

نه، صددرصد نمی‌توان. وجود این عبارت‌ها احتمال نوشته‌شدن متن توسط هوش مصنوعی را بالا می‌برد، اما چون انسان‌ها هم گاهی همین عبارت‌ها را به‌کار می‌برند، نمی‌توان آن را به‌تنهایی یک مدرک قطعی دانست.

آیا این ردپاها در نسخه‌های بعدی مدل‌ها هم باقی می‌مانند؟

بعید است. همان‌طور که خط‌تیرهٔ بلند تقریباً از کلود Opus 5.5 حذف شد، احتمالاً آزمایشگاه‌ها در نسخه‌های آینده همین عبارت‌های تازه را هم اصلاح کنند و نشانه‌های جدیدی جای آن‌ها را بگیرد.

چرا شرکت Graphite این پژوهش را انجام داده؟

Graphite در حوزهٔ بازاریابی محتوا فعالیت می‌کند و برای مشتریانش به ابزارهایی برای تشخیص و بهبود کیفیت محتوای تولیدشده با هوش مصنوعی نیاز دارد؛ همین نیاز باعث شده این فهرست بزرگ از عبارت‌های تکراری را استخراج کنند و آن را عمومی منتشر کنند.

آیا همهٔ مدل‌های هوش مصنوعی همین ردپاها را دارند؟

خیر، هرکدام الگوی خاص خودشان را دارند. کلود Opus 5.5 و Astra اوپن‌ای‌آی دو نمونهٔ اصلی بررسی‌شده در این گزارش بودند، اما Graphite برای مدل‌های دیگر هم الگوهای مشابه و متفاوتی ثبت کرده است که می‌تواند موضوع گزارش‌های بعدی باشد.

این پژوهش یک یادآوری ساده اما مهم است: هر چقدر هم هوش مصنوعی پیشرفت کند، هنوز یک «امضای» قابل‌ردیابی از خودش به‌جا می‌گذارد. دنبال‌کردن چنین جزئیاتی می‌تواند هم به نویسنده‌ها در تولید محتوای طبیعی‌تر و باورپذیرتر کمک کند و هم به خواننده‌ها در تشخیص منبع واقعی یک متن. برای آخرین اخبار هوش مصنوعی و این‌جور نکات کاربردی، بخش اخبار مرچت‌جی‌پی‌تی را دنبال کنید و در کانال تلگرام @MrChatGPT_IR هم همراه ما باشید.

نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید

— (0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *