یک پژوهش تازه نشان داده مدلهای بزرگ زبانی، از کلود گرفته تا جیپیتی، هرکدام یک «لهجهٔ» نوشتاری مخصوص خودشان دارند که حتی با بازنویسی هم پاک نمیشود.

لیست مطالب
۱. یک پژوهش عجیب دربارهٔ لحن هوش مصنوعی
فرض کنید هزاران مقاله را به چند مدل هوش مصنوعی بدهید تا دوباره بنویسند، بعد متنهای تازه را با نسخهٔ اصلیِ انسانی مقایسه کنید. دقیقاً همین کار را شرکت بازاریابی Graphite انجام داد. آنها دههزار مقالهٔ متعلق به دوران پیش از چتجیپیتی را بهعنوان نمونهٔ «نوشتار خالص انسانی» کنار گذاشتند، همان متنها را به چند مدل بزرگ زبانی دادند تا بازنویسی کنند، و بعد فراوانیِ کلمهبهکلمهٔ هر دو نسخه را با هم مقایسه کردند.
نتیجه برایشان هم تا حدی غافلگیرکننده بود: با وجود همهٔ ادعاهای شرکتهای هوش مصنوعی دربارهٔ «نوشتن کاملاً طبیعی و انسانی»، هر مدل یک دسته عبارت و کلمهٔ مشخص دارد که بهطرز عجیبی بیشتر از حد معمول استفاده میکند؛ درست مثل لهجهای که هرچقدر هم تلاش کنی پنهانش کنی، باز لو میرود. این موضوع بهخصوص برای خوانندههای فارسیزبانی که روزانه با متنهای تولیدشده توسط هوش مصنوعی سروکار دارند، نکتهٔ تازه و کاربردیای بهحساب میآید.
۲. چطور Graphite این ردپاها را پیدا کرد
روش کار این پژوهش زیاد پیچیده نبود، اما مقیاسش بزرگ بود. تیم Graphite با مقایسهٔ فراوانی عبارتها در دو مجموعهٔ متن (نسخهٔ انسانی در برابر نسخهٔ بازنویسیشده توسط هوش مصنوعی)، هر عبارتی را که دستکم دو برابر بیشتر در متنهای هوش مصنوعی ظاهر میشد، ثبت کردند. در نهایت فهرستی نزدیک به ۱۳هزار عبارت به دست آمد که میتوان آنها را «امضای زبانی» هر مدل دانست؛ فهرستی که به گفتهٔ محققان، دقیقتر از هر حدسوگمان کلی دربارهٔ لحن هوش مصنوعی است.
گرگ دراک، مسئول هوش مصنوعی Graphite، دربارهٔ این یافته گفته با وجود تلاش زیاد آزمایشگاههای هوش مصنوعی برای طبیعیتر کردن لحن مدلها، کنترل کامل میلیاردها پارامتر هنوز ممکن نیست و همیشه چیزی از زیر دستشان در میرود. به بیان او، «چیزهایی همیشه از لابهلای مدل بیرون میزنند»، حتی وقتی تیمهای مهندسی تلاش زیادی برای حذف آنها کرده باشند.
۳. عبارتهای محبوب کلود Opus 5.5
در میان همهٔ مدلهای بررسیشده، کلود Opus 5.5 شاید عجیبترین و در عین حال قابلپیشبینیترین الگو را داشته باشد. طبق دادهٔ Graphite، این مدل عبارت «این مهم است» را ۱۱۶ برابر بیشتر از یک نویسندهٔ معمولی انسانی بهکار میبرد. ساختار مشابه «چرا X مهم است» هم با فاصلهٔ کمی پشت سر آن، ۹۲ برابر پرتکرارتر از نوشتار انسانی ظاهر میشود؛ انگار این مدل همیشه نگران است که خواننده اهمیت موضوع را درک نکند.
کلمهٔ «قابلاعتماد» هم یکی دیگر از نشانههای کلود Opus 5.5 است؛ این مدل آن را حدود ۲۳ برابر بیشتر از حد معمول بهکار میبرد. یک ساختار جملهای دیگر هم در متنهای این مدل زیاد دیده میشود: «X چیزی بیش از یک Y نیست، بلکه یک Z است»، الگویی که بهخصوص در توضیح مفاهیم انتزاعی و جمعبندی بخشهای پایانی زیاد سراغش میرود.
۴. مدل Astra اوپنایآی و لحن خاص خودش
مدل Astra از اوپنایآی هم لحن مخصوص به خودش را دارد، فقط با عبارتهای کاملاً متفاوت. این مدل عاشق اشاره به «یک بُعد دیگر» است و از قیدوشرطهای احتیاطآمیزی مثل «میتواند ارائه دهد» یا «شاید ارائه دهد» زیاد استفاده میکند؛ لحنی که بیشتر شبیه گزارش رسمی و محتاطانه است تا نوشتار روان و مستقیم.
نشانهٔ دیگر Astra چیزی است که محققان آن را «قاببندی اصلاحی» نامیدهاند: جملههایی که یک مفهوم را با رد کردن معنای سادهترش تعریف میکنند، مثلاً «این فقط X نیست» پیش از رسیدن به توضیح اصلی. این الگو بیش از صد برابر بیشتر از نوشتار انسانی در متنهای Astra دیده میشود و یکی از پرتکرارترین نشانههای شناساییشده در کل این پژوهش است.
۵. خطتیرهٔ بلند؛ نشانهای که دیگر کار نمیکند
تا همین چند فصل پیش، خطتیرهٔ بلند (—) یکی از شناختهشدهترین نشانههای متن تولیدشده با هوش مصنوعی بود؛ آنقدر که خیلی از کاربران صرفاً با دیدن همین علامت، یک متن را «مشکوک» میدانستند و حتی در شبکههای اجتماعی هم به شوخی دربارهٔ آن صحبت میشد. اما طبق دادهٔ Graphite، این نشانه دیگر چندان قابلاعتماد نیست؛ کلود Opus 5.5 نسبت به نسخهٔ قبلی خودش استفاده از خطتیرهٔ بلند را نزدیک به ۹۹ درصد کاهش داده است.
این موضوع نشان میدهد آزمایشگاههای هوش مصنوعی بهطور فعال روی نشانههای شناختهشده کار میکنند و آنها را اصلاح میکنند؛ اما همزمان، چون کنترل کامل هزاران پارامتر دیگر عملاً غیرممکن است، نشانههای تازهای مثل همین «این مهم است» یا «یک بُعد دیگر» جای آنها را میگیرند. به عبارت دیگر، بازی موشوگربهٔ تشخیص متن هوش مصنوعی هیچوقت واقعاً تمام نمیشود، فقط نشانهها عوض میشوند.
۶. چرا کنترل کامل لحن هوش مصنوعی اینقدر سخت است
شاید این سؤال پیش بیاید که چرا شرکتهایی با این حجم از منابع و مهندس، نمیتوانند جلوی تکرار چند عبارت ساده را بگیرند. پاسخ به ماهیت خود مدلهای زبانی برمیگردد: این مدلها بر اساس الگوهای آماری در دادههای آموزشیشان پاسخ تولید میکنند، نه با قوانین دستی و ثابت. وقتی مدلی روی مقدار زیادی متن با یک لحن خاص (مثلاً توضیحی و آموزشی) تنظیم دقیق میشود، همان لحن بهصورت ناخواسته در عبارتهای تکراری هم بروز پیدا میکند. اگر به منطق آماری پشت این مدلها علاقه دارید، در مقالهٔ آشنایی با اوپنایآی و فناوری پشت آن به زبان ساده توضیح دادهایم.
این موضوع یک بار دیگر محدودیتهای واقعی هوش مصنوعی امروز را یادآوری میکند؛ ابزاری قدرتمند اما نه بینقص و نه قابل کنترل صددرصدی. برای نگاهی دقیقتر به این محدودیتها و در کنارش تواناییهای واقعی هوش مصنوعی، پتانسیل واقعی و محدودیتهای هوش مصنوعی را هم بخوانید.

۷. این یافتهها برای نویسندهها و کسبوکارها چه معنایی دارد
اگر از هوش مصنوعی برای نوشتن محتوای سایت، شبکههای اجتماعی یا حتی ایمیلهای کاری استفاده میکنید، این فهرست عملاً یک چکلیست رایگان برای ویرایش نهایی است. حذف یا کمکردن عبارتهایی مثل «این مهم است»، «قابلاعتماد» یا جملههای «X چیزی بیش از Y نیست» میتواند متن را طبیعیتر و کمتر «ماشینی» نشان دهد؛ نکتهای که بهخصوص برای کسبوکارهایی که به اعتبار برندشان در محتوا اهمیت میدهند حیاتی است. دربارهٔ اهمیت هوش مصنوعی در فضای کسبوکار امروز، چرا هوش مصنوعی برای کسبوکار ۲۰۲۵ مهم است را از دست ندهید.
از طرف دیگر، این یافتهها به تیمهای محتوا، ناشران و حتی موتورهای جستوجو کمک میکند تشخیص دهند یک متن احتمالاً با چه مدلی نوشته شده، بدون نیاز به ابزارهای پیچیده و گاه غیردقیق تشخیص هوش مصنوعی که این روزها زیاد شدهاند.
تفاوت لحن کلود و جیپیتی در عمل
اگر تا امروز هم کلود و هم جیپیتی را برای نوشتن امتحان کرده باشید، احتمالاً بهطور ناخودآگاه همین تفاوت لحن را حس کردهاید، حتی اگر نمیتوانستید دقیقاً بگویید چیست. برای مقایسهای کاربردیتر از عملکرد این دو مدل در یک زمینهٔ کاملاً متفاوت، مقایسهٔ چتجیپیتی و دیپسیک در شطرنج هم نمونهٔ جالبی از تفاوت «شخصیت» مدلهای مختلف در میدانی کاملاً متفاوت است.
۸. چطور خودمان جلوی لحن ماشینی در نوشتههایمان را بگیریم
خبر خوب این است که با کمی دقت در پرامپتنویسی میتوان بسیاری از این ردپاهای تکراری را کم کرد. مثلاً میتوانید مستقیماً در پرامپت از مدل بخواهید از عبارتهای کلیشهای مثل «این مهم است» یا ساختارهای «X نه، بلکه Y» پرهیز کند، یا از او بخواهید لحنش را به سبک نوشتاری خودتان نزدیکتر کند. اگر تازهکار پرامپتنویسی هستید، راهنمای نوشتن پرامپت برای مبتدیان نقطهٔ شروع خوبی است.
برای یادگیری عمیقتر و دنبالکردن چنین نکتههای کاربردی دربارهٔ پرامپتنویسی و تکنیکهای نوشتن بهتر با هوش مصنوعی، سری آموزشی ما در بخش آموزش چتجیپیتی بهصورت منظم بهروزرسانی میشود.
مرز بین کمک گرفتن و جایگزین شدن
نکتهٔ مهم دیگر این است که هدف از این پژوهش، ترساندن از استفاده از هوش مصنوعی نیست، بلکه کمک به استفادهٔ هوشمندانهتر از آن است. استفاده از هوش مصنوعی بهعنوان دستیار نویسندگی، با جایگزین کردن کامل آن بهجای تفکر و تخصص انسانی فرق دارد؛ تفاوتی که در توهم هوش مصنوعی؛ توسعهدهندهٔ تنها در برابر مهندس واقعی هم از زاویهای دیگر بررسی شده است و ارزش خواندن دارد.

سوالات متداول
آیا میتوان با دیدن همین عبارتها مطمئن شد یک متن را هوش مصنوعی نوشته؟
نه، صددرصد نمیتوان. وجود این عبارتها احتمال نوشتهشدن متن توسط هوش مصنوعی را بالا میبرد، اما چون انسانها هم گاهی همین عبارتها را بهکار میبرند، نمیتوان آن را بهتنهایی یک مدرک قطعی دانست.
آیا این ردپاها در نسخههای بعدی مدلها هم باقی میمانند؟
بعید است. همانطور که خطتیرهٔ بلند تقریباً از کلود Opus 5.5 حذف شد، احتمالاً آزمایشگاهها در نسخههای آینده همین عبارتهای تازه را هم اصلاح کنند و نشانههای جدیدی جای آنها را بگیرد.
چرا شرکت Graphite این پژوهش را انجام داده؟
Graphite در حوزهٔ بازاریابی محتوا فعالیت میکند و برای مشتریانش به ابزارهایی برای تشخیص و بهبود کیفیت محتوای تولیدشده با هوش مصنوعی نیاز دارد؛ همین نیاز باعث شده این فهرست بزرگ از عبارتهای تکراری را استخراج کنند و آن را عمومی منتشر کنند.
آیا همهٔ مدلهای هوش مصنوعی همین ردپاها را دارند؟
خیر، هرکدام الگوی خاص خودشان را دارند. کلود Opus 5.5 و Astra اوپنایآی دو نمونهٔ اصلی بررسیشده در این گزارش بودند، اما Graphite برای مدلهای دیگر هم الگوهای مشابه و متفاوتی ثبت کرده است که میتواند موضوع گزارشهای بعدی باشد.
نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید
