بیشتر ما وقتی از یک مدل زبانی نظر میخواهیم، ناخودآگاه جوابی میگیریم که خوشایند است، نه جوابی که درست است. تکنیک «استیلمن» دقیقاً برای شکستن همین چرخه ساخته شده: بهجای اینکه دیدگاه مخالف را ضعیف و مسخره نشان دهی، از مدل میخواهی قویترین و منصفانهترین نسخهی ممکن از آن را بسازد. نتیجه، خروجیای است که بهجای تأیید کردن تو، فکر کردن تو را جلو میبرد.

لیست مطالب
۱) استیلمن چیست؟
استیلمن (Steelman) یعنی پیش از نقد کردن یک دیدگاه، آن را در قویترین، منسجمترین و منصفانهترین شکل ممکنش بازسازی کنی. معیار موفقیت هم ساده است: اگر جدیترین طرفدار آن دیدگاه نسخهی بازسازیشدهی تو را بخواند، باید بگوید «بله، دقیقاً همین را میگویم؛ حتی بهتر از خودم گفتی.»
این کار یک ژست اخلاقی نیست، یک ابزار شناختی است. تا وقتی نسخهی ضعیف یک استدلال را نقد میکنی، نمیفهمی چرا آدمهای باهوش هنوز به آن باور دارند؛ و دقیقاً همانجا ریسک تصمیم تو پنهان شده است.
۲) تفاوت استیلمن با استرامن (مغالطهی مترسکی)
نقطهی مقابل استیلمن، «استرامن» یا مغالطهی مترسکی است: ساختن یک نسخهی مقوایی و آسانشکن از حرف طرف مقابل و بعد پیروزمندانه فرو ریختن آن. مترسک را میسازی تا راحت بزنیاش، ولی چیزی که فرو میریزد اصلاً حرف واقعی مخالف نبوده است.
- استرامن: «مخالفان دورکاری فکر میکنند کارمند باید زیر نظر باشد چون به کسی اعتماد ندارند.»
- استیلمن: «مخالفان دورکاری میگویند انتقال دانش ضمنی، آموزش نیروی تازهکار و شکلگیری اعتماد بینتیمی در تعامل حضوریِ برنامهریزینشده اتفاق میافتد و ابزارهای آنلاین هنوز جایگزین قابلاتکایی برایش نساختهاند.»
نسخهی اول را در سه ثانیه رد میکنید و چیزی یاد نمیگیرید؛ نسخهی دوم شما را مجبور میکند فکر کنید. مدلهای زبانی هم اگر پرامپتتان جهتدار باشد با کمال میل مترسک میسازند، چون کوتاهترین مسیر به «موافقت با کاربر» همین است. اگر تازه با اصول نوشتن درخواستهای دقیق آشنا میشوید، مبانی را در آموزش نوشتن پرامپت برای مبتدیها مرور کنید.
۳) چرا هوش مصنوعی پیشفرض جوابهای تأییدگرانه میدهد
مدلهای زبانی طوری آموزش دیدهاند که پاسخهای «مفید و مطلوب» تولید کنند و بخش بزرگی از سیگنال آموزشیشان از ترجیح انسانها میآید. انسانها هم معمولاً پاسخهایی را بالاتر امتیاز میدهند که لحن مثبت دارد و مسیرشان را تأیید میکند. نتیجهی طبیعی این فرایند، تمایلی است که به آن سازگاری بیشازحد یا چاپلوسی مدل گفته میشود.
مسئلهی دوم، سوگیری خود پرامپت است. وقتی مینویسید «میخواهم این محصول را لانچ کنم، نظرت چیست؟»، در همان جمله جهتگیریتان را لو دادهاید و مدل پاسخ را حول همان قاب میچیند. برای فهم بهتر مرز توانایی این ابزارها، پتانسیل واقعی و محدودیتهای هوش مصنوعی کمک میکند.
مسئلهی سوم، سطحیبودن است؛ مدل بدون درخواست صریح شما وارد لایههای دوم و سوم استدلال نمیشود. استیلمن هر سه مشکل را همزمان هدف میگیرد: جهت را برعکس میکند، سوگیری پرامپت را خنثی میکند و مدل را به عمق میفرستد.
۴) پرامپت اصلی استیلمن
این پرامپت پایه است. هر جا احساس کردید جوابی که گرفتهاید بیش از حد خوشایند است، همین را بفرستید:
تا اینجا مقدمه بود. بخش اصلی این درس — نمونهها، پرامپتهای آماده و تمرینها — برای اعضای ویژه باز میشود.
تکنیک استیلمن در پرامپتنویسی: قویترین نسخهی مخالف را بساز
برای دیدن این بخش باید عضو ویژه (VIP) باشی. با شمارهٔ موبایلت وارد شو تا ۱۴ روز دسترسی رایگان فعال شود.
🎁 ورود / ثبتنام و شروع ۱۴ روز رایگان