پرامپت سلفی دونفره واقع‌گرایانه در ارتفاع

پرامپت سلفی دونفره؛ قاب واقع‌گرایانه در دل ارتفاع

⏱ زمان مطالعه: حدود ۹ دقیقه
آموزش · پرامپت‌نویسی

سلفی، سخت‌ترین نوع عکسی است که یک مدل تصویری می‌تواند بسازد. دلیلش هم ساده است: مغز ما هزاران سلفی واقعی دیده و کوچک‌ترین بی‌نقصی مشکوک به نظر می‌رسد. پرامپتی که در این پست منتشر شد، دقیقاً بر همین نکته سوار می‌شود؛ به‌جای درخواست تصویر بی‌نقص، از مدل می‌خواهد عمداً ناقص باشد: کادربندی کج، اعوجاج لنز اولترا‌واید، موی به‌هم‌ریخته از باد و حس یک عکس ویرایش‌نشده در گالری گوشی. در ادامه متن کامل، منطق هر بند و نسخه‌های جایگزین را بررسی می‌کنیم.

چکیده. این مقاله پرامپت انگلیسی ساخت سلفی دونفرهٔ واقع‌گرایانه را کامل توضیح می‌دهد. یاد می‌گیرید چرا «نقص عمدی» مهم‌ترین بخش این پرامپت است، چطور هویت دو نفر را هم‌زمان حفظ کنید، صحنه و لباس را بدون خراب‌کردن ساختار عوض کنید و از خطاهای رایجی مثل چسبیدن دو چهره به هم یا دست ناقص در کادر جلوگیری کنید. یک بخش هم به ملاحظات اخلاقی استفاده از عکس دیگران اختصاص دارد.
پرامپت سلفی دونفره واقع‌گرایانه در ارتفاع

۱) چرا سلفی مصنوعی زود لو می‌رود

وقتی از یک مدل تصویری سلفی می‌خواهید، خروجی پیش‌فرض معمولاً بیش‌ازحد تمیز است: هر دو نفر دقیقاً وسط کادر، نور یکنواخت، پوست بی‌منفذ و زاویه‌ای که هیچ آدمی با دست خودش نمی‌تواند بگیرد. همین بی‌نقصی است که تصویر را لو می‌دهد.

عکس سلفی واقعی مجموعه‌ای از نقص‌هاست: یک دست در گوشهٔ کادر دیده می‌شود، لبه‌های تصویر به‌خاطر لنز اولترا‌واید کمی کشیده شده‌اند، افق کج است و نور خورشید مستقیم روی یک نیمهٔ صورت افتاده. پرامپت این پست هر کدام از این نقص‌ها را جداگانه و صریح سفارش می‌دهد.

این همان اصلی است که در راهنمای پایهٔ پرامپت‌نویسی با عنوان «توصیف مصداقی به‌جای توصیف کیفی» شناخته می‌شود؛ نوشتن «واقعی به نظر برسد» تقریباً بی‌اثر است، اما نوشتن «کادربندی ناقص و دست قابل مشاهده» فوراً جواب می‌دهد.

۲) متن کامل پرامپت

ابتدا عکس دونفرهٔ مرجع را آپلود کنید و سپس این متن را بفرستید:

Photorealistic iPhone front-camera selfie of the two people from the uploaded reference image, preserving their identities, faces, hairstyles, body proportions, and overall appearance, but changing their clothes. They stand on a tiny exposed maintenance platform beneath the Empire State Building antenna, surrounded by steel framework, with Manhattan far below; no other people, extreme height, candid tourist-selfie feeling. Black urban-climbing outfits: cargo pants, sleeveless tops, combat boots, man with black cap, woman with loose black scarf; ultra-wide iPhone look, visible arm, slight distortion, imperfect framing, natural midday light, wind-blown hair, realistic skin, unedited camera-roll photo.

ساختار متن سه بخش دارد: بند هویت، بند صحنه و بند دوربین. اگر می‌خواهید پرامپت را برای موقعیت دیگری بازنویسی کنید، فقط بند وسط را عوض کنید و دو بند دیگر را دست نزنید.

۳) بند هویت؛ حفظ هم‌زمان دو چهره

حفظ هویت یک نفر کار سختی نیست، اما وقتی دو نفر در کادر باشند، مدل‌ها معمولاً یکی از این دو خطا را مرتکب می‌شوند: یا ویژگی‌های دو چهره را با هم مخلوط می‌کنند، یا یکی را درست می‌سازند و دیگری را کاملاً از نو می‌آفرینند.

راه‌حل پرامپت این است که فهرست دقیقی از چیزهایی می‌دهد که باید حفظ شوند: چهره، مدل مو، تناسب اندام و ظاهر کلی — و بلافاصله می‌گوید فقط لباس‌ها باید عوض شوند. این ترکیب «فهرست حفظ + استثنای مشخص» بهترین کاری است که در سطح متن می‌توان کرد.

وقتی باز هم چهره‌ها مخلوط می‌شوند

در این حالت دو کار جواب می‌دهد: اول اینکه در پرامپت هر نفر را جداگانه توصیف کنید («نفر سمت چپ… نفر سمت راست…»)، و دوم اینکه عکس مرجعی انتخاب کنید که هر دو صورت در آن کاملاً واضح و بدون هم‌پوشانی باشند.

۴) نقص عمدی؛ راز اصلی این پرامپت

پنج عبارت در انتهای پرامپت هستند که کل حس واقعی‌بودن را می‌سازند و هیچ‌کدام نباید حذف شوند:

  • حس لنز اولترا‌واید. همان چیزی که دوربین جلوی گوشی می‌سازد و باعث بزرگ‌تر دیده‌شدن اجسام نزدیک می‌شود.
  • دست قابل مشاهده. بازوی کشیده‌شده در گوشهٔ کادر، صادق‌ترین نشانهٔ یک سلفی واقعی است.
  • اعوجاج خفیف. کشیدگی ملایم لبه‌های تصویر که در هر عکس اولترا‌واید دیده می‌شود.
  • کادربندی ناقص. یعنی سوژه‌ها دقیقاً وسط نیستند و بخشی از سر یا شانه ممکن است بیرون بزند.
  • عکس ویرایش‌نشدهٔ گالری. این عبارت کل لایهٔ روتوش و فیلتر را خاموش می‌کند و بافت واقعی پوست را برمی‌گرداند.

اگر خروجی شما هنوز حس تبلیغاتی دارد، احتمالاً یکی از این پنج عبارت را حذف کرده‌اید یا مدل شما به‌صورت پیش‌فرض روتوش سنگین اعمال می‌کند.

نقص‌های عمدی که سلفی هوش مصنوعی را باورپذیر می‌کنند

۵) صحنه و لباس؛ دو بخشی که آزادانه عوض می‌شوند

صحنهٔ اصلی این پرامپت یک سکوی نگهداری کوچک زیر آنتن یک آسمان‌خراش است؛ انتخابی که کنتراست شدیدی بین حس معمولی سلفی و موقعیت غیرعادی می‌سازد. همین کنتراست است که تصویر را دیدنی می‌کند.

برای عوض‌کردن صحنه، همان الگو را نگه دارید: یک مکان مشخص، یک عنصر محیطی نزدیک (اینجا سازهٔ فولادی) و یک منظرهٔ دوردست. اگر فقط بنویسید «روی یک ساختمان بلند»، مدل پس‌زمینه‌ای مبهم می‌سازد و عمق تصویر از بین می‌رود.

لباس‌ها هم با ذکر جنس و قطعه توصیف شده‌اند، نه با صفت کلی. نوشتن «شلوار کارگو، تاپ بدون آستین، بوت» بسیار دقیق‌تر از «لباس ورزشی مشکی» عمل می‌کند. برای درک بهتر اینکه مدل‌ها چطور از توصیف به تصویر می‌رسند، این مرور بر توانایی‌ها و محدودیت‌های هوش مصنوعی کمک می‌کند.

۶) چهار نسخهٔ جایگزین

در هر چهار نسخه، بند هویت و بند دوربین ثابت است و فقط صحنه و لباس عوض می‌شود:

نسخهٔ ساحل غروب

...They stand on a wet sand beach at sunset with the ocean and a long pier far behind them; no other people, warm low sun, candid tourist-selfie feeling. Light linen shirts and rolled-up trousers, barefoot; ultra-wide iPhone look, visible arm, slight distortion, imperfect framing, wind-blown hair, realistic skin, unedited camera-roll photo.

نسخهٔ خیابان برفی

...They stand on a snowy city street at night, warm shop windows and blurred traffic lights far behind them; falling snow, cold breath visible, candid selfie feeling. Heavy wool coats, knitted scarves and gloves; ultra-wide iPhone look, visible arm, slight distortion, imperfect framing, realistic skin, unedited camera-roll photo.

نسخهٔ قلهٔ کوه

...They stand on a rocky ridge at sunrise with layered mountain peaks and low clouds far below; no other people, thin cold air, candid hiking-selfie feeling. Technical shell jackets, backpacks straps visible, beanies; ultra-wide iPhone look, visible arm, slight distortion, imperfect framing, wind-blown hair, realistic skin, unedited camera-roll photo.

نسخهٔ کافه

...They sit at a small table in a busy corner cafe, warm lamps and a rain-streaked window behind them; candid indoor selfie feeling. Simple knitwear in neutral tones; ultra-wide iPhone look, visible arm, slight distortion, imperfect framing, mixed indoor lighting, realistic skin, unedited camera-roll photo.

الگوی مشترک همهٔ نسخه‌ها یکی است: مکان مشخص، عنصر نزدیک، منظرهٔ دور، لباس با ذکر قطعه، و در آخر همان پنج عبارت نقص عمدی.

۷) شش خطای رایج و راه‌حلشان

  • چهره‌ها با هم مخلوط می‌شوند. هر نفر را جداگانه و با ذکر جایگاهش در کادر توصیف کنید.
  • دست‌ها بدشکل می‌شوند. بنویسید فقط یک بازو در کادر دیده شود و دست دیگر خارج از قاب باشد.
  • خروجی بیش‌ازحد تمیز است. عبارت مربوط به عکس ویرایش‌نشده را برگردانید و کلمات مربوط به کیفیت استودیویی را حذف کنید.
  • پس‌زمینه مبهم است. منظرهٔ دور را با نام و جزئیات مشخص کنید، نه با توصیف کلی.
  • لباس‌ها عوض نمی‌شوند. عبارت «فقط لباس‌ها را تغییر بده» را به ابتدای بند هویت منتقل کنید.
  • نور غیرطبیعی است. نوع نور را با زمان روز مشخص کنید؛ «نور طبیعی ظهر» خیلی دقیق‌تر از «نور خوب» است.
ملاحظات اخلاقی انتشار تصویر ساخته‌شده با هوش مصنوعی

۸) دو ملاحظهٔ مهم پیش از انتشار

نکتهٔ اول دربارهٔ صحنه است. سکوی زیر آنتن یک آسمان‌خراش، یک موقعیت واقعاً خطرناک است و در دنیای واقعی دسترسی به آن ممنوع و مرگبار است. تصویر ساخته‌شده صرفاً یک تصویر است و بازسازی آن در واقعیت به هیچ عنوان توصیه نمی‌شود؛ اگر تصویر را منتشر می‌کنید، بهتر است روشن کنید که ساخته‌شده با هوش مصنوعی است.

نکتهٔ دوم دربارهٔ عکس ورودی است. وقتی از عکس دونفره استفاده می‌کنید، یک نفر دیگر هم در ماجرا هست. پیش از ساختن و به‌ویژه پیش از انتشار، رضایت آن فرد را بگیرید. این موضوع فقط اخلاقی نیست؛ در بسیاری از کشورها بُعد حقوقی هم دارد. بحث‌های مربوط به این حوزه را می‌توانید در بخش اخبار هوش مصنوعی دنبال کنید و برای یادگیری گام‌به‌گام کار با ابزارها، آموزش‌های سایت در دسترس است.

پرسش‌های پرتکرار دربارهٔ پرامپت سلفی دونفره

حتماً باید عکس دونفره آپلود کنم؟

برای حفظ هویت هر دو نفر بله. می‌توانید دو عکس جداگانه هم بدهید، اما در آن حالت باید صریح بنویسید که هر عکس مربوط به کدام نفر در کادر است.

روی کدام ابزارها بهتر جواب می‌دهد؟

هر مدلی که ورودی تصویری بپذیرد و ویرایش روی همان تصویر انجام دهد. طبق گزارش‌ها، مدل‌های تصویری جدید گوگل و مدل‌های شرکت اوپن‌ای‌آی در حفظ چهره از عکس مرجع نتایج قابل قبولی داده‌اند.

چرا پوست خروجی من پلاستیکی است؟

چون عبارت مربوط به پوست واقعی و عکس ویرایش‌نشده حذف شده یا ابزار شما به‌صورت پیش‌فرض روتوش اعمال می‌کند. آن دو عبارت را برگردانید و کلمات مربوط به کیفیت تبلیغاتی را بردارید.

می‌توانم نسبت تصویر را عوض کنم؟

بله. برای استوری نسبت ۹:۱۶ و برای فید ۴:۵ مناسب است. فقط توجه کنید که در قاب عمودی، منظرهٔ دور فضای کمتری می‌گیرد.

این پرامپت برای سه نفر هم کار می‌کند؟

کار می‌کند اما خطا بیشتر می‌شود. برای بیش از دو نفر، هر شخص را جداگانه و با ذکر موقعیتش در کادر توصیف کنید و انتظار داشته باشید چند بار تکرار لازم شود.

جمع‌بندی. قدرت این پرامپت در چیزی است که از مدل می‌خواهد نسازد: قاب بی‌نقص، پوست صیقلی و نور بی‌عیب. اگر پنج عبارت نقص عمدی را نگه دارید و فقط صحنه و لباس را عوض کنید، از یک متن به ده‌ها سلفی باورپذیر می‌رسید. پرامپت‌های تازه را هر روز در @MrChatGPT_IR منتشر می‌کنیم.
(0 رأی)

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *