ویدیوهای کوتاهی که در آنها یک تصویر مات و پیکسلی جلوی چشم بیننده به یک قاب تمیز و باکیفیت تبدیل میشود، یکی از پرتکرارترین قالبهای ویدیویی شبکههای اجتماعی هستند. راز جذابیتشان روانشناختی است: مغز ما از دیدن مسیر «آشفتگی به نظم» لذت میبرد و همین باعث میشود بیننده تا انتها بماند. پرامپتی که در این پست منتشر شد، همین قالب را با یک تصویر ورودی و چند خط دستور میسازد. در ادامه متن کامل، منطق هر بند و نسخههای جایگزین را بررسی میکنیم.

لیست مطالب
۱) چرا این قالب ویدیویی جواب میدهد
در ویدیوهای کوتاه، چند ثانیهٔ اول تعیینکننده است. تصویری که عمداً بیکیفیت و مبهم شروع میشود، یک پرسش در ذهن بیننده میسازد: این چیست؟ و همین پرسش او را نگه میدارد تا جواب را ببیند. وقتی تصویر بهتدریج شفاف میشود، بیننده حس پاداش میگیرد.
طبق گزارشها این قالب ابتدا بهصورت قالبهای آمادهٔ تدوین در اپلیکیشنهای ویرایش ویدیو رواج پیدا کرد و بعد با ابزارهای ویدیوسازی هوش مصنوعی به شکل خودکار قابل ساخت شد. تفاوت مهم این است که در حالت دوم، لازم نیست خودتان نسخهٔ بیکیفیت را بسازید؛ مدل هر دو سر ماجرا را تولید میکند.
اگر با مبانی نوشتن دستور برای مدلها آشنا نیستید، راهنمای مقدماتی پرامپتنویسی نقطهٔ شروع خوبی است.
۲) متن کامل پرامپت
ابتدا تصویر مورد نظرتان را آپلود کنید و سپس این متن را بفرستید:
Use the uploaded image as the exact source frame. Create a vertical 9:16 before-and-after transformation video. At the beginning, show the image in extreme 144p quality: blurry, pixelated, compressed, noisy, low-detail, and unclear. Then smoothly upgrade the exact same image into ultra-clear 4K quality. The transition should be satisfying and dramatic, like the image is being restored in real time. Keep the same subject, face, pose, outfit, background, camera angle, and composition. No identity change, no outfit change, no scene change, no new elements. Add a small clean label at the beginning: "144P" As the quality improves, change the label to: "4K" The final frame should look sharp, cinematic, clean, detailed, and high-resolution. Smooth quality upgrade only. No camera jump, no face change, no body change.
ساختار متن سه لایه دارد: تعریف نقطهٔ شروع و پایان، تعریف نوع گذار، و مجموعهای از قفلهای منفی که جلوی تغییرات ناخواسته را میگیرند. لایهٔ سوم بیشترین حجم متن را گرفته و دلیلش را در بخش چهارم میبینید.
۳) بند فریم منبع؛ تفاوت اصلی با پرامپت تصویری
جملهٔ اول میگوید تصویر آپلودشده «فریم منبع دقیق» است. این عبارت در ویدیوسازی نقشی حیاتی دارد. مدلهای ویدیویی بهصورت پیشفرض تمایل دارند تصویر ورودی را فقط بهعنوان «الهام» در نظر بگیرند و از آن یک صحنهٔ جدید بسازند؛ در حالی که کل ایدهٔ این ویدیو بر این استوار است که تصویر ابتدا و انتها دقیقاً یکی باشد.
اگر خروجی شما در طول ویدیو صحنه را عوض میکند یا دوربین را حرکت میدهد، تقریباً همیشه مشکل از همین جمله است. آن را در خط اول نگه دارید و در صورت نیاز در انتها هم تکرارش کنید.
۴) چرا اینهمه دستور منفی در متن هست
در نگاه اول عجیب است که بیش از یکسوم پرامپت را جملههای «نه» تشکیل دادهاند: تغییر هویت نه، تغییر لباس نه، تغییر صحنه نه، عنصر جدید نه، پرش دوربین نه، تغییر چهره نه، تغییر بدن نه. اما این تکرار عمدی است.
مدلهای ویدیویی هر فریم را با کمی آزادی نسبت به فریم قبل میسازند و همین آزادی در طول چند ثانیه انباشته میشود. نتیجه پدیدهای است که کاربران به آن «رانش» میگویند: چهره کمکم عوض میشود، لباس رنگ میبازد و پسزمینه جابهجا میشود. هر قفل منفی، یک بُعد از این رانش را میبندد.
وقتی باز هم رانش اتفاق میافتد
دو راهحل عملی وجود دارد: کوتاهکردن مدت ویدیو (هرچه کوتاهتر، رانش کمتر) و صریحنوشتن اینکه فریم آخر باید دقیقاً همان ترکیببندی فریم اول را داشته باشد و فقط کیفیتش بالاتر باشد.

۵) برچسب متنی روی ویدیو
پرامپت میخواهد در ابتدای ویدیو یک برچسب کوچک با نوشتهٔ کیفیت پایین ظاهر شود و با بهترشدن تصویر، به برچسب کیفیت بالا تغییر کند. این بخش معمولاً بیشترین دردسر را دارد، چون مدلهای ویدیویی در تولید متن دقیق ضعیفاند و ممکن است حروف را ناقص یا نامفهوم بسازند.
سه راهکار وجود دارد:
- پذیرش خطا و تکرار. چند بار تولید کنید تا یکی از خروجیها متن درست داشته باشد.
- افزودن متن در مرحلهٔ تدوین. ویدیو را بدون برچسب بسازید و بعد در نرمافزار تدوین متن را اضافه کنید. این روش دقیقترین نتیجه را میدهد.
- سادهکردن متن. هرچه رشتهٔ متن کوتاهتر و سادهتر باشد، احتمال درستسازی آن بیشتر است.
روش دوم برای کارهای حرفهای توصیه میشود، چون کنترل کامل روی فونت، اندازه و زمانبندی به شما میدهد.
۶) نسبت تصویر و مدت ویدیو
نسبت ۹:۱۶ برای این قالب انتخاب شده چون مقصد اصلیاش ویدیوهای کوتاه عمودی است. اگر برای پلتفرم افقی میسازید، نسبت را عوض کنید ولی توجه داشته باشید که در قاب افقی، افت کیفیت اولیه کمتر به چشم میآید و افکت ضعیفتر میشود.
دربارهٔ مدت، تجربهٔ عملی نشان میدهد بازهٔ کوتاه بهترین نتیجه را میدهد: زمان کافی برای دیدهشدن گذار، و کوتاهتر از حدی که رانش تصویری شروع شود. اگر ابزار شما اجازهٔ تعیین مدت میدهد، از کوتاهترین گزینه شروع کنید. مروری بر آنچه ابزارهای ویدیویی امروز میتوانند و نمیتوانند انجام دهند، در این مقاله آمده است.
۷) چهار نسخهٔ جایگزین از همین ساختار
منطق «حالت اول تا حالت دوم با حفظ کامل سوژه» را میتوانید برای چیزهای دیگری هم به کار ببرید:
نسخهٔ سیاهوسفید به رنگی
Use the uploaded image as the exact source frame. Create a vertical 9:16 transformation video. Start with the image in faded black-and-white with visible film grain. Then smoothly restore full natural color. Keep the same subject, face, pose, outfit, background, camera angle, and composition. No identity change, no scene change, no new elements, no camera jump.
نسخهٔ طرح خطی به تصویر نهایی
Use the uploaded image as the exact source frame. Create a vertical 9:16 transformation video. Start with a rough pencil sketch version of the image on white paper. Then smoothly transform it into the full photorealistic image. Keep the same subject, pose, and composition. No identity change, no scene change, no new elements, no camera jump.
نسخهٔ قدیمی به امروزی
Use the uploaded image as the exact source frame. Create a vertical 9:16 transformation video. Start with the image looking like a damaged old photograph: faded, scratched, with torn edges. Then smoothly restore it into a clean modern photo. Keep the same subject, face, pose, outfit, background, and composition. No identity change, no new elements, no camera jump.
نسخهٔ شب به روز
Use the uploaded image as the exact source frame. Create a vertical 9:16 transformation video. Start with the scene at night under dim blue light. Then smoothly transition the same scene to bright natural daylight. Keep the same subject, pose, outfit, background, camera angle, and composition. No identity change, no new elements, no camera jump.
در هر چهار نسخه، بند فریم منبع و مجموعهٔ قفلهای منفی دستنخورده ماندهاند؛ فقط حالت شروع و پایان عوض شده است.

۸) پنج خطای رایج و راهحلشان
- چهره در طول ویدیو عوض میشود. مدت را کوتاهتر کنید و قفلهای مربوط به تغییرنکردن چهره و بدن را تکرار کنید.
- دوربین حرکت میکند. صریح بنویسید دوربین کاملاً ثابت است و هیچ حرکت یا زومی نباید وجود داشته باشد.
- برچسب متنی خوانا نیست. متن را در مرحلهٔ تدوین اضافه کنید یا رشتهٔ متن را کوتاهتر بگیرید.
- گذار ناگهانی است. عبارت مربوط به روانبودن گذار را تقویت کنید و بنویسید تغییر باید تدریجی و پیوسته باشد.
- نسخهٔ اولیه بهقدری بیکیفیت است که سوژه دیده نمیشود. شدت افت کیفیت را ملایمتر توصیف کنید تا فرم کلی سوژه از ابتدا قابل تشخیص باشد.
برای مسیر یادگیری گامبهگام کار با این ابزارها میتوانید به بخش آموزشهای سایت سر بزنید و تازهترین قابلیتهای مدلهای ویدیویی هم در بخش اخبار پوشش داده میشود.
پرسشهای پرتکرار دربارهٔ پرامپت ویدیوی قبل و بعد
روی کدام ابزارها جواب میدهد؟
هر ابزار ویدیوسازی که ورودی تصویری بپذیرد و از روی یک تصویر ویدیو بسازد. کیفیت خروجی بین ابزارها تفاوت محسوسی دارد و بهتر است پرامپت را روی دو یا سه ابزار امتحان کنید.
آیا این ویدیو واقعاً کیفیت عکس من را بالا میبرد؟
خیر. این یک افکت نمایشی است، نه ابزار ترمیم تصویر. اگر هدفتان بهبود واقعی کیفیت یک عکس است، باید از ابزارهای افزایش رزولوشن استفاده کنید.
چرا خروجی من عناصر جدیدی اضافه میکند؟
چون قفل مربوط به نبود عنصر جدید حذف شده یا ضعیف است. آن جمله را برگردانید و در انتهای پرامپت هم تکرارش کنید.
میتوانم موسیقی یا صدا هم اضافه کنم؟
بعضی ابزارها امکان تولید صدا دارند، اما برای این قالب بهتر است صدا را در مرحلهٔ تدوین اضافه کنید تا هماهنگی دقیق با لحظهٔ گذار داشته باشد.
برای محصول و کسبوکار هم کاربرد دارد؟
بله. همین ساختار برای نمایش «قبل و بعد» خدمات یا محصولات کاربرد مستقیم دارد؛ کاربردهای گستردهتر این ابزارها را در این مقاله دربارهٔ نقش هوش مصنوعی در کسبوکار بخوانید.
