چهارشنبه، ۲۵ شهریور ۱۴۰۵

زمان مطالعه: ۸ دقیقه
تاریخ انتشار: ۲۶ شهریور ۱۴۰۵
ساخت یک ویدیوی سینمایی دیگر الزاماً به دوربین حرفهای، لوکیشن گرانقیمت یا تیم فیلمبرداری نیاز ندارد. امروز میتوان یک ایده چندخطی را به مجموعهای از شاتهای سینمایی تبدیل کرد، برای آن حرکت دوربین و نورپردازی تعریف کرد و در نهایت کلیپها را کنار هم قرار داد.
اما یک نکته مهم وجود دارد: نتیجه خوب معمولاً از یک «پرامپت جادویی» به دست نمیآید. مسیر بهتر این است که ایده را به فیلمنامه کوتاه تبدیل کنیم، برای هر صحنه دستور مشخصی بنویسیم، چند خروجی بگیریم و در پایان کلیپها را تدوین کنیم. در این راهنما دقیقاً همین مسیر را بررسی میکنیم.
فرض کنید فقط یک ایده در ذهن دارید:
«مردی تنها در یک خیابان بارانی قدم میزند و چراغهای نئون روی آسفالت خیس منعکس شدهاند.»
این جمله برای شروع خوب است، اما هنوز یک دستور کامل برای ساخت ویدیو نیست. برای تبدیل چنین ایدهای به یک ویدیوی قابلاستفاده، بهتر است مسیر را به چند مرحله تقسیم کنیم:
ایده → فیلمنامه کوتاه → پرامپت تصویری/ویدیویی → تولید چند خروجی → انتخاب شاتها → تدوین و صداگذاری
مزیت این روش این است که اگر خروجی نهایی خوب نبود، میتوانیم بفهمیم مشکل دقیقاً در کدام مرحله بوده است.
قبل از اینکه سراغ ابزار تولید ویدیو بروید، مشخص کنید دقیقاً چه چیزی قرار است دیده شود. لازم نیست فیلمنامه چند صفحه باشد. برای یک ویدیوی کوتاه، حتی چند جمله میتواند کافی باشد:
شخصیت یا سوژه چیست؟
کجا قرار دارد؟
چه کاری انجام میدهد؟
دوربین چه چیزی را میبیند؟
فضای صحنه چگونه است؟
برای این مرحله میتوانید از ChatGPT یا Claude استفاده کنید و از مدل بخواهید یک ایده خام را به چند شات کوتاه تبدیل کند. مثلاً به جای اینکه فقط بگویید:
«یک ویدیوی سینمایی از یک شهر بارانی بساز.»
میتوانید ابتدا از مدل بخواهید سه شات متفاوت برای این ایده طراحی کند:
شات اول: نمای باز از خیابان در شب
شات دوم: نمای نزدیک از شخصیت در حال قدمزدن
شات سوم: نمایی از انعکاس نورهای نئون روی آسفالت خیس
حالا به جای یک تصویر مبهم، یک توالی تصویری دارید که میتواند پایه ویدیوی نهایی باشد.
اینجا یکی از مهمترین بخشهای کار شروع میشود. پرامپت ویدیویی نباید فقط درباره سوژه صحبت کند. اگر میخواهید خروجی حس سینمایی داشته باشد، بهتر است درباره حرکت دوربین، نور، فضای صحنه و نوع تصویربرداری هم توضیح دهید.
یک فرمول ساده برای شروع:
[سوژه] + [حرکت دوربین] + [نور و حالوهوا] + [نوع تصویربرداری]
برای مثال:
A lone man walking through a rainy neon-lit street,
slow tracking shot following from behind,
cinematic blue-orange lighting,
shot on a 35mm anamorphic lens

در این پرامپت فقط نگفتهایم «مردی در خیابان راه میرود». حرکت دوربین، نورپردازی، فضای رنگی و نوع لنز هم مشخص شدهاند.
A drone shot slowly rising above a misty forest at sunrise,
golden hour lighting,
warm cinematic color grade,
wide aerial shot
اینجا هم مدل میداند با یک نمای هوایی روبهرو هستیم و حرکت دوربین، زمان نورپردازی و حس کلی تصویر مشخص شده است.
Close-up of a woman looking out a rainy window,
soft window light,
shallow depth of field,
moody cinematic tone,
handheld camera feel
این نوع جزئیات به مدل کمک میکند به جای تولید یک تصویر عمومی، صحنه را با ویژگیهای بصری مشخصتری تفسیر کند. اگر نوشتن چنین پرامپتهایی برایتان سخت است، میتوانید فیلمنامه کوتاه را به هوش مصنوعی Gemini بدهید و از آن بخواهید هر شات را به یک پرامپت دقیق و قابلاستفاده تبدیل کند.
یکی از اشتباهات رایج این است که بعد از گرفتن اولین ویدیو انتظار داشته باشیم همان چیزی باشد که در ذهنمان بوده است.
در تولید ویدیوی AI، یک پرامپت یکسان میتواند خروجیهای متفاوتی ایجاد کند. بنابراین بهتر است برای شاتهای مهم چند نسخه تولید کنید و بعد بهترین را انتخاب کنید. مثلاً اگر قرار است نمای راه رفتن شخصیت را بسازید، فقط یک خروجی نگیرید.
سه یا چهار نسخه را مقایسه کنید:
کدام حرکت طبیعیتری دارد؟
چهره یا بدن در کدام خروجی پایدارتر است؟
حرکت دوربین کدام نسخه بهتر است؟
نورپردازی کدام نسخه به فضای داستان نزدیکتر است؟
گاهی نسخه دوم یا سوم چیزی دارد که در خروجی اول وجود نداشته است.
نکته مهم: اگر نتیجه ضعیف بود، فقط تعداد کلمات پرامپت را بیشتر نکنید. ابتدا ببینید دقیقاً چه چیزی مشکل دارد و همان بخش را اصلاح کنید.

یک ویدیوی سینمایی کوتاه معمولاً از یک شات تشکیل نشده است. فرض کنید برای همان داستان خیابان بارانی، این سه کلیپ را دارید:
نمای باز خیابان
حرکت شخصیت در خیابان
نمای نزدیک از چهره یا دست شخصیت
حالا باید این شاتها را کنار هم قرار دهید. برای تدوین ساده میتوانید از Canva استفاده کنید. اگر به کنترل بیشتری روی سرعت، ترانزیشن و تدوین نیاز دارید، CapCut هم میتواند گزینه مناسبی باشد.
در این مرحله لازم نیست افکتهای زیادی اضافه کنید. گاهی یک برش درست بین دو شات، یک اصلاح رنگ ساده و موسیقی مناسب، نتیجه بهتری از مجموعهای از ترانزیشنهای شلوغ ایجاد میکند.
ممکن است یک شات بهتنهایی بسیار زیبا باشد، اما وقتی آن را کنار شاتهای دیگر قرار میدهید، ویدیو مصنوعی یا ناهماهنگ به نظر برسد. یکی از دلایل، تفاوت شدید در رنگ، نور یا فضای بصری کلیپهاست.
به همین دلیل در تدوین نهایی بهتر است به این موارد توجه کنید:
رنگ شاتها تا حد ممکن هماهنگ باشد.
تغییر زاویه دوربین ناگهانی و بیدلیل نباشد.
موسیقی با ریتم تدوین هماهنگ شود.
صداهای محیطی را فراموش نکنید.
از ترانزیشنهای زیاد استفاده نکنید.
اگر برای ویدیوی خود به موسیقی، فوتیج، افکت صوتی یا عناصر استوک نیاز دارید، Envato Elements میتواند در بخش تکمیل پروژه به کار بیاید.
اگر خروجی بیش از حد «AIگونه» به نظر میرسد، همیشه مشکل از کیفیت مدل نیست. گاهی پرامپت بیش از حد روی کلمات کلی مثل:
beautiful، cinematic، amazing، professional
تمرکز دارد، اما مشخص نمیکند دوربین چه کاری انجام میدهد. به جای توصیفهای کلی، اطلاعات قابلتصویری بدهید.
مثلاً:
ضعیف:
A beautiful cinematic shot of a man in a city.
دقیقتر:
A man walking alone through a narrow rain-soaked street at night,
slow tracking camera from behind,
neon signs reflected on wet pavement,
soft atmospheric fog,
shallow depth of field,
subtle handheld movement
در نسخه دوم، مدل با اطلاعات بسیار مشخصتری درباره صحنه روبهرو است.
«یک ویدیوی زیبا از دریا بساز» بیشتر شبیه یک ایده است تا دستور تولید. هرچه عناصر مهم صحنه را دقیقتر مشخص کنید، کنترل بیشتری روی نتیجه خواهید داشت.
بهتر است یک ویدیوی چندثانیهای را به شاتهای کوچکتر تقسیم کنید. این کار کنترل شما روی دوربین، سوژه و تدوین را بیشتر میکند و اصلاح یک بخش هم نیازی به ساخت دوباره کل پروژه ندارد.
حتی اگر تکتک شاتها زیبا باشند، کنار هم قرار دادن آنها بدون توجه به ریتم، رنگ و صدا الزاماً یک ویدیوی خوب نمیسازد.
AI میتواند شات تولید کند؛ این تدوین است که به آنها ساختار میدهد.
نه به معنای سنتی آن. برای شروع نیازی نیست فیلمبردار یا تدوینگر حرفهای باشید. اما آشنایی ابتدایی با مفاهیمی مثل نمای باز، کلوزآپ، حرکت دوربین، نورپردازی و عمق میدان میتواند کیفیت پرامپتهای شما را بهتر کند.
در واقع، هرچه بهتر بدانید چیزی که میخواهید چگونه فیلمبرداری میشود، راحتتر میتوانید آن را به زبان مدلهای هوش مصنوعی توضیح دهید.

بعضی سرویسهای هوش مصنوعی امکان استفاده رایگان یا محدود دارند، اما امکانات، کیفیت خروجی، تعداد تولیدها و محدودیتهای هر سرویس متفاوت است. اگر قصد دارید مرتب ویدیو تولید کنید، معمولاً محدودیتهای پلن رایگان خیلی زود خودش را نشان میدهد.
برای یک ویدیوی ۱۵ تا ۳۰ ثانیهای، زمان فقط به تولید ویدیو محدود نمیشود. بخشی از زمان صرف ایده و فیلمنامه، بخشی صرف گرفتن و مقایسه چند خروجی و بخشی هم صرف تدوین میشود.
اگر پروژه ساده باشد، میتوان در مدت نسبتاً کوتاهی به خروجی نهایی رسید؛ اما پروژههای پیچیدهتر، مخصوصاً زمانی که نیاز به چند شات هماهنگ دارند، زمان بیشتری میبرند.
از نظر فنی، بعضی ابزارها چند مرحله از این فرایند را پوشش میدهند؛ اما الزاماً بهترین نتیجه زمانی به دست نمیآید که همهچیز را به یک سرویس بسپارید. یک Workflow ساده میتواند اینطور باشد:
ChatGPT یا Claude → ایده و فیلمنامه
Gemini و ابزار تولید ویدیو → توسعه پرامپت و ساخت شات
Canva یا ابزار تدوین → مونتاژ و اصلاح نهایی
Envato Elements → موسیقی، فوتیج و عناصر مکمل
این ترکیب به شما اجازه میدهد هر ابزار را برای کاری استفاده کنید که در آن راحتتر هستید.
ساخت ویدیوی سینمایی با هوش مصنوعی دیگر فقط یک ایده عجیب و آزمایشی نیست. میتوانید کار را با چند جمله شروع کنید، ایده را به چند شات تبدیل کنید، برای هر شات پرامپت مشخص بنویسید، چند خروجی بگیرید و در نهایت آنها را در یک ویدیوی منسجم کنار هم قرار دهید.
اما مهمترین نکته این است که هوش مصنوعی جای فکر کردن درباره ویدیو را نمیگیرد؛ فقط بخش زیادی از اجرای آن را سادهتر میکند.
اگر قرار باشد از همین امروز شروع کنید، یک صحنه ساده انتخاب کنید، آن را به سه شات تقسیم کنید و برای هرکدام یک پرامپت جدا بنویسید. ممکن است اولین خروجی دقیقاً چیزی نباشد که تصور کردهاید؛ اما همین مرحله آزمون و اصلاح است که به شما نشان میدهد چطور از یک ایده متنی، یک تصویر متحرک واقعی بسازید.