• آکادمی سالچین- صفحه اصلی
  • مقالات
  • فروشگاه
  • ارتباط با ما
 

ورود

رمز عبور را فراموش کرده اید؟

هنوز عضو نشده اید؟ عضویت در سایت
آکادمی سالچین SALchain Academy
  • صفحه اصلی
  • مقالات
  • فروشگاه
  • ارتباط با ما
0
سبد خرید خالی است.
ورود به حساب
0
سبد خرید خالی است.
ورود / ثبت نام

وبلاگ

آکادمی سالچین | Salchain Academy مقالات هوش مصنوعی گوگل Flow با Veo 3.1 آپدیت شد – هوش مصنوعی جدید گوگل برای ساخت فیلم سینمایی

گوگل Flow با Veo 3.1 آپدیت شد – هوش مصنوعی جدید گوگل برای ساخت فیلم سینمایی

هوش مصنوعی
ارسال شده توسط شقایق محمدی
1405/06/23
14 بازدید
گوگل Flow با Veo 3.1 آپدیت شد - هوش مصنوعی جدید گوگل برای ساخت فیلم سینمایی

تا چند سال قبل ساخت یک ویدیوی سینمایی حرفه ای نیاز به دوربین های گران قیمت، تیم فیلمبرداری، بازیگر و تجهیزات پیچیده داشت؛ اما حالا هوش مصنوعی در حال تغییر کامل صنعت تولید محتوا است. گوگل با معرفی Google Flow و مدل قدرتمند Veo 3.1 قدم جدیدی در مسیر ساخت فیلم با هوش مصنوعی برداشته است؛ ابزاری که به کاربران اجازه می دهد تنها با نوشتن یک توضیح متنی یا استفاده از یک تصویر، صحنه های ویدیویی واقع گرایانه با کیفیت سینمایی تولید کنند. Google Flow در واقع یک محیط خلاقانه برای ساخت و مدیریت پروژه های ویدیویی است که با کمک مدل Veo 3.1 می تواند حرکت دوربین، جزئیات صحنه، نورپردازی، افکت های صوتی و حتی داستان پردازی را به شکل هوشمند ایجاد کند. این فناوری می تواند برای فیلمسازان، تولیدکنندگان محتوای شبکه های اجتماعی، تبلیغات، آموزش و حتی کاربران عادی که می خواهند ایده های خود را به تصویر تبدیل کنند، کاربرد داشته باشد. در این مقاله بررسی می کنیم Google Flow چیست، چه تفاوتی با Veo 3.1 دارد، چگونه می توان با آن ویدیو ساخت، چه قابلیت هایی ارائه می دهد و آیا می تواند رقیبی جدی برای ابزارهایی مانند Sora، Runway و دیگر مدل های تولید ویدیو با هوش مصنوعی باشد.

Google Flow چیست؟

Google Flow یک ابزار ساخت ویدیو با هوش مصنوعی از طرف گوگل است که برای کمک به فیلمسازان، تولیدکنندگان محتوا و کاربران عادی طراحی شده است. این پلتفرم با استفاده از مدل های پیشرفته هوش مصنوعی گوگل مانند Veo، Imagen و Gemini به کاربران اجازه می دهد ایده های خود را به صحنه های ویدیویی واقعی و سینمایی تبدیل کنند. بر خلاف ابزارهای ساده تولید ویدیو که فقط یک کلیپ کوتاه از یک متن ایجاد می کنند، Google Flow بیشتر شبیه یک محیط فیلمسازی دیجیتال عمل می کند. کاربران می توانند صحنه های مختلف یک داستان را طراحی کنند، تصاویر مرجع اضافه کنند، زاویه دوربین را تغییر دهند و خروجی های مختلف را برای رسیدن به نتیجه بهتر آزمایش کنند. هدف گوگل از ساخت Flow این است که فرآیند تولید فیلم را ساده تر کند؛ به شکلی که حتی افرادی که تجربه فیلمبرداری یا تدوین حرفه ای ندارند، بتوانند ایده های خود را به ویدیوهای با کیفیت نزدیک به استانداردهای سینمایی تبدیل کنند.

Google Flow چگونه کار می کند؟

Google Flow از ترکیب چند فناوری هوش مصنوعی استفاده می کند:

فناورینقش در Google Flow
Veo 3.1مدل اصلی تولید ویدیو که صحنه های واقعی با حرکت، نورپردازی و جزئیات سینمایی ایجاد می کند.
Geminiکمک به درک ایده ها، نوشتن سناریو و تبدیل توضیحات کاربر به دستورهای دقیق.
Imagenساخت تصاویر و عناصر بصری مورد استفاده در پروژه های ویدیویی.

Veo 3.1 چه تغییری در Google Flow ایجاد کرد؟

Veo 3.1 یکی از جدیدترین مدل های هوش مصنوعی گوگل برای تولید ویدیو است که توسط Google DeepMind توسعه داده شده و به عنوان موتور اصلی تولید محتوا در Google Flow استفاده می شود. این مدل با هدف ساده تر کردن فرآیند فیلمسازی ساخته شده تا کاربران بتوانند تنها با نوشتن یک توضیح متنی یا ارائه یک تصویر، صحنه های ویدیویی واقع گرایانه با کیفیت سینمایی ایجاد کنند. بر خلاف نسل های قدیمی تر ابزارهای تولید ویدیو با هوش مصنوعی که معمولا فقط تصاویر متحرک کوتاه تولید می کردند، Veo 3.1 تلاش می کند مفهوم کامل یک صحنه را درک کند. این مدل می تواند عناصر مختلفی مانند محیط، حرکت شخصیت ها، نورپردازی، زاویه دوربین، سبک فیلمبرداری و حتی فضای داستانی را تحلیل کند و خروجی طبیعی تری ایجاد کند. به همین دلیل Veo 3.1 فقط یک ابزار تبدیل متن به ویدیو نیست، بلکه یک دستیار هوشمند برای ساخت محتوای ویدیویی، تبلیغات، فیلم های کوتاه، محتوای شبکه های اجتماعی و پروژه های خلاقانه محسوب می شود.

مهم ترین قابلیت های Veo 3.1 :

ساخت ویدیو از متن (Text to Video)
مهم ترین قابلیت Veo 3.1 تبدیل توضیحات متنی به ویدیو است. کاربران می توانند ایده خود را با جزئیات بنویسند و مدل هوش مصنوعی گوگل بر اساس آن یک صحنه ویدیویی ایجاد کند. برای مثال:
“یک خیابان بارانی در توکیو هنگام شب، نورهای نئون روی آسفالت خیس، حرکت آرام دوربین به سمت یک خودروی اسپرت، سبک فیلم سینمایی”
در این حالت مدل تلاش می کند مواردی مانند فضای شهری، نور، حرکت دوربین و حس سینمایی صحنه را در خروجی نهایی حفظ کند.

تبدیل تصویر به ویدیو (Image to Video)
Veo 3.1 علاوه بر تولید ویدیو از متن، می تواند تصاویر ثابت را نیز به صحنه های متحرک تبدیل کند. این قابلیت کاربردهای زیادی دارد، از جمله:

✔ تبدیل طرح های اولیه به ویدیو
✔ ساخت تیزر تبلیغاتی از تصاویر محصولات
✔ متحرک کردن تصاویر هنری
✔ ایجاد حرکت برای شخصیت ها و محیط ها
✔ تولید صدا و افکت های صوتی هماهنگ با تصویر

یکی از ویژگی های مهم نسل جدید Veo، توجه بیشتر به بخش صوتی ویدیو است. این مدل می تواند در کنار تصویر، صداهای مرتبط با محیط و فضای صحنه را نیز ایجاد کند. برای مثال در یک صحنه خیابانی می تواند صداهایی مانند:
✔ صدای باران
✔ صدای خودروها
✔ صدای محیط
✔ افکت های سینمایی
را به ویدیو اضافه کند تا نتیجه نهایی طبیعی تر باشد.

کنترل حرکت دوربین و سبک فیلمبرداری
یکی از تفاوت های مهم Veo 3.1 با بسیاری از ابزارهای ساده تولید ویدیو، توانایی بهتر در درک دستورات مربوط به دوربین است. کاربر می تواند نوع فیلمبرداری را مشخص کند، مانند:

✔ حرکت آرام دوربین به سمت سوژه
✔ نمای نزدیک از چهره یا محصول
✔ حرکت هوایی شبیه فیلمبرداری با پهپاد
✔ دنبال کردن یک شخصیت در محیط
این قابلیت باعث می شود خروجی بیشتر شبیه یک سکانس واقعی فیلم باشد.

حفظ هماهنگی شخصیت ها و عناصر در چند صحنه
یکی از مشکلات مدل های قدیمی تولید ویدیو، تغییر ظاهر شخصیت ها یا جزئیات محیط در هر خروجی بود. Veo 3.1 تلاش می کند هماهنگی بیشتری بین صحنه های مختلف ایجاد کند تا کاربران بتوانند داستان های طولانی تر و پروژه های منسجم تری بسازند. این ویژگی برای تولید:

✔ فیلم کوتاه
✔ تبلیغات برندها
✔ محتوای داستانی
✔ ویدیوهای آموزشی

اهمیت زیادی دارد.

خلاصه قابلیت های Veo 3.1

قابلیتتوضیح
Text to Videoتبدیل توضیحات متنی به ویدیوهای سینمایی با کمک هوش مصنوعی
Image to Videoتبدیل تصاویر ثابت به ویدیوهای متحرک
تولید صداایجاد افکت های صوتی و صداهای هماهنگ با صحنه
کنترل دوربینایجاد حرکت های سینمایی مانند زوم، حرکت دنبال کننده و نمای هوایی
هماهنگی صحنه هاحفظ بهتر شخصیت ها و عناصر داستانی در چند ویدیو

یکی از جذاب ترین قابلیت ها: تولید صدا همراه ویدیو

Veo مدل هوش مصنوعی تولید ویدئوی گوگل است که توسط Gooیکی از چیزهایی که باعث شد Veo 3.1 بیشتر مورد توجه تولیدکنندگان محتوا قرار بگیرد، پیشرفت قابلیت Audio است. در این رویکرد، صدا فقط یک مرحله جداگانه بعد از ساخت ویدیو نیست. مدل می تواند صداهای محیطی، افکت ها و دیالوگ را در کنار تصویر تولید کند و هدف این است که صدا با اتفاقات داخل صحنه هماهنگ باشد. گوگل در به روزرسانی Flow اعلام کرد که پشتیبانی صوتی به قابلیت هایی فراتر از تولید مستقیم ویدیو گسترش پیدا کرده است. برای یک تولیدکننده محتوا این یعنی مثلا می توانید یک صحنه خیابانی بارانی تعریف کنید و از مدل بخواهید همزمان صدای باران، حرکت خودرو و دیالوگ شخصیت ها را در نظر بگیرد. البته هنوز نباید انتظار داشت که تمام خروجی ها بدون نیاز به اصلاح حرفه ای آماده انتشار باشند. برای تبلیغات جدی، فیلم کوتاه یا محتوای برند، کنترل دستی صدا همچنان ارزش زیادی دارد.gle DeepMind توسعه داده شده است. هدف اصلی Veo این است که بتواند ویدئوهایی با کیفیت بالا و نزدیک به تصاویر واقعی تولید کند. نسخه جدید Veo 3.1 تلاش می کند مشکلات رایج مدل های قبلی را کاهش دهد:

  • حرکت غیر طبیعی اجسام
  • تغییر چهره شخصیت ها
  • ضعف در نمایش فیزیک محیط
  • هماهنگ نبودن صدا و تصویر

بهبود این موارد باعث شده Google Flow برای استفاده های حرفه ای تر مناسب تر شود.

Ingredients؛ راه حل گوگل برای حفظ شخصیت و اشیا

یکی از مشکلات قدیمی ویدیوهای تولیدشده با AI، تغییر ظاهر سوژه در نماهای مختلف بود. فرض کنید یک کاراکتر با کت قرمز ساخته اید. در شات دوم ممکن است مدل چهره، لباس یا حتی جزئیات ظاهری او را تغییر دهد. برای پروژه های چندصحنه ای، این مسئله می تواند خروجی را خراب کند.
Flow با قابلیت Ingredients to Video تلاش می کند این مشکل را کاهش دهد. شما می توانید چند تصویر مرجع از شخصیت، محصول، شیء یا سبک بصری را در اختیار سیستم قرار دهید و از آنها برای کنترل بهتر نتیجه استفاده کنید. گوگل در اسناد رسمی Flow نیز این قابلیت را به عنوان یکی از حالت های پشتیبانی شده در مدل های مشخص Veo و Omni معرفی کرده است. Ingredients برای چه کسانی مهم تر است؟

  • ساخت تبلیغات محصول
  • ساخت شخصیت ثابت
  • تولید سری ویدیوهای شبکه های اجتماعی
  • ساخت داستان چندشاته
  • انیمیشن و محتوای داستانی
  • ساخت محتوای برند با ظاهر یکسان

برای مثال، اگر یک فروشگاه اینترنتی بخواهد از یک محصول در چند ویدیوی تبلیغاتی استفاده کند، داشتن تصویر مرجع محصول می تواند به حفظ ظاهر آن در نماهای مختلف کمک کند.

Frames to Video؛ وقتی کنترل اولین و آخرین فریم مهم است

یکی دیگر از قابلیت های مهم Flow، ساخت ویدیو از روی فریم های مشخص است. به جای اینکه فقط بگویید «یک شخصیت وارد اتاق شود»، می توانید نقطه شروع یا حتی ابتدا و انتهای شات را مشخص کنید. این قابلیت در سناریوهایی که حرکت باید بین دو وضعیت تعریف شده اتفاق بیفتد، بسیار کاربردی است. در مستندات فعلی Flow، Veo 3.1 از حالت First Frame و First + Last Frame پشتیبانی می کند و مدل های Omni نیز امکان استفاده از فریم شروع و پایان را ارائه می دهند. این ویژگی برای ساخت transition های کنترل شده، تبلیغات محصول و پروژه هایی که به continuity اهمیت می دهند، ارزش زیادی دارد.

Extend؛ ویدیو را ادامه بده، نه اینکه از اول بساز

فرض کنید یک شات ۸ ثانیه ای ساخته اید و پایان آن دقیقا جایی است که تازه داستان جالب می شود. به جای اینکه کل پروژه را از ابتدا تولید کنید، قابلیت Extend می تواند ادامه صحنه را ایجاد کند. در نسخه های مشخص Veo 3.1 در Flow، این قابلیت برای ادامه دادن ویدیو در دسترس است و البته نوع مدل انتخابی اهمیت دارد. برای مثال در مستندات فعلی گوگل، برخی قابلیت های Edit و Extend در Veo 3.1 Lite و Fast در دسترس هستند، در حالی که Veo 3.1 Quality مجموعه متفاوتی از امکانات را ارائه می دهد. پس یک نکته مهم این است که نام مدل را تنها معیار انتخاب ندانید؛ قابلیت مورد نیاز شما هم تعیین می کند کدام مدل مناسب تر است.

آیا Veo 3.1 در Flow همان مدل قدیمی است؟

در حال حاضر Google Flow چند مدل مختلف را ارائه می دهد و Veo 3.1 تنها گزینه موجود نیست. طبق مستندات فعلی، کاربران می توانند بر اساس قابلیت مورد نظر از مدل هایی مانند Veo 3.1 Lite، Veo 3.1 Fast، Veo 3.1 Quality و Gemini Omni Flash استفاده کنند. از طرف دیگر، گوگل در سرویس Gemini اعلام کرده که Gemini Omni جایگزین Veo قبلی در خود اپلیکیشن Gemini شده و Gemini Omni 1.1 Flash مدل قبلی Veo 3.1 در Gemini را جایگزین کرده است. این موضوع به این معنا نیست که Veo 3.1 از Flow حذف شده است؛ بلکه باید بین مدل های مورد استفاده در Gemini و مدل های موجود در Flow تفاوت قائل شوید.

مدل های فعلی Flow چه تفاوتی با هم دارند؟

مدلمناسب برایقابلیت های شاخص
Veo 3.1 Liteتست ایده و تولید اقتصادیText to Video، Frames to Video، Ingredients، Extend
Veo 3.1 Fastتولید سریع و آزمون و خطاتولید سریع ویدیو، مناسب برای iteration
Veo 3.1 Qualityخروجی نهایی با کیفیت بالاترText to Video و Frames to Video با کیفیت بالاتر
Gemini Omni Flash 1.1تولید و ویرایش چندوجهیویدیو ۱۰ ثانیه ای، Ingredients، ویرایش ویدیویی و قابلیت های مکالمه ای

Gemini Omni چه چیزی به Flow اضافه کرده است؟

در به روزرسانی های جدید ۲۰۲۶، Google Flow از Gemini Omni هم بهره می برد و همین موضوع آن را از یک ابزار ساده تولید ویدیو دورتر کرده است. Omni برای کارهای چندوجهی طراحی شده؛ یعنی می تواند متن، تصویر و ویدیو را در یک workflow درک کند و در قابلیت هایی مانند ویرایش ویدیوی آپلودشده، ساخت ویدیو از تصاویر مرجع، تنظیم شات و تولید ویدیوهای ۱۰ ثانیه ای به کار رود.
Flow، Gemini Omni Flash 1.1 قابلیت هایی مانند موارد زیر دارد:

  • Text to Video
  • Frames to Video
  • First + Last Frame
  • Ingredients یا References
  • Video to Video Editing
  • تولید کلیپ های ۱۰ ثانیه ای
  • تولید در وضوح ۳۶۰p با هزینه اعتباری کمتر
  • Upscale برخی خروجی ها
  • ویرایش ویدیوی تولیدشده یا آپلودشده

Flow در سال ۲۰۲۶ فقط ابزار ساخت ویدیو نیست

اشتراک گذاری:

آکادمی سالچین - سالیدیتی

مطالب زیر را حتما بخوانید
  • Claude Fable 5.1 چیست؟ معرفی مدل جدید هوش مصنوعی آنتروپیک
    Claude Fable 5.1 چیست؟ معرفی مدل جدید هوش مصنوعی آنتروپیک

    65 بازدید

  • جمنای 3.8 - Gemini 3.8
    معرفی جمنای 3.8 – بررسی Gemini 3.8 کامل جدیدترین مدل هوش مصنوعی گوگل

    155 بازدید

  • GPT-6 Astra معرفی شد – نسل جدید هوش مصنوعی OpenAI
    GPT-6 Astra معرفی شد – نسل جدید هوش مصنوعی OpenAI

    167 بازدید

  • AI Mode گوگل چیست؟ قابلیت جدید گوگل که آینده جستجو را تغییر می‌دهد!
    AI Mode گوگل چیست؟ قابلیت جدید گوگل که آینده جستجو را تغییر می‌دهد!

    189 بازدید

  • Google Pics چیست؟ معرفی ابزار جدید هوش مصنوعی گوگل برای طراحی و ویرایش تصویر
    Google Pics چیست؟ معرفی ابزار جدید هوش مصنوعی گوگل برای طراحی و ویرایش تصویر

    216 بازدید

  • هوش مصنوعی جدید Wan 3.0 چیست؟
    هوش مصنوعی جدید Wan 3.0 چیست؟

    329 بازدید

قدیمی تر Claude Fable 5.1 چیست؟ معرفی مدل جدید هوش مصنوعی آنتروپیک

دیدگاهتان را بنویسید لغو پاسخ

آکادمی سالچین

  • گوگل Flow با Veo 3.1 آپدیت شد – هوش مصنوعی جدید گوگل برای ساخت فیلم سینمایی
  • Claude Fable 5.1 چیست؟ معرفی مدل جدید هوش مصنوعی آنتروپیک
  • معرفی جمنای 3.8 – بررسی Gemini 3.8 کامل جدیدترین مدل هوش مصنوعی گوگل
  • GPT-6 Astra معرفی شد – نسل جدید هوش مصنوعی OpenAI
  • AI Mode گوگل چیست؟ قابلیت جدید گوگل که آینده جستجو را تغییر می‌دهد!
درباره سالچین

آکادمی سالچین مرجع آموزش و اجرای پروژه های هوش مصنوعی است. ما با آموزش تولید محتوا، ایجنت های هوشمند و راهکارهای کاربردی Ai به افراد و کسب و کارها کمک میکنیم تا رشد کنند، درآمد بیشتری داشته باشند و برندشان را با هوش مصنوعی بدرخشانند.

فهرست منو
  • جلسه مشاوره
  • مقالات
  • دوره سالیدیتی
  • دوره NFT
  • دوره کیف پول ارز دیجیتال
شگفت زده شوید!
  • آدرس: تهران، خ شریعتی
  • تماس: تلگرام salchain
  • ایمیل: office[at]salchain.ir

©2025 - All Rights Reserved | تمامی حقوق برای آکادمی سالچین محفوظ می باشد.

ساخته شده: آکادمی سالچین

درخواست مشاوره رایگان

  • 0219996000

فرم درخواست مشاوره

مشاوره

ورود | ثبت نام
ورود
ورود با رمز یکبار مصرف
فراموشی رمز عبور
اعتبارسنجی

ارسال کد به ایمیل
ارسال کد به موبایل
ثبت نام

  • حداقل 8 کاراکتر
  • حروف کوچک و بزرگ انگلیسی
  • شامل عدد
  • شامل کارکتر علائم ویژه (*)
بازیابی رمز عبور

  • حداقل 8 کاراکتر
  • حروف کوچک و بزرگ انگلیسی
  • شامل عدد
  • شامل کارکتر علائم ویژه (*)
بازگشت
ورود با رمزعبور
جستجو

جستجو با زدن Enter و بستن با زدن ESC