هوش مصنوعی

معرفی شاهکار جدید: هوش مصنوعی flux و انقلاب مدل چندوجهی FLUX 3 در تولید ویدیو

آنچه میخوانید

Toggle

سلام همراهان هوشیوز! امیدوارم حالتون عالی باشه و آماده شنیدن یکی از داغ‌ترین خبرهای تکنولوژی در تابستان ۲۰۲۶ باشید. اگر اخبار دنیای خلاقیت و تولید محتوا را دنبال می‌کنید، حتماً می‌دانید که به‌تازگی خبر رونمایی از نسخه جدید هوش مصنوعی flux حسابی در شبکه‌های اجتماعی سروصدا کرده است. استارتاپ Black Forest Labs در تاریخ ۲۳ جولای ۲۰۲۶ از این شاهکار جدید پرده برداشت. این بار با یک آپدیت معمولی طرف نیستیم؛ ما داریم درباره یک جهش بزرگ در دنیای مدل‌های چندوجهی (Multimodal) صحبت می‌کنیم.

تیم سازنده هوش مصنوعی flux این بار فراتر از تولید تصاویر ثابت رفته است. مدل جدید FLUX 3 می‌تواند کلیپ‌های ویدیویی را تا سقف ۲۰ ثانیه تولید کند و خبر دیوانه‌کننده‌تر این است که صدای هماهنگ با ویدیو را نیز به‌صورت همزمان می‌سازد. در این مقاله می‌خواهیم این مدل را حسابی زیر ذره‌بین ببریم، وضعیت فعلی دسترسی به آن را بررسی کنیم و ببینیم چرا این ابزار توانسته توجه تمام کامیونیتی‌های تخصصی را به خود جلب کند.

وضعیت فعلی دسترسی؛ چطور همین حالا از FLUX 3 استفاده کنیم؟

یکی از بزرگ‌ترین سؤالاتی که این روزها مطرح می‌شود این است که آیا مدل جدید به صورت کامل منتشر شده است؟ جواب این است که این مدل منتشر شده، اما هنوز برای عموم به صورت کاملاً باز در دسترس نیست. استارتاپ Black Forest Labs این ابزار را در قالب فاز دسترسی زودهنگام (Early Access) روانه بازار کرده است.

چیزی که امروز می‌توانید از آن استفاده کنید، مشخصاً مدل FLUX 3 Video است. شرکت سازنده اعلام کرده است که در حال حاضر بخش ویدیویی در اولویت قرار دارد و دسترسی به آن به صورت کنترل‌شده و مرحله‌به‌مرحله انجام می‌شود. اگر می‌خواهید همین امروز شانس خودتان را امتحان کنید، باید از مسیر ثبت‌نام Early Access در دیسکورد یا از طریق پلتفرم‌های پارتنر (Partner Platforms) که از قبل پشتیبانی این مدل را اضافه کرده‌اند، اقدام کنید. فایل‌های قابل دانلود و متن‌باز (Open Weights) نیز برای اواخر سال ۲۰۲۶ زمان‌بندی شده‌اند.

انقلاب یکپارچگی: تفاوت هوش مصنوعی flux با رقبای قدیمی

در مقایسه با نسخه قبلی که در مقاله راهنمای کامل مدل FLUX 2 مفصل درباره کیفیت عکس‌هایش صحبت کردیم، نسخه سوم یک معماری کاملاً یکپارچه موسوم به Self-Flow دارد. این معماری نه‌تنها ویدیو و تصویر را ادیت می‌کند، بلکه در زمینه پیش‌بینی حرکات نیز کاربرد دارد.

در مدل‌های سنتی، شما یک ویدیو بی‌صدا تولید می‌کردید و بعد در ابزارهای دیگر رویش صدا می‌گذاشتید. اما هوش مصنوعی flux زمان، مکان و صدا را در یک سیستم واحد پردازش می‌کند. یعنی وقتی در پرامپت می‌نویسید «افتادن یک لیوان شیشه‌ای»، شبکه عصبی دقیقاً می‌فهمد که صدای شکستن باید در لحظه برخورد با زمین تولید شود.

> «وقتی مدل‌های هوش مصنوعی را به صورت چندوجهی و یکپارچه آموزش می‌دهیم، آن‌ها فیزیک دنیای واقعی را بهتر درک می‌کنند. صدا و حرکت دیگر دو موجودیت جداگانه نیستند و باید به صورت همزمان رندر شوند.»

— تیم تحقیق و توسعه استارتاپ سازنده

Structure flux3

نظرات و بازتاب‌های واقعی در کامیونیتی‌ها (ردیت، هکرنیوز و X)

وقتی یک ابزار تا این حد سروصدا می‌کند، بررسی نظرات کاربران گیک در کامیونیتی‌ها بسیار جذاب است. بیایید ببینیم در گوشه و کنار اینترنت درباره هوش مصنوعی flux چه می‌گویند:

  • هکرنیوز (Hacker News): در این انجمن تخصصی، بحث‌ها به‌شدت روی کلمه “Early Access” متمرکز است. توسعه‌دهندگان از اینکه دسترسی محدود است کمی شاکی هستند، اما معماری مدل و توانایی آن در حفظ ثبات کاراکتر را یک دستاورد مهندسی بی‌نظیر می‌دانند.
  • ردیت (Reddit): در ساب‌ردیت‌های مرتبط با ابزارهای تولید محتوا، کاربران مشغول مقایسه فریم‌به‌فریم خروجی‌های این مدل با رقبایی مثل مدل ویدیویی Runway Gen-4.5 هستند. بسیاری معتقدند تولید صدای بومی (Native Audio)، ساعت‌ها در زمان تدوین ویدیو صرفه‌جویی می‌کند.
  • شبکه X (توییتر سابق): ویدیوهای تست و دموهایی که از این مدل در توییتر پخش شده، بازخوردهای مثبتی داشته است. هنرمندان دیجیتال معتقدند این پلتفرم در کنار بهترین ابزارهای ساخت تصویر با هوش مصنوعی، می‌تواند به یک استودیوی تک‌نفره تبدیل شود.

از سرگرمی تا صنعت: کاربرد شگفت‌انگیز در رباتیک

شاید فکر کنید هدف از ساخت این مدل فقط ساخت کلیپ برای شبکه‌های اجتماعی است. اما استارتاپ سازنده فکر بسیار بزرگ‌تری در سر دارد. معماری یکپارچه FLUX 3 به‌گونه‌ای توسعه یافته که در آینده می‌تواند حرکات ربات‌ها را نیز پیش‌بینی کند. در صنایع پیشرفته، از این درک فیزیکی برای آموزش بازوهای رباتیک استفاده می‌کنند. مراحل کار به این شکل است:

  1. مدل از طریق دوربین‌های متصل به ربات، محیط را به صورت ویدیویی و صوتی دریافت می‌کند.
  2. سیستم با استفاده از موتور پیش‌بینی خود، اتفاقات چند ثانیه آینده (مثل سقوط یک جسم) را شبیه‌سازی می‌کند.
  3. ربات بر اساس امن‌ترین حالت پیش‌بینی شده، تصمیم به اجرای حرکت مکانیکی می‌گیرد.

Benchmark flux3 Benchmark flux3

جدول مقایسه قابلیت‌ها: FLUX 3 در برابر سایر مدل‌های بازار

برای اینکه دید بهتری از موقعیت هوش مصنوعی flux داشته باشیم، آن را با رقبای سرسختی که در بازار هستند مقایسه کرده‌ایم. در جدول زیر، ویژگی‌های کلیدی این مدل را در کنار ابزارهای مطرحی مثل Runway و هوش مصنوعی Luma Ray3 قرار داده‌ایم:

ویژگی اصلی مدل FLUX 3 رقبای فعلی (Runway / Luma)
طول ویدیو خروجی ۲۰ ثانیه معمولاً بین ۵ تا ۱۰ ثانیه
تولید صدای بومی و همگام بله (مستقیم) خیر / نیازمند ابزارهای جانبی
پیش‌بینی حرکات رباتیک دارد (معماری چندوجهی) ندارد (صرفاً متمرکز بر تصویر)
انتشار نسخه متن‌باز برنامه‌ریزی برای اواخر ۲۰۲۶ بیشتر مدل‌ها کاملاً بسته هستند

جمع‌بندی: آینده از آن کیست؟

در یک کلام، معرفی مدل جدید هوش مصنوعی flux یک آپدیت ساده نبود، بلکه یک زلزله در دنیای تولید محتوا بود. اگرچه در حال حاضر دسترسی به آن محدود و کنترل‌شده است، اما وعده انتشار نسخه‌های متن‌باز تا اواخر سال جاری میلادی، آینده بسیار روشنی را برای توسعه‌دهندگان مستقل رقم می‌زند. بی‌صبرانه منتظریم تا ببینیم کاربران با دسترسی به این ابزار قدرتمند چه شاهکارهایی خلق خواهند کرد.

منابع :

  • Black Forest Labs Announcement (July 23, 2026)
  • AI Reiter – FLUX 3 Early Access
مشاهده بیشتر
دکمه بازگشت به بالا