1

شرکت Runway ادعا می‌کند تازه‌ترین مدل متن‌به‌ویدیو آن، تصاویری حتی دقیق‌تر از نسخه قبلی تولید می‌کند. در یک پست وبلاگی روز دوشنبه، این شرکت اعلام کرد که مدل Gen-4.5 قادر است خروجی‌هایی “سینمایی و بسیار واقع‌گرایانه” بسازد، به‌گونه‌ای که تشخیص تفاوت میان واقعیت و محتوای تولیدشده با هوش مصنوعی دشوارتر شود. به گفته‌ی شرکت، Gen-4.5 دقت فیزیکی و وضوح بصری بی‌سابقه‌ای به دست آورده است.

این مدل بهتر از گذشته به دستورات متنی پایبند می‌ماند و می‌تواند صحنه‌های جزئی‌تر را بدون افت کیفیت ویدیو تولید کند. اشیای ساخته‌شده توسط این هوش مصنوعی “با وزن، شتاب و نیروی واقعی حرکت می‌کنند” و مایعات نیز “با دینامیک صحیح جریان می‌یابند”. این مدل به‌تدریج برای همه کاربران عرضه می‌شود و همان سرعت و کارایی نسخه قبلی را دارد. در همین حال، OpenAI نیز تلاش‌های خود را برای واقعی‌تر کردن ویدیوهای تولیدی افزایش داده است.

این شرکت در سپتامبر با معرفی مدل Sora 2 بهبودهای فیزیکی را برجسته کرد. “بیل پیبلز” مدیر Sora بیان کرد: می‌توانید به‌طور دقیق روی یک تخته‌پارو در آب پشتک بزنید و همه دینامیک‌های سیال و شناوری به‌درستی مدل‌سازی می‌شوند. Runway همچنین می‌گوید مدل Gen-4.5 در مدیریت سبک‌های بصری مختلف بهتر عمل می‌کند و می‌تواند خروجی‌های فوتورئالیستی، سبک‌دار و سینمایی را با ثبات بیشتری تولید کند. این استارتاپ ادعا دارد که تصاویر فوتورئالیستی ساخته‌شده با Gen-4.5 می‌توانند از نظر جزئیات و دقت، غیرقابل‌تشخیص از فیلم‌برداری واقعی باشند.