1

شرکت ادوبی در حال گسترش قابلیت‌های صوتی پلتفرم هوش مصنوعی Firefly است تا کاربران بتوانند بخش عمده، یا حتی تمام اجزای صوتی یک ویدئو را بدون نیاز به استفاده از ابزارهای جداگانه تولید کنند. سه قابلیت Generate Music، Generate Speech و Generate Sound Effects اکنون به‌طور عمومی در دسترس قرار گرفته‌اند و بخش‌های اصلی موردنیاز برای ساخت صدای یک ویدئو را پوشش می‌دهند.

ابزار Generate Music به کاربران امکان می‌دهد موسیقی متناسب با ویدئو تولید کنند. Firefly می‌تواند ویدئو را تحلیل کرده و بر اساس حال‌وهوا، سبک، انرژی و ریتم آن، موسیقی اختصاصی پیشنهاد دهد. کاربران نیز می‌توانند توضیحات یا تنظیمات خود را برای کنترل بیشتر بر نتیجه وارد کنند. ادوبی اعلام کرده است موسیقی تولیدشده با این ابزار برای استفاده تجاری مجاز است.  قابلیت Generate Speech نیز برای ساخت گویندگی و صداگذاری طراحی شده است.

این ابزار می‌تواند متن را به گفتاری طبیعی تبدیل کند و امکان تنظیم عواملی مانند احساس، سرعت و تأکید در گفتار را فراهم می‌کند. پشتیبانی از بیش از 20 زبان نیز برای این قابلیت در نظر گرفته شده است. در کنار این دو ابزار، Generate Sound Effects به کاربران اجازه می‌دهد جلوه‌های صوتی، صداهای محیطی و افکت‌های موردنیاز ویدئو را از طریق توضیحات متنی تولید کنند. کاربر همچنین می‌تواند صدای مرجع بارگذاری کند یا حتی با اجرای صوتی یک صدا از طریق میکروفون، زمان‌بندی و ویژگی‌های جلوه تولیدشده را هدایت کند. سپس می‌توان شدت، زمان‌بندی و ترکیب چندین افکت را برای هماهنگی بهتر با بخش‌های مختلف ویدئو تنظیم کرد.

هدف ادوبی از کنار هم قرار دادن این قابلیت‌ها، تبدیل Firefly به محیطی جامع‌تر برای تولید محتواست؛ محیطی که کاربر بتواند ویدئو، موسیقی متن، گویندگی و جلوه‌های صوتی را در یک جریان کاری واحد تولید و ویرایش کند. چنین رویکردی می‌تواند به‌ویژه برای تولیدکنندگان محتوا و بازاریابانی که به تولید سریع ویدئو نیاز دارند، وابستگی به چندین ابزار و اشتراک جداگانه را کاهش دهد. با این حال، این ابزارها لزوماً جایگزین کامل مهندسان حرفه‌ای صدا، آهنگسازان یا گویندگان نخواهند بود. کاربرد اصلی آن‌ها در ساده‌تر و سریع‌تر کردن تولید محتوا و فراهم‌کردن راهی برای ساخت اجزای صوتی ویدئو با استفاده از هوش مصنوعی است.