ساخته شده با این اپلیکیشن
OmniHuman v1.5 یک عکس پرتره تک و یک فایل صوتی را به یک ویدیوی آواتار متحرک کاملاً تبدیل میکند که دارای حرکت لبهای همزمان، عبارات طبیعی چهره و ژستهای منطبق با گفتار است. خروجی یک فایل MP4 تمیز در کیفیت 720p یا 1080p است که آن را برای ارائهدهندگان مجازی، سخنگویان برند، ناظران آموزش الکترونیکی و هر کسی که به ویدیوی سخنگو حرفهای بدون تجهیزات دوربین یا استودیو نیاز دارد، عملی میکند.
نحوه استفاده از این اپلیکیشن
- 1
آنچه را میخواهید ایجاد کنید توصیف کنید یا فایل منبع خود را آپلود کنید.
- 2
گزینههای خود را انتخاب کنید، سپس تولید را فشار دهید.
- 3
نتیجه خود را در گالری در چند لحظه ببینید.
- 4
دانلود کنید، به اشتراک بگذارید یا با ایده جدیدی دوباره تولید کنید.
آنچه میتوانید بسازید
مدرسان دورههای مجازی
یک عکس حرفهای سر و شانه و یک اسکریپت سخنرانی ضبطشده را آپلود کنید تا یک مدرس روی صفحه تولید شود که طبیعی حرف میزند، ژست میدهد و واکنش نشان میدهد. OmniHuman v1.5 عبارات چهره را با تن صوتی تطابق میدهد، بنابراین آواتار در تمام دورهای 60 ثانیهای صوت در کیفیت 720p احساس طبیعی و زندهتر میشود.
نمایش محصولات چندزبانه
یک صدای تکمیلنویسی به هر زبانی ضبط کنید، آن را با یک عکس نمایندهٔ برند ترکیب کنید و در چند دقیقه یک ویدیوی سخنگوی محلیسازیشده تولید کنید. از آنجا که OmniHuman v1.5 ژستها را از ریتم گفتار بدست میآورد، زبان بدن بدون نیاز به کیفریمینگ دستی با ریتم طبیعی هر زبان تطابق مییابد.
اعلانات داخلی شرکتی
تیمهای منابع انسانی و ارتباطات میتوانند یک عکس سر و شانهٔ مدیری را به یک پیام ویدیویی حرفهای برای توزیع سراسری تبدیل کنند. گزینهٔ خروجی 1080p تضمین میکند که ویدیو در صفحههای بزرگ کیفیت خود را حفظ کند، در حالی که همزمانی لبها اعتبار را برقرار میدارند وقتی مدیر نمیتواند مستقیماً روبروی دوربین ظاهر شود.
ویدیوهای شخصیت شبکههای اجتماعی
سازندگان محتوای که ترجیح میدهند پشت صحنه بمانند میتوانند از یک پرتره یک شخصیت روی صفحهای سازگار بسازند. برای هر پست صوت اسکریپتشده تغذیه کنید و یک آواتار MP4 دریافت کنید که صورت، عبارات و سبک ژستی یکسان را در تمام ویدیوهای یک سری حفظ میکند.
نقاط فروش بازاریابی نمونهای
قبل از تعهد به یک فیلمبرداری زنده، تیمهای بازاریابی میتوانند اسکریپتها و جهت بصری را با تولید یک ویدیوی ارائهدهندهٔ واقعگرایانه از عکس بدون حق کپی یا مفهومی تأیید کنند. محدودیت 30 ثانیهای 1080p برای قالبهای معمول ویدیوی تبلیغات و شبکههای اجتماعی مطابقت خوبی دارد و چرخههای بررسی را سریعتر و ارزانتر میکند.
ایدههای پرامپت برای امتحان
چرا خلاقان از این اپلیکیشن استفاده میکنند
- ورودی تک عکس
- همگام سازی لب کامل
- عبارات طبیعی
- تولید حرکات
- حالت توربو
- خروجی 720p/1080p
نکاتی برای نتایج بهتر
یک پرتره تمیز انتخاب کنید
OmniHuman v1.5 تمام انیمیشن را از یک عکس ساخته است، بنابراین کیفیت تصویر اهمیت دارد. از یک پرتره روشنشدهٔ روبهرو با پسزمینهٔ خنثی استفاده کنید. از فیلترهای سنگین، زوایای شدید یا برشهای صورت جزئی اجتناب کنید، زیرا این موارد دقت مدل را در تولید حرکت لب و عبارات محدود میکنند.
مدت صوت را با کیفیت تطابق دهید
اپلیکیشن تا 60 ثانیه در 720p و 30 ثانیه در 1080p را پشتیبانی میکند. اسکریپت خود را قبل از ضبط در حد صحیح برنامهریزی کنید. برش صوت پس از ضبط اغلب باعث پایانهای ناگهانی میشود، بنابراین ابتدا روایت خود را بنویسید و زمانبندی کنید، سپس کیفیتی را انتخاب کنید که با مدت صوت شما مطابقت داشته باشد.
از صوت بیانی برای ژستهای بهتر استفاده کنید
تولید ژست در OmniHuman v1.5 توسط ریتم گفتار و احساس در صوت هدایت میشود. یک ضبط تخت و یکنواخت حرکت کمینهای تولید میکند. با ریتم طبیعی، تاکید متنوع و قصد احساسی روشن ضبط کنید تا یک آواتار پویاتر و زندهتر با تلنگرهای سر و ژستهای بدن مناسب دریافت کنید.
از حالت Turbo برای تکرار سریع استفاده کنید
حالت Turbo تولید را تسریع میکند و آن را برای آزمایش انتخابهای صوتی یا پرترههای متفاوت قبل از تعهد به یک رندر نهایی ایدهآل میسازد. ابتدا آواتار خود را در 720p با حالت Turbo طراحی کنید، تأیید کنید نتیجه نیازهای شما را برآورده میکند، سپس نسخهٔ پولیششدهٔ 1080p را برای توزیع تولید کنید.
زمانی که این اپ را انتخاب کنید
OmniHuman v1.5 انتخاب درستی است وقتی واقعگرایی و همزمانی بیانی بالاترین اولویتها باشند. در مقایسه با SadTalker، حرکت صورت به طور نمایانی طبیعیتر و انیمیشن ژست کامل را به جای حرکت سر تنها تولید میکند. در مقایسه با Sync-3 Lipsync، یک آواتار متحرک کامل را از یک عکس تولید میکند به جای نیاز به فایل ویدیویی موجود به عنوان ورودی. اگر هدف شما یک ارائهدهندهٔ مجازی معتبر از مواد منبع کمینه است، OmniHuman v1.5 بیشترین راهحل کامل در خطوط است.
سوالات متداول
آیا میتوانم از یک پرتره تصویری شده یا سبکدار به جای عکس استفاده کنم؟
OmniHuman v1.5 میتواند پرترههای غیرعکاسی مانند تصاویر دیجیتالی یا شخصیتهای رندرشده را متحرک کند، اما نتایج با پرترههای انسانی واقعگرایانه قابل اعتمادتر است. تصاویر بسیار سبکدار با نسبتهای اغراقآمیز یا ویژگیهای غیرانسانی ممکن است همزمانی لب و دقت عبارت ناسازگار را تولید کنند.
آیا مدل هویت و ظاهر شخص در عکس را حفظ میکند؟
بله. OmniHuman v1.5 صورت، رنگ پوست، موی سر و ظاهر کلی را با پرتره ورودی در طول ویدیوی تولید شده ثابت نگاه میدارد. صورت موجود را متحرک میکند نه جایگزین کردن آن، بنابراین آواتار شبیه شخص در عکس اصلی است.
چه قالبها و سطح کیفیت صوتی بهترین نتایج را میدهند؟
اگرچه اپلیکیشن فایلهای صوتی استاندارد را قبول میکند، گفتار روشن ضبطشده در سطح صدای ثابت بدون نویز پسزمینه یا فشردهسازی سنگین بیشترین همزمانی لب را تولید میکند. از صوت پردازششدهٔ سنگین با طنین یا صداهای برهمافتاده اجتناب کنید، زیرا این موارد میتوانند شناسایی ریتمی را که ژستها را هدایت میکند گمراه کنند.
آیا روشی برای کنترل شدت ژستها یا عبارات است؟
شدت ژست و عبارت در OmniHuman v1.5 به طور خودکار از احساس و ریتم صوت بجای کنترلهای دستی بدست میآیند. تنظیم تحویل، ریتم و بیانی صوت ضبطشده روش اصلی برای تأثیر بر اینکه آواتار در ویدیوی نهایی چقدر متحرک ظاهر میشود است.
آیا آواتار میتواند به هر زبانی حرف بزند؟
OmniHuman v1.5 همزمانی لب و ژستها را از موج صوتی و محتوای احساسی آن بدست میآورد نه از قوانین زبان خاص، بنابراین در سراسر زبانها کار میکند. دقت لب برای زبانهایی با الگوهای فونم کمتر معمول در دادههای آموزشی ممکن است کمی متفاوت باشد، اما نتایج کلی به طور گسترده چندزبانه است.
اگر همزمانی لب در جاهایی کمی دارای انحراف باشد چه کنم؟
ضبتمجدد صوت با تلفظ پاکتر و ریتم کمی آهستهتر اغلب مشکلات همزمانی جزئی را حل میکند. همچنین میتوانید از حالت Turbo برای آزمایش سریع یک ضبط صوتی جایگزین قبل از صرف اعتبار برای یک رندر کامل 1080p استفاده کنید. نویز پسزمینه در صوت اصلی رایجترین علت انحراف همزمانی است.
کدام مدل هوش مصنوعی این اپلیکیشن را تشغیل میکند؟
این برنامه بر روی OmniHuman v1.5 اجرا میشود که از طریق Arteza در دسترس است بدون نیاز به حساب یا تنظیمات جداگانه.
آیا میتوانم از نتایج بهصورت تجاری استفاده کنم؟
بله. محتوای تولیدی شما برای استفاده شما است، مشروط بر شرایط مجوزهای محتوای ما.
تولید چقدر طول میکشد؟
اکثر تولیدات کمتر از یک دقیقه تمام میشوند و شما میتوانید پیشرفت را بهصورت زنده در گالری مشاهده کنید.