إدخال الصورة والصوت
- يتطلب الإدخال عنوان URL واحدًا للصورة وعنوان URL صوتيًا واحدًا للكلام.
- يمكن أن تكون الصورة JPEG أو PNG أو WEBP بحجم يصل إلى 10 ميجابايت.
- يمكن أن يكون الصوت بتنسيقات MP3 أو WAV أو AAC أو MP4 أو OGG بحجم يصل إلى 10 ميجابايت.
UlazAI - أدوات الصور والفيديو بالذكاء الاصطناعي
نموذج بورتريه ناطق متميز
قم بتحويل صورة شخصية أو صورة شخصية أو موضوع محدد إلى فيديو ناطق يتم تشغيله بواسطة ملف صوتي للكلام. هذا هو الطريق الذي يجب استخدامه عندما تكون الهوية والتعبير وتوقيت الفم وأداء الجزء العلوي من الجسم أكثر أهمية من اختراع مشهد كامل من الصفر.
27 اعتماد / ثانية. تم تكوين إخراج الاستوديو لـ 1080.
مقاطع فيديو المؤسس، وشرح المنتج، ومقاطع المتحدث الرسمي المحلية.
التعليم الذي تقوده الشخصية حيث يحتاج الوجه نفسه إلى نصوص متعددة.
الرسوم المتحركة الشخصية حيث تكون حركة الفم والتعبير وتوقيت الصوت مهمة.
منشئ الذكاء الاصطناعي والصورة الرمزية ومقاطع الحملة التي تحتاج إلى وجه واحد قابل للتكرار عبر العديد من الرسائل.
فيديو نموذجي
استخدم هذا كفحص سريع للنموذج قبل الإنشاء: المدخلات المقبولة والمخرجات التي تم إنشاؤها والمسار الأوضح في Video Studio.
مدخل اختر المسار من الأصل الذي لديك بالفعل.
عينة شاهد المقاطع التي تم إنشاؤها قبل إنفاق الاعتمادات.
طريق امسح prompt، وحدد الأسعار، وامسح الخطوة التالية.
OmniHuman مخصص لأداء الشخصية المعتمد على الصوت. الصورة المصدر تعطي الهوية. يحرك مسار الكلام التوقيت وحركة الفم والكثير من التعبير.
يبدأ OmniHuman من صورة شخصية وصوت الكلام. تبدأ مزامنة الشفاه من مقطع فيديو موجود وتغير توقيت الفم ليتوافق مع الصوت الجديد.
| المدة | 720p / قاعدة | 1080p |
|---|---|---|
| 5s | 135 الاعتمادات | - |
| 10 ثانية | 270 الاعتمادات | - |
| 30 ثانية | 810 الاعتمادات | - |
| الستينيات | 1620 الاعتمادات | - |
استخدم OmniHuman عندما يكون الأصل التسويقي هو الشخص أو الشخصية، وليس مشهد الخلفية.
قم بإنشاء مقطع قصير للمؤسس أو الخبير أو مقدم العلامة التجارية من صورة واحدة والنص المنطوق الدقيق.
أعد استخدام الوجه نفسه عبر المسارات الصوتية المترجمة مع الحفاظ على تركيز المقطع على الكلام والتعبير.
أنشئ دروسًا صغيرة متعددة بنفس صورة الشخصية ومسارات صوتية واضحة مختلفة.
أنشئ مقاطع متكررة بأسلوب منشئ المحتوى حيث توفر الهوية نفسها روابط أو عروض أو إعلانات جديدة.
omnihuman_1_5
مقدر من الطول المحدد؛ يتحكم المسار الصوتي في السرعة
يتطلب عنوان URL واحدًا لصورة عمودية، وعنوان URL صوتيًا واحدًا للكلام، وسلوكًا قصيرًا prompt.
طريق مفتوحيبدأ OmniHuman من صورة شخصية وصوت الكلام. تبدأ مزامنة الشفاه من مقطع فيديو موجود وتغير توقيت الفم ليتوافق مع الصوت الجديد.
عنوان URL واحد للصورة الشخصية، وعنوان URL واحد للصوت الخاص بالكلام، وprompt للتعبير أو السلوك.
لا. مسار الاستوديو هو مسار إنشاء الفيديو؛ تعتبر مساعدات الكشف عبارة عن عمليات فحص منفصلة ولا يتم عرضها كنماذج فيديو.
يجب أن يكون الصوت أقل من 60 ثانية. للحصول على جودة أقوى للوجه، احتفظ بالمقاطع لمدة 15 ثانية تقريبًا أو أقل.
استخدم عناوين URL لصور JPEG أو PNG أو WEBP بحجم يصل إلى 10 ميجابايت.
يساعد القناع في تحديد موضوع واحد عندما تحتوي الصورة على عدة أشخاص أو عندما لا تؤدي الخلفية إلى تشغيل الرسوم المتحركة.
يعمل الوضع السريع على تسريع عملية الإنشاء ولكنه قد يقلل من التفاصيل وجودة الحركة.
تكاليف المسار 27 اعتماد لكل إخراج الثانية.