3-दिन की असीमित पहुंच प्राप्त करें Seedance 2.5 + अधिक के लिए25% तक छूट

छूट -- में समाप्त होती है

इस ऐप के साथ बनाया गया

Gemini Omni Flash 1.1 Google का बहु-माध्यम वीडियो मॉडल है, जो यहाँ लघु-रूप वीडियो बनाने और संपादित करने के लिए एक केंद्रित ऐप के रूप में उपलब्ध है। यह पाठ संकेत, एक स्थिर छवि, एक वैकल्पिक अंतिम फ्रेम, दस तक संदर्भ छवियाँ, या तीन संदर्भ क्लिप स्वीकार करता है, और यह सादे भाषा के निर्देश से किसी मौजूदा वीडियो को संपादित कर सकता है। आउटपुट 360p से 4K तक तीन से दस सेकंड तक चलता है, जिसमें मूल रूप से सिंक्रोनाइज़ ऑडियो शामिल है। यह निर्माताओं, विपणकों और डेवलपर्स के लिए उपयुक्त है जिन्हें सटीक दृश्य निरंतरता, पठनीय ऑन-स्क्रीन पाठ और पॉलिश ऑडियो की आवश्यकता है बिना अलग ध्वनि पास के।

इस ऐप का उपयोग कैसे करें

  1. 1

    वर्णन करें कि आप क्या बनाना चाहते हैं, या अपनी सोर्स फाइल अपलोड करें।

  2. 2

    अपने विकल्प चुनें, फिर जेनरेट दबाएं।

  3. 3

    कुछ पलों में अपना परिणाम गैलरी में दिखाई देता हुआ देखें।

  4. 4

    डाउनलोड करें, शेयर करें, या एक नई आइडिया के साथ फिर से जेनरेट करें।

आप क्या बना सकते हैं

उत्पाद क्लोज़-अप ऑडियो के साथ

किसी उत्पाद का वर्णन करें, शुरुआती फ्रेम के रूप में एक स्थिर फोटो प्रदान करें, और मॉडल को 4K पर सिंक्रोनाइज़ परिवेश या वॉयसओवर-शैली ऑडियो के साथ एनिमेट करने दें। मॉडल का विश्व ज्ञान हर फ्रेम में पैकेजिंग पर लेबल और पाठ को पठनीय रखता है, जो AI उत्पाद वीडियो में एक सामान्य समस्या को हटाता है।

संदर्भ-संचालित चरित्र निरंतरता

किसी चरित्र या स्थान की दस तक संदर्भ छवियाँ अपलोड करें ताकि प्रत्येक रेंडर को निर्देशित किया जा सके। Gemini Omni Flash 1.1 कटों में दृश्य पहचान को सुसंगत रखता है, जिससे यह स्टोरीबोर्ड-शैली अनुक्रमों, ब्रांडेड शुभंकरों, या आवर्ती दृश्य सेटिंग्स के लिए व्यावहारिक बनाता है जो शॉट दर शॉट समान दिखना चाहिए।

निर्देश द्वारा मौजूदा क्लिप संपादित करना

एक स्रोत वीडियो में डालें और एक सादे भाषा संपादन निर्देश टाइप करें जैसे 'आकाश को बादल भरा बनाएँ' या 'पृष्ठभूमि की अव्यवस्था हटाएँ।' मॉडल एक अलग कंपोजिटिंग चरण के बिना परिवर्तन लागू करता है, जो अन्यथा समाप्त फुटेज पर त्वरित संशोधन दौर के लिए उपयोगी है।

पाठ-ओवरले गति ग्राफिक्स

क्योंकि मॉडल Gemini के विश्व ज्ञान में निहित है, ऑन-स्क्रीन पाठ सही ढंग से प्रस्तुत होता है और गति के माध्यम से तीव्र रहता है। इसे गतिशील शीर्षकों, निचली तिहाई, या डेटा कॉलआउट के लिए उपयोग करें जहाँ अन्य जनरेटिव मॉडल आमतौर पर विकृत या बहाव वाले अक्षर उत्पन्न करते हैं।

छवि-से-वीडियो कहानी बीट्स

एक शुरुआती छवि और एक वैकल्पिक अंतिम फ्रेम प्रदान करें ताकि दृश्य के पहले और अंतिम क्षणों को परिभाषित किया जा सके, फिर मॉडल को बीच में कार्रवाई को प्रक्षेपित करने दें। यह अवधारणा प्रस्तुतियों, एनिमेटिक्स, और पिच डेक के लिए अच्छी तरह से काम करता है जहाँ आपको स्थिर कलाकृति से नियंत्रित गति की आवश्यकता है।

आज़माने के लिए प्रॉम्प्ट आइडियाज़

क्रिएटर्स इस ऐप का उपयोग क्यों करते हैं

  • नेटिव सिंक्रोनाइज़्ड ऑडियो
  • 360p से 4K आउटपुट
  • 3-10 सेकंड की अवधि
  • टेक्स्ट, इमेज और रेफरेंस इनपुट
  • रेफरेंस वीडियो स्टीयरिंग
  • निर्देश से वीडियो एडिट करें

बेहतर परिणामों के लिए टिप्स

संकेत के साथ पाठ को एंकर करें

जब आपके वीडियो को पठनीय शब्दों की आवश्यकता हो, तो उन्हें संकेत में बिल्कुल स्पष्ट करें। Gemini Omni Flash 1.1 विश्व ज्ञान में निहित है, जो इसे अक्षर रूप सटीकता पर एक बढ़त देता है, लेकिन एक स्पष्ट संकेत अभी भी बहाव को कम करता है और सुनिश्चित करता है कि मॉडल उस तत्व को प्राथमिकता देता है।

नियंत्रण के लिए अंतिम फ्रेम का उपयोग करें

एक शुरुआती छवि और एक अंतिम फ्रेम दोनों प्रदान करने से मॉडल को प्रक्षेपित करने के लिए दो एंकर मिलते हैं। यह चाप और संरचना को नियंत्रित करने का सबसे विश्वसनीय तरीका है जब आपको क्लिप के निष्कर्ष पर एक विशिष्ट दृश्य पेऑफ की आवश्यकता हो, खुली-अंत गति के बजाय।

संदर्भ इनपुट को रणनीतिक रूप से परत करें

मॉडल दस तक संदर्भ छवियाँ और तीन संदर्भ क्लिप एक साथ स्वीकार करता है। चरित्र या वस्तु सुसंगतता के लिए छवि स्लॉट का उपयोग करें और गति शैली या कैमरा व्यवहार को परिभाषित करने के लिए क्लिप स्लॉट का उपयोग करें। एक रेंडर में दोनों इनपुट प्रकारों को मिलाने से आपको अकेले किसी भी इनपुट प्रकार की तुलना में बेहतर स्टीयरिंग मिलता है।

संपादन निर्देश सटीक रूप से लिखें

वीडियो-संपादन मोड का उपयोग करते समय, वर्णन करें कि क्या बदलना है और एक ही निर्देश में क्या संरक्षित करना है। एक वाक्यांश जैसे 'दीवार का रंग गहरे नीले-हरे रंग में बदलें, फर्नीचर और प्रकाश को समान रखें' एक अस्पष्ट निर्देश की तुलना में बहुत अधिक प्रभावी है, क्योंकि यह संपादन और अपरिवर्तित तत्वों दोनों पर स्पष्ट बाधाएँ निर्धारित करता है।

इस ऐप को कब चुनें

इस ऐप को चुनें जब आपकी प्राथमिकता 4K रिज़ॉल्यूशन हो जिसमें एक रेंडर से मूल रूप से सिंक्रोनाइज़ ऑडियो हो, कई संपत्तियों में संदर्भ-नियंत्रित दृश्य निरंतरता हो, पठनीय ऑन-स्क्रीन पाठ हो, या एक टाइप किए गए निर्देश के माध्यम से एक मौजूदा क्लिप को संपादित करने की क्षमता हो। Seedance 2.5 30 सेकंड तक लंबे रन को कवर करता है और बहुत अधिक संदर्भ सामग्री स्वीकार करता है, जो तब बेहतर फिट है जब अवधि या संदर्भ गहराई रिज़ॉल्यूशन स्तर से अधिक महत्वपूर्ण हो। Wan 3.0 30-सेकंड एकल-पास वीडियो सर्वव्यापी-संदर्भ के साथ प्रदान करता है, जिससे यह विस्तारित दृश्यों के लिए मजबूत विकल्प बन जाता है। Gemini Omni Flash 1.1 सही विकल्प है जब आपको तीनों में से सर्वोच्च आउटपुट रिज़ॉल्यूशन की आवश्यकता हो, या इसे पुनः उत्पन्न करने के बजाय एक टाइप किए गए निर्देश द्वारा एक मौजूदा क्लिप को संशोधित करना चाहते हों।

अक्सर पूछे जाने वाले प्रश्न

क्या मैं कोई छवि प्रदान किए बिना वीडियो बना सकता हूँ?

हाँ। ऐप अकेले पाठ संकेत स्वीकार करता है। छवियाँ, अंतिम फ्रेम, संदर्भ छवियाँ, और संदर्भ क्लिप सभी वैकल्पिक इनपुट हैं। आपको उन्हें केवल तभी प्रदान करने की आवश्यकता है जब आप दृश्य निरंतरता को निर्देशित करना चाहते हैं, गति अंतिम बिंदुओं को परिभाषित करना चाहते हैं, या किसी विशिष्ट चरित्र या स्थान को आपकी स्रोत सामग्री से मेल खाना चाहते हैं।

आउटपुट में मूल रूप से सिंक्रोनाइज़ ऑडियो कैसे काम करता है?

Gemini Omni Flash 1.1 वीडियो उत्पन्न करने वाले समान मॉडल पास के हिस्से के रूप में ऑडियो उत्पन्न करता है, इसलिए ध्वनि बाद में एक सामान्य ट्रैक जोड़े जाने के बजाय दृश्यों के समय में होती है। परिणामी MP4 में ऑडियो चैनल पहले से ही एम्बेड किया गया है, एक अलग मिश्रण चरण के बिना उपयोग के लिए तैयार है।

मैं एक रेंडर में कितने संदर्भ इनपुट प्रदान कर सकता हूँ?

आप एक रेंडर में दस तक संदर्भ छवियाँ और तीन तक संदर्भ वीडियो क्लिप प्रदान कर सकते हैं। ये इनपुट मॉडल को चरित्रों, वस्तुओं, स्थानों, या कैमरा गति शैली के लिए सुसंगत दृश्य पहचान की ओर निर्देशित करते हैं, जो संदर्भ चित्रित करते हैं उस पर निर्भर करता है।

क्या वीडियो-संपादन मोड किसी भी अपलोड किए गए क्लिप पर काम करता है?

संपादन मोड एक स्रोत के रूप में एक मौजूदा वीडियो लेता है और इसे संशोधित करने के लिए एक सादे भाषा निर्देश लागू करता है। मॉडल प्राकृतिक भाषा की व्याख्या करता है, इसलिए आपको तकनीकी पैरामीटर निर्दिष्ट करने की आवश्यकता नहीं है। परिणाम सबसे सुसंगत होते हैं जब निर्देश स्पष्ट रूप से बताता है कि क्या बदलना चाहिए और क्या समान रहना चाहिए।

सामाजिक या वेब वितरण के लिए मुझे कौन सा रिज़ॉल्यूशन चुनना चाहिए?

अधिकांश सामाजिक प्लेटफॉर्म के लिए, 1080p एक व्यावहारिक डिफ़ॉल्ट है क्योंकि यह दृश्य गुणवत्ता को फ़ाइल आकार और अपलोड आवश्यकताओं के साथ संतुलित करता है। 4K का उपयोग करें जब गंतव्य इसका समर्थन करता है, जैसे एक उच्च-रिज़ॉल्यूशन डिस्प्ले डेमो या एक प्लेटफॉर्म जो एक उच्च स्रोत से सुंदरता से डाउनसैंपल करता है। 720p पूर्वावलोकन या ड्राफ्ट के लिए उपयुक्त है। 360p अंतिम रिज़ॉल्यूशन के लिए प्रतिबद्ध होने से पहले तेजी से पुनरावृत्ति के लिए उपयोगी है।

मैं कई अलग-अलग रेंडर में एक चरित्र को सुसंगत कैसे रखूँ?

एक रेंडर से अपनी संदर्भ छवियाँ सहेजें और उन्हें अगली रेंडर में संदर्भ इनपुट के रूप में प्रदान करें। मॉडल प्रति रन दस तक संदर्भ छवियाँ स्वीकार करता है, इसलिए आप सुसंगतता को मजबूत करने के लिए एक ही चरित्र के कई कोण या अभिव्यक्तियाँ शामिल कर सकते हैं। छवि संदर्भों को एक वर्णनात्मक संकेत के साथ मिलाना जो चरित्र की विशिष्ट विशेषताओं का नाम देता है, सुसंगतता को और बेहतर बनाता है।

इस ऐप को कौन सा AI मॉडल संचालित करता है?

यह ऐप Gemini Omni Flash 1.1 पर चलता है, जो Arteza के माध्यम से अलग खाते या सेटअप के बिना उपलब्ध है।

क्या मैं परिणामों का व्यावसायिक रूप से उपयोग कर सकता हूं?

हां। आपके द्वारा जेनरेट किया गया कंटेंट आपका है, हमारे कंटेंट लाइसेंस के अधीन।

एक जनरेशन में कितना समय लगता है?

अधिकांश जनरेशन एक मिनट से कम समय में पूरी हो जाती हैं, और आप गैलरी में लाइव प्रगति देख सकते हैं।

और ऐप्स एक्सप्लोर करें