इस ऐप के साथ बनाया गया
Kling O3 Standard, Kuaishou की नवीनतम Kling आर्किटेक्चर को Arteza के टेक्स्ट-टू-वीडियो सूट में लाता है, जिसे ऐसे दृश्यों के लिए डिज़ाइन किया गया है जिनमें एक से अधिक विषय की आवश्यकता होती है। देशी बहु-चरित्र समर्थन, कस्टम इमेज तत्व इनपुट और जेनरेशन में सीधे एकीकृत वॉयस ऑडियो के साथ, यह उन निर्माताओं के लिए डिज़ाइन किया गया है जिन्हें पोस्ट-प्रोडक्शन में क्लिप्स को जोड़े बिना आबाद दृश्यों, संवादों या ब्रांडेड विग्नेट्स को निर्देशित करने की आवश्यकता है। वीडियो 5 से 10 सेकंड तक चलते हैं, जिससे यह सोशल कंटेंट, स्टोरीबोर्ड और छोटे आख्यान खंडों के लिए व्यावहारिक है।
इस ऐप का उपयोग कैसे करें
- 1
वर्णन करें कि आप क्या बनाना चाहते हैं, या अपनी सोर्स फाइल अपलोड करें।
- 2
अपने विकल्प चुनें, फिर जेनरेट दबाएं।
- 3
कुछ पलों में अपना परिणाम गैलरी में दिखाई देता हुआ देखें।
- 4
डाउनलोड करें, शेयर करें, या एक नई आइडिया के साथ फिर से जेनरेट करें।
आप क्या बना सकते हैं
दो-चरित्र संवाद दृश्य
जब स्क्रिप्ट को दो लोगों के बीच इंटरैक्शन की आवश्यकता होती है, तो Kling O3 एक ही जेनरेशन में कई चरित्रों को संभालता है। लेखक और फिल्ममेकर बातचीत के क्षण, दृश्य, या विभिन्न चरित्रों की विशेषता वाले सोशल विज्ञापनों को प्रोटोटाइप कर सकते हैं, बिना कार्रवाई को अलग-अलग क्लिप्स में विभाजित किए।
वॉयस-संचालित चरित्र एनिमेशन
Kling O3 देशी रूप से कस्टम वॉयस इनपुट स्वीकार करता है, इसलिए बोली गई ऑडियो दृश्य को आकार देती है बजाय बाद में लेयर किए जाने के। पॉडकास्टर, शिक्षक और विज्ञापनदाता एक विशिष्ट वॉकल डिलीवरी के लिए एक वीडियो को एंकर कर सकते हैं, लिप टाइमिंग और पेसिंग को शुरुआत से ही वास्तविक ऑडियो से जुड़ा हुआ रख सकते हैं।
ब्रांड एसेट एकीकरण
कस्टम तत्व सुविधा आपको अपनी खुद की छवियों को दृश्य घटकों के रूप में इनपुट करने देती है, जिससे यह उत्पाद प्रदर्शन, लोगो प्लेसमेंट या चरित्र डिज़ाइन के लिए उपयोगी है जो दृश्य रूप से सुसंगत रहना चाहिए। मार्केटर्स एक जेनरेट किए गए वीडियो को केवल टेक्स्ट से काम करने के बजाय मौजूदा ब्रांड विजुअल्स में ग्राउंड कर सकते हैं।
छोटे सोशल नैरेटिव क्लिप्स
5 से 10 सेकंड पर, Kling O3 Reels, Shorts और TikTok स्टोरीज़ की ध्यान विंडो में फिट बैठता है। कंटेंट टीमें एक ही पास में कई अभिनेताओं और देशी ऑडियो के साथ पूर्ण माइक्रो-नैरेटिव्स जेनरेट कर सकती हैं, एकल-चरित्र मॉडल की आवश्यकता वाली असेंबली कार्य को छोड़ते हुए।
स्टोरीबोर्ड एनिमेटिक्स
निर्देशक और एनिमेटर Kling O3 का उपयोग करके भीड़, जोड़ों या समूह कास्ट वाले दृश्यों के लिए त्वरित एनिमेटिक्स तैयार कर सकते हैं। बहु-चरित्र क्षमता का मतलब है कि प्रत्येक बीट को पूर्ण प्रोडक्शन में प्रतिबद्ध होने से पहले स्क्रीन पर सही संख्या में आकृतियों के साथ पूर्वावलोकन किया जा सकता है।
आज़माने के लिए प्रॉम्प्ट आइडियाज़
क्रिएटर्स इस ऐप का उपयोग क्यों करते हैं
- मल्टी-कैरेक्टर
- वॉइस इनपुट
- कस्टम एलिमेंट्स
- 5-10s अवधि
बेहतर परिणामों के लिए टिप्स
चरित्रों को स्पष्ट रूप से नाम दें
क्योंकि Kling O3 कई चरित्रों का समर्थन करता है, अपने प्रॉम्प्ट में प्रत्येक आकृति को स्पष्ट रूप से लेबल करें, उदाहरण के लिए 'चरित्र क, एक लंबा आदमी एक भूरे कोट में' और 'चरित्र ख, एक महिला एक लाल स्कार्फ में।' विभिन्न विवरण दृश्य ओवरलैप को कम करते हैं और मॉडल को प्रत्येक विषय के लिए स्पष्ट संकेत देते हैं।
वॉयस इनपुट को दृश्य पेसिंग से मिलाएं
देशी ऑडियो इनपुट का अर्थ है कि आप जो वॉयस सप्लाई करते हैं वह पूरी क्लिप में टाइमिंग को प्रभावित करता है। रिकॉर्ड की गई ऑडियो को 4 से 9 सेकंड के बीच रखें ताकि यह 5 से 10 सेकंड की आउटपुट विंडो में स्वच्छ रूप से मैप हो और किसी भी छोर पर अचानक कटऑफ से बचे।
कस्टम तत्वों को प्रॉम्प्ट के शुरुआत में एंकर करें
कस्टम इमेज तत्वों को अपलोड करते समय, अपने टेक्स्ट प्रॉम्प्ट के अंत में नहीं बल्कि शुरुआत में उनका संदर्भ दें। तत्व का वर्णन पहले करने से Kling O3 को एक कंपोजिशनल एंकर मिलता है इससे पहले कि अतिरिक्त दृश्य विवरण पेश किए जाएं, यह बेहतर करते हुए कि यह आपकी एसेट को फ्रेम में कैसे एकीकृत करता है।
स्थानिक संबंधों को निर्दिष्ट करें
बहु-चरित्र दृश्य स्पष्ट स्थानिक भाषा से लाभान्वित होते हैं: 'आमने-सामने खड़े,' 'एक बैठा, एक पीछे खड़ा,' या 'बाईं ओर साथ-साथ चल रहे।' स्पष्ट पज़िशनिंग अस्पष्टता को कम करती है और मॉडल को फ्रेम में पठनीय तरीके से चरित्रों को वितरित करने में मदद करती है।
इस ऐप को कब चुनें
Kling O3 चुनें जब आपकी अवधारणा एक से अधिक चरित्रों के इंटरैक्शन पर निर्भर करे, कस्टम दृश्य तत्वों की आवश्यकता हो, या जेनरेशन समय पर वॉयस ऑडियो को एकीकृत करने की आवश्यकता हो। Seedance 2.0 और Seedance 2.0 Mini जैसी सहयोगी ऐप्स द्रव एकल-विषय गति में उत्कृष्टता प्राप्त करती हैं, और Sora 2 उच्च सिनेमाटिक निष्ठा प्रदान करता है, लेकिन न तो बहु-चरित्र स्टेजिंग, कस्टम तत्व इनपुट और देशी वॉयस समर्थन का समान संयोजन प्रदान करता है जो Kling O3 एक ही जेनरेशन में प्रदान करता है।
अक्सर पूछे जाने वाले प्रश्न
एक एकल Kling O3 जेनरेशन में कितने चरित्र दिखाई दे सकते हैं?
Kling O3 बहु-चरित्र दृश्यों के लिए बनाया गया है, और जबकि कोई कठिन सीमा प्रकाशित नहीं की गई है, स्पष्ट विवरण के साथ दो से चार विशिष्ट चरित्रों की विशेषता वाले प्रॉम्प्ट सबसे सुसंगत परिणाम देते हैं। कई नामहीन आकृतियों वाले भीड़ के दृश्य एक छोटी, अच्छी तरह से वर्णित कास्ट वाले दृश्यों की तुलना में कम विश्वसनीय हैं।
वॉयस इनपुट सुविधा के साथ किस प्रकार की ऑडियो फाइल सबसे अच्छी तरह काम करती है?
Kling O3 देशी रूप से कस्टम वॉयस इनपुट स्वीकार करता है, और न्यूनतम पृष्ठभूमि शोर वाली स्वच्छ मोनो रिकॉर्डिंग सबसे अच्छी तरह प्रदर्शन करती है। अपनी ऑडियो क्लिप को 5 से 10 सेकंड की आउटपुट रेंज के भीतर रखें ताकि यह जेनरेट किए गए वीडियो की अवधि के साथ बिना अंतराल या मजबूर ट्रंकेशन के संरेखित हो।
कस्टम इमेज तत्व अंतिम वीडियो को कैसे प्रभावित करते हैं?
कस्टम तत्व आपको अपनी खुद की छवियों को कंपोजिशनल एंकर के रूप से आपूर्ति करने देते हैं, जैसे एक उत्पाद, एक लोगो, या एक चरित्र डिज़ाइन। Kling O3 पूरी तरह से टेक्स्ट से जेनरेट करने के बजाय इन्हें जेनरेट किए गए दृश्य में शामिल करता है। जब तत्व के पास एक स्वच्छ पृष्ठभूमि और एक स्पष्ट मुख्य विषय होता है तो परिणाम सबसे मजबूत होते हैं।
क्या मैं वॉयस इनपुट का उपयोग करते समय नियंत्रित कर सकता हूं कि कौन सा चरित्र बोलता है?
वॉयस इनपुट पूरे दृश्य के लिए ऑडियो ट्रैक सेट करता है। मॉडल आपके प्रॉम्प्ट में संदर्भभित सुझावों का उपयोग करके भाषण को उपयुक्त चरित्र से जोड़ता है, इसलिए प्रॉम्प्ट टेक्स्ट में निर्दिष्ट करना कि कौन सा चरित्र बोल रहा है, उदाहरण के लिए 'बाईं ओर की महिला समझाती है,' ऑडियो और ऑन-स्क्रीन कार्रवाई के बीच संरेखण में सुधार करता है।
क्या 5 से 10 सेकंड की अवधि रेंज उपयोगकर्ता-चयनयोग्य है या स्वचालित है?
Kling O3 के लिए अवधि रेंज 5 से 10 सेकंड है। चाहे आप एक विशिष्ट लक्ष्य लंबाई सेट करें या मॉडल इसे प्रॉम्प्ट से निर्धारित करता है, यह जेनरेशन इंटरफेस पर निर्भर करता है, लेकिन आउटपुट उस विंडो के भीतर गिरेगा। ऑडियो इनपुट प्रदान करना या अपने प्रॉम्प्ट में एक दृश्य लंबाई निर्दिष्ट करना मॉडल को स्पष्ट अवधि निर्देशन देता है।
Kling O3 Standard Arteza पर उपलब्ध अन्य Kling संस्करणों से कैसे भिन्न है?
Kling O3 Standard Kuaishou से नवीनतम Kling आर्किटेक्चर का प्रतिनिधित्व करता है और Arteza पर एकमात्र Kling मॉडल है जो मानक गुणवत्ता आउटपुट में बहु-चरित्र समर्थन, वॉयस इनपुट और कस्टम तत्व एकीकरण को जोड़ता है। प्लेटफॉर्म पर अन्य Kling संस्करण आर्किटेक्चर जेनरेशन, समर्थित सुविधाओं, या आउटपुट गुणवत्ता स्तर में भिन्न हो सकते हैं।
इस ऐप को कौन सा AI मॉडल संचालित करता है?
यह ऐप Kling O3 पर चलता है, जो Arteza के माध्यम से अलग खाते या सेटअप के बिना उपलब्ध है।
क्या मैं परिणामों का व्यावसायिक रूप से उपयोग कर सकता हूं?
हां। आपके द्वारा जेनरेट किया गया कंटेंट आपका है, हमारे कंटेंट लाइसेंस के अधीन।
एक जनरेशन में कितना समय लगता है?
अधिकांश जनरेशन एक मिनट से कम समय में पूरी हो जाती हैं, और आप गैलरी में लाइव प्रगति देख सकते हैं।