สร้างด้วยแอปนี้
Gemini Omni Flash 1.1 เป็นโมเดลวิดีโอมัลติโมดัลของ Google ที่พร้อมใช้งานที่นี่เป็นแอปพลิเคชันเฉพาะสำหรับสร้างและแก้ไขวิดีโอรูปแบบสั้น รับข้อความพร้อมท์ รูปภาพนิ่ง เฟรมสิ้นสุดเพิ่มเติม รูปภาพอ้างอิงได้ถึงสิบภาพ หรือคลิปอ้างอิงสามคลิป และสามารถแก้ไขวิดีโอที่มีอยู่จากคำสั่งภาษาธรรมชาติ เอาต์พุตทำงานจาก 360p ถึง 4K ที่ระยะเวลาสามถึงสิบวินาที พร้อมเสียงซิงโครไนซ์แบบเนทีฟในตัว เหมาะสำหรับผู้สร้างสรรค์ นักการตลาด และนักพัฒนาที่ต้องการความต่อเนื่องทางภาพที่แม่นยำ ข้อความบนหน้าจออ่านได้ และเสียงที่ขัดเงาโดยไม่ต้องผ่านการประมวลผลเสียงแยกต่างหาก
วิธีใช้แอปนี้
- 1
อธิบายสิ่งที่คุณต้องการสร้าง หรืออัปโหลดไฟล์ต้นฉบับของคุณ
- 2
เลือกตัวเลือกของคุณ จากนั้นกดสร้าง
- 3
ดูผลงานของคุณปรากฏในแกลเลอรี่ในอีกสักครู่
- 4
ดาวน์โหลด แชร์ หรือสร้างอีกครั้งด้วยไอเดียใหม่
สิ่งที่คุณสามารถสร้างได้
ภาพประกอบสินค้าพร้อมเสียง
อธิบายสินค้า จัดเตรียมรูปภาพนิ่งเป็นเฟรมเริ่มต้น และปล่อยให้โมเดลสร้างภาพเคลื่อนไหวที่ 4K พร้อมเสียงโดยรอบหรือเสียงบรรยายที่ซิงโครไนซ์ ความรู้โลกของโมเดลทำให้ป้ายกำกับและข้อความบนบรรจุภัณฑ์อ่านได้ชัดเจนในทุกเฟรม ซึ่งแก้ไขปัญหาทั่วไปในวิดีโอสินค้าที่สร้างด้วย AI
ความต่อเนื่องของตัวละครที่ขับเคลื่อนด้วยการอ้างอิง
อัปโหลดรูปภาพอ้างอิงได้ถึงสิบภาพของตัวละครหรือสถานที่เพื่อชี้นำการสร้าง Gemini Omni Flash 1.1 รักษาตัวตนทางภาพให้สอดคล้องกันในทุกการตัด ทำให้เป็นไปได้สำหรับลำดับแบบสตอรีบอร์ด มาสคอตแบบแบรนด์ หรือการตั้งค่าฉากที่เกิดซ้ำซึ่งต้องมีลักษณะเดียวกันในทุกช็อต
แก้ไขคลิปที่มีอยู่ตามคำสั่ง
วางวิดีโอต้นฉบับและพิมพ์คำสั่งแก้ไขภาษาธรรมชาติ เช่น 'ทำให้ท้องฟ้ามืดครึ้ม' หรือ 'ลบความยุ่งเหยิงพื้นหลัง' โมเดลใช้การเปลี่ยนแปลงโดยไม่ต้องมีขั้นตอนการประกอบภาพแยกต่างหาก มีประโยชน์สำหรับการแก้ไขอย่างรวดเร็วในฟุตเทจที่เสร็จสิ้นแล้ว
กราฟิกส์โมชั่นที่มีข้อความซ้อนทับ
เนื่องจากโมเดลมีพื้นฐานจากความรู้โลกของ Gemini ข้อความบนหน้าจอจึงแสดงผลอย่างถูกต้องและคมชัดตลอดการเคลื่อนไหว ใช้สำหรับชื่อเรื่องแบบจลนศาสตร์ ข้อความด้านล่าง หรือคำอธิบายข้อมูลที่โมเดลสร้างสรรค์อื่นๆ มักจะสร้างตัวอักษรที่ไม่ชัดเจนหรือลอยไปมา
จากภาพไปยังจังหวะเรื่องราวของวิดีโอ
จัดเตรียมรูปภาพเริ่มต้นและเฟรมสิ้นสุดเพิ่มเติมเพื่อกำหนดช่วงเวลาแรกและสุดท้ายของฉาก จากนั้นปล่อยให้โมเดลสอดแทรกการกระทำระหว่างนั้น เหมาะสำหรับการนำเสนอแนวคิด ภาพเคลื่อนไหวแบบสแตติก และสไลด์โปรโมชั่นที่คุณต้องการการเคลื่อนไหวที่ควบคุมได้จากงานศิลปะแบบนิ่ง
ไอเดียพรอมต์ที่ลองได้
เหตุผลที่ผู้สร้างสรรค์ใช้แอปนี้
- เสียงที่ซิงโครไนซ์แบบเนทีฟ
- ผลลัพธ์ 360p ถึง 4K
- ระยะเวลา 3-10 วินาที
- ข้อความ, รูปภาพและข้อมูลนำเข้าการอ้างอิง
- การชี้นำวิดีโออ้างอิง
- แก้ไขวิดีโอด้วยคำสั่ง
เคล็ดลับเพื่อผลลัพธ์ที่ดีขึ้น
ยึดข้อความด้วยพร้อมท์
เมื่อวิดีโอของคุณต้องการคำที่อ่านได้ ให้สะกดคำเหล่านั้นออกมาอย่างชัดเจนในพร้อมท์ Gemini Omni Flash 1.1 มีพื้นฐานจากความรู้โลก ซึ่งให้ความได้เปรียบในความแม่นยำของรูปแบบตัวอักษร แต่พร้อมท์ที่ชัดเจนยังคงลดการลอยตัวและทำให้โมเดลให้ความสำคัญกับองค์ประกอบนั้น
ใช้เฟรมสิ้นสุดเพื่อการควบคุม
การจัดเตรียมทั้งรูปภาพเริ่มต้นและเฟรมสิ้นสุดให้โมเดลมีจุดยึดสองจุดเพื่อสอดแทรกระหว่างนั้น นี่คือวิธีที่เชื่อถือได้มากที่สุดในการควบคุมส่วนโค้งและองค์ประกอบเมื่อคุณต้องการผลตอบแทนทางภาพที่เฉพาะเจาะจงที่สิ้นสุดคลิปแทนที่จะเป็นการเคลื่อนไหวแบบเปิด
จัดเรียงอินพุตอ้างอิงอย่างมีกลยุทธ์
โมเดลยอมรับรูปภาพอ้างอิงได้ถึงสิบภาพและคลิปอ้างอิงสามคลิพพร้อมกัน ใช้ช่องรูปภาพสำหรับความสอดคล้องของตัวละครหรือวัตถุ และใช้ช่องคลิปเพื่อกำหนดสไตล์การเคลื่อนไหวหรือพฤติกรรมของกล้อง การผสมประเภทอินพุตทั้งสองในการสร้างหนึ่งครั้งให้คุณการชี้นำที่ละเอียดกว่าการใช้อย่างใดอย่างหนึ่งเพียงอย่างเดียว
เขียนคำสั่งแก้ไขอย่างแม่นยำ
เมื่อใช้โหมดแก้ไขวิดีโอ อธิบายสิ่งที่จะเปลี่ยนและสิ่งที่จะรักษาไว้ในคำสั่งเดียวกัน วลีเช่น 'เปลี่ยนสีผนังเป็นสีเทลขึ้นเข้ม รักษาเฟอร์นิเจอร์และการให้แสงให้เหมือนเดิม' มีประสิทธิภาพมากกว่าคำสั่งที่คลุมเครือ เพราะมันตั้งข้อจำกัดที่ชัดเจนทั้งในการแก้ไขและองค์ประกอบที่ไม่ได้สัมผัส
เมื่อใดที่ควรเลือกแอปนี้
เลือกแอปนี้เมื่อลำดับความสำคัญของคุณคือความละเอียด 4K พร้อมเสียงซิงโครไนซ์แบบเนทีฟจากการผ่านการสร้างครั้งเดียว ความต่อเนื่องทางภาพที่ควบคุมด้วยการอ้างอิงในหลายสินทรัพย์ ข้อความบนหน้าจออ่านได้ หรือความสามารถในการแก้ไขคลิปที่มีอยู่ผ่านคำสั่งที่พิมพ์ Seedance 2.5 ครอบคลุมการทำงานที่นานขึ้นถึง 30 วินาทีและยอมรับวัสดุอ้างอิงมากขึ้นมาก ซึ่งเป็นตัวเลือกที่ดีกว่าเมื่อระยะเวลาหรือความลึกของการอ้างอิงมีความสำคัญมากกว่าระดับความละเอียด Wan 3.0 นำเสนอวิดีโอ 30 วินาทีในการผ่านครั้งเดียวพร้อมการอ้างอิงแบบ omni ทำให้เป็นตัวเลือกที่แข็งแกร่งกว่าสำหรับฉากที่ขยายออกไป Gemini Omni Flash 1.1 เป็นตัวเลือกที่ถูกต้องเมื่อคุณต้องการความละเอียดเอาต์พุตสูงสุดของทั้งสาม หรือต้องการแก้ไขคลิปที่มีอยู่โดยพิมพ์คำสั่งแทนที่จะสร้างใหม่
คำถามที่พบบ่อย
ฉันสามารถสร้างวิดีโอโดยไม่จัดเตรียมรูปภาพใดๆ ได้หรือไม่
ใช่ แอปยอมรับพร้อมท์ข้อความเพียงอย่างเดียว รูปภาพ เฟรมสิ้นสุด รูปภาพอ้างอิง และคลิปอ้างอิงเป็นอินพุตเพิ่มเติมทั้งหมด คุณต้องจัดเตรียมเฉพาะเมื่อคุณต้องการชี้นำความต่อเนื่องทางภาพ กำหนดจุดสิ้นสุดการเคลื่อนไหว หรือจับคู่ตัวละครหรือสถานที่เฉพาะกับวัสดุต้นฉบับของคุณ
เสียงซิงโครไนซ์แบบเนทีฟทำงานอย่างไรในเอาต์พุต
Gemini Omni Flash 1.1 สร้างเสียงเป็นส่วนหนึ่งของการผ่านโมเดลเดียวกันที่สร้างวิดีโอ ดังนั้นเสียงจึงมีเวลาตรงกับภาพแทนที่จะเพิ่มเป็นแทร็กทั่วไปหลังจากนั้น MP4 ที่ได้จะรวมช่องเสียงแล้ว พร้อมใช้งานโดยไม่ต้องมีขั้นตอนการผสมแยกต่างหาก
จำนวนสูงสุดของอินพุตอ้างอิงที่ฉันสามารถจัดเตรียมได้คือเท่าใด
คุณสามารถจัดเตรียมรูปภาพอ้างอิงได้ถึงสิบภาพและคลิปวิดีโออ้างอิงได้ถึงสามคลิปในการสร้างครั้งเดียว อินพุตเหล่านี้ชี้นำโมเดลไปยังตัวตนทางภาพที่สอดคล้องกันสำหรับตัวละคร วัตถุ สถานที่ หรือสไตล์การเคลื่อนไหวของกล้อง ขึ้นอยู่กับสิ่งที่อ้างอิงแสดง
โหมดแก้ไขวิดีโอทำงานกับคลิปที่อัปโหลดใดๆ ได้หรือไม่
โหมดแก้ไขใช้วิดีโอที่มีอยู่เป็นต้นฉบับและใช้คำสั่งภาษาธรรมชาติเพื่อแก้ไขมัน โมเดลตีความภาษาธรรมชาติ ดังนั้นคุณจึงไม่จำเป็นต้องระบุพารามิเตอร์ทางเทคนิค ผลลัพธ์มีความสอดคล้องมากที่สุดเมื่อคำสั่งระบุอย่างชัดเจนว่าสิ่งใดควรเปลี่ยนและสิ่งใดควรคงไว้เหมือนเดิม
ฉันควรเลือกความละเอียดใดสำหรับการส่งมอบโซเชียลหรือเว็บ
สำหรับแพลตฟอร์มโซเชียลส่วนใหญ่ 1080p เป็นค่าเริ่มต้นที่ใช้ได้จริงเพราะสมดุลระหว่างคุณภาพภาพและขนาดไฟล์กับข้อกำหนดการอัปโหลด ใช้ 4K เมื่อปลายทางรองรับ เช่น การสาธิตจอแสดงผลความละเอียดสูงหรือแพลตฟอร์มที่ลดขนาดลงอย่างสวยงามจากต้นฉบับที่สูงกว่า 720p เหมาะสำหรับการแสดงตัวอย่างหรือร่างแบบ 360p มีประโยชน์สำหรับการวนซ้ำอย่างรวดเร็วก่อนที่จะยึดมั่นกับความละเอียดสุดท้าย
ฉันจะรักษาตัวละครให้สอดคล้องกันในการสร้างแยกต่างหากหลายครั้งได้อย่างไร
บันทึกรูปภาพอ้างอิงของคุณจากการสร้างครั้งหนึ่งและจัดเตรียมเป็นอินพุตอ้างอิงในครั้งถัดไป โมเดลยอมรับรูปภาพอ้างอิงได้ถึงสิบภาพต่อการทำงาน ดังนั้นคุณสามารถรวมมุมมองหรือนิพจน์หลายแบบของตัวละครเดียวกันเพื่อเสริมความสอดคล้อง การรวมการอ้างอิงรูปภาพกับพร้อมท์อธิบายที่ตั้งชื่อลักษณะเด่นของตัวละครจะปรับปรุงความสอดคล้องเพิ่มเติม
โมเดล AI ใดที่ขับเคลื่อนแอปนี้?
แอปนี้ทำงานบน Gemini Omni Flash 1.1 ซึ่งใช้งานได้ผ่าน Arteza โดยไม่ต้องสมัครหรือตั้งค่าแยกต่างหาก
ฉันสามารถใช้ผลงานเชิงพาณิชย์ได้หรือไม่?
ได้ เนื้อหาที่คุณสร้างเป็นของคุณที่จะใช้ได้ตามเงื่อนไขใบอนุญาตเนื้อหาของเรา
การสร้างจะใช้เวลานานแค่ไหน?
การสร้างส่วนใหญ่เสร็จภายในหนึ่งนาที และคุณสามารถดูความคืบหน้าแบบสดในแกลเลอรี่