이 앱으로 만든 작품
Gemini Omni Flash 1.1은 Google의 멀티모달 비디오 모델로, 단편 영상 생성 및 편집을 위한 전문 앱으로 제공됩니다. 텍스트 프롬프트, 정지 이미지, 선택적 종료 프레임, 최대 10개의 참조 이미지 또는 3개의 참조 클립을 받아들이며, 일반 언어 지시로 기존 영상을 편집할 수 있습니다. 출력은 360p에서 4K까지 3~10초 범위이며, 기본 동기화된 오디오가 포함되어 있습니다. 정확한 시각적 연속성, 읽을 수 있는 화면 텍스트, 별도의 사운드 작업 없이 완성도 높은 오디오가 필요한 크리에이터, 마케터, 개발자에게 적합합니다.
이 앱을 사용하는 방법
- 1
만들고 싶은 것을 설명하거나 소스 파일을 업로드하세요.
- 2
옵션을 선택한 후 생성을 누르세요.
- 3
갤러리에서 순식간에 결과를 확인하세요.
- 4
다운로드, 공유 또는 새로운 아이디어로 다시 생성하세요.
만들 수 있는 것
제품 클로즈업 및 오디오
제품을 설명하고 시작 프레임으로 정지 사진을 제공한 후 모델이 4K에서 동기화된 주변음 또는 보이스오버 스타일 오디오로 애니메이션을 만들도록 합니다. 모델의 세계 지식은 모든 프레임에서 라벨과 패키징 텍스트를 읽을 수 있게 유지하여 AI 제품 영상의 일반적인 문제점을 제거합니다.
참조 기반 캐릭터 연속성
캐릭터나 장소의 참조 이미지를 최대 10개까지 업로드하여 생성을 조정합니다. Gemini Omni Flash 1.1은 시각적 정체성을 컷 전체에서 일관되게 유지하므로 스토리보드 스타일 시퀀스, 브랜드 마스코트 또는 매번 동일하게 보여야 하는 반복되는 장면 설정에 실용적입니다.
지시에 따른 기존 클립 편집
소스 영상을 드롭하고 '하늘을 흐리게 만들기' 또는 '배경 어수선함 제거'와 같은 일반 언어 편집 지시를 입력합니다. 모델은 별도의 합성 단계 없이 변경을 적용하므로 이미 완성된 푸티지의 빠른 수정 라운드에 유용합니다.
텍스트 오버레이 모션 그래픽
모델이 Gemini의 세계 지식에 기반하므로 화면 텍스트가 올바르게 렌더링되고 모션 전체에서 선명하게 유지됩니다. 다른 생성 모델이 일반적으로 왜곡되거나 흔들리는 글자를 생성하는 동적 제목, 로어 써드 또는 데이터 콜아웃에 사용합니다.
이미지에서 비디오 스토리 비트로
시작 이미지와 선택적 종료 프레임을 제공하여 장면의 첫 번째와 마지막 순간을 정의한 후 모델이 그 사이의 동작을 보간하도록 합니다. 정적 아트워크에서 제어된 모션이 필요한 개념 프레젠테이션, 애니매틱, 피치 덱에 효과적입니다.
시도해볼 프롬프트 아이디어
크리에이터들이 이 앱을 사용하는 이유
- 네이티브 동기화 오디오
- 360p에서 4K 출력
- 3-10초 길이
- 텍스트, 이미지 및 참고 이미지 입력
- 참고 비디오 조종
- 지시사항으로 비디오 편집
더 나은 결과를 위한 팁
프롬프트로 텍스트 고정
영상에 읽을 수 있는 단어가 필요할 때 프롬프트에 정확히 입력합니다. Gemini Omni Flash 1.1은 세계 지식에 기반하므로 글자 형태 정확도에서 이점이 있지만, 명시적 프롬프트는 여전히 변동을 줄이고 모델이 해당 요소를 우선시하도록 합니다.
제어를 위해 종료 프레임 사용
시작 이미지와 종료 프레임을 모두 제공하면 모델이 보간할 두 개의 앵커를 갖게 됩니다. 개방형 모션보다는 클립 결론에서 특정 시각적 보상이 필요할 때 호 및 구성을 제어하는 가장 안정적인 방법입니다.
참조 입력을 전략적으로 계층화
모델은 최대 10개의 참조 이미지와 3개의 참조 클립을 동시에 받아들입니다. 이미지 슬롯을 캐릭터나 객체 일관성을 위해 사용하고 클립 슬롯을 모션 스타일이나 카메라 동작을 정의하는 데 사용합니다. 한 번의 생성에서 두 입력 유형을 혼합하면 둘 중 하나만 사용하는 것보다 더 세밀한 조정이 가능합니다.
편집 지시를 정확하게 작성
비디오 편집 모드를 사용할 때 변경할 내용과 보존할 내용을 동일한 지시에서 설명합니다. '벽 색상을 진한 청록색으로 변경하고, 가구와 조명은 동일하게 유지'와 같은 문구는 모호한 지시보다 훨씬 더 효과적입니다. 편집과 변경되지 않은 요소 모두에 명시적 제약을 설정하기 때문입니다.
이 앱을 선택하면 좋은 경우
4K 해상도와 단일 생성 패스의 기본 동기화 오디오, 여러 자산 전체의 참조 제어 시각적 연속성, 읽을 수 있는 화면 텍스트 또는 입력한 지시를 통해 기존 클립을 편집할 수 있는 기능이 우선순위일 때 이 앱을 선택합니다. Seedance 2.5는 최대 30초까지 더 긴 실행을 지원하고 훨씬 더 많은 참조 자료를 받아들이므로 지속 시간이나 참조 깊이가 해상도 계층보다 중요할 때 더 적합합니다. Wan 3.0은 30초 단일 패스 비디오와 옴니 참조를 제공하므로 확장된 장면에 더 강력한 선택입니다. Gemini Omni Flash 1.1은 세 가지 중 가장 높은 출력 해상도가 필요하거나 재생성하는 대신 입력한 지시를 통해 기존 클립을 수정하려고 할 때 올바른 선택입니다.
자주 묻는 질문
이미지를 전혀 제공하지 않고 비디오를 생성할 수 있습니까?
예. 앱은 텍스트 프롬프트만 받아들입니다. 이미지, 종료 프레임, 참조 이미지 및 참조 클립은 모두 선택적 입력입니다. 시각적 연속성을 조정하거나, 모션 끝점을 정의하거나, 특정 캐릭터나 위치를 소스 자료와 일치시키려는 경우에만 제공하면 됩니다.
출력에서 기본 동기화 오디오는 어떻게 작동합니까?
Gemini Omni Flash 1.1은 비디오를 생성하는 동일한 모델 패스의 일부로 오디오를 생성하므로 사운드가 나중에 추가된 일반 트랙이 아니라 시각에 맞춰집니다. 결과 MP4에는 오디오 채널이 이미 포함되어 있어 별도의 믹싱 단계 없이 사용할 수 있습니다.
한 번의 생성에서 제공할 수 있는 최대 참조 입력 수는 얼마입니까?
한 번의 생성에서 최대 10개의 참조 이미지와 최대 3개의 참조 비디오 클립을 제공할 수 있습니다. 이러한 입력은 참조가 묘사하는 내용에 따라 캐릭터, 객체, 위치 또는 카메라 모션 스타일의 시각적 정체성 일관성을 향해 모델을 조정합니다.
비디오 편집 모드는 업로드된 모든 클립에서 작동합니까?
편집 모드는 기존 비디오를 소스로 사용하고 일반 언어 지시를 적용하여 수정합니다. 모델은 자연어를 해석하므로 기술 매개변수를 지정할 필요가 없습니다. 지시가 변경되어야 할 사항과 동일하게 유지되어야 할 사항을 명확하게 명시할 때 결과가 가장 일관성 있습니다.
소셜 또는 웹 전달을 위해 어떤 해상도를 선택해야 합니까?
대부분의 소셜 플랫폼의 경우 1080p은 시각적 품질과 파일 크기 및 업로드 요구사항의 균형을 맞추므로 실용적인 기본값입니다. 고해상도 디스플레이 데모 또는 더 높은 소스에서 우아하게 다운샘플링하는 플랫폼과 같이 대상이 지원할 때 4K을 사용합니다. 720p는 미리보기 또는 초안에 적합합니다. 360p은 최종 해상도에 커밋하기 전에 빠른 반복에 유용합니다.
여러 개의 별도 생성에서 캐릭터를 일관되게 유지하려면 어떻게 해야 합니까?
한 번의 생성에서 참조 이미지를 저장하고 다음 생성에서 참조 입력으로 제공합니다. 모델은 실행당 최대 10개의 참조 이미지를 받아들이므로 동일한 캐릭터의 여러 각도 또는 표정을 포함하여 일관성을 강화할 수 있습니다. 이미지 참조를 캐릭터의 구별되는 특징을 명명하는 설명적 프롬프트와 결합하면 응집력이 더욱 향상됩니다.
이 앱은 어떤 AI 모델을 사용하나요?
이 앱은 별도의 계정이나 설정 없이 Arteza를 통해 사용할 수 있는 Gemini Omni Flash 1.1에서 실행됩니다.
결과물을 상업적으로 사용할 수 있나요?
네. 생성한 콘텐츠는 당사의 콘텐츠 라이선스에 따라 자유롭게 사용할 수 있습니다.
생성에 얼마나 걸리나요?
대부분의 생성은 1분 이내에 완료되며, 갤러리에서 진행 상황을 실시간으로 확인할 수 있습니다.