OmniHuman v1.5
단일 인물 사진과 오디오 파일에서 극도로 사실적인 음성 아바타 생성. 완벽한 입술 싱크, 자연스러운 표정, 그리고 음성 리듬과 감정에 동기화된 제스처 생성을 특징으로 함.
OmniHuman v1.5 체험
OmniHuman v1.5로 생성됨
Studio portrait of a 40-year-old Japanese woman with silver-
Welcome to Arteza. Every image, video, and sound on this pag
Studio portrait of a friendly woman in her 30s with curly da
Studio portrait of a friendly woman in her 30s with curly da
Studio portrait of a young man with short locs and a denim j
Studio portrait of a man in his 40s with short grey beard an
기능
- 단일 사진 입력
- 완벽한 입술 싱크
- 자연스러운 표정
- 제스처 생성
- 터보 모드
- 720p/1080p 출력
사양
- 해상도
- 720p 또는 1080p
- 입력
- 인물 사진 + 오디오 파일
- 오디오 제한
- 720p에서 60초 / 1080p에서 30초
- 출력
- MP4 비디오
입력 요구사항
관련 모델
Kling Avatar v2
모든 캐릭터를 위한 다재다능한 입술 싱크
SadTalker
사진 + 오디오로 만드는 예산 친화적 아바타
Sync-3 Lipsync
4K 입술 싱크를 이용한 비디오 더빙
Hunyuan Avatar
음성 및 노래 (단계적 제거됨)
Fabric 1.0
사진 + 오디오 말하는 아바타
Infini Talk
오디오 기반 말하는 아바타
Wan 2.2 S2V
사진과 오디오에서 음성으로 영상 생성
자주 묻는 질문
OmniHuman v1.5의 비용은 얼마인가요?
OmniHuman v1.5는 생성당 3 크레딧 ($0.30-$7.20~). 매일 10개의 무료 크레딧을 사용하여 시험해 볼 수 있습니다.
OmniHuman v1.5 결과물을 상업적으로 사용할 수 있나요?
네, Arteza에서 OmniHuman v1.5로 생성된 모든 콘텐츠는 상업용 라이선스가 포함되어 있습니다.
OmniHuman v1.5은 어떤 파일 형식으로 출력하나요?
립싱크 오디오가 포함된 MP4 동영상 파일입니다.