HunyuanVideo는 130억 파라미터와 압축된 비디오 latent를 사용하는 공개 비디오 생성 모델이며, 품질의 핵심은 모델 크기뿐 아니라 데이터 필터링과 점진적 학습에 있습니다.
- 논문: HunyuanVideo: A Systematic Framework for Large Video Generative Models
- 코드: HunyuanVideo GitHub 저장소
- 데모: HunyuanVideo Playground
- 모델: HunyuanVideo on Hugging Face
13B라는 모델 크기만으로 영상 품질이나 실행 가능성을 판단할 수는 없습니다. 입력 데이터가 어떤 기준으로 걸러졌는지, latent 압축에서 무엇이 사라지는지, 자신의 하드웨어에서 어느 길이와 해상도까지 가능한지를 나눠 확인해야 합니다.