Overview
알리바바 타오톈 Future Life Lab이 만든 150억 파라미터 영상 모델. 단일 스트림 트랜스포머가 영상과 동기화 오디오를 한 번의 추론으로 함께 생성하고, 네이티브 1080p와 7개 언어 립싱크를 지원한다. 2026년 4월 익명으로 Artificial Analysis 아레나에 등장해 텍스트→영상·이미지→영상 양쪽에서 1위에 올랐다(공개 후 알리바바 제작으로 확인). 가중치는 Apache-2.0으로 오픈소스화 예정.
Use Cases
이렇게 쓰세요
01
한 문장 프롬프트로 효과음까지 붙은 1080p 컷 생성
Pro Tips
실무 팁
- TIP리서치 중 확인: 아직 베타·제한적 접근 단계이고 공개 API는 미정. 오픈 가중치 공개 일정을 지켜보는 게 좋다.
Gallery
결과물 미리보기
Related
비슷한 툴




