AI X/Twitter
MiniMax H3, 33B 영상·오디오 생성 모델로 Hugging Face에 등장
오픈 영상 생성 스택이 더 넓어지고 있다. MiniMax H3는 33B 파라미터 모델로 텍스트·이미지·참조 입력을 받아 4~15초 영상과 32kHz 스테레오 오디오를 생성한다.
1분 소요 19 조회
태그
#diffusers 태그가 달린 기사
오픈 영상 생성 스택이 더 넓어지고 있다. MiniMax H3는 33B 파라미터 모델로 텍스트·이미지·참조 입력을 받아 4~15초 영상과 32kHz 스테레오 오디오를 생성한다.