AI Hacker News 1d ago 1 min read FLUX 3, 영상·오디오·액션을 한 모델에 묶은 이유 시각 생성 모델 논의가 이미지 품질 비교를 넘어, 영상·소리·행동 예측을 같은 backbone에 넣을 수 있느냐로 옮겨갔다. #flux#multimodal#video-generation 1