AI 해커뉴스 FLUX 3, 영상·오디오·액션을 한 모델에 묶은 이유 시각 생성 모델 논의가 이미지 품질 비교를 넘어, 영상·소리·행동 예측을 같은 backbone에 넣을 수 있느냐로 옮겨갔다. 2026년 7월 24일 · 1분 소요 · 19 조회 #flux#multimodal#video-generation