SelfFlow (1) 썸네일형 리스트형 FLUX 3가 이미지·영상·소리·로봇 행동을 한 모델에 담는 이유 FLUX 3가 이미지·영상·소리·로봇 행동을 한 모델에 담는 이유AI 뉴스 썸네일Black Forest Labs가 이미지, 비디오, 오디오를 함께 학습하는 멀티모달 기반 모델 FLUX 3를 공개했어요. 먼저 Early Access로 나온 FLUX 3 Video는 네이티브 오디오가 포함된 영상을 한 번에 최대 20초까지 만들어요. 회사는 같은 기반 모델을 이미지 편집과 로봇 행동 예측에도 확장할 계획이에요. 1핵심 요약구분핵심왜 볼 만한가요통합 학습이미지·비디오·오디오를 하나의 구조에서 함께 학습해요화면과 움직임, 소리 사이의 관계를 모델이 함께 다룰 수 있어요비디오 생성네이티브 오디오를 포함한 영상을 최대 20초까지 한 번에 만들어요영상과 음향을 따로 생성해 맞추는 단계를 줄일 수 있어요활용 범위이미지 .. 이전 1 다음