- Black Forest Labs에서 개발한 가장 큰 SOTA 오픈 소스 텍스트-이미지 모델
- Stable Diffusion을 개발한 오리지널 팀
- 12B 파라미터로 창의성과 성능의 경계를 확장하여, Midjourney와 유사한 이미지 생성 기능을 제공
3가지 모델로 제공
- FLUX.1 [dev]: 비상업적 라이선스로 오픈 소스화된 기본 모델. 커뮤니티가 이를 기반으로 구축할 수 있음
- FLUX.1 [schnell]: 기본 모델의 증류 버전으로 최대 10배 빠르게 작동함. Apache 2 라이선스.
- FLUX.1 [pro]: API를 통해서만 이용 가능한 비공개 버전
주요 특징
- 향상된 이미지 품질: 고해상도의 놀라운 비주얼 생성 가능
- 고급 인간 해부학 및 포토리얼리즘: 매우 현실적이고 해부학적으로 정확한 이미지 생성 가능
- 개선된 프롬프트 준수: 입력에 기반한 더 정확하고 관련성 높은 이미지 생성 가능
- 뛰어난 속도: 높은 수요 애플리케이션에 이상적인 Flux Schnell의 속도와 효율성
fal의 통합
- fal의 최첨단 추론 엔진을 통합하여 Flux 모델을 eager torch보다 최대 2배 빠르게 실행 가능
- 빠른 처리 시간과 뛰어난 품질 및 디테일 유지
GN⁺의 정리
- Flux는 Black Forest Labs에서 개발한 최신 텍스트-이미지 모델로, 창의성과 성능의 새로운 기준을 제시함
- 다양한 변형 모델을 통해 다양한 사용 사례에 맞춤형 솔루션을 제공함
- 향상된 이미지 품질과 현실적인 표현력으로 높은 수요 애플리케이션에 적합함
- fal의 추론 엔진을 통해 더욱 빠르고 효율적인 모델 실행이 가능함
- 유사한 기능을 가진 다른 프로젝트로는 DALL-E와 Midjourney가 있음