FLUX 3 Image
FLUX 3 Image — 경계 상자로 이미지 구도를 지정하고 편집합니다
Black Forest Labs의 이미지 생성·편집 모델 FLUX 3 Image는 경계 상자와 요소별 설명으로 이미지 구도를 지정합니다. 상자마다 요소를 다시 설명하거나 옮겨 편집할 수 있고, 건드리지 않은 영역은 그대로 유지한다고 소개합니다.
- 주제
AI 요약
Black Forest Labs가 이미지 생성·편집 모델 FLUX 3 Image를 소개했습니다. 장면 전체를 설명하는 문장과 요소별 경계 상자를 함께 지정해 구도를 제어합니다. 요소를 어디에 배치할지 세밀하게 정하고, 완성된 이미지에서 특정 부분만 바꾸려는 작업을 겨냥합니다.
경계 상자로 구도 지정
캔버스의 가로·세로 좌표를 각각 0부터 1000까지로 놓고 요소마다 상자를 그립니다. 상자 좌표는 [y_min, x_min, y_max, x_max] 순서로 씁니다. 각 요소에는 식별자와 설명을 붙이고, 장면 전체를 묘사하는 문장에서는 식별자로 해당 요소를 가리킵니다. 예시에는 포스터 문구, 해안 마을, 돔, 물속 인물, 해변 관중을 각각 다른 상자에 배치합니다.
직접 상자를 그리지 않아도 됩니다. 에이전트에 한 줄 프롬프트와 화면 비율을 주면 대규모 언어 모델(LLM)이 전체 설명과 요소 표를 작성합니다. 사용자는 생성 결과를 보고 마음에 들지 않는 상자만 옮기거나 수정하면 됩니다. 프롬프트 업샘플러는 짧은 요청을 모델이 학습한 상세한 설명으로 늘리지만, 사용자가 정한 상자와 좌표는 그대로 모델에 전달한다고 안내합니다.
요소별 편집과 출력
이미 만든 이미지에서도 여러 요소를 한 번에 다시 설명하거나, 다른 요소로 바꾸거나, 위치를 옮길 수 있습니다. 수정하지 않은 부분은 그대로 유지하는 방식입니다. 제품 페이지는 참조 이미지 최대 10장을 활용할 수 있고, 기본 해상도 4K로 렌더링해 질감·얼굴·색상의 세부 묘사를 보존한다고 설명합니다. 상자마다 편집할 수 있는 구성은 사진 위에 문자를 배치하는 작업, 콜라주와 패널 구성, 편집 디자인, 여러 인물이 각자 자리를 차지하는 장면처럼 요소 간 위치 관계가 중요한 이미지에 맞습니다.
이용 조건
페이지는 기업이 대규모 이미지 생성을 위해 자체 인프라에 모델을 배포하고 미세 조정하는 상용 가중치 라이선스를 안내합니다. Hacker News 댓글에서는 오픈 웨이트 버전이 몇 주 안에 나온다는 Black Forest Labs의 발표가 인용됐습니다. 다만 일부 댓글은 이전 모델처럼 비상업 라이선스가 적용될지 논의하며, 이용 조건을 확인해야 한다고 지적합니다.
Hacker News 반응
- @reilly3000 — 최신 Gemini 출시에서 가능했던 조정 방식이 이전 세대보다 사용하기 편했습니다. API에 선언형 제어 기능이 들어오고 오픈 모델로도 나올 예정이라니 반갑습니다.
- @arnaudsm — 사용 경험이 정말 좋아 보이고 조정도 잘 되는군요. 팀이 인터페이스에 집중한 점을 축하합니다. 채팅은 끔찍한 사용자 인터페이스가 될 때가 많습니다.
- @neals — 새 모델인가요, 새 UI인가요?
- @swiftcoder — 둘 다 아닐까요? 새 UI를 제대로 활용하려면 경계 상자 입력을 조건으로 받는 모델이 필요할 테니까요.
- @vunderba — 여기서 강조하는 점은 이미지에서 특정 요소를 원하는 위치에 놓는 사용 경험인 것 같습니다. 구성 요소의 위치가 중요할 때 훨씬 쉽게 작업할 수 있어 보이며 InvokeAI도 떠오릅니다. Ideogram V4도 경계 상자를 지정할 수 있지만, 여러 상자를 JSON으로 기술하는 방식은 번거롭습니다. FLUX.2나 Klein처럼 오픈 웨이트로 풀릴 때까지 기다릴 것 같습니다.
- @kranke155 — LLM에 경계 상자를 만들게 하거나, 경계 상자 생성 GUI를 제공하는 ComfyUI 노드를 쓰면 됩니다.
- @KazaNLP — 다른 댓글처럼 저도 모델 자체보다 UI에 더 관심이 있습니다. 한 곳에서 모델을 고르고 결과를 비교할 수 있는 UI가 늘었으면 합니다. 모델을 시험하려고 개발자별 샌드박스를 찾아다니고 싶지는 않습니다.
- @armcat — 프레임별 정확도가 충분한 스프라이트 시퀀스도 만들 수 있을까요? 어떤 이미지 모델도 한 번에 스프라이트 시트를 만들거나 프레임 하나를 조건으로 삼는 방식으로는 잘하지 못했습니다.
- @popalchemist — 설명한 작업은 이미지 모델보다 비디오 모델에 맞습니다. 시간의 흐름이 본질에 포함된 작업입니다.
- @fuzzythrowaway — 인터페이스는 좋아합니다. 지금까지는 꽤 번거로웠던 작업에 유용해 보입니다. 다만 자의적인 검열 때문에 제약을 받는 플랫폼이 또 생긴 점은 싫습니다.
- @imgbenchdude — 작은 주관적 이미지 테스트를 해봤습니다. FLUX 3는 회색조 도시형 바지와 들어 올린 무릎은 그렸지만, 얼룩무늬는 실제 M81 Urban 무늬와 달랐습니다. Gemini 3 Pro Image보다 무늬 재현이 확실히 뒤처졌습니다.
- @pks016 — 말 앞에 울타리가 있는 사진을 정밀 편집해 봤습니다. 한 번에 편집해도 안 됐고, 작은 영역을 여러 개로 나눠도 안 됐습니다. 노출을 조정하는 것도 잘되지 않았습니다.
원문: Black Forest Labs / 번역·요약: Trawling