Black Forest Labs, FLUX 3 공개…이미지·영상·오디오 통합 멀티모달 AI 모델

Black Forest Labs(BFL)가 2026년 7월 23일 이미지·영상·오디오·액션 예측을 단일 아키텍처로 통합 학습하는 멀티모달 프론티어 모델 ‘FLUX 3’를 공개했다. 20초 분량 영상을 네이티브 오디오와 함께 생성하는 FLUX 3 Video와 로봇 조작을 위한 FLUX 3 Action이 얼리 액세스로 공개됐으며, FLUX 3 Image는 수 주 내 출시 예정이다. 내부 벤치마크에서 Runway Gen-4.5 대비 77%, Luma Ray 3.2 대비 […]
NVIDIA·허깅페이스 협력, 디퓨저 모델 대규모 파인튜닝 기술 공개

NVIDIA와 Hugging Face가 협력해 FLUX.2-dev, Wan 2.1, HunyuanVideo 같은 최신 오픈소스 이미지·영상 생성 모델을 대규모로 파인튜닝할 수 있는 기술을 공개했다. NVIDIA NeMo Automodel과 Diffusers 라이브러리의 통합으로, 크리에이터와 개발자는 Hugging Face 허브의 모든 디퓨저 포맷 모델을 체크포인트 변환 없이 바로 자신의 데이터셋으로 학습시켜 독자적인 스타일의 이미지·영상을 생성할 수 있다. Apache 2.0 라이선스 완전 오픈소스다. […]
Claude 내에서 직접 영상·이미지·아바타 생성, Apatero Studio MCP 출시

AI 이미지·영상 생성 플랫폼 Apatero Studio가 Claude용 MCP(Model Context Protocol) 서버로 출시되었다. 사용자는 Claude 대화 내에서 직접 이미지, 영상, 토킹 아바타, 지속적인 AI 캐릭터를 생성할 수 있으며, 생성된 이미지는 대화창에 인라인으로 렌더링되어 즉시 확인 가능하다. Claude 통합으로 워크플로우 간소화 Apatero Studio MCP는 MCP 서버와 CLI(커맨드 라인 인터페이스) 형태로 제공되며, 사용자 계정으로 인증하여 […]
오픈소스 AI 영상 제작 시스템 ‘OpenMontage’ 공개

자연어 설명만으로 완전한 영상을 자동 제작하는 오픈소스 에이전트 영상 제작 시스템 ‘OpenMontage’가 공개됐다. 12개 파이프라인, 52개 도구, 500개 이상의 에이전트 스킬을 갖춘 이 시스템은 AI 코딩 어시스턴트를 완벽한 영상 제작 스튜디오로 변환한다. 자연어로 영상 제작부터 편집까지 자동화 OpenMontage는 기존의 ‘이미지 몇 장을 애니메이션화하는 트릭’과 완전히 다르다. 사용자가 원하는 영상을 자연어로 설명하면, […]