MiniMax-H3 영상 편집 1위, 오픈웨이트 모델의 강점

MiniMax의 영상 모델 H3가 아티피셜 애널리시스 영상 편집 리더보드에서 1위에 올랐다. 오픈웨이트 모델로는 처음이다. 다만 공개된 라이선스는 한국을 사용 허가 지역에서 제외했다. MiniMax는 7월 31일 H3를 발표하고 8월 3일 허깅페이스에 가중치를 공개했다. 텍스트, 이미지, 영상, 오디오를 함께 입력받아 4~15초 영상을 스테레오 사운드와 함께 생성하는 330억 파라미터 모델이다. 하나의 프롬프트에 이미지 9장, 영상 3개, […]
NVIDIA·허깅페이스 협력, 디퓨저 모델 대규모 파인튜닝 기술 공개

NVIDIA와 Hugging Face가 협력해 FLUX.2-dev, Wan 2.1, HunyuanVideo 같은 최신 오픈소스 이미지·영상 생성 모델을 대규모로 파인튜닝할 수 있는 기술을 공개했다. NVIDIA NeMo Automodel과 Diffusers 라이브러리의 통합으로, 크리에이터와 개발자는 Hugging Face 허브의 모든 디퓨저 포맷 모델을 체크포인트 변환 없이 바로 자신의 데이터셋으로 학습시켜 독자적인 스타일의 이미지·영상을 생성할 수 있다. Apache 2.0 라이선스 완전 오픈소스다. […]
크리에이터를 위한 오픈웨이트 이미지 생성 모델 ‘Krea 2’ 출시

AI 이미지 생성 플랫폼 Krea가 새로운 파운데이션 모델 ‘Krea 2’를 공개했다. 오픈웨이트로 제공되는 Krea 2 Raw와 Krea 2 Turbo는 광범위한 미적 다양성과 사용자 창의 제어를 동시에 제공하도록 설계되었으며, 크리에이터들의 창작 탐색을 위한 새로운 기준을 제시한다. Krea 2의 핵심 특징과 기술 구조 Krea 2는 단순히 하나의 모델이 아닌 ‘일련의 파운데이션 모델’로, […]
YouTube 자동 제작 파이프라인 도구 PyPI 출시

AI 기반 영상 생성부터 업로드까지 모든 과정을 자동화하는 ‘youtube-factory-pipeline’ 도구가 공개되었다. 이 모듈식 파이프라인은 연구·스크립트 작성·음성 생성·비주얼 제작·편집·업로드 등 유튜브 영상 제작의 전 단계를 자동으로 처리할 수 있으며, 파이썬 3.10 이상에서 실행 가능하다. 자동화된 영상 제작 파이프라인 구성 youtube-factory-pipeline은 ‘Weight and See’ 유튜브 채널의 핵심 오케스트레이션 라이브러리로 개발되었으며, MIT 라이선스 하에 공개되었다. 이 도구는 […]
Hugging Face, 구글 Gemma 4 12B 경량 모델 공개로 오픈소스 생성 AI 민주화 가속

Hugging Face가 구글의 최신 언어 모델 ‘Gemma 4 12B’를 양자화 형식으로 공개하며, 개인 크리에이터와 소규모 스튜디오도 고성능 AI 모델을 직접 활용할 수 있는 환경을 조성했다. Hugging Face는 전 세계 AI 개발자들의 협업 플랫폼으로, 다양한 오픈소스 모델과 데이터셋을 호스팅하고 관리하는 중추적 역할을 담당하고 있다. 이번에 공개된 Gemma 4 12B-it-qat-q4_0-gguf 버전은 구글의 최신 언어 모델을 로컬 […]