NVIDIA·허깅페이스 협력, 디퓨저 모델 대규모 파인튜닝 기술 공개

NVIDIA와 Hugging Face가 협력해 FLUX.2-dev, Wan 2.1, HunyuanVideo 같은 최신 오픈소스 이미지·영상 생성 모델을 대규모로 파인튜닝할 수 있는 기술을 공개했다. NVIDIA NeMo Automodel과 Diffusers 라이브러리의 통합으로, 크리에이터와 개발자는 Hugging Face 허브의 모든 디퓨저 포맷 모델을 체크포인트 변환 없이 바로 자신의 데이터셋으로 학습시켜 독자적인 스타일의 이미지·영상을 생성할 수 있다. Apache 2.0 라이선스 완전 오픈소스다. […]
Google Vids, Gemini Omni으로 AI 영상 생성·편집 기능 대폭 강화
구글이 2026년 7월 16일 Google Vids에 Gemini Omni Flash를 통합하며 대규모 AI 업데이트를 단행했다. 셀카 한 장과 짧은 음성 샘플로 자신의 AI 아바타를 생성하는 ‘개인 아바타’ 기능, 타임라인 없이 텍스트 프롬프트로 영상을 편집하는 대화형 편집, 음성 감정·속도를 세밀하게 제어하는 오디오 태그가 핵심이다. HeyGen, Synthesia, Captions, D-ID 등 AI 아바타 영상 플랫폼에 대한 구글의 정면 […]
구글, 펠레의 ‘잃어버린 골’ AI로 복원…Veo·Gemini 활용

구글 DeepMind가 1959년 펠레가 기록했지만 촬영되지 않은 역사적 골을 AI 영상 생성 기술로 복원했다. Veo 3, Gemini Omni, Nano Banana Pro 등 구글의 최신 AI 모델들을 활용해 67년간 실종된 영상을 재구성한 이 프로젝트는 AI 기술이 단순한 콘텐츠 생산을 넘어 역사적 보존에 활용될 수 있음을 보여준다. 잃어버린 역사, AI로 되살아나다 1959년 8월 […]