Kling AI 카메라 컨트롤 기능 출시, Push·Pull·Pan·Tilt 지원

Kling AI가 영화 촬영 기법의 핵심인 Push, Pull, Pan, Tilt 카메라 무브먼트를 AI 영상 생성에 직접 통합한 카메라 컨트롤 기능을 공개했다. Kling VIDEO 3.0과 VIDEO 3.0 Omni를 기반으로 하는 이 기능은 단순한 텍스트 설명을 넘어 샷 구조, 카메라 동선, 시점을 체계적으로 설계할 수 있게 해주며, 크리에이터들이 전문 영상 장비 없이도 시네마틱 품질의 영상을 제작할 수 […]
Higgsfield, AI 모션 디자인 도구 ‘Vibe Motion’ 가이드 공개

Higgsfield가 새로운 AI 모션 디자인 도구 ‘Vibe Motion’을 선보였다. 채팅 기반 인터페이스를 통해 모션 그래픽스, 프레젠테이션, 구조화된 비주얼 콘텐츠를 더욱 쉽게 제작하고 반복 수정할 수 있도록 설계된 이 도구는 기존 AI 영상 생성 워크플로우를 확장하는 새로운 단계다. 모션 그래픽스의 자연스러운 확장 Higgsfield에 따르면, 생성형 AI 영상 기술이 풍부한 시각 […]
구글 ‘Gemini Omni Flash’ 영상 편집 성능 2위 달성, 3위와 40점 격차

구글 DeepMind가 Google I/O에서 공개한 Gemini Omni Flash가 Video Edit Arena 리더보드에서 1347점으로 2위를 차지했다. 3위 모델과는 약 39점의 격차를 벌렸으며, 1위 ByteDance의 dreamina-seedance-2.0-720p(약 1377점)와는 30점 차이로 매우 근접한 성능을 보이고 있다. 멀티모달 영상 생성·편집 기능 Gemini Omni Flash는 텍스트, 이미지, 오디오, 비디오를 입력으로 받아 대화형 지시사항(conversational instructions)에 따라 영상 콘텐츠를 생성하거나 […]
구글, 초고속 저비용 이미지 생성 ‘Nano Banana 2 Lite’ 출시

구글이 이미지 생성 속도를 4초로 단축하고 1,000장당 3.4센트의 초저가 요금으로 운영할 수 있는 새로운 AI 이미지 생성 모델 ‘Nano Banana 2 Lite’를 공개했다. 이 모델은 대량의 이미지를 빠르게 생성·반복해야 하는 크리에이터와 개발자를 위해 최적화되었으며, 동시에 공개한 영상 생성 모델 ‘Gemini Omni Flash’와 함께 이미지에서 영상으로의 엔드-투-엔드 멀티미디어 워크플로우를 제공한다. 초저가 고속 이미지 생성의 새로운 […]
구글 Gemini, 맞춤형 AI 이미지 생성 기능 미국 무료 사용자에게 개방 — 내 데이터로 만드는 개인화 이미지

구글이 Gemini의 개인화 AI 이미지 생성 기능을 미국 내 모든 적격 무료 사용자에게 개방했다. 기존에는 AI Plus, Pro, Ultra 유료 구독자에게만 제한됐던 이 기능이 이제 Gmail, 구글 포토, 유튜브 등 개인 구글 앱 데이터를 기반으로 맞춤형 이미지를 생성할 수 있게 되면서, AI 이미지 생성 도구의 접근성이 크게 높아졌다. Nano Banana 모델 기반의 […]
Kling AI로 4K 이커머스 제품 영상 만들기 — 이미지-to-비디오 완전 가이드

AI 영상 생성 기술이 이커머스 시장을 근본적으로 바꾸고 있다. Kling AI의 네이티브 4K 영상 생성 기능을 활용하면 전문 스튜디오 촬영 수준의 제품 영상을 수 분 안에, 단 몇 달러의 비용으로 제작할 수 있다. Kling AI 공식 블로그가 공개한 6단계 워크플로우와 핵심 기능을 바탕으로 실전 활용법을 상세히 정리했다. 이커머스에서 고해상도 영상이 중요한 이유 […]
오픈소스 AI 영상 제작 시스템 ‘OpenMontage’ 공개

자연어 설명만으로 완전한 영상을 자동 제작하는 오픈소스 에이전트 영상 제작 시스템 ‘OpenMontage’가 공개됐다. 12개 파이프라인, 52개 도구, 500개 이상의 에이전트 스킬을 갖춘 이 시스템은 AI 코딩 어시스턴트를 완벽한 영상 제작 스튜디오로 변환한다. 자연어로 영상 제작부터 편집까지 자동화 OpenMontage는 기존의 ‘이미지 몇 장을 애니메이션화하는 트릭’과 완전히 다르다. 사용자가 원하는 영상을 자연어로 설명하면, […]
Gemini 3.5 Flash에 컴퓨터 사용 기능 통합

Google DeepMind가 Gemini 3.5 Flash에 컴퓨터 사용(Computer Use) 기능을 통합했다. 이제 개발자들은 브라우저, 모바일, 데스크톱 환경에서 작동하는 AI 에이전트를 구축할 수 있으며, 장기적인 자동화 작업과 엔터프라이즈 수준의 업무 자동화가 가능해졌다. Gemini 3.5 Flash의 컴퓨터 사용 기능이란 그동안 컴퓨터 사용 기능은 독립형 Gemini 2.5 모델로만 제공되었으나, 이번 업데이트로 Gemini 3.5 Flash의 메인 모델에 […]
ByteDance, Seedance 2.5 공개…최대 30초 4K 영상 단일 생성

ByteDance가 동영상 생성 AI ‘Seedance 2.5’를 공개했다. 이전 모델 대비 생성 가능한 영상 길이가 15초에서 30초로 두 배 늘어났으며, 최대 50개의 멀티모달 참조 소재를 입력할 수 있어 영상 제작의 자유도가 크게 향상됐다. 7월 초 정식 서비스 예정이다. 30초 4K 영상 단일 생성 가능…15초에서 2배 확장 ByteDance의 클라우드 사업부인 Volcano Engine이 주최하는 […]
크리에이터를 위한 오픈웨이트 이미지 생성 모델 ‘Krea 2’ 출시

AI 이미지 생성 플랫폼 Krea가 새로운 파운데이션 모델 ‘Krea 2’를 공개했다. 오픈웨이트로 제공되는 Krea 2 Raw와 Krea 2 Turbo는 광범위한 미적 다양성과 사용자 창의 제어를 동시에 제공하도록 설계되었으며, 크리에이터들의 창작 탐색을 위한 새로운 기준을 제시한다. Krea 2의 핵심 특징과 기술 구조 Krea 2는 단순히 하나의 모델이 아닌 ‘일련의 파운데이션 모델’로, […]