구글이 영상 제작을 위한 새로운 AI 모델 ‘제미나이 옴니 1.1 플래시(Gemini Omni 1.1 Flash)’를 공개했다. 개발자들이 생성 영상을 더 정밀하게 제어하고 실제 콘텐츠 제작에 활용할 수 있도록 기능을 강화한 것이 특징이다.

구글은 27일(현지시간) 제미나이 옴니 1.1 플래시를 구글 AI 스튜디오의 제미나이 API를 통해 전문적인 제작 환경에서 사용할 수 있도록 제공한다고 밝혔다.

이번 업데이트는 생성 영상 워크플로와 크리에이티브 도구, 미디어 편집 소프트웨어 등을 개발하는 기업과 개발자가 주요 대상이다.

가장 눈에 띄는 기능은 ‘장면 확장(Scene Extension)’이다. 기존에 생성된 영상의 마지막 부분에서 자연스럽게 다음 장면을 이어서 생성할 수 있으며, 옴니 1.1은 기존 모델보다 훨씬 긴 최대 10초의 영상 맥락을 분석할 수 있다.

기존 모델이 영상의 마지막 1초만 참조했던 것과 비교하면 영상의 시각적 일관성과 이야기 흐름을 유지하는 능력이 향상된 셈이다. 영상은 10초 단위로 최대 누적 40초까지 확장할 수 있다.

시작 프레임과 종료 프레임을 직접 지정해 두 장면 사이의 영상을 생성하는 기능도 제공한다. 개발자는 두 개의 키프레임을 입력해 카메라가 피사체 주변을 회전하거나 줌인·줌아웃하는 장면, 반복 재생이 가능한 영상 등을 정교하게 제작할 수 있다. 이를 통해 생성 AI가 임의로 영상을 만드는 방식에서 벗어나 제작자가 원하는 연출을 직접 통제할 수 있다.

빠른 반복 작업을 위한 성능 개선도 이뤄졌다. 360p 해상도의 미리보기 영상을 기존 720p 표준 출력보다 최대 60% 빠르게 생성할 수 있으며, 비용도 약 3분의 1 수준으로 낮췄다.

구글은 이를 스토리보드 제작과 아이디어 검증, 반복적인 프롬프트 수정 등 초기 제작 단계에서 유용한 기능으로 설명했다. 최종 결과물은 1080p나 4K 해상도로 생성할 수 있어 전문적인 콘텐츠 제작에도 활용할 수 있다.

최대 3초의 참조 영상을 입력해 새로운 장면을 제작하는 기능도 추가됐다. 이를 활용하면 기존 영상의 시각적 스타일이나 캐릭터의 모습을 유지하면서 새로운 장면을 생성할 수 있어 영상 전체의 일관성을 높일 수 있다.

제미나이 옴니 1.1 플래시는 구글의 개발자 생태계 전반으로 확대되고 있다. 개발자는 구글 AI 스튜디오에서 직접 모델을 사용할 수 있으며, 기업은 제미나이 엔터프라이즈 에이전트 플랫폼의 API를 통해 애플리케이션과 업무용 도구에 통합할 수 있다.

구글은 공식 개발자 문서와 쿡북(cookbook), 프롬프트 가이드 등을 통해 장면 확장과 영상 참조, 업스케일링 기능의 활용법도 제공한다.

일반 이용자에게도 적용된다. 전 세계 구글 AI 플러스·프로·울트라 구독자의 ‘구글 플로우(Google Flow)’에서 제공되며, 장면 확장 기능은 같은 구독자의 제미나이 앱에서도 이용할 수 있다.

박찬 기자 cpark@aitimes.com