Gemini Omni는 이제 비디오를 40초까지 연장하고 4K로 업스케일할 수 있습니다.

짧은 AI 비디오를 생성하는 것도 한 가지입니다. 여러 장의 장면을 실제로 동일한 비디오에 속하는 것처럼 보이게 만드는 것은 훨씬 더 어려운 문제입니다. Google은 제작자와 개발자가 첫 번째 프레임과 마지막 프레임 사이에 일어나는 일에 대해 훨씬 더 많은 제어권을 제공하는 것을 목표로 하는 최신 생성 비디오 모델인 Gemini Omni 1.1 Flash를 통해 또 다른 방향으로 나아가고 있습니다.

가장 큰 변화는 장면을 계속하도록 요청할 때 Gemini가 기존 비디오를 얼마나 기억할 수 있는지입니다. Omni 1.1은 마지막 순간에만 의존하지 않고 최대 10초의 이전 영상을 확인하여 맥락을 파악할 수 있습니다. 이는 다음에 일어날 일을 효과적으로 추측하는 대신 캐릭터, 환경 및 장면의 일반적인 방향을 보다 일관되게 유지하는 데 도움이 됩니다.

AI 비디오가 너무 빨리 끝날 필요는 없습니다

Google은 또한 제작자에게 이러한 장면을 계속 유지할 수 있는 훨씬 더 많은 공간을 제공하고 있습니다. 비디오는 총 길이가 40초에 도달할 때까지 10초 단위로 확장될 수 있습니다. 기존 비디오에 비해 특별히 길게 들리지는 않지만 실제 시작, 중간, 끝이 있는 AI 생성 시퀀스에 훨씬 더 많은 공간이 열립니다.

제작자는 원하는 장면의 첫 번째 프레임과 마지막 프레임을 모두 제공할 수도 있습니다. 그런 다음 Gemini는 둘을 연결하는 데 필요한 모든 것을 생성합니다. 이는 피사체 주위로 카메라를 움직이게 하거나, 구성 간을 부드럽게 확대/축소하거나, 뚜렷한 점프 없이 반복되도록 설계된 클립을 만드는 데 유용할 수 있습니다. 비디오 참조도 지원됩니다. Gemini에게 최대 3초의 기존 영상을 제공하여 모델에 추가 시각적 컨텍스트를 제공할 수 있습니다. Google에서는 생성된 장면 전체에서 캐릭터 모양과 같은 항목을 유지하는 데 도움이 된다고 말합니다.

모든 것을 4K로 렌더링할 필요는 없습니다

모든 실험이 최대 품질에서 시작될 필요는 없으며 Omni 1.1의 보다 실용적인 추가 기능 중 하나는 이를 정확하게 인정합니다. 개발자는 Google이 주장하는 360p 미리보기를 일반 720p 출력보다 최대 60% 더 빠르게 생성할 수 있으며 비용은 약 1/3 정도 소요됩니다. 이를 통해 최종 결과에 더 많은 시간과 비용을 투자하기 전에 아이디어를 신속하게 테스트하고, 프롬프트를 조정하고, 여러 버전을 통해 작업하는 것이 더 쉬워졌습니다. 만족스러우면 Omni 1.1에서 1080p 영상을 생성하거나 완성된 비디오를 최대 4K까지 업스케일할 수 있습니다.

회사는 이미 Google AI Studio의 Gemini API를 통해 개발자에게 Omni 1.1 Flash를 제공하고 있으며, 기업에서는 Google의 엔터프라이즈 에이전트 플랫폼을 통해 이에 액세스할 수 있습니다. 이러한 트릭 중 일부를 시도하기 위해 반드시 앱을 구축할 필요는 없습니다. Omni 1.1은 AI Plus, Pro 및 Ultra 구독자를 위해 Google Flow를 통해 전 세계적으로 출시됩니다. 장면 확장도 Gemini 앱 내에서 직접 구독자에게 제공되므로 모델의 가장 흥미로운 새 기능 중 하나를 훨씬 더 쉽게 시도할 수 있습니다.

관련 정보는 아래 링크에서 확인하세요

자세한 정보 확인

관련 기사

댓글 남기기