Skip to main content
Gemini Omni Flash는 Google DeepMind의 대화형 비디오 생성 및 편집 모델입니다. Google I/O 2026에서 Gemini Omni 제품군의 일부로 처음 소개되었으며, Gemini의 멀티모달 추론과 네이티브 비디오 생성을 결합합니다. 자연어로 원하는 내용을 설명하고 참조 이미지나 비디오를 첨부하면 동기화된 오디오가 포함된 클립을 생성합니다. 현재 버전인 Gemini Omni Flash 1.1은 2026년 8월 27일 정식 출시(GA)되었으며, 키프레임 보간, 360p/4K 출력 옵션, 장면 확장 기능이 추가되었습니다.

Gemini Omni Flash 1.1이 뛰어난 점

  • 대화형 비디오 편집: 자연어를 사용하여 비디오를 다듬고 편집합니다: 캐릭터 교체, 장면 조명 변경, 각도 변경, 원본 오디오 및 비디오 트랙을 유지하면서 객체 추가 또는 제거
  • 멀티모달 입력: 텍스트, 이미지(최대 14장), 비디오(최대 3개, 각 10초)를 결합하여 생성을 안내합니다. 모든 출력에 네이티브 오디오 트랙이 포함됩니다
  • 키프레임 보간: image_to_video 작업에서 시작 프레임과 선택적인 종료 프레임을 첨부하면 모델이 그 사이의 영상을 생성합니다
  • 참조 이미지 기반 비디오 생성: <IMAGE_REF_0> 같은 태그로 참조 이미지를 역할에 바인딩하면 이미지 속 캐릭터, 제품, 객체가 새 장면에 등장합니다. 이미지 자체는 프레임으로 사용되지 않습니다
  • 장면 확장: extend 작업은 클립에 최대 10초의 새로운 영상을 추가합니다. 마지막 10초의 컨텍스트를 읽어 캐릭터와 움직임의 일관성을 유지하며, 누적 약 40초까지 확장할 수 있습니다
  • 해상도 제어: 360p로 초안을 작성한 후(비용은 720p의 약 3분의 1) 720p, 1080p 또는 4K로 다시 렌더링합니다. 16:9 및 9:16 화면 비율을 지원합니다
  • 세계 지식 및 시뮬레이션: 물리 이해와 Gemini의 역사, 과학, 문화적 맥락에 대한 지식을 결합하여 포토리얼리즘을 넘어선 의미 있는 스토리텔링을 가능하게 합니다
  • 텍스트 및 동작 동기화: 읽기 쉬운 텍스트와 그래픽을 비디오에 직접 렌더링하여 키네틱 타이포그래피를 화면 내 움직임과 동기화합니다
파트너 노드를 사용하려면 올바르게 로그인되어 있고 허가된 네트워크 환경을 사용하고 있는지 확인해야 합니다. 파트너 노드를 사용하기 위한 구체적인 요구사항은 문서의 파트너 노드 개요 섹션을 참조해 주세요.
ComfyUI가 최신 버전으로 업데이트되었는지 확인하세요.이 가이드의 워크플로는 워크플로 템플릿에서 확인할 수 있습니다. 템플릿에서 찾을 수 없다면, 귀하의 ComfyUI가 오래된 버전일 수 있습니다.워크플로를 로드할 때 노드가 누락되는 경우, 가능한 원인:
  1. 최신 ComfyUI 버전(최신 테스트 버전(nightly))을 사용하고 있지 않음
  2. 일부 노드가 시작 시 가져오기에 실패함
Gemini Omni Flash 1.1 워크플로에는 ComfyUI 0.34.2 이상이 필요합니다. 노드의 모델 드롭다운에서 Omni Flash 1.1을 선택하면 정식 버전 모델을 사용할 수 있습니다. Omni Flash 옵션은 프리뷰 모델을 실행하며, 이 모델은 2026년 9월 30일에 지원이 종료될 예정입니다.

사용 가능한 워크플로

텍스트 기반 비디오 생성 (Omni Flash 1.1)

Gemini Omni Flash 1.1을 사용하여 자연어 프롬프트로 시네마틱 비디오를 생성합니다. 프롬프트에 원하는 길이(3~10초)를 직접 설명하고, 노드에서 화면 비율과 출력 해상도를 선택합니다: 16:9 또는 9:16, 저비용 초안은 360p, 최종 렌더링은 최대 4K. 모든 클립에 생성된 오디오 트랙이 포함됩니다. Gemini Omni Flash 1.1 텍스트 기반 비디오 생성 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Gemini Omni 1.1” 검색

이미지 기반 비디오 생성 (Omni Flash 1.1)

Gemini Omni Flash 1.1로 이미지에 애니메이션을 적용합니다. image_to_video 작업에서 첫 번째 첨부 이미지가 시작 프레임이 되고, 선택적인 두 번째 이미지가 종료 프레임이 됩니다: 모델이 그 사이의 영상을 생성하므로 카메라 오빗, 줌 전환, 루프 클립을 예측 가능하게 만들 수 있습니다. Gemini Omni Flash 1.1 이미지 기반 비디오 생성 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Gemini Omni 1.1” 검색

참조 이미지 기반 비디오 생성 (Omni Flash 1.1)

최대 14장의 참조 이미지에서 특정 피사체를 통합한 비디오를 생성합니다. 참조 모드에서는 <IMAGE_REF_0> 같은 태그로 각 이미지를 역할에 바인딩하고 프롬프트에서 해당 태그를 참조합니다: 이미지 속 캐릭터, 제품, 객체가 장면에 등장하며 이미지 자체는 프레임으로 사용되지 않습니다. 캐릭터 참조와 스타일 참조를 결합하면 브랜드 일관성 있는 콘텐츠를 만들 수 있습니다. Gemini Omni Flash 1.1 참조 이미지 기반 비디오 생성 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Gemini Omni 1.1” 검색

비디오 편집 (Omni Flash 1.1)

Gemini Omni Flash 1.1을 사용하여 자연어로 비디오를 편집합니다. edit 작업에서 노드는 입력 비디오를 정확히 하나만 받아(10초 이하) 지시에 따라 다시 작성합니다: 배경 교체, 장면 스타일 변경, 요소 추가 또는 제거. editextend 작업은 입력 비디오의 화면 비율을 유지합니다. 간단한 프롬프트가 가장 효과적입니다. “나머지는 그대로 유지”를 추가하면 일관성이 최대화됩니다. Gemini Omni Flash 1.1 비디오 편집 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Gemini Omni 1.1” 검색

비디오 확장 (Omni Flash 1.1)

extend 작업으로 기존 비디오를 단계당 최대 10초씩 확장하여 총 약 40초의 스토리를 구축할 수 있습니다. 모델은 마지막 10초의 컨텍스트를 분석하여 장면이 중단된 지점부터 이어질 때 캐릭터, 움직임, 오디오의 일관성을 유지합니다. 참조 이미지를 첨부하여 스토리 중간에 새로운 캐릭터를 등장시킬 수도 있습니다. 확장은 클립 끝에만 새 콘텐츠를 추가하지만, 전환이 자연스럽도록 모델이 마지막 원본 프레임을 수정할 수 있습니다. Gemini Omni Flash 1.1 비디오 확장 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Gemini Omni 1.1” 검색

시작하기

  1. ComfyUI를 최신 버전으로 업데이트하세요 (Omni Flash 1.1 워크플로에는 0.34.2 이상 필요)
  2. 캔버스를 더블 클릭하고 “Gemini Omni Flash” 노드를 검색하세요.
  3. 또는 템플릿 라이브러리에서 바로 사용할 수 있는 워크플로를 사용하세요.
  4. 입력 유형(텍스트, 이미지 또는 비디오)에 맞는 워크플로를 선택하세요.
  5. 프롬프트를 입력하고 생성하세요.
최상의 결과를 위해 Gemini Omni Flash를 Nano Banana 2 Lite와 결합하세요: 고속으로 이미지를 생성한 다음, Gemini Omni Flash를 사용하여 비디오로 애니메이션화하세요.