Skip to main content
Google Gemini는 구글이 개발한 강력한 AI 모델로, 대화 및 텍스트 생성 기능을 지원합니다. 현재 ComfyUI는 Google Gemini API를 통합하여, ComfyUI에서 관련 노드를 직접 사용해 대화 기능을 완성할 수 있도록 지원합니다. 이 가이드에서는 해당 대화 기능을 완성하는 과정을 안내해 드립니다.
파트너 노드를 사용하려면 올바르게 로그인되어 있고 허가된 네트워크 환경을 사용하고 있는지 확인해야 합니다. 파트너 노드를 사용하기 위한 구체적인 요구사항은 문서의 파트너 노드 개요 섹션을 참조해 주세요.
ComfyUI가 최신 버전으로 업데이트되었는지 확인하세요.이 가이드의 워크플로는 워크플로 템플릿에서 확인할 수 있습니다. 템플릿에서 찾을 수 없다면, 귀하의 ComfyUI가 오래된 버전일 수 있습니다.워크플로를 로드할 때 노드가 누락되는 경우, 가능한 원인:
  1. 최신 ComfyUI 버전(최신 테스트 버전(nightly))을 사용하고 있지 않음
  2. 일부 노드가 시작 시 가져오기에 실패함

Google Gemini

Google의 멀티모달 AI를 Gemini의 추론 기능으로 경험해보세요. Google Gemini 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로우 다운로드

JSON 다운로드 또는 템플릿 라이브러리에서 “Google Gemini” 검색
입력 자료 이 파일을 해당 LoadImage 노드에 업로드하세요:

example.png

LoadImage 노드 2 · example.png
example.png

워크플로우 실행을 단계별로 완료하세요

OpenAI 채팅 단계 안내
해당 템플릿에서는 역할 프롬프트를 분석하고 생성하는 프롬프트를 구축했으며, 이를 통해 이미지를 해당 드로잉 프롬프트로 해석합니다.
이미지에 표시된 번호를 참고해 기본적인 텍스트 기반 이미지 생성 워크플로우 실행을 완료할 수 있습니다:
  1. Load Image 노드에서 AI가 해석하도록 할 이미지를 로드하세요.
  2. (선택사항) 필요하다면 Google Gemini에서 프롬프트를 수정해 특정 작업을 실행하도록 AI에게 지시할 수 있습니다.
  3. 실행 버튼을 클릭하거나 단축키 Ctrl(cmd) + Enter를 사용해 대화를 실행하세요.
  4. API가 결과를 반환할 때까지 기다린 후, 미리보기 모든 항목 노드에서 AI가 반환한 해당 콘텐츠를 확인할 수 있습니다.

3. 추가 참고사항

  • 현재 파일 입력 노드 Gemini 입력 파일은 먼저 파일을 ComfyUI/input/ 디렉토리에 업로드해야 합니다. 이 노드는 개선 중이며, 업데이트 이후 템플릿을 수정할 예정입니다.
  • 워크플로우는 배치 이미지를 사용한 예시를 제공합니다. 여러 이미지를 AI가 해석해야 한다면, 단계 도표를 참고해 마우스 오른쪽 클릭으로 해당 노드 모드를 항상으로 설정해 활성화할 수 있습니다.