이미지에서 동영상 생성

Vertex AI 기반 Veo를 사용하여 이미지와 텍스트 프롬프트에서 새 동영상을 생성할 수 있습니다. 지원되는 인터페이스에는 Google Cloud 콘솔과 Vertex AI API가 있습니다.

동영상 생성에 효과적인 텍스트 프롬프트 작성에 대한 자세한 내용은 Veo 프롬프트 가이드를 참조하세요.

시작하기 전에

  1. Sign in to your Google Cloud account. If you're new to Google Cloud, create an account to evaluate how our products perform in real-world scenarios. New customers also get $300 in free credits to run, test, and deploy workloads.
  2. In the Google Cloud console, on the project selector page, select or create a Google Cloud project.

    Go to project selector

  3. Enable the Vertex AI API.

    Enable the API

  4. In the Google Cloud console, on the project selector page, select or create a Google Cloud project.

    Go to project selector

  5. Enable the Vertex AI API.

    Enable the API

  6. 환경에 대한 인증을 설정하세요.

    Select the tab for how you plan to use the samples on this page:

    Console

    When you use the Google Cloud console to access Google Cloud services and APIs, you don't need to set up authentication.

    REST

    로컬 개발 환경에서 이 페이지의 REST API 샘플을 사용하려면 gcloud CLI에 제공한 사용자 인증 정보를 사용합니다.

      After installing the Google Cloud CLI, initialize it by running the following command:

      gcloud init

      If you're using an external identity provider (IdP), you must first sign in to the gcloud CLI with your federated identity.

    자세한 내용은 Google Cloud 인증 문서의 REST 사용을 위한 인증을 참조하세요.

    이미지에서 동영상 생성

    샘플 입력 샘플 출력
    1. 입력 이미지1
      크로셰 코끼리의 PNG 파일 입력
    2. 텍스트 프롬프트: 코끼리가 자연스럽게 움직인다

    크로셰 코끼리 동영상 출력

    1 사바나를 걷고 있는 복잡한 패턴의 크로셰 코끼리 프롬프트로 Vertex AI 기반 Imagen을 사용하여 생성한 이미지

    이미지만 입력으로 사용하거나 이미지와 설명 텍스트를 입력으로 사용하여 새로운 동영상을 생성할 수 있습니다. 다음 샘플에서는 이미지와 텍스트로 동영상을 생성하는 기본 안내를 보여줍니다.

    콘솔

    1. Google Cloud 콘솔에서 Vertex AI Studio > Media Studio 페이지로 이동합니다.

      Media Studio

    2. 동영상을 클릭합니다.

    3. 선택사항: 설정 창에서 다음 설정을 구성합니다.

      • 모델: 사용 가능한 옵션 중에서 모델을 선택합니다.
      • 가로세로 비율: 16:9 또는 9:16을 선택합니다.

      • 결과 수: 슬라이더를 조정하거나 1~4 사이의 값을 입력합니다.

      • 동영상 길이: 길이를 5초~8초 중에서 선택합니다.

      • 출력 디렉터리: 찾아보기를 클릭하여 출력 파일을 저장할 Cloud Storage 버킷을 만들거나 선택합니다.

    4. 선택사항: 안전 섹션에서 다음 인물 생성 설정 중 하나를 선택합니다.

      • 허용(성인만 해당): 기본값입니다. 성인이나 성인 얼굴만 생성합니다. 청소년 또는 아동이나 청소년 또는 아동의 인물을 생성하지 마세요.

      • 허용 안함: 사람이나 얼굴을 생성하지 않습니다.

    5. 선택사항: 동영상을 무작위로 생성하려면 고급 옵션 섹션에서 시드 값을 입력합니다.

    6. 프롬프트 작성 상자에서 업로드를 클릭합니다.

    7. 업로드할 로컬 이미지를 선택하고 선택을 클릭합니다.

    8. 프롬프트 작성 상자에 생성할 동영상을 설명하는 텍스트 프롬프트를 입력합니다.

    9. 생성을 클릭합니다.

    REST

    환경을 설정하면 REST를 사용하여 텍스트 프롬프트를 테스트할 수 있습니다. 다음 샘플은 요청을 게시자 모델 엔드포인트에 전송합니다.

    Veo API에 대한 자세한 내용은 Vertex AI 기반 Veo API를 참조하세요.

    1. 다음 명령어를 사용하여 동영상 생성 요청을 전송합니다. 이 요청은 장기 실행 작업을 시작하고 지정한 Cloud Storage 버킷에 출력을 저장합니다.

      요청 데이터를 사용하기 전에 다음을 바꿉니다.

      • PROJECT_ID: Google Cloud 프로젝트 ID
      • MODEL_ID: 사용할 모델 ID. 사용 가능한 값은 다음과 같습니다.
        • veo-2.0-generate-001(정식 버전)
        • veo-3.0-generate-preview(미리보기)
      • TEXT_PROMPT: 동영상 생성을 안내하는 데 사용되는 텍스트 프롬프트
      • INPUT_IMAGE: 입력 이미지를 나타내는 base64로 인코딩된 바이트 문자열입니다. 품질을 보장하려면 입력 이미지가 720p 이상(1280x720픽셀)이고 가로세로 비율이 16:9 또는 9:16이어야 합니다. 업로드 중에 가로세로 비율이나 크기가 다른 이미지는 조절되거나 중앙에서 잘릴 수 있습니다.
      • MIME_TYPE: 입력 이미지의 MIME 유형입니다. image/jpeg 또는 image/png MIME 유형의 이미지만 지원됩니다.
      • OUTPUT_STORAGE_URI: (선택사항) 출력 동영상을 저장할 Cloud Storage 버킷. 제공하지 않으면 응답으로 동영상 바이트가 반환됩니다. 예를 들면 gs://video-bucket/output/입니다.
      • RESPONSE_COUNT: 생성할 동영상 파일의 수. 허용되는 정수 값은 1~4입니다.
      • DURATION: 생성할 동영상 파일의 길이. 허용되는 정수 값은 5~8입니다.
      • 추가 선택적 파라미터

        사용 사례에 따라 다음 선택적 변수를 사용하세요. "parameters": {} 객체에 다음 파라미터 중 일부 또는 전부를 추가합니다.

        "parameters": {
          "aspectRatio": "ASPECT_RATIO",
          "negativePrompt": "NEGATIVE_PROMPT",
          "personGeneration": "PERSON_SAFETY_SETTING",
          "sampleCount": RESPONSE_COUNT,
          "seed": SEED_NUMBER
        }
        • ASPECT_RATIO: 문자열입니다. (선택사항) 생성된 동영상의 가로세로 비율을 정의합니다. 값은 16:9(기본값, 가로) 또는 9:16(세로)입니다.
        • NEGATIVE_PROMPT: 문자열입니다. (선택사항) 모델에서 생성하지 않게 하려는 항목을 설명하는 텍스트 문자열입니다.
        • PERSON_SAFETY_SETTING: 문자열입니다. (선택사항) 사람 또는 얼굴 생성 허용 여부를 제어하는 안전 설정입니다. 값은 다음과 같습니다.
          • allow_adult(기본값): 성인만 생성합니다.
          • disallow: 이미지에 사람이나 얼굴을 포함하지 않습니다.
        • RESPONSE_COUNT: 선택사항. 정수. 요청된 출력 이미지 수입니다. 값은 1~4입니다.
        • SEED_NUMBER: uint32. (선택사항) 생성된 동영상을 결정론적으로 만드는 수입니다. 다른 파라미터를 변경하지 않고 요청에 시드 수를 지정하면 모델에서 동일한 동영상을 생성합니다. 값은 0~4294967295입니다.

      HTTP 메서드 및 URL:

      POST https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning

      JSON 요청 본문:

      {
        "instances": [
          {
            "prompt": "TEXT_PROMPT",
            "image": {
              "bytesBase64Encoded": "INPUT_IMAGE",
              "mimeType": "MIME_TYPE"
            }
          }
        ],
        "parameters": {
          "storageUri": "OUTPUT_STORAGE_URI",
          "sampleCount": RESPONSE_COUNT
        }
      }
      

      요청을 보내려면 다음 옵션 중 하나를 선택합니다.

      curl

      요청 본문을 request.json 파일에 저장하고 다음 명령어를 실행합니다.

      curl -X POST \
      -H "Authorization: Bearer $(gcloud auth print-access-token)" \
      -H "Content-Type: application/json; charset=utf-8" \
      -d @request.json \
      "https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning"

      PowerShell

      요청 본문을 request.json 파일에 저장하고 다음 명령어를 실행합니다.

      $cred = gcloud auth print-access-token
      $headers = @{ "Authorization" = "Bearer $cred" }

      Invoke-WebRequest `
      -Method POST `
      -Headers $headers `
      -ContentType: "application/json; charset=utf-8" `
      -InFile request.json `
      -Uri "https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning" | Select-Object -Expand Content
      이 요청은 고유한 작업 ID가 포함된 전체 작업 이름을 반환합니다. 이 전체 작업 이름을 사용하여 동영상 생성 요청 상태를 폴링합니다.
      {
        "name": "projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID/operations/a1b07c8e-7b5a-4aba-bb34-3e1ccb8afcc8"
      }
      

    2. (선택사항) 동영상 생성 장기 실행 작업의 상태를 확인합니다.

      요청 데이터를 사용하기 전에 다음을 바꿉니다.

      • PROJECT_ID: Google Cloud 프로젝트 ID
      • MODEL_ID: 사용할 모델 ID. 사용 가능한 값은 다음과 같습니다.
        • veo-2.0-generate-001
      • TEXT_PROMPT: 동영상 생성을 안내하는 데 사용되는 텍스트 프롬프트
      • OUTPUT_STORAGE_URI: (선택사항) 출력 동영상을 저장할 Cloud Storage 버킷. 제공하지 않으면 응답으로 동영상 바이트가 반환됩니다. 예를 들면 gs://video-bucket/output/입니다.
      • RESPONSE_COUNT: 생성할 동영상 파일의 수. 허용되는 정수 값은 1~4입니다.
      • 추가 선택적 파라미터

        사용 사례에 따라 다음 선택적 변수를 사용하세요. "parameters": {} 객체에 다음 파라미터 중 일부 또는 전부를 추가합니다.

        "parameters": {
          "aspectRatio": "ASPECT_RATIO",
          "negativePrompt": "NEGATIVE_PROMPT",
          "personGeneration": "PERSON_SAFETY_SETTING",
          "sampleCount": RESPONSE_COUNT,
          "seed": SEED_NUMBER
        }
        • ASPECT_RATIO: 문자열입니다. (선택사항) 생성된 동영상의 가로세로 비율을 정의합니다. 값은 16:9(기본값, 가로) 또는 9:16(세로)입니다.
        • NEGATIVE_PROMPT: 문자열입니다. (선택사항) 모델에서 생성하지 않게 하려는 항목을 설명하는 텍스트 문자열입니다.
        • PERSON_SAFETY_SETTING: 문자열입니다. (선택사항) 사람 또는 얼굴 생성 허용 여부를 제어하는 안전 설정입니다. 값은 다음과 같습니다.
          • allow_adult(기본값): 성인만 생성합니다.
          • disallow: 이미지에 사람이나 얼굴을 포함하지 않습니다.
        • RESPONSE_COUNT: 선택사항. 정수. 요청된 출력 이미지 수입니다. 값은 1~4입니다.
        • SEED_NUMBER: uint32. (선택사항) 생성된 동영상을 결정론적으로 만드는 수입니다. 다른 파라미터를 변경하지 않고 요청에 시드 수를 지정하면 모델에서 동일한 동영상을 생성합니다. 값은 0~4294967295입니다.

      HTTP 메서드 및 URL:

      POST https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning

      JSON 요청 본문:

      {
        "instances": [
          {
            "prompt": "TEXT_PROMPT"
          }
        ],
        "parameters": {
          "storageUri": "OUTPUT_STORAGE_URI",
          "sampleCount": "RESPONSE_COUNT"
        }
      }
      

      요청을 보내려면 다음 옵션 중 하나를 선택합니다.

      curl

      요청 본문을 request.json 파일에 저장하고 다음 명령어를 실행합니다.

      curl -X POST \
      -H "Authorization: Bearer $(gcloud auth print-access-token)" \
      -H "Content-Type: application/json; charset=utf-8" \
      -d @request.json \
      "https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning"

      PowerShell

      요청 본문을 request.json 파일에 저장하고 다음 명령어를 실행합니다.

      $cred = gcloud auth print-access-token
      $headers = @{ "Authorization" = "Bearer $cred" }

      Invoke-WebRequest `
      -Method POST `
      -Headers $headers `
      -ContentType: "application/json; charset=utf-8" `
      -InFile request.json `
      -Uri "https://us-central1-aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID:predictLongRunning" | Select-Object -Expand Content
      이 요청은 고유한 작업 ID가 포함된 전체 작업 이름을 반환합니다. 이 전체 작업 이름을 사용하여 동영상 생성 요청 상태를 폴링합니다.
      {
        "name": "projects/PROJECT_ID/locations/us-central1/publishers/google/models/MODEL_ID/operations/a1b07c8e-7b5a-4aba-bb34-3e1ccb8afcc8"
      }
      

    Python

    설치

    pip install --upgrade google-genai

    자세한 내용은 SDK 참고 문서를 참조하세요.

    Vertex AI에서 Gen AI SDK를 사용하도록 환경 변수를 설정합니다.

    # Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values
    # with appropriate values for your project.
    export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT
    export GOOGLE_CLOUD_LOCATION=global
    export GOOGLE_GENAI_USE_VERTEXAI=True

    import time
    from google import genai
    from google.genai.types import GenerateVideosConfig, Image
    
    client = genai.Client()
    
    # TODO(developer): Update and un-comment below line
    # output_gcs_uri = "gs://your-bucket/your-prefix"
    
    operation = client.models.generate_videos(
        model="veo-3.0-generate-preview",
        image=Image(
            gcs_uri="gs://cloud-samples-data/generative-ai/image/flowers.png",
            mime_type="image/png",
        ),
        config=GenerateVideosConfig(
            aspect_ratio="16:9",
            output_gcs_uri=output_gcs_uri,
        ),
    )
    
    while not operation.done:
        time.sleep(15)
        operation = client.operations.get(operation)
        print(operation)
    
    if operation.response:
        print(operation.result.generated_videos[0].video.uri)
    
    # Example response:
    # gs://your-bucket/your-prefix

    다음 단계