Descripción general de la capacidad

AI Hypercomputer admite varias opciones de consumo para ayudarte a obtener y usar recursos de procesamiento. En este documento, se proporciona una descripción general de cómo puedes obtener capacidad para cada opción de consumo.

Cómo obtener capacidad

En la siguiente tabla, se describe cómo puedes obtener capacidad para cada opción de consumo.

Opción de consumo Proceso para obtener capacidad Implicaciones de precios
Reservas futuras en AI Hypercomputer

Para obtener recursos de reservas futuras, el proceso es el siguiente:

  1. Reserva capacidad comunicándote con tu equipo de cuentas.
  2. La cuota se aumenta automáticamente antes de que se entregue la capacidad. No es necesario que realices ninguna acción.
  3. Cuando creas una instancia o un clúster de Compute Engine, especifica el modelo de aprovisionamiento vinculado a la reserva. Las instancias de procesamiento y los clústeres se aprovisionan a partir de tu capacidad reservada.
Se te cobrará por todo el período de la reserva, independientemente de si usas los recursos reservados durante todo el período. Para obtener más información, consulta la sección Facturación de reservas de la documentación sobre las reservas de Compute Engine.
Reservas futuras de menos de 90 días (en modo de calendario)

Para obtener recursos de reservas futuras, el proceso es el siguiente:

  1. Busca capacidad disponible y reserva recursos.
  2. No se cobra ninguna cuota y no es necesario que realices ninguna acción.
  3. Cuando creas una instancia o un clúster de procesamiento, debes especificar el modelo de aprovisionamiento vinculado a la reserva. Las instancias de procesamiento y los clústeres se aprovisionan a partir de tu capacidad reservada.
Se te cobrará por todo el período de la reserva, independientemente de si usas los recursos reservados durante todo el período. Para obtener más información, consulta los precios del Programador de cargas de trabajo dinámico.
Inicio flexible

Para esta opción de consumo, no se requiere reserva. Para obtener recursos de inicio flexible, el proceso es el siguiente:

  1. Debes solicitar cuota interrumpible para el tipo de máquina con GPU que deseas usar.
  2. Cuando crees instancias o clústeres de procesamiento con una de las siguientes opciones, especifica el modelo de aprovisionamiento de inicio flexible:

    Cuando los recursos solicitados estén disponibles, Compute Engine aprovisionará tus VMs. Tus VMs se ejecutan durante un máximo de siete días.

Se te cobra cuando los recursos están en uso. Los recursos aprovisionados con VMs de inicio flexible obtienen descuentos automáticamente a través de los precios del Programador dinámico de cargas de trabajo.
A pedido

Para esta opción de consumo, reservar capacidad es opcional. Los recursos a pedido solo están disponibles para las GPU generales (como N1, G2, G4, A2 o A3 Edge). Para obtener estos recursos a pedido, el proceso es el siguiente:

  1. Solicita una cuota de GPU estándar para el tipo de máquina que deseas usar. Para obtener más información, consulta Solicita un aumento de la cuota.
  2. Verifica la disponibilidad consultando las regiones preferidas para tu hardware en la lista de disponibilidad de GPU por región y zona de Compute Engine.
  3. Crea una instancia de procesamiento o un clúster y especifica el modelo de aprovisionamiento estándar. Los recursos se aprovisionan de inmediato según la capacidad disponible.
Se aplican las tarifas estándar según demanda mientras se usan los recursos.
Reservas según demanda

Las reservas bajo demanda (a veces denominadas reservas) solo están disponibles para las GPU generales (como G2, G4, A2 o A3 Edge). Para reservar capacidad, el proceso es el siguiente:

  1. Solicita una cuota de GPU estándar para tu tipo de máquina. Para obtener más información, consulta Solicita un aumento de la cuota.
  2. Crea una reserva según demanda para tu tipo específico de VM y GPU con la Google Cloud consola, la gcloud CLI o cualquier otro método. Para obtener detalles sobre todos los métodos para crear reservas, consulta Crea una reserva para un solo proyecto.
  3. Aprovisiona tus recursos creando una instancia o un clúster y segmentando tu reserva específica.
Se aplican tarifas estándar durante todo el período de reserva. Aplica CUDs para obtener ahorros significativos.
Reservas futuras estándar

En esta opción de consumo, reservas capacidad para una fecha futura. Las reservas futuras estándares usan el modelo de aprovisionamiento estándar y solo están disponibles para las GPUs generales.

  1. Solicita una cuota de GPU estándar para tu tipo de máquina. Para obtener más información, consulta Solicita un aumento de la cuota.
  2. Crea una solicitud de reserva futura para tu VM y tipo de GPU específicos.
  3. Cuando la reserva alcance su hora de inicio, crea instancias de procesamiento con la capacidad reservada.
Se aplican tarifas estándar durante todo el período de reserva. Aplica CUDs para obtener ahorros significativos.
Spot

Para esta opción de consumo, no se requiere reserva. Para obtener recursos de Spot, el proceso es el siguiente:

  1. Debes solicitar cuota interrumpible para el tipo de máquina con GPU que deseas usar.
  2. Consulta la disponibilidad de recursos en la región o zona en la que deseas crear instancias de procesamiento.
  3. Cuando crees una instancia o un clúster de procesamiento, especifica el modelo de aprovisionamiento de instancias interrumpibles. Los recursos se aprovisionan para ti a medida que la capacidad está disponible, pero se pueden interrumpir en cualquier momento.
Se te cobra cuando los recursos están en uso. Las VMs Spot obtienen descuentos automáticamente a través de los precios de las VMs Spot.

¿Qué sigue?