En este documento, se explica cómo planificar y diseñar tu infraestructura de procesamiento enviando instrucciones a Gemini.
Compute Advisor es una interfaz potenciada por IA en la Google Cloud consola, con tecnología de Gemini, que te ayuda a evaluar opciones de hardware, estimar costos de implementación y ver configuraciones recomendadas para tus instancias de Compute Engine. Para adaptar sus recomendaciones, Gemini evalúa tu Google Cloud proyecto verificando los límites de cuota, las reservas existentes, los descuentos por uso comprometido (CUD), la región y la zona predeterminadas, y cualquier restricción de ubicación de recursos. Si usas Gemini para ayudarte con la planificación, puedes alcanzar una configuración óptima para tu carga de trabajo antes de crear o modificar una instancia de procesamiento.
Para obtener más información sobre los componentes que debes configurar antes de crear una instancia de procesamiento o cuando lo hagas, consulta Descripción general de la creación de instancias de Compute Engine.
Limitaciones
Cuando envías instrucciones a Gemini en la Google Cloud consola, no puedes crear, modificar ni borrar recursos con Gemini.
Antes de comenzar
Cuando usas la Google Cloud consola para acceder a los Google Cloud servicios y las APIs, no necesitas configurar la autenticación.
Roles obligatorios
Para obtener los permisos que
necesitas para acceder a Gemini y enviarle instrucciones,
pídele a tu administrador que te otorgue el rol de Visualizador de Compute (roles/compute.viewer) de IAM en el proyecto.
Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.
Este rol predefinido contiene los permisos necesarios para acceder a Gemini y enviarle instrucciones. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:
Permisos necesarios
Se requieren los siguientes permisos para acceder a Gemini y enviarle instrucciones:
-
Para ver una lista de instancias:
compute.instances.list
También puedes obtener estos permisos con roles personalizados o otros roles predefinidos.
Accede a Gemini en la Google Cloud consola
Para acceder a Gemini en la Google Cloud consola, sigue estos pasos:
En la Google Cloud consola, ve a la página Descripción general.
En la sección Diseña tu infraestructura con Compute Advisor, puedes ver lo siguiente:
Los elementos de la IU que se muestran en la captura de pantalla anterior son los siguientes:
Tarjetas de instrucciones de acción rápida: Un conjunto de tarjetas que contienen una muestra de instrucción. Si haces clic en una tarjeta, la Google Cloud consola completa automáticamente el cuadro de instrucciones con la instrucción de muestra.
Cuadro de instrucciones: Este campo te permite ingresar y enviar instrucciones. Para enviar una instrucción, haz clic en Enviar instrucción.
Ver conversaciones anteriores: Esta función te permite ver los detalles de una conversación anterior y reanudarla, o borrar conversaciones si ya no las necesitas.
Panel lateral del historial de conversaciones: Muestra tus chats recientes. Este panel solo está visible después de que comienzas a enviar instrucciones desde la página Descripción general. Puedes interactuar con este panel de la siguiente manera:
Para iniciar una conversación nueva, haz clic en Nuevo chat.
Para reanudar una conversación reciente, en la sección Chats recientes , haz clic en la conversación.
Para ver una lista de todas tus conversaciones, haz clic en Ver todos. En la página Mi historial, puedes ver los detalles de una conversación anterior y reanudarla, o borrar conversaciones si ya no las necesitas.
Envía instrucciones a Gemini
Después de enviar una instrucción, Gemini comienza a generar una respuesta. Aparece un panel y Google Cloud la consola muestra la respuesta a tu instrucción en el panel, como se muestra en la siguiente captura de pantalla:
Según tu instrucción, el panel de respuestas incluye los siguientes elementos:
Fundamentación contextual: Gemini evalúa automáticamente el contexto de tu proyecto para ofrecer recomendaciones altamente personalizadas, incluidos los límites de cuota, las reservas existentes, los CUD, tu región y zona predeterminadas, y cualquier restricción de ubicación de recursos.
Fragmentos de código interactivos: Gemini genera comandos de gcloud, métodos de la API de REST o recursos de Terraform. Puedes copiar y pegar estos fragmentos de código o ejecutarlos en Cloud Shell.
Lienzo visual: Gemini organiza las recomendaciones en tablas estructuradas y comparaciones en paralelo. Esta vista te ayuda a evaluar las funciones del producto y los enfoques arquitectónicos. También proporciona un plan de implementación para tu caso de uso.
En las siguientes secciones, se describen las prácticas recomendadas para escribir instrucciones y ejemplos de instrucciones que puedes usar antes de crear o modificar una instancia de procesamiento.
Prácticas recomendadas para enviar instrucciones
Para obtener las recomendaciones más precisas y prácticas de Gemini, te recomendamos que estructures tus instrucciones de la misma manera que lo harías con un bloque de código. Este enfoque guía la IA generativa mediante declaraciones de parámetros claras, definiciones de roles, instrucciones específicas y formatos de salida explícitos.
Cuando envíes instrucciones a Gemini, ten en cuenta las siguientes prácticas recomendadas:
Enfócate en el diseño y la planificación: Te recomendamos que no envíes instrucciones a Gemini para solucionar errores de instancias de procesamiento. Para resolver estos errores, consulta Soluciona problemas relacionados con la creación, actualización y eliminación de instancias de procesamiento.
Especifica una personificación o un rol: declara un rol o una personificación objetivo, como un administrador de TI, un investigador de IA o un ingeniero de plataformas, para que Gemini lo adopte. Este enfoque guía el tono, la profundidad y el nivel de experiencia de las recomendaciones resultantes.
Proporciona instrucciones explícitas y numeradas: Divide tu objetivo en preguntas o tareas concretas paso a paso. Este enfoque estructura el proceso de razonamiento de Gemini y ayuda a garantizar que Gemini aborde todos tus requisitos.
Define un formato de resultado específico: Indica explícitamente cómo quieres que se formatee la recomendación, como una explicación paso a paso, una tabla de comparación de Markdown o un bloque de código de gcloud listo para usar.
Aprovecha la fundamentación automática del contexto: No necesitas incluir tu región o zona predeterminada, las cuotas disponibles, los CUD ni las restricciones de ubicación de recursos en tu instrucción. Gemini puede acceder a esta información en tu Google Cloud proyecto.
Refina tus diseños de forma iterativa: Puedes modificar o expandir la respuesta que generó Gemini enviando instrucciones nuevas. Por ejemplo, puedes pedirle al asistente que agregue recomendaciones de redes a tu plan de implementación o que modifique los requisitos de almacenamiento sin iniciar una conversación nueva.
Ejemplos de instrucciones
Los siguientes son ejemplos de instrucciones que puedes usar para ayudarte a diseñar y optimizar tu infraestructura de procesamiento:
Topología de instancias de procesamiento y estrategia de ubicación: Para determinar el modelo de implementación y la política de ubicación óptimos para una carga de trabajo de alta disponibilidad, usa una instrucción como la siguiente:
Act as a cloud architect. I need to design a compute instance topology for a distributed database that balances multi-zone resilience with sub-millisecond latency. Please provide the following: 1. A side-by-side comparison of regional MIGs against zonal MIGs. 2. An explanation of whether compact placement policies work regionally. 3. The optimal autoscaling configuration for this workload. Format the comparison as a Markdown table, and provide the deployment steps as ready-to-use gcloud code blocks.Modelo de aprovisionamiento y optimización de costos: Para evaluar los modelos de aprovisionamiento y reducir los costos de procesamiento por lotes, usa una instrucción como la siguiente:
Act as a platform engineer. I need to find the cheapest way to run large, interruptible analytics jobs on our cloud servers without risking data loss. Please provide the following: 1. A cost and reliability comparison of standard discounted servers against queue-based servers. 2. An explanation of how to boot all our compute power at the exact same time. 3. A deployment script that gives our jobs a two-minute warning before a server gets reclaimed. Format the comparison as a Markdown table, and provide the script as a ready-to-use code block.
¿Qué sigue?
Descripción general de la creación de instancias de Compute Engine
Modelos de aprovisionamiento de instancias de Compute Engine