Diseñe su despliegue de IA privada
Cree una topología completa de apps cliente, AI Gateway y workers de AI Server antes de crear recursos en la nube. En este planificador, cada «worker» es un nodo de AI Server que ejecuta modelos.
Parámetros de despliegue
Pasarela con grupo de workers gestionado
Estimación de planificación, no una oferta. Las tarifas son una instantánea de precios públicos del 21 de agosto de 2026. Se excluyen transferencia de datos, IPv4 pública, balanceadores, ingestión de monitorización, copias, soporte, descuentos, capacidad reservada o Spot, impuestos y requisitos específicos del modelo.
Valide el diseño con seguridad y plataforma, mida sus modelos, confirme la cuota GPU y los SKU regionales, y calcule la arquitectura final con el proveedor.
Antes de la aprobación, utilice la lista de verificación de adquisiciones de IA privada para verificar las rutas de datos, la supervisión humana, las operaciones, el costo total y los términos de salida.
Un punto de partida práctico
Piloto
Use un worker CPU para validar red, claves, clientes y operaciones. Demuestra el despliegue, no la velocidad de producción.
Equipo
Empiece con dos workers GPU tras AI Gateway. Mantenga uno mientras el otro atiende tráfico y amplíe sin cambiar clientes.
Producción
Use tres o más workers entre dominios de fallo, SLA de producción, límites de autoescalado, almacenamiento persistente, entrada TLS y su observabilidad habitual.