Desenhe a sua implementação de IA privada
Crie uma topologia completa para apps cliente, AI Gateway e workers do AI Server antes de criar recursos na nuvem. Neste planeador, cada “worker” é um nó do AI Server que executa modelos.
Parâmetros de implementação
Gateway com pool gerido de workers
Estimativa de planeamento, não uma proposta. As tarifas são preços públicos em 21 de agosto de 2026. Excluem transferência, IPv4 público, balanceadores, ingestão de monitorização, cópias, suporte, descontos, capacidade reservada ou Spot, impostos e requisitos dos modelos.
Valide o desenho com segurança e plataforma, teste os modelos, confirme quota GPU e SKU regionais e calcule a arquitetura final no fornecedor.
Antes da aprovação, use a lista de verificação de compras de IA privada para verificar rotas de dados, supervisão humana, operações, custo total e termos de saída.
Um ponto de partida prático
Piloto
Use um worker CPU para validar rede, chaves, clientes e operações. Demonstra a implementação, não a velocidade de produção.
Equipa
Comece com dois workers GPU atrás do AI Gateway. Mantenha um enquanto o outro serve tráfego e aumente capacidade sem mudar clientes.
Produção
Use três ou mais workers entre domínios de falha, SLA de produção, limites de autoescala, armazenamento persistente, entrada TLS e observabilidade padrão.