AI Server
La piattaforma di IA privata per i team. Un server esegue i modelli — ogni app e ogni dispositivo li usa e basta. AI Server offre chat, embedding, generazione di immagini, voce e visione dal tuo hardware, tramite API compatibili con OpenAI, a tutta l'AI Suite e a qualsiasi strumento compatibile.
Inizia gratis sulla tua macchina. Quando il team cresce, servi la tua rete; quando una macchina non basta, la modalità AI Gateway trasforma più server in un unico endpoint con bilanciamento del carico — sulla tua LAN, in Docker o su Kubernetes. Nessun cloud di fornitori nel percorso dei dati, in nessun momento.
Scaricalo dal Microsoft Store Guarda cosa fa ↓ Licenze e prezzi
Un'unica installazione alimenta tutto
Senza un server, ogni PC scarica i propri modelli, richiede la propria GPU e va configurato e aggiornato separatamente. Con AI Server i modelli si scaricano una volta sola, girano sul miglior hardware che hai e servono tutti.
API di IA universali
Endpoint compatibili con OpenAI per chat, embedding, generazione di immagini, riconoscimento vocale (incluso lo streaming in tempo reale), sintesi vocale, clonazione della voce e visione — tutto servito dal tuo hardware. Puntaci qualsiasi strumento compatibile o il tuo codice.
Alimenta tutta l'AI Suite
Ogni app dell'AI Suite individua il server e gli delega il proprio lavoro di IA — senza alcuna configurazione. Note, PDF, traduzione, dettatura, immagini, e-mail e altro, tutto condividendo un unico set di modelli su una sola macchina.
Governance integrata
Chiavi API con piani per chiave, limiti di frequenza, quote e budget, analisi d'uso per app e modello e registri di audit privi di contenuti con esportazione firmata. I controlli che l'IT si aspetta, senza un fornitore cloud di mezzo.
Scala con AI Gateway
Basta un interruttore e più server diventano un unico endpoint: bilanciamento del carico con controllo dello stato, routing consapevole del modello che preferisce le macchine che lo hanno già caricato, rilasci canary e aggiornamenti senza tempi di inattività.
Gira ovunque
Un'app desktop per la macchina sotto la scrivania; container, manifest Kubernetes e un chart Helm per il rack o il cloud. Stesso prodotto, stesse API, stessa licenza — da un portatile a una farm di GPU.
Osservabile per progettazione
Ogni server ospita la propria dashboard in tempo reale e metriche Prometheus native: salute della flotta, latenza, utilizzo e capacità a colpo d'occhio — senza uno stack di monitoraggio aggiuntivo per iniziare.
Da un server a una farm — senza cambiare un solo client
AI Gateway è AI Server eseguito nella sua modalità front-end di farm. I client vi si connettono esattamente come se fosse un singolo AI Server; dietro, un pool di server di lavoro (worker) esegue l'inferenza vera e propria. Aggiungi una macchina e la capacità cresce; togline una per la manutenzione e il traffico defluisce con dolcezza — nessuna richiesta viene persa.
Su Kubernetes i worker vengono individuati automaticamente man mano che scalano, così una farm con scalabilità automatica non richiede modifiche manuali al pool. L'intero parco resta osservabile dalla dashboard integrata e dalle metriche Prometheus.
Cosa gestisce il Gateway per te
- Bilanciamento del carico — round-robin, latenza minima, meno connessioni, ponderato o sticky per client.
- Routing consapevole del modello — le richieste vanno a una macchina che ha già caricato il modello richiesto.
- Failover — un worker che fallisce viene ritentato su uno integro prima ancora che il client se ne accorga.
- Rilasci canary — invia una quota costante di traffico alle nuove macchine prima di fidartene del tutto.
- Backpressure — quando ogni worker è saturo, i chiamanti ricevono un onesto "riprova a breve" invece di un timeout.
- Aggiornamenti senza tempi di inattività — svuota un worker, aggiornalo e rimettilo nel pool.
Inizia gratis. Cresci quando cresce il tuo team.
Il livello gratuito è un prodotto vero, non una prova: un server di IA locale completo per tutte le app dell'AI Suite sulla tua macchina, per sempre. I livelli a pagamento iniziano esattamente dove il valore supera i confini di una macchina.
Gratis
Un server di IA locale completo sulla tua macchina. Uso illimitato da parte di ogni app dell'AI Suite su quella macchina; i client generici compatibili con OpenAI hanno un limite di frequenza.
Pro Personal
Servi i tuoi dispositivi sulla tua rete: distribuzione su LAN, esecuzione come servizio del sistema, chiavi API per portatile e telefono, client generici illimitati e un piccolo pool di gateway.
Pro Commercial
Servi altre persone: uso commerciale, chiavi API illimitate, governance completa (quote, budget, firma di audit) e una farm di gateway di produzione con rilasci canary e individuazione automatica dei worker.
Enterprise
Parchi illimitati, arruolamento dell'organizzazione con AI Admin Console, funzionamento offline e air-gapped e supporto prioritario. Licenza per parco — parliamone.
Installa gratuitamente l’app dal relativo marketplace. Un abbonamento diretto Personal o Commercial include un codice prodotto valido su tutte le piattaforme supportate.
Una piattaforma AI privata, più modelli di distribuzione
Centralizza modelli costosi e governance lasciando ai team app familiari e strumenti compatibili OpenAI.
Uffici e team della conoscenza
Condividi da una macchina gestita modelli approvati di chat, traduzione, riscrittura, RAG documentale, immagini e voce invece di scaricarli su ogni postazione.
Leggi il modello di distribuzione →Carichi regolamentati e sensibili
Offri AI a team legali, sanitari, finanziari, pubblici e di ricerca mantenendo prompt, file, accesso e audit nel confine scelto.
Leggi il modello di distribuzione →Sviluppatori e piattaforma API interna
Collega app compatibili OpenAI, agenti e valutazioni CI a un endpoint interno. Il team piattaforma controlla modelli e capacità senza chiavi vendor in ogni progetto.
Leggi il modello di distribuzione →Sedi, failover e farm GPU
Metti AI Gateway davanti a worker distribuiti per routing basato sullo stato, affinità dei modelli caldi, manutenzione progressiva e crescita senza riconfigurare i client.
Leggi il modello di distribuzione →Pianifica la prima distribuzione attorno a un flusso reale
Dimostra lavoro utile e confine di privacy su una macchina prima di aggiungere utenti, policy o una server farm.
1. Scegli il carico di lavoro
Scegli un’attività delimitata, come chat privata, domande sui documenti, traduzione o trascrizione, e le persone che la valuteranno.
2. Abbina l’hardware
Seleziona modello e macchina in base a contesto, tempo di risposta e utenti simultanei previsti. Valida prima su CPU o aggiungi GPU quando serve.
3. Verifica il confine
Conferma client, modelli, log e percorsi di rete consentiti. Mantieni prompt e file entro il confine scelto.
4. Aggiungi controllo crescendo
Passa al servizio in rete, alle chiavi API e alle quote, poi registra l’ambiente in AI Admin Console o aggiungi worker AI Gateway quando la domanda lo giustifica.
Distribuzione certificata per Azure e AWS
AI Server è disponibile come applicazione Kubernetes gratuita/BYOL su Microsoft Marketplace e AWS Marketplace. L’infrastruttura cloud è fatturata dal provider; la stessa licenza AI Server Commercial o Enterprise attiva gateway e worker.
Microsoft Azure
Installa l’app Kubernetes certificata in un cluster AKS esistente. Inizia con un nodo CPU per convalidare la distribuzione, quindi aggiungi worker NVIDIA GPU per i carichi di inferenza reali.
Trova in Microsoft MarketplaceAmazon Web Services
Distribuisci il pacchetto Helm di AWS Marketplace su Amazon EKS. Un piccolo pool di nodi di sistema e worker GPU separati mantiene stabili i servizi e semplifica la scalabilità.
Trova in AWS MarketplaceI tuoi prompt non lasciano mai la tua rete — perché non hanno dove andare
AI Server non è un proxy verso un'API cloud. I modelli girano sul tuo hardware; le richieste viaggiano dalle tue app al tuo server e ritorno, dentro il tuo perimetro. Il funzionamento offline e air-gapped sono modalità di distribuzione supportate, non eccezioni speciali.
- Nessun cloud di fornitori nel percorso dei dati. Prompt, documenti e contenuti generati restano tra i tuoi client e il tuo server.
- Registrazioni prive di contenuti. Le analisi d'uso e i registri di audit annotano chi ha chiamato cosa e quando — mai il testo di un prompt o di una risposta.
- Licenze a prova di guasto. Se il nostro servizio di licenze fosse mai irraggiungibile, la tua flotta concessa in licenza continua a servire. La tua disponibilità non dipende dalla nostra.
- Le tue chiavi, le tue regole. Le chiavi API le emetti e le revochi tu, sul tuo server — non account nel cloud di qualcun altro.
Domande su AI Server o AI Gateway?
Per aiuto sulla distribuzione, consigli di dimensionamento, domande su Kubernetes o licenze, scrivi a [email protected] — oppure usa il modulo di contatto e scegli "Prodotto".