AI Server

La piattaforma di IA privata per i team. Un server esegue i modelli — ogni app e ogni dispositivo li usa e basta. AI Server offre chat, embedding, generazione di immagini, voce e visione dal tuo hardware, tramite API compatibili con OpenAI, a tutta l'AI Suite e a qualsiasi strumento compatibile.

Inizia gratis sulla tua macchina. Quando il team cresce, servi la tua rete; quando una macchina non basta, la modalità AI Gateway trasforma più server in un unico endpoint con bilanciamento del carico — sulla tua LAN, in Docker o su Kubernetes. Nessun cloud di fornitori nel percorso dei dati, in nessun momento.

Scaricalo dal Microsoft Store Guarda cosa fa ↓ Licenze e prezzi

COSA FA AI SERVER

Un'unica installazione alimenta tutto

Senza un server, ogni PC scarica i propri modelli, richiede la propria GPU e va configurato e aggiornato separatamente. Con AI Server i modelli si scaricano una volta sola, girano sul miglior hardware che hai e servono tutti.

API di IA universali

Endpoint compatibili con OpenAI per chat, embedding, generazione di immagini, riconoscimento vocale (incluso lo streaming in tempo reale), sintesi vocale, clonazione della voce e visione — tutto servito dal tuo hardware. Puntaci qualsiasi strumento compatibile o il tuo codice.

Alimenta tutta l'AI Suite

Ogni app dell'AI Suite individua il server e gli delega il proprio lavoro di IA — senza alcuna configurazione. Note, PDF, traduzione, dettatura, immagini, e-mail e altro, tutto condividendo un unico set di modelli su una sola macchina.

Governance integrata

Chiavi API con piani per chiave, limiti di frequenza, quote e budget, analisi d'uso per app e modello e registri di audit privi di contenuti con esportazione firmata. I controlli che l'IT si aspetta, senza un fornitore cloud di mezzo.

Scala con AI Gateway

Basta un interruttore e più server diventano un unico endpoint: bilanciamento del carico con controllo dello stato, routing consapevole del modello che preferisce le macchine che lo hanno già caricato, rilasci canary e aggiornamenti senza tempi di inattività.

Gira ovunque

Un'app desktop per la macchina sotto la scrivania; container, manifest Kubernetes e un chart Helm per il rack o il cloud. Stesso prodotto, stesse API, stessa licenza — da un portatile a una farm di GPU.

Osservabile per progettazione

Ogni server ospita la propria dashboard in tempo reale e metriche Prometheus native: salute della flotta, latenza, utilizzo e capacità a colpo d'occhio — senza uno stack di monitoraggio aggiuntivo per iniziare.

AI GATEWAY

Da un server a una farm — senza cambiare un solo client

AI Gateway è AI Server eseguito nella sua modalità front-end di farm. I client vi si connettono esattamente come se fosse un singolo AI Server; dietro, un pool di server di lavoro (worker) esegue l'inferenza vera e propria. Aggiungi una macchina e la capacità cresce; togline una per la manutenzione e il traffico defluisce con dolcezza — nessuna richiesta viene persa.

Su Kubernetes i worker vengono individuati automaticamente man mano che scalano, così una farm con scalabilità automatica non richiede modifiche manuali al pool. L'intero parco resta osservabile dalla dashboard integrata e dalle metriche Prometheus.

Cosa gestisce il Gateway per te

  • Bilanciamento del carico — round-robin, latenza minima, meno connessioni, ponderato o sticky per client.
  • Routing consapevole del modello — le richieste vanno a una macchina che ha già caricato il modello richiesto.
  • Failover — un worker che fallisce viene ritentato su uno integro prima ancora che il client se ne accorga.
  • Rilasci canary — invia una quota costante di traffico alle nuove macchine prima di fidartene del tutto.
  • Backpressure — quando ogni worker è saturo, i chiamanti ricevono un onesto "riprova a breve" invece di un timeout.
  • Aggiornamenti senza tempi di inattività — svuota un worker, aggiornalo e rimettilo nel pool.
EDIZIONI E LIVELLI

Inizia gratis. Cresci quando cresce il tuo team.

Il livello gratuito è un prodotto vero, non una prova: un server di IA locale completo per tutte le app dell'AI Suite sulla tua macchina, per sempre. I livelli a pagamento iniziano esattamente dove il valore supera i confini di una macchina.

Gratis

Un server di IA locale completo sulla tua macchina. Uso illimitato da parte di ogni app dell'AI Suite su quella macchina; i client generici compatibili con OpenAI hanno un limite di frequenza.

Pro Personal

Servi i tuoi dispositivi sulla tua rete: distribuzione su LAN, esecuzione come servizio del sistema, chiavi API per portatile e telefono, client generici illimitati e un piccolo pool di gateway.

Pro Commercial

Servi altre persone: uso commerciale, chiavi API illimitate, governance completa (quote, budget, firma di audit) e una farm di gateway di produzione con rilasci canary e individuazione automatica dei worker.

Enterprise

Parchi illimitati, arruolamento dell'organizzazione con AI Admin Console, funzionamento offline e air-gapped e supporto prioritario. Licenza per parco — parliamone.

Acquista Pro nel nostro Store → Licenze e prezzi Parlaci di Enterprise

Installa gratuitamente l’app dal relativo marketplace. Un abbonamento diretto Personal o Commercial include un codice prodotto valido su tutte le piattaforme supportate.

CASI D’USO

Una piattaforma AI privata, più modelli di distribuzione

Centralizza modelli costosi e governance lasciando ai team app familiari e strumenti compatibili OpenAI.

Uffici e team della conoscenza

Condividi da una macchina gestita modelli approvati di chat, traduzione, riscrittura, RAG documentale, immagini e voce invece di scaricarli su ogni postazione.

Leggi il modello di distribuzione →

Carichi regolamentati e sensibili

Offri AI a team legali, sanitari, finanziari, pubblici e di ricerca mantenendo prompt, file, accesso e audit nel confine scelto.

Leggi il modello di distribuzione →

Sviluppatori e piattaforma API interna

Collega app compatibili OpenAI, agenti e valutazioni CI a un endpoint interno. Il team piattaforma controlla modelli e capacità senza chiavi vendor in ogni progetto.

Leggi il modello di distribuzione →

Sedi, failover e farm GPU

Metti AI Gateway davanti a worker distribuiti per routing basato sullo stato, affinità dei modelli caldi, manutenzione progressiva e crescita senza riconfigurare i client.

Leggi il modello di distribuzione →
INIZIA IN PICCOLO

Pianifica la prima distribuzione attorno a un flusso reale

Dimostra lavoro utile e confine di privacy su una macchina prima di aggiungere utenti, policy o una server farm.

1. Scegli il carico di lavoro

Scegli un’attività delimitata, come chat privata, domande sui documenti, traduzione o trascrizione, e le persone che la valuteranno.

2. Abbina l’hardware

Seleziona modello e macchina in base a contesto, tempo di risposta e utenti simultanei previsti. Valida prima su CPU o aggiungi GPU quando serve.

3. Verifica il confine

Conferma client, modelli, log e percorsi di rete consentiti. Mantieni prompt e file entro il confine scelto.

4. Aggiungi controllo crescendo

Passa al servizio in rete, alle chiavi API e alle quote, poi registra l’ambiente in AI Admin Console o aggiungi worker AI Gateway quando la domanda lo giustifica.

DISTRIBUISCI NEL TUO CLOUD

Distribuzione certificata per Azure e AWS

AI Server è disponibile come applicazione Kubernetes gratuita/BYOL su Microsoft Marketplace e AWS Marketplace. L’infrastruttura cloud è fatturata dal provider; la stessa licenza AI Server Commercial o Enterprise attiva gateway e worker.

Microsoft Azure

Installa l’app Kubernetes certificata in un cluster AKS esistente. Inizia con un nodo CPU per convalidare la distribuzione, quindi aggiungi worker NVIDIA GPU per i carichi di inferenza reali.

Trova in Microsoft Marketplace

Amazon Web Services

Distribuisci il pacchetto Helm di AWS Marketplace su Amazon EKS. Un piccolo pool di nodi di sistema e worker GPU separati mantiene stabili i servizi e semplifica la scalabilità.

Trova in AWS Marketplace
PRIVATO PER ARCHITETTURA

I tuoi prompt non lasciano mai la tua rete — perché non hanno dove andare

AI Server non è un proxy verso un'API cloud. I modelli girano sul tuo hardware; le richieste viaggiano dalle tue app al tuo server e ritorno, dentro il tuo perimetro. Il funzionamento offline e air-gapped sono modalità di distribuzione supportate, non eccezioni speciali.

  • Nessun cloud di fornitori nel percorso dei dati. Prompt, documenti e contenuti generati restano tra i tuoi client e il tuo server.
  • Registrazioni prive di contenuti. Le analisi d'uso e i registri di audit annotano chi ha chiamato cosa e quando — mai il testo di un prompt o di una risposta.
  • Licenze a prova di guasto. Se il nostro servizio di licenze fosse mai irraggiungibile, la tua flotta concessa in licenza continua a servire. La tua disponibilità non dipende dalla nostra.
  • Le tue chiavi, le tue regole. Le chiavi API le emetti e le revochi tu, sul tuo server — non account nel cloud di qualcun altro.
Rivedere l’attuale matrice di fiducia e controllo

Domande su AI Server o AI Gateway?

Per aiuto sulla distribuzione, consigli di dimensionamento, domande su Kubernetes o licenze, scrivi a [email protected] — oppure usa il modulo di contatto e scegli "Prodotto".

Iscriviti agli aggiornamenti prodotto

Nuovi prodotti IA gratuiti, aggiornamenti importanti e release disponibili solo su questo sito. Niente spam.