AI Server

Die private KI-Plattform für Teams. Ein Server betreibt die Modelle — jede App und jedes Gerät nutzt sie einfach. AI Server stellt Chat, Embeddings, Bildgenerierung, Sprache und Vision von Ihrer eigenen Hardware über OpenAI-kompatible APIs bereit — für die gesamte AI Suite und jedes kompatible Tool.

Starten Sie kostenlos auf Ihrem eigenen Rechner. Wenn Ihr Team wächst, stellen Sie es im Netzwerk bereit; wenn ein Rechner nicht mehr reicht, macht der AI Gateway-Modus aus mehreren Servern einen einzigen lastverteilten Endpunkt — in Ihrem LAN, in Docker oder auf Kubernetes. Zu keinem Zeitpunkt eine Anbieter-Cloud im Datenpfad.

Im Microsoft Store herunterladen Sehen, was es kann ↓ Lizenzierung & Preise

WAS AI SERVER LEISTET

Eine Installation für alles

Ohne Server lädt jeder PC seine eigenen Modelle herunter, braucht seine eigene GPU und wird einzeln konfiguriert und aktualisiert. Mit AI Server werden Modelle einmal heruntergeladen, laufen auf der besten verfügbaren Hardware und stehen allen zur Verfügung.

Universelle KI-APIs

OpenAI-kompatible Endpunkte für Chat, Embeddings, Bildgenerierung, Sprache-zu-Text (auch Live-Streaming), Text-zu-Sprache, Stimmklonen und Vision — alles von Ihrer Hardware bereitgestellt. Richten Sie jedes kompatible Tool oder Ihren eigenen Code darauf aus.

Betreibt die gesamte AI Suite

Jede AI-Suite-App erkennt den Server und lagert ihre KI-Arbeit an ihn aus — ganz ohne Konfiguration. Notizen, PDFs, Übersetzung, Diktat, Bilder, E-Mail und mehr, alle mit einem Satz Modelle auf einem Rechner.

Governance integriert

API-Schlüssel mit Plänen pro Schlüssel, Ratenbegrenzungen, Kontingenten und Budgets, Nutzungsanalysen nach App und Modell sowie inhaltsfreie Audit-Protokolle mit signiertem Export. Die Kontrollen, die die IT erwartet — ohne Cloud-Anbieter dazwischen.

Skaliert mit AI Gateway

Ein Schalter genügt und aus mehreren Servern wird ein einziger Endpunkt: geprüfte Lastverteilung, modellbewusstes Routing, das Rechner mit bereits geladenem Modell bevorzugt, Canary-Rollouts und Upgrades ohne Ausfallzeit.

Läuft überall

Eine Desktop-App für den Rechner unter dem Schreibtisch; Container, Kubernetes-Manifeste und ein Helm-Chart für das Rack oder die Cloud. Gleiches Produkt, gleiche APIs, gleiche Lizenz — vom Laptop bis zur GPU-Farm.

Auf Beobachtbarkeit ausgelegt

Jeder Server bringt sein eigenes Live-Dashboard und native Prometheus-Metriken mit: Flottenzustand, Latenz, Nutzung und Kapazität auf einen Blick — ohne zusätzlichen Monitoring-Stack für den Einstieg.

AI GATEWAY

Von einem Server zur Farm — ohne einen einzigen Client zu ändern

AI Gateway ist AI Server im Farm-Frontend-Modus. Clients verbinden sich damit genau so, als wäre es ein einzelner AI Server; dahinter erledigt ein Pool von Worker-Servern die eigentliche Inferenz. Fügen Sie einen Rechner hinzu und die Kapazität wächst; nehmen Sie einen für die Wartung heraus und der Traffic wird sanft abgeleitet — keine Anfrage geht verloren.

Unter Kubernetes werden Worker beim Skalieren automatisch erkannt, sodass eine autoskalierende Farm keine manuellen Pool-Änderungen braucht. Der gesamte Bestand bleibt über das integrierte Dashboard und Prometheus-Metriken beobachtbar.

Was das Gateway für Sie übernimmt

  • Lastverteilung — Round-Robin, geringste Latenz, wenigste Verbindungen, gewichtet oder pro Client fest.
  • Modellbewusstes Routing — Anfragen gehen an einen Rechner, der das angeforderte Modell bereits geladen hat.
  • Failover — ein ausfallender Worker wird auf einem gesunden erneut versucht, bevor der Client etwas merkt.
  • Canary-Rollouts — senden Sie einen konstanten Teil des Traffics an neue Rechner, bevor Sie ihnen ganz vertrauen.
  • Backpressure — wenn jeder Worker ausgelastet ist, erhalten Aufrufer ein ehrliches "gleich erneut versuchen" statt eines Timeouts.
  • Upgrades ohne Ausfallzeit — einen Worker leeren, aktualisieren und in den Pool zurückgeben.
EDITIONEN & STUFEN

Kostenlos starten. Mitwachsen, wenn Ihr Team wächst.

Die kostenlose Stufe ist ein echtes Produkt, keine Testversion: ein vollständiger lokaler KI-Server für alle AI-Suite-Apps auf Ihrem eigenen Rechner, für immer. Kostenpflichtige Stufen beginnen genau dort, wo der Nutzen Rechnergrenzen überschreitet.

Kostenlos

Ein vollständiger lokaler KI-Server auf Ihrem eigenen Rechner. Unbegrenzte Nutzung durch jede AI-Suite-App auf diesem Rechner; generische OpenAI-kompatible Clients sind ratenbegrenzt.

Pro Personal

Stellen Sie Ihre eigenen Geräte im Netzwerk bereit: LAN-Serving, Betrieb als OS-Dienst, API-Schlüssel für Laptop und Telefon, unbegrenzte generische Clients und ein kleiner Gateway-Pool.

Pro Commercial

Stellen Sie für andere bereit: kommerzielle Nutzung, unbegrenzte API-Schlüssel, vollständige Governance (Kontingente, Budgets, Audit-Signierung) und eine produktive Gateway-Farm mit Canary-Rollouts und automatischer Worker-Erkennung.

Enterprise

Unbegrenzte Bestände, Organisations-Enrollment mit AI Admin Console, Offline- und Air-Gap-Betrieb sowie Priority-Support. Lizenziert pro Bestand — sprechen Sie mit uns.

Pro in unserem Store kaufen → Lizenzierung & Preise Sprechen Sie mit uns über Enterprise

Installieren Sie die App kostenlos über den jeweiligen Marktplatz. Ein direktes Personal- oder Commercial-Abo umfasst einen Produktschlüssel, der auf jeder unterstützten Plattform funktioniert.

EINSATZGEBIETE

Eine private KI-Plattform, mehrere Bereitstellungsmuster

Zentralisieren Sie teure Modelle und Governance, während Teams vertraute Apps und OpenAI-kompatible Werkzeuge behalten.

Büro- und Wissensteams

Teilen Sie freigegebene Chat-, Übersetzungs-, Text-, Dokument-RAG-, Bild- und Sprachmodelle von einem verwalteten Rechner statt je Arbeitsplatz.

Bereitstellungsmuster lesen →

Regulierte und sensible Lasten

Geben Sie Recht, Gesundheit, Finanzen, Behörden und Forschung nützliche KI, während Prompts, Dateien, Modellzugriff und Audit in der gewählten Grenze bleiben.

Bereitstellungsmuster lesen →

Entwickler- und interne API-Plattform

Verbinden Sie OpenAI-kompatible Apps, Agenten und CI-Tests mit einem internen Endpunkt. Plattformteams steuern Modelle und Kapazität ohne Vendor-Key je Projekt.

Bereitstellungsmuster lesen →

Standorte, Failover und GPU-Farmen

AI Gateway vor Workern über Rechner oder Fehlerdomänen ermöglicht zustandsbasiertes Routing, Warmmodell-Affinität, rollende Wartung und Skalierung ohne Clientänderung.

Bereitstellungsmuster lesen →
KLEIN ANFANGEN

Die erste Bereitstellung um einen echten Workflow planen

Belegen Sie Nutzen und Datenschutzgrenze zunächst auf einer Maschine, bevor Sie Benutzer, Richtlinien oder eine Serverfarm hinzufügen.

1. Workload auswählen

Wählen Sie eine klar begrenzte Aufgabe wie privaten Chat, Dokumentfragen, Übersetzung oder Transkription sowie die Personen, die sie bewerten.

2. Hardware abstimmen

Wählen Sie Modell und Maschine für erwarteten Kontext, Antwortzeit und gleichzeitige Benutzer. Zuerst auf CPU validieren und bei Bedarf GPU-Kapazität ergänzen.

3. Grenze testen

Bestätigen Sie erlaubte Clients, Modelle, Protokolle und Netzwerkwege. Prompts und Dateien bleiben innerhalb der gewählten Grenze.

4. Kontrolle mitwachsen lassen

Erweitern Sie auf Netzwerkbereitstellung, API-Schlüssel und Quoten. Registrieren Sie die Umgebung bei Bedarf in AI Admin Console oder fügen Sie AI-Gateway-Worker hinzu.

IN IHRER CLOUD BEREITSTELLEN

Zertifizierte Bereitstellung für Azure und AWS

AI Server ist als kostenlose/BYOL-Kubernetes-Anwendung im Microsoft Marketplace und AWS Marketplace verfügbar. Die Cloud-Infrastruktur rechnet Ihr Anbieter ab; dieselbe AI Server Commercial- oder Enterprise-Lizenz aktiviert Gateway und Worker.

Microsoft Azure

Installieren Sie die zertifizierte Kubernetes-Anwendung in einem vorhandenen AKS-Cluster. Validieren Sie die Bereitstellung zunächst mit einem CPU-Knoten und ergänzen Sie dann NVIDIA-GPU-Worker für reale Inferenzlasten.

Im Microsoft Marketplace finden

Amazon Web Services

Stellen Sie das Helm-Paket aus dem AWS Marketplace auf Amazon EKS bereit. Ein kleiner System-Knotenpool und separate GPU-Worker halten Clusterdienste stabil und machen Inferenzkapazität einfach skalierbar.

Im AWS Marketplace finden
PRIVAT DURCH ARCHITEKTUR

Ihre Prompts verlassen niemals Ihr Netzwerk — weil es kein Ziel dafür gibt

AI Server ist kein Proxy zu einer Cloud-API. Die Modelle laufen auf Ihrer Hardware; Anfragen wandern von Ihren Apps zu Ihrem Server und zurück, innerhalb Ihres Perimeters. Offline- und Air-Gap-Betrieb sind unterstützte Bereitstellungsmodi, keine Sonderfälle.

  • Keine Anbieter-Cloud im Datenpfad. Prompts, Dokumente und generierte Inhalte bleiben zwischen Ihren Clients und Ihrem Server.
  • Inhaltsfreie Aufzeichnungen. Nutzungsanalysen und Audit-Protokolle erfassen, wer wann was aufgerufen hat — nie den Text eines Prompts oder einer Antwort.
  • Lizenzierung, die sicher ausfällt. Sollte unser Lizenzdienst je nicht erreichbar sein, arbeitet Ihre lizenzierte Flotte weiter. Ihre Verfügbarkeit hängt nicht von unserer ab.
  • Ihre Schlüssel, Ihre Regeln. API-Schlüssel werden von Ihnen auf Ihrem Server ausgestellt und widerrufen — keine Konten in fremder Cloud.
Überprüfen Sie die aktuelle Vertrauens- und Kontrollmatrix

Fragen zu AI Server oder AI Gateway?

Für Hilfe bei der Bereitstellung, Dimensionierungsberatung, Kubernetes-Fragen oder Lizenzierung schreiben Sie an [email protected] — oder nutzen Sie das Kontaktformular und wählen "Produkt".

Produkt-Updates abonnieren

Neue kostenlose KI-Produkte, größere Updates und Releases, die nur über diese Seite verfügbar sind. Kein Spam.