
Mit Privatemode erhalten Sie Datenschutz auf On-Prem-Niveau, kombiniert mit dem Komfort und der Flexibilität der Cloud.
Überblick
Privatemode stellt führende Open-Weight-Modelle über einen sicheren Endpunkt bereit. So wählen Sie für jeden Workload das passende Modell, ohne sensible Daten offenzulegen.
Die Inference API läuft auf moderner GPU-Infrastruktur. So erhalten Sie geringe Latenzen und hohen Token-Durchsatz, auch unter Last. Agents und nutzernahe Anwendungen reagieren schnell, ohne dass Sie eigene GPU-Cluster betreiben müssen.
Privatemode ist mit der OpenAI- und Anthropic-API kompatibel, einschließlich bestehender SDKs und Client-Bibliotheken. Binden Sie das Privatemode SDK direkt in Ihre JavaScript- oder TypeScript-Anwendung ein, oder starten Sie für jeden anderen Stack den Encryption Proxy und richten Ihren Client darauf aus. Ihr bestehender Code bleibt, wie er ist, und der gesamte Verkehr ist durchgehend geschützt.
Planbare nutzungsbasierte Preise ohne versteckte Kosten, von der Free Tier bis zur Produktion. Enterprise-Tarife mit individuellen Rate Limits sind auf Anfrage verfügbar.
Privatemode kombiniert Ende-zu-Ende-Verschlüsselung mit Confidential Computing und nachprüfbarer Attestation. So können Sie prüfen, in welcher Umgebung Ihre Daten verarbeitet werden und welcher Code dort läuft. Unser Überblick zur Sicherheitsarchitektur macht nachvollziehbar, wie Schlüsselverwaltung und Attestation Ihre Daten vor externen Angriffen und Zugriff durch Insider schützen.

Vorteile
Vertrauliche Inference API
Nutzen Sie bestehende OpenAI- oder Anthropic-Clients weiter. In JavaScript und TypeScript binden Sie das Privatemode SDK direkt in Ihre Anwendung ein; für jeden anderen Stack starten Sie den Privatemode Encryption Proxy und richten Ihren Client darauf aus. In beiden Fällen sprechen Ihre Anwendungen eine vertraute API, während Prompts verschlüsselt und Antworten entschlüsselt werden.
Prompts werden verschlüsselt, bevor sie Ihre Infrastruktur verlassen, Antworten kommen verschlüsselt zurück. Klartext wird nur innerhalb der Confidential-Computing-Umgebung von Privatemode verarbeitet, niemals durch Betreiber oder Cloud-Anbieter.
Privatemode nutzt hardwaregestütztes Confidential Computing, damit Daten auch während der Verarbeitung durch CPU und GPU geschützt bleiben. Remote Attestation prüft Laufzeitumgebung und Modelle, bevor eine Anfrage entschlüsselt wird. So sieht nur freigegebener Code jemals Klartext.
So legen Sie los
SDK oder Proxy
Für JavaScript- und TypeScript-Anwendungen müssen Sie nichts betreiben. Das SDK bringt den Code für die Remote Attestation als WebAssembly-Modul mit. Ihre Anwendung prüft das Privatemode-Deployment also selbst und baut den verschlüsselten Kanal auf, bevor die erste Anfrage rausgeht.
Das SDK stellt die Schnittstelle des offiziellen OpenAI-Clients bereit, inklusive Streaming. Ihr Code bleibt also größtenteils unverändert. Unterstützt werden Chat Completions, Embeddings und Audio-Transkriptionen – im Browser wie in jeder JavaScript-Runtime mit ES-Modulen.
Registrieren Sie sich kostenlos und erhalten Sie sofort Ihren API-Schlüssel. Die meisten OpenAI- und Anthropic-kompatiblen Tools lassen sich direkt weiterverwenden.
KI auf Cloud-Niveau mit Ende-zu-Ende-Verschlüsselung und Confidential Computing. Für Branchen, in denen Compliance Pflicht ist.
Leistungsstarke KI, aber Prompts und Daten werden im Klartext auf der Infrastruktur von OpenAI verarbeitet, ohne technisch nachweisbare Datenschutzgarantien.
Volle Datenkontrolle. Erfordert aber eigene Hardware, MLOps im Haus und laufende Wartung.

Technische Details
Erstellen Sie einen API-Schlüssel im Portal und wählen Sie dann Ihren Weg. In JavaScript oder TypeScript installieren Sie das SDK mit `npm i privatemode-ai` und nutzen es wie den OpenAI-Client – siehe SDK-Referenz. In jeder anderen Sprache starten Sie den Privatemode Proxy mit Ihrem API-Schlüssel und senden Anfragen an `localhost:8080` – siehe API-Quickstart. Die Einrichtung dauert in beiden Fällen etwa 10 Minuten.
