Private AI API (PAI API)

Programmatischer Zugriff auf in der Schweiz gehostete private LLMs für Anwendungen und Automatisierung.

Produktübersicht


Die PAI-API bietet Ihren Teams programmatischen Zugriff auf in der Schweiz gehostete private LLMs über eine sichere, OpenAI-kompatible Schnittstelle. Sie können KI-Funktionen direkt in Ihre Anwendungen, Automatisierungen und Backend-Systeme einbinden, während Sie die volle Kontrolle darüber behalten, wo Ihre Daten leben und wie sie verarbeitet werden. Alle Modelle laufen in der Schweiz, und es werden keine Kundendaten für Schulungen verwendet.

Mit der PAI-API arbeiten Sie mit einer einzigen, einheitlichen API, während Sie aus einem kuratierten Katalog offener LLMs wie DeepSeek, Llama4-Maverick, Apertus, Mistral und mehr wählen. Dynamisches Routing, konsistente Antwortformate und flexible Konfiguration machen es einfach, souveräne, unternehmensfreundliche KI in jedes Produkt oder jeden Workflow einzubetten – zu transparenten Preisen pro Token.

Eigenschaften


Führen Sie Ihre KI-Workloads auf privat gehosteten Modellen in Schweizer Rechenzentren aus. Alle Eingabeaufforderungen und Ausgaben bleiben in der privaten KI-Umgebung und werden nicht für das Modelltraining verwendet. Dies gibt Ihnen Datensouveränität, regulatorische Ausrichtung und volle Kontrolle darüber, wie sensible Informationen verarbeitet werden.

Integrieren Sie schnell mit vertrauten Endpunkten im OpenAI-Stil. Vorhandener Code, SDKs und Tools, die bereits die OpenAI-API sprechen, können sich normalerweise mit minimalen Änderungen verbinden, was den Integrationsaufwand und die Wertschöpfungszeit drastisch reduziert.

Greifen Sie über dieselbe API auf einen wachsenden Katalog offener LLMs zu, darunter DeepSeek, Llama4-Maverick, Apertus, Mistral und andere. Das dynamische Routing erkennt automatisch den Anbieterstatus und die Kontextbeschränkungen und kann transparent zu alternativen Modellen wechseln, wenn ein primäres Modell langsam oder nicht verfügbar ist – was die Zuverlässigkeit und effektive Betriebszeit erhöht.

Feinabstimmung des Verhaltens auf Anforderungs- oder Modellbasis mit Parametern wie Temperatur, max_tokens und mehr. Wenden Sie detaillierte Budgetkontrollen und Ratenlimits pro Projekt, Team oder Benutzer an, um die Ausgaben vorhersehbar und auf interne Richtlinien abgestimmt zu halten, auch in großem Maßstab.

Alle Antworten folgen einem konsistenten, normalisierten Format mit generiertem Text, der immer bei Auswahlmöglichkeiten, Nachrichten und Inhalten verfügbar ist. Diese Abstraktion schützt Ihre Anwendungen vor anbieterspezifischen Unterschieden und vereinfacht nachgelagertes Parsing, Protokollierung und Analyse – insbesondere, wenn Sie mit mehreren Modellen parallel arbeiten.

Verwenden Sie synchrone oder asynchrone Aufrufe, abhängig von Ihrer Architektur, und aktivieren Sie serverseitiges Streaming, wenn Sie schnellere wahrgenommene Reaktionszeiten in Ihrer Benutzeroberfläche wünschen. Die PAI-API wird pro Million Eingabe- und Ausgabe-Token in Rechnung gestellt, was Ihnen transparente, nutzungsbasierte Preise bietet, die von Prototypen bis hin zu Produktions-Workloads mit hohem Volumen sauber skaliert werden.

Bereit für Private AI API?

In our free briefing, we show you how to use Private AI API productively and securely in the company – without data risks and compliance concerns.

Service-Beschreibung


Die PAI API bietet Ihren Entwicklern und Applikationen direkten, programmatischen Zugriff auf die Private-AI-Modelle von Safe Swiss Cloud, die vollständig auf GPU-Infrastruktur in unseren Schweizer Rechenzentren betrieben werden. Sie ist als Drop-in-Alternative zu öffentlichen KI-APIs konzipiert — vollständig verwaltet, OpenAI-kompatibel und auf denselben Standards aufgebaut, die Ihre bestehenden Tools bereits unterstützen.

Die folgenden Service-Details beschreiben, wie die PAI API bereitgestellt, abgesichert und abgerechnet wird:

  • Abrechnung: Pro Million Eingabe- und Ausgabe-Tokens. (Preisdetails →)
  • Standarddienst: Kunden erhalten einen dedizierten API-Endpunkt und einen Authentifizierungsschlüssel, um ihre Applikationen mit den LLMs zu verbinden.
  • API-Standard: Die API ist OpenAI-kompatibel — der de-facto-Industriestandard — sodass bestehende Libraries, SDKs und Integrationen ohne Anpassungen funktionieren.
  • Vollständig verwaltet: Safe Swiss Cloud betreibt, wartet und aktualisiert den gesamten Dienst von Ende zu Ende.
  • Sicherheit: Der gesamte API-Datenverkehr wird über HTTPS verschlüsselt und kann optional über ein VPN geleitet werden.
  • Keine Inhaltsprotokollierung: Prompts und Modellantworten werden nicht protokolliert. Es werden ausschliesslich Metadaten erfasst — z. B. Zeitpunkt der Anfrage, verwendetes Modell, Dauer bis zur Fertigstellung und Anzahl der Tokens.

LLM-Modelle und Eigenschaften


Wählen Sie aus einem umfangreichen Katalog souveräner LLMs – alle mit denselben strengen Datenschutz- und Compliance-Garantien. Die Private-AI-Dienste (PAI) von Safe Swiss Cloud kombinieren eine breite Auswahl an Open-Source-LLMs mit einer einheitlichen Grundlage für Sicherheit, Datenschutz und Compliance. Sie behalten die vollständige Kontrolle über Daten, Infrastruktur und Modellauswahl, während wir das souveräne Hosting und operative Exzellenz bereitstellen.

Welche LLM-Modelle werden von PAI unterstützt?

SSC stellt Zugang zu den folgenden Open-Source-Large-Language-Models bereit. Diese werden ohne jegliche Gewährleistung zur Verfügung gestellt:

ModellTypDetails
apertus-v1.5-70bChatOptimiert für mehrsprachige Dialoganwendungen.
bge-m3EmbeddingOptimiert für Embeddings und präzises Retrieval mit Unterstützung für Multi-Funktionalität, Mehrsprachigkeit und Multi-Granularität.
bge-rerankerRerankerOptimiert für Reranking zur Ermittlung von Relevanz-Scores.
deepseek-v3.2ChatOptimiert für reasoning-basierte Chat-Completions.
deepseek-v4-flashReasoningOptimiert für reasoning-basierte Chat-Completions.
deepseek-ocrOCROptical Character Recognition- scanning documents and identifying text
gemma-12b-itMultimodalOptimiert für die Verarbeitung von Text- und Bildeingaben sowie die Generierung von Textausgaben.
gemma4-31bMultimodalOptimiert für die Verarbeitung von Text- und Bildeingaben sowie die Generierung von Textausgaben.
glm45-air-110bChat
glm5Coding & Reasoning
gpt-oss-120bChatOptimiert für leistungsstarkes Reasoning, agentische Aufgaben und vielseitige Entwickler-Anwendungsfälle.
granite-3.3-8b-instructChatOptimiert für Reasoning und Instruction-Following.
granite-emb-278mEmbeddingOptimiert für Embeddings.
granite-vision-2bMultimodalOptimiert für ein kompaktes und effizientes Vision-Language-Modell.
llama4-maverickChat und MultimodalOptimiert für Text- und multimodale Anwendungen.
llama4-scout-17bChat und MultimodalOptimiert für Text- und multimodale Anwendungen.
mistral-7B-Instruct-v03Nur ChatOptimiert für mehrsprachige Dialoganwendungen.
miner-u25Vision-LanguageOptimiert für die Dokumentenverarbeitung, die mit hoher rechnerischer Effizienz eine Genauigkeit auf dem neuesten Stand der Technik erreicht.
qwen3-8bReasoningOptimiert für Denken und Reasoning.
qwq-32bReasoningOptimiert für Denken und Reasoning.
qwen3-vl-235bMultimodalOptimiert für Text- und multimodale Anwendungen.
whisper-large-v3Speech to TextZur Umwandlung von Sprache in Text.

Weitere kommerzielle oder proprietäre LLMs können je nach Lizenz- und Infrastrukturanforderungen ebenfalls integriert werden.

Merkmale aller Private-AI-Dienste

Private AI (PAI) umfasst die Bereitstellung souveräner Private-AI-Lösungen durch SSC für seine Kunden. Die folgenden Servicemerkmale gelten für alle PAI-Dienste von Safe Swiss Cloud.

  • Mehrsprachige LLMs ermöglichen den Zugriff auf Wissen aus jeder Sprache, wobei die Ergebnisse in Ihrer eigenen Sprache geliefert werden.
  • Modellauswahl: Wählen Sie aus einem umfangreichen Katalog offener Large Language Models (LLMs), darunter DeepSeek, Llama4-Maverick, Apertus, Mistral und viele mehr.
  • Sovereign AI by Design: Alle LLMs werden privat in der Schweiz gehostet, von Schweizer Unternehmen in Schweizer Eigentum. Ihre Daten bleiben stets unter Ihrer Kontrolle und werden strikt gemäss Schweizer und europäischem Datenschutzrecht verarbeitet.
  • Datenschutz: Ihre Daten werden strikt gemäss dem Schweizer Datenschutzgesetz (DSG) und der EU-DSGVO verarbeitet.
  • Kein Training, Retraining oder Fine-Tuning der LLMs mit Ihren Daten.
  • ISO-Zertifizierungen: 27001, 27017, 27018.
  • Konform mit den Standards C5 und NIS2.
  • 100 % in Schweizer Rechenzentren gehostet, unter Schweizer Kontrolle.

Warum Private AI?


PAI API Preise


Alle Preise sind in CHF / EUR. Die Preise basieren auf der Anzahl (in Millionen) von Eingabe- und Ausgabe-Tokens, die pro Modell und Monat verwendet werden. Über eine OpenAI-API-kompatible Programmierschnittstelle (API) können Entwicklerinnen und Entwickler auf mehr als 25 LLMs zugreifen. 

Es gilt ein Mindestverbrauch von 95 CHF oder EUR 100 (für nicht Schweizer Kunden) pro Monat für den Gesamtverbrauch von Input- und Output-Tokens aller Modelle. Die Preise pro Modell sind wie folgt:

ModellTypPreis in CHF/EUR pro Million
Input-Tokens
Preis in CHF/EUR pro
Million Output-
Tokens
Details
apertus-v1.5-70b Chat 0.7122.553Optimiert für mehrsprachige Dialog-Anwendungsfälle.
bge-m3 Embedding 0.496 Optimiert für Embeddings und Sparse Retrieval mit Unterstützung für Multifunktionalität, Mehrsprachigkeit und unterschiedliche Granularität.
bge-reranker-v2Reranker 0.009Optimiert als Reranker zur Ermittlung von Relevanz-Scores.
deepseek-v4-flashCoding & Reasoning0.1680.451
deepseek-ocrOCR0.4431.770Optimiert für das einlesen von Dokumente
deepseek-v32Chat0.7082.124Deepseek Version 3.2
gemma-12b-it Multimodal 0.3100.496Optimiert für die Verarbeitung von Text- und Bildeingaben sowie die Generierung von Textausgaben.
gemma4-31bMultimodal0.1360.374Optimiert für die Verarbeitung von Text- und Bildeingaben sowie die Generierung von Textausgaben.
glm45-air-110bChat0.4871.938
glm5Coding & Reasoning1.2393.894
gpt-oss-120b Chat 0.1330.531Optimiert für leistungsstarkes Reasoning, agentische Aufgaben und vielseitige Developer-Use-Cases.
granite-33-8b Chat 0.1770.177Optimiert für Reasoning und Instruction-Following-Fähigkeiten.
granite-emb-278m Embedding 0.089Optimiert für Embeddings.
granite-vision-2b Multimodal 0.0890.089Optimiert als kompaktes, effizientes Vision-Language-Modell.
llama4-maverick Chat und Multimodal0.3101.239Optimiert für Text- und Multimodal-Anwendungsfälle.
llama4-scout-17b Chat und Multimodal0.2210.735Optimiert für Text- und Multimodal-Anwendungsfälle.
miner-u25Vision – Language0.4370.265Optimiert für die Dokumentenverarbeitung, die mit hoher rechnerischer Effizienz eine Genauigkeit auf dem neuesten Stand der Technik erreicht.
mistral-7B-Instruct-v03Nur Chat 0.1770.177Optimiert für mehrsprachige Chat-Anwendungen.
qwen3-8b Reasoning 0.0310.122Optimiert für Denken und Logik.
qwq-32b Reasoning 1.0621.062Optimiert für Denken und Logik.
qwen3-vl-235b Multimodal 0.8052.300Optimiert für Text- und Multimodal-Anwendungsfälle.
whisper-large-v3Speech to Text0.007 pro Minuten/aZur Umwandlung von Sprache in Text.

FAQ


Fragen und Antworten zur Private AI von Safe Swiss Cloud

Wie entspricht Safe Swiss Clouds Private AI dem revidierten Schweizer Datenschutzgesetz und anderen anwendbaren Datenschutzgesetzen?

Safe Swiss Clouds Private AI erfüllt vollständig die Anforderungen des revidierten Schweizer Datenschutzgesetzes (CH DSG) sowie der EU-DSGVO.

Wie schützen Sie Kunden vor dem Zugriff nicht-schweizerischer oder ausländischer Regierungen auf ihre Daten?

Das Schweizer Recht schreibt vor, dass Safe Swiss Cloud Kundendaten nur dann an nicht-schweizerische oder ausländische Behörden herausgeben darf, wenn ein entsprechendes Rechtshilfeersuchen eines Schweizer Gerichts nach Schweizer Recht vorliegt. Dies bietet einen robusten rechtlichen Schutz gegen extraterritoriale Datenzugriffsanfragen.

Welche Service-Level und SLAs bieten Sie für GPU-intensive KI-Workloads an?

Safe Swiss Cloud bietet ein SLA mit einer Verfügbarkeit von 99,9 %. Für kostenpflichtige Support-Pakete beträgt die garantierte Reaktionszeit maximal eine Stunde.

Welche Leistungsgarantien bietet Private AI hinsichtlich GPU-Verfügbarkeit, I/O und Speicherdurchsatz?

Wie alle KI-Dienstleister — einschliesslich der grossen internationalen Public-Cloud-Anbieter — garantiert Safe Swiss Cloud keine bestimmten Leistungsniveaus für KI-Workloads. Ein grosser Pool an Hochleistungs-GPUs sowie ein dynamisches Kapazitätsmanagement sorgen jedoch unter normalen Betriebsbedingungen für eine zuverlässig gute Performance.

Welche Support-Optionen stehen zur Verfügung?

Safe Swiss Cloud bietet kostenpflichtige Support-Pakete mit 24/7-Abdeckung an. Weitere Informationen finden Sie auf unserer Seite zu den Support-Services.

Welche Services bietet Safe Swiss Cloud für die Integration von Unternehmensdaten in KI an?

Wir bieten Services zur Entwicklung von MCP-Servern (Model Context Protocol) an, um KI-Systeme mit Unternehmensdatenquellen und -prozessen zu verbinden.

Wie einfach ist es, unsere Modelle, Daten und Prompts von Safe Swiss Cloud zu einem anderen Anbieter zu migrieren?

Wir verwenden Open-Source-Modelle, die über die branchenübliche OpenAI API zugänglich sind. Dies ermöglicht Kunden, Modelle und Anbieter bei Bedarf zu wechseln, ohne an proprietäre Formate oder Schnittstellen gebunden zu sein.

Welche offenen Formate, APIs oder Schnittstellen unterstützen Sie, um Vendor-Lock-in zu minimieren?

Large Language Models are accessed via the industry-standard OpenAI API. Interfaces to enterprise data are based on the Model Context Protocol (MCP) standard. Together, these ensure a very high degree of interoperability between systems, making it straightforward to switch models or providers.

Entwickelt Safe Swiss Cloud auch unsere Anwendung?

Nein. Safe Swiss Cloud stellt die Plattform bereit, auf der Ihre Anwendung läuft. Entwicklung und Betrieb der Anwendung selbst liegen bei Ihrem Team oder Ihrem Umsetzungspartner.

Für die Anbindung Ihrer Datenquellen an das Sprachmodell bieten wir Integrationsleistungen an, etwa die Entwicklung von MCP-Servern.

Wie aufwendig ist die Migration einer bestehenden Anwendung?

Wenn Ihre Anwendung bereits gegen die OpenAI-API arbeitet, genügt in der Regel ein Wechsel von Endpunkt und Schlüssel.

Für die Infrastrukturebene richtet sich der Aufwand nach Ihrer bisherigen Umgebung. Containerisierte Anwendungen lassen sich meist ohne Anpassung übernehmen.

Wie hoch ist die Latenz gegenüber einem US-Anbieter?

Die Modelle laufen in Schweizer Rechenzentren, was bei Nutzern in der Schweiz und Europa kurze Netzwerkwege bedeutet. Serverseitiges Streaming steht zur Verfügung, um die wahrgenommene Antwortzeit in Ihrer Oberfläche zu verkürzen.

Wie vermeiden wir Vendor-Lock-in?

Die Anbindung erfolgt über eine OpenAI-kompatible Schnittstelle und über den offenen MCP-Standard. Es kommen ausschliesslich offene Modelle zum Einsatz.

Ein Wechsel zu einem anderen Anbieter ist damit ohne Umbau proprietärer Schnittstellen möglich.

Werden unsere Daten für das Training verwendet?

Nein. Weder Prompts noch Antworten noch hochgeladene Dokumente fliessen in Training, Retraining oder Fine-Tuning ein.

Sind unsere Workloads von denen anderer Kunden getrennt?

Ja. Jeder Kunde erhält ein eigenes, dediziertes RAG-System. Prompts sind vollständig voneinander isoliert und haben keine kundenübergreifenden Auswirkungen.

Auf Wunsch stehen dedizierte GPU- und Storage-Cluster ohne weitere Mandanten zur Verfügung.

Eignet sich die Plattform für regulierte Daten?

Ja. Die technischen Schutzmassnahmen und der rechtliche Rahmen nach Schweizer DSG und EU-DSGVO decken die Verarbeitung regulierter Daten ab, einschliesslich Gesundheits- und Finanzdaten.

Safe Swiss Cloud ist nach ISO 27001, 27017 und 27018 zertifiziert und erfüllt die Anforderungen von Branchenstandards wie FINMA, BaFin, HIPAA, FMH, C5 und NIS2.

Welche Verfügbarkeit ist zugesichert?

Das SLA sieht eine Verfügbarkeit von 99,9 Prozent vor. Bei kostenpflichtigen Support-Paketen beträgt die garantierte Reaktionszeit maximal eine Stunde.

Wo werden die Daten gespeichert und verarbeitet?

Ausschliesslich in der Schweiz. Das gilt für Infrastruktur, Storage und Sprachmodelle gleichermassen.

Als vollständig in der Schweiz ansässige IT-Gruppe kann Safe Swiss Cloud nicht nach US-Recht zur Offenlegung von Kundendaten gezwungen werden.

Können wir dedizierte GPUs erhalten?

Ja. Diese Option ist kostenintensiver und eignet sich für Kunden mit ausreichendem Lastvolumen oder besonders strengen Compliance-Anforderungen.