Member of Inception Program

Schweizer FlaggeSwiss Engineering Server S2: Enterprise-KI für Ihr ganzes Team

Unser meistgewählter Server: 2x NVIDIA RTX PRO 6000 Blackwell mit 192 GB VRAM, vorinstallierter onprem.ai Software und den neuesten LLM-Modellen. Einzeln einsetzbar, als Cluster skalierbar.

Ein Server, der ein ganzes Team versorgt

Konzipiert für Teams in regulierten Branchen wie Recht, Finanzen und Gesundheit. Alle Daten werden ausschliesslich on premises verarbeitet, auf Wunsch vollständig air-gapped. Dank OpenAI-kompatibler APIs ersetzt der S2 Cloud-KI-Dienste ohne Codeänderungen.

onprem.ai Server S2
GPUs
2x NVIDIA RTX PRO 6000 Blackwell
VRAM
192 GB @ 1.8 TB/s
KI-Leistung
8000 AI TOPS
Leistungsaufnahme
~1.8 kW max
Formfaktor
4U Rack
Nutzer
5 - 20 gleichzeitig

Gebaut für Geschwindigkeit

Ein einzelner S2 betreibt DeepSeek v4 flash mit vollem 1M-Kontext und bedient damit ein ganzes Team gleichzeitig. Die wichtigsten Messwerte:

1'300 Tokens/s

Textgenerierung bei parallelen Anfragen, 200 Tokens/s im Einzelbetrieb

10'000 Tokens/s

Verarbeitung von Eingaben bei parallelen Anfragen

1M Tokens

Kontextfenster, mit 1,4M Tokens KV-Cache

44 Nutzer:innen

Gleichzeitig im Office-Einsatz, plus 10 parallele Coding-Agenten

60'000 Seiten/h

Dokumentenklassifikation im Dauerbetrieb

3,4 Mrd. Tokens/Monat

Generierte Tokens, dazu 26 Mrd. verarbeitete Eingabe-Tokens

Vorläufige Messwerte mit DeepSeek v4 flash auf dem Server S2, Stand August 2026. Verifizierung läuft.

Weitere Konfigurationen

Alle Konfigurationen laufen mit derselben Software und lassen sich einzeln betreiben oder zu einem Cluster verbinden. Erweitern Sie die Kapazität, sobald Ihr Bedarf wächst.

S1
S1 Einsteiger
  • 1x Blackwell GPU
  • Nvidia RTX6000WS
  • 96 GB VRAM @ 1.8 TB/s
  • 4000 AI TOPS
  • ~1 KW max

Der kompakte Einstieg: eine RTX PRO 6000 Blackwell im 2U-Chassis, ideal für erste produktive Anwendungen und Pilotprojekte.

DC4
DC4 Business
  • 4x Blackwell GPU
  • Nvidia RTX6000S
  • 384 GB VRAM @ 1.6 TB/s
  • 16000 AI TOPS
  • ~3 KW max

Vier GPUs in einem System für Abteilungen mit mehreren parallelen Workloads, von RAG über OCR bis zu Coding-Agenten.

DC8
DC8 Enterprise
  • 8x Blackwell GPU
  • Nvidia MGX RTX6000S
  • 768 GB VRAM @ 1.6 TB/s
  • 32000 AI TOPS
  • ~5.4 KW max

Acht GPUs für den unternehmensweiten Einsatz: grosse Modelle, hohe Parallelität und Reserven für neue Anwendungsfälle.

DGX B200
DGX B200 Datacenter
  • 8x Blackwell GPU
  • Nvidia DGX B200
  • 1440 GB VRAM @ 8 TB/s
  • 144000 AI TOPS
  • ~14.3 KW max

NVIDIAs Referenzsystem für das Rechenzentrum: acht B200-GPUs mit NVLink, für Training, Fine-Tuning und die Inferenz der grössten Modelle.

Dell PowerEdge R7715
Dell PowerEdge R7715 Chassis
  • 2U Rack
  • Bis 3 GPUs
  • 2-GPU-Konfiguration: Server S2

Das kompakte 2U-Chassis hinter S1 und S2: mit einer oder zwei RTX PRO 6000 Blackwell bestückt und leise genug für den Betrieb in vorhandenen Serverräumen.

Dell PowerEdge XE7745
Dell PowerEdge XE7745 Chassis
  • 4U Rack
  • Bis 8 GPUs
  • 8-GPU-Konfiguration: DC8

Das grosse 4U-Chassis hinter DC4 und DC8: bis acht GPUs pro System, ausgelegt auf hohe Dichte im Rechenzentrum und den Ausbau zum KI-Cluster.