Member of Inception Program

Schweizer FlaggeSwiss Engineering Server S2: Enterprise-KI für Ihr ganzes Team

Unser meistgewählter Server: 2x NVIDIA RTX PRO 6000 Blackwell mit 192 GB VRAM, vorinstallierter onprem.ai Software und den neuesten LLM-Modellen. Einzeln einsetzbar, als Cluster skalierbar.

Ein Server, der ein ganzes Team versorgt

Konzipiert für Teams in regulierten Branchen wie Recht, Finanzen und Gesundheit. Alle Daten werden ausschliesslich on premises verarbeitet, auf Wunsch vollständig air-gapped. Dank OpenAI-kompatibler APIs ersetzt der S2 Cloud-KI-Dienste ohne Codeänderungen.

onprem.ai Server S2
GPUs
2x NVIDIA RTX PRO 6000 Blackwell
VRAM
192 GB @ 1.8 TB/s
KI-Leistung
8000 AI TOPS
Leistungsaufnahme
~1.8 kW max
Formfaktor
4U Rack
Nutzer
5 - 20 gleichzeitig

Gebaut für Geschwindigkeit

Ein einzelner S2 betreibt DeepSeek v4 flash mit vollem 1M-Kontext und bedient damit ein ganzes Team gleichzeitig. Die wichtigsten Messwerte:

1'300 Tokens/s

Textgenerierung bei parallelen Anfragen, 200 Tokens/s im Einzelbetrieb

10'000 Tokens/s

Verarbeitung von Eingaben bei parallelen Anfragen

1M Tokens

Kontextfenster, mit 1,4M Tokens KV-Cache

44 Nutzer:innen

Gleichzeitig im Office-Einsatz, plus 10 parallele Coding-Agenten

60'000 Seiten/h

Dokumentenklassifikation im Dauerbetrieb

3,4 Mrd. Tokens/Monat

Generierte Tokens, dazu 26 Mrd. verarbeitete Eingabe-Tokens

Vorläufige Messwerte mit DeepSeek v4 flash auf dem Server S2, Stand August 2026. Verifizierung läuft.

Weitere Konfigurationen

Alle Konfigurationen laufen mit derselben Software und lassen sich einzeln betreiben oder zu einem Cluster verbinden. Erweitern Sie die Kapazität, sobald Ihr Bedarf wächst.