Member of Inception Program

Kann ich klein starten und später skalieren?

Ja, Sie können klein starten und bei Bedarf skalieren. Unsere Konfigurationen sind als modulare Bausteine konzipiert: vom Einstieg mit dem Server S1 bis zum KI-Rechenzentrum.

Unsere Konfigurationen

  • S1: Der Einstieg für kleine Teams
  • S2: Enterprise-KI für Ihr ganzes Team (2x NVIDIA RTX PRO 6000 Blackwell, 192 GB VRAM)
  • DC4 und DC8: Rechenzentrums-Konfigurationen für hohe Last und viele Nutzer

Die Kapazität wächst in 2-GPU-Schritten. Jede Konfiguration kann einzeln betrieben oder mit weiteren ergänzt werden, ohne Umstellung Ihrer Anwendungen. Details finden Sie auf der Server-Seite.

Die Software macht Skalierung einfach

Die onprem.ai Software, das Betriebssystem für Enterprise-KI im eigenen Rechenzentrum, verwaltet alle Server zentral:

  • Mehrere Server einbinden: Konfigurationen lassen sich einfach kombinieren
  • Load Balancing: Last wird automatisch verteilt
  • Zentrale Verwaltung: alle Systeme über eine Oberfläche steuern
  • Keine Datenmigration: neue Server werden ergänzt, bestehende Integrationen bleiben unverändert

Skalierungsszenarien

Beispiel 1: Start mit S1 für ein Pilotprojekt, später Erweiterung auf S2 für das gesamte Team

Beispiel 2: Zwei Standorte mit unterschiedlichem Bedarf: je ein eigener Server, gemeinsam zentral verwaltet

Beispiel 3: Engineering-Team mit hohem Token-Verbrauch: direkt S2 oder eine DC-Konfiguration

Welche Konfiguration zu Ihrem Team passt, zeigt Ihnen der Kostenrechner: Er ermittelt den GPU-Bedarf aus Teamgrösse und Nutzung.

Nächste Schritte


Quellen und weiterführende Informationen: