Zum Inhalt springen

Produkte

KI-Cluster (3+ Geräte) · KI-generierte Illustration der Geräteklasse. Kein Herstellerfoto und kein bestimmtes Modell. Das gelieferte Gerät kann in Gehäuse, Hersteller und Ausstattung abweichen.
KI-generierte Illustration der Geräteklasse. Kein Herstellerfoto und kein bestimmtes Modell. Das gelieferte Gerät kann in Gehäuse, Hersteller und Ausstattung abweichen.

KI-Cluster (3+ Geräte)

HardwareGPUvLLM

Überblick

Ab drei kompakten KI-Workstations: ein lokaler Cluster für große Open-Weights-Modelle und mehrere parallele Nutzer. Die Kapazität bleibt in Ihrem Haus, die Kosten sind vor allem Hardware und Energie.

Wir beschaffen und richten Systeme dieser Geräteklasse ein. Beispiele sind NVIDIA DGX Spark, ASUS Ascent GX10 und vergleichbare kompakte Plattformen. Die konkrete Hardware wählen wir gemeinsam anhand Last, Modellgröße, Lieferzeit und Verfügbarkeit; wir sind nicht an einen Hersteller gebunden.

Die Skalierung erfolgt typisch über eine schnelle Direktverbindung (RoCE, je nach Modell bis 200 GBit) – per Direktkabel, Switch oder Mesh. Die konkrete Topologie legen wir im Anforderungsworkshop anhand Knotenzahl, Modellgröße und Herstellervorgaben fest.

Die Abbildung ist eine KI-generierte Illustration. Sie zeigt nicht das gelieferte Gerät und ist kein Foto der genannten Herstellerprodukte.

Für wen

  • Teams und Abteilungen mit hoher paralleler Last
  • Use-Cases, die sehr große Open-Weights-Modelle lokal brauchen

Kleiner Einstieg: einzelnes Gerät oder Dual-Setup. Architekturklärung vorab über die Beratung.

Typische Nutzung

  • Gemeinsame Inferenz-Plattform für mehrere Teams
  • Große Modelle und anspruchsvolle Agent-/Batch-Workloads
  • Optional: autorisierte Security- und Red-Team-Workloads auf eigener Hardware

Leistungsumfang

  • Beschaffung und Lieferung
  • Netzwerkkonfiguration der schnellen Direktverbindung (typisch RoCE, je nach Plattform bis 200 GBit)
  • Einrichtung der Verbindungstopologie; Switch oder Mesh legen wir im Anforderungsworkshop anhand Knotenzahl, Modellgröße und Herstellervorgaben fest
  • Installation und Konfiguration (vLLM sowie Coding-/KI-Assistent)
  • Integration in Ihre bestehende IT- und Netzwerk-Infrastruktur
  • Dokumentation und Einweisung

Ablauf

  1. Anforderungsworkshop und Lastabschätzung
  2. Empfehlung und Angebot
  3. Beschaffung und Einrichtung
  4. Abnahme und Schulung

Plattform und Marken

NVIDIA, DGX, Spark, GB10, ASUS, Ascent und GX10 sind Marken der jeweiligen Inhaber. Wir verwenden sie nur beschreibend, um die Geräteklasse zu benennen. Quantenland AI GmbH ist unabhängig: wir sind weder Hersteller dieser Geräte noch lizenzierter Partner, autorisierter Händler oder Repräsentant der Markeninhaber. Siehe auch Impressum, Abschnitt Marken Dritter.

Preise

Auf Anfrage – abhängig von Knotenzahl, gewählter Plattform, Netzwerk und Lieferzeit.

Wir beschaffen die Geräte im Handel und erbringen Einrichtung, Integration und Support als eigenständige Leistung.