HPC- und KI-Systeme für Forschung und Industrie

Rechenleistung aus dem Schwarzwald. Geplant, gebaut, betrieben.

Wir konzipieren GPU-Cluster, HPC-Storage und flüssigkeitsgekühlte Rack-Infrastruktur, liefern sie schlüsselfertig und betreuen sie über die gesamte Laufzeit. Sie haben dabei einen Vertrag und einen Ansprechpartner.

Turnkeyvon der Ausschreibung bis zur Abnahme DLCDirect Liquid Cooling bis ins Rack 60 MonateSupport aus einer Hand
RACK A01 · 48 HE800 × 1400 mm
48Mgmt-Switch 1G
47Leaf 10G · Provisionierung
46InfiniBand NDR 400G Leaf
42GPU-Knoten 8× · DLC
38GPU-Knoten 8× · DLC
34GPU-Knoten 8× · DLC
30GPU-Knoten 8× · DLC
26Reserve
20Cluster Guardian · Mgmt-Knoten
18CPU-Knoten · Pre/Post
4In-Rack-CDU · redundante Pumpen
Manifold UQD06Vorlauf 14–25 °C · ΔT 10 K

Leistungen

Plan, Build, Run

Ein HPC-System ist erst fertig, wenn es unter Volllast stabil läuft. Wir begleiten jedes Projekt in drei Phasen und bleiben danach als Betreuer im Projekt.

Phase 1 · Plan

Strategie & Planung

  • Bedarfsanalyse und Bewertung der vorhandenen Infrastruktur
  • Cloud oder eigener Betrieb: Vergleich mit TCO-Rechnung
  • Architektur, Hardware- und Software-Stack
  • Rack-, Strom- und Kühlkonzept
  • Roadmap für Ausbau und Skalierung
Phase 2 · Build

Implementierung

  • Lieferung, Aufbau und Verkabelung
  • Anschluss an Gebäudekühlung und Stromversorgung
  • Cluster-Setup: Slurm, Provisionierung, Datenmanagement
  • InfiniBand- und Ethernet-Fabric
  • Migration bestehender Workloads
  • Abnahme mit HPL und ML-Benchmarks
Phase 3 · Run

Betrieb & Optimierung

  • Fester Ansprechpartner, Hardware-Service am nächsten Werktag
  • Monitoring, Firmware- und Sicherheitsupdates
  • Engpassanalyse, I/O- und Scheduler-Tuning
  • Energieeffizienz und Lastverteilung
  • Benchmarks und Leistungsberichte

Schwerpunkt

Unterstützung bei öffentlichen Ausschreibungen

Hochschulen und Forschungseinrichtungen beschaffen HPC-Systeme über Vergabeverfahren. Wir kennen beide Seiten: Wir helfen Auftraggebern bei der Leistungsbeschreibung und bieten als Bieter ein vollständiges Paket aus Lieferung, Integration und mehrjährigem Service an.

  1. Analyse der Vergabeunterlagen
  2. Technische Leistungsbeschreibung
  3. Lösungskonzept passend zu den Kriterien
  4. Kosten- und Ressourcenplanung
  5. Nachweise zu Qualität und Compliance
  6. Risiko- und Terminplanung
  7. Verfahren nach VgV, Verträge nach EVB-IT
  8. Marktübersicht und Benchmarks

Ergänzende Leistungen

KI-Entwicklung

Modelle trainieren, optimieren und komprimieren, direkt auf der eigenen HPC-Infrastruktur.

Datenanalyse

Datenpipelines, Vorverarbeitung und Auswertung großer Datenmengen.

Security & Compliance

Schwachstellenanalyse, Zugriffskonzepte, Netzwerksicherheit und Notfallpläne.

Schulung

Einweisung für Betriebsteams sowie Workshops zu HPC, Slurm und Machine Learning.

Systeme

Hardware, konfiguriert für Ihr Projekt

Wir stellen jedes System nach Ihrer Anwendung zusammen und wählen die Hersteller passend zum Projekt. Sie erhalten eine Stückliste und ein verbindliches Angebot. Preise nennen wir auf Anfrage, weil sie von Konfiguration, Stückzahl und Liefertermin abhängen.

Anwendung beschreiben→Konfiguration & Stückliste→Angebot→Lieferung & Aufbau→Service
KlasseSystemEinsatzTypische Merkmale
GPU

GPU-Server

KI-Training, Inferenz, Simulation und Molekülmodellierung.

NVIDIA HGXNVLinkMIGDLC
HPC

HPC-Server

Rechenknoten hoher Dichte für wissenschaftliche Berechnungen.

Dual-SocketMulti-NodeSlurm
ENT

Enterprise-Server

Datenbanken, Virtualisierung und geschäftskritische Anwendungen.

1–2 HEredundante Netzteile
STO

DataFlow-Storage

Vom schnellen NVMe-Flash für GPU-Cluster bis zum Petabyte-Archiv, auch branchenspezifisch.

LustreGPFSNVMe
NET

Interconnect

Netzwerke mit niedriger Latenz, vom Leaf-Switch bis zum Uplink, beschriftet und dokumentiert.

IB NDR 400GXDR 800GRoCEMLAG
SW

Cluster-Software

Scheduler, Provisionierung, Container und Monitoring, eingebunden in Ihre bestehende Umgebung.

SlurmApptainerRHEL
MGT

Cluster Guardian

Eigener Management-Knoten, der Zustand, Auslastung und Auffälligkeiten des gesamten Clusters überwacht.

MonitoringAlarmierung
DLC

Rack & Kühlung

Racks, In-Rack-CDUs, Manifolds und Side Cooler, angeschlossen an das Kühlwasser Ihres Rechenzentrums.

CDUUQD06Smart-PDU

Kühlung wahlweise luftgekühlt, Direct Liquid Cooling (Kühlung direkt am Chip) oder vorbereitet für Immersionskühlung.

Für wen

Unsere Kunden

Wir arbeiten dort, wo Rechenleistung Teil der Forschung oder des Produkts ist.

Hochschulen & Forschung

Cluster-Erweiterungen, Landes- und Bundesrechenzentren, Exzellenzcluster und KI-Zentren, meist über öffentliche Vergabe.

Rechenzentren

Betreiber, die Flächen für GPU-Lasten mit hoher Dichte und Flüssigkeitskühlung vorbereiten.

Industrie & KI-Teams

Unternehmen, die eigene Modelle auf eigener Hardware trainieren und betreiben wollen, ohne dass Daten das Haus verlassen.

Partnernetzwerk

Ein Vertrag. Ein Ansprechpartner.

Öffentliche Ausschreibungen verlangen meist einen Single Point of Contact. Wir übernehmen diese Rolle und stützen uns dabei auf feste Partner für Hardware-Beschaffung und bundesweiten Vor-Ort-Service.

Wissen

Malgukke: unser offenes HPC-Wissensportal

Auf malgukke.com sammeln wir Wissen rund um Hochleistungsrechnen: eine weltweite Karte der Rechenzentren, europäische Kompetenzzentren, ein Fachlexikon und Grundlagen zu KI-Architekturen.

malgukke.com öffnen

Kontakt

System anfragen oder Projekt besprechen

Beschreiben Sie kurz Ihre Anwendung. Wir melden uns innerhalb eines Werktags mit Rückfragen oder einem ersten Konfigurationsvorschlag.

E-Mail
info@blackforestdata.de
Telefon
+49 …
Sitz
Ort, Baden-Württemberg
Optional: Systemwunsch