Welche GPU passt in welchen Server?
Entscheidend sind vier Dinge: die Slotbreite der Karte, ihre Leistungsaufnahme im Verhältnis zur Netzteilstufe des Gehäuses, das Kühlkonzept und die Freigabeliste des Serverherstellers. Die meisten Rechenzentrums-GPUs sind dual-slot und passiv gekühlt, brauchen also den Luftstrom der Gehäuselüfter. GIGABYTE weist für 132 Barebones der Kategorie GPU-Server aus, welche der 39 Beschleuniger-Typen darin qualifiziert sind - zum Beispiel die NVIDIA L40S in 42 Modellen, die H200 NVL in 17 und die RTX PRO 6000 Blackwell Server Edition in 16. Im Kompatibilitäts-Finder auf dieser Seite lässt sich beides gegeneinander prüfen: Karte auswählen und passende Plattformen sehen - oder Modellnummer eingeben und die freigegebenen Karten sehen. Wichtig dabei: Freigegeben heißt nicht automatisch in voller Stückzahl. Wo GIGABYTE für eine bestimmte Karte eine eigene Höchstzahl, eine Temperaturgrenze oder eine NVLink-Anordnung nennt, steht diese Angabe direkt an der jeweiligen Plattform. Nelpx prüft die Kombination kostenlos und bestätigt sie verbindlich im Angebot.
Wie viele GPUs passen in einen 2-HE- oder 4-HE-Server?
Das hängt an der Slotbreite der Karte. Mit dual-slot-Karten nehmen 2-HE-Plattformen üblicherweise zwei bis vier Karten auf - GPU-dichte 2-HE-Modelle wie die G293- und G294-Reihe schaffen acht. In 4 Höheneinheiten sind acht dual-slot-Karten üblich, mit zusätzlichen PCIe-Switches zehn. Mit Single-Slot-Karten wie NVIDIA L4 oder RTX PRO 4500 Blackwell Server Edition steigt die Dichte auf bis zu 16 Karten in 2 HE. Achtung beim Lesen von Datenblättern: Eine Angabe wie „bis 16 GPUs“ bezieht sich immer auf eine bestimmte Slotbreite - mit breiteren Karten sinkt die Zahl entsprechend. Die Obergrenze setzen ohnehin nicht nur die Steckplätze, sondern auch Netzteilstufe und Abwärme.
Kann ich eine Gaming-Grafikkarte wie die RTX 4090 in einen Rack-Server einbauen?
In einen 19-Zoll-Rack-Server in der Regel nicht. Consumer-Karten haben eigene Axiallüfter und sind auf offene Gehäuse mit niedrigem Gegendruck ausgelegt, während Rack-Barebones den Luftstrom mit hohem Druck von vorn nach hinten durch passive Kühlkörper drücken. Dazu kommen Baulänge, Stromanschlüsse und fehlende Freigaben. GIGABYTE führt die GeForce RTX 4090 ausschließlich für Tower- und Workstation-Plattformen der W-Serie. Wer Consumer-Hardware im Rack betreiben will, sollte stattdessen zu einer passiv gekühlten Server-Edition greifen - wir nennen im Beratungsgespräch die jeweils nächstgelegene Alternative.
Was ist der Unterschied zwischen HGX und PCIe-GPUs?
PCIe-GPUs sind Steckkarten: einzeln beschaffbar, tauschbar, später erweiterbar, gekoppelt über PCIe und - je nach Modell - über NVLink-Brücken in Zweier- oder Vierergruppen. HGX-Systeme wie HGX B200, HGX B300 oder HGX H200 sind dagegen Baseboards mit acht fest montierten SXM-Modulen, die über NVLink-Switches zu einem gemeinsamen Speicherpool verbunden sind. Das bringt die höchste Trainings- und Inferenzleistung pro Rackplatz, legt die Bestückung aber beim Kauf fest: Nachrüsten oder Tauschen einzelner GPUs ist nicht vorgesehen. Wer flexibel bleiben oder mit weniger Karten starten will, fährt mit PCIe besser. Details und Systeme: HGX B200, HGX B300 und HGX H200.
Hat die RTX PRO 6000 Blackwell Server Edition NVLink?
Nein. Die RTX PRO 6000 Blackwell Server Edition hat keinen NVLink-Anschluss; mehrere Karten kommunizieren ausschließlich über PCIe Gen5. Für Inferenz und für Modelle, die in die 96 GB GDDR7 einer einzelnen Karte passen, ist das unkritisch. Wer dagegen ein großes Modell über mehrere Karten verteilen und dabei hohe Bandbreite zwischen den GPUs braucht, sollte NVLink-fähige Karten wie die H200 NVL oder gleich ein HGX-System prüfen. Zur Karte: RTX PRO 6000 Server Edition.
H200 NVL oder RTX PRO 6000 Server Edition - welche Karte passt besser?
Die H200 NVL bietet 141 GB HBM3e mit deutlich höherer Speicherbandbreite und lässt sich über NVLink-Brücken zu Zweier- oder Vierergruppen koppeln - die richtige Wahl für Training und für große Modelle, die über mehrere GPUs verteilt werden. Die RTX PRO 6000 Blackwell Server Edition hat 96 GB GDDR7, kein NVLink, dafür starke Leistung bei Inferenz, Rendering und Visual Computing sowie einen niedrigeren Einstiegspreis. Beide sind dual-slot und passiv gekühlt und laufen in vergleichbaren Plattformen. Faustregel: Trainingslast und Modellparallelität sprechen für die H200 NVL, Inferenz- und Grafiklast für die RTX PRO 6000 SE. Seiten dazu: H200 NVL und RTX PRO 6000 SE.
Was ist ein Barebone-Server?
Ein Barebone ist ein Servergrundsystem: Gehäuse, Mainboard, Netzteile, Lüfter und Backplane sind bereits aufeinander abgestimmt, während Prozessoren, Speicher, Datenträger und GPUs frei bestückt werden. Bei GPU-Servern ist genau das der Punkt, an dem Kompatibilität entschieden wird: Das Barebone gibt vor, wie viele Karten welcher Bauform hineinpassen, wie viel Leistung die Netzteile liefern und ob luft- oder flüssiggekühlt wird. Deshalb prüft man die Wunsch-GPU immer gegen die Freigabeliste des konkreten Barebone-Modells, nicht gegen die Serie.
Kann ich vorhandene GPUs in ein neues Barebone übernehmen?
Oft ja - vorausgesetzt, die Karte steht in der Freigabeliste des neuen Barebones, ist passiv gekühlt und die Netzteilstufe trägt die Summe aus GPU-, CPU- und Lüfterlast. Häufige Stolpersteine sind ältere Karten mit 8-Pin-Stromanschluss in Plattformen, die auf 12V-2x6 ausgelegt sind, sowie GPUs, die im neuen Gehäuse zwar mechanisch passen, aber thermisch nicht mehr vorgesehen sind. Schicken Sie uns Modellbezeichnung und Stückzahl Ihrer vorhandenen Karten - wir gleichen sie gegen die Freigaben ab und sagen Ihnen, welche Plattform sie aufnimmt. Die Prüfung ist kostenlos.
Woran erkenne ich, ob eine GPU für Rack-Server geeignet ist?
Am Kühlkörper ohne eigenen Lüfter. Server-Ausführungen tragen meist einen geschlossenen Passivkühler und im Namen einen Zusatz wie Server Edition oder - bei AMD - ein angehängtes S (Radeon AI PRO R9700S). Aktiv gekühlte Karten mit sichtbaren Lüftern oder Blower-Rad gehören in Tower- und Workstation-Gehäuse. Vorsicht bei Vergleichsportalen: Dort werden Server- und Workstation-Ausführungen derselben Baureihe regelmäßig vermischt, samt falscher Angaben zu Lüftern, Displayausgängen und Leistungsaufnahme. Maßgeblich ist das Datenblatt zur konkreten Teilenummer.
Wie viel Strom braucht ein GPU-Server mit acht Karten?
Rechnen Sie zuerst die GPU-Last: acht Karten zu je 600 W ergeben 4,8 kW, acht L40S mit 350 W immerhin 2,8 kW. Dazu kommen zwei Prozessoren, Arbeitsspeicher, Datenträger und Lüfter. Systeme dieser Klasse arbeiten deshalb mit vier Netzteilen der 3.000-W-Klasse in Redundanz und brauchen entsprechend ausgelegte Zuleitungen und Kühlung im Rack. Für die Planung im Rechenzentrum rechnen wir Anschlussleistung und Abwärme pro Rack mit durch - das gehört zur Kompatibilitätsprüfung dazu.
Passen wirklich so viele GPUs hinein, wie im Datenblatt steht?
Nicht in jedem Fall - und das ist der häufigste Irrtum. Die Zahl im Datenblatt gilt für eine bestimmte Slotbreite und oft nur bei 25 °C Umgebungstemperatur. Für einzelne Karten nennt GIGABYTE zusätzlich eigene Höchstzahlen, die unter dem Plattform-Maximum liegen. Ein Beispiel: Das 2-HE-Modell G294-A22-AAP2 wird mit bis zu 8 GPUs geführt, für die NVIDIA H200 NVL nennt der Hersteller aber 4 Karten bei 25 °C, angeordnet als zwei Zweiergruppen mit je einer 2-Wege-NVLink-Brücke. Bei den 4-HE-Modellen der G494-Reihe gilt die volle Bestückung mit 600-W-Karten nur mit optionalem Lüfter-Kit. Wir haben diese Herstellerangaben für alle 132 Plattformen ausgewertet und zeigen sie im Finder an der jeweiligen Karte an - damit die Zahl im Angebot der Zahl entspricht, die das System wirklich trägt.
Kann ich verschiedene GPU-Modelle im selben Server mischen?
In aller Regel nein. GIGABYTE validiert die meisten GPU-Plattformen ausdrücklich nur mit einem einheitlichen GPU-Modell. Vier L40S und vier H200 NVL im selben Gehäuse sind deshalb keine freigegebene Konfiguration, auch wenn beide Karten einzeln in der Freigabeliste stehen. Der Grund liegt in Kühlung, Stromverteilung und PCIe-Topologie, die auf ein Lastprofil ausgelegt sind. Wer unterschiedliche Kartentypen braucht, verteilt sie auf mehrere Systeme - wir planen das mit.
Wo kaufe ich einen passenden GPU-Server?
Bei Nelpx. Wir sind offizieller GIGABYTE-Partner und liefern GPU-Server, Barebones und Beschleunigerkarten EU-weit aus dem autorisierten Kanal - vom einzelnen 2-HE-System bis zur Rack-Integration. Sagen Sie uns Karte, Stückzahl und Einsatzumgebung; wir prüfen die Kombination gegen die Herstellerfreigaben, schlagen die passende Plattform samt Netzteil- und Kühlvariante vor und legen ein Angebot bei. Fertig konfigurierbare Systeme finden Sie außerdem im GPU-Server-Konfigurator und im RTX-PRO-6000-Server-Konfigurator.
Prüft Nelpx auch Plattformen anderer Hersteller?
Ja. Die Tabelle auf dieser Seite basiert auf den Freigaben von GIGABYTE, weil wir dort im direkten Herstellerkanal arbeiten und die Datenlage vollständig ist. Die Prüfung selbst ist herstellerunabhängig: Nennen Sie uns Ihr vorhandenes System - etwa von Supermicro, ASUS, Dell oder HPE - samt gewünschter Karte, und wir sagen Ihnen, ob die Kombination trägt und welche Voraussetzungen dafür gelten. Für die Beschaffung schlagen wir dann die Plattform vor, die wir belastbar liefern können.