NVIDIA L40S kaufen - die Universal-GPU für GenAI & Grafik
Die Ada-Lovelace-GPU mit 48 GB GDDR6 (ECC) - GenAI-Inferenz, Rendering, Video und VDI auf einer Karte. Passiv gekühlt für PCIe-Server, 350 W, typisch bis 8 Karten pro System. Nelpx liefert die Original-PNY-Karte ab Lager - einzeln, im Multi-GPU-Verbund oder mit passendem Server. Angebot in 48 h.
IT-Systemhaus für HPC & AI-Infrastruktur · Lieferung EU-weit · Tagesaktuelle Preise & Verfügbarkeit
Was kostet die NVIDIA L40S?
Die NVIDIA L40S (48 GB GDDR6 mit ECC, PNY-Artikelnummer TCSL40SPCIE-PB) kostet bei Nelpx ab 7.600 € zzgl. MwSt. pro Karte - auf Lager und kurzfristig lieferbar; der Endpreis hängt von Stückzahl und tagesaktueller Marktlage ab. Sie ist die Universal-GPU der Ada-Lovelace-Generation: stark in GenAI-Inferenz bis zur 30B-Modellklasse (FP8: 1.466 TFLOPS sparse) und zugleich vollwertige Grafikkarte mit 142 RT-Cores, AV1-Video-Engines und aktivierbaren Display-Ausgängen. Passiv gekühlt mit 350 W läuft sie in Standard-PCIe-Servern - von der Einzelkarte bis zum 8-GPU-System.
- Preis
- ab 7.600 € netto pro Karte bei Nelpx - der deutsche Markt bewegt sich je nach Kanal grob zwischen 6.400 und 7.800 € netto, die Marktlage ist angespannt; Angebot mit tagesaktueller Bestätigung in der Regel in 48 h.
- Verfügbarkeit
- Auf Lager bei Nelpx - aktives NVIDIA-Produkt ohne Abkündigung; die L40S gilt im NVIDIA-Partnerkanal als Drop-in-Ersatz für die 2026 auslaufende L40.
- Artikelnummer
- PNY TCSL40SPCIE-PB (EU-Retail) · NVIDIA-P/N 900-2G133-0080-000 · US-Kit NVL40STCGPU-KIT.
Stand: 6. August 2026 · Quellen: NVIDIA-L40S-Datenblatt & -Produktseite, PNY-EU-Produktseite, deutsche Handelspreise - Herstellerclaims sind gekennzeichnet.
Eine Karte für GenAI, Rendering, Video und VDI - als Original-PNY-Karte
Die L40S ist keine Spezial-GPU: Sie kombiniert Tensor-Leistung der Ada-Generation mit vollem Grafik-Silizium - und bleibt mit 350 W passiv in fast jedem GPU-Server kühlbar.
48 GB GDDR6 mit ECC, 864 GB/s, 18.176 CUDA-Cores, 568 Tensor-Cores der 4. Generation (FP8), 142 RT-Cores der 3. Generation. PCIe Gen4 x16, Dual-Slot, passiv gekühlt, max. 350 W. Anders als reine KI-Beschleuniger mit 4 DisplayPort-1.4a-Ausgängen (ab Werk deaktiviert, per NVIDIA Display Mode Selector aktivierbar).
Offiziell auf der NVIDIA-AI-Enterprise-Support-Matrix, vGPU-Unterstützung (vPC/vApps, RTX vWS) und Omniverse-Enterprise-qualifiziert als OVX-GPU. 3× NVENC + 3× NVDEC mit AV1-Encode und -Decode. Kein MIG, kein NVLink - Multi-GPU läuft über PCIe Gen4.
Die Karte selbst ist identisches NVIDIA-Referenzdesign - „PNY“ steht für Verpackung, Support und Garantieweg im autorisierten EU-Kanal (PNY ist NVIDIA-Channel-Partner für professionelle GPUs). Nelpx liefert Neuware aus diesem Kanal (Art.-Nr. TCSL40SPCIE-PB) mit 3 Jahren PNY-Garantie (EMEA). Die L40S ist 2026 nicht abgekündigt - sie gilt im Partnerkanal als Ersatz für die auslaufende L40.
Werte: NVIDIA-L40S-Datenblatt und nvidia.com-Produktseite, Stand 06.08.2026. RT-Core-Leistung: Das Datenblatt nennt 209 TFLOPS, die NVIDIA-Produktseite 212 - wir zitieren das Datenblatt. Sparse-Werte beruhen auf NVIDIAs Structured-Sparsity-Angabe.
Ihre L40S-Bestellung.
In 2 Minuten angefragt.
Stückzahl, Software und Services wählen - als PDF herunterladen oder direkt an Nelpx senden. Angebot mit tagesaktueller Bestätigung in der Regel innerhalb von 48 Stunden.
= 48 GB GDDR6 · ~0,35 kW GPU-Last
Datenschutz: Konfiguration und Kontaktdaten bleiben beim Ausfüllen vollständig in Ihrem Browser - Daten werden erst beim aktiven Absenden der E-Mail übertragen.
Passt mein Modell in 48 GB?
Die wichtigste Frage vor dem Kauf - gängige Modellklassen mit Speicherbedarf (Richtwerte: Gewichte + Reserve für KV-Cache; lange Kontexte brauchen mehr):
Faustregel: FP16 ≈ 2 Byte, FP8 ≈ 1 Byte, INT4 ≈ 0,5 Byte pro Parameter, plus 10-20 % Overhead. 70B-INT4-Praxiswert: Community-Messung mit vLLM auf einer L40S (fingon.iki.fi, Llama 3.1 70B AWQ), Stand 06.08.2026 - längere Kontexte und parallele Anfragen erhöhen den Bedarf deutlich. Für die 70B-Klasse empfiehlt Nelpx 2× L40S oder die RTX PRO 6000 Server Edition (96 GB).
L40S im Vergleich: RTX PRO 6000 SE, H200 NVL & L40
Ehrlich eingeordnet: Die L40S ist der bezahlbare Einstieg in die 48-GB-Klasse - die Nachfolge-Generation bietet mehr Speicher und Bandbreite, zum entsprechend höheren Preis.
GPU-Speicher pro Karte
GB - GDDR6 vs. GDDR7 vs. HBM3e
Speicherbandbreite
GB/s - entscheidend für Token-Durchsatz
FP8-Tensorleistung
TFLOPS sparse (Herstellerangaben; RTX PRO 6000 SE: Peak-Angabe)
Preis pro Karte
€ netto, Nelpx-Preise - weniger ist besser
Werte: NVIDIA-Datenblätter der jeweiligen Karten, Stand 06.08.2026 - sparse-Werte nach NVIDIAs Structured-Sparsity-Angabe; für die RTX PRO 6000 SE nennt NVIDIA „2 PFLOPS peak" ohne sparse/dense-Label. Preise: Nelpx-Kaufseiten (RTX PRO 6000 SE, H200 NVL) - L40S und H200 NVL als ab-Preise. Die H200 NVL bietet zusätzlich NVLink-Bridges und MIG - für Training und Modelle jenseits der 48-GB-Klasse bleibt sie gesetzt.
Alle technischen Daten anzeigen (NVIDIA L40S)
| Spezifikation | PNY NVIDIA L40S |
|---|---|
| Architektur | NVIDIA Ada Lovelace · Tensor-Cores 4. Gen (FP8) · RT-Cores 3. Gen |
| Rechenwerke | 18.176 CUDA-Cores · 568 Tensor-Cores · 142 RT-Cores |
| GPU-Speicher | 48 GB GDDR6 mit ECC · 864 GB/s |
| AI-/Compute-Leistung | FP8: 733 / 1.466 TFLOPS · INT8: 733 / 1.466 TOPS · FP16/BF16: 362 / 733 TFLOPS · TF32: 183 / 366 TFLOPS (dense / sparse, Herstellerangaben) |
| Grafik-Leistung | FP32: 91,6 TFLOPS · RT-Cores: 209 TFLOPS (Datenblatt; NVIDIA-Produktseite: 212) |
| MIG | nicht unterstützt |
| vGPU | unterstützt - NVIDIA vPC/vApps und RTX Virtual Workstation (vWS), Software separat lizenziert |
| NVIDIA AI Enterprise | offiziell unterstützt (Support-Matrix, bare-metal und vGPU) |
| Multi-GPU | kein NVLink · PCIe Gen4 x16 (64 GB/s bidirektional) |
| Sicherheit | Secure Boot mit Root of Trust · NEBS Level 3 ready |
| Video-Engines | 3× NVENC · 3× NVDEC · AV1 Encode & Decode · 4× DisplayPort 1.4a (ab Werk deaktiviert) |
| Formfaktor | PCIe Gen4 x16 · Dual-Slot FHFL (4,4" × 10,5") · passiv gekühlt (qualifizierter Server-Airflow erforderlich) |
| Leistungsaufnahme | max. 350 W · 1× 16-Pin-Anschluss |
| Artikelnummern | PNY TCSL40SPCIE-PB (EU-Retail) · US-Kit NVL40STCGPU-KIT · NVIDIA-P/N 900-2G133-0080-000 (OEM-Variante: 900-2G133-0180-030) |
| Garantie | 3 Jahre PNY-Garantie (EMEA) - Abwicklung in den ersten 12 Monaten über den Handelspartner |
Von einer Karte zum 8-GPU-Server
Mit 350 W passiv bleibt die L40S auch im Vollausbau luftgekühlt - vom Einstieg mit einer Karte bis zur NVIDIA-OVX-Referenz mit 8 GPUs pro System.
Als offizieller GIGABYTE-Partner konfiguriert Nelpx die L40S direkt in qualifizierte Plattformen: GIGABYTE G493-ZB0 mit bis zu 8× L40S (QVL-qualifiziert) oder kompakte 2U-Systeme - mit Airflow-Prüfung, Enterprise-Treiber-Setup und Angebot in der Regel innerhalb von 48 Stunden.
Wofür lohnt sich die NVIDIA L40S?
Der Kern-Use-Case: 8B-Modelle mit hohem Durchsatz, 30B-Klasse in FP8/INT8 auf einer Karte - mit FP8-Tensor-Cores der 4. Generation und Transformer Engine. Chatbots, RAG und interne Assistenten laufen komplett on-premises.
Die Stärke gegenüber reinen KI-Beschleunigern: dieselbe Karte rechnet tagsüber Inferenz und rendert nachts - oder beides parallel. Für Teams, die eine GPU für alles brauchen.
142 RT-Cores der 3. Generation für Raytracing, dazu die offizielle Omniverse-Enterprise-Qualifikation: Die L40S ist die GPU der NVIDIA-OVX-Server für Digital Twins und 3D-Pipelines.
3× NVENC und 3× NVDEC inklusive AV1-Encode und -Decode: Transcoding-Farmen, Streaming und Video-KI profitieren von Media-Engines, die reinen Compute-Karten fehlen.
Per NVIDIA vGPU (vPC/vApps, RTX vWS) wird der GPU-Server zur Workstation-Flotte für CAD, DCC und Engineering - auf Wunsch auch mit direkter Display-Ausgabe (4× DP 1.4a, per NVIDIA-Tool aktivierbar).
Prompts, Dokumente und Modelle bleiben im Haus - die bezahlbare Alternative zur US-Cloud-API, mit Secure Boot (Root of Trust) auf Karten-Ebene.
NVIDIA L40S kaufen - oder etwas anderes?
Die ehrliche Entscheidungshilfe - denn nicht jedes Projekt braucht dieselbe GPU:
Darum die L40S
- Bezahlbarer 48-GB-Einstieg: ab 7.600 € netto - drei L40S kosten zusammen weniger als eine H200 NVL.
- Universal-GPU: Tensor-, RT- und Media-Engines plus aktivierbare Display-Ausgänge - GenAI, Rendering, Video und VDI auf einer Karte.
- 350 W passiv: 8 Karten ergeben nur ~2,8 kW GPU-Last - klassisch luftkühlbar, auch in Bestands-Racks.
- Voller Software-Stack: NVIDIA AI Enterprise, vGPU (vPC/vApps, RTX vWS) und Omniverse Enterprise offiziell unterstützt.
- Kein EOL: aktives NVIDIA-Produkt - und der im Partnerkanal empfohlene Ersatz für die 2026 auslaufende L40 (zum L40S-Datenblatt).
Die Alternativen ehrlich betrachtet
- RTX PRO 6000 Blackwell SE: die De-facto-Nachfolgerin - 96 GB GDDR7, 1,85× Bandbreite, FP4 und MIG für 12.925 € netto; pro GB rechnerisch günstiger (zur PNY-RTX-PRO-6000-Seite).
- NVIDIA H200 NVL: 141 GB HBM3e, 4,8 TB/s und NVLink-Bridges - gesetzt für Training, Tensor-Parallelismus und 70B+-Modelle (zur H200-Seite).
- Kompletter 8-GPU-Server: Karte plus Plattform in einem Projekt - GIGABYTE G493-ZB0 (L40S auf der QVL) oder der GPU-Server-Konfigurator.
- Hochschulen & Forschung: Sonderkonditionen und vergabekonforme Beschaffung - HPC für Universitäten & Forschung.
- Portfolio-Überblick: alle GPU-Server und Karten im Vergleich - KI-Server kaufen.
Häufige Fragen zur NVIDIA L40S
Was kostet eine NVIDIA L40S?
Bei Nelpx kostet die PNY NVIDIA L40S (48 GB GDDR6, TCSL40SPCIE-PB) ab 7.600 € zzgl. MwSt. pro Karte - auf Lager; der Endpreis hängt von Stückzahl und tagesaktueller Marktlage ab. Zur Einordnung: Der deutsche Marktpreis bewegt sich Anfang August 2026 je nach Kanal grob zwischen 6.400 und 7.800 € netto - Boxmover-Angebote unten, OEM-gebrandete Karten (HPE, Fujitsu) oben; die Marktlage ist angespannt, Anfang 2026 wurden lieferkettenbedingte Preisanstiege gemeldet. Nelpx bestätigt Preis und Verfügbarkeit tagesaktuell im Angebot - in der Regel innerhalb von 48 Stunden über den Konfigurator auf dieser Seite. Für Hochschulen, Forschung und öffentliche Hand bestehen Sonderkonditionen.
Welche Artikelnummer hat die PNY NVIDIA L40S?
Die PNY-Artikelnummer der NVIDIA L40S für Europa lautet TCSL40SPCIE-PB; in den USA wird die Karte als Kit NVL40STCGPU-KIT geführt. Die zugehörige NVIDIA-Teilenummer ist 900-2G133-0080-000 (Board PG133G); daneben existiert eine OEM-Variante 900-2G133-0180-030, die u. a. Dell verbaut. Technisch sind alle diese Karten identisches NVIDIA-Referenzdesign - „PNY“ steht für Verpackung, Support und Garantieweg im autorisierten EU-Kanal. Wer eine dieser Nummern sucht, bekommt bei Nelpx die Original-PNY-Karte ab Lager - mit 3 Jahren PNY-Garantie (EMEA).
Ist die NVIDIA L40S 2026 noch eine gute Wahl?
Ja - die L40S ist 2026 weiterhin ein aktives NVIDIA-Produkt ohne Abkündigung: Sie steht auf den aktuellen Support-Listen von NVIDIA AI Enterprise und vGPU, und NVIDIAs OVX-Referenzarchitektur setzt unverändert auf 4× oder 8× L40S pro Server. Im Gegenteil: Die verwandte L40 (ohne S) und die H100 NVL wurden 2026 abgekündigt - die L40S gilt in der EOL-Kommunikation des Partnerkanals als empfohlener Ersatz für die L40. Wer mehr Speicher und maximale Zukunftssicherheit will, greift zur RTX PRO 6000 Blackwell Server Edition (96 GB, De-facto-Nachfolgerin) - für rund 70 % Aufpreis (12.925 € netto). Als bezahlbarer Einstieg in GenAI-Inferenz und Grafik bleibt die L40S die Preis-Leistungs-Wahl.
Welche LLMs laufen auf den 48 GB der L40S?
Faustregel: FP16 ≈ 2 Byte, FP8 ≈ 1 Byte, INT4 ≈ 0,5 Byte pro Parameter, plus Reserve für KV-Cache. Damit läuft die 8B-Klasse (z. B. Llama 3.1 8B, ~16 GB in FP16) komfortabel mit viel Headroom für parallele Anfragen; der Sweet Spot ist die 30B-Klasse in FP8/INT8 (~30-32 GB). Ein 70B-Modell passt nur 4-bit-quantisiert (~35-40 GB) auf eine Karte und ist dann eng - Community-Messungen zeigen rund 18 Token/s bei auf 4k begrenztem Kontext. Für die 70B-Klasse empfiehlt Nelpx 2× L40S oder gleich die RTX PRO 6000 Server Edition mit 96 GB.
Unterstützt die L40S MIG?
Nein - die L40S unterstützt kein Multi-Instance GPU (MIG); Vorsicht: Einzelne Vergleichsportale behaupten das Gegenteil. Mandantentrennung gelingt stattdessen per NVIDIA vGPU (vPC/vApps, RTX Virtual Workstation), die die L40S offiziell unterstützt. Wer harte Hardware-Isolation per MIG braucht, greift zur RTX PRO 6000 Blackwell Server Edition (bis 4 Instanzen à 24 GB) oder zur H200 NVL (bis 7 Instanzen).
Hat die L40S NVLink?
Nein - die L40S hat kein NVLink. Mehrere Karten kommunizieren über PCIe Gen4 x16 (64 GB/s bidirektional). Für viele parallele Inferenz-Workloads, bei denen jede Karte eigene Anfragen bedient, ist das kein Nachteil; für Tensor-Parallelismus über mehrere GPUs oder das Training großer Modelle sind NVLink-Systeme wie die H200 NVL (900 GB/s Bridge) oder die HGX-Klasse die bessere Wahl.
Wie wird die L40S gekühlt und wie viel Strom braucht sie?
Die L40S ist passiv gekühlt (Dual-Slot, max. 350 W, 1× 16-Pin-Anschluss) und wird vom Front-to-Back-Luftstrom des Servers gekühlt - sie gehört in dafür qualifizierte Chassis, nicht in Desktop-Gehäuse. Mit 350 W liegt sie deutlich unter modernen 600-W-Beschleunigern: Acht Karten ergeben nur rund 2,8 kW GPU-Last, ein 8-GPU-System bleibt damit klassisch luftkühlbar. Nelpx prüft Bestandsserver kostenlos auf Airflow-Qualifikation, freie Slots und Netzteil-Reserve.
Was ist der Unterschied zwischen L40 und L40S?
Beide teilen 48 GB GDDR6 (864 GB/s) und die Ada-Lovelace-Architektur - aber die L40S bietet die doppelte Tensor-Leistung (FP8: 1.466 vs. 724 TFLOPS sparse; FP16: 733 vs. 362) bei 350 statt 300 W. Die L40 war primär als Grafik- und Visualisierungskarte positioniert, die L40S als Universal-GPU inklusive GenAI. Wichtig für 2026: Die L40 ist abgekündigt (Final Ship Juni 2026) - im Partnerkanal gilt die L40S als Drop-in-Ersatz.
L40S oder NVIDIA H200 - welche GPU ist richtig?
Die H200 NVL (141 GB HBM3e, 4,8 TB/s, NVLink-Bridge, MIG) ist die Trainings- und Großmodell-GPU: rund 2,3-fache FP8-Leistung und 5,5-fache Speicherbandbreite - ab 26.200 € netto aber auch mehr als das Dreifache der L40S. Die L40S gewinnt, wenn viele mittelgroße Modelle, Grafik-Mischbetrieb oder das Budget zählen: Drei L40S (144 GB verteilt) kosten zusammen weniger als eine H200. Faustregel: Training, 70B+-Modelle und Tensor-Parallelismus → H200; Inferenz bis zur 30B-Klasse, Rendering, Video und VDI → L40S.
L40S oder RTX PRO 6000 Blackwell Server Edition?
Die RTX PRO 6000 Blackwell Server Edition ist die De-facto-Nachfolgerin: 96 GB GDDR7 (doppelter Speicher), 1.597 GB/s (1,85-fache Bandbreite), natives FP4 und MIG - bei Nelpx 12.925 € netto und damit rund 70 % teurer. Die L40S bleibt die Wahl, wenn 48 GB reichen (Modelle bis zur 30B-Klasse, Rendering, VDI, Video) und das Budget im Vordergrund steht - oder wenn ein bestehendes L40S-/OVX-Setup homogen erweitert wird. Pro GB Speicher ist die RTX PRO 6000 SE rechnerisch sogar günstiger (~135 €/GB vs. ~158 €/GB) - wer heute neu für LLM-Workloads plant, sollte sie ernsthaft mitprüfen. Nelpx rechnet beide Wege im Angebot transparent vor.
Unterstützt die L40S NVIDIA AI Enterprise, vGPU und Omniverse?
Ja, alle drei: Die L40S steht auf der offiziellen NVIDIA-AI-Enterprise-Support-Matrix (bare-metal und vGPU), unterstützt NVIDIA vGPU mit vPC/vApps und RTX Virtual Workstation (vWS) und ist als OVX-GPU offiziell für NVIDIA Omniverse Enterprise qualifiziert. Dazu kommen 4 DisplayPort-1.4a-Ausgänge (ab Werk im Compute-Modus deaktiviert, per NVIDIA Display Mode Selector aktivierbar) - anders als H100/H200, die gar keine Display-Ausgänge haben, kann die L40S nach Umschaltung auch direkt Displays ansteuern. Die Lizenzen (AI Enterprise, vGPU) sind separat erhältlich - Nelpx weist sie im Angebot aus.
Welche Garantie hat die PNY L40S und liefert Nelpx EU-weit?
PNY gewährt auf professionelle Karten in EMEA 3 Jahre Garantie - in den ersten 12 Monaten läuft die Abwicklung über den Handelspartner, danach direkt über PNY (der Kaufbeleg genügt). Nelpx liefert die L40S EU-weit als Neuware aus dem autorisierten Kanal - auf Wunsch inklusive Einbau, CUDA-Stack-Setup oder komplettem GPU-Server. Angebot in der Regel innerhalb von 48 Stunden.
Ihre NVIDIA L40S - ab Lager, angefragt in 2 Minuten
Ab 7.600 € zzgl. MwSt. pro Karte, auf Lager, 3 Jahre PNY-Garantie. Die Universal-GPU für GenAI, Rendering, Video und VDI - Nelpx liefert einzeln, im Multi-GPU-Verbund oder mit passendem Server.
Jetzt konfigurieren & Angebot einholenAuf Lager · Angebot in der Regel innerhalb von 48 h · Lieferung & Integration EU-weit
NVIDIA L40S kaufen - die Universal-GPU für GenAI & Grafik
Die Ada-Lovelace-GPU mit 48 GB GDDR6 (ECC) - GenAI-Inferenz, Rendering, Video und VDI auf einer Karte. Passiv gekühlt für PCIe-Server, 350 W, typisch bis 8 Karten pro System. Nelpx liefert die Original-PNY-Karte ab Lager - einzeln, im Multi-GPU-Verbund oder mit passendem Server. Angebot in 48 h.
IT-Systemhaus für HPC & AI-Infrastruktur · Lieferung EU-weit · Tagesaktuelle Preise & Verfügbarkeit
Was kostet die NVIDIA L40S?
Die NVIDIA L40S (48 GB GDDR6 mit ECC, PNY-Artikelnummer TCSL40SPCIE-PB) kostet bei Nelpx ab 7.600 € zzgl. MwSt. pro Karte - auf Lager und kurzfristig lieferbar; der Endpreis hängt von Stückzahl und tagesaktueller Marktlage ab. Sie ist die Universal-GPU der Ada-Lovelace-Generation: stark in GenAI-Inferenz bis zur 30B-Modellklasse (FP8: 1.466 TFLOPS sparse) und zugleich vollwertige Grafikkarte mit 142 RT-Cores, AV1-Video-Engines und aktivierbaren Display-Ausgängen. Passiv gekühlt mit 350 W läuft sie in Standard-PCIe-Servern - von der Einzelkarte bis zum 8-GPU-System.
- Preis
- ab 7.600 € netto pro Karte bei Nelpx - der deutsche Markt bewegt sich je nach Kanal grob zwischen 6.400 und 7.800 € netto, die Marktlage ist angespannt; Angebot mit tagesaktueller Bestätigung in der Regel in 48 h.
- Verfügbarkeit
- Auf Lager bei Nelpx - aktives NVIDIA-Produkt ohne Abkündigung; die L40S gilt im NVIDIA-Partnerkanal als Drop-in-Ersatz für die 2026 auslaufende L40.
- Artikelnummer
- PNY TCSL40SPCIE-PB (EU-Retail) · NVIDIA-P/N 900-2G133-0080-000 · US-Kit NVL40STCGPU-KIT.
Stand: 6. August 2026 · Quellen: NVIDIA-L40S-Datenblatt & -Produktseite, PNY-EU-Produktseite, deutsche Handelspreise - Herstellerclaims sind gekennzeichnet.
Eine Karte für GenAI, Rendering, Video und VDI - als Original-PNY-Karte
Die L40S ist keine Spezial-GPU: Sie kombiniert Tensor-Leistung der Ada-Generation mit vollem Grafik-Silizium - und bleibt mit 350 W passiv in fast jedem GPU-Server kühlbar.
48 GB GDDR6 mit ECC, 864 GB/s, 18.176 CUDA-Cores, 568 Tensor-Cores der 4. Generation (FP8), 142 RT-Cores der 3. Generation. PCIe Gen4 x16, Dual-Slot, passiv gekühlt, max. 350 W. Anders als reine KI-Beschleuniger mit 4 DisplayPort-1.4a-Ausgängen (ab Werk deaktiviert, per NVIDIA Display Mode Selector aktivierbar).
Offiziell auf der NVIDIA-AI-Enterprise-Support-Matrix, vGPU-Unterstützung (vPC/vApps, RTX vWS) und Omniverse-Enterprise-qualifiziert als OVX-GPU. 3× NVENC + 3× NVDEC mit AV1-Encode und -Decode. Kein MIG, kein NVLink - Multi-GPU läuft über PCIe Gen4.
Die Karte selbst ist identisches NVIDIA-Referenzdesign - „PNY“ steht für Verpackung, Support und Garantieweg im autorisierten EU-Kanal (PNY ist NVIDIA-Channel-Partner für professionelle GPUs). Nelpx liefert Neuware aus diesem Kanal (Art.-Nr. TCSL40SPCIE-PB) mit 3 Jahren PNY-Garantie (EMEA). Die L40S ist 2026 nicht abgekündigt - sie gilt im Partnerkanal als Ersatz für die auslaufende L40.
Werte: NVIDIA-L40S-Datenblatt und nvidia.com-Produktseite, Stand 06.08.2026. RT-Core-Leistung: Das Datenblatt nennt 209 TFLOPS, die NVIDIA-Produktseite 212 - wir zitieren das Datenblatt. Sparse-Werte beruhen auf NVIDIAs Structured-Sparsity-Angabe.
Ihre L40S-Bestellung.
In 2 Minuten angefragt.
Stückzahl, Software und Services wählen - als PDF herunterladen oder direkt an Nelpx senden. Angebot mit tagesaktueller Bestätigung in der Regel innerhalb von 48 Stunden.
= 48 GB GDDR6 · ~0,35 kW GPU-Last
Datenschutz: Konfiguration und Kontaktdaten bleiben beim Ausfüllen vollständig in Ihrem Browser - Daten werden erst beim aktiven Absenden der E-Mail übertragen.
Passt mein Modell in 48 GB?
Die wichtigste Frage vor dem Kauf - gängige Modellklassen mit Speicherbedarf (Richtwerte: Gewichte + Reserve für KV-Cache; lange Kontexte brauchen mehr):
Faustregel: FP16 ≈ 2 Byte, FP8 ≈ 1 Byte, INT4 ≈ 0,5 Byte pro Parameter, plus 10-20 % Overhead. 70B-INT4-Praxiswert: Community-Messung mit vLLM auf einer L40S (fingon.iki.fi, Llama 3.1 70B AWQ), Stand 06.08.2026 - längere Kontexte und parallele Anfragen erhöhen den Bedarf deutlich. Für die 70B-Klasse empfiehlt Nelpx 2× L40S oder die RTX PRO 6000 Server Edition (96 GB).
L40S im Vergleich: RTX PRO 6000 SE, H200 NVL & L40
Ehrlich eingeordnet: Die L40S ist der bezahlbare Einstieg in die 48-GB-Klasse - die Nachfolge-Generation bietet mehr Speicher und Bandbreite, zum entsprechend höheren Preis.
GPU-Speicher pro Karte
GB - GDDR6 vs. GDDR7 vs. HBM3e
Speicherbandbreite
GB/s - entscheidend für Token-Durchsatz
FP8-Tensorleistung
TFLOPS sparse (Herstellerangaben; RTX PRO 6000 SE: Peak-Angabe)
Preis pro Karte
€ netto, Nelpx-Preise - weniger ist besser
Werte: NVIDIA-Datenblätter der jeweiligen Karten, Stand 06.08.2026 - sparse-Werte nach NVIDIAs Structured-Sparsity-Angabe; für die RTX PRO 6000 SE nennt NVIDIA „2 PFLOPS peak" ohne sparse/dense-Label. Preise: Nelpx-Kaufseiten (RTX PRO 6000 SE, H200 NVL) - L40S und H200 NVL als ab-Preise. Die H200 NVL bietet zusätzlich NVLink-Bridges und MIG - für Training und Modelle jenseits der 48-GB-Klasse bleibt sie gesetzt.
Alle technischen Daten anzeigen (NVIDIA L40S)
| Spezifikation | PNY NVIDIA L40S |
|---|---|
| Architektur | NVIDIA Ada Lovelace · Tensor-Cores 4. Gen (FP8) · RT-Cores 3. Gen |
| Rechenwerke | 18.176 CUDA-Cores · 568 Tensor-Cores · 142 RT-Cores |
| GPU-Speicher | 48 GB GDDR6 mit ECC · 864 GB/s |
| AI-/Compute-Leistung | FP8: 733 / 1.466 TFLOPS · INT8: 733 / 1.466 TOPS · FP16/BF16: 362 / 733 TFLOPS · TF32: 183 / 366 TFLOPS (dense / sparse, Herstellerangaben) |
| Grafik-Leistung | FP32: 91,6 TFLOPS · RT-Cores: 209 TFLOPS (Datenblatt; NVIDIA-Produktseite: 212) |
| MIG | nicht unterstützt |
| vGPU | unterstützt - NVIDIA vPC/vApps und RTX Virtual Workstation (vWS), Software separat lizenziert |
| NVIDIA AI Enterprise | offiziell unterstützt (Support-Matrix, bare-metal und vGPU) |
| Multi-GPU | kein NVLink · PCIe Gen4 x16 (64 GB/s bidirektional) |
| Sicherheit | Secure Boot mit Root of Trust · NEBS Level 3 ready |
| Video-Engines | 3× NVENC · 3× NVDEC · AV1 Encode & Decode · 4× DisplayPort 1.4a (ab Werk deaktiviert) |
| Formfaktor | PCIe Gen4 x16 · Dual-Slot FHFL (4,4" × 10,5") · passiv gekühlt (qualifizierter Server-Airflow erforderlich) |
| Leistungsaufnahme | max. 350 W · 1× 16-Pin-Anschluss |
| Artikelnummern | PNY TCSL40SPCIE-PB (EU-Retail) · US-Kit NVL40STCGPU-KIT · NVIDIA-P/N 900-2G133-0080-000 (OEM-Variante: 900-2G133-0180-030) |
| Garantie | 3 Jahre PNY-Garantie (EMEA) - Abwicklung in den ersten 12 Monaten über den Handelspartner |
Von einer Karte zum 8-GPU-Server
Mit 350 W passiv bleibt die L40S auch im Vollausbau luftgekühlt - vom Einstieg mit einer Karte bis zur NVIDIA-OVX-Referenz mit 8 GPUs pro System.
Als offizieller GIGABYTE-Partner konfiguriert Nelpx die L40S direkt in qualifizierte Plattformen: GIGABYTE G493-ZB0 mit bis zu 8× L40S (QVL-qualifiziert) oder kompakte 2U-Systeme - mit Airflow-Prüfung, Enterprise-Treiber-Setup und Angebot in der Regel innerhalb von 48 Stunden.
Wofür lohnt sich die NVIDIA L40S?
Der Kern-Use-Case: 8B-Modelle mit hohem Durchsatz, 30B-Klasse in FP8/INT8 auf einer Karte - mit FP8-Tensor-Cores der 4. Generation und Transformer Engine. Chatbots, RAG und interne Assistenten laufen komplett on-premises.
Die Stärke gegenüber reinen KI-Beschleunigern: dieselbe Karte rechnet tagsüber Inferenz und rendert nachts - oder beides parallel. Für Teams, die eine GPU für alles brauchen.
142 RT-Cores der 3. Generation für Raytracing, dazu die offizielle Omniverse-Enterprise-Qualifikation: Die L40S ist die GPU der NVIDIA-OVX-Server für Digital Twins und 3D-Pipelines.
3× NVENC und 3× NVDEC inklusive AV1-Encode und -Decode: Transcoding-Farmen, Streaming und Video-KI profitieren von Media-Engines, die reinen Compute-Karten fehlen.
Per NVIDIA vGPU (vPC/vApps, RTX vWS) wird der GPU-Server zur Workstation-Flotte für CAD, DCC und Engineering - auf Wunsch auch mit direkter Display-Ausgabe (4× DP 1.4a, per NVIDIA-Tool aktivierbar).
Prompts, Dokumente und Modelle bleiben im Haus - die bezahlbare Alternative zur US-Cloud-API, mit Secure Boot (Root of Trust) auf Karten-Ebene.
NVIDIA L40S kaufen - oder etwas anderes?
Die ehrliche Entscheidungshilfe - denn nicht jedes Projekt braucht dieselbe GPU:
Darum die L40S
- Bezahlbarer 48-GB-Einstieg: ab 7.600 € netto - drei L40S kosten zusammen weniger als eine H200 NVL.
- Universal-GPU: Tensor-, RT- und Media-Engines plus aktivierbare Display-Ausgänge - GenAI, Rendering, Video und VDI auf einer Karte.
- 350 W passiv: 8 Karten ergeben nur ~2,8 kW GPU-Last - klassisch luftkühlbar, auch in Bestands-Racks.
- Voller Software-Stack: NVIDIA AI Enterprise, vGPU (vPC/vApps, RTX vWS) und Omniverse Enterprise offiziell unterstützt.
- Kein EOL: aktives NVIDIA-Produkt - und der im Partnerkanal empfohlene Ersatz für die 2026 auslaufende L40 (zum L40S-Datenblatt).
Die Alternativen ehrlich betrachtet
- RTX PRO 6000 Blackwell SE: die De-facto-Nachfolgerin - 96 GB GDDR7, 1,85× Bandbreite, FP4 und MIG für 12.925 € netto; pro GB rechnerisch günstiger (zur PNY-RTX-PRO-6000-Seite).
- NVIDIA H200 NVL: 141 GB HBM3e, 4,8 TB/s und NVLink-Bridges - gesetzt für Training, Tensor-Parallelismus und 70B+-Modelle (zur H200-Seite).
- Kompletter 8-GPU-Server: Karte plus Plattform in einem Projekt - GIGABYTE G493-ZB0 (L40S auf der QVL) oder der GPU-Server-Konfigurator.
- Hochschulen & Forschung: Sonderkonditionen und vergabekonforme Beschaffung - HPC für Universitäten & Forschung.
- Portfolio-Überblick: alle GPU-Server und Karten im Vergleich - KI-Server kaufen.
Häufige Fragen zur NVIDIA L40S
Was kostet eine NVIDIA L40S?
Bei Nelpx kostet die PNY NVIDIA L40S (48 GB GDDR6, TCSL40SPCIE-PB) ab 7.600 € zzgl. MwSt. pro Karte - auf Lager; der Endpreis hängt von Stückzahl und tagesaktueller Marktlage ab. Zur Einordnung: Der deutsche Marktpreis bewegt sich Anfang August 2026 je nach Kanal grob zwischen 6.400 und 7.800 € netto - Boxmover-Angebote unten, OEM-gebrandete Karten (HPE, Fujitsu) oben; die Marktlage ist angespannt, Anfang 2026 wurden lieferkettenbedingte Preisanstiege gemeldet. Nelpx bestätigt Preis und Verfügbarkeit tagesaktuell im Angebot - in der Regel innerhalb von 48 Stunden über den Konfigurator auf dieser Seite. Für Hochschulen, Forschung und öffentliche Hand bestehen Sonderkonditionen.
Welche Artikelnummer hat die PNY NVIDIA L40S?
Die PNY-Artikelnummer der NVIDIA L40S für Europa lautet TCSL40SPCIE-PB; in den USA wird die Karte als Kit NVL40STCGPU-KIT geführt. Die zugehörige NVIDIA-Teilenummer ist 900-2G133-0080-000 (Board PG133G); daneben existiert eine OEM-Variante 900-2G133-0180-030, die u. a. Dell verbaut. Technisch sind alle diese Karten identisches NVIDIA-Referenzdesign - „PNY“ steht für Verpackung, Support und Garantieweg im autorisierten EU-Kanal. Wer eine dieser Nummern sucht, bekommt bei Nelpx die Original-PNY-Karte ab Lager - mit 3 Jahren PNY-Garantie (EMEA).
Ist die NVIDIA L40S 2026 noch eine gute Wahl?
Ja - die L40S ist 2026 weiterhin ein aktives NVIDIA-Produkt ohne Abkündigung: Sie steht auf den aktuellen Support-Listen von NVIDIA AI Enterprise und vGPU, und NVIDIAs OVX-Referenzarchitektur setzt unverändert auf 4× oder 8× L40S pro Server. Im Gegenteil: Die verwandte L40 (ohne S) und die H100 NVL wurden 2026 abgekündigt - die L40S gilt in der EOL-Kommunikation des Partnerkanals als empfohlener Ersatz für die L40. Wer mehr Speicher und maximale Zukunftssicherheit will, greift zur RTX PRO 6000 Blackwell Server Edition (96 GB, De-facto-Nachfolgerin) - für rund 70 % Aufpreis (12.925 € netto). Als bezahlbarer Einstieg in GenAI-Inferenz und Grafik bleibt die L40S die Preis-Leistungs-Wahl.
Welche LLMs laufen auf den 48 GB der L40S?
Faustregel: FP16 ≈ 2 Byte, FP8 ≈ 1 Byte, INT4 ≈ 0,5 Byte pro Parameter, plus Reserve für KV-Cache. Damit läuft die 8B-Klasse (z. B. Llama 3.1 8B, ~16 GB in FP16) komfortabel mit viel Headroom für parallele Anfragen; der Sweet Spot ist die 30B-Klasse in FP8/INT8 (~30-32 GB). Ein 70B-Modell passt nur 4-bit-quantisiert (~35-40 GB) auf eine Karte und ist dann eng - Community-Messungen zeigen rund 18 Token/s bei auf 4k begrenztem Kontext. Für die 70B-Klasse empfiehlt Nelpx 2× L40S oder gleich die RTX PRO 6000 Server Edition mit 96 GB.
Unterstützt die L40S MIG?
Nein - die L40S unterstützt kein Multi-Instance GPU (MIG); Vorsicht: Einzelne Vergleichsportale behaupten das Gegenteil. Mandantentrennung gelingt stattdessen per NVIDIA vGPU (vPC/vApps, RTX Virtual Workstation), die die L40S offiziell unterstützt. Wer harte Hardware-Isolation per MIG braucht, greift zur RTX PRO 6000 Blackwell Server Edition (bis 4 Instanzen à 24 GB) oder zur H200 NVL (bis 7 Instanzen).
Hat die L40S NVLink?
Nein - die L40S hat kein NVLink. Mehrere Karten kommunizieren über PCIe Gen4 x16 (64 GB/s bidirektional). Für viele parallele Inferenz-Workloads, bei denen jede Karte eigene Anfragen bedient, ist das kein Nachteil; für Tensor-Parallelismus über mehrere GPUs oder das Training großer Modelle sind NVLink-Systeme wie die H200 NVL (900 GB/s Bridge) oder die HGX-Klasse die bessere Wahl.
Wie wird die L40S gekühlt und wie viel Strom braucht sie?
Die L40S ist passiv gekühlt (Dual-Slot, max. 350 W, 1× 16-Pin-Anschluss) und wird vom Front-to-Back-Luftstrom des Servers gekühlt - sie gehört in dafür qualifizierte Chassis, nicht in Desktop-Gehäuse. Mit 350 W liegt sie deutlich unter modernen 600-W-Beschleunigern: Acht Karten ergeben nur rund 2,8 kW GPU-Last, ein 8-GPU-System bleibt damit klassisch luftkühlbar. Nelpx prüft Bestandsserver kostenlos auf Airflow-Qualifikation, freie Slots und Netzteil-Reserve.
Was ist der Unterschied zwischen L40 und L40S?
Beide teilen 48 GB GDDR6 (864 GB/s) und die Ada-Lovelace-Architektur - aber die L40S bietet die doppelte Tensor-Leistung (FP8: 1.466 vs. 724 TFLOPS sparse; FP16: 733 vs. 362) bei 350 statt 300 W. Die L40 war primär als Grafik- und Visualisierungskarte positioniert, die L40S als Universal-GPU inklusive GenAI. Wichtig für 2026: Die L40 ist abgekündigt (Final Ship Juni 2026) - im Partnerkanal gilt die L40S als Drop-in-Ersatz.
L40S oder NVIDIA H200 - welche GPU ist richtig?
Die H200 NVL (141 GB HBM3e, 4,8 TB/s, NVLink-Bridge, MIG) ist die Trainings- und Großmodell-GPU: rund 2,3-fache FP8-Leistung und 5,5-fache Speicherbandbreite - ab 26.200 € netto aber auch mehr als das Dreifache der L40S. Die L40S gewinnt, wenn viele mittelgroße Modelle, Grafik-Mischbetrieb oder das Budget zählen: Drei L40S (144 GB verteilt) kosten zusammen weniger als eine H200. Faustregel: Training, 70B+-Modelle und Tensor-Parallelismus → H200; Inferenz bis zur 30B-Klasse, Rendering, Video und VDI → L40S.
L40S oder RTX PRO 6000 Blackwell Server Edition?
Die RTX PRO 6000 Blackwell Server Edition ist die De-facto-Nachfolgerin: 96 GB GDDR7 (doppelter Speicher), 1.597 GB/s (1,85-fache Bandbreite), natives FP4 und MIG - bei Nelpx 12.925 € netto und damit rund 70 % teurer. Die L40S bleibt die Wahl, wenn 48 GB reichen (Modelle bis zur 30B-Klasse, Rendering, VDI, Video) und das Budget im Vordergrund steht - oder wenn ein bestehendes L40S-/OVX-Setup homogen erweitert wird. Pro GB Speicher ist die RTX PRO 6000 SE rechnerisch sogar günstiger (~135 €/GB vs. ~158 €/GB) - wer heute neu für LLM-Workloads plant, sollte sie ernsthaft mitprüfen. Nelpx rechnet beide Wege im Angebot transparent vor.
Unterstützt die L40S NVIDIA AI Enterprise, vGPU und Omniverse?
Ja, alle drei: Die L40S steht auf der offiziellen NVIDIA-AI-Enterprise-Support-Matrix (bare-metal und vGPU), unterstützt NVIDIA vGPU mit vPC/vApps und RTX Virtual Workstation (vWS) und ist als OVX-GPU offiziell für NVIDIA Omniverse Enterprise qualifiziert. Dazu kommen 4 DisplayPort-1.4a-Ausgänge (ab Werk im Compute-Modus deaktiviert, per NVIDIA Display Mode Selector aktivierbar) - anders als H100/H200, die gar keine Display-Ausgänge haben, kann die L40S nach Umschaltung auch direkt Displays ansteuern. Die Lizenzen (AI Enterprise, vGPU) sind separat erhältlich - Nelpx weist sie im Angebot aus.
Welche Garantie hat die PNY L40S und liefert Nelpx EU-weit?
PNY gewährt auf professionelle Karten in EMEA 3 Jahre Garantie - in den ersten 12 Monaten läuft die Abwicklung über den Handelspartner, danach direkt über PNY (der Kaufbeleg genügt). Nelpx liefert die L40S EU-weit als Neuware aus dem autorisierten Kanal - auf Wunsch inklusive Einbau, CUDA-Stack-Setup oder komplettem GPU-Server. Angebot in der Regel innerhalb von 48 Stunden.
Ihre NVIDIA L40S - ab Lager, angefragt in 2 Minuten
Ab 7.600 € zzgl. MwSt. pro Karte, auf Lager, 3 Jahre PNY-Garantie. Die Universal-GPU für GenAI, Rendering, Video und VDI - Nelpx liefert einzeln, im Multi-GPU-Verbund oder mit passendem Server.
Jetzt konfigurieren & Angebot einholenAuf Lager · Angebot in der Regel innerhalb von 48 h · Lieferung & Integration EU-weit