# GPU-Server

> NVIDIA-H200-, B200- und L40S-Server mit CUDA-Images, NVLink und 400-Gbit/s-InfiniBand für Trainingscluster.

Source: https://docs.avenlith.com/de/gpu-servers  
Category: KI & GPU  
Last updated: 2026-09-22

## Konfigurationen

| Tarif | GPUs | GPU-Speicher | Ideal für |
| --- | --- | --- | --- |
| gpu-l40s-1x | 1 × L40S | 48 GB | Inferenz, Rendering |
| gpu-l40s-4x | 4 × L40S | 192 GB | Mittelgroße Inferenz |
| gpu-h200-8x | 8 × H200 SXM | 1.128 GB | Training, 70B+-Modelle |
| gpu-b200-8x | 8 × B200 | 1.440 GB | Training im Frontier-Maßstab |

## Bereitstellen

```bash
avenlith gpu list-stock
avenlith server create --name train-01 --plan gpu-h200-8x --region mow1 \
  --image ubuntu-26.04-cuda-13
nvidia-smi
```

Images mit dem Suffix `-cuda` enthalten NVIDIA-Treiber, CUDA 13, cuDNN, NCCL und das Container Toolkit.

## Cluster

8-GPU-Server in MOW1 und FRA1 lassen sich über nicht blockierendes 400-Gbit/s-InfiniBand verbinden. Cluster bis 64 Knoten erhalten Sie über unser KI-Team.

> **Note:** > GPU-Kapazität ist begrenzt. Reservieren Sie Server für 3 oder 12 Monate, um Verfügbarkeit zu sichern und bis zu 35 % zu sparen.
