LLM-Kostenplaner
LLM-Betrieb kalkulieren
Monatliche API-Kosten und den Hardwarebedarf für den Betrieb auf eigener Infrastruktur verständlich abschätzen.
Effektiver Preis nach der 7:2:1-Faustregel: 70 % Cache-Hit, 20 % Input und 10 % Output. Cache-Write ist nicht enthalten.
ModellvergleichKosten, Intelligence Index und Parameter auf Abruf vergleichen
ModellvergleichIntelligence Index und Parameter auf Abruf vergleichen
GPU-ÜberblickTechnische Daten und hinterlegte Richtpreise
| Hardware | Klasse | VRAM | Speichertyp | Bandbreite | Typischer Ausbau | Max. Leistung | Preis ca. |
|---|
Alle aufgeführten GPUs verfügen über ECC-Speicher. Server- und Plattformdaten: RTX PRO 4500 Server Edition, RTX PRO 6000 Server Edition, H200, DGX B200 und AMD Instinct MI300.
Grenzen der Schätzung
Grobe Kapazitäts- und Kostenschätzung: Der Mindestbedarf enthält Modellgewichte, Kontextspeicher und Runtime-Overhead, aber keinen zusätzlichen Sicherheitspuffer. Je nach Modell und Software sind ±15–20 % Abweichung möglich. Workstation-Karten werden nur bis vier GPUs pro System berücksichtigt; für fünf bis acht GPUs nutzt die Empfehlung passive Server Editions. Oberhalb der Kapazität eines 8-GPU-Servers wird eine Enterprise-Plattformklasse gezeigt, deren Kaufpreis nur auf Anfrage erhältlich ist. Addierter VRAM ist kein gleichwertiger gemeinsamer Speicherpool: Bei einem über mehrere GPUs verteilten Modell können PCIe, NVLink, Infinity Fabric, Runtime und Parallelisierungsverfahren die nutzbare Leistung bestimmen. Kühlung, Netzwerk, Software, Support, Personal und Restwert sind nicht vollständig eingerechnet. GPU-Richtpreise und die Serverbasis sind Planungswerte ohne MwSt.- oder Versandkorrektur.
Datenstand: 22.07.2026 · API-Quelldaten in USD · GPU-Richtpreise in EUR