Hardware · Modell-Fit


Zuerst Speicher. Dann Durchsatz, Strom und Support.

Die kleinste Maschine, die ein Modell hält, ist nicht automatisch die Maschine, die Ihr Team bedient. Wir trennen Gewichtsresidenz von Kontext, Parallelität, Latenz und Betriebsreserve.

Offizielle SpezifikationenPlanungsrechnung

Passt das Modell?

Wählen Sie Modell und aggregierte Beschleuniger-Speicherklasse. Das Ergebnis ist eine Planungsschranke, kein Leistungsversprechen.

Lokal berechnet

Läuft in diesem Browser. Keine Auswahl wird übertragen oder gespeichert.

Planungsergebnis

Modell und Speicherklasse wählen.

Referenzkomponenten statt anonymer Stufen

Diese Spezifikationen verankern die Architektur. Fertige Systeme ergänzen CPU, RAM, Storage, Fabric, Redundanz, Garantie und Serving-Validierung.

Geprüft am 26. Juli 2026
96 GBRTX PRO 6000 Blackwell · ECC GDDR7 · 600 W
128 GBDGX Spark · kohärenter Unified Memory · Proof Node
141 GBH200 SXM · HBM3e · Enterprise Fabric
288 GBMI355X · HBM3e · 1,4-kW-Beschleuniger

Ein DGX Spark kann grosse quantisierte Gewichte im Unified Memory halten, ist bei Latenz und Parallelität aber nicht automatisch einem Datacenter-Beschleuniger gleichwertig.

Vier Lieferklassen

24–32 GB

Compact Node

< 1 kW

  • Apertus 8B
  • gpt-oss-20b
  • Qwen 27B INT4

Pilot, lokales RAG, ein Prinzipal oder kleines Team.

192–384 GB

Vault

2–8 kW

  • grössere multimodale Modelle
  • höhere Parallelität
  • redundante Speicher- und Servicepfade

Mehrbenutzer-Archivsystem.

8 Beschleuniger

Cell

8–40 kW

  • validiertes Kimi K2.5 INT4
  • DeepSeek-V3-Kandidaten
  • getrennte Entwicklung und Produktion

Reguliertes Team- und Grossmodellsystem.

Fabric-Programm

Sovereign Rack

50–200+ kW

  • offizielle Kimi-K2- und K3-Serving-Rahmen
  • K3 beginnt bei 8× GB300 oder MI350X-Klasse; Produktion kann mehrere Knoten benötigen
  • Flüssigkühlung und Wärmenutzung

Ein Gebäudeprogramm, nie ein Gerät. Strom und Leistung bleiben standort- und benchmarkspezifisch.

Was der Rechner bewusst nicht verspricht

Kontextreserve

Längerer Kontext erhöht KV-Cache und Runtime-Bedarf. Ein Gewichts-Fit bei 2K kann bei 128K scheitern.

Parallelität

Ein schneller Nutzer und zwanzig gleichzeitige Nutzer sind verschiedene Architekturen, auch beim gleichen Modell.

Qualität

Hardware-Fit sagt nichts über Quellentreue, Sprachqualität oder Verweigerungsverhalten aus.

Beschaffungsregel: Keine genannte Komponente wird zur Kundenkonfiguration, bevor aktuelle Schweizer Verfügbarkeit, Garantiepfad, Lieferzeit, Chassis-Fit und Benchmarks dokumentiert sind.

Fit ist die erste Schranke. Messung ist die zweite.

Lesen Sie den genauen Benchmark-Vertrag, bevor eine Konfiguration als produktionsbereit gilt.

Performance Lab öffnen Planungspreise ansehen →