Compact Node
< 1 kW
- Apertus 8B
- gpt-oss-20b
- Qwen 27B INT4
Pilot, lokales RAG, ein Prinzipal oder kleines Team.
Hardware · Modell-Fit
Die kleinste Maschine, die ein Modell hält, ist nicht automatisch die Maschine, die Ihr Team bedient. Wir trennen Gewichtsresidenz von Kontext, Parallelität, Latenz und Betriebsreserve.
Wählen Sie Modell und aggregierte Beschleuniger-Speicherklasse. Das Ergebnis ist eine Planungsschranke, kein Leistungsversprechen.
Modell und Speicherklasse wählen.
Diese Spezifikationen verankern die Architektur. Fertige Systeme ergänzen CPU, RAM, Storage, Fabric, Redundanz, Garantie und Serving-Validierung.
Ein DGX Spark kann grosse quantisierte Gewichte im Unified Memory halten, ist bei Latenz und Parallelität aber nicht automatisch einem Datacenter-Beschleuniger gleichwertig.
< 1 kW
Pilot, lokales RAG, ein Prinzipal oder kleines Team.
0,6–1,5 kW
Der normale Ausgangspunkt für ernsthafte lokale Produktion.
2–8 kW
Mehrbenutzer-Archivsystem.
8–40 kW
Reguliertes Team- und Grossmodellsystem.
50–200+ kW
Ein Gebäudeprogramm, nie ein Gerät. Strom und Leistung bleiben standort- und benchmarkspezifisch.
Längerer Kontext erhöht KV-Cache und Runtime-Bedarf. Ein Gewichts-Fit bei 2K kann bei 128K scheitern.
Ein schneller Nutzer und zwanzig gleichzeitige Nutzer sind verschiedene Architekturen, auch beim gleichen Modell.
Hardware-Fit sagt nichts über Quellentreue, Sprachqualität oder Verweigerungsverhalten aus.
Beschaffungsregel: Keine genannte Komponente wird zur Kundenkonfiguration, bevor aktuelle Schweizer Verfügbarkeit, Garantiepfad, Lieferzeit, Chassis-Fit und Benchmarks dokumentiert sind.
Lesen Sie den genauen Benchmark-Vertrag, bevor eine Konfiguration als produktionsbereit gilt.