Die AMD Threadripper Halo Station ist AMDs Antwort auf Nvidias DGX Station: eine wassergekühlte Workstation mit 96-Kern-CPU und bis zu vier Instinct-MI350P-Beschleunigern, die Modelle mit über einer Billion Parametern komplett im Grafikspeicher halten soll. Vorgestellt wurde sie am 4. September 2026 zur Eröffnung der IFA in Berlin. Kaufen kann man sie noch nicht – und für die meisten wird das auch so bleiben.
Was AMD gezeigt hat
Herzstück ist der Ryzen Threadripper PRO 9995WX mit 96 Zen-5-Kernen und 192 Threads, angebunden an bis zu 2 TB DDR5-RDIMM über acht Speicherkanäle. Dazu kommen laut AMD bis zu vier Instinct MI350P – PCIe-Karten mit je 144 GB HBM3e und 4 TB/s Speicherbandbreite. Voll bestückt ergibt das 576 GB GPU-Speicher, insgesamt 2,6 TB Systemspeicher und eine aggregierte Bandbreite von rund 16,4 TB/s. CPU und jede Karte sind einzeln flüssigkeitsgekühlt.
Klartext ins Postfach
KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.
Auf der Messe stand allerdings eine Konfiguration mit zwei Karten, also 288 GB HBM3e. AMD selbst nennt das System auf seiner Produktseite einen Prototyp („Coming in 2027″). Preis und Verfügbarkeit sind offen; The Register schätzt auf Basis der Komponenten einen Bereich von 100.000 bis 150.000 US-Dollar. Das ist eine Einschätzung, keine Herstellerangabe.
Der Vergleich, den AMD zieht: bis zu 3,4-mal so viel Gesamtspeicher wie Nvidias DGX Station mit ihrem GB300-Superchip (252 GB HBM3e plus 496 GB LPDDR5X) und mehr als doppelte Speicherbandbreite. Erstmals wandert damit ein Instinct-Beschleuniger, bisher reine Rechenzentrums-Hardware, unter einen Schreibtisch.
Warum Speicher hier alles ist
Bei lokaler KI entscheidet nicht die Rechenleistung, sondern ob das Modell überhaupt in den Speicher passt und wie schnell die Gewichte pro Token gelesen werden können. Ein Modell mit einer Billion Parametern braucht bei 4-Bit-Quantisierung grob 500 GB. Genau deshalb bewirbt AMD die 576 GB: Sie erlauben es, die größten offenen Modelle ohne Auslagerung in den langsameren Hauptspeicher zu fahren. Für kleinere Modelle ist das System schlicht überdimensioniert.
Was das für dich bedeutet
Ich beobachte das Thema „KI im eigenen Haus” seit Jahren aus zwei Richtungen: als jemand, der Modelle lokal laufen lässt, und mit CISO-Blick auf die Frage, welche Daten überhaupt in eine Cloud dürfen. Die Halo Station adressiert genau die zweite Gruppe – Unternehmen, Forschungseinrichtungen und Behörden, die sensible Daten und geistiges Eigentum nicht an einen API-Anbieter geben wollen oder dürfen. Für sie ist ein sechsstelliger Einmalbetrag oft günstiger als Jahre an Cloud-Inferenz für dauerhaft laufende Agenten. AMDs Argument, man behalte das Geld, das sonst an Cloud-Rechnungen ginge, ist nicht falsch.
Für Admins, Entwickler und kleine Betriebe ändert die Ankündigung kurzfristig nichts. Relevant ist sie trotzdem, aus drei Gründen. Erstens zeigt sie, wohin der Markt läuft: Frontier-Modelle lokal sind kein Nischenprojekt mehr, sondern ein Produktsegment mit zwei ernsthaften Anbietern. Zweitens sinken die Preise darunter – die 128-GB-Ryzen-AI-Halo-Systeme mit Strix Halo kosten laut Testbericht von The Register rund 4.000 US-Dollar und laufen quantisierte Modelle bis in den Bereich von etwa 100 Milliarden Parametern. Drittens: Wer heute Rechenzentrums-Beschleuniger auf den Schreibtisch stellt, braucht auch die Sicherheitsdisziplin eines Rechenzentrums. Eine Workstation mit Terabytes an Firmendaten im Modell-Kontext ist ein hochwertiges Ziel, kein Bastelrechner.
Konkrete Praxis-Tipps
- Erst den Bedarf messen, dann Hardware kaufen: Welche Modellgröße brauchst du wirklich? Ein 30B-Modell in 4-Bit läuft auf 24 GB VRAM; 70B braucht etwa 48 GB; ab 400B wird es teuer. Nach meiner Erfahrung enden die meisten Business-Anwendungen bei 70B.
- Strom und Kühlung einplanen: Vier Karten mit je 450 bis 600 W (The Register erwartet in der Halo Station die 450-W-Konfiguration) plus CPU überfordern eine normale Steckdose. Auch kleinere Multi-GPU-Setups brauchen einen eigenen Stromkreis und Klimatisierung.
- Software-Stack prüfen: AMD läuft über ROCm, nicht CUDA. Für Inferenz mit llama.cpp, vLLM oder Ollama ist das inzwischen gut abgedeckt; bei exotischen Trainings-Frameworks lohnt ein Test vor dem Kauf.
- Einstieg unterhalb der Halo-Klasse: Welche Hardware für lokale LLMs heute sinnvoll ist – von der Grafikkarte bis zum Mini-PC mit Unified Memory – haben wir im Ratgeber Hardware für lokale KI zusammengestellt.
Einordnung
Die Ankündigung fällt in eine Woche, in der Nvidia die Übernahme von Hugging Face angekündigt hat – des zentralen Marktplatzes für offene Modelle. Dass AMD genau jetzt eine Maschine für die größten offenen Modelle zeigt, wirkt kaum zufällig. Ob die Halo Station 2027 tatsächlich so kommt, wird sich zeigen; Prototypen auf Messen haben eine wechselhafte Geschichte. Die Richtung stimmt aber: Wer lokale KI ernst nimmt, bekommt Auswahl. Und Auswahl drückt Preise.
Quellen
- AMD: Threadripper Halo Station – Produktseite mit Spezifikationen und FAQ
- The Register: AMD’s Threadripper Halo is a local-AI workstation for researchers with deep pockets (04.09.2026)
- Tom’s Hardware: AMD unveils Threadripper Halo Station (04.09.2026)
- ServeTheHome: AMD Announces Threadripper Halo Station
Diese Analysen als Newsletter
Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.
Jetzt anmelden