Ein leistungsfähiger KI-Assistent braucht kein Rechenzentrum mehr. 2026 betreibt ein Mini-PC in Taschenbuchgröße ein nützliches großes Sprachmodell vollständig auf Ihrem Schreibtisch — kein Cloud-Konto, kein Token-Zähler, nichts verlässt das Haus. Die schwierige Frage ist nicht mehr, ob Sie selbst hosten können, sondern welche Box Sie kaufen sollten.
Dieser Ratgeber vergleicht die Mini-PCs und kompakten Workstations, auf denen sich ein lokaler KI-Kern lohnt, gruppiert nach dem, was sie tatsächlich leisten. Wenn Sie nur die engere Auswahl mit aktuellen Preisen und Bezugsquellen möchten, springen Sie zur Hardware-Seite — sie bleibt aktuell. Wenn Sie zuerst die Abwägungen verstehen wollen, lesen Sie weiter.
Was einen Mini-PC für lokale KI wirklich gut macht
Eine Zahl entscheidet fast alles: der Speicher. Ein Sprachmodell muss in schnellen Speicher passen, um gut zu laufen, und die Größe des betreibbaren Modells ist dadurch begrenzt, wie viel Speicher der Chip ansprechen kann.
- Ein Modell mit 7–14 Milliarden Parametern, auf 4-Bit quantisiert, braucht rund 8–16 GB. Jeder moderne Mini-PC mit 32 GB schafft das mühelos.
- Ein Modell mit 70 Milliarden Parametern braucht etwa 40 GB — deshalb haben die interessanten Boxen 128 GB Unified Memory, von denen bis zu 96 GB der GPU zugewiesen werden können.
Nach der Kapazität zählen drei Dinge, in dieser Reihenfolge: Speicherbandbreite (wie schnell Token herauskommen), der Software-Stack (CUDA, Metal oder ROCm/Vulkan) und erst dann die reine Rechenleistung. Eines zählt weniger, als das Marketing nahelegt: die NPU. Die „50 TOPS"-Copilot+-Zahl verkauft Laptops, aber lokale LLM-Inferenz läuft auf der integrierten GPU, nicht auf der NPU. Die Silizium-Abwägungen erklären wir in AMD vs. Intel vs. Apple vs. NVIDIA für lokale LLMs, und wie Sie Speicher zum Modell passend dimensionieren, in welche Hardware Sie für ein lokales LLM brauchen.
Die Einstiegsklasse: eine Wissensbasis, 7–14B
Hier sollten die meisten kleinen Unternehmen beginnen. Ein einzelner NPU-/iGPU-Mini-PC, 32–96 GB RAM, eine Wissensbasis, ein öffentlicher Agent. Das sind die Boxen, die Sie heute kaufen und an einem Nachmittag in Betrieb nehmen können.
| Gerät | Modelle | Speicher | Rechenleistung | Preis |
|---|---|---|---|---|
| Minisforum AI X1 Pro | 7–14B + long context | up to 96 GB (upgradeable) | Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS | ab €739 |
| GEEKOM A8 | 7–14B | up to 64 GB (upgradeable) | Ryzen 9 8945HS · Radeon 780M | ab €759 |
| Minisforum UM890 Pro | 7–14B | up to 96 GB (upgradeable) | Ryzen 9 8945HS · Radeon 780M | ab €489 |
| GMKtec EVO-X1 | 7–14B | 32 GB LPDDR5X-7500 | Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS | ab €880 |
| Beelink SER9 Pro | 7–14B | 32 GB LPDDR5X-7500 | Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS | ca. €1,000 |
| ASUS NUC 14 Pro AI | 7–14B | up to 96 GB | Intel Core Ultra · Arc · 48 TOPS | ca. €1,250 |
Ein paar Anmerkungen zum Feld:
- Der Minisforum AI X1 Pro ist unsere Standardempfehlung — er nimmt bis zu 96 GB aufrüstbaren Speicher auf, was im Verhältnis zum Preis die größte Reserve der Klasse bietet.
- Der GEEKOM A8 ist die verlässliche Preis-Leistungs-Wahl, mit drei Jahren Garantie und EU-Versand.
- Der Minisforum UM890 Pro ist die günstigste Box, die noch qualifiziert — eine gute Wahl für ein einzelnes KMU mit einer Wissensbasis.
- Der GMKtec EVO-X1 hat die höchste Speicherbandbreite der Klasse, was sich in mehr Token pro Sekunde niederschlägt.
- Der Beelink SER9 Pro ist am schlüsselfertigsten — er liefert ein lokales Modell startklar.
- Der ASUS NUC 14 Pro AI ist die Wahl für Intel-/vPro-Umgebungen, die Flottenverwaltung schätzen.
Jede dieser Boxen betreibt ein 7–14B-Modell gut — genug, um Kundenfragen aus Ihren Dokumenten zu beantworten, Antworten zu entwerfen und Ihr eigenes Wissen zu durchsuchen. Die aktuellen Spezifikationen und die offengelegten Kauf-Links finden Sie auf der Hardware-Seite.
Die Leistungsklasse: ein 70B in einer Box
Wenn Sie mehrere Wissensbasen oder ein einzelnes größeres 70B-Modell für schärfere Antworten möchten, steigen Sie auf eine Maschine mit 128 GB Unified Memory oder eine schnelle dedizierte GPU um.
| Gerät | Modelle | Speicher | Rechenleistung | Preis |
|---|---|---|---|---|
| Minisforum MS-S1 MAX | 30–70B (clusters higher) | 128 GB unified | Ryzen AI Max+ 395 · Radeon 8060S | ab €2,679 |
| Apple Mac Studio M3 Ultra | 30–100B+ | 96–256 GB unified | M3 Ultra · 819 GB/s bandwidth | ab €4,799 |
| NVIDIA DGX Spark | 30–70B (infer to ~200B; ~405B linked) | 128 GB unified | GB10 Grace Blackwell · full CUDA | ca. €4,800 |
| RTX 5090 SFF Workstation | ~30B, very fast | 32 GB GDDR7 + system RAM | GeForce RTX 5090 · CUDA · 1,792 GB/s | ab €3,999 |
| Beelink GTR9 Pro | 30–70B | 128 GB unified | Ryzen AI Max+ 395 · Radeon 8060S | ca. €4,000 |
| Framework Desktop | 30–70B | 128 GB unified | Ryzen AI Max+ 395 'Strix Halo' | ca. €2,400 |
Hier teilt sich die Wahl nach dem Software-Ökosystem. Der Minisforum MS-S1 MAX und der Beelink GTR9 Pro sind AMD-„Strix-Halo"-Boxen, die ein 70B im Unified Memory laden und sich clustern lassen. Der Apple Mac Studio M3 Ultra hat die mit Abstand höchste Speicherbandbreite und ist damit die schnellste reine Inferenz-Box (läuft aber über Metal, nicht CUDA). Der NVIDIA DGX Spark tauscht rohes Tempo gegen volles CUDA und den stärksten Software-Stack. Der RTX 5090 SFF ist die schnellste Option für Modelle, die in seine 32 GB VRAM passen. Wir lassen sie in Kann ein Mini-PC ein 70B-Modell betreiben? direkt gegeneinander antreten.
Für 70B-plus-Modelle, die vielen Mandanten gleichzeitig bereitgestellt werden, verlassen Sie das Mini-PC-Terrain in Richtung Workstation — die Hardware-Seite führt diese ebenfalls, auf Anfrage.
Die Wahl in einer Minute
- Eine Wissensbasis, knappes Budget → ein Einstiegs-Mini-PC. Beginnen Sie mit dem Minisforum AI X1 Pro oder dem GEEKOM A8.
- Mehrere Wissensbasen oder ein 70B → eine 128-GB-Leistungsbox wie der MS-S1 MAX oder ein Mac Studio, wenn leise, schnelle Inferenz am wichtigsten ist.
- Viele Mandanten oder maximaler Durchsatz → eine Workstation mit dedizierter GPU (sprechen Sie uns für ein Angebot an).
Unsicher, auf welcher Seite der Linie Sie stehen? Die ehrliche Antwort lautet meist: „kleiner anfangen, als Sie denken." Ein 14B-Modell auf einer Einstiegsbox (ab ~490 €, indikativ) überrascht die meisten. Eine größere Box lässt sich später ergänzen — das Wissen und die Governance ziehen mit um.
Ein Vorbehalt: Preise bewegen sich
KI-Hardwarepreise waren 2026 wegen der Speicherknappheit ungewöhnlich volatil — manche Boxen bewegten sich in einem einzigen Monat zweistellig. Behandeln Sie jede Zahl (auch unsere) als indikativ und bestätigen Sie den aktuellen Preis vor der Bestellung. Wir prüfen die Hardware-Seite monatlich und versehen sie mit einem Datum; einige ihrer Links sind Affiliate-Links (klar gekennzeichnet) — die Nutzung kostet Sie nichts extra und hilft, den offenen Kern frei zu halten.
Die Box ist nur die halbe Miete
Ein Mini-PC, der ein nacktes Modell betreibt, ist eine vertrauliche Datenbank, die ihre eigenen Geheimnisse jedem vorliest, der fragt. Was eine lokale KI sicher genug macht, um sie Kunden vorzusetzen, ist die Governance darum herum — die Grenze zwischen Ihrem internen Wissen und dem öffentlichen Agenten und die Schleife, die ihn verbessert. Das, nicht die Hardware, ist das eigentliche Produkt; wir begründen es in Das Produkt ist Governance und erklären das Souveränitätsmodell in Souveräne KI, erklärt.
Wählen Sie also die Box, die zu Ihrem Wissen passt — und setzen Sie dann einen gesteuerten Kern darauf. Wenn Sie das ganze Bild möchten, inklusive echte Kosten im Vergleich zur Cloud und Compliance, beginnen Sie mit unserem Leitfaden zum lokalen KI-Hosting für den Mittelstand oder sehen Sie die vollständige Hardware-Auswahl.