Ihre KI läuft auf einem Gerät,
das Ihnen gehört.
Ein souveräner Assistent auf einem Mini-PC in Ihrem Regal — keine Cloud zur Miete. Einmalige Hardware, keine Abrechnung pro Token, und Ihr Wissen verlässt nie das Haus.
Souveränität, auf die Sie zeigen können
Die Box macht das Produkt greifbar. Zeigen Sie auf das Regal — dort liegen Ihre Daten, dort denkt die KI, und dort ruht Ihre Compliance-Aufstellung.
Ihr Wissen verlässt nie das Haus
Das Modell läuft auf der Appliance, in Ihrem Netzwerk. Keine Eingaben, keine Dokumente, keine Embeddings wandern in eine fremde Cloud.
Keine Cloud-Rechnung pro Token
Die Inferenz läuft auf einmal gekaufter Hardware. Die laufenden Kosten sind ein dünner Ausläufer für Governance und Updates — kein Zähler, der bei jeder Frage tickt.
Compliance, greifbar gemacht
On-Premises by Design — so ruht Ihre Aufstellung zu DSGVO und EU-KI-Verordnung auf Hardware, auf die Sie zeigen können, mit der regulatorischen Ebene durch Cloud Shield statt einer Richtlinie, auf die Sie hoffen.
Es gehört Ihnen — forken Sie alles außer der Haftung
Der offene Kern läuft auf handelsüblicher Hardware, die Sie kontrollieren. Nichts bindet Sie an uns außer dem Teil, den Sie nie besitzen wollen: Zertifizierung und Haftung.
Was aus einem Mini-PC eine Appliance macht
Aus einer handelsüblichen Box wird ein versiegelter, souveräner KI-Kern durch das Betriebssystem, das darauf läuft. WegentyOS ist das gehärtete, Linux-basierte OS-Image — ausgeliefert als installierbares ISO und auf das Gerät geflasht. Appliance × WegentyOS = KI-Kern.
Ein OS, kein Desktop
Eine Linux-Basis, eigens dafür gebaut, quelloffene Modelle direkt auf dem Gerät zu betreiben — Inferenz-Laufzeit, der Connector-Daemon, die gesteuerte Antwort-Pipeline und die Admin-Konsole sind vorhanden und konfiguriert, sonst nichts. Kein Allzweck-Desktop, keine Telemetrie als Standard.
Standardmäßig versiegelt
Keine eingehenden Ports. Der Kern ist nur über den ausgehenden Connector-Tunnel erreichbar, den er selbst aufbaut — eine minimale Angriffsfläche, mit gehärteten Voreinstellungen statt einer Box, die Sie erst absichern müssen.
Signierte, unveränderliche Updates
Image-basierte, atomare und rücksetzbare Updates im Rahmen des Wartungsvertrags — die Appliance konvergiert stets auf einen signierten, geprüften Stand. Genau das macht aus dem Hardware- und Update-Vertrag eine wartbare Einheit statt einer Einzelfall-Installation.
Quelloffen wie der Rest des Stacks — alles außer Cloud Shield ist überprüfbar.
Das passende Gerät für Ihr Wissen
Jede Box hier kann einen gesteuerten Wegenty-Kern betreiben. Dimensionieren Sie sie danach, wie viel Sie lokal betreiben möchten — eine Wissensbasis oder mehrere mit einem 70B-Modell in einem Gerät.
Transparenz — einige Links hier sind Affiliate-Links (Werbung). Kaufen Sie darüber, erhalten wir ggf. eine kleine Provision, ohne Mehrkosten für Sie. Wir listen nur Geräte, die wir selbst betreiben würden. Preise sind indikativ (Juni 2026) und verändern sich mit dem Markt — prüfen Sie den aktuellen Preis vor dem Kauf.
Einstieg
7–14B · eine Wissensbasis · ab ~490 €
NPU-/iGPU-Mini-PCs für ein einzelnes KMU mit einer Wissensbasis und einem öffentlichen Agenten.
Minisforum AI X1 Pro
Unsere EmpfehlungBeste Speicherreserve seiner Klasse — unsere Standard-Box mit Luft nach oben.
- Modelle
- 7–14B + long context
- Speicher
- up to 96 GB (upgradeable)
- Rechenleistung
- Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS
GEEKOM A8
Bestes Preis-LeistungDer verlässliche Preis-Einstieg — 3 Jahre Garantie und EU-Versand.
- Modelle
- 7–14B
- Speicher
- up to 64 GB (upgradeable)
- Rechenleistung
- Ryzen 9 8945HS · Radeon 780M
Minisforum UM890 Pro
Die günstigste qualifizierte Box — ein KMU, eine Wissensbasis.
- Modelle
- 7–14B
- Speicher
- up to 96 GB (upgradeable)
- Rechenleistung
- Ryzen 9 8945HS · Radeon 780M
GMKtec EVO-X1
Höchste Speicherbandbreite im Einstieg — mehr Token pro Sekunde.
- Modelle
- 7–14B
- Speicher
- 32 GB LPDDR5X-7500
- Rechenleistung
- Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS
Beelink SER9 Pro
Am schlüsselfertigsten — liefert ein lokales Modell startklar.
- Modelle
- 7–14B
- Speicher
- 32 GB LPDDR5X-7500
- Rechenleistung
- Ryzen AI 9 HX 370 · Radeon 890M · 50 TOPS
ASUS NUC 14 Pro AI
Die Intel-/vPro-Wahl — die stärksten Argumente für die Flottenverwaltung.
- Modelle
- 7–14B
- Speicher
- up to 96 GB
- Rechenleistung
- Intel Core Ultra · Arc · 48 TOPS
Leistung
30–70B · mehrere Wissensbasen · ~2.400–6.000 €
Unified-Memory-Boxen (128 GB) oder eine schnelle dedizierte GPU — ein 70B-Modell in einem Gerät.
Minisforum MS-S1 MAX
Unsere EmpfehlungBetreibt ein 70B in einer Box — Cluster-fähig für mehrere Wissensbasen.
- Modelle
- 30–70B (clusters higher)
- Speicher
- 128 GB unified
- Rechenleistung
- Ryzen AI Max+ 395 · Radeon 8060S
RTX 5090 SFF Workstation
Am schnellstenAm schnellsten für Modelle bis 32 GB — CUDA-Durchsatzführer der Klasse.
- Modelle
- ~30B, very fast
- Speicher
- 32 GB GDDR7 + system RAM
- Rechenleistung
- GeForce RTX 5090 · CUDA · 1,792 GB/s
Beelink GTR9 Pro
Beste Vernetzung — zwei 10-GbE für einen Vor-Ort-Cluster oder HA-Paar.
- Modelle
- 30–70B
- Speicher
- 128 GB unified
- Rechenleistung
- Ryzen AI Max+ 395 · Radeon 8060S
NVIDIA DGX Spark
Volles CUDA plus 128 GB — der cloud-konsistente Weg mit dem stärksten Software-Stack.
- Modelle
- 30–70B (infer to ~200B; ~405B linked)
- Speicher
- 128 GB unified
- Rechenleistung
- GB10 Grace Blackwell · full CUDA
Apple Mac Studio M3 Ultra
Größte KapazitätSchnellste reine Inferenz — leise und stromsparend. Direktkauf (kein Affiliate-Link).
- Modelle
- 30–100B+
- Speicher
- 96–256 GB unified
- Rechenleistung
- M3 Ultra · 819 GB/s bandwidth
Framework Desktop
Offene ReferenzDie offene, reparierbare Referenz-Box. Nur Direktkauf — selbst kaufen, wir installieren.
- Modelle
- 30–70B
- Speicher
- 128 GB unified
- Rechenleistung
- Ryzen AI Max+ 395 'Strix Halo'
Workstations & Multi-Mandanten-Knoten
Für 70B-plus-Modelle mit Tempo oder viele gesteuerte Wissensbasen auf einer Box wird aus der Appliance eine Workstation. Diese laufen über einen Reseller und werden auf Ihren Aufbau hin angeboten — sprechen Sie mit uns.
NVIDIA RTX PRO 6000 Workstation
ab €12,000Premium — schnell UND es passt: ein 70B mit Tempo und cloud-konsistentem CUDA.
- Modelle
- 70B+ · high concurrency
- Speicher
- 96 GB GDDR7 ECC
- Rechenleistung
- RTX PRO 6000 Blackwell · CUDA
Dual RTX PRO 6000 Workstation
ab €22,000Das Multi-Mandanten-Flaggschiff im Tower — viele Wissensbasen aus einem Knoten.
- Modelle
- 70–120B · multi-tenant
- Speicher
- 192 GB GDDR7 (2× 96 GB)
- Rechenleistung
- 2× RTX PRO 6000 Blackwell
NVIDIA DGX Station GB300
Auf AnfrageDie definitive Vor-Ort-Appliance für mehrere Mandanten — bis zu sieben isolierte Mandanten.
- Modelle
- 70B → 1T · 7 isolated tenants
- Speicher
- 748 GB coherent
- Rechenleistung
- GB300 Grace Blackwell Ultra
Preise indikativ · Juni 2026
Eine Beraterin oder ein Berater liefert, installiert und betreibt sie.
Sie müssen nichts beschaffen oder einrichten. Eine Beraterin oder ein Berater Ihres Vertrauens liefert die vorinstallierte Appliance, installiert sie an einem Nachmittag, bindet Ihr Wissen ein und wartet sie — Box, Einrichtung und Support als eine Beziehung.
Sie sind die Beraterin oder der Berater?
Die Appliance ist eine Vertriebslinie zusätzlich zum Abonnement, das Sie ohnehin betreiben. So verdienen Partner an der Hardware.
An Hardware verdienenFragen zur Hardware
Welche Box soll ich nehmen?
Gehen Sie davon aus, wie viel Sie lokal betreiben möchten. Eine Wissensbasis für ein einzelnes KMU → ein Einstiegs-Mini-PC (der Minisforum AI X1 Pro ist unsere Standardwahl). Mehrere Wissensbasen oder ein 70B-Modell in einer Box → ein Leistungsgerät wie der MS-S1 MAX. Viele Mandanten oder maximales Tempo → eine Workstation. Im Zweifel buchen Sie eine Demo und wir legen es gemeinsam fest.
Läuft das wirklich offline?
Ja. Ein rein lokaler Kern braucht überhaupt kein Internet — das Sprachmodell und Ihre Wissensbasis liegen auf der Appliance, in Ihrem eigenen Netzwerk, und jede Antwort entsteht genau dort. Cloud Shield ist der optionale öffentliche Rand: Wenn der Assistent von außen erreichbar sein soll, baut der Kern den Connector-Tunnel von sich aus nach außen auf (keine eingehenden Ports, kein erzwungenes Nach-Hause-Telefonieren), und über dieselbe Verbindung kommen signierte Updates. Bleiben Sie vollständig lokal, oder ergänzen Sie den öffentlichen Rand — die Wahl liegt bei Ihnen.
Welche Modelle laufen darauf?
Einstiegs-Mini-PCs betreiben 7–14B-Modelle in 4-Bit komfortabel. Die 128-GB-Unified-Memory-Boxen halten ein 70B-Modell in einem Gerät; Workstations mit 96 GB VRAM (oder mehr) betreiben 70B-plus mit vollem Tempo und bedienen mehrere Wissensbasen gleichzeitig.
Muss ich über eure Links kaufen?
Nein. Kaufen Sie das Gerät, wo Sie möchten — die Empfehlungen gelten unabhängig davon. Die Affiliate-Links sind nur, wie wir die Pflege dieses Leitfadens gegenfinanzieren; ihre Nutzung kostet Sie nichts extra und hilft, den offenen Kern frei zu halten.
Ist die Hardware Teil des Abonnements?
Nein — die Box ist ein Einmalkauf, der Ihnen vollständig gehört. Das Abonnement deckt Governance, Updates und Support darum herum ab. Genau diese Trennung ist der Punkt: Die Hardware bleibt Ihnen, selbst wenn Sie irgendwann gehen.
Was läuft sonst noch auf der Box?
Mehr als das Modell. Derselbe Kern beherbergt auch das souveräne CRM auf dem Kern und die passwortlosen Konten Ihrer Kundschaft — die Concierge-Ebene, mit der der Assistent wiederkehrende Kundschaft erkennt und ihre Historie mitführt. Wie alles andere liegen diese Kontaktdaten auf Ihrem eigenen Kern, niemals in einer fremden Cloud.
Warum ändern sich die Preise?
Die Speicherknappheit 2026 hat KI-Hardware ungewöhnlich volatil gemacht — manche Boxen bewegten sich in einem einzigen Monat zweistellig. Wir prüfen diese Liste monatlich und versehen sie mit einem Datum, aber bestätigen Sie den aktuellen Shop-Preis stets vor der Bestellung.
Unsicher, welche Box passt?
Sagen Sie uns, wie viel Sie lokal betreiben möchten, und wir legen die Appliance gemeinsam fest — unverbindlich.