Die Frage fällt in fast jedem ersten Verkaufsgespräch, und sie ist berechtigt: „Kann ich nicht einfach mein ChatGPT – oder mein Claude – an meinen Kunden-Chat anschließen?"
Die kurze Antwort lautet: ja. Die wichtige Antwort lautet: nicht so, wie Sie es sich gerade vorstellen. Ein rohes Frontier-Modell direkt in einen Website-Chat zu verdrahten, ist genau die Haftungsmaschine, die Wegenty verhindern soll. Es hat keine gesteuerte Wissensbasis, keine Quellenangaben, keine Erdungsprüfung und keine ehrliche Möglichkeit zu sagen „Das weiß ich nicht". Eine selbstbewusste, unbelegte, erfundene Antwort an Ihre Kundschaft ist ein reales Risiko – und rechtliche Unsicherheit ist bereits der mit Abstand am häufigsten genannte Grund, warum der Mittelstand beim Thema KI zögert.
Deshalb drehen wir die Perspektive um. Sie verbinden ein Modell nicht mit Ihren Kunden. Sie verbinden ein Modell mit Wegentys Governance-Schicht, und Wegenty spricht mit Ihren Kunden. Das Modell wird zu einer konfigurierbaren Komponente. Alles, was die Antwort vertrauenswürdig macht, bleibt genau dort, wo es ist.
Das Modell ist die Maschine, nicht das Auto
Hier ist die unbequeme Wahrheit für jeden „Powered by [großer KI-Name]"-Pitch: Das Modell ist eine Massenware. Eine austauschbare Maschine. Es ist nicht das Produkt.
Das Produkt ist die gesteuerte Pipeline um das Modell herum – die gesteuerte Projektion Ihres Wissens, das geerdete Retrieval, die Quellenprüfung, der Eskalationspfad. Diese Pipeline ist dieselbe, egal ob die Maschine, die die Tokens berechnet, ein kleines Modell auf Ihrem eigenen Gerät ist oder ein Frontier-Modell in einer Anbieter-Cloud.
Der Wechsel der Maschine ändert, wer die Tokens berechnet – nicht, was der Agent sagen darf.
Diese Unterscheidung ist der Kern dieses Beitrags. Weil die Inferenz bereits hinter einer einzigen internen Fassade läuft, dürfen Sie wählen, welches Gehirn Ihren öffentlichen Chat antreibt – ohne eine einzige Governance-Garantie anzutasten. Die Modellwahl ist ein Regler für Leistung, Kosten und Souveränität. Sie ist kein Regler für Governance.
Drei Stufen von Gehirn
Wir treiben Kundschaft nicht auf einer Leiter immer leistungsstärkerer Modelle nach oben. Wir machen die sicherste Option mühelos und alles Übrige zu einer informierten, protokollierten Entscheidung, die Ihr Berater mit offenen Augen trifft. Drei Stufen:
- Lokal (Voreinstellung) – volle Souveränität. Ein Modell läuft auf Ihrem eigenen Gerät. Kein Fragetext verlässt jemals das Haus. Das ist das Versprechen von Cloud Shield in seiner reinsten Form: DSGVO-sauber, planbar im Festpreis, nichts kann abfließen, weil nichts das Haus verlässt. Es ist nicht ohne Grund die Voreinstellung.
- Frontier-EU – partielle Souveränität, auf Anfrage. Claude oder GPT, fest an eine EU-Region gebunden (Frankfurt, Irland, Paris) mit EU-Datenresidenz und ohne Training auf Ihren Daten. Ihre Daten bleiben in der EU, verlassen aber das Gerät. Die richtige Wahl, wenn eine Kundin wirklich Reasoning-Qualität auf Frontier-Niveau braucht und eine Auftragsverarbeiter-Beziehung mit einem EU-ansässigen Anbieter akzeptiert.
- Frontier-global – nur auf ausdrücklichen Wunsch. Die Standard-Endpunkte von Claude oder ChatGPT, US-Cloud als Standard. Wir weisen ehrlich darauf hin, dass dies die souveräne Voreinstellung durchbricht. Diese Stufe existiert für den seltenen, unkritischen Fall – und ist nie der empfohlene Weg.
Die Aufgabe dieses Menüs ist kein Upselling. Sie besteht darin, lokal zur mühelosen Voreinstellung zu machen und die Cloud-Stufen zu einer bewussten Entscheidung pro Instanz – souverän per Voreinstellung, nicht per Upsell.
Die Invariante, die niemand brechen darf
Welches Gehirn Sie auch wählen: Was die Antwort sicher macht, bewegt sich nicht:
- Der öffentliche Agent sieht weiterhin nur die gesteuerte Projektion Ihres Wissens – niemals die rohe interne Basis.
- Jede Aussage gilt weiterhin Zitat-oder-Schweigen: einem realen Chunk zugeordnet, und sinkt die Erdungs-Zuversicht unter den Schwellenwert von 0,85, ruft der Agent erneut ab oder sagt „nicht gefunden", statt zu raten.
- Ein Erdungs-Richter verwirft weiterhin strukturell jeden Entwurf, den die Belege nicht stützen.
- Ein unsicherer Agent eskaliert weiterhin an einen Menschen, statt zu bluffen – und die Antwort dieses Menschen fließt zurück in die Korrekturschleife, sodass sich das System mit der Zeit summiert.
Nichts davon hängt vom Modell ab. Eine größere Maschine schreibt schönere Prosa; sie erwirbt damit nicht das Recht zu erfinden. Die Governance-Schicht setzt bei einem Frontier-Modell denselben Vertrag durch wie bei einem lokalen mit sieben Milliarden Parametern. Genau deshalb ist „welches Modell" eine Frage, die man getrost offenlassen kann – und eine gefährliche, wenn man sie ohne die Schicht darunter beantwortet.
Die ehrliche Verkaufszeile
Wir können es klar sagen, und wir tun es:
„Bringen Sie das Gehirn mit, dem Sie vertrauen. Wir sorgen dafür, dass es seine Quellen zitiert, innerhalb Ihres freigegebenen Wissens bleibt und an einen Menschen übergibt, wenn es unsicher ist – und das auf dieselbe Weise, ob das Gehirn auf Ihrem Gerät oder in der Cloud sitzt."
Dieser Satz ist der gesamte Pitch. Er ist auch der Grund, warum wir in unserem eigenen Marketing engine-agnostisch bleiben. „Powered by Claude" oder „Powered by ChatGPT" ist ein verlockendes Etikett, doch es lenkt das Rampenlicht auf den austauschbaren Teil. Der Burggraben ist die Governance, nicht das Modell. Das Modell ist nur der Teil, bei dem Sie es sich frei anders überlegen dürfen.
Was das für Sie bedeutet
Wenn Sie einem Modell bereits vertrauen – Ihrem Claude, Ihrem ChatGPT oder einem lokalen, das Sie selbst betreiben –, müssen Sie es nicht aufgeben, um Wegenty einzuführen. Sie verbinden es mit der Schicht, die es sicher genug macht, um es vor eine Kundin zu stellen, und behalten die Freiheit, es später zu wechseln, wenn etwas Besseres erscheint. Die Plattform-Seite führt durch die vollständige Pipeline, in die sich das Modell einklinkt, und die Vergleichsseite zeigt, wie sich das vom bloßen Anschrauben eines Chatbots an Ihre Dokumente unterscheidet.
Möchten Sie sehen, wie ein gesteuerter Agent auf echtem Wissen antwortet – zitiert, wo er kann, eskaliert, wo er es nicht kann? Testen Sie die Live-Demo. Wenn Sie darüber sprechen möchten, welches Gehirn zu Ihrem Unternehmen passt, nehmen Sie Kontakt auf, und wir konkretisieren es gemeinsam.