Internes ChatGPT: KI für Mitarbeitende, ohne Daten preiszugeben
„Wir brauchen keine KI“ — dieser Satz bedeutet fast immer, dass sie längst genutzt wird, nur ohne Ihr Wissen. Der Vertrieb kopiert Angebote in einen Chatbot, Entwickler Teile des Arbeitscodes, Juristen Vertragsentwürfe. Sie tun es über private Konten und Umwege, weil es keinen Firmenzugang gibt: Weder OpenAI noch Anthropic bedient Russland — Abos lassen sich nicht legal bezahlen, die Anmeldung ist regional gesperrt. Das Unternehmen erhält so das Schlechteste aus beiden Welten: Den Nutzen der KI misst niemand, die Daten fließen aber schon ab.
Open WebUI ist eine offene Weboberfläche für Sprachmodelle, die auf Ihrem eigenen Server installiert wird. Sie sieht wie ChatGPT aus: Chatliste links, Eingabefeld, Verlauf, Ordner, gemeinsame Prompt-Bibliotheken. Der Unterschied liegt dahinter: Mitarbeitende melden sich mit dem Firmenlogin an, eine Administration verwaltet Rollen und Gruppen, und jede Anfrage bleibt in Ihrem Protokoll. Die Oberfläche selbst enthält kein Modell — sie führt Nutzende nur zu einem, und genau darum bleibt die Modellwahl bei Ihnen.
Der erste Weg ist ein Modell auf eigener Hardware. Offene Modelle haben kommerzielle bei alltäglichen Arbeitsaufgaben längst eingeholt: Qwen, DeepSeek, Mistral, Gemma und Llama stehen zum Download bereit, für Russisch gibt es einheimische offene Modelle wie T-lite und T-pro von der T-Bank. Betrieben werden sie über Ollama (einfacher) oder vLLM (schneller unter Last). Als Richtwert für die Hardware: Ein Modell mit 7–14 Milliarden Parametern läuft auf einer einzelnen 24-GB-Karte und versorgt eine Abteilung; Modelle mit 30–70 Milliarden brauchen 48–160 GB, also mehrere Karten oder einen eigenen Server. Ein solcher Aufbau ist vollständig autark — er funktioniert ganz ohne Internet, für abgeschottete Netzsegmente oft die einzige zulässige Variante.
Der zweite Weg ist die API eines russischen Anbieters. Wenn GPUs zu kaufen unwirtschaftlich ist, verbindet sich Open WebUI mit jeder OpenAI-kompatiblen API — so werden YandexGPT in Yandex Cloud oder GigaChat von Sber angebunden. Sie zahlen die Nutzung in Rubel per regulärem Vertrag, umgehen nichts, und die Daten bleiben in russischer Jurisdiktion. Das Modell ist dabei fremd, weshalb wir in der Praxis häufig kombinieren: Sensibles auf dem eigenen Modell im Perimeter, alles andere über eine API, wo sie günstiger und leistungsfähiger ist.
Ein eigener Wert entsteht, sobald das Modell an Ihre Dokumente angebunden wird. Open WebUI indexiert Richtlinien, Handbücher, technische Dokumentation und Verträge und antwortet daraus mit Quellenangabe. „Wie beantrage ich eine Dienstreise nach unserer Richtlinie“ ist kein Gang zur Personalabteilung mehr, und neue Kolleginnen und Kollegen erhalten Antworten, ohne das Team eine Woche zu binden.
Wir liefern das schlüsselfertig: Aufgaben klären und Modell auswählen, Server dimensionieren oder API-Kosten kalkulieren, Open WebUI mit Single Sign-on über Keycloak betreiben, Zugriffskontrolle, Protokollierung und Backups einrichten, Mitarbeitende und Administration schulen. Schreiben Sie uns über die Kontaktseite — wir zeigen die Oberfläche und rechnen aus, was in Ihrem Fall günstiger ist: eigene GPU oder API.