Lokale KI.
Nachgeprüft.
Ihre Daten bleiben im Haus. Und Sie wissen, ob die Antworten stimmen.
Das Problem
Kommt Ihnen
das bekannt vor?
Schatten-KI
Mitarbeiter kopieren längst interne Daten in ChatGPT und ähnliche Dienste. Niemand weiß genau, was dort landet.
Blockiertes Projekt
Das KI-Projekt steht, weil Datenschutz oder Kundenverträge verbieten, dass Daten das Haus verlassen.
Unklare Qualität
Der Pilot läuft, aber niemand kann sagen, ob die Antworten stimmen oder nach dem letzten Modell-Update schlechter geworden sind.
Alle drei lassen sich lösen, ohne dass Ihre Daten das Haus verlassen.
Das Kauderwelsch
Installieren kann jeder.
Richtig einstellen nicht.
Ollama oder vLLM laufen in einer Stunde. Danach fangen die Fragen an:
- Welches Modell ist das beste?
- Q4_K_M oder Q8?
- 27B oder 122B?
- MoE oder dense?
- Temperatur 0,2 oder 0,7?
- top_p, top_k, min_p?
- 32k oder 128k Kontext?
- KV-Cache voll?
- Speculative Decoding?
- Warum ist es plötzlich schlechter?
Die müssen Sie nicht beantworten. Ich wähle Modell und Einstellungen für Ihre Aufgabe und Ihre Hardware und messe, ob es wirklich besser wird.
Zum Setup-ReviewAb dem 2. Dezember 2027. Die ursprüngliche Frist vom 2. August 2026 wurde durch den Digital Omnibus verschoben.
Pakete
Vier Wege
zum Einstieg.
Local AI Check
Ihre Anwendungsfälle, Ihre Daten, Ihre Hardware. Ich prüfe, was lokal sinnvoll läuft und was es kostet.
Setup-Review
Ollama, vLLM oder ein fertiger KI-Server läuft schon, aber die Antworten überzeugen nicht. Ich prüfe Modellwahl, Quantisierung, Kontext, Sampling und Prompts.
Pilot im eigenen Haus
Ein Modell in Ihrer Infrastruktur für einen echten Anwendungsfall, vom einzelnen GPU-Server bis zum Kubernetes-Cluster. Mit Zugriffsrechten, Logging und Kreuzprüfung.
Qualität im Betrieb
Tests aus Ihren echten Fragen. Jeder Modell- oder Prompt-Wechsel wird gemessen, bevor er live geht.
Wenn der Check zeigt, dass sich lokale KI für Sie nicht lohnt, sage ich Ihnen das.
Alle Preise zzgl. MwSt. Hardware ist nicht enthalten.
Ausbaustufen
Schlüsselfertig,
mit Hardware.
Server von Wortmann aus Deutschland. Ich richte sie ein, prüfe die Qualität und betreue den Betrieb.
Kompakt
Ein Server mit einer GPU für eine interne Chat-KI und die Suche in Ihren Dokumenten.
- Wortmann-Server mit GPU
- Chat-Oberfläche mit Firmen-Login, auf Ihre Nutzer reduziert
- Anbindung Ihrer Dokumente
- Kreuzprüfung der Antworten
- Einrichtung und Schulung
Unternehmen
Mehrere GPUs für mehr gleichzeitige Nutzer, mehrere Modelle und die Anbindung an Ihre Fachsysteme.
- Alles aus Kompakt
- Mehrere Modelle parallel
- Rechte pro Abteilung
- Monatlicher Qualitätsbericht
Rechenzentrum
Mehrere Server auf Kubernetes, ausfallsicher und auf Wunsch komplett ohne Internetverbindung.
- Alles aus Unternehmen
- Hochverfügbarkeit auf Kubernetes
- Betrieb ohne Internet (Air-Gap)
- Dokumentation für Audits
Warum hier keine Hardwarepreise stehen: Arbeitsspeicher und SSDs sind derzeit knapp, die Preise ändern sich von Woche zu Woche. Sie bekommen ein verbindliches Angebot zum Tagespreis.
Branchen
Wo ich
herkomme.
Über 20 Jahre Infrastruktur in diesen Branchen. Ich kenne die Auflagen, bevor wir über KI reden.
Energie & Versorgung
Netz- und Anlagendaten, KRITIS-Auflagen, getrennte Netze.
Öffentliche Verwaltung
Bürger- und Personaldaten, Vergaberecht und der Wunsch nach Unabhängigkeit von US-Anbietern.
Industrie & Fertigung
Konstruktionsdaten, Fertigungswissen und Dokumentation, die das Werk nicht verlassen sollen.
Logistik
Kunden-, Sendungs- und Vertragsdaten über viele Standorte hinweg.
Wer das baut
Keine Folien.
Laufende Systeme.
Ich bin kein KI-Stratege. Ich bin Plattform-Engineer mit über 20 Jahren Linux und Kubernetes in Energie, Logistik, Behörden und Industrie.
Was ich empfehle, läuft vorher bei mir. Wenn ein Framework einen Speicherfehler hat, finde ich ihn und melde ihn. Wenn ein Modell anfängt zu driften, will ich das sehen, bevor es jemand anderes merkt.
Powered by Froala Editor
Eigene Systeme
Täglich im Einsatz.
Kvasir
Mein Prüfstand. Damit teste ich Modelle und Einstellungen, bevor sie zu Ihnen kommen, und messe im Betrieb die Qualität. Auf Wunsch entsteht daraus auch eine auf Ihr Unternehmen zugeschnittene Lösung.
NOMI
Private KI auf eigener Hardware, mit Gedächtnis und Stimme. Jedes selbst vorgeschlagene Verhalten gibt ein Mensch frei.
SiliconTrailer
Mein App-Studio. Native Apps für Mac und iOS, deren Daten auf dem Gerät bleiben.
Fragen
Häufige
Fragen.
Welches Modell ist das beste?
Das beste Modell gibt es nicht. Es gibt das passende für Ihre Aufgabe und Ihre Hardware, und das zeigt sich erst an Ihren eigenen Fragen. Deshalb teste ich mehrere Kandidaten mit einem Testsatz, bevor ich eines empfehle.
Ist die Qualität so gut wie bei ChatGPT?
Für die meisten Büroaufgaben wie Zusammenfassen, Dokumentensuche und Entwürfe reichen aktuelle offene Modelle. Bei sehr anspruchsvollem Denken liegen die großen Cloud-Modelle noch vorn. Im Check teste ich das mit Ihren echten Aufgaben, bevor Sie Hardware kaufen.
Woher wissen wir, dass die Antworten stimmen?
Antworten können von einem zweiten Modell gegengeprüft werden, und ein fester Testsatz aus Ihren eigenen Fragen misst die Qualität bei jeder Änderung. Sie sehen das Ergebnis im monatlichen Bericht.
Bekommen wir Kvasir?
Nicht als fertiges Produkt. Ihre Mitarbeiter bekommen eine schlanke Chat-Oberfläche mit vorbereiteten Assistenten, ohne Modellauswahl und Einstellungsdschungel. Kvasir ist mein Werkzeug, mit dem ich prüfe, was bei Ihnen läuft. Wenn Sie mehr brauchen, baue ich auf dieser Grundlage eine auf Sie abgestimmte Lösung.
Warum stehen hier keine Hardwarepreise?
Arbeitsspeicher und SSDs sind seit Herbst 2025 knapp, manche Preise haben sich vervielfacht und ändern sich laufend. Ein Preis auf dieser Seite wäre schnell falsch. Sie bekommen über Wortmann ein Angebot zum Tagespreis.
Braucht der Server eine Internetverbindung?
Nein. Im Betrieb läuft alles im eigenen Netz. Neue Modelle und Updates lassen sich auch ohne Internet einspielen.
Was passiert, wenn bessere Modelle erscheinen?
Ein neues Modell läuft zuerst durch Ihren Testsatz. Nur wenn es besser abschneidet, spiele ich es nach Ihrer Freigabe ein.
Wir haben kein Kubernetes. Geht das trotzdem?
Ja. Für die meisten Firmen reicht ein einzelner Server. Kubernetes lohnt sich erst bei mehreren Servern oder hohen Anforderungen an die Verfügbarkeit.
Kontakt
Reden wir über
Ihre Daten.
30 Minuten, kostenlos, mit Live-Demo. Direkt oder über Ihren Vermittler buchbar. Ich antworte auf Deutsch, Dänisch oder Englisch.
Christopher Rau
Gründer von OpnViking, seit über 20 Jahren Linux- und Kubernetes-Engineer
OpnViking ApS