✦ Lokale KI aus Dänemark

Lokale KI.
Nachgeprüft.

Ihre Daten bleiben im Haus. Und Sie wissen, ob die Antworten stimmen.

Das Problem

Kommt Ihnen
das bekannt vor?

1

Schatten-KI

Mitarbeiter kopieren längst interne Daten in ChatGPT und ähnliche Dienste. Niemand weiß genau, was dort landet.

2

Blockiertes Projekt

Das KI-Projekt steht, weil Datenschutz oder Kundenverträge verbieten, dass Daten das Haus verlassen.

3

Unklare Qualität

Der Pilot läuft, aber niemand kann sagen, ob die Antworten stimmen oder nach dem letzten Modell-Update schlechter geworden sind.

Alle drei lassen sich lösen, ohne dass Ihre Daten das Haus verlassen.

Das Kauderwelsch

Installieren kann jeder.
Richtig einstellen nicht.

Ollama oder vLLM laufen in einer Stunde. Danach fangen die Fragen an:

  • Welches Modell ist das beste?
  • Q4_K_M oder Q8?
  • 27B oder 122B?
  • MoE oder dense?
  • Temperatur 0,2 oder 0,7?
  • top_p, top_k, min_p?
  • 32k oder 128k Kontext?
  • KV-Cache voll?
  • Speculative Decoding?
  • Warum ist es plötzlich schlechter?

Die müssen Sie nicht beantworten. Ich wähle Modell und Einstellungen für Ihre Aufgabe und Ihre Hardware und messe, ob es wirklich besser wird.

Zum Setup-Review
AI Act Fristen Blick in meinen Prüfstand
YouAb wann gelten die Hochrisiko-Pflichten des AI Act für eigenständige Systeme?
Assistant

Ab dem 2. Dezember 2027. Die ursprüngliche Frist vom 2. August 2026 wurde durch den Digital Omnibus verschoben.

Modell A
Stimmt überein
Modell B
Stimmt überein
Modell C
Nannte 2. August 2026. Veraltetes Wissen, verworfen.
Quelle: Verordnung (EU) 2026/1744 Beispiel

Pakete

Vier Wege
zum Einstieg.

015 Tage

Local AI Check

Ihre Anwendungsfälle, Ihre Daten, Ihre Hardware. Ich prüfe, was lokal sinnvoll läuft und was es kostet.

ErgebnisArchitektur, Hardwarebedarf und Kostenrahmen als Entscheidungsgrundlage.
ab 4.500 € Festpreis Anfragen
022–3 Tage

Setup-Review

Ollama, vLLM oder ein fertiger KI-Server läuft schon, aber die Antworten überzeugen nicht. Ich prüfe Modellwahl, Quantisierung, Kontext, Sampling und Prompts.

ErgebnisMessung vorher und nachher mit Ihren echten Fragen und konkrete Einstellungen, die Sie behalten.
ab 2.500 € Festpreis Anfragen
034 Wochen

Pilot im eigenen Haus

Ein Modell in Ihrer Infrastruktur für einen echten Anwendungsfall, vom einzelnen GPU-Server bis zum Kubernetes-Cluster. Mit Zugriffsrechten, Logging und Kreuzprüfung.

ErgebnisEin laufendes System, dokumentiert und an Ihr Team übergeben.
ab 18.000 € Anfragen
04laufend

Qualität im Betrieb

Tests aus Ihren echten Fragen. Jeder Modell- oder Prompt-Wechsel wird gemessen, bevor er live geht.

ErgebnisEin monatlicher Bericht, ob die Antworten stimmen und ob sich etwas verschlechtert hat.
ab 1.750 € / Monat Anfragen

Wenn der Check zeigt, dass sich lokale KI für Sie nicht lohnt, sage ich Ihnen das.

Alle Preise zzgl. MwSt. Hardware ist nicht enthalten.

Ausbaustufen

Schlüsselfertig,
mit Hardware.

Server von Wortmann aus Deutschland. Ich richte sie ein, prüfe die Qualität und betreue den Betrieb.

20 bis 100 Mitarbeiter

Kompakt

Ein Server mit einer GPU für eine interne Chat-KI und die Suche in Ihren Dokumenten.

  • Wortmann-Server mit GPU
  • Chat-Oberfläche mit Firmen-Login, auf Ihre Nutzer reduziert
  • Anbindung Ihrer Dokumente
  • Kreuzprüfung der Antworten
  • Einrichtung und Schulung
Angebot zum Tagespreis Konfiguration anfragen
100 bis 500 Mitarbeiter

Unternehmen

Mehrere GPUs für mehr gleichzeitige Nutzer, mehrere Modelle und die Anbindung an Ihre Fachsysteme.

  • Alles aus Kompakt
  • Mehrere Modelle parallel
  • Rechte pro Abteilung
  • Monatlicher Qualitätsbericht
Angebot zum Tagespreis Konfiguration anfragen
über 500 Mitarbeiter, KRITIS, öffentliche Hand

Rechenzentrum

Mehrere Server auf Kubernetes, ausfallsicher und auf Wunsch komplett ohne Internetverbindung.

  • Alles aus Unternehmen
  • Hochverfügbarkeit auf Kubernetes
  • Betrieb ohne Internet (Air-Gap)
  • Dokumentation für Audits
Angebot zum Tagespreis Konfiguration anfragen

Warum hier keine Hardwarepreise stehen: Arbeitsspeicher und SSDs sind derzeit knapp, die Preise ändern sich von Woche zu Woche. Sie bekommen ein verbindliches Angebot zum Tagespreis.

Branchen

Wo ich
herkomme.

Über 20 Jahre Infrastruktur in diesen Branchen. Ich kenne die Auflagen, bevor wir über KI reden.

Energie & Versorgung

Netz- und Anlagendaten, KRITIS-Auflagen, getrennte Netze.

Öffentliche Verwaltung

Bürger- und Personaldaten, Vergaberecht und der Wunsch nach Unabhängigkeit von US-Anbietern.

Industrie & Fertigung

Konstruktionsdaten, Fertigungswissen und Dokumentation, die das Werk nicht verlassen sollen.

Logistik

Kunden-, Sendungs- und Vertragsdaten über viele Standorte hinweg.

Wer das baut

Keine Folien.
Laufende Systeme.

Ich bin kein KI-Stratege. Ich bin Plattform-Engineer mit über 20 Jahren Linux und Kubernetes in Energie, Logistik, Behörden und Industrie.

Was ich empfehle, läuft vorher bei mir. Wenn ein Framework einen Speicherfehler hat, finde ich ihn und melde ihn. Wenn ein Modell anfängt zu driften, will ich das sehen, bevor es jemand anderes merkt.

Powered by Froala Editor

122BParameter lokal betrieben
−17,6 GBSpeicherspitze nach meinem oMLX-Bugreport
1,8–2×schneller durch Speculative Decoding
20+Jahre Linux in Produktion

Eigene Systeme

Täglich im Einsatz.

Kvasir

Mein Prüfstand. Damit teste ich Modelle und Einstellungen, bevor sie zu Ihnen kommen, und messe im Betrieb die Qualität. Auf Wunsch entsteht daraus auch eine auf Ihr Unternehmen zugeschnittene Lösung.

Lokal und CloudIm Einsatz

NOMI

Private KI auf eigener Hardware, mit Gedächtnis und Stimme. Jedes selbst vorgeschlagene Verhalten gibt ein Mensch frei.

Mac StudioPrivat

SiliconTrailer

Mein App-Studio. Native Apps für Mac und iOS, deren Daten auf dem Gerät bleiben.

silicontrailer.comAnsehen

Fragen

Häufige
Fragen.

Welches Modell ist das beste?

Das beste Modell gibt es nicht. Es gibt das passende für Ihre Aufgabe und Ihre Hardware, und das zeigt sich erst an Ihren eigenen Fragen. Deshalb teste ich mehrere Kandidaten mit einem Testsatz, bevor ich eines empfehle.

Ist die Qualität so gut wie bei ChatGPT?

Für die meisten Büroaufgaben wie Zusammenfassen, Dokumentensuche und Entwürfe reichen aktuelle offene Modelle. Bei sehr anspruchsvollem Denken liegen die großen Cloud-Modelle noch vorn. Im Check teste ich das mit Ihren echten Aufgaben, bevor Sie Hardware kaufen.

Woher wissen wir, dass die Antworten stimmen?

Antworten können von einem zweiten Modell gegengeprüft werden, und ein fester Testsatz aus Ihren eigenen Fragen misst die Qualität bei jeder Änderung. Sie sehen das Ergebnis im monatlichen Bericht.

Bekommen wir Kvasir?

Nicht als fertiges Produkt. Ihre Mitarbeiter bekommen eine schlanke Chat-Oberfläche mit vorbereiteten Assistenten, ohne Modellauswahl und Einstellungsdschungel. Kvasir ist mein Werkzeug, mit dem ich prüfe, was bei Ihnen läuft. Wenn Sie mehr brauchen, baue ich auf dieser Grundlage eine auf Sie abgestimmte Lösung.

Warum stehen hier keine Hardwarepreise?

Arbeitsspeicher und SSDs sind seit Herbst 2025 knapp, manche Preise haben sich vervielfacht und ändern sich laufend. Ein Preis auf dieser Seite wäre schnell falsch. Sie bekommen über Wortmann ein Angebot zum Tagespreis.

Braucht der Server eine Internetverbindung?

Nein. Im Betrieb läuft alles im eigenen Netz. Neue Modelle und Updates lassen sich auch ohne Internet einspielen.

Was passiert, wenn bessere Modelle erscheinen?

Ein neues Modell läuft zuerst durch Ihren Testsatz. Nur wenn es besser abschneidet, spiele ich es nach Ihrer Freigabe ein.

Wir haben kein Kubernetes. Geht das trotzdem?

Ja. Für die meisten Firmen reicht ein einzelner Server. Kubernetes lohnt sich erst bei mehreren Servern oder hohen Anforderungen an die Verfügbarkeit.

Kontakt

Reden wir über
Ihre Daten.

30 Minuten, kostenlos, mit Live-Demo. Direkt oder über Ihren Vermittler buchbar. Ich antworte auf Deutsch, Dänisch oder Englisch.

Christopher Rau
Gründer von OpnViking, seit über 20 Jahren Linux- und Kubernetes-Engineer