🇩🇪 Made in Germany · DSGVO-konform · ISO 27001

Souveräne KIPlattform und Infrastruktur aus deutschen Rechenzentren

Generative KI für Ihr Unternehmen – ohne dass Ihre Daten in US-Clouds wandern. Drei Wege, in souveräne KI einzusteigen: pro Token, stundenweise LLM oder eigener Server in deutschen Rechenzentren.

Angebot ansehen ↓
100 % Hosting in Deutschland
ISO 27001 Zertifizierte Rechenzentren
seit 1996 Managed Hosting Erfahrung
0 Cloud-Act-Risiko
Unser Angebot

Drei Wege in die souveräne KI

Je nach Anwendungsfall, Nutzungsverhalten und Budget bieten wir drei unabhängige Varianten an. Sie wählen die passende – oder kombinieren mehrere, etwa Plattform für den Alltag und LLM on Demand für Trainings-Sprints.

Variante 1

Pay-per-Token

Sofort einsatzbereit. Abrechnung nach Verbrauch. Kein Hardware-Commitment.

  • OpenAI-kompatible API zu führenden Open-Source-Sprachmodellen
  • Chatbot-Oberfläche und RAG-Anbindung an Ihr Unternehmenswissen
  • Abrechnung nach tatsächlichem Token-Verbrauch
  • Mandantenfähig, von 10 bis 10.000 Nutzenden skalierbar
  • Keine Mindestlaufzeit, keine Einrichtungspauschale
Passt, wenn: Sie die perfekte KI für den Nextcloud Assistenten oder Ihr Online-Office suchen.
Variante 3

Dedizierter GPU-Server

Eigene Hardware, planbare monatliche Kosten.

  • Dedizierte Server mit aktuellen NVIDIA-GPUs
  • Konfigurationen vom Einstiegssystem bis zum High-End-Knoten
  • Inferenz, Finetuning oder verteiltes Training im Dauerbetrieb
  • ISO-27001-zertifizierte Rechenzentren mit VK4-Verfügbarkeit
  • Monatliche Abrechnung, transparente Festkonditionen
Passt, wenn: Sie KI dauerhaft im Produktivbetrieb haben und maximale Trennung sowie planbare Kosten brauchen.
Pay-per-Token im Detail

In drei Schritten zur souveränen KI im Nextcloud

Andere Sovereign-AI-Angebote lassen Sie nach drei Absätzen im Unklaren, was Sie eigentlich kaufen. Bei uns ist der Weg so kurz, dass er in einen Satz passt.

1

„Pay-per-Token" bestellen

Sie sagen uns, welches Modell Sie einsetzen möchten und wie viele Nutzende Sie haben. Sie erhalten Ihre API-Zugangsdaten – in der Regel am selben Werktag.

2

Nextcloud Assistenten oder Office anschließen

API-Endpoint in Ihrer Nextcloud eintragen. Nextcloud Assistent, Nextcloud Text, Nextcloud Office und Talk nutzen ab diesem Moment das souveräne LLM.

3

Fertig.

Ihre Mitarbeitenden schreiben, fassen zusammen, übersetzen und recherchieren wie gewohnt – nur läuft alles in Deutschland statt in einer US-Cloud.

Kein Consulting-Projekt, keine wochenlange Implementierung. Sie tauschen den KI-Anbieter aus – der Rest Ihrer Nextcloud bleibt genau so, wie er ist.

LLM on Demand im Detail

Ein eigenes LLM, so lange Sie es brauchen

Nicht jedes KI-Vorhaben rechtfertigt eigene Hardware – aber die geteilte Token-Plattform ist manchmal zu eng. LLM on Demand liegt dazwischen: Sie erhalten eine dedizierte Sprachmodell-Instanz für die Dauer, die Sie brauchen. Stundengenau abgerechnet, exklusiv, in Deutschland betrieben.

⏱️

Stündliche Abrechnung

Sie zahlen ausschließlich für die tatsächlich genutzten Stunden. Kein Vorhalten, keine Mindestabnahme, keine Laufzeit. Wenn die Instanz nicht mehr gebraucht wird, hört die Uhr auf zu ticken.

Bereitstellung in Minuten

Sie buchen, Sie loggen sich ein, Sie arbeiten. Kein Einkaufsprozess, keine Hardware-Bestellung, keine Wochen Vorlauf für eine zeitlich begrenzte Nutzung.

🎛️

Dedizierte Instanz

Ihr Modell läuft während der Mietdauer ausschließlich für Sie – kein Sharing, kein Noisy-Neighbor-Effekt. Volle Kontextlänge, reproduzierbare Antwortzeiten, keine Token-Grenzen.

🇩🇪

Standort Deutschland

Auch die kurzfristige Miete erfolgt ausschließlich in deutschen Rechenzentren. Prompts, Antworten und Kontextdaten verlassen den deutschen Rechtsraum nicht.

🧱

Modellauswahl

Sie wählen das für Ihren Anwendungsfall passende Sprachmodell aus dem verfügbaren Open-Source-Portfolio. Auch parallele Instanzen unterschiedlicher Modelle sind möglich.

🔁

Kombinierbar mit anderen Varianten

Sie nutzen unsere Token-Plattform im Alltag und buchen LLM on Demand für Batch-Läufe oder temporäre Lastspitzen dazu – beides läuft in derselben souveränen Umgebung.

Preise auf Anfrage: Stundensätze hängen vom gewählten Modell und vom Buchungsumfang ab. Aktuelle Konditionen nennen wir Ihnen kurzfristig im Erstgespräch oder per individueller Anfrage.
Dedizierter GPU-Server im Detail

Eigene Hardware für den KI-Dauerbetrieb

Wenn Sie eigene Modelle dauerhaft betreiben, hochfrequente Inferenz fahren oder maximale Trennung benötigen, ist ein dedizierter Server die richtige Wahl. Wir stellen abgestimmte Konfigurationen bereit – mit NVIDIA-GPUs der aktuellen Generation in deutschen Rechenzentren.

Einstiegskonfiguration

Kompakter Inferenz-Server für Entwicklung, Testing und kleinere KI-Workloads. Für Teams, die Modelle deployen oder produktive Inferenz auf begrenzter Last fahren.

  • Einsatz: Inferenz, Dev/Test
  • Skalierung: überschaubare Nutzerzahl, einzelne Modelle
  • Hardware: dedizierter Server mit NVIDIA-GPUs

High-End-Konfiguration

High-End-Knoten für verteiltes Training und große Foundation-Modelle. Für Forschung und GenAI-Projekte im anspruchsvollen Produktivbetrieb.

  • Einsatz: Training, große Foundation-Modelle
  • Skalierung: verteilte Workloads, hoher Durchsatz
  • Hardware: Multi-GPU-Server mit Hochgeschwindigkeits-Netz
Konfiguration und Preise auf Anfrage: Die endgültige Server-Konfiguration und Konditionen stimmen wir individuell auf Ihren Bedarf, Ihre Laufzeit und die aktuelle Hardware-Verfügbarkeit ab. Weitere GPU-Generationen und Konfigurationen sind auf Wunsch möglich.
Einsatzfelder

Für wen souveräne KI besonders relevant ist

Überall dort, wo Daten besonders schützenswert sind oder regulatorische Vorgaben den Verarbeitungsort vorschreiben, ist eine in Deutschland betriebene KI keine Komfort-, sondern eine Compliance-Entscheidung.

Öffentliche Verwaltung

Antrags- und Aktenanalyse, CV-Vorprüfung, Fuhrparkmanagement, Bürgerdialog. Mit nachvollziehbarem Verarbeitungsort innerhalb Deutschlands.

Banken & Finanzdienstleister

Risiko- und Vertragsanalyse, Reporting-Unterstützung, regulatorische Auswertungen – aufsichtsrechtlich tragfähig durch Hosting in zertifizierten deutschen Rechenzentren.

Mittelstand mit IP-Schutz

Konstruktionsdaten, Patentschriften, Vertragsentwürfe, Angebote – Inhalte, die nicht in fremden Trainingsdatensätzen landen dürfen.

Software- und KI-Anbieter

Eigene KI-gestützte Produkte auf einer souveränen Infrastruktur betreiben, ohne Endkunden um eine US-Cloud zu bitten. Dediziertes Hosting statt Hyperscaler-Abhängigkeit.

Warum HKN

Souveränität ist ein Versprechen – wir können es einlösen

HKN betreibt seit 1996 Managed-Hosting-Infrastruktur für Unternehmen, die ihre Daten nicht aus der Hand geben wollen. Souveräne KI ist keine Abkehr von dieser Linie, sondern ihre konsequente Fortsetzung.

🇩🇪

Hosting in Deutschland

Daten und Modelle bleiben in deutschen Rechenzentren. Keine Replikation in andere Regionen, kein Cloud-Act-Zugriff, keine versteckten Datenflüsse.

🔐

Mandantenfähige Trennung

Strikte Isolation Ihrer Daten und Modelle. Keine Nutzung Ihrer Inhalte zur Modellverbesserung. Kein Zugriff durch Dritte.

⚙️

Managed statt Self-Service

Betrieb, Monitoring, Updates, Skalierung – wir kümmern uns. Sie konzentrieren sich auf Anwendungsfälle, nicht auf GPU-Treiber.

📞

Persönlicher Ansprechpartner

Kein Ticket-Roulette in fremder Sprache. Sie sprechen mit Menschen, die Ihre Umgebung kennen – auf Deutsch, zu deutschen Geschäftszeiten.

🌱

Nachhaltige Rechenzentren

Niedrige PUE-Werte, Strom aus erneuerbaren Quellen, moderne Kühlkonzepte. Hochleistung bedeutet nicht zwangsläufig hohen Energieverbrauch.

📈

Wachstum ohne Reißbrett

Von Proof of Concept bis Produktivbetrieb begleiten wir Sie. Sie zahlen für das, was Sie heute brauchen, und skalieren, wenn der Anwendungsfall trägt.

Warum überhaupt souveräne KI

KI ist da. Die Frage ist nur: Wessen Cloud nutzt sie?

Die großen KI-Modelle sind beeindruckend – aber sie liegen in den USA. Jede Eingabe, jeder Prompt, jedes Dokument, das ein Mitarbeiter dort einkippt, verlässt den europäischen Rechtsraum. Für viele Unternehmen, Behörden und Banken ist das ein Risiko, das sich nicht mehr rechnen lässt.

Cloud Act & Vendor-Lock-in

US-Behörden können auf Daten zugreifen, die bei US-Anbietern liegen – auch wenn die Server in Europa stehen. Ein Lock-in beim Hyperscaler macht den Ausstieg später teuer.

Modelltraining mit Ihren Daten

In den Standard-AGB vieler KI-Anbieter steht das Recht, Eingaben zur Verbesserung der Modelle zu nutzen. Vertrauliche Informationen werden so Teil des nächsten öffentlichen Modells.

Compliance & Regulierung

DSGVO, EU AI Act, BSI-Vorgaben, branchenspezifische Aufsicht: Wer sensible Daten verarbeitet, braucht nachvollziehbare Verarbeitungsorte und einen Auftragsverarbeiter mit Sitz in der EU.

Klingt passend? Reden wir.

Ein Erstgespräch klärt in 20 Minuten, welche Variante zu Ihrem Anwendungsfall passt – oder ob eine Kombination sinnvoller ist.

oder +49 211 875505 11
Häufige Fragen

Souveräne KI – die wichtigsten Antworten

Was bedeutet „Souveräne KI" konkret?

Souveräne KI bezeichnet eine generative KI, deren Daten, Modelle und Verarbeitung dauerhaft in einem definierten Rechtsraum verbleiben – im Fall von HKN in Deutschland. Es gibt keinen Zugriff durch ausländische Behörden über extraterritoriale Gesetze wie den US Cloud Act, keine Nutzung Ihrer Eingaben zum Trainieren öffentlicher Modelle und einen klar benannten Auftragsverarbeiter mit Sitz in der EU.

Welche Sprachmodelle stehen zur Verfügung?

Die Plattform unterstützt führende Open-Source-Modelle wie Llama 3, Mistral und vergleichbare. Welche Modelle für Sie sinnvoll sind, hängt vom Anwendungsfall ab – wir beraten dazu im Erstgespräch und konfigurieren die Plattform passend. Auf der Infrastruktur können Sie zusätzlich eigene Modelle betreiben.

Werden meine Daten zur Modellverbesserung genutzt?

Nein. Ihre Eingaben, Dokumente und Prompts fließen weder in das Training öffentlicher Modelle noch werden sie anderen Mandanten zugänglich gemacht. Die Architektur ist mandantenfähig aufgebaut, Ihre Daten bleiben in Ihrer Umgebung.

Wie funktioniert die Anbindung an unser Unternehmenswissen (RAG)?

Über Retrieval-Augmented Generation bindet die Plattform Ihre Wissensquellen an – etwa SharePoint, Confluence, Dateiablagen, Wikis oder eigene Datenbanken. Bei einer Anfrage holt sich das Modell die relevanten Quellen, beantwortet die Frage darauf basierend und nennt die Quellen. So sind Antworten nachvollziehbar und bleiben aktuell, ohne das Modell selbst trainieren zu müssen.

Welche Variante passt zu meinem Anwendungsfall?

Drei Faustregeln helfen bei der Einordnung: Wenn Sie GenAI im Alltag nutzen wollen, ohne sich um Infrastruktur zu kümmern, ist die Token-Plattform der schnellste Weg. Wenn Sie gezielte Trainings-Sprints, Finetunings oder Proof of Concepts ohne dauerhafte Hardware-Kosten umsetzen wollen, mieten Sie GPUs stundenweise. Wenn KI dauerhaft im Produktivbetrieb läuft oder maximale Trennung gefordert ist, lohnt sich ein dedizierter GPU-Server. Die Varianten lassen sich auch kombinieren.

Wie unterscheidet sich „LLM on Demand" von einem dedizierten Server?

Bei LLM on Demand mieten Sie eine dedizierte Sprachmodell-Instanz für die Dauer, in der Sie sie brauchen – stundengenau, ohne Mindestlaufzeit. Beim dedizierten Server stellen wir Ihnen eine eigene Hardware-Plattform fest für mehrere Jahre zur Verfügung. LLM on Demand ist ideal für zeitlich begrenzte Nutzung, Batch-Verarbeitung oder Lastspitzen. Der dedizierte Server lohnt sich, sobald das Modell dauerhaft läuft oder besonders strenge Anforderungen an Isolation, Konfiguration und Verfügbarkeit gestellt werden.

Was kostet souveräne KI?

Die Kosten hängen von der gewählten Variante ab. Bei der Token-Plattform zahlen Sie nach Verbrauch ohne Mindestlaufzeit. LLM on Demand wird stundenweise abgerechnet. Für dedizierte Server erstellen wir ein Angebot auf Basis Ihrer Konfiguration, Laufzeit und Anforderungen. Ein verbindliches Angebot mit konkreten Zahlen erhalten Sie im Anschluss an das Erstgespräch.

Wie lange dauert die Bereitstellung?

Die Plattform ist innerhalb weniger Werktage einsatzbereit. Bei dedizierter Infrastruktur richtet sich die Lieferzeit nach der gewählten Hardware-Konfiguration und der aktuellen GPU-Marktlage – wir geben dazu im Angebot eine konkrete Zusage.

Welche Compliance- und Zertifizierungsstandards werden erfüllt?

Der Betrieb erfolgt in ISO-27001-zertifizierten Rechenzentren in Deutschland. Die Lösung lässt sich DSGVO-konform einsetzen, die Anforderungen des EU AI Act werden berücksichtigt. Für KRITIS-Unternehmen und regulierte Branchen stellen wir die nötigen Verarbeitungs- und Auditnachweise bereit.

Können wir mit einem kleinen Pilotprojekt starten?

Ja. Wir empfehlen sogar, mit einem klar abgegrenzten Anwendungsfall zu beginnen – etwa einer Wissens-Suche für eine Abteilung oder einem Chatbot für interne Anfragen. Aus dem Piloten heraus lässt sich der weitere Rollout fundiert planen, statt eine konzernweite Lösung auf Verdacht aufzubauen.

Was unterscheidet HKN von anderen Anbietern?

HKN ist seit 1996 Managed-Hosting-Spezialist mit Fokus auf datensouveräne Lösungen. Wir kombinieren eine fertige GenAI-Plattform mit dedizierter GPU-Infrastruktur in deutschen Rechenzentren und betreuen den Betrieb persönlich – ohne ausgelagerten First-Level-Support und ohne Vendor-Lock-in in einen Hyperscaler.

Sprechen Sie mit uns über Ihren KI-Anwendungsfall

In einem kostenfreien Erstgespräch klären wir, ob die Plattform, die dedizierte Infrastruktur oder eine Kombination zu Ihrem Vorhaben passt. Wir hören zu, statt zu pitchen.

Weiterführende Artikel

Oder direkt anrufen: +49 211 875505 11