Souveräne KIPlattform und Infrastruktur aus deutschen Rechenzentren
Generative KI für Ihr Unternehmen – ohne dass Ihre Daten in US-Clouds wandern. Drei Wege, in souveräne KI einzusteigen: pro Token, stundenweise LLM oder eigener Server in deutschen Rechenzentren.
Drei Wege in die souveräne KI
Je nach Anwendungsfall, Nutzungsverhalten und Budget bieten wir drei unabhängige Varianten an. Sie wählen die passende – oder kombinieren mehrere, etwa Plattform für den Alltag und LLM on Demand für Trainings-Sprints.
Pay-per-Token
Sofort einsatzbereit. Abrechnung nach Verbrauch. Kein Hardware-Commitment.
- OpenAI-kompatible API zu führenden Open-Source-Sprachmodellen
- Chatbot-Oberfläche und RAG-Anbindung an Ihr Unternehmenswissen
- Abrechnung nach tatsächlichem Token-Verbrauch
- Mandantenfähig, von 10 bis 10.000 Nutzenden skalierbar
- Keine Mindestlaufzeit, keine Einrichtungspauschale
LLM on Demand
Eine dedizierte LLM-Instanz, stundengenau abgerechnet.
- Führendes Open-Source-Sprachmodell, exklusiv für Sie bereitgestellt
- Abrechnung im Stundentakt – nur was läuft, wird bezahlt
- Volle Kontrolle über Modellwahl und Kontextlänge
- Bereitstellung in Minuten, kein Beschaffungsprozess
- Auch für Batch-Verarbeitung und Lastspitzen geeignet
Dedizierter GPU-Server
Eigene Hardware, planbare monatliche Kosten.
- Dedizierte Server mit aktuellen NVIDIA-GPUs
- Konfigurationen vom Einstiegssystem bis zum High-End-Knoten
- Inferenz, Finetuning oder verteiltes Training im Dauerbetrieb
- ISO-27001-zertifizierte Rechenzentren mit VK4-Verfügbarkeit
- Monatliche Abrechnung, transparente Festkonditionen
In drei Schritten zur souveränen KI im Nextcloud
Andere Sovereign-AI-Angebote lassen Sie nach drei Absätzen im Unklaren, was Sie eigentlich kaufen. Bei uns ist der Weg so kurz, dass er in einen Satz passt.
„Pay-per-Token" bestellen
Sie sagen uns, welches Modell Sie einsetzen möchten und wie viele Nutzende Sie haben. Sie erhalten Ihre API-Zugangsdaten – in der Regel am selben Werktag.
Nextcloud Assistenten oder Office anschließen
API-Endpoint in Ihrer Nextcloud eintragen. Nextcloud Assistent, Nextcloud Text, Nextcloud Office und Talk nutzen ab diesem Moment das souveräne LLM.
Fertig.
Ihre Mitarbeitenden schreiben, fassen zusammen, übersetzen und recherchieren wie gewohnt – nur läuft alles in Deutschland statt in einer US-Cloud.
Kein Consulting-Projekt, keine wochenlange Implementierung. Sie tauschen den KI-Anbieter aus – der Rest Ihrer Nextcloud bleibt genau so, wie er ist.
Ein eigenes LLM, so lange Sie es brauchen
Nicht jedes KI-Vorhaben rechtfertigt eigene Hardware – aber die geteilte Token-Plattform ist manchmal zu eng. LLM on Demand liegt dazwischen: Sie erhalten eine dedizierte Sprachmodell-Instanz für die Dauer, die Sie brauchen. Stundengenau abgerechnet, exklusiv, in Deutschland betrieben.
Stündliche Abrechnung
Sie zahlen ausschließlich für die tatsächlich genutzten Stunden. Kein Vorhalten, keine Mindestabnahme, keine Laufzeit. Wenn die Instanz nicht mehr gebraucht wird, hört die Uhr auf zu ticken.
Bereitstellung in Minuten
Sie buchen, Sie loggen sich ein, Sie arbeiten. Kein Einkaufsprozess, keine Hardware-Bestellung, keine Wochen Vorlauf für eine zeitlich begrenzte Nutzung.
Dedizierte Instanz
Ihr Modell läuft während der Mietdauer ausschließlich für Sie – kein Sharing, kein Noisy-Neighbor-Effekt. Volle Kontextlänge, reproduzierbare Antwortzeiten, keine Token-Grenzen.
Standort Deutschland
Auch die kurzfristige Miete erfolgt ausschließlich in deutschen Rechenzentren. Prompts, Antworten und Kontextdaten verlassen den deutschen Rechtsraum nicht.
Modellauswahl
Sie wählen das für Ihren Anwendungsfall passende Sprachmodell aus dem verfügbaren Open-Source-Portfolio. Auch parallele Instanzen unterschiedlicher Modelle sind möglich.
Kombinierbar mit anderen Varianten
Sie nutzen unsere Token-Plattform im Alltag und buchen LLM on Demand für Batch-Läufe oder temporäre Lastspitzen dazu – beides läuft in derselben souveränen Umgebung.
Eigene Hardware für den KI-Dauerbetrieb
Wenn Sie eigene Modelle dauerhaft betreiben, hochfrequente Inferenz fahren oder maximale Trennung benötigen, ist ein dedizierter Server die richtige Wahl. Wir stellen abgestimmte Konfigurationen bereit – mit NVIDIA-GPUs der aktuellen Generation in deutschen Rechenzentren.
Einstiegskonfiguration
Kompakter Inferenz-Server für Entwicklung, Testing und kleinere KI-Workloads. Für Teams, die Modelle deployen oder produktive Inferenz auf begrenzter Last fahren.
- Einsatz: Inferenz, Dev/Test
- Skalierung: überschaubare Nutzerzahl, einzelne Modelle
- Hardware: dedizierter Server mit NVIDIA-GPUs
Produktivkonfiguration
Produktionsreifer Server für mittlere bis große Modelle und Trainings-Workloads. Für Finetuning, Batch-Inferenz und Multi-User-Umgebungen mit dauerhafter Last.
- Einsatz: Finetuning, Produktivbetrieb
- Skalierung: mehrere Modelle parallel, hohe Auslastung
- Hardware: Multi-GPU-Server, großzügiger RAM-Ausbau
High-End-Konfiguration
High-End-Knoten für verteiltes Training und große Foundation-Modelle. Für Forschung und GenAI-Projekte im anspruchsvollen Produktivbetrieb.
- Einsatz: Training, große Foundation-Modelle
- Skalierung: verteilte Workloads, hoher Durchsatz
- Hardware: Multi-GPU-Server mit Hochgeschwindigkeits-Netz
Für wen souveräne KI besonders relevant ist
Überall dort, wo Daten besonders schützenswert sind oder regulatorische Vorgaben den Verarbeitungsort vorschreiben, ist eine in Deutschland betriebene KI keine Komfort-, sondern eine Compliance-Entscheidung.
Öffentliche Verwaltung
Antrags- und Aktenanalyse, CV-Vorprüfung, Fuhrparkmanagement, Bürgerdialog. Mit nachvollziehbarem Verarbeitungsort innerhalb Deutschlands.
Banken & Finanzdienstleister
Risiko- und Vertragsanalyse, Reporting-Unterstützung, regulatorische Auswertungen – aufsichtsrechtlich tragfähig durch Hosting in zertifizierten deutschen Rechenzentren.
Mittelstand mit IP-Schutz
Konstruktionsdaten, Patentschriften, Vertragsentwürfe, Angebote – Inhalte, die nicht in fremden Trainingsdatensätzen landen dürfen.
Software- und KI-Anbieter
Eigene KI-gestützte Produkte auf einer souveränen Infrastruktur betreiben, ohne Endkunden um eine US-Cloud zu bitten. Dediziertes Hosting statt Hyperscaler-Abhängigkeit.
Souveränität ist ein Versprechen – wir können es einlösen
HKN betreibt seit 1996 Managed-Hosting-Infrastruktur für Unternehmen, die ihre Daten nicht aus der Hand geben wollen. Souveräne KI ist keine Abkehr von dieser Linie, sondern ihre konsequente Fortsetzung.
Hosting in Deutschland
Daten und Modelle bleiben in deutschen Rechenzentren. Keine Replikation in andere Regionen, kein Cloud-Act-Zugriff, keine versteckten Datenflüsse.
Mandantenfähige Trennung
Strikte Isolation Ihrer Daten und Modelle. Keine Nutzung Ihrer Inhalte zur Modellverbesserung. Kein Zugriff durch Dritte.
Managed statt Self-Service
Betrieb, Monitoring, Updates, Skalierung – wir kümmern uns. Sie konzentrieren sich auf Anwendungsfälle, nicht auf GPU-Treiber.
Persönlicher Ansprechpartner
Kein Ticket-Roulette in fremder Sprache. Sie sprechen mit Menschen, die Ihre Umgebung kennen – auf Deutsch, zu deutschen Geschäftszeiten.
Nachhaltige Rechenzentren
Niedrige PUE-Werte, Strom aus erneuerbaren Quellen, moderne Kühlkonzepte. Hochleistung bedeutet nicht zwangsläufig hohen Energieverbrauch.
Wachstum ohne Reißbrett
Von Proof of Concept bis Produktivbetrieb begleiten wir Sie. Sie zahlen für das, was Sie heute brauchen, und skalieren, wenn der Anwendungsfall trägt.
KI ist da. Die Frage ist nur: Wessen Cloud nutzt sie?
Die großen KI-Modelle sind beeindruckend – aber sie liegen in den USA. Jede Eingabe, jeder Prompt, jedes Dokument, das ein Mitarbeiter dort einkippt, verlässt den europäischen Rechtsraum. Für viele Unternehmen, Behörden und Banken ist das ein Risiko, das sich nicht mehr rechnen lässt.
Cloud Act & Vendor-Lock-in
US-Behörden können auf Daten zugreifen, die bei US-Anbietern liegen – auch wenn die Server in Europa stehen. Ein Lock-in beim Hyperscaler macht den Ausstieg später teuer.
Modelltraining mit Ihren Daten
In den Standard-AGB vieler KI-Anbieter steht das Recht, Eingaben zur Verbesserung der Modelle zu nutzen. Vertrauliche Informationen werden so Teil des nächsten öffentlichen Modells.
Compliance & Regulierung
DSGVO, EU AI Act, BSI-Vorgaben, branchenspezifische Aufsicht: Wer sensible Daten verarbeitet, braucht nachvollziehbare Verarbeitungsorte und einen Auftragsverarbeiter mit Sitz in der EU.
Klingt passend? Reden wir.
Ein Erstgespräch klärt in 20 Minuten, welche Variante zu Ihrem Anwendungsfall passt – oder ob eine Kombination sinnvoller ist.
Souveräne KI – die wichtigsten Antworten
Was bedeutet „Souveräne KI" konkret?
Souveräne KI bezeichnet eine generative KI, deren Daten, Modelle und Verarbeitung dauerhaft in einem definierten Rechtsraum verbleiben – im Fall von HKN in Deutschland. Es gibt keinen Zugriff durch ausländische Behörden über extraterritoriale Gesetze wie den US Cloud Act, keine Nutzung Ihrer Eingaben zum Trainieren öffentlicher Modelle und einen klar benannten Auftragsverarbeiter mit Sitz in der EU.
Welche Sprachmodelle stehen zur Verfügung?
Die Plattform unterstützt führende Open-Source-Modelle wie Llama 3, Mistral und vergleichbare. Welche Modelle für Sie sinnvoll sind, hängt vom Anwendungsfall ab – wir beraten dazu im Erstgespräch und konfigurieren die Plattform passend. Auf der Infrastruktur können Sie zusätzlich eigene Modelle betreiben.
Werden meine Daten zur Modellverbesserung genutzt?
Nein. Ihre Eingaben, Dokumente und Prompts fließen weder in das Training öffentlicher Modelle noch werden sie anderen Mandanten zugänglich gemacht. Die Architektur ist mandantenfähig aufgebaut, Ihre Daten bleiben in Ihrer Umgebung.
Wie funktioniert die Anbindung an unser Unternehmenswissen (RAG)?
Über Retrieval-Augmented Generation bindet die Plattform Ihre Wissensquellen an – etwa SharePoint, Confluence, Dateiablagen, Wikis oder eigene Datenbanken. Bei einer Anfrage holt sich das Modell die relevanten Quellen, beantwortet die Frage darauf basierend und nennt die Quellen. So sind Antworten nachvollziehbar und bleiben aktuell, ohne das Modell selbst trainieren zu müssen.
Welche Variante passt zu meinem Anwendungsfall?
Drei Faustregeln helfen bei der Einordnung: Wenn Sie GenAI im Alltag nutzen wollen, ohne sich um Infrastruktur zu kümmern, ist die Token-Plattform der schnellste Weg. Wenn Sie gezielte Trainings-Sprints, Finetunings oder Proof of Concepts ohne dauerhafte Hardware-Kosten umsetzen wollen, mieten Sie GPUs stundenweise. Wenn KI dauerhaft im Produktivbetrieb läuft oder maximale Trennung gefordert ist, lohnt sich ein dedizierter GPU-Server. Die Varianten lassen sich auch kombinieren.
Wie unterscheidet sich „LLM on Demand" von einem dedizierten Server?
Bei LLM on Demand mieten Sie eine dedizierte Sprachmodell-Instanz für die Dauer, in der Sie sie brauchen – stundengenau, ohne Mindestlaufzeit. Beim dedizierten Server stellen wir Ihnen eine eigene Hardware-Plattform fest für mehrere Jahre zur Verfügung. LLM on Demand ist ideal für zeitlich begrenzte Nutzung, Batch-Verarbeitung oder Lastspitzen. Der dedizierte Server lohnt sich, sobald das Modell dauerhaft läuft oder besonders strenge Anforderungen an Isolation, Konfiguration und Verfügbarkeit gestellt werden.
Was kostet souveräne KI?
Die Kosten hängen von der gewählten Variante ab. Bei der Token-Plattform zahlen Sie nach Verbrauch ohne Mindestlaufzeit. LLM on Demand wird stundenweise abgerechnet. Für dedizierte Server erstellen wir ein Angebot auf Basis Ihrer Konfiguration, Laufzeit und Anforderungen. Ein verbindliches Angebot mit konkreten Zahlen erhalten Sie im Anschluss an das Erstgespräch.
Wie lange dauert die Bereitstellung?
Die Plattform ist innerhalb weniger Werktage einsatzbereit. Bei dedizierter Infrastruktur richtet sich die Lieferzeit nach der gewählten Hardware-Konfiguration und der aktuellen GPU-Marktlage – wir geben dazu im Angebot eine konkrete Zusage.
Welche Compliance- und Zertifizierungsstandards werden erfüllt?
Der Betrieb erfolgt in ISO-27001-zertifizierten Rechenzentren in Deutschland. Die Lösung lässt sich DSGVO-konform einsetzen, die Anforderungen des EU AI Act werden berücksichtigt. Für KRITIS-Unternehmen und regulierte Branchen stellen wir die nötigen Verarbeitungs- und Auditnachweise bereit.
Können wir mit einem kleinen Pilotprojekt starten?
Ja. Wir empfehlen sogar, mit einem klar abgegrenzten Anwendungsfall zu beginnen – etwa einer Wissens-Suche für eine Abteilung oder einem Chatbot für interne Anfragen. Aus dem Piloten heraus lässt sich der weitere Rollout fundiert planen, statt eine konzernweite Lösung auf Verdacht aufzubauen.
Was unterscheidet HKN von anderen Anbietern?
HKN ist seit 1996 Managed-Hosting-Spezialist mit Fokus auf datensouveräne Lösungen. Wir kombinieren eine fertige GenAI-Plattform mit dedizierter GPU-Infrastruktur in deutschen Rechenzentren und betreuen den Betrieb persönlich – ohne ausgelagerten First-Level-Support und ohne Vendor-Lock-in in einen Hyperscaler.
Sprechen Sie mit uns über Ihren KI-Anwendungsfall
In einem kostenfreien Erstgespräch klären wir, ob die Plattform, die dedizierte Infrastruktur oder eine Kombination zu Ihrem Vorhaben passt. Wir hören zu, statt zu pitchen.
Oder direkt anrufen: +49 211 875505 11