Zum Hauptinhalt springen
Helm KI

On-Premise KI-Infrastruktur für Unternehmen im DACH-Raum.

Private KI-Systeme für interne Nutzung, Dokumentensuche und AI-Gateway – vollständig On-Premise in Ihrer eigenen Infrastruktur. Ihre Daten verlassen das Unternehmen nicht.

  • On-Premise als Standard
  • Daten bleiben im Unternehmen
  • DSGVO-konforme Betriebsmodelle
  • Auditierbare KI-Nutzung
  • Häufig förderfähig

Plattform

Schatten-KI ist Realität. Die Antwort sind drei kontrollierte Bausteine.

Mitarbeitende nutzen bereits öffentliche KI-Tools – oft ohne Kontrolle über Prompts, sensible Daten, Anbieter, Logs oder interne Freigabeprozesse. Daraus entstehen Datenschutz-, Sicherheits- und Governance-Risiken. Helm KI setzt dort an: drei Module, einzeln oder als Plattform, vollständig On-Premise.

Typische Risiken der Schatten-KI

Datenabfluss

Prompts und Dokumente verlassen unkontrolliert das Unternehmen.

Unklare Anbieter

Modellbetreiber, Datenstandorte und Subdienstleister nicht freigegeben.

Fehlende Logs

Keine nachvollziehbare Historie über Nutzung, Inhalte und Empfänger.

Keine Rechtekontrolle

Zugriff auf KI-Dienste ohne Rollen- und Rechtekonzept.

Die Bausteine

Jedes Modul ist auf den On-Premise-Betrieb in Ihrer eigenen Infrastruktur ausgelegt – auf Servern, VMs oder Kubernetes im Kundennetz.

Inklusive

Nr. 01

Interner Assistent

Private AI Chat

Sicherer interner KI-Assistent für Mitarbeitende mit Zugriff auf freigegebene Unternehmensinformationen.

  • Chat mit internen Dokumenten
  • Quellenangaben & rechtebasierte Antworten
  • Admin-Konsole, Rollen- und Rechteverwaltung
  • Logging und Audit-Spuren

Nr. 02

Zentrale Kontrollschicht

Private AI Gateway

Zentrale Kontrollschicht für KI-Nutzung im Unternehmen. Routing, Policies und Logging an einer Stelle.

  • Modellrouting zwischen internen Modellen
  • Policy Enforcement · PII-Redaction · Audit-Log
  • Quoten, Kosten- und Lastkontrolle
  • Stabile API für interne Anwendungen
  • Optional: zentrale Freigabe externer Anbieter

Nr. 03

Wissensplattform

Private AI RAG

Unternehmenswissen durchsuchbar machen, ohne Berechtigungen zu umgehen. Rechte, Indexierung und Freigaben bleiben konsistent.

  • Rechtebasierte Antworten mit Quellenverweis
  • Indexierung von SharePoint, Confluence, Filestores
  • Lokale Vektordatenbank im Kundennetz
  • Definierte Re-Indexierungs- und Freigabeprozesse

Sicherheit

Daten bleiben in Ihrer Umgebung – kontrolliert über klare Leitplanken.

On-Premise läuft ausschließlich in Ihrer Infrastruktur – überall im DACH-Raum. Darauf setzt eine technische und organisatorische Basis auf, die sich an bestehende Datenschutz- und IT-Security-Prozesse anbinden lässt.

in der Vertrauenszone
01

Datenresidenz

Daten bleiben in Ihrer eigenen Umgebung – On-Premise im Unternehmen, überall im DACH-Raum. Air-Gap-Betrieb ohne externe Verbindungen ist möglich; kein impliziter Datenabfluss zu öffentlichen KI-Diensten.

vollständig protokolliert
02

Auditierbarkeit

Nachvollziehbarkeit auf Aufruf-Ebene: Prompt, Antwort, Modell und Policy-Entscheidung werden protokolliert. Exportierbar für Revision, interne Audits und SIEM-Anbindung.

zentral durchgesetzt
03

Policy Enforcement

Richtlinien werden auf Gateway-Ebene durchgesetzt – konsistent über alle Anwendungen, Datenkategorien und freigegebenen Anbieter.

freigabebasiert
04

Modellfreigaben

Eine klare Freigabematrix bestimmt, welches Modell welche Datenkategorie verarbeiten darf. Externe Anbieter sind zentral steuerbar – oder vollständig ausgeschlossen.

Bewusst zurückhaltend formuliert. Die Plattform unterstützt DSGVO-konforme Betriebsmodelle, ermöglicht nachvollziehbare KI-Nutzung und kann an bestehende Governance-Prozesse angebunden werden. Pauschale Aussagen wie „DSGVO garantiert" oder „100 % sicher" treffen wir nicht – Compliance ist ein Prozess, kein Zustand.

Betrieb & Technik

Betriebsmodelle und konkrete technische Eckdaten.

Die Plattform läuft ausschließlich On-Premise – wahlweise selbst betrieben oder als Managed On-Premise in Ihrer Umgebung. Darunter Richtwerte für die technische Bewertung, im Erstgespräch auf Ihr Lastprofil bezogen.

Betriebsmodelle – immer On-Premise

On-Premise beim Kunden

Standard
Standort
Eigene Server / VMs / K8s
Betrieb
Kunde
Daten
Bleiben in der Kundenumgebung
Geeignet für
Strenge IT-Sicherheits- und Datenschutzanforderungen

Managed On-Premise

Optional
Standort
Kundensysteme
Betrieb
Helm KI (Managed Operations)
Daten
Bleiben in der Kundenumgebung
Geeignet für
Bestehende On-Prem-Strategie, aber ohne eigene Betriebsmannschaft

Welches der beiden Betriebsmodelle zu Ihnen passt, klären wir im Erstgespräch – anhand vorhandener Infrastruktur, Sicherheitsanforderungen und Betriebsteam.

Spezifikationen

Datenabfluss

Datenfluss

0 Datenflüsse zu öffentlichen KI-Diensten

On-Premise als Standard – Daten verlassen die Vertrauenszone nicht

Modellgrößen

Modell

7B – 70B lokal · 200B+ auf Multi-Node-Clustern

Auswahl gemäß Hardware und Anwendungsfall

GPU-Anforderung

Hardware

NVIDIA RTX PRO 6000 Blackwell (96 GB, luftgekühlt) als Standard · 1× – 8× pro Instanz

Empfohlen für Neuanschaffungen. Bestehende H100 · A100 · L40S werden unterstützt – hardware-neutral, neuere Generationen (Rubin) sobald die Inferenz-Runtime sie freigibt · CPU-Inferenz für kleine Modelle möglich

Antwortzeit (typisch)

Performance

≤ 500 ms · p95 für Standard-Anfragen

Abhängig von Modell, Kontextlänge und Auslastung

Identity-Anbindung

Identity

Microsoft Entra ID · Keycloak · LDAP · SAML 2.0

Single Sign-On und Rollen-Mapping

Datenquellen

Daten

SharePoint · Confluence · Filestore · S3-kompatibel

Weitere Connectoren projektbezogen

Audit-Log-Retention

Compliance

1 – 7 Jahre · konfigurierbar

Exportierbar in SIEM-Systeme

Hochverfügbarkeit

Betrieb

Aktiv-Aktiv oder Aktiv-Passiv · optional Multi-Standort

SLAs im Enterprise-Paket

Pilot-Zeitraum

Einführung

4 – 8 Wochen bis produktive Pilotnutzung

Inkl. Sicherheitsanalyse und Zielarchitektur

Zielgruppen

Anwendungsbereiche und Branchen.

Typische Einsatzfelder, in denen sich kontrollierte KI-Nutzung besonders auszahlt – insbesondere unter den Datenschutz- und Sicherheitsanforderungen des DACH-Raums.

Anwendungsbereiche

  • Interner KI-Assistent für Mitarbeitende
  • Interne Wissenssuche über freigegebene Quellen
  • Vertrags- und Dokumentenanalyse
  • Support- und Service-Assistenz
  • AI Gateway für bestehende Softwareprodukte
  • Zusammenfassung interner Dokumente

Branchen

  • Mittelstand
  • Finanzdienstleister
  • Versicherungen
  • Kanzleien
  • Steuerberatung & Wirtschaftsprüfung
  • Healthcare & MedTech
  • Industrie & Maschinenbau
  • IT-Dienstleister
  • Öffentliche & regulierte Organisationen
  • Größere Unternehmensgruppen

Pakete & Förderung

Drei Stufen nach Unternehmensgröße – Module flexibel zubuchbar.

Private AI Chat ist in jedem Paket enthalten. Private AI Gateway und RAG lassen sich bei Bedarf in jeder Stufe dazubuchen. Die Stufen selbst unterscheiden sich ausschließlich in Unternehmensgröße, Nutzerzahl und der dafür ausgelegten Hardware. Preise werden pro Projekt kalkuliert.

Paket 01

Starter On-Prem

Für kleinere Unternehmen und Pilotprojekte.

Dimensionierung nach Größe

Nutzer
1 – 10
GPU
1× RTX PRO 6000
Memory
96 GB
Modelle
bis 32B
Inklusive
  • Private AI Chat

Optional zubuchbar

  • Private AI Gateway
  • Private AI RAG
Paket 02

Business On-Prem

Für mittelständische Unternehmen mit produktivem Einsatz.

Dimensionierung nach Größe

Nutzer
10 – 50
GPU
2 – 4× RTX PRO 6000
Memory
bis 384 GB
Modelle
bis 70B
Inklusive
  • Private AI Chat

Optional zubuchbar

  • Private AI Gateway
  • Private AI RAG
Paket 03

Enterprise Infrastructure

Für größere Unternehmen und regulierte Umgebungen.

Dimensionierung nach Größe

Nutzer
50 – 150+
GPU
8× H100 · Multi-Node
Memory
640 GB+
Modelle
bis 200B+
Inklusive
  • Private AI Chat

Optional zubuchbar

  • Private AI Gateway
  • Private AI RAG

Die Werte dienen als Orientierung – nicht als Mindestpflicht. Wenn Ihr Vorhaben nicht in eine Stufe passt, klären wir das im Erstgespräch und kalkulieren ein passendes Setup.

Förderfähigkeit

On-Premise-KI ist in vielen Fällen förderfähig.

Bund, Länder und EU bieten Programme, die KI-Einführung, Digitalisierung und Forschung & Entwicklung unterstützen. Welche im konkreten Fall passen, hängt von Unternehmensgröße, Standort und Projekttiefe ab. Wir unterstützen im Erstgespräch bei der Einordnung – die Antragstellung erfolgt durch das Kundenunternehmen, in der Regel mit einer Fördermittelberatung.

Deutschland

DE
  • Forschungszulage (FZulG)

    Steuerliche F&E-Förderung – seit 2026 erweitert: Bemessungsgrundlage bis 12 Mio € / Jahr, KMU-Bonus 35 %.

  • KfW ERP-Förderkredit Digitalisierung (511 / 512)

    Kredit ab 25.000 € für KI-Tools, Hardware und IT-Sicherheit. KI muss interne Daten nutzen – passt zum On-Premise-Modell.

  • ZIM

    Zentrales Innovationsprogramm Mittelstand – F&E-Kooperationen, neue Konditionen seit 2025.

  • Bundesland-Programme

    Digitalbonus Bayern Plus (bis 30.000 €), MID NRW (bis 70.000 €), DIGI-Zuschuss Hessen u. a.

Österreich

AT
  • FFG Basisprogramm

    F&E-Projekte – Förderquoten bis 50 %, Antragssumme bis mehrere Millionen Euro.

  • aws Digitalisierung

    Umsetzungsförderung bis 20.000 €, ergänzt durch Landesförderungen.

  • KMU.DIGITAL

    Beratungsförderung für KI- und Digitalisierungsstrategie.

  • AI Mission Austria

    Bündelung der nationalen KI-Förderungen seit 2026.

Schweiz

CH
  • Innosuisse Innovationsprojekte

    Förderquoten 20–60 %, Voraussetzung: Kooperation mit einer Schweizer Forschungseinrichtung.

  • SECO – sektorale Programme

    Branchenbezogene Digitalisierungs- und Innovationsförderung.

  • Kantonale Förderungen

    Pro Kanton unterschiedlich – ergänzend zu Bundesprogrammen.

EU-Ebene: Digital Europe Programme, Horizon Europe und Eurostars flankieren die nationalen Programme. Der EU-Rahmen Cloud and AI Development Act (CADA) befindet sich 2026 im Gesetzgebungsverfahren – wir beobachten ihn aktiv, da er für souveräne KI-Infrastruktur einen eigenen Förderkanal öffnen kann.

Programme ändern sich jährlich. Die Aufstellung dient als Orientierung – wir treffen keine pauschalen Förderzusagen und übernehmen die Antragstellung nicht. Konkrete Förderfähigkeit, Antragsweg und Kombinierbarkeit klären wir gemeinsam im Erstgespräch oder mit Ihrer Fördermittelberatung.

FAQ

Häufige Fragen aus dem Erstgespräch.

Die Antworten geben Orientierung. Konkrete Aussagen treffen wir immer projektbezogen, weil Sicherheits- und Datenschutzanforderungen pro Unternehmen unterschiedlich gelagert sind.

Welche DSGVO-Pflichten übernehmen Sie – welche bleiben beim Kunden?

Beim On-Premise-Betrieb bleiben die Datenverantwortung und der Großteil der DSGVO-Pflichten beim Kunden. Wir liefern eine Plattform, die DSGVO-konforme Betriebsmodelle unterstützt, dokumentieren Datenflüsse und unterstützen bei der Umsetzung interner Anforderungen. Beim Managed-On-Premise-Betrieb klären wir die Rollen (Verantwortlicher, Auftragsverarbeiter) im Auftragsverarbeitungsvertrag.

Können bestehende Identity-Systeme eingebunden werden?

Ja. Standardmäßig unterstützt sind Microsoft Entra ID, Keycloak, LDAP und SAML 2.0. Rollen- und Gruppen-Mappings werden zur Steuerung der RAG-Berechtigungen und der Modell-Freigaben genutzt.

Welche Modelle lassen sich tatsächlich lokal betreiben?

Modelle mit 7B – 70B Parametern lassen sich auf typischer GPU-Hardware lokal betreiben (z. B. Llama 3.1 70B auf 4×–8× H100 / A100). Größere Modelle (200B+) laufen auf Multi-Node-Clustern in Ihrer eigenen Infrastruktur. Die Modellauswahl ist Teil der Sicherheitsanalyse.

Wozu ein Gateway, wenn alles On-Premise läuft?

Das Gateway ist nicht das Tor nach außen, sondern die zentrale Kontrollschicht zwischen Anwendungen und Modellen – auch und gerade im reinen On-Premise-Betrieb. Es übernimmt fünf interne Aufgaben: Routing zwischen mehreren internen Modellen (z. B. kleines Modell für Routine-Anfragen, großes Modell für komplexe Analysen), zentrale Durchsetzung von Policies und PII-Redaction, einheitliches Audit-Log, Kontrolle von Quoten und GPU-Lasten sowie eine stabile API für interne Anwendungen, die unabhängig vom konkreten Modell ist. Ohne Gateway müsste jede App diese Logik selbst implementieren – Drift, Lücken und schwer auditierbare Datenflüsse sind die Folge. Die zentrale Freigabe externer Anbieter ist eine zusätzliche, optionale Funktion und im reinen On-Premise-Betrieb deaktiviert.

Wie lange dauert ein typisches Pilotprojekt?

Ein Pilot dauert in der Regel 4 – 8 Wochen, inklusive Sicherheitsanalyse, Zielarchitektur und Anbindung der ersten Datenquellen. Voraussetzung ist eine geklärte Hardware-Situation und ein definierter Pilot-Nutzerkreis.

Welche Förderprogramme kommen für ein On-Premise-KI-Projekt in Frage?

Abhängig von Standort, Unternehmensgröße und Projekttiefe greifen unterschiedliche Programme. In Deutschland sind die Forschungszulage (FZulG), der KfW ERP-Förderkredit Digitalisierung (511/512) sowie Bundesland-Programme wie Digitalbonus Bayern Plus oder MID NRW häufige Optionen. In Österreich kommen FFG-Basisprogramm, aws Digitalisierung und KMU.DIGITAL in Betracht; in der Schweiz Innosuisse-Innovationsprojekte mit Forschungspartner. Eine Übersicht steht im Abschnitt Förderung weiter oben auf dieser Seite. Wir unterstützen im Erstgespräch bei der Einordnung – die Antragstellung erfolgt durch das Kundenunternehmen, in der Regel mit einer Fördermittelberatung. Pauschale Förderzusagen geben wir nicht.

Funktioniert der Betrieb in einer Air-Gapped Umgebung?

Ja. Die Plattform ist so aufgebaut, dass sie ohne externe Verbindungen betrieben werden kann. Updates werden in solchen Umgebungen über kontrollierte Wege ausgeliefert. Air-Gapped-Setups sind Teil des Enterprise-Pakets.

Werden Daten über das Kundennetzwerk hinaus verarbeitet?

Beim On-Premise-Betrieb nein. Beim Einsatz freigegebener externer Anbieter über das Gateway gelten ausschließlich die ausdrücklich freigegebenen Routen. Alle Aufrufe sind protokolliert und im Audit-Log nachvollziehbar.

Wie wird mit Modellupdates und neuen Anbietern umgegangen?

Modelle und Anbieter werden zentral über das Gateway freigegeben. Neue Versionen durchlaufen einen Freigabeprozess, der pro Kunde definiert wird – inkl. Tests, Sicherheitsbewertung und kontrolliertem Rollout.

Kontakt

Beratungsgespräch oder schriftliche Anfrage.

Wir melden uns mit einer kurzen Agenda und stimmen die nächsten Schritte mit Ihnen ab.

Pflichtfelder mit * kennzeichnen

Reaktionszeit

innerhalb 1 Werktag

Antwort mit Agenda für das Erstgespräch (30 – 45 Min.)

Vertraulich

unverbindlich

NDA auf Wunsch vor Abstimmung der technischen Details

Sprache · Region

Deutsch · DACH

Betrieb ausschließlich On-Premise in Ihrer eigenen Infrastruktur

Lieber direkt per E-Mail?

kontakt@helm-ki.de

PGP-Schlüssel auf Anfrage.