Antwort innerhalb 1 Werktag · vertraulich, unverbindlich
On-Premise KI-Infrastruktur für Unternehmen im DACH-Raum.
Private KI-Systeme für interne Nutzung, Dokumentensuche und AI-Gateway – vollständig On-Premise in Ihrer eigenen Infrastruktur. Ihre Daten verlassen das Unternehmen nicht.
Schatten-KI ist Realität. Die Antwort sind drei kontrollierte Bausteine.
Mitarbeitende nutzen bereits öffentliche KI-Tools – oft ohne Kontrolle über Prompts, sensible Daten, Anbieter, Logs oder interne Freigabeprozesse. Daraus entstehen Datenschutz-, Sicherheits- und Governance-Risiken. Helm KI setzt dort an: drei Module, einzeln oder als Plattform, vollständig On-Premise.
Typische Risiken der Schatten-KI
Datenabfluss
Prompts und Dokumente verlassen unkontrolliert das Unternehmen.
Unklare Anbieter
Modellbetreiber, Datenstandorte und Subdienstleister nicht freigegeben.
Fehlende Logs
Keine nachvollziehbare Historie über Nutzung, Inhalte und Empfänger.
Keine Rechtekontrolle
Zugriff auf KI-Dienste ohne Rollen- und Rechtekonzept.
Die Bausteine
Jedes Modul ist auf den On-Premise-Betrieb in Ihrer eigenen Infrastruktur ausgelegt – auf Servern, VMs oder Kubernetes im Kundennetz.
Inklusive
Nr. 01
Interner Assistent
Private AI Chat
Sicherer interner KI-Assistent für Mitarbeitende mit Zugriff auf freigegebene Unternehmensinformationen.
Chat mit internen Dokumenten
Quellenangaben & rechtebasierte Antworten
Admin-Konsole, Rollen- und Rechteverwaltung
Logging und Audit-Spuren
Nr. 02
Zentrale Kontrollschicht
Private AI Gateway
Zentrale Kontrollschicht für KI-Nutzung im Unternehmen. Routing, Policies und Logging an einer Stelle.
Modellrouting zwischen internen Modellen
Policy Enforcement · PII-Redaction · Audit-Log
Quoten, Kosten- und Lastkontrolle
Stabile API für interne Anwendungen
Optional: zentrale Freigabe externer Anbieter
Nr. 03
Wissensplattform
Private AI RAG
Unternehmenswissen durchsuchbar machen, ohne Berechtigungen zu umgehen. Rechte, Indexierung und Freigaben bleiben konsistent.
Rechtebasierte Antworten mit Quellenverweis
Indexierung von SharePoint, Confluence, Filestores
Lokale Vektordatenbank im Kundennetz
Definierte Re-Indexierungs- und Freigabeprozesse
Sicherheit
Daten bleiben in Ihrer Umgebung – kontrolliert über klare Leitplanken.
On-Premise läuft ausschließlich in Ihrer Infrastruktur – überall im DACH-Raum. Darauf setzt eine technische und organisatorische Basis auf, die sich an bestehende Datenschutz- und IT-Security-Prozesse anbinden lässt.
in der Vertrauenszone
01
Datenresidenz
Daten bleiben in Ihrer eigenen Umgebung – On-Premise im Unternehmen, überall im DACH-Raum. Air-Gap-Betrieb ohne externe Verbindungen ist möglich; kein impliziter Datenabfluss zu öffentlichen KI-Diensten.
vollständig protokolliert
02
Auditierbarkeit
Nachvollziehbarkeit auf Aufruf-Ebene: Prompt, Antwort, Modell und Policy-Entscheidung werden protokolliert. Exportierbar für Revision, interne Audits und SIEM-Anbindung.
zentral durchgesetzt
03
Policy Enforcement
Richtlinien werden auf Gateway-Ebene durchgesetzt – konsistent über alle Anwendungen, Datenkategorien und freigegebenen Anbieter.
freigabebasiert
04
Modellfreigaben
Eine klare Freigabematrix bestimmt, welches Modell welche Datenkategorie verarbeiten darf. Externe Anbieter sind zentral steuerbar – oder vollständig ausgeschlossen.
Bewusst zurückhaltend formuliert. Die Plattform unterstützt DSGVO-konforme Betriebsmodelle, ermöglicht nachvollziehbare KI-Nutzung und kann an bestehende Governance-Prozesse angebunden werden. Pauschale Aussagen wie „DSGVO garantiert" oder „100 % sicher" treffen wir nicht – Compliance ist ein Prozess, kein Zustand.
Betrieb & Technik
Betriebsmodelle und konkrete technische Eckdaten.
Die Plattform läuft ausschließlich On-Premise – wahlweise selbst betrieben oder als Managed On-Premise in Ihrer Umgebung. Darunter Richtwerte für die technische Bewertung, im Erstgespräch auf Ihr Lastprofil bezogen.
Betriebsmodelle – immer On-Premise
Betriebsmodell
Standort
Betrieb durch
Daten
Geeignet für
On-Premise beim KundenStandard
Eigene Server / VMs / K8s
Kunde
Bleiben in der Kundenumgebung
Strenge IT-Sicherheits- und Datenschutzanforderungen
Managed On-PremiseOptional
Kundensysteme
Helm KI (Managed Operations)
Bleiben in der Kundenumgebung
Bestehende On-Prem-Strategie, aber ohne eigene Betriebsmannschaft
On-Premise beim Kunden
Standard
Standort
Eigene Server / VMs / K8s
Betrieb
Kunde
Daten
Bleiben in der Kundenumgebung
Geeignet für
Strenge IT-Sicherheits- und Datenschutzanforderungen
Managed On-Premise
Optional
Standort
Kundensysteme
Betrieb
Helm KI (Managed Operations)
Daten
Bleiben in der Kundenumgebung
Geeignet für
Bestehende On-Prem-Strategie, aber ohne eigene Betriebsmannschaft
Welches der beiden Betriebsmodelle zu Ihnen passt, klären wir im Erstgespräch – anhand vorhandener Infrastruktur, Sicherheitsanforderungen und Betriebsteam.
Spezifikationen
Datenabfluss
Datenfluss
0 Datenflüsse zu öffentlichen KI-Diensten
On-Premise als Standard – Daten verlassen die Vertrauenszone nicht
Modellgrößen
Modell
7B – 70B lokal · 200B+ auf Multi-Node-Clustern
Auswahl gemäß Hardware und Anwendungsfall
GPU-Anforderung
Hardware
NVIDIA RTX PRO 6000 Blackwell (96 GB, luftgekühlt) als Standard · 1× – 8× pro Instanz
Empfohlen für Neuanschaffungen. Bestehende H100 · A100 · L40S werden unterstützt – hardware-neutral, neuere Generationen (Rubin) sobald die Inferenz-Runtime sie freigibt · CPU-Inferenz für kleine Modelle möglich
Aktiv-Aktiv oder Aktiv-Passiv · optional Multi-Standort
SLAs im Enterprise-Paket
Pilot-Zeitraum
Einführung
4 – 8 Wochen bis produktive Pilotnutzung
Inkl. Sicherheitsanalyse und Zielarchitektur
Zielgruppen
Anwendungsbereiche und Branchen.
Typische Einsatzfelder, in denen sich kontrollierte KI-Nutzung besonders auszahlt – insbesondere unter den Datenschutz- und Sicherheitsanforderungen des DACH-Raums.
Anwendungsbereiche
Interner KI-Assistent für Mitarbeitende
Interne Wissenssuche über freigegebene Quellen
Vertrags- und Dokumentenanalyse
Support- und Service-Assistenz
AI Gateway für bestehende Softwareprodukte
Zusammenfassung interner Dokumente
Branchen
Mittelstand
Finanzdienstleister
Versicherungen
Kanzleien
Steuerberatung & Wirtschaftsprüfung
Healthcare & MedTech
Industrie & Maschinenbau
IT-Dienstleister
Öffentliche & regulierte Organisationen
Größere Unternehmensgruppen
Pakete & Förderung
Drei Stufen nach Unternehmensgröße – Module flexibel zubuchbar.
Private AI Chat ist in jedem Paket enthalten. Private AI Gateway und RAG lassen sich bei Bedarf in jeder Stufe dazubuchen. Die Stufen selbst unterscheiden sich ausschließlich in Unternehmensgröße, Nutzerzahl und der dafür ausgelegten Hardware. Preise werden pro Projekt kalkuliert.
Die Werte dienen als Orientierung – nicht als Mindestpflicht. Wenn Ihr Vorhaben nicht in eine Stufe passt, klären wir das im Erstgespräch und kalkulieren ein passendes Setup.
Förderfähigkeit
On-Premise-KI ist in vielen Fällen förderfähig.
Bund, Länder und EU bieten Programme, die KI-Einführung, Digitalisierung und Forschung & Entwicklung unterstützen. Welche im konkreten Fall passen, hängt von Unternehmensgröße, Standort und Projekttiefe ab. Wir unterstützen im Erstgespräch bei der Einordnung – die Antragstellung erfolgt durch das Kundenunternehmen, in der Regel mit einer Fördermittelberatung.
Deutschland
DE
Forschungszulage (FZulG)
Steuerliche F&E-Förderung – seit 2026 erweitert: Bemessungsgrundlage bis 12 Mio € / Jahr, KMU-Bonus 35 %.
KfW ERP-Förderkredit Digitalisierung (511 / 512)
Kredit ab 25.000 € für KI-Tools, Hardware und IT-Sicherheit. KI muss interne Daten nutzen – passt zum On-Premise-Modell.
ZIM
Zentrales Innovationsprogramm Mittelstand – F&E-Kooperationen, neue Konditionen seit 2025.
Bundesland-Programme
Digitalbonus Bayern Plus (bis 30.000 €), MID NRW (bis 70.000 €), DIGI-Zuschuss Hessen u. a.
Österreich
AT
FFG Basisprogramm
F&E-Projekte – Förderquoten bis 50 %, Antragssumme bis mehrere Millionen Euro.
aws Digitalisierung
Umsetzungsförderung bis 20.000 €, ergänzt durch Landesförderungen.
KMU.DIGITAL
Beratungsförderung für KI- und Digitalisierungsstrategie.
AI Mission Austria
Bündelung der nationalen KI-Förderungen seit 2026.
Schweiz
CH
Innosuisse Innovationsprojekte
Förderquoten 20–60 %, Voraussetzung: Kooperation mit einer Schweizer Forschungseinrichtung.
SECO – sektorale Programme
Branchenbezogene Digitalisierungs- und Innovationsförderung.
Kantonale Förderungen
Pro Kanton unterschiedlich – ergänzend zu Bundesprogrammen.
EU-Ebene: Digital Europe Programme, Horizon Europe und Eurostars flankieren die nationalen Programme. Der EU-Rahmen Cloud and AI Development Act (CADA) befindet sich 2026 im Gesetzgebungsverfahren – wir beobachten ihn aktiv, da er für souveräne KI-Infrastruktur einen eigenen Förderkanal öffnen kann.
Programme ändern sich jährlich. Die Aufstellung dient als Orientierung – wir treffen keine pauschalen Förderzusagen und übernehmen die Antragstellung nicht. Konkrete Förderfähigkeit, Antragsweg und Kombinierbarkeit klären wir gemeinsam im Erstgespräch oder mit Ihrer Fördermittelberatung.
FAQ
Häufige Fragen aus dem Erstgespräch.
Die Antworten geben Orientierung. Konkrete Aussagen treffen wir immer projektbezogen, weil Sicherheits- und Datenschutzanforderungen pro Unternehmen unterschiedlich gelagert sind.
Welche DSGVO-Pflichten übernehmen Sie – welche bleiben beim Kunden?+
Beim On-Premise-Betrieb bleiben die Datenverantwortung und der Großteil der DSGVO-Pflichten beim Kunden. Wir liefern eine Plattform, die DSGVO-konforme Betriebsmodelle unterstützt, dokumentieren Datenflüsse und unterstützen bei der Umsetzung interner Anforderungen. Beim Managed-On-Premise-Betrieb klären wir die Rollen (Verantwortlicher, Auftragsverarbeiter) im Auftragsverarbeitungsvertrag.
Können bestehende Identity-Systeme eingebunden werden?+
Ja. Standardmäßig unterstützt sind Microsoft Entra ID, Keycloak, LDAP und SAML 2.0. Rollen- und Gruppen-Mappings werden zur Steuerung der RAG-Berechtigungen und der Modell-Freigaben genutzt.
Welche Modelle lassen sich tatsächlich lokal betreiben?+
Modelle mit 7B – 70B Parametern lassen sich auf typischer GPU-Hardware lokal betreiben (z. B. Llama 3.1 70B auf 4×–8× H100 / A100). Größere Modelle (200B+) laufen auf Multi-Node-Clustern in Ihrer eigenen Infrastruktur. Die Modellauswahl ist Teil der Sicherheitsanalyse.
Wozu ein Gateway, wenn alles On-Premise läuft?+
Das Gateway ist nicht das Tor nach außen, sondern die zentrale Kontrollschicht zwischen Anwendungen und Modellen – auch und gerade im reinen On-Premise-Betrieb. Es übernimmt fünf interne Aufgaben: Routing zwischen mehreren internen Modellen (z. B. kleines Modell für Routine-Anfragen, großes Modell für komplexe Analysen), zentrale Durchsetzung von Policies und PII-Redaction, einheitliches Audit-Log, Kontrolle von Quoten und GPU-Lasten sowie eine stabile API für interne Anwendungen, die unabhängig vom konkreten Modell ist. Ohne Gateway müsste jede App diese Logik selbst implementieren – Drift, Lücken und schwer auditierbare Datenflüsse sind die Folge. Die zentrale Freigabe externer Anbieter ist eine zusätzliche, optionale Funktion und im reinen On-Premise-Betrieb deaktiviert.
Wie lange dauert ein typisches Pilotprojekt?+
Ein Pilot dauert in der Regel 4 – 8 Wochen, inklusive Sicherheitsanalyse, Zielarchitektur und Anbindung der ersten Datenquellen. Voraussetzung ist eine geklärte Hardware-Situation und ein definierter Pilot-Nutzerkreis.
Welche Förderprogramme kommen für ein On-Premise-KI-Projekt in Frage?+
Abhängig von Standort, Unternehmensgröße und Projekttiefe greifen unterschiedliche Programme. In Deutschland sind die Forschungszulage (FZulG), der KfW ERP-Förderkredit Digitalisierung (511/512) sowie Bundesland-Programme wie Digitalbonus Bayern Plus oder MID NRW häufige Optionen. In Österreich kommen FFG-Basisprogramm, aws Digitalisierung und KMU.DIGITAL in Betracht; in der Schweiz Innosuisse-Innovationsprojekte mit Forschungspartner. Eine Übersicht steht im Abschnitt Förderung weiter oben auf dieser Seite. Wir unterstützen im Erstgespräch bei der Einordnung – die Antragstellung erfolgt durch das Kundenunternehmen, in der Regel mit einer Fördermittelberatung. Pauschale Förderzusagen geben wir nicht.
Funktioniert der Betrieb in einer Air-Gapped Umgebung?+
Ja. Die Plattform ist so aufgebaut, dass sie ohne externe Verbindungen betrieben werden kann. Updates werden in solchen Umgebungen über kontrollierte Wege ausgeliefert. Air-Gapped-Setups sind Teil des Enterprise-Pakets.
Werden Daten über das Kundennetzwerk hinaus verarbeitet?+
Beim On-Premise-Betrieb nein. Beim Einsatz freigegebener externer Anbieter über das Gateway gelten ausschließlich die ausdrücklich freigegebenen Routen. Alle Aufrufe sind protokolliert und im Audit-Log nachvollziehbar.
Wie wird mit Modellupdates und neuen Anbietern umgegangen?+
Modelle und Anbieter werden zentral über das Gateway freigegeben. Neue Versionen durchlaufen einen Freigabeprozess, der pro Kunde definiert wird – inkl. Tests, Sicherheitsbewertung und kontrolliertem Rollout.
Kontakt
Beratungsgespräch oder schriftliche Anfrage.
Wir melden uns mit einer kurzen Agenda und stimmen die nächsten Schritte mit Ihnen ab.
Reaktionszeit
innerhalb 1 Werktag
Antwort mit Agenda für das Erstgespräch (30 – 45 Min.)
Vertraulich
unverbindlich
NDA auf Wunsch vor Abstimmung der technischen Details
Sprache · Region
Deutsch · DACH
Betrieb ausschließlich On-Premise in Ihrer eigenen Infrastruktur