Sovereign AI · Private RAG · EU Infrastructure

Private AI-Infrastruktur für Unternehmen, die Kontrolle behalten müssen

Konzeption und Aufbau von RAG- und LLM-Plattformen auf europäischer oder kundeneigener Infrastruktur, mit kontrollierbaren Datenflüssen, Identitäten, Betriebsprozessen und Abhängigkeiten.

AI-Vorhaben besprechen

Warum nicht einfach eine Public-AI-Lösung?

Für viele Unternehmen sind generische AI-Dienste kein gangbarer Weg. Nicht, weil Public Cloud grundsätzlich unsicher wäre, sondern weil konkrete Anforderungen dagegenstehen:

  • Sensible interne Daten und interne Zugriffs- und Berechtigungskonzepte
  • Regulatorische Anforderungen und Anforderungen an EU-Hosting
  • Fehlende Transparenz über Datenflüsse externer Dienste
  • Vendor Lock-in bei Modellen, APIs und Infrastruktur
  • Fehlende Betriebs- und Governance-Strukturen für AI-Workloads

Was angeboten wird

01

AI Readiness & Architektur

  • Use-Case-Bewertung
  • Daten- und Systemanalyse
  • Zielarchitektur
  • Hosting- und Modellstrategie
  • Souveränitätsanforderungen
  • Technische Roadmap

02

Private RAG Deployment

  • Dokumenten-Ingestion
  • Embeddings und Vector Store
  • Retrieval
  • API-Schicht
  • Authentifizierung
  • Zugriffskontrolle

03

Sovereign Platform Setup

  • Kubernetes (Standard: SUSE RKE2) oder OpenShift
  • EU-Cloud oder kundeneigene Infrastruktur
  • GitOps
  • Secrets und Identity
  • Observability

Nach dem Projekt

Managed AI Operations

Nach dem Projekt geht die Plattform in den Betrieb über: monatlicher Betriebs-Retainer, standardmäßig in jedem Projektangebot enthalten. Definierte Reaktionszeiten innerhalb der Geschäftszeiten (Mo bis Fr, CET) mit automatisiertem Alerting rund um die Uhr.

Bewusst ohne 24/7-Bereitschaft und ohne SLA-Pönalen: nachvollziehbare Betriebsprozesse statt formaler Zusagen.

Vier Souveränitätsstufen

Die Infrastrukturwahl folgt den tatsächlichen Datenanforderungen, nicht umgekehrt.

Stufe 1

EU-Region

Datenresidenz in der EU; der Betreiber kann US-eigen sein (z. B. AWS Frankfurt).

Typisch: unkritische Daten mit EU-Residenzanforderung.
Einschränkung: US-Rechtszugriff nicht ausgeschlossen.

Stufe 2

EU Sovereign Cloud

EU-Personal und EU-Betrieb, aber US-Mutterkonzern (z. B. AWS European Sovereign Cloud).

Typisch: regulierte Workloads mit Hyperscaler-Anschluss.
Einschränkung: Konzernstruktur bleibt US-geprägt.

Stufe 3 · Standard

EU-eigene Cloud

Kein US-Rechtszugriff auf irgendeiner Ebene: Scaleway, STACKIT, IONOS. Standard für verwaltete Deployments.

Typisch: sensible Unternehmensdaten mit Cloud-Betrieb.
Einschränkung: kleineres Managed-Service-Portfolio als Hyperscaler.

Stufe 4

On-Premises

Modell und Daten vollständig auf kundeneigener Hardware.

Typisch: höchste Vertraulichkeit, Air-Gap-nahe Umgebungen.
Einschränkung: Hardware, GPU-Kapazität und Betrieb liegen beim Kunden.

Der definierte Einstieg

AI Readiness Sprint

Ein klar abgegrenzter Einstieg, bevor über Infrastruktur oder Umsetzung entschieden wird, mit schriftlicher Ergebnisdokumentation als Entscheidungsgrundlage.

  • Ein bis zwei Workshops
  • Use-Case- und Datenanalyse
  • Infrastruktur- und Hostingoptionen
  • Datenschutz- und Risikofragen aus technischer Sicht
  • Zielarchitektur und Roadmap
  • Schriftliche Ergebnisdokumentation

Festpreis

€2.000

zzgl. USt.

Bei Projektbeauftragung innerhalb von 60 Tagen werden €1.000 angerechnet.

AI Readiness Sprint anfragen

Referenzarchitektur und Referenzplattform

Reduzierte Darstellung einer privaten RAG-Plattform: jede Komponente läuft auf kontrollierbarer Infrastruktur.

Referenzplattform

Eigene Referenzplattform, verifiziert auf vier Infrastruktur-Zielen

BSE IT CONSULTING betreibt eine eigene Referenz- und Entwicklungsplattform für RAG- und AI-Workloads, entwickelt für den Betrieb auf unterschiedlichen Infrastruktur-Zielen. Dieselben versionierten Helm-Charts sind deployt und verifiziert auf:

  • SUSE RKE2 (Bare-Metal)
  • Managed Kubernetes in der EU-Cloud (Scaleway, STACKIT)
  • AWS European Sovereign Cloud (EKS, Region Brandenburg)
  • OpenShift SNO
Argo CD · Zwei-Repository-Muster Qdrant · Dokumenten-Ingestion vLLM · EU-gehostete Inferenz Keycloak SSO/OIDC External Secrets · RBAC kube-prometheus-stack · Grafana · Langfuse Terraform

Referenz- und Entwicklungsplattform von BSE IT CONSULTING, zugleich technische Basis des Sovereign-AI-Angebots.

Vorgehensmodell

Phase 1

Use Case und Anforderungen

  • Bewerteter Use Case
  • Datenklassifizierung
  • Souveränitätsanforderungen

Phase 2

Architektur und Scope

  • Zielarchitektur
  • Hosting-Entscheidung
  • Abgegrenzter Projektumfang

Phase 3

Pilot oder Referenzimplementierung

  • Lauffähige RAG-Plattform
  • Angebundene Dokumentquellen
  • Evaluierung mit echten Nutzern

Phase 4

Produktionsreife und Betriebsmodell

  • Gehärteter Betrieb
  • Observability und Alerting
  • Definiertes Betriebsmodell

Sovereign-AI-Vorhaben technisch bewerten

Beschreiben Sie kurz Vorhaben, Datenlage und Zeithorizont. Sie erhalten eine direkte Rückmeldung ohne vorgeschalteten Vertrieb.

Erstgespräch anfragen