NCA Social Media
Erstellt:
Aktualisiert:
Autor:
Roland Golla
Self Hosted KI für Unternehmen 2026 mit Multi Tenant Architektur und DSGVO

Was ist Self Hosted KI für Unternehmen 2026?

Self Hosted KI für Unternehmen bezeichnet den Betrieb von KI Modellen, Inferenz Servern und Frontends auf der eigenen Infrastruktur eines Unternehmens, statt sie über externe Cloud APIs wie OpenAI, Anthropic oder Google zu nutzen. Prompts, Dokumente und Antworten verlassen das eigene Rechenzentrum nicht und unterliegen vollständig der eigenen Kontrolle.

Der Unterschied zu generischem Self Hosting ist die Unternehmens Perspektive. In einer Organisation greifen mehrere Abteilungen, Mandanten oder Tochtergesellschaften auf dieselbe KI Infrastruktur zu. Multi Tenant Architektur trennt diese Mandanten sauber voneinander, regelt Zugriffsrechte, protokolliert Nutzung über Audit Logs und stellt sicher, dass die HR Abteilung nicht versehentlich Daten der Finanzabteilung sieht.

Treiber für diese Architektur sind 2026 vor allem drei Themen. Die DSGVO mit Bußgeldern bis zu 4 Prozent des Jahresumsatzes oder 20 Millionen Euro bei Datenschutz Verstößen. Berufsgeheimnisse bei Anwälten, Steuerberatern, Ärzten und Wirtschaftsprüfern, die eine Datenweitergabe an Dritte rechtlich ausschließen. Und sensible Geschäftsdaten wie Lieferanten Konditionen, Personalakten und nicht öffentliche Finanzplanung, die nicht auf US Servern landen sollen.

Inhalt

Self Hosted KI mit NCA: Schnelle Hilfe vom Experten

Never Code Alone aus Duisburg betreibt eigene KI Inferenz auf Servern in Deutschland, nicht in der US Cloud. Wir nutzen täglich Ollama mit Qwen3 Coder und Llama, dazu Gemini, GLM und MiniMax für spezielle Aufgaben. Die typischen Stolperfallen kennen wir aus eigener Praxis: GPU Auswahl, Quantisierung, Mandanten Trennung, Token Durchsatz und das Zusammenspiel von Inferenz Engine, Frontend und Vektor Datenbank.

Für Unternehmen mit DSGVO Bedarf bieten wir das volle Spektrum. Im Vibe Coding Consulting klären wir Stack Auswahl und Architektur, in der Vibe Coding Datenschutz Beratung bauen wir Rollenkonzepte, Verschlüsselung und Audit Logging. Wir migrieren bestehende Cloud Setups auf Ollama oder vLLM, richten Open WebUI als Multi Tenant Frontend ein und beraten zur passenden Compliance Architektur für Berufsgeheimnisträger. Wer den größeren Schritt plant, findet bei der SaaS Ablösung mit eigener Plattform die strategische Ergänzung. Für kleinere Teams ist KI Assistenten selbst hosten der passende Einstieg.

Lass uns sprechen
Finde das passende Angebot für dein Projekt
Anfrage-Konfiguration
Starten Sie Ihre Anfrage
Projektart
Infos
Nachricht

Eliminierung technischer Schulden mit PHPStan, Rector PHP und PHPUnit. Über 20 Jahre Praxiserfahrung in skalierbaren Backends.

CORE EXPERTISE

Gesetzliche Konformität & Inklusion. Optimierung von Performance und Conversion durch radikal nutzerzentriertes, universelles Design.

BFSG COMPLIANT

Skalierbare KI-Systeme mit echtem Code Ownership. CI/CD, Backup-Strategien und Infrastruktur, die mit deinem Team wächst.

ENTERPRISE READY

Vorteile von Self Hosted KI für Unternehmen

Self Hosted KI auf eigener Infrastruktur gibt Unternehmen drei Dinge zurück, die in der Cloud schwer zu halten sind: volle Datensouveränität, planbare Kosten und Unabhängigkeit von Preisänderungen oder Modell Abschaltungen.

Datensouveränität ohne Auftragsverarbeitung Dritter. Die DSGVO verlangt für jede Verarbeitung personenbezogener Daten eine Rechtsgrundlage und einen Auftragsverarbeitungsvertrag mit jedem Dienstleister, der die Daten sieht. Sobald ein Prompt an OpenAI oder Anthropic geht, ist ein US Anbieter im Spiel. Self Hosting schaltet diesen Vertragspartner aus, weil keine Daten das eigene Rechenzentrum verlassen.

Berufsgeheimnis bleibt gewahrt. Für Anwälte, Steuerberater, Wirtschaftsprüfer, Ärzte und Therapeuten ist das zentral, weil Paragraph 203 StGB die Weitergabe anvertrauter Geheimnisse unter Strafe stellt. Cloud KI Anbieter sind nicht ohne weiteres als zulässige Hilfspersonen eingeordnet. Eine lokale Inferenz schließt das Risiko sauber aus.

Kosten werden planbar. Cloud KI rechnet pro Million Token ab. Mit vielen Nutzern und Agenten wächst die Rechnung mit jedem Prompt. Eigene Hardware kostet einmal in der Anschaffung, danach vor allem Strom und Wartung. Ob und wann sich das rechnet, hängt von Last und Modell ab. Diese Rechnung machen wir mit Teams ehrlich auf, Hintergründe stehen unter lokale KI wirtschaftlich betreiben.

Schutz vor Modell Abschaltungen. Cloud Anbieter ziehen ältere Modelle regelmäßig aus dem Angebot. Wer seinen Workflow auf ein lokal gespeichertes Modell aufsetzt, betreibt ihn unverändert weiter, auch wenn neue Versionen erscheinen.

Der NCA Stack für Self Hosted KI in Unternehmen

Für Unternehmens Setups nutzen wir einen abgestimmten Stack, den wir täglich in eigener Production fahren. Die Bausteine sind austauschbar. Diese Kombination hat sich für deutsche Unternehmen mit DSGVO Anspruch als robust erwiesen.

Inferenz Engine als Default: Ollama. Einfache Installation, breite Modell Auswahl, gute Performance auf Apple Silicon und auf Linux mit NVIDIA GPU. Bei vielen parallelen Nutzern wechseln wir auf vLLM mit PagedAttention, das im Multi User Betrieb deutlich mehr Tokens pro Sekunde liefert. Für CPU only Setups oder eingebettete Geräte ist llama.cpp die richtige Wahl.

Multi User Frontend: Open WebUI. Open Source Web Interface mit Benutzer Verwaltung, Rollen, Gruppen, RAG, Modell Routing und Logging. Es lässt sich mit wenigen Docker Befehlen aufsetzen und über LDAP oder OIDC an Active Directory anbinden.

Agenten Orchestrierung: Paperclip. Wenn aus dem einfachen Chat ein Team aus spezialisierten KI Agenten werden soll, ist Paperclip die passende Wahl. Org Charts, Budget Kontrolle, Audit Log, alles selbst gehostet.

Open Weight Modelle statt US API. Qwen3 Coder und Llama sind unsere Arbeitstiere für Coding und Texte. Seit August 2026 läuft mit Qwen3.8 27B zudem ein starkes dichtes Modell auf einer einzelnen 24 GB GPU. Sehr große Modelle wie GLM 5.3 oder Kimi K3 haben mehrere hundert Milliarden bis Billionen Parameter. Für echtes Self Hosting brauchen sie Rechenzentrums Hardware, Ollama bietet sie als Cloud Variante an. Embeddings laufen auf multilingual e5 large: MIT lizenziert, rund hundert Sprachen, kostenlos. Alternativen zeigt unser Vergleich der Embedding Modelle für RAG.

Hosting Default: Ollama auf eigenem Server. Bei Bedarf gehostete Inferenz über unseren Partner Conversis in Duisburg. Das ist die Enterprise Option für regulierte Branchen, deren Compliance eine spezialisierte Rechenzentrums Umgebung verlangt.

Vier Stufen der KI Hosting Souveränität

Self Hosted KI ist kein binärer Schalter, sondern ein Spektrum. Wer als Unternehmen die passende Stufe für seinen Bedarf finden will, sollte vier Hosting Modelle kennen und für jedes Use Case bewusst eine Wahl treffen. Die Stufen unterscheiden sich in Datenhoheit, Bedienkomfort, Kosten und der Frage, wer letztlich auf die Daten Zugriff hat.

Die folgende Tabelle ordnet die Stufen mit typischen Tools und der jeweiligen Eignung. Die anschließende Infografik zeigt die Souveränität visuell als aufsteigende Balken.

Level Tools und Anbieter Eignung und Souveränität
Level 1: Cloud API OpenAI, Anthropic, Google Gemini, AWS Bedrock Niedrige Souveränität, Daten gehen an US Anbieter, schnell startklar, ungeeignet für DSGVO sensible Daten ohne Zusatzverträge
Level 2: Hosted EU Mistral La Plateforme, IONOS AI Studio, Aleph Alpha Mittlere Souveränität, EU Hosting mit AVV, kein Eigenbetrieb, gute Wahl für niedrige Sensibilität bei mittlerem Compliance Bedarf
Level 3: Managed Self Hosted Conversis in Duisburg, Hetzner Dedicated mit Managed Service Hohe Souveränität, eigene Modelle auf gemieteter Infrastruktur, ideal für regulierte Branchen mit begrenzten Inhouse Kapazitäten
Level 4: Eigene Hardware Mac Mini Cluster, NVIDIA GPU Workstation, Server im eigenen Rack Vollständige Souveränität, alle Daten bleiben im Haus, höhere Initialkosten, volle Kontrolle über Modelle und Updates
Cartoon Entwickler mit Daten Folder steigt vier Stufen der KI Hosting Souveränität zur sicheren Festung

Multi Tenant Architektur für Self Hosted KI

In Unternehmen reicht eine einzige geteilte KI Installation selten aus. Sobald mehrere Abteilungen, Mandanten oder Tochtergesellschaften zugreifen, braucht es saubere Trennung auf allen Ebenen. Ohne Multi Tenant Design entstehen schnell DSGVO Konflikte, Vertraulichkeitsprobleme und Audit Fallen.

Mandanten Trennung auf Datenebene. Jeder Mandant bekommt eine eigene Datenbank, einen eigenen Vektor Index für RAG und eigene Storage Buckets. Cross Tenant Queries sind technisch unmöglich, nicht nur durch Rechte verboten. Open WebUI bildet das über Gruppen und Berechtigungen ab und bindet bestehende Identity Provider per OIDC oder LDAP an.

Modell Trennung nach Sensibilität. Nicht alle Daten brauchen das gleiche Modell. Für allgemeine Recherche reicht ein kleines schnelles Modell, für hoch sensible juristische Texte ein eigens auditiertes Setup mit Protokollierung. Über einen Routing Layer wie LiteLLM oder einen eigenen Proxy hinterlegst du pro Mandant und pro Use Case das passende Modell.

Audit Logging als Pflicht. Wer welchen Prompt wann gestellt hat und welche Antwort zurückkam, gehört in ein revisionssicheres Log. Bei Berufsgeheimnisträgern und in regulierten Branchen fragt der Prüfer im Ernstfall genau danach. Paperclip bringt Audit Log und Budget Kontrolle mit, Open WebUI speichert Konversationen pro Nutzer.

Rate Limits und Budget Töpfe pro Tenant. Eine einzige Abteilung kann mit unkontrollierten Agent Loops die ganze Inferenz Infrastruktur in die Knie zwingen. Quoten pro Mandant verhindern das und machen Kosten und Last fair zuordenbar. Im Vibe Coding Consulting nehmen wir genau diese Architektur Themen mit ins Setup auf.

Use Cases für Self Hosted KI im Unternehmen

Sobald Datensouveränität nicht verhandelbar ist, sortieren sich die Use Cases von selbst. NCA berät zu diesen typischen Szenarien, in denen Self Hosted KI den Unterschied macht.

OCR und Verarbeitung sensibler Akten. Verträge, Personalakten, medizinische Befunde, Schriftsätze. Solche Dokumente dürfen nicht an externe APIs. Lokale Vision Modelle wie Qwen3 VL oder das spezialisierte GLM OCR laufen über Ollama auf dem eigenen Server und extrahieren Text und Struktur. Das Ergebnis landet in der eigenen Datenbank. Wer ein fertiges Archiv sucht, schaut sich Paperless-ngx mit lokaler KI über Ollama an.

Interne Recherche mit RAG auf Geschäftsgeheimnissen. Mitarbeiter fragen nach Lieferanten Konditionen, Prozessdokumenten oder vertraulichen Strategie Papieren, ohne dass eine externe KI diese Dokumente je sieht. Open WebUI mit eigener Knowledge Base und einem lokalen Embedding Modell wie multilingual e5 large löst genau das.

Transkription von Meetings und Interviews. Aufzeichnungen aus Vorstandssitzungen, Personalgesprächen oder Mandanten Terminen gehören nicht in eine Cloud Transkription. Lokale Whisper Varianten liefern Transkripte direkt auf eigener Hardware.

KI gestütztes Coding für vertraulichen Code. Wenn Quellcode unter Geheimhaltung fällt, darf er nicht an Cloud Modelle gehen. Die Lösung: Claude Code oder OpenCode laufen über Ollama gegen lokale Coding Modelle wie Qwen3 Coder, Qwen3.8 27B oder Devstral Small 2. Der Code verlässt das Haus nicht.

Agenten Teams für Backoffice Automatisierung. Buchhaltung, HR, Compliance, Lieferanten Onboarding. Wer hier Agenten einsetzt, braucht eine Orchestrierungs Schicht, die die Mandanten Trennung respektiert. Paperclip übernimmt Org Chart und Budget Kontrolle, lokale Modelle die Inferenz.

DSGVO und Berufsgeheimnis: Rechtliche Treiber im Detail

Wer in Deutschland mit personenbezogenen oder geheimhaltungspflichtigen Daten arbeitet, kommt um drei rechtliche Hebel nicht herum: DSGVO, Paragraph 203 StGB und die NIS2 Richtlinie. Self Hosted KI ist in vielen Konstellationen der sauberste Weg.

DSGVO Auftragsverarbeitung mit US Anbietern bleibt heikel. Trotz EU US Data Privacy Framework gibt es weiter rechtliche Unsicherheit bei Daten Transfers in die USA. Eine eigene Inferenz nimmt das Thema aus dem Verarbeitungsverzeichnis, weil kein externer Auftragsverarbeiter beteiligt ist.

Paragraph 203 StGB für Berufsgeheimnisträger. Anwälte, Ärzte, Steuerberater, Wirtschaftsprüfer und Therapeuten dürfen anvertraute Geheimnisse nicht an Dritte weitergeben. Auch wenn ein KI Anbieter zur Verschwiegenheit verpflichtet ist, bleibt die Einordnung als zulässige Hilfsperson umstritten. Lokale Inferenz vermeidet die Diskussion. Mehr dazu unter lokale KI für Compliance und Berufsgeheimnis.

NIS2 für wichtige und besonders wichtige Einrichtungen. Energie, Wasser, Gesundheit, Finanzen, Telekommunikation und viele weitere Sektoren. Seit dem 6. Dezember 2025 gilt in Deutschland das NIS2 Umsetzungsgesetz, ohne Übergangsfrist. Es verlangt strenge Cybersecurity Maßnahmen inklusive Lieferketten Sicherheit. Ein selbst kontrollierter KI Stack reduziert das Lieferantenrisiko deutlich.

Der Bußgeld Rahmen rechtfertigt die Investition. DSGVO Bußgelder reichen bis 20 Millionen Euro oder 4 Prozent des weltweiten Jahresumsatzes, je nachdem, welcher Betrag höher ist. Ein einziger ernster Verstoß kann damit teurer werden als eine eigene GPU Infrastruktur. Aufstellung und Architektur klären wir in der Vibe Coding Datenschutz Beratung.

As AI evolves, private and sovereign approaches are testing enterprise readiness.

Abhijit Dubey, CEO und Chief AI Officer NTT DATA Inc. – via Help Net Security

Was Dubeys Statement für deutsche Unternehmen bedeutet

Für den NTT DATA Report zu Private und Sovereign AI wurden über 2500 Organisationen befragt. Das Ergebnis zeigt, wie hoch das Thema hängt:

  • 95 Prozent halten private oder souveräne KI für wichtig in ihrer KI Strategie.
  • 96 Prozent erwägen wegen geopolitischer Spannungen, KI Infrastruktur in bestimmte Regionen zu verlagern.
  • 57 Prozent der CEOs sehen Datenschutz und Datensouveränität als Risiko für ihr Unternehmen.

Genau diese Spannung meint Dubey mit Enterprise Readiness. Wer Self Hosted KI nur als Compliance Pflicht versteht, baut eine teure Sonderlösung, die niemand nutzen will. Wer sie als operatives Fundament begreift, schafft eine Architektur, die über Standorte und Geschäftsbereiche hinweg funktioniert und mit dem Unternehmen wächst. NCA begleitet den Schritt vom punktuellen Setup zum tragfähigen Stack, in dem Multi Tenant Trennung, Audit Logging und Modell Routing kein Add On sind, sondern das Fundament. Den größeren Rahmen beschreibt unser Beitrag zur digitalen Souveränität für Entwickler.

NCA Erfahrung mit Self Hosted KI in Unternehmen

Never Code Alone berät zu Self Hosting Setups, betreibt die eigene Infrastruktur in Deutschland und kennt die Stolperfallen aus erster Hand. Drei Beobachtungen aus unserer Beratung 2026.

Die GPU Frage ist selten der Engpass. Viele Unternehmen denken zuerst an große H100 Cluster und schrecken vor den Kosten zurück. Für viele Setups reicht ein Mac Mini mit M4 oder eine Workstation mit RTX 4090, weil die Last selten gleichzeitig auftritt und kleinere Modelle viele Aufgaben gut lösen. Wir helfen Teams, die passende Hardware zu finden, statt überdimensioniert einzukaufen.

Der eigentliche Aufwand liegt im Frontend und in der Anbindung. Open WebUI aufsetzen dauert Stunden. Single Sign On, LDAP, Rollenkonzepte, RAG mit eigenen Dokumenten und das Onboarding der Mitarbeiter brauchen Wochen. Wer das unterschätzt, scheitert an der Akzeptanz, nicht an der Technik. Das gleiche Muster sehen wir bei der SaaS Ablösung mit eigener Plattform.

Hybride Setups sind oft der pragmatische Mittelweg. Sensible Daten laufen lokal, unkritische Aufgaben dürfen weiter über Cloud APIs. Voraussetzung ist ein sauberer Routing Layer, der die Daten Klassifizierung respektiert. Solche Setups bauen wir im Vibe Coding Consulting und übernehmen auf Wunsch das Onboarding, damit das interne Team danach selbst weiter operiert.

Zum Vertiefen: Ollama Grundlagen im KI Tools Glossar, Vibe Coding Best Practices für DSGVO konformen Aufbau, llama.cpp für CPU only Setups, Hermes Agent für selbstlernende Agenten und Coolify als Self Hosted PaaS.

Die Infrastruktur ist nur die halbe Miete. Erst wenn das Entwicklerteam täglich damit arbeitet, zahlt sie sich aus. Wie wir Quality Gates und Agenten im Team verankern, steht unter KI Agenten im Entwicklerteam. Ein gutes Setup ist 2026 auch ein Argument im Bewerbungsgespräch.

CYPRESS.IO Ambassador und IT Consultant für QA Engenieering und Qualität in PHP Projekten.
NCA Vibe Coding Consulting

Roland Golla ist Entwickler aus Leidenschaft – seit über 20 Jahren. Er hat hunderte Projekte begleitet, von Legacy-Refactoring bis KI-Integration. Bei Vibe Coding verbindet er das Beste aus beiden Welten: Die Geschwindigkeit von KI-generiertem Code mit der Qualität professioneller Softwareentwicklung. Kein Bullshit, keine Agentur-Floskeln – direkte Hilfe von jemandem, der selbst täglich im Code steckt.

Häufige Fragen zu Self Hosted KI für Unternehmen

Die wichtigsten Fragen rund um Self Hosted KI in Unternehmen, von DSGVO und Multi Tenant bis zu Hardware Auswahl und Kosten.

Was ist Self Hosted KI für Unternehmen 2026?

Self Hosted KI für Unternehmen ist der Betrieb von KI Modellen und Frontends auf eigener Infrastruktur, ohne externe Cloud APIs. Prompts und Antworten verlassen das eigene Rechenzentrum nicht. Anders als beim privaten Self Hosting stehen Mandanten Trennung, Rollenverwaltung und Audit Logging im Vordergrund. So arbeiten mehrere Abteilungen oder Tochtergesellschaften sauber getrennt auf derselben Plattform.

Welche Tools brauche ich für Self Hosted KI in Unternehmen 2026?

Der NCA Stack kombiniert Ollama oder vLLM als Inferenz Engine, Open WebUI als Multi User Frontend und optional Paperclip für Agenten Orchestrierung. Als Modelle laufen Qwen3 Coder, Llama oder das seit August 2026 verfügbare Qwen3.8 27B. Embeddings laufen auf multilingual e5 large. Für CPU only Setups passt llama.cpp. Gehostet wird auf eigenen Servern oder über Conversis in Duisburg.

Wie funktioniert Multi Tenant Architektur bei Self Hosted KI 2026?

Multi Tenant trennt Mandanten technisch auf Ebene von Datenbank, Vektor Index und Storage. Open WebUI bildet das über Gruppen ab und bindet Active Directory per OIDC oder LDAP an. Ein Routing Layer wie LiteLLM hinterlegt pro Mandant das passende Modell. Audit Logging und Quoten pro Mandant verhindern Ressourcen Konflikte und machen die Nutzung revisionssicher nachvollziehbar.

Was kostet Self Hosted KI für ein mittelständisches Unternehmen 2026?

Das hängt von Nutzerzahl, Hardware, Modell und Integrationsaufwand ab, deshalb nennen wir keine Pauschalpreise. Im kostenlosen Kennenlernen klären wir Anforderungen und schätzen den Aufwand. Danach rechnen wir transparent minutengenau ab. Bei der Hardware helfen wir, weder zu groß noch zu klein einzukaufen. Oft reicht für den Start eine einzelne Workstation.

Welche DSGVO Vorteile bringt Self Hosted KI 2026?

Self Hosted KI nimmt die Verarbeitung aus der Kette externer Auftragsverarbeiter, weil kein Cloud Anbieter beteiligt ist. Damit entfallen Diskussionen um US Anbieter, Data Privacy Framework und Drittstaaten Transfers. Für Berufsgeheimnisträger nach Paragraph 203 StGB ist es oft die rechtlich sauberste Lösung. Auch die Anforderungen aus dem NIS2 Umsetzungsgesetz lassen sich leichter erfüllen.

Welche Hardware brauche ich für eine eigene KI Inferenz?

Für kleine Teams reicht oft ein Mac Mini mit M4 oder eine Workstation mit RTX 4090. Qwen3 Coder 30B und Qwen3.8 27B passen in Q4 Quantisierung auf eine 24 GB GPU. Größere Modelle wie Qwen3 Coder Next brauchen 64 GB Speicher und mehr, sehr große Modelle Rechenzentrums GPUs. NCA hilft bei der Auswahl passend zur echten Last.

Wie integriere ich Self Hosted KI in Active Directory?

Open WebUI unterstützt OIDC und LDAP direkt. Über einen Identity Provider wie Keycloak oder die Anbindung an Microsoft Entra ID übernimmst du Nutzer, Gruppen und Rollen aus dem AD. Single Sign On funktioniert damit ohne zweites Passwort. Logs zeigen, wer wann was gefragt hat. NCA setzt diese Integration in der Vibe Coding Datenschutz Beratung um.

Welches Modell eignet sich für deutsche Sprache?

Aktuelle Open Weight Modelle wie Qwen3.8 27B, Llama und Gemma 4 liefern gute deutsche Texte. Für Embeddings ist multilingual e5 large mit rund hundert Sprachen eine robuste Wahl. Welches Modell bei euren Texten vorne liegt, zeigt ein kurzer Test mit echten Dokumenten. Bei sehr spezieller Fachsprache aus Recht oder Medizin kann Feintuning auf eigene Daten helfen.

Wie funktioniert RAG mit eigenen Dokumenten?

Retrieval Augmented Generation kombiniert lokale Embeddings mit einem Vektor Index wie Qdrant oder pgvector. Dokumente werden in Abschnitte zerlegt, in Vektoren übersetzt und im Index gespeichert. Bei jeder Frage holt das System die ähnlichsten Abschnitte und gibt sie dem Modell als Kontext. Open WebUI bringt eine Knowledge Base mit, die diesen Ablauf direkt abbildet.

Was passiert, wenn das lokale Modell nicht ausreicht?

Dann ist ein hybrides Setup oft die pragmatische Lösung. Sensible Daten bleiben lokal, unkritische Aufgaben gehen über eine Cloud API. Voraussetzung ist ein sauberes Routing mit Daten Klassifizierung, das automatisch entscheidet, welcher Weg passt. Dieses Setup baut NCA im Beratungsprojekt mit klaren Compliance Regeln, damit kein vertraulicher Inhalt versehentlich nach außen geht.

Wie unterscheidet sich Self Hosted KI von Cloud KI für Anwälte?

Für Anwälte und andere Berufsgeheimnisträger ist der Unterschied rechtlich entscheidend. Cloud KI bedeutet Weitergabe an Dritte, was nach Paragraph 203 StGB problematisch sein kann, selbst mit Auftragsverarbeitung. Self Hosted KI verlässt das Haus nicht, die Frage nach der Hilfsperson stellt sich nicht. Für Mandantenakten, Vertragsentwürfe und Schriftsätze ist das oft die sauberste Lösung.

Kann NCA die Infrastruktur für mich betreiben?

NCA unterstützt beim Setup und bei der Übergabe an interne Teams. Wer keine eigene Operations Mannschaft hat, kann gehostete Inferenz über unseren Partner Conversis in Duisburg nutzen, einen deutschen Rechenzentrums Anbieter. Default bei NCA bleibt die direkte Eigenkontrolle mit Ollama auf eigenen Servern, Conversis ist die Enterprise Option für regulierte Branchen.