Souveräne & lokale KI
Du bestimmst, wo die Daten liegen und wo das Modell läuft.
Individuelle KI auf Infrastruktur, die du kontrollierst: deine Cloud-Region, deine Server oder deine Geräteflotte. Lokale Modelle für Fälle, die nicht raus dürfen, Anbieter-APIs dort, wo es geht.
[ 01 — DAS BEKOMMST DU ]
Kontrolle, auf die du zeigen kannst.
Souverän heisst nicht, dass alles On-Premises läuft. Es heisst, dass jeder Workflow eine dokumentierte Antwort darauf hat, wohin Daten gehen.
- [ 01 ]Pro Workflow: Welche Daten gehen hinein, wo läuft die Inferenz, welcher Anbieter oder welches Modell sieht sie und was wird gespeichert.
- [ 02 ]
Betriebsvarianten
Dein Cloud-Tenant und deine Region, ein privater Endpunkt, Server, die du betreibst, oder ein lokales Modell auf verwalteten Geräten. - [ 03 ]
Modellauswahl
Open-Weight-Modelle wie die Familien Llama, Mistral oder Qwen neben Anbietermodellen. Wir testen sie an deinen Aufgaben und berichten die Qualitätslücke. - [ 04 ]
Gesteuerter Zugriff
Deine Identitäten, Rollen und Protokollierung vor jedem Modell, damit die Nutzung zuordenbar und prüfbar ist. - [ 05 ]
Ehrliche Kompromisse
Lokale Modelle kosten Hardware und Pflege und sind bei manchen Aufgaben schwächer. Du bekommst die Zahlen, bevor du dich festlegst.
[ 02 — ABLAUF ]
Mit Belegen entscheiden.
Wir vergleichen die Optionen an deinen eigenen Aufgaben, nicht an Benchmarks.
- 01
Daten klassifizieren
Welche Daten dürfen zu einem Anbieter, welche nur in deine Cloud-Region, welche müssen im Haus bleiben.1 bis 2 Wochen - 02
Modelle testen
Wir lassen eine Stichprobe deiner Aufgaben durch lokale und gehostete Kandidaten laufen und vergleichen Qualität, Tempo und Kosten.2 Wochen - 03
Setup pilotieren
Ein Workflow auf der gewählten Architektur, mit Protokollierung und Zugriffskontrolle.4 Wochen - 04
Übergeben
Runbook, Monitoring und ein benannter Owner. Du kannst es selbst betreiben, oder wir übernehmen das im Rahmen einer separaten Vereinbarung.1 bis 2 Wochen
[ 03 — ANWENDUNGSFÄLLE ]
Fälle, in denen es zählt.
Typische Szenarien. Keines davon beschreibt einen bestimmten Kunden.
Interner Wissensassistent
- Heute
- Mitarbeitende dürfen öffentliche Chatbots nicht mit internen Dokumenten nutzen.
- Mit dem Workflow
- Ein privater Assistent antwortet aus freigegebenen Dokumenten und nennt Quellen. Er respektiert die bestehenden Dateiberechtigungen.
Verarbeitung sensibler Dokumente
- Heute
- Verträge oder Fallakten werden von Hand gelesen, weil sie nicht an eine externe API dürfen.
- Mit dem Workflow
- Ein lokales Modell extrahiert Felder und Zusammenfassungen auf deinen eigenen Servern. Ein Mensch bestätigt jedes Ergebnis.
Vorgabe zum Hosting-Standort
- Heute
- Ein Kundenvertrag verlangt die Verarbeitung in einer definierten Region.
- Mit dem Workflow
- Der Workflow läuft auf einem Modell in dieser Region, mit einem Log, das zeigt, wo jede Anfrage lief.
[ 04 — UMFANG & PREIS ]
Erst die Architektur, dann der Bau.
Architektur & Setup für souveräne KI · 6 bis 8 Wochen
Hardware- und Inferenzkosten kommen separat. Erweiterungen: CHF 2'200 pro Tag.
- Daten- und Hosting-Karte
- Modelltests an deinen Aufgaben
- Ein Workflow auf dem gewählten Setup
- Runbook und benannter Owner
[ 05 — FRAGEN ]
Was Leute zu souveräner KI fragen.
Ist lokale KI so gut wie die grossen Modelle?
Nicht bei jeder Aufgabe. Für enge, klar definierte Arbeit wie Extraktion oder Klassifikation schneiden kompakte lokale Modelle oft gut ab. Für offenes Schlussfolgern sind Anbietermodelle meist stärker. Wir messen das an deinen Aufgaben.
Brauchen wir eigene GPUs?
Nicht immer. Die Optionen reichen von einem privaten Cloud-Endpunkt bis zu einem einzelnen Server oder einer Workstation. Das Audit dimensioniert das gegen dein Volumen.
Heisst eine Anbieter-API, dass unsere Daten fürs Training genutzt werden?
Die Business-API-Bedingungen der grossen Anbieter schliessen ein Training mit deinen Daten in der Regel aus, aber die Bedingungen unterscheiden sich und ändern sich. Wir lesen sie pro Anwendungsfall mit dir und halten das Ergebnis fest.
Wer betreibt und pflegt es?
Du, mit einem Runbook, das wir übergeben, oder wir im Rahmen einer separaten Supportvereinbarung. Modell-Updates werden geplant, nicht automatisch eingespielt.
Kann das in unserem Microsoft-Tenant laufen?
Ja, zum Beispiel mit Azure AI Foundry in deiner Region. Der Tenant-Betrieb bleibt bei worxspace oder deiner IT.
Sag uns, was das Haus nicht verlassen darf.
Wir zeigen dir, was auf deiner eigenen Infrastruktur möglich ist und was es kostet.