Zum Inhalt springen

Installation und Betrieb

NomOS läuft auf Kubernetes und wird mit einem Helm-Chart installiert. Die Referenzinstallation läuft auf AWS EKS in der Region Zürich. Andere Kubernetes-Umgebungen sind vorgesehen, aber noch nicht als Installation erprobt. Ein von Ainomos betriebenes SaaS-Angebot ist geplant.

Teil Aufgabe
brain-core Backend mit Räumen, Wissen, Regeln, Belegen und MCP-Server
web-ui Oberfläche für Chat, Räume, Regeln, Posteingang und Administration
Worker geplante Aufgaben wie Dreaming, Log-Weiterleitung und Wartung
Keycloak Anmeldung, oder Anbindung Ihres eigenen OIDC- oder SAML-Identity-Providers
OPA Zugriffsentscheide auf Räume
Presidio Erkennung von Personendaten
LiteLLM Gateway für alle Modellaufrufe, mit Kosten pro Raum
Valkey Cache

Sie stellen eine PostgreSQL-16-Datenbank mit der Erweiterung pgvector bereit.

Alle Modellaufrufe laufen über das Gateway. Standard sind Modelle über Amazon Bedrock mit EU-Inferenzprofilen.

  • Eigene Modelle für Antworten: Plattform-Admins registrieren im Modellkatalog weitere Modelle mit OpenAI-kompatibler Schnittstelle, zum Beispiel lokal betriebene. Jedes Modell trägt einen Standort (im Cluster, in Ihrer Cloud oder extern) und die Datenklassen, die es verarbeiten darf.
  • Hintergrundaufgaben und Suche: Dreaming und einige Prüfungen nutzen heute fest Claude-Modelle, die Suche das Embedding-Modell Titan. Dass Installationen dafür eigene Modelle wählen, ist geplant.

NomOS nutzt den Identity Provider der Installation. Für den Fall, dass die Anmeldung über den Identity Provider ausfällt, gibt es einen separaten Notfallzugang, damit sich Admins nicht aussperren.

Für signierte Belege braucht die Installation einen Ed25519-Schlüssel. Legen Sie ihn als Secret an und verwalten Sie ihn getrennt von der Datenbank. Den öffentlichen Teil nutzt die Prüfung der Belege.