Open Source · Apache 2.0 · Self-hosted

Die KI-Infrastruktur, die aus Prompts optimale Arbeitsprozesse macht.

MoE Sovereign analysiert jede Anfrage, kombiniert passende Modelle, Expert Templates, GraphRAG, MCP-Werkzeuge und aktuelle Recherche – validiert das Ergebnis und speichert verwertbares Wissen für zukünftige Aufgaben.

Nicht nur ein Router. Ein Compiler für ausführbare KI-Workflows.

Peer-reviewed Resource AwardEuroHPC JU · LUMI-G4.500 Node-h

Eine API, viele Fähigkeiten

Für Clients ein LLM.
Intern ein vollständiges System.

OpenAI Chat CompletionsOpenAI ResponsesAnthropic MessagesOllama API
POST /v1/responses
{
  "model": "moe-sovereign",
  "input": "Bewerte die aktuelle Lage …"
}

Whitepaper · Preview Release

Architektur, Forschung und Evidenz – offen zur Prüfung.

Alle drei Dokumente sind Vorabfassungen. Inhalte, Methodik, Ergebnisse und Seitenzahlen können sich bis zur finalen Veröffentlichung ändern. Feedback ist ausdrücklich willkommen.

Preview · July 2026

English Whitepaper

Complete international edition covering the platform, architecture and research vision.

Umfang
108 Seiten
Format
PDF · 3,1 MB
PDF herunterladen
Preprint · Preview

Wissenschaftliche Kurzfassung

Kompakte englischsprachige Forschungsfassung für wissenschaftliche Diskussion und Review.

Umfang
12 Seiten
Format
PDF · 317 KB
Preprint herunterladen

Publikationsstatus: Preview / Preprint. Noch nicht als finale Fassung veröffentlicht und – soweit nicht im Dokument anders ausgewiesen – nicht peer-reviewed.

Gleicher Prompt. Anderer Prozess.

Ein Modell antwortet. MoE Sovereign organisiert die Lösung.

Die Architektur setzt Rechenaufwand dort ein, wo Aktualität, Wissen, Mehrschrittigkeit oder Nachweisbarkeit ihn rechtfertigen.

Direkter Modellbetrieb

Native LLM

  1. PromptEine Eingabe
  2. Ein ModellStatisches Trainingswissen
  3. AntwortKeine persistente Lernerfahrung

Für einfache, stabile Aufgaben kann dieser direkte Weg optimal sein.

Adaptive Verarbeitung

MoE Sovereign

  1. PromptanalyseDomäne, Komplexität, Risiko
  2. Expert TemplateModelle, Abhängigkeiten, Policies
  3. AusführungGraphRAG · MCP · Recherche · Agenten
  4. ValidierungJudge · Quellen · Korrekturschleife
  5. Antwort + WissenVerwertbares Ergebnis bleibt erhalten

Der größte Vorteil entsteht bei anspruchsvollen, aktuellen, wissensintensiven oder sicherheitsrelevanten Aufgaben.

Die lernende Architektur

Wissen wächst außerhalb der Modellgewichte.

Heute löst ein großes Modell eine neue Aufgabe. Morgen kann ein kleineres Modell auf verifiziertes Wissen und den bewährten Arbeitsprozess zurückgreifen.

01BearbeitenWorkflow ausführen
02PrüfenQualität validieren
03ExtrahierenFakten, Quellen, Wege
04SpeichernGraph + Memory
05VerbessernRouting + nächste Anfrage
Implementiert

Produktives Systemlernen

GraphRAG, mehrschichtige Caches, episodisches Wissen, Correction Memory, Feedback und Routing-Signale verbessern den Systemkontext – ohne unkontrolliertes Training.

In Entwicklung

SLM-Kompetenz erweitern

Erfolgreiche Pläne und verifizierte Entscheidungen sollen in spezialisierte kleine Modelle distilliert werden, damit wiederkehrende Aufgaben lokal und effizient übernommen werden können.

Forschungsziel

Dynamische Template-Generierung

Ein auf LUMI-G entwickeltes MoE Sovereign soll künftig pro Anfrage den optimalen Ausführungsplan erzeugen – einschließlich Ressourcen, Regeln und Persistenzentscheidung.

Ein souveränes Ökosystem

Drei Projekte. Drei klar getrennte Aufgaben.

MoE Sovereign bleibt der eigenständig betreibbare Kern. Libris und Codex erweitern ihn optional um föderierten Wissensaustausch und eine auditierbare Datenplattform.

S
Core · Orchestration

MoE Sovereign

Kompiliert Prompts zu Workflows aus Modellen, Expert Templates, Wissen, Tools und Validierung. Funktioniert vollständig ohne die Schwesterprojekte.

  • Adaptive KI-Workflows
  • GraphRAG, MCP und Memory
  • OpenAI-, Anthropic- und Ollama-APIs
Core Repository ↗
L
Federation · Knowledge

MoE Libris

Föderierter Wissensaustausch zwischen souveränen Instanzen – freiwillig, vertrauensbasiert und mit Prüfung vor der Übernahme.

  • JSON-LD Push und Pull
  • Pre-Audit und Human Review
  • mTLS und senderseitiges Privacy Scrubbing
moe-libris.org ↗
C
Data · Audit

MoE Codex

Optionale souveräne Daten- und Auditplattform für Organisationen mit Katalog-, Freigabe-, Lineage- und Nachweisanforderungen.

  • Datenkatalog und Versionierung
  • Approvals, Lineage und Drift Detection
  • Policies, Suche und Analysewerkzeuge
moe-codex.org ↗

Modular statt monolithisch: Jedes Projekt besitzt einen eigenen Verantwortungsbereich und kann unabhängig entwickelt beziehungsweise betrieben werden. Integrationen erfolgen über dokumentierte Schnittstellen.

Qualität durch Zusammenspiel

Nicht mehr Features. Bessere Ursachenketten.

01

Besseres Wissen

GraphRAG, Dokumente und aktuelle Recherche liefern belegbaren Kontext statt allein auf Trainingswissen zu vertrauen.

02

Präzisere Ausführung

MCP-Präzisionswerkzeuge und strukturierte Toolpfade führen berechenbare Aufgaben deterministisch aus.

03

Bessere Entscheidungen

Expert Templates, Komplexitätsanalyse und Routing wählen nur die Ressourcen, die eine Aufgabe benötigt.

04

Höhere Verlässlichkeit

Judge, Self-Correction, Widerspruchserkennung und Quellenpriorisierung prüfen vor der Ausgabe.

05

Kontinuierliche Verbesserung

Korrekturen, Feedback, Episoden und Routing-Scores fließen als wiederverwendbarer Systemkontext zurück.

Referenzarchitektur

Sechs Ebenen. Eine gewöhnliche API nach außen.

01InterfaceOpenAI · Anthropic · Ollama · bestehende Clients
02IntelligenceMeta-Orchestrator · Planner · Templates · Routing · Policies
03ExecutionLLMs · SLMs · Expert Workers · agentic_tool · MCP · Recherche
04KnowledgeNeo4j GraphRAG · Vektoren · Dokumente · Cache · Memory
05QualityJudge · Self-Correction · Corrective RAG · Security Gates
06ObservabilityTracing · Metriken · Audit · Routing-Telemetrie

EuroHPC · LUMI-G

Supercomputer nutzen, damit die Plattform später weniger Supercomputer benötigt.

Einmalige hohe Rechenleistung dient der Forschung an Planungs-, Routing- und Validierungsfähigkeiten. Das Deploymentziel sind kleinere, lokale Spezialmodelle – nicht dauerhafte HPC-Abhängigkeit.

Die Förderung erfolgt durch die EuroHPC Joint Undertaking als Zuteilung von Hochleistungsrechenressourcen, nicht als direkte finanzielle Zuwendung.

Forschungsdokumentation ansehen →
ImplementiertCompound-AI-PipelineTemplates, GraphRAG, Tools, Validierung, Memory
In ValidierungTrainings- und EvaluationsdatenNachvollziehbare Pläne und Qualitätsentscheidungen
In EntwicklungLUMI-G DistillationKomplexität, Routing, Toolwahl, Validierung
GeplantSpezialisierte SLMsMehr lokale Übernahme wiederkehrender Aufgaben

Wissenschaftliche Ecke

Hypothesen prüfen – nicht nur Systeme demonstrieren.

Die Forschungsarbeit untersucht, welche Teile eines Compound-AI-Systems messbar lernen, wann persistentes Wissen Modellgröße ersetzen kann und wie Qualität nachvollziehbar bewertet wird.

Q₀

Kann eine lernende Orchestrierungs- und Wissensarchitektur kleine, lokal betreibbare Modelle bei anspruchsvollen Aufgaben so unterstützen, dass Qualität steigt und wiederkehrende Verarbeitung effizienter wird?

R1
In Entwicklung

Routing & Plan-Distillation

Hypothese: Erfolgreiche Expertenpläne lassen sich in kleinere Router und Planner übertragen, ohne jede Anfrage erneut mit einem großen Modell zu planen.

Methode
Supervised Fine-Tuning, Routing-Evaluation und Ablationen auf LUMI-G
Messgrößen
Planqualität, Routingtreffer, Latenz und Ressourcenverbrauch
R2
In Validierung

Vertrauensmetriken & Judge

Hypothese: Quellen-, Graph- und Widerspruchssignale können Qualitätsentscheidungen belastbarer machen als reine Modell-Selbsteinschätzung.

Methode
Parakonsistente Konfliktbewertung, Trust-Scores und kontrollierte Vergleichsläufe
Messgrößen
Faktentreue, Konflikterkennung, Kalibrierung und Fehlerraten
R3
Systembasis aktiv

Wissensakkumulation

Hypothese: Verifizierte Fakten, Lösungswege und Korrekturen verkürzen spätere ähnliche Bearbeitungen und reduzieren wiederholte Modellarbeit.

Methode
GraphRAG, episodisches Memory, semantische Caches und wiederholte Aufgabenserien
Messgrößen
Cache-/Knowledge-Hits, Latenz, Tokens, Wiederverwendung und Antwortqualität

Methodische Leitplanken

Reproduzierbar, statusklar, widerlegbar.

  • Konfiguration, Version und Hardware dokumentieren
  • Interne Messung und externe Vergleichsbasis trennen
  • Stichprobe, Varianz und Einschränkungen ausweisen
  • Negative und fehlgeschlagene Ergebnisse nicht ausblenden

Vom Prompt zum bleibenden Wissen

Konkrete Workflows statt Branchenetiketten.

Öffentliche VerwaltungVergabeunterlagen gegen aktuelle Vorgaben prüfen
„Prüfe diese Leistungsbeschreibung auf Widersprüche und fehlende Nachweise.“
Template
Dokumentanalyse → Rechtsquellen → Widerspruchsprüfung
Ressourcen
Lokales LLM, Dokumente, GraphRAG, aktuelle offizielle Quellen
Validierung
Quellenrang, Fundstellen, Judge, Unsicherheitsmarkierung
Bleibt erhalten
Freigegebene Begriffe, Beziehungen, Korrekturen und Prüfmuster
IT & SecurityEine Architektur gegen Bedrohungen bewerten
„Erstelle ein Threat Model für diese hybride Plattform und priorisiere Maßnahmen.“
Template
Systemmodell → Threat Research → Maßnahmen → Review
Ressourcen
Security-Experte, MCP, interne Standards, aktuelle Advisories
Validierung
Abdeckung, Quellenaktualität, Widersprüche, Judge
Bleibt erhalten
Systembeziehungen, akzeptierte Risiken und validierte Kontrollen
SoftwareentwicklungEin reproduzierbares Produktionsproblem lösen
„Finde die Ursache dieses sporadischen Fehlers und liefere einen getesteten Patch.“
Template
Reproduktion → Codeanalyse → Patch → Tests → Review
Ressourcen
Code-SLM/LLM, Repository-Tools, Tests, Dokumentation
Validierung
Build, Tests, statische Analyse, Diff-Review
Bleibt erhalten
Ursache, verifizierter Lösungsweg und relevante Codebeziehungen

Evidenz, nicht Superlative

Messwerte mit Kontext.

Interne Benchmarks zeigen Verhalten einer konkreten Konfiguration. Sie sind keine pauschale Aussage gegenüber Frontier-Modellen oder jeder Aufgabe.

9,3×

Akkumulations-Latenz

707 s → 76 s über fünf interne Epochen durch Wiederverwendung von Wissen und Cachepfaden.

Interner Benchmark · Stand April 2026 · kleine Stichprobe; hardware- und aufgabenspezifischMethodik und Artefakte ↗
14/30

GAIA Level 1

46,7 % in einem dokumentierten internen Lauf mit 30 Aufgaben.

Interner Lauf · Stand April 2026 · nicht repräsentativ für den vollständigen Benchmark; Konfiguration und Varianz beachtenBenchmark prüfen ↗

Souveränität & Sicherheit

Kontrolle ist eine technische Eigenschaft – keine pauschale Rechtsbehauptung.

MoE Sovereign schafft technische Voraussetzungen für kontrollierbare Datenflüsse und Datenschutz durch Technikgestaltung. Die rechtliche Bewertung bleibt vom konkreten Betrieb, Zweck und den organisatorischen Maßnahmen abhängig.

Versionierte Datenschutz-Selbsteinschätzung prüfen →
  • Lokale Inferenz und optionaler Offline-/Air-Gap-Betrieb
  • Explizit konfigurierbare Outbound-Verbindungen
  • Versionierte Expert Templates und Konfiguration
  • Routing-, Request- und Audit-Telemetrie
  • Tenant-, Rollen- und Budgetsteuerung
  • OCI-portabel und rootless betreibbar
  • Keine erforderliche versteckte Produkttelemetrie
  • Security Gates und gehärtete Toolpfade

Deployment nach Bedarf

Vom lokalen System bis zur Plattform.

Eine OCI-basierte Architektur unterstützt unterschiedliche Betriebsmodelle. Kubernetes und OpenShift sind architektonisch vorbereitet; die jeweilige Produktionsvalidierung bleibt deploymentspezifisch.

ONE-LINE INSTALLER · LINUX

MoE Sovereign interaktiv installieren

Für einen frischen Debian- oder Ubuntu-Server. Der Installer erkennt Docker oder Podman, erzeugt Secrets und führt durch die Konfiguration.

curl -sSL https://moe-sovereign.org/install.sh | bash

Shell-Skripte vor der Ausführung prüfen: install.sh ansehen · Voraussetzungen und manuelle Installation

Solo

Ein Host

Lokale Modelle, private Wissensbasis, volle Kontrolle.

Team

Geteilte Instanz

Zentrale API, Rollen, Templates und Wissensräume.

Enterprise

Skalierte Plattform

Mandanten, Observability und integrierte Policies.

LXC · Docker Compose · Podman Quadlet · Kubernetes · OpenShift

Die Architektur ist offen

Verstehen Sie nicht nur das Modell.
Verstehen Sie den Prozess dahinter.