Seite 2 von 2
Architekturen
Sprachsynthese
Read Aloud
│
▼
OpenAI-kompatibler Proxy-Container
│
▼
Supertonic-3
│
▼
Lokale Sprachsynthese
---
Emulierte OpenAI-Endpunkt - unter anderem:
/v1/models
/v1/audio/speech
Audio-Konvertierung - Automatische Anpassung zu MP3
Kreative Pipeline
WRITE-Modus
Idee/Draft
↓
Writer (ggf. erst in zweiter Iteration)
↓
Review
↓
Merge + Advice --> Repeat: Writer
↓
Memory
REVIEW-Modus (batch-fähig)
Kapitel 1..N
↓
Review0..2
↓
Review-Merge + Advice (Pro Kapitel)
↓
Konsolidierung
↓
Memory Update (Txt-basiertes TOML)
Modellrollen
| Rolle | Modell | Aufgabe |
|---|---|---|
| Writer & Review0 | Mistral Small 3.2 | Kreative Texterstellung, Creative Director |
| Review1 | Qwen 3.5 | Struktur, Logik, Lore |
| Review2 | Gemma 4 | Stil und Konsistenz |
| Review-Conflictor, Review2Writing Advisor | Nemotron Cascade 2 | Konsolidierung |
| Memory | Nemotron Nano | Wissensextraktion (Zusammenfassungen,
Charakterdaten, Orte, Fraktionen, Ereignisse, Regeln, Zeitachsen) |