feat: add privacy-aware hybrid routing

This commit is contained in:
2026-07-30 18:00:20 +02:00
parent f3e11831fb
commit e57186f678
6 changed files with 541 additions and 11 deletions
+8 -5
View File
@@ -49,7 +49,11 @@ Stand: lokaler Textchat auf `main`, 30.07.2026.
begrenztem Timeout, höchstens einem Retry und keinem 429-Retry
- bereinigte, getrennte Fehler für fehlenden/ungültigen Key, Quote, Netzwerk,
Modellverfügbarkeit, Timeout und ungültige Antwort
- 37 Unit-Tests aktuell erfolgreich; Ruff-Format und Lint sauber
- Hybridrouter erzwingt vor Cloudaufrufen lokal `allowed`/`ask`/`never`,
Aktivierung, Billing-Bestätigung, Tages-/Größenlimit und minimierten Kontext
- sichtbares lokales Fallback für fehlenden/ungültigen Key, 429, Netzwerk,
Datenschutz und lokale Grenzen; alte Ollama-Sitzungen bleiben ladbar
- 51 Unit-Tests aktuell erfolgreich; Ruff-Format und Lint sauber
## Nicht implementiert
@@ -74,7 +78,6 @@ Living-Mind-Frontend und automatische Ollama-Prozessverwaltung.
Ollama wird bewusst manuell in einem eigenen Terminal gestartet. Antworten werden
noch nicht gestreamt; Sitzungen haben noch keine Titel, Suche oder Löschfunktion.
`qwen3:8b` ist nicht automatisch für die GTX 1050 des späteren Zielhosts geeignet.
Der Gemini-Netzwerkprovider ist isoliert implementiert, aber noch nicht in den
Chatkern geroutet. Das automatische Ollama-Fallback fehlt noch. Es wurde kein
echter API-Key angefordert, angezeigt oder konfiguriert und keine Cloudanfrage
ausgeführt.
Der Hybridprovider ist implementiert, aber noch nicht in der echten CLI verdrahtet.
Lokale TOML-Aktivierung, Statusbefehle und Startskript fehlen. Es wurde kein echter
API-Key angefordert, angezeigt oder konfiguriert und keine Cloudanfrage ausgeführt.