From a28e2d8bc9619a84ed8537b0669bf16a616e3aed Mon Sep 17 00:00:00 2001 From: Dystroyer8 Date: Thu, 30 Jul 2026 17:45:11 +0200 Subject: [PATCH] docs: record Gemini free tier constraints --- docs/CHATGPT_HANDOFF.md | 10 ++++- docs/GEMINI_PROVIDER.md | 84 +++++++++++++++++++++++++++++++++++++++++ 2 files changed, 92 insertions(+), 2 deletions(-) create mode 100644 docs/GEMINI_PROVIDER.md diff --git a/docs/CHATGPT_HANDOFF.md b/docs/CHATGPT_HANDOFF.md index a4b922b..34d83f6 100644 --- a/docs/CHATGPT_HANDOFF.md +++ b/docs/CHATGPT_HANDOFF.md @@ -63,6 +63,9 @@ Rootserver: Smoke-Test nutzte `D:\Javis-Data\runtime\core-chat-smoke`. - Kein Obsidian-, Laptop- oder Rootserverzugriff wurde implementiert. - Keine Tool-, Sprach-, Mobil-, Status- oder Living-Mind-Funktion ist implementiert. +- Offizielle Gemini-Prüfung abgeschlossen: `gemini-3.6-flash` und + `gemini-3.5-flash-lite` sind stabile GA-Modelle mit Free-Tier-Textnutzung; + Standard dieses Pakets wird ausschließlich `gemini-3.6-flash`. ## Aktuelle Architektur @@ -104,6 +107,9 @@ Rootserver: - Echten CLI-Chat ausgeführt und dieselbe Sitzung in einem neuen Prozess geladen, aufgelistet und erfolgreich mit einer weiteren Modellantwort fortgesetzt. - Obsidian, Ubuntu-Laptop und Rootserver blieben unverändert. +- Aktuelle offizielle Gemini-Modelle, Free-Tier-Preise, dynamische Quoten, + Auth-Keys, GA-SDK, Fehlercodes und Datenschutzbedingungen geprüft und unter + `docs/GEMINI_PROVIDER.md` kompakt dokumentiert. ## Aktuelle Tests @@ -180,8 +186,8 @@ Abnahmestatus: - Antworten werden noch nicht gestreamt; Sitzungen besitzen noch keine Titel oder Suche - genauer späterer Obsidian-Schreibbereich ist nicht freigegeben - endgültiger Secret-Provider ist offen; lokale Klartext-XML wäre nur restriktiv geschützt und Git-ignoriert zulässig -- aktuelle kostenlose Gemini-Modelle, Modellkennungen und Kontingente müssen vor - der Implementierung anhand offizieller Google-Dokumentation neu geprüft werden +- Google-Quoten bleiben projektabhängig und müssen in AI Studio geprüft werden; + lokale Limits sind nur zusätzliche Schutzgrenzen - Gaming-PC zeigt derzeit nur 8 statt 16 logische CPU-Prozessoren; Ursache ungeklärt - ASUS-Laptop ist nicht automatisch für dasselbe Modell wie die RTX 3060 geeignet diff --git a/docs/GEMINI_PROVIDER.md b/docs/GEMINI_PROVIDER.md new file mode 100644 index 0000000..d254de2 --- /dev/null +++ b/docs/GEMINI_PROVIDER.md @@ -0,0 +1,84 @@ +# Gemini-Provider: bestätigte Rahmenbedingungen + +Stand der Prüfung: 30.07.2026. Verwendet wurden ausschließlich offizielle +Google-Dokumentation und das offizielle Google-SDK-Repository. + +## Modellauswahl + +- aktiver Standard dieses Arbeitspakets: `gemini-3.6-flash` +- später optional konfigurierbar: `gemini-3.5-flash-lite` +- beide Kennungen sind stabile, allgemein verfügbare Modelle +- keine Preview-, Experimental- oder `latest`-Kennung wird Standard + +`gemini-3.6-flash` ist für Standard-Textgenerierung im Free Tier mit kostenfreien +Ein- und Ausgabetokens aufgeführt. `gemini-3.5-flash-lite` ist ebenfalls im Free +Tier verfügbar, wird in diesem Paket aber nicht aktiv geroutet. + +Quellen: + +- +- +- +- + +## Quoten und Kosten + +Google misst Limits unter anderem als Requests pro Minute, Eingabetokens pro +Minute und Requests pro Tag. Die aktiven Werte hängen von Modell, Projekt und +Nutzungsstufe ab, sind nicht garantiert und müssen in Google AI Studio geprüft +werden. Javis bildet deshalb keine Google-Quote als feste Wahrheit ab, sondern +setzt zusätzliche konservative lokale Schutzlimits. + +Der Free Tier erfordert kein Billingkonto. Der Wechsel in einen bezahlten Tier +erfordert laut Google eine aktive Billing-Verknüpfung. Javis kann den externen +Projektstatus nicht technisch beweisen und verlangt deshalb vor Aktivierung eine +lokale Bestätigung, dass Billing deaktiviert ist. + +Quellen: + +- +- + +## Datenschutz + +Die Preisübersicht kennzeichnet kostenlose Standardnutzung grundsätzlich als für +Produktverbesserung nutzbar. Die zusätzlichen Nutzungsbedingungen enthalten eine +Sonderregel für EWR, Schweiz und Vereinigtes Königreich. Unabhängig davon bleibt +Javis konservativ: keine Secrets, Gesundheits-, Finanz- oder besonders sensiblen +Daten; persönliche Daten nur nach lokaler Freigabe und mit minimalem Kontext. + +Quellen: + +- +- + +## Schlüssel und SDK + +Neue Schlüssel aus Google AI Studio sind laut aktueller Dokumentation Auth-Keys, +standardmäßig auf die Gemini API beschränkt. Unbeschränkte Standard-Keys werden +abgelehnt beziehungsweise ausgemustert. Pascal soll einen neuen, ausschließlich +für Javis verwendeten Auth-Key in AI Studio erstellen und niemals in Chat, Git, +Obsidian, Logs oder Dokumentation einfügen. + +Für Python wird das GA-SDK `google-genai` verwendet. Javis nutzt ausschließlich +zustandslose Textgenerierung über `generate_content`; keine Chatspeicherung, +Dateien, Tools, Grounding, Caches, Agenten oder Medienfunktionen. + +Quellen: + +- +- +- +- + +## Fehler und Retries + +`429 RESOURCE_EXHAUSTED`, Timeouts und geeignete Netzwerk-/Serverfehler dürfen +höchstens einmal kontrolliert wiederholt werden. Authentifizierungs-, Datenschutz- +und Quota-Fehler werden nicht wiederholt. Anschließend wird sichtbar lokal +weitergearbeitet. Das SDK besitzt eigene Retry-Mechanismen; Javis konfiguriert +diese ausdrücklich, damit die lokale Obergrenze nicht unbemerkt überschritten wird. + +Quelle: + +-