docs: record Gemini free tier constraints

This commit is contained in:
2026-07-30 17:45:11 +02:00
parent cc34f14ece
commit a28e2d8bc9
2 changed files with 92 additions and 2 deletions
+8 -2
View File
@@ -63,6 +63,9 @@ Rootserver:
Smoke-Test nutzte `D:\Javis-Data\runtime\core-chat-smoke`. Smoke-Test nutzte `D:\Javis-Data\runtime\core-chat-smoke`.
- Kein Obsidian-, Laptop- oder Rootserverzugriff wurde implementiert. - Kein Obsidian-, Laptop- oder Rootserverzugriff wurde implementiert.
- Keine Tool-, Sprach-, Mobil-, Status- oder Living-Mind-Funktion ist implementiert. - Keine Tool-, Sprach-, Mobil-, Status- oder Living-Mind-Funktion ist implementiert.
- Offizielle Gemini-Prüfung abgeschlossen: `gemini-3.6-flash` und
`gemini-3.5-flash-lite` sind stabile GA-Modelle mit Free-Tier-Textnutzung;
Standard dieses Pakets wird ausschließlich `gemini-3.6-flash`.
## Aktuelle Architektur ## Aktuelle Architektur
@@ -104,6 +107,9 @@ Rootserver:
- Echten CLI-Chat ausgeführt und dieselbe Sitzung in einem neuen Prozess geladen, - Echten CLI-Chat ausgeführt und dieselbe Sitzung in einem neuen Prozess geladen,
aufgelistet und erfolgreich mit einer weiteren Modellantwort fortgesetzt. aufgelistet und erfolgreich mit einer weiteren Modellantwort fortgesetzt.
- Obsidian, Ubuntu-Laptop und Rootserver blieben unverändert. - Obsidian, Ubuntu-Laptop und Rootserver blieben unverändert.
- Aktuelle offizielle Gemini-Modelle, Free-Tier-Preise, dynamische Quoten,
Auth-Keys, GA-SDK, Fehlercodes und Datenschutzbedingungen geprüft und unter
`docs/GEMINI_PROVIDER.md` kompakt dokumentiert.
## Aktuelle Tests ## Aktuelle Tests
@@ -180,8 +186,8 @@ Abnahmestatus:
- Antworten werden noch nicht gestreamt; Sitzungen besitzen noch keine Titel oder Suche - Antworten werden noch nicht gestreamt; Sitzungen besitzen noch keine Titel oder Suche
- genauer späterer Obsidian-Schreibbereich ist nicht freigegeben - genauer späterer Obsidian-Schreibbereich ist nicht freigegeben
- endgültiger Secret-Provider ist offen; lokale Klartext-XML wäre nur restriktiv geschützt und Git-ignoriert zulässig - endgültiger Secret-Provider ist offen; lokale Klartext-XML wäre nur restriktiv geschützt und Git-ignoriert zulässig
- aktuelle kostenlose Gemini-Modelle, Modellkennungen und Kontingente müssen vor - Google-Quoten bleiben projektabhängig und müssen in AI Studio geprüft werden;
der Implementierung anhand offizieller Google-Dokumentation neu geprüft werden lokale Limits sind nur zusätzliche Schutzgrenzen
- Gaming-PC zeigt derzeit nur 8 statt 16 logische CPU-Prozessoren; Ursache ungeklärt - Gaming-PC zeigt derzeit nur 8 statt 16 logische CPU-Prozessoren; Ursache ungeklärt
- ASUS-Laptop ist nicht automatisch für dasselbe Modell wie die RTX 3060 geeignet - ASUS-Laptop ist nicht automatisch für dasselbe Modell wie die RTX 3060 geeignet
+84
View File
@@ -0,0 +1,84 @@
# Gemini-Provider: bestätigte Rahmenbedingungen
Stand der Prüfung: 30.07.2026. Verwendet wurden ausschließlich offizielle
Google-Dokumentation und das offizielle Google-SDK-Repository.
## Modellauswahl
- aktiver Standard dieses Arbeitspakets: `gemini-3.6-flash`
- später optional konfigurierbar: `gemini-3.5-flash-lite`
- beide Kennungen sind stabile, allgemein verfügbare Modelle
- keine Preview-, Experimental- oder `latest`-Kennung wird Standard
`gemini-3.6-flash` ist für Standard-Textgenerierung im Free Tier mit kostenfreien
Ein- und Ausgabetokens aufgeführt. `gemini-3.5-flash-lite` ist ebenfalls im Free
Tier verfügbar, wird in diesem Paket aber nicht aktiv geroutet.
Quellen:
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash>
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite>
- <https://ai.google.dev/gemini-api/docs/pricing>
- <https://ai.google.dev/gemini-api/docs/deprecations>
## Quoten und Kosten
Google misst Limits unter anderem als Requests pro Minute, Eingabetokens pro
Minute und Requests pro Tag. Die aktiven Werte hängen von Modell, Projekt und
Nutzungsstufe ab, sind nicht garantiert und müssen in Google AI Studio geprüft
werden. Javis bildet deshalb keine Google-Quote als feste Wahrheit ab, sondern
setzt zusätzliche konservative lokale Schutzlimits.
Der Free Tier erfordert kein Billingkonto. Der Wechsel in einen bezahlten Tier
erfordert laut Google eine aktive Billing-Verknüpfung. Javis kann den externen
Projektstatus nicht technisch beweisen und verlangt deshalb vor Aktivierung eine
lokale Bestätigung, dass Billing deaktiviert ist.
Quellen:
- <https://ai.google.dev/gemini-api/docs/rate-limits>
- <https://ai.google.dev/gemini-api/docs/billing>
## Datenschutz
Die Preisübersicht kennzeichnet kostenlose Standardnutzung grundsätzlich als für
Produktverbesserung nutzbar. Die zusätzlichen Nutzungsbedingungen enthalten eine
Sonderregel für EWR, Schweiz und Vereinigtes Königreich. Unabhängig davon bleibt
Javis konservativ: keine Secrets, Gesundheits-, Finanz- oder besonders sensiblen
Daten; persönliche Daten nur nach lokaler Freigabe und mit minimalem Kontext.
Quellen:
- <https://ai.google.dev/gemini-api/terms>
- <https://ai.google.dev/gemini-api/docs/logs-policy>
## Schlüssel und SDK
Neue Schlüssel aus Google AI Studio sind laut aktueller Dokumentation Auth-Keys,
standardmäßig auf die Gemini API beschränkt. Unbeschränkte Standard-Keys werden
abgelehnt beziehungsweise ausgemustert. Pascal soll einen neuen, ausschließlich
für Javis verwendeten Auth-Key in AI Studio erstellen und niemals in Chat, Git,
Obsidian, Logs oder Dokumentation einfügen.
Für Python wird das GA-SDK `google-genai` verwendet. Javis nutzt ausschließlich
zustandslose Textgenerierung über `generate_content`; keine Chatspeicherung,
Dateien, Tools, Grounding, Caches, Agenten oder Medienfunktionen.
Quellen:
- <https://ai.google.dev/gemini-api/docs/api-key>
- <https://ai.google.dev/gemini-api/docs/libraries>
- <https://ai.google.dev/gemini-api/docs/generate-content/text-generation>
- <https://github.com/googleapis/python-genai>
## Fehler und Retries
`429 RESOURCE_EXHAUSTED`, Timeouts und geeignete Netzwerk-/Serverfehler dürfen
höchstens einmal kontrolliert wiederholt werden. Authentifizierungs-, Datenschutz-
und Quota-Fehler werden nicht wiederholt. Anschließend wird sichtbar lokal
weitergearbeitet. Das SDK besitzt eigene Retry-Mechanismen; Javis konfiguriert
diese ausdrücklich, damit die lokale Obergrenze nicht unbemerkt überschritten wird.
Quelle:
- <https://ai.google.dev/gemini-api/docs/troubleshooting>