Files
Jarvis-Ai/docs/GEMINI_PROVIDER.md
T

86 lines
3.6 KiB
Markdown

# Gemini-Provider: bestätigte Rahmenbedingungen
Stand der Prüfung: 30.07.2026. Verwendet wurden ausschließlich offizielle
Google-Dokumentation und das offizielle Google-SDK-Repository.
## Modellauswahl
- aktiver Standard dieses Arbeitspakets: `gemini-3.6-flash`
- später optional konfigurierbar: `gemini-3.5-flash-lite`
- beide Kennungen sind stabile, allgemein verfügbare Modelle
- keine Preview-, Experimental- oder `latest`-Kennung wird Standard
`gemini-3.6-flash` ist für Standard-Textgenerierung im Free Tier mit kostenfreien
Ein- und Ausgabetokens aufgeführt. `gemini-3.5-flash-lite` ist ebenfalls im Free
Tier verfügbar, wird in diesem Paket aber nicht aktiv geroutet.
Quellen:
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash>
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite>
- <https://ai.google.dev/gemini-api/docs/pricing>
- <https://ai.google.dev/gemini-api/docs/deprecations>
## Quoten und Kosten
Google misst Limits unter anderem als Requests pro Minute, Eingabetokens pro
Minute und Requests pro Tag. Die aktiven Werte hängen von Modell, Projekt und
Nutzungsstufe ab, sind nicht garantiert und müssen in Google AI Studio geprüft
werden. Javis bildet deshalb keine Google-Quote als feste Wahrheit ab, sondern
setzt zusätzliche konservative lokale Schutzlimits.
Der Free Tier erfordert kein Billingkonto. Der Wechsel in einen bezahlten Tier
erfordert laut Google eine aktive Billing-Verknüpfung. Javis kann den externen
Projektstatus nicht technisch beweisen und verlangt deshalb vor Aktivierung eine
lokale Bestätigung, dass Billing deaktiviert ist.
Quellen:
- <https://ai.google.dev/gemini-api/docs/rate-limits>
- <https://ai.google.dev/gemini-api/docs/billing>
## Datenschutz
Die Preisübersicht kennzeichnet kostenlose Standardnutzung grundsätzlich als für
Produktverbesserung nutzbar. Die zusätzlichen Nutzungsbedingungen enthalten eine
Sonderregel für EWR, Schweiz und Vereinigtes Königreich. Unabhängig davon bleibt
Javis konservativ: keine Secrets, Gesundheits-, Finanz- oder besonders sensiblen
Daten; persönliche Daten nur nach lokaler Freigabe und mit minimalem Kontext.
Quellen:
- <https://ai.google.dev/gemini-api/terms>
- <https://ai.google.dev/gemini-api/docs/logs-policy>
## Schlüssel und SDK
Neue Schlüssel aus Google AI Studio sind laut aktueller Dokumentation Auth-Keys,
standardmäßig auf die Gemini API beschränkt. Unbeschränkte Standard-Keys werden
abgelehnt beziehungsweise ausgemustert. Pascal soll einen neuen, ausschließlich
für Javis verwendeten Auth-Key in AI Studio erstellen und niemals in Chat, Git,
Obsidian, Logs oder Dokumentation einfügen.
Für Python wird das GA-SDK `google-genai` verwendet. Javis nutzt ausschließlich
zustandslose Textgenerierung über `generate_content`; keine Chatspeicherung,
Dateien, Tools, Grounding, Caches, Agenten oder Medienfunktionen.
Der reproduzierbare Lockfile löst aktuell `google-genai` 2.16.0 auf.
Quellen:
- <https://ai.google.dev/gemini-api/docs/api-key>
- <https://ai.google.dev/gemini-api/docs/libraries>
- <https://ai.google.dev/gemini-api/docs/generate-content/text-generation>
- <https://github.com/googleapis/python-genai>
## Fehler und Retries
Timeouts und geeignete Server-/Netzwerkfehler dürfen höchstens einmal kontrolliert
wiederholt werden. `429 RESOURCE_EXHAUSTED`, Authentifizierungs-, Datenschutz- und
Quota-Fehler werden nicht wiederholt. Anschließend wird im späteren Router sichtbar
lokal weitergearbeitet. Das SDK besitzt eigene Retry-Mechanismen; Javis konfiguriert
diese ausdrücklich auf höchstens zwei Gesamtversuche und schließt 429 aus.
Quelle:
- <https://ai.google.dev/gemini-api/docs/troubleshooting>