86 lines
3.6 KiB
Markdown
86 lines
3.6 KiB
Markdown
# Gemini-Provider: bestätigte Rahmenbedingungen
|
|
|
|
Stand der Prüfung: 30.07.2026. Verwendet wurden ausschließlich offizielle
|
|
Google-Dokumentation und das offizielle Google-SDK-Repository.
|
|
|
|
## Modellauswahl
|
|
|
|
- aktiver Standard dieses Arbeitspakets: `gemini-3.6-flash`
|
|
- später optional konfigurierbar: `gemini-3.5-flash-lite`
|
|
- beide Kennungen sind stabile, allgemein verfügbare Modelle
|
|
- keine Preview-, Experimental- oder `latest`-Kennung wird Standard
|
|
|
|
`gemini-3.6-flash` ist für Standard-Textgenerierung im Free Tier mit kostenfreien
|
|
Ein- und Ausgabetokens aufgeführt. `gemini-3.5-flash-lite` ist ebenfalls im Free
|
|
Tier verfügbar, wird in diesem Paket aber nicht aktiv geroutet.
|
|
|
|
Quellen:
|
|
|
|
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash>
|
|
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite>
|
|
- <https://ai.google.dev/gemini-api/docs/pricing>
|
|
- <https://ai.google.dev/gemini-api/docs/deprecations>
|
|
|
|
## Quoten und Kosten
|
|
|
|
Google misst Limits unter anderem als Requests pro Minute, Eingabetokens pro
|
|
Minute und Requests pro Tag. Die aktiven Werte hängen von Modell, Projekt und
|
|
Nutzungsstufe ab, sind nicht garantiert und müssen in Google AI Studio geprüft
|
|
werden. Javis bildet deshalb keine Google-Quote als feste Wahrheit ab, sondern
|
|
setzt zusätzliche konservative lokale Schutzlimits.
|
|
|
|
Der Free Tier erfordert kein Billingkonto. Der Wechsel in einen bezahlten Tier
|
|
erfordert laut Google eine aktive Billing-Verknüpfung. Javis kann den externen
|
|
Projektstatus nicht technisch beweisen und verlangt deshalb vor Aktivierung eine
|
|
lokale Bestätigung, dass Billing deaktiviert ist.
|
|
|
|
Quellen:
|
|
|
|
- <https://ai.google.dev/gemini-api/docs/rate-limits>
|
|
- <https://ai.google.dev/gemini-api/docs/billing>
|
|
|
|
## Datenschutz
|
|
|
|
Die Preisübersicht kennzeichnet kostenlose Standardnutzung grundsätzlich als für
|
|
Produktverbesserung nutzbar. Die zusätzlichen Nutzungsbedingungen enthalten eine
|
|
Sonderregel für EWR, Schweiz und Vereinigtes Königreich. Unabhängig davon bleibt
|
|
Javis konservativ: keine Secrets, Gesundheits-, Finanz- oder besonders sensiblen
|
|
Daten; persönliche Daten nur nach lokaler Freigabe und mit minimalem Kontext.
|
|
|
|
Quellen:
|
|
|
|
- <https://ai.google.dev/gemini-api/terms>
|
|
- <https://ai.google.dev/gemini-api/docs/logs-policy>
|
|
|
|
## Schlüssel und SDK
|
|
|
|
Neue Schlüssel aus Google AI Studio sind laut aktueller Dokumentation Auth-Keys,
|
|
standardmäßig auf die Gemini API beschränkt. Unbeschränkte Standard-Keys werden
|
|
abgelehnt beziehungsweise ausgemustert. Pascal soll einen neuen, ausschließlich
|
|
für Javis verwendeten Auth-Key in AI Studio erstellen und niemals in Chat, Git,
|
|
Obsidian, Logs oder Dokumentation einfügen.
|
|
|
|
Für Python wird das GA-SDK `google-genai` verwendet. Javis nutzt ausschließlich
|
|
zustandslose Textgenerierung über `generate_content`; keine Chatspeicherung,
|
|
Dateien, Tools, Grounding, Caches, Agenten oder Medienfunktionen.
|
|
Der reproduzierbare Lockfile löst aktuell `google-genai` 2.16.0 auf.
|
|
|
|
Quellen:
|
|
|
|
- <https://ai.google.dev/gemini-api/docs/api-key>
|
|
- <https://ai.google.dev/gemini-api/docs/libraries>
|
|
- <https://ai.google.dev/gemini-api/docs/generate-content/text-generation>
|
|
- <https://github.com/googleapis/python-genai>
|
|
|
|
## Fehler und Retries
|
|
|
|
Timeouts und geeignete Server-/Netzwerkfehler dürfen höchstens einmal kontrolliert
|
|
wiederholt werden. `429 RESOURCE_EXHAUSTED`, Authentifizierungs-, Datenschutz- und
|
|
Quota-Fehler werden nicht wiederholt. Anschließend wird im späteren Router sichtbar
|
|
lokal weitergearbeitet. Das SDK besitzt eigene Retry-Mechanismen; Javis konfiguriert
|
|
diese ausdrücklich auf höchstens zwei Gesamtversuche und schließt 429 aus.
|
|
|
|
Quelle:
|
|
|
|
- <https://ai.google.dev/gemini-api/docs/troubleshooting>
|