docs: record Gemini free tier constraints
This commit is contained in:
@@ -63,6 +63,9 @@ Rootserver:
|
|||||||
Smoke-Test nutzte `D:\Javis-Data\runtime\core-chat-smoke`.
|
Smoke-Test nutzte `D:\Javis-Data\runtime\core-chat-smoke`.
|
||||||
- Kein Obsidian-, Laptop- oder Rootserverzugriff wurde implementiert.
|
- Kein Obsidian-, Laptop- oder Rootserverzugriff wurde implementiert.
|
||||||
- Keine Tool-, Sprach-, Mobil-, Status- oder Living-Mind-Funktion ist implementiert.
|
- Keine Tool-, Sprach-, Mobil-, Status- oder Living-Mind-Funktion ist implementiert.
|
||||||
|
- Offizielle Gemini-Prüfung abgeschlossen: `gemini-3.6-flash` und
|
||||||
|
`gemini-3.5-flash-lite` sind stabile GA-Modelle mit Free-Tier-Textnutzung;
|
||||||
|
Standard dieses Pakets wird ausschließlich `gemini-3.6-flash`.
|
||||||
|
|
||||||
## Aktuelle Architektur
|
## Aktuelle Architektur
|
||||||
|
|
||||||
@@ -104,6 +107,9 @@ Rootserver:
|
|||||||
- Echten CLI-Chat ausgeführt und dieselbe Sitzung in einem neuen Prozess geladen,
|
- Echten CLI-Chat ausgeführt und dieselbe Sitzung in einem neuen Prozess geladen,
|
||||||
aufgelistet und erfolgreich mit einer weiteren Modellantwort fortgesetzt.
|
aufgelistet und erfolgreich mit einer weiteren Modellantwort fortgesetzt.
|
||||||
- Obsidian, Ubuntu-Laptop und Rootserver blieben unverändert.
|
- Obsidian, Ubuntu-Laptop und Rootserver blieben unverändert.
|
||||||
|
- Aktuelle offizielle Gemini-Modelle, Free-Tier-Preise, dynamische Quoten,
|
||||||
|
Auth-Keys, GA-SDK, Fehlercodes und Datenschutzbedingungen geprüft und unter
|
||||||
|
`docs/GEMINI_PROVIDER.md` kompakt dokumentiert.
|
||||||
|
|
||||||
## Aktuelle Tests
|
## Aktuelle Tests
|
||||||
|
|
||||||
@@ -180,8 +186,8 @@ Abnahmestatus:
|
|||||||
- Antworten werden noch nicht gestreamt; Sitzungen besitzen noch keine Titel oder Suche
|
- Antworten werden noch nicht gestreamt; Sitzungen besitzen noch keine Titel oder Suche
|
||||||
- genauer späterer Obsidian-Schreibbereich ist nicht freigegeben
|
- genauer späterer Obsidian-Schreibbereich ist nicht freigegeben
|
||||||
- endgültiger Secret-Provider ist offen; lokale Klartext-XML wäre nur restriktiv geschützt und Git-ignoriert zulässig
|
- endgültiger Secret-Provider ist offen; lokale Klartext-XML wäre nur restriktiv geschützt und Git-ignoriert zulässig
|
||||||
- aktuelle kostenlose Gemini-Modelle, Modellkennungen und Kontingente müssen vor
|
- Google-Quoten bleiben projektabhängig und müssen in AI Studio geprüft werden;
|
||||||
der Implementierung anhand offizieller Google-Dokumentation neu geprüft werden
|
lokale Limits sind nur zusätzliche Schutzgrenzen
|
||||||
- Gaming-PC zeigt derzeit nur 8 statt 16 logische CPU-Prozessoren; Ursache ungeklärt
|
- Gaming-PC zeigt derzeit nur 8 statt 16 logische CPU-Prozessoren; Ursache ungeklärt
|
||||||
- ASUS-Laptop ist nicht automatisch für dasselbe Modell wie die RTX 3060 geeignet
|
- ASUS-Laptop ist nicht automatisch für dasselbe Modell wie die RTX 3060 geeignet
|
||||||
|
|
||||||
|
|||||||
@@ -0,0 +1,84 @@
|
|||||||
|
# Gemini-Provider: bestätigte Rahmenbedingungen
|
||||||
|
|
||||||
|
Stand der Prüfung: 30.07.2026. Verwendet wurden ausschließlich offizielle
|
||||||
|
Google-Dokumentation und das offizielle Google-SDK-Repository.
|
||||||
|
|
||||||
|
## Modellauswahl
|
||||||
|
|
||||||
|
- aktiver Standard dieses Arbeitspakets: `gemini-3.6-flash`
|
||||||
|
- später optional konfigurierbar: `gemini-3.5-flash-lite`
|
||||||
|
- beide Kennungen sind stabile, allgemein verfügbare Modelle
|
||||||
|
- keine Preview-, Experimental- oder `latest`-Kennung wird Standard
|
||||||
|
|
||||||
|
`gemini-3.6-flash` ist für Standard-Textgenerierung im Free Tier mit kostenfreien
|
||||||
|
Ein- und Ausgabetokens aufgeführt. `gemini-3.5-flash-lite` ist ebenfalls im Free
|
||||||
|
Tier verfügbar, wird in diesem Paket aber nicht aktiv geroutet.
|
||||||
|
|
||||||
|
Quellen:
|
||||||
|
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/pricing>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/deprecations>
|
||||||
|
|
||||||
|
## Quoten und Kosten
|
||||||
|
|
||||||
|
Google misst Limits unter anderem als Requests pro Minute, Eingabetokens pro
|
||||||
|
Minute und Requests pro Tag. Die aktiven Werte hängen von Modell, Projekt und
|
||||||
|
Nutzungsstufe ab, sind nicht garantiert und müssen in Google AI Studio geprüft
|
||||||
|
werden. Javis bildet deshalb keine Google-Quote als feste Wahrheit ab, sondern
|
||||||
|
setzt zusätzliche konservative lokale Schutzlimits.
|
||||||
|
|
||||||
|
Der Free Tier erfordert kein Billingkonto. Der Wechsel in einen bezahlten Tier
|
||||||
|
erfordert laut Google eine aktive Billing-Verknüpfung. Javis kann den externen
|
||||||
|
Projektstatus nicht technisch beweisen und verlangt deshalb vor Aktivierung eine
|
||||||
|
lokale Bestätigung, dass Billing deaktiviert ist.
|
||||||
|
|
||||||
|
Quellen:
|
||||||
|
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/rate-limits>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/billing>
|
||||||
|
|
||||||
|
## Datenschutz
|
||||||
|
|
||||||
|
Die Preisübersicht kennzeichnet kostenlose Standardnutzung grundsätzlich als für
|
||||||
|
Produktverbesserung nutzbar. Die zusätzlichen Nutzungsbedingungen enthalten eine
|
||||||
|
Sonderregel für EWR, Schweiz und Vereinigtes Königreich. Unabhängig davon bleibt
|
||||||
|
Javis konservativ: keine Secrets, Gesundheits-, Finanz- oder besonders sensiblen
|
||||||
|
Daten; persönliche Daten nur nach lokaler Freigabe und mit minimalem Kontext.
|
||||||
|
|
||||||
|
Quellen:
|
||||||
|
|
||||||
|
- <https://ai.google.dev/gemini-api/terms>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/logs-policy>
|
||||||
|
|
||||||
|
## Schlüssel und SDK
|
||||||
|
|
||||||
|
Neue Schlüssel aus Google AI Studio sind laut aktueller Dokumentation Auth-Keys,
|
||||||
|
standardmäßig auf die Gemini API beschränkt. Unbeschränkte Standard-Keys werden
|
||||||
|
abgelehnt beziehungsweise ausgemustert. Pascal soll einen neuen, ausschließlich
|
||||||
|
für Javis verwendeten Auth-Key in AI Studio erstellen und niemals in Chat, Git,
|
||||||
|
Obsidian, Logs oder Dokumentation einfügen.
|
||||||
|
|
||||||
|
Für Python wird das GA-SDK `google-genai` verwendet. Javis nutzt ausschließlich
|
||||||
|
zustandslose Textgenerierung über `generate_content`; keine Chatspeicherung,
|
||||||
|
Dateien, Tools, Grounding, Caches, Agenten oder Medienfunktionen.
|
||||||
|
|
||||||
|
Quellen:
|
||||||
|
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/api-key>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/libraries>
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/generate-content/text-generation>
|
||||||
|
- <https://github.com/googleapis/python-genai>
|
||||||
|
|
||||||
|
## Fehler und Retries
|
||||||
|
|
||||||
|
`429 RESOURCE_EXHAUSTED`, Timeouts und geeignete Netzwerk-/Serverfehler dürfen
|
||||||
|
höchstens einmal kontrolliert wiederholt werden. Authentifizierungs-, Datenschutz-
|
||||||
|
und Quota-Fehler werden nicht wiederholt. Anschließend wird sichtbar lokal
|
||||||
|
weitergearbeitet. Das SDK besitzt eigene Retry-Mechanismen; Javis konfiguriert
|
||||||
|
diese ausdrücklich, damit die lokale Obergrenze nicht unbemerkt überschritten wird.
|
||||||
|
|
||||||
|
Quelle:
|
||||||
|
|
||||||
|
- <https://ai.google.dev/gemini-api/docs/troubleshooting>
|
||||||
Reference in New Issue
Block a user