Google Modelle
Ausgewählte API-Modelle mit Quellen, Prüfdaten und klaren Preisannahmen.
API-Spezifikationen bestimmen nicht die Modellwahl, Limits oder Abrechnung in einer Chat-Oberfläche, einem Coding-Agenten oder einer IDE. Prüfe den tatsächlichen Zugang.
| Modell / API-ID | Kontext / Eingabelimit | Max. Ausgabe | Eingabe / Ausgabe | Geprüft |
|---|---|---|---|---|
Gemini 3.8 Flashgemini-3.8-flash | 1.048576M Eingabelimit | 65.536K | $0.75 / $3.75 | Preisquelle |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite | 1.048576M Eingabelimit | 65.536K | $0.3 / $2.5 | Preisquelle |
Profile vergleichen
Nutze denselben Auftrag und dieselben Prüfungen. Vergleiche bestätigte Fehler, Korrekturen, Zeit und Verbrauch. Anbieterbezeichnungen und ähnlich benannte Denkstufen sind keine gemeinsame Leistungsskala.
Die folgenden Modellnotizen sind auf Englisch; Quellen führen zur jeweiligen Anbieterdokumentation.
- Gemini 3.8 Flash
Evaluate a current Flash profile for your coding or extraction workload.
Denksteuerung: thinking level (low, medium, high).
Standard paid-tier token rates through 2026-12-31. Scheduled rates from 2027-01-01: input $1.50, output $7.50. Grounding and caching have separate charges.
- Google lists an input token limit separately from the output limit.
- The minimal thinking level is unsupported. Availability in Gemini and Gemini CLI is separate from API availability.
- Gemini 3.5 Flash-Lite
Evaluate for simple extraction or other tasks where cost and latency matter.
Denksteuerung: supported; see configuration.
Standard paid-tier rates. Output includes thinking tokens; grounding, caching and other processing tiers are separate.
- An API capability does not imply that an account exposes the same option in Gemini or Gemini CLI.