Google Modelle

Ausgewählte API-Modelle mit Quellen, Prüfdaten und klaren Preisannahmen.

API-Spezifikationen bestimmen nicht die Modellwahl, Limits oder Abrechnung in einer Chat-Oberfläche, einem Coding-Agenten oder einer IDE. Prüfe den tatsächlichen Zugang.

Modell / API-IDKontext / EingabelimitMax. AusgabeEingabe / AusgabeGeprüft
Gemini 3.8 Flash
gemini-3.8-flash
1.048576M
Eingabelimit
65.536K$0.75 / $3.75
Preisquelle
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
1.048576M
Eingabelimit
65.536K$0.3 / $2.5
Preisquelle

Profile vergleichen

Nutze denselben Auftrag und dieselben Prüfungen. Vergleiche bestätigte Fehler, Korrekturen, Zeit und Verbrauch. Anbieterbezeichnungen und ähnlich benannte Denkstufen sind keine gemeinsame Leistungsskala.

Die folgenden Modellnotizen sind auf Englisch; Quellen führen zur jeweiligen Anbieterdokumentation.

Gemini 3.8 Flash

Evaluate a current Flash profile for your coding or extraction workload.

Denksteuerung: thinking level (low, medium, high).

Standard paid-tier token rates through 2026-12-31. Scheduled rates from 2027-01-01: input $1.50, output $7.50. Grounding and caching have separate charges.

  • Google lists an input token limit separately from the output limit.
  • The minimal thinking level is unsupported. Availability in Gemini and Gemini CLI is separate from API availability.
Gemini 3.5 Flash-Lite

Evaluate for simple extraction or other tasks where cost and latency matter.

Denksteuerung: supported; see configuration.

Standard paid-tier rates. Output includes thinking tokens; grounding, caching and other processing tiers are separate.

  • An API capability does not imply that an account exposes the same option in Gemini or Gemini CLI.

Zugang, Limits und weitere Anbieter