Estimate a Gemini 3.8 Flash call
Beispiel
Input: 10,000 tokens Output: 500 tokens
Das erhalten Sie
Adjust model tier to match Google AI Studio or Vertex pricing (Gemini 3.8 Flash and nearby tiers).
Googles Gemini-Linie ändert sich schnell. Dieser Rechner lädt aktive Gemini-Modelle — inkl. Gemini 3.8 Flash und benachbarte Flash/Pro-Stufen — sowie Preise von OpenRouter und kann Thinking-/Reasoning-Tokens schätzen. Modelllisten und $/1M-Preise kommen live von der öffentlichen OpenRouter-Models-API (https://openrouter.ai/api/v1/models), mit TensorFeed und lokalem Snapshot als Fallback. Neue Releases (z. B. Gemini 3.8 Flash oder Claude Fable 5.1) erscheinen automatisch, sobald OpenRouter sie listet.
Google · Local registry · as of 2026-09-02 · 5 models · refreshing…
Pricing data: OpenRouter models
| Model | Input | Output | Thinking |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | $3.75 |
| Gemini 3.7 Flash | $0.75 | $3.75 | $3.75 |
| Gemini 3.5 Flash | $1.50 | $9.00 | $9.00 |
| Gemini 3.1 Pro | $2.00 | $12.00 | $12.00 |
| Gemini 3.1 Flash Lite | $0.25 | $1.50 | $1.50 |
Beispiel
Input: 10,000 tokens Output: 500 tokens
Das erhalten Sie
Adjust model tier to match Google AI Studio or Vertex pricing (Gemini 3.8 Flash and nearby tiers).
API-Kosten für aktuelle OpenAI-GPT-Modelle mit Live-Preisen von OpenRouter berechnen.
Kosten für Claude Fable 5.1 und weitere aktuelle Anthropic-Modelle mit Live-Preisen schätzen.
Tokens zählen und API-Kosten über große LLMs schätzen — Modelle aktualisieren sich aus OpenRouter-Live-Preisen.
GPU- und Cloud-Kosten für Self-Hosting von Llama-Modellen schätzen.
RAG- und Fine-Tuning-Kosten vergleichen, um den optimalen Ansatz zu finden.