OpenRouter API-Anleitung: GPT, Claude & Gemini mit einem Key (2026)
Wer hat welches Problem? Mac-Entwickler und AI-Engineers, die in Cursor, OpenClaw oder eigenen Agents GPT, Claude und Gemini parallel testen, ohne fünf Vendor-Keys, SDKs und Rechnungen zu pflegen. Was liefert dieser Guide? Datenbasierte Routing-Matrix, OpenRouter-vs-Direkt-API-Vergleich, 7-Schritte-Key-Setup, curl/Python/OpenAI-SDK-Beispiele, Fallback-JSON und transparente 5,5%-Preislogik. Struktur: 3 harte Datenpunkte, Preismatrix, FAQ×6, Mac-Tagesmiete für isolierte API-Tests.
Inhalt
Weiterführend: Wöchentliche Token-Rankings, CLI-Tools-Ranking, Juni-2026-Modellanteile.
Kurzantwort (Featured Snippet)
OpenRouter ist ein einheitliches LLM-API-Gateway: Ein OpenRouter API-Key plus OpenAI-kompatibler Endpoint (https://openrouter.ai/api/v1/chat/completions) ruft 400+ Modelle von 70+ Anbietern auf — GPT, Claude, Gemini, DeepSeek, Llama u. a. — per anbieter/modell-String. Bestehender OpenAI-SDK-Code bleibt gültig; nur base_url und api_key tauschen.
01 · TL;DR & Kennzahlen
- Ein Endpoint, alle Modelle: Bearer-Auth + Model-IDs wie
openai/gpt-4o,anthropic/claude-3.5-sonnet,google/gemini-2.5-pro. - Zwei Routing-Ebenen: Modellwahl via
model; Anbieterwahl viaprovider(preisgewichtet). - Failover:
models-Array +route: fallbackfür automatische Modellkette. - Preise: Kein Token-Aufschlag; 5,5% beim Credit-Kauf (min. 0,80 USD); BYOK: 1 Mio. Anfragen/Monat gratis.
Datenpunkt #1: Öffentliche OpenRouter-Leaderboards zeigen regelmäßig 28+ Billionen Tokens in einem rollierenden 7-Tage-Fenster — Produktions-Agents, nicht Hobby-Skripte, treiben Routing.
Datenpunkt #2: Gateway-Overhead typisch 10–80 ms je nach Region; vor Latenz-SLAs benchmarken.
Datenpunkt #3: Bei ~1 Mio. Tokens/Monat Claude Sonnet addiert die 5,5%-Credit-Gebühr grob 4–8 USD — oft günstiger als drei Vendor-Integrationen, ab ~50k USD/Monat lohnt BYOK/Direktvertrag.
02 · Routing-Matrix: Model vs Provider
| Ebene | Entscheidung | Steuerfeld |
|---|---|---|
| Model Routing | Welches Modell antwortet | model oder openrouter/auto |
| Provider Routing | Welcher Upstream-Host bedient dasselbe Modell | provider-Objekt; Standard: preisgewichtete Auswahl |
| Fallback | Automatischer Modellwechsel bei 429/5xx | models + "route": "fallback" |
| Free Tier | 25+ kostenlose Modelle | ~50 Anfragen/Tag ohne Credits; 1.000/Tag nach 10-USD-Top-up; 20/min |
03 · OpenRouter vs Direkt-API (OpenAI, Anthropic, Google)
| Dimension | OpenRouter | Direkt-API |
|---|---|---|
| API-Keys | 1 Key, 400+ Modelle | Pro Vendor Account + Key |
| SDK-Migration | OpenAI-kompatibel (base_url-Swap) | Native SDKs oder Adapter |
| Token-Preis | Listenpreis, kein Markup | Listenpreis |
| Plattformgebühr | 5,5% Credit-Kauf (min. 0,80 USD) | Keine Gateway-Gebühr |
| Failover | Eingebaut | Eigene Retry-Logik |
| Exklusive Features | Teilmenge (kein OpenAI Batch first-class) | Prompt Caching, Vertex, Assistants … |
| Latenz | +10–80 ms Gateway | Direkt zur Provider-Region |
| Sweet Spot | Multi-Model, Prototypen, <~10k USD/Monat | Single-Model-Skala, Compliance, <50 ms SLA |
04 · Fünf Vorteile — und wann OpenRouter falsch ist
- Ein Key für alle Modelle — Vendor-Wechsel = ein
model-String. - Automatisches Failover — Rate-Limits ohne eigenen Circuit Breaker.
- Ein Dashboard — Token, Kosten, TTFT über alle Modelle.
- Kein Token-Markup — Gebühr nur beim Credit-Kauf oder BYOK-Overage.
- 25+ Free Models — CI-Smoke-Tests vor Frontier-Modellen.
Wann nicht nutzen
- Hyperscale Single-Model, wo 5,5% Credits teurer als Enterprise-Direktvertrag.
- Vendor-exklusive APIs (OpenAI Batch, Anthropic Prompt Caching, Vertex-only).
- Strikte Datenresidenz ohne US-Gateway (außer BYOK besteht Legal Review).
- Sub-50-ms-Inferenz-SLAs.
Ausgewogene „Wann nicht"-Abschnitte stärken E-E-A-T und konvertieren Suchanfragen wie „OpenRouter lohnt sich".
05 · 7-Schritte-Setup: OpenRouter API-Key
- Account anlegen auf openrouter.ai (GitHub/Google SSO).
- Keys → Create Key; pro Umgebung benennen (
dev-mac-sandbox). - Credit-Limit am Key setzen, wenn Billing geteilt wird.
- Key exportieren:
export OPENROUTER_API_KEY="sk-or-..."— nie in Git committen. - Optional Credits (10 USD minimum für höhere Free-Quotas); Krypto +5%.
- Test-Request per curl (Abschnitt 06) vor Cursor/LangChain/OpenClaw.
- BYOK optional: Upstream-Keys in Settings — erste 1 Mio. Anfragen/Monat gebührenfrei geroutet.
06 · Code-Beispiele
6.1 cURL
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-3.5-sonnet",
"messages": [
{ "role": "user", "content": "Erkläre Quantencomputing in einem Satz." }
]
}'6.2 Python (OpenAI SDK Drop-in)
import os
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.environ["OPENROUTER_API_KEY"],
)
completion = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hallo von OpenRouter!"}],
)
print(completion.choices[0].message.content)6.3 Fallback-Routing JSON
{
"model": "anthropic/claude-3.5-sonnet",
"models": [
"anthropic/claude-3.5-sonnet",
"openai/gpt-4o",
"google/gemini-2.5-pro"
],
"route": "fallback",
"messages": [{ "role": "user", "content": "Hallo" }]
}6.4 Streaming (Node.js)
const stream = await openai.chat.completions.create({
model: "google/gemini-2.5-pro",
messages: [{ role: "user", content: "Kurzes Gedicht über Herbst." }],
stream: true,
});
for await (const chunk of stream) {
const c = chunk.choices[0]?.delta?.content;
if (c) process.stdout.write(c);
}07 · Preismatrix
| Gebührentyp | Satz | Anmerkung |
|---|---|---|
| Paid-Model-Tokens | Anbieter-Listenpreis | Kein OpenRouter-Markup |
| Credit-Kauf | 5,5% (min. 0,80 USD) | Beim Aufladen |
| Krypto | +5% | Zusätzlich zur Credit-Gebühr |
| BYOK | 0 USD erste 1 Mio./Monat | Danach 5% auf Äquivalent |
| Free Models | 0 USD Tokens | 50/Tag default; 1.000/Tag nach 10 USD |
08 · Fünf-Schritte-Validierung (Mac-Entwickler)
- Isolierte Maschine (nicht Daily Driver): disposable Key, curl gegen GPT/Claude/Gemini-IDs.
- OpenAI SDK auf
base_url=https://openrouter.ai/api/v1— Response-Schema vergleichen. stream: true— TTFT vs Direkt-Baseline messen.- Fallback-JSON posten; 429 simulieren — Kette prüfen.
- Latenz/Tokens/Kosten loggen, Test-Key widerrufen, Umgebung wischen.
09 · FAQ×6
Q: Was ist OpenRouter?
A: Einheitliches LLM-Gateway — ein Key, OpenAI-kompatibler Endpoint, 70+ Anbieter, 400+ Modelle.
Q: Gibt es Token-Aufschläge?
A: Nein. 5,5% nur beim Credit-Kauf (min. 0,80 USD) oder 5% BYOK über 1 Mio./Monat.
Q: Lohnt sich OpenRouter vs Direkt-OpenAI?
A: Multi-Model und Failover unter moderatem Spend: meist ja. Hyperscale/Compliance: oft Direkt-API.
Q: OpenAI Python SDK kompatibel?
A: Ja — base_url + Key tauschen, model als anbieter/modell.
Q: Fallback-Routing?
A: models-Array + "route": "fallback" — sequentieller Modellwechsel ohne Client-Retry.
Q: Produktionssicher?
A: Weit verbreitet; Keys pro Umgebung, Rotation bei Leak, isolierte Test-Hardware, BYOK bei Compliance.
10 · Mac-Tagesmiete für isolierte OpenRouter-Tests
curl funktioniert auf jedem VPS — aber Cursor BYOK, OpenClaw-Gateways und macOS Keychain sind der realistische Prüfstand für Mac-Teams. GPT/Claude/Gemini A/B auf dem Daily Driver leakt Keys in .zshrc, vermischt Caches und hinterlässt Fallback-Configs.
Windows-Cloud und Linux-VPS decken reine API-Skripte ab, nicht aber Keychain-Isolation oder Apple-Silicon-Agent-Oberflächen. Tagesmiete passt zum Rhythmus „Key erzeugen, benchmarken, widerrufen, Node zerstören". Details: Mac mini M4 Preisleitfaden.
11 · Quellen
Zuletzt aktualisiert: 24. Juli 2026 | Preise laut OpenRouter-Docs zum Veröffentlichungsdatum