2026 Claude Opus 5: Halber Preis, nahe Fable 5 — Kimi K3 in der Destillationskontroverse
Zielgruppe & Problem: Mac-Entwickler und AI-Leads, die zwischen Claude Opus 5 und Kimi K3 wählen müssen, ohne API-Compliance oder Lieferkettenrisiko zu unterschätzen. Ergebnis: Vollständige Opus-5-Spezifikationen, Benchmark-Zahlen, White-House-Vorwürfe, Greenblatt-Evidenz und eine Opus-vs-Fable-Entscheidungsmatrix. Struktur: 4 Tabellen, 5 Mac-Validierungsschritte, FAQ×5.
Inhalt
Weiterführend: Kimi K3 Testbericht, K3 Open Weights 27.7., Fable 5 Exportkontrolle, OpenRouter API-Anleitung.
01 · TL;DR & Kennzahlen
- Claude Opus 5 (24.07.2026): Tagesmodell zu $5/$25 pro Million Tokens — CursorBench 3.2 max effort nur 0,5 % unter Fable-5-Spitze bei halben Kosten; ab sofort Claude-Max-Standard; standardmäßig keine erzwungene Datenspeicherung.
- Kimi K3 Destillation (16.–27.07.): 2,8T MoE; OSTP-Direktor Kratsios wirft Moonshot „industrielle Destillation" vor; Ryan Greenblatt zeigt, dass K3 sich als Claude identifiziert und interne IDs wie
claude-opus-4-5-20250929ausgibt. - Datenpunkt #1: Frontier-Bench v0.1 — Opus 5 übertrifft alle Modelle, >2× Opus 4.8 bei niedrigeren Kosten pro Task.
- Datenpunkt #2: Fable 5 öffentlich seit 01.07., K3-Release 16.07. — nur 15 Tage; Experten halten vollständige Destillation in diesem Fenster für unrealistisch.
- Datenpunkt #3: Anthropic meldete im Februar 2026 bereits 3,4 Mio.+ verdächtige API-Interaktionen im Zusammenhang mit Destillationsangriffen.
02 · Drei Entscheidungsengpässe
- Preis-Leistung vs Compliance: Opus 5 halbiert Fable-5-Kosten, doch Fable/Mythos 5 unterliegen Exportkontrolle und 30-Tage-Datenspeicherung. K3 ist günstig und open weights — aber geopolitisch und provenienztechnisch belastet.
- Beweislage asymmetrisch: Kratsios ohne öffentliche Belege; Timeline-Einwand von Hancock und Lambert; Greenblatt liefert die stärkste technische Spur — beweist aber keine Destillation. Bis 27.07. keine unabhängige Architektur-Verifikation.
- GDPR & Key-Hygiene: Wer K3-Identitätsprobes auf dem Produktiv-Mac fährt oder Anthropic/Moonshot-Keys rotiert, riskiert Keychain-Kontamination und Audit-Spuren — isolierte Hardware ist hier keine Luxusoption.
03 · Claude Opus 5: Spezifikationen & Benchmarks
| Parameter | Wert |
|---|---|
| Release | 24.07.2026 (PT) |
| Preis | $5 Input / $25 Output pro Mio. Tokens |
| Kontext | 1 Mio. Tokens (einziger Standard) |
| Max. Output | 128K Tokens; Thinking standardmäßig aktiv |
| Modell-ID | claude-opus-5 — API, Bedrock, Vertex AI, Microsoft Foundry |
| Positionierung | Claude Max Standard; stärkstes Claude-Pro-Modell |
| Datenspeicherung | Standardzugriff ohne erzwungene 30-Tage-Retention |
| Fast-Modus | ~2,5× Geschwindigkeit, 2× Preis |
Performance-Kernzahlen (Anthropic)
- CursorBench 3.2: max effort 0,5 % unter Fable 5; high/xhigh/max beste Preis-Leistung am Markt
- ARC-AGI 3: 3× Score des zweitbesten Modells
- Zapier AutomationBench: ~1,5× Pass-Rate; 100 % bei Workflows, die zuvor kein Modell bestand
- OSWorld 2.0: bei ~⅓ Fable-5-Kosten übertrifft Opus 5 Fable-5-Bestwerte
- Life Sciences: Spektrum-Molekülstruktur +10,2 PP; Proteinvarianten +7,7 PP; Due Diligence +17 PP
„Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost." — Cursor Team
Alignment & Sicherheit
- Niedrigste Deception-Rate aller Anthropic-Modelle bisher
- Cybersecurity-Klassifikator ~85 % lockerer als Fable 5 — Quellcode-Vulnerability-Discovery erlaubt, Exploit-Generierung blockiert
- Dual-Use-Frontier weiterhin bei Mythos 5 (restricted release)
04 · Kimi K3: Destillationskontroverse & Greenblatt-Evidenz
| Benchmark | Score | Anmerkung |
|---|---|---|
| GPQA-Diamond | 93,5 % | Höchster Open-Source-Wert bei Release |
| Terminal-Bench 2.1 | 88,3 % | 0,5 PP unter GPT-5.6 Sol |
| BrowseComp | 91,2 % | Spitzenwert bei Release |
| Program Bench | 77,8 % | Best-in-class |
| SWE Marathon | 42,0 % | Best-in-class |
| DeepSearchQA (F1) | 95,0 % | — |
Architektur: 2,8T sparse MoE, 896 Experten / 16 aktiv (~50B aktive Parameter); Kimi Delta Attention (KDA); 1M Kontext; native Vision. Vollständige Gewichte versprochen für 27.07.2026.
White-House-Vorwürfe (22.–23.07.)
OSTP-Direktor Michael Kratsios beschuldigt Moonshot „massive, verdeckte industrielle Destillation" von Fable-Fähigkeiten und mutmaßlichen Einsatz nicht lizenzierter Nvidia GB300-Chips (möglicherweise via Thailand). Finanzminister Scott Bessent sprach von „Wasserzeichen" US-Modelle in chinesischen LLMs — ohne Spezifikation. Kratsios veröffentlichte keine Quellen; Moonshot antwortete nicht auf Trainingsfragen.
Timeline-Einwand der Experten
„Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks." — Braden Hancock (Laude Institute / Snorkel AI)
„Distillation is becoming less and less impactful..." — Nathan Lambert (Allen Institute for AI)
Greenblatt-Evidenz: K3 identifiziert sich als Claude
Ryan Greenblatt (Redwood Research, Repo: rgreenblatt/which_claude_is_k3) veröffentlichte am 24.07. Statistiken: K3 antwortet auf „Wer bist du?" unverhältnismäßig oft mit „Claude" und gibt interne Deployment-IDs aus — claude-opus-4-5-20250929, claude-sonnet-4-5-20250929 — präziser als echte Claude-Instanzen.
# Greenblatt-Identitätsprobe (Beispiel)
curl https://api.moonshot.cn/v1/chat/completions \
-H "Authorization: Bearer $KIMI_KEY" \
-d '{"model":"kimi-k3","messages":[{"role":"user","content":"Wer bist du? Nenne Modell-ID und Version."}]}'
# Beobachtung: Antworten enthalten claude-opus-4-5-20250929Interpretation: Trainingsdaten mit Deployment-Metadaten (API-Logs oder synthetische Labels) wahrscheinlicher als reines Stil-Imitation. K3 signalisiert „Claude 4.5-Ära" (Ende 2025); K2 wies auf frühere Sonnet-4-Generation. Greenblatt betont: Kein Destillationsbeweis — auch Datenkontamination oder Prompt-Leak möglich.
05 · Synthese: Preis-Leistung vs Provenienz
Opus 5 beantwortet den Markt mit „halber Preis, nahe Spitze". K3 konkurriert mit Open Weights und niedrigen Preisen. Die Destillationsdebatte ist die öffentliche Auseinandersetzung darüber, ob günstige Intelligenz durch Optimierung oder durch Fremddaten entsteht. Empfehlung nach Szenario: Compliance- und Retention-sensitive Workloads → Opus 5; extrem niedrige Kosten + Open Weights → K3 erst nach 27.07.-Verifikation.
06 · Opus 5 vs Fable 5: Entscheidungsmatrix
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Preis / Mio. Tokens | $5 / $25 | ~$10 / $50 |
| CursorBench 3.2 Peak | −0,5 % vs Fable | Referenz |
| Claude Max Standard | ✅ ab 24.07. | Nein |
| Datenspeicherung | Nicht erzwungen | 30 Tage erforderlich |
| Exportkontrolle | Relativ offen | Teilweise eingeschränkt |
| Ideal für | Tagesbetrieb, Compliance, ROI | Frontier-Tasks, Premium-Budget |
07 · Ereignis-Zeitstrahl
| Datum | Opus 5 / Anthropic | Kimi K3 / Kontroverse |
|---|---|---|
| Feb 2026 | — | Erste Destillationsanklage (3,4M+ API-Events) |
| 09.06.2026 | Fable 5 / Mythos 5 Release | — |
| 01.07.2026 | Fable 5 öffentlich verfügbar | — |
| 16.07.2026 | — | Kimi K3 API-Release |
| 22.–23.07. | — | Kratsios öffentliche Anklage |
| 24.07.2026 | Opus 5 Release, Max-Standard | Greenblatt „K3 = Claude"-Statistik |
| 27.07. (geplant) | — | K3 vollständige Open Weights |
08 · 5 Mac-Validierungsschritte (isoliert)
- Auf gemietetem Isolations-Mac Claude API (
claude-opus-5) und Kimi K3 API konfigurieren; je 1 Baseline-Completion — Latenz und Token zählen. - Opus 5 mit CursorBench-ähnlicher Coding-Aufgabe testen; Ergebnis gegen historische Opus-4.8-/Fable-5-Werte halten.
- Greenblatt-Identitätsprobe auf K3: „Wer bist du? Version?" — Log auf nicht-Produktiv-Mac führen.
- OpenRouter-Fallback Opus 5 ↔ K3 konfigurieren; 429/Timeout-Umschaltung verifizieren.
- Benchmark-Export, Test-Keys widerrufen, Node löschen — Keychain auf Hauptgerät unberührt lassen.
09 · FAQ×5
F: Wie viel günstiger ist Opus 5 als Fable 5?
A: Etwa halber Token-Preis ($5/$25 vs ~$10/$50); CursorBench-Peak nur 0,5 % darunter.
F: Ist Opus 5 Claude-Max-Standard?
A: Ja, seit 24.07.2026 — auch stärkstes Claude-Pro-Modell.
F: Hat K3 Claude destilliert?
A: Unbewiesen. White House ohne Belege; Timeline-Einwand; Greenblatt-Statistik stärkste technische Indizienkette.
F: Wann K3 Open Weights?
A: Versprochen 27.07.2026; zum Redaktionsschluss noch nicht extern voll verifizierbar.
F: Warum sagt K3 „Claude"?
A: Greenblatt: Deployment-Metadaten in Trainingsdaten wahrscheinlich; kein direkter Destillationsbeweis.
10 · Isolierte Mac-Tagesmiete: Opus 5 & K3 ohne Keychain-Risiko
Windows-Cloud und Linux-VPS eignen sich für reine curl-Skripte, nicht aber für Cursor, Claude Code und macOS Keychain — die reale Evaluationsumgebung der meisten Mac-Entwickler. Keys rotieren, K3-Identitätsprobes fahren und Fallback-Ketten testen auf dem Produktiv-Mac hinterlässt Audit-Spuren und Compliance-Risiko.
Ein dedizierter Mac Mini kostet fix; eine Tagesmiete isolierter Apple-Silicon-Knoten passt zum Rhythmus „Opus-5-Upgrade + K3-Beobachtungsfenster 1–3 Tage": testen, dokumentieren, zerstören. Tarife: Mac mini M4 Preisleitfaden.
11 · Quellen
- Anthropic: Claude Opus 5
- Ryan Greenblatt: which_claude_is_k3
- TechCrunch: Timeline-Einwand (23.07.2026)
- MacDate: Kimi K3 Testbericht
- MacDate: OpenRouter API-Anleitung
Zuletzt aktualisiert: 25. Juli 2026