Claude Opus 5 Release und Kimi K3 Destillations-Skandal: K3 nennt sich selbst Claude
In der letzten Juliwoche 2026 liefen zwei Ereignisse parallel: Anthropic veröffentlichte am 24. Juli den Alltags-Flaggschiff-Ersatz Claude Opus 5 — Fable-5-Nähe zum halben Preis — und Kimi K3 (Release 16. Juli) geriet in die Destillations-Kontroverse: Weißes-Haus-Vorwürfe gegen Moonshot AI, unabhängige Forscher fanden, dass K3 sich als Claude bezeichnet und interne Deployment-Versionen ausgibt.
Für Modell-Entscheider und Tech Leads liefert dieser Artikel: ① Opus-5-Preise, Benchmarks und Sicherheitsrichtlinien; ② die K3-Destillationskette von politischer Anklage bis Greenblatt-Statistik; ③ einen Sechs-Schritte-Rahmen für Opus 5 vs. K3. Frühere K3-Architektur: Kimi K3 Benchmark-Review.
01 Zwei Ereignisse, drei Engpässe bei der Modellauswahl
Beide Stories adressieren dasselbe Marktthema: Preis-Leistung und die Herkunft von Modellfähigkeiten.
| Engpass | Symptom | Betroffene Modelle |
|---|---|---|
| Flaggschiff zu teuer | Coding-Agents und Automatisierung nicht skalierbar | Claude Fable 5 ($10/$50 pro 1M Tokens) |
| Open Source „verdächtig stark" | GPQA-Diamond 93,5 %, Gewichte erst 27.07. | Kimi K3 (2,8T MoE) |
| Compliance + Lieferkette | Destillation, Chip-Export, API-Metadaten | K3 + Anthropic-Februar-Klage |
Opus 5 antwortet mit „Halbpreis, fast Fable-Niveau"; K3 mit „Open Weights + niedriger Preis + weniger Refusals". Die Kontroverse fragt: Ist der günstige Preis Engineering — oder unautorisierte Extraktion fremder Modelle?
02 Claude Opus 5 — vollständige Spezifikationstabelle
Release: 24. Juli 2026 (US-Pacific). Modell-ID claude-opus-5. Verfügbar über Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry. Ab Release-Tag: Claude-Max-Standardmodell und stärkste Claude-Pro-Version.
| Parameter | Wert | Vergleich Opus 4.8 / Fable 5 |
|---|---|---|
| Input-Preis | $5 / 1M Tokens | Unverändert vs. Opus 4.8; ~50 % von Fable 5 |
| Output-Preis | $25 / 1M Tokens | Unverändert vs. Opus 4.8; ~50 % von Fable 5 |
| Fast-Modus | ~2,5× Geschwindigkeit, 2× Preis | Wie Opus 4.8 |
| Kontextfenster | 1M Tokens (einzige Stufe) | = Fable 5 |
| Max. Output | 128K Tokens | — |
| Reasoning | Thinking standardmäßig an; Effort-Parameter | — |
| Datenaufbewahrung | Keine Pflicht-30-Tage-Retention | Fable 5 / Mythos 5: 30-Tage-Pflicht |
| Benchmark | Opus 5 Ergebnis | Relativwert |
|---|---|---|
| Frontier-Bench v0.1 | SWE-Spitze aller Modelle | >2× Opus 4.8, niedrigere Kosten/Task |
| CursorBench 3.2 (max) | −0,5 % vs. Fable-5-Peak | 50 % Kosten; bestes P/$ aller Modelle (high/xhigh/max) |
| ARC-AGI 3 | Neuartige Probleme | 3× nächstbestes Modell |
| OSWorld 2.0 | Computer-Use | > Fable-5-Best bei <⅓ Kosten |
| Zapier AutomationBench | End-to-End-Automatisierung | ~1,5× nächstbestes; 100 % Account-Health-Workflow |
| Life Sciences (intern) | Spektroskopie / Proteinvarianten | +10,2 PP / +7,7 PP vs. Opus 4.8 |
| Box (Enterprise) | Datenanalyse / Due Diligence | +11 % / +17 %; Gesamt +8 % |
Sicherheit: Opus 5 = Anthropics bisher am besten aligniertes Modell (niedrigste Täuschungsrate). Dual-Use-Frontier (Cyberangriff, Biosicherheit) bewusst nicht refreshed — Mythos 5 bleibt Spitze. Cyber-Klassifikator ~85 % weniger Eingriffe als Fable 5; Quellcode-Schwachstellen ja, Binär-Scanning / Pentest / Exploit-Generierung nein.
Cursor-Team: „Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. On CursorBench it's just under Fable 5 and has many of the same behaviors."
03 Claude Opus 5 vs. Fable 5 — Entscheidungsmatrix
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Input / Output Preis | $5 / $25 pro 1M Tokens | ca. $10 / $50 pro 1M Tokens |
| Relative Kosten | ~50 % von Fable 5 | Flaggschiff-Preis |
| CursorBench 3.2 (max) | −0,5 % vs. Fable-5-Peak | Peak-Referenz |
| Kontextfenster | 1M Tokens | 1M Tokens |
| Datenaufbewahrung | Keine 30-Tage-Pflicht | 30-Tage-Retention erforderlich |
| Claude Max Standard | Ja (ab 24.07.2026) | Nein |
| Dual-Use-Risiko | Bewusst unter Mythos 5 | Stärker; Mythos 5 = limitierter Gipfel |
| Einsatzszenario | Tägliche Coding-Agents, Automatisierung, Compliance | FrontierSWE, Grenz-Reasoning |
Wer Fable 5 wegen des Preises gemieden hat, erhält mit Opus 5 „minimaler Leistungsverlust, halbe Kosten" — Anthropics direkte Antwort auf den KI-Preiskrieg.
04 Kimi K3 Destillations-Skandal — Timeline und Benchmarks
Moonshot AI veröffentlichte Kimi K3 am 16. Juli 2026: 2,8T Gesamtparameter, erster Open-Weight-„3T-Klasse"-Satz; Sparse MoE mit 896 Experten / 16 aktiv (~50B aktive Parameter); 1M Kontext + native Vision; KDA + Attention Residuals + Stable LatentMoE (~2,5× Trainingseffizienz vs. K2). Vollgewichte geplant 27. Juli 2026.
| Benchmark | Kimi K3 | Anmerkung |
|---|---|---|
| GPQA-Diamond | 93,5 % | Höchster Open-Source-Score zum Release |
| Terminal-Bench 2.1 | 88,3 % | −0,5 PP vs. GPT-5.6 Sol |
| BrowseComp | 91,2 % | Release-Höchstwert |
| Program Bench | 77,8 % | Gesamtbeste |
| SWE Marathon | 42,0 % | Gesamtbeste |
| DeepSearchQA (F1) | 95,0 % | — |
| Datum | Ereignis | Quelle |
|---|---|---|
| 2026-02 | Anthropic: 3,4M+ anomale Moonshot-API-Calls | Anthropic öffentlich |
| 2026-07-01 | Fable 5 öffentlich verfügbar | Anthropic |
| 2026-07-16 | Kimi K3 Release | Moonshot |
| 2026-07-22/23 | OSTP-Direktor Kratsios: industrielle Destillation + GB300-Chips | Weißes Haus / X |
| 2026-07-23 | TechCrunch: Experten bezweifeln Zwei-Wochen-Timeline | Braden Hancock, Nathan Lambert |
| 2026-07-24 | Greenblatt: K3 nennt sich Claude | GitHub rgreenblatt/which_claude_is_k3 |
| 2026-07-27 (geplant) | K3 Vollgewichte Open Source | Moonshot |
22.–23. Juli 2026: OSTP-Direktor Michael Kratsios warf Moonshot „großangelegte, verdeckte industrielle Destillation" vor, plus unlizenzierte Nvidia GB300-Chips (möglicherweise via Thailand). Finanzminister Scott Bessent: „Wasserzeichen" US-LLMs in chinesischen Modellen — ohne Spezifikation.
„I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation... Fable's only been publicly available since July 1st." — Braden Hancock, Laude Institute / Snorkel AI
„Distillation is becoming less and less impactful over time as the Chinese models get closer to the frontier..." — Nathan Lambert, Allen Institute for AI
Elon Musk gab in einem Prozess zu, xAI habe Grok mit OpenAI-Destillation trainiert — Branchenpraxis; Streitpunkt ist die Grenze zwischen legitimer Technikübernahme und verdecktem industriellen Diebstahl.
05 Greenblatt-Analyse: K3 nennt sich Claude — harte Daten
Redwood Research Chief Scientist Ryan Greenblatt veröffentlichte um den 24. Juli eine Statistik (GitHub: rgreenblatt/which_claude_is_k3) über Identitätsantworten auf „Wer bist du?".
| Befund | K3-Verhalten | Echtes Claude-Modell |
|---|---|---|
| Selbstbezeichnung | Disproportional „Claude" | Sagt „Claude Sonnet/Opus X.Y" |
| Deployment-IDs | claude-opus-4-5-20250929, claude-sonnet-4-5-20250929 | Gibt interne IDs nicht preis |
| Genauigkeit Metadaten | Präziser als Lehrer-Modell | Opus 4.5 meldet IDs nicht/freiwillig falsch |
| Generations-Mapping | Claude-4.5-Ära (Ende 2025) | Aktuell: Fable/Mythos |
| Vorgänger K2 | Signal → Claude Sonnet 4 (Mitte 2025) | „Generation-für-Generation"-Muster |
Greenblatt-Interpretation: Wahrscheinlicher Hinweis auf Trainingsdaten mit Deployment-Metadaten (API-Logs, synthetische Labels) — schwerer durch „Stilimitation" zu erklären. Wichtig: beweist Destillation nicht direkt; Kontamination, Prompt-Leak oder öffentliche Datensätze sind alternative Erklärungen.
Zitierbare Hard Facts (Stand 25.07.2026):
- Opus 5 Preis: $5 / $25 pro 1M Tokens; ~50 % von Fable 5
- CursorBench Gap: Opus 5 max vs. Fable 5 Peak = 0,5 %
- K3 Parameter: 2,8T gesamt; 896/16 MoE; ~50B aktiv
- Anthropic Feb. 2026: Moonshot 3,4M+ anomale API-Interaktionen
- Open Weights: K3 geplant 2026-07-27
06 Sechs-Schritte-Auswahl, FAQ und Produktionsempfehlung
Hauptschlachtfeld 2026: Preis-Leistung — Opus 5 halbiert Kosten; K3 drückt Open-Source-Preise; Destillationsdebatte klärt die Frage nach Fähigkeitsherkunft.
- Workload definieren: Tägliche Coding-Agents / Automatisierung → Opus 5; FrontierSWE / Grenz-Reasoning → Fable 5; langer Open-Source-Kontext → K3 (ab 27.07.).
- Compliance prüfen: Opus 5 ohne 30-Tage-Retention-Pflicht — Vorteil für sensible Unternehmensdaten.
- P/$ hart messen: CursorBench −0,5 % + 50 % Kostenersparnis — für Cursor/Claude-Code-Workflows Default-Upgrade H2 2026.
- K3 unabhängig verifizieren: Vor 27.07. nur Moonshot-Self-Report; kein Produktionseinsatz in compliance-kritischen Umgebungen.
- Lieferkettenrisiko dokumentieren: Destillation, Chip-Export, politische Beschränkungen — Provenance in Architektur-Docs festhalten.
- Stabile Host-Umgebung: 7×24 Agent-Gateways brauchen dedizierte Apple-Silicon-Kapazität und launchd-Persistenz — kein Shared-VPS-Overselling.
F: Wie viel günstiger ist Claude Opus 5 als Claude Fable 5?
A: Gleiche Benchmark-Stufe: Opus 5 ~50 % ($5/$25 vs. ca. $10/$50 pro 1M Input/Output); CursorBench-Peak-Differenz <1 %.
F: Ist Claude Opus 5 jetzt das Claude-Max-Standardmodell?
A: Ja, seit 24. Juli 2026 — auch stärkste Claude-Pro-Version.
F: Hat Moonshot Kimi K3 aus Claude destilliert?
A: Unbestätigt. Weißes-Haus ohne öffentliche Belege; Timeline-Kritik; Greenblatt-Statistik stärkster technischer Indizienbeweis, aber nicht konklusiv.
F: Wann Kimi K3 Vollgewichte?
A: Moonshot: 27. Juli 2026 — zum Artikelzeitpunkt noch nicht veröffentlicht.
Reine API-Nutzung birgt versteckte Kosten: Shared-Cloud-Overselling unterbricht Long-Connections, fehlende 7×24-Stabilität für Multi-Modell-A/B-Tests, Compliance erfordert dedizierte Umgebung. Für dauerhaft laufende Claude-Code- / Kimi-Code-Agents ist JEXCLOUD Multi-Region Bare-Metal Mac die robustere Option: dediziertes Apple-Silicon-Unified-Memory, kein Overselling-Jitter, launchd-persistente Gateways, 120-Sekunden-Provisioning. Details: JEXCLOUD-Preisseite.