AI Agent 2026.07.25

Claude Opus 5 Release und Kimi K3 Destillations-Skandal: K3 nennt sich selbst Claude

In der letzten Juliwoche 2026 liefen zwei Ereignisse parallel: Anthropic veröffentlichte am 24. Juli den Alltags-Flaggschiff-Ersatz Claude Opus 5 — Fable-5-Nähe zum halben Preis — und Kimi K3 (Release 16. Juli) geriet in die Destillations-Kontroverse: Weißes-Haus-Vorwürfe gegen Moonshot AI, unabhängige Forscher fanden, dass K3 sich als Claude bezeichnet und interne Deployment-Versionen ausgibt.

Für Modell-Entscheider und Tech Leads liefert dieser Artikel: ① Opus-5-Preise, Benchmarks und Sicherheitsrichtlinien; ② die K3-Destillationskette von politischer Anklage bis Greenblatt-Statistik; ③ einen Sechs-Schritte-Rahmen für Opus 5 vs. K3. Frühere K3-Architektur: Kimi K3 Benchmark-Review.

01 Zwei Ereignisse, drei Engpässe bei der Modellauswahl

Beide Stories adressieren dasselbe Marktthema: Preis-Leistung und die Herkunft von Modellfähigkeiten.

Engpass-Matrix — Auswahlrisiken Juli 2026
Engpass Symptom Betroffene Modelle
Flaggschiff zu teuerCoding-Agents und Automatisierung nicht skalierbarClaude Fable 5 ($10/$50 pro 1M Tokens)
Open Source „verdächtig stark"GPQA-Diamond 93,5 %, Gewichte erst 27.07.Kimi K3 (2,8T MoE)
Compliance + LieferketteDestillation, Chip-Export, API-MetadatenK3 + Anthropic-Februar-Klage

Opus 5 antwortet mit „Halbpreis, fast Fable-Niveau"; K3 mit „Open Weights + niedriger Preis + weniger Refusals". Die Kontroverse fragt: Ist der günstige Preis Engineering — oder unautorisierte Extraktion fremder Modelle?

02 Claude Opus 5 — vollständige Spezifikationstabelle

Release: 24. Juli 2026 (US-Pacific). Modell-ID claude-opus-5. Verfügbar über Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry. Ab Release-Tag: Claude-Max-Standardmodell und stärkste Claude-Pro-Version.

Claude Opus 5 — Kerndaten (Anthropic, 24.07.2026)
Parameter Wert Vergleich Opus 4.8 / Fable 5
Input-Preis$5 / 1M TokensUnverändert vs. Opus 4.8; ~50 % von Fable 5
Output-Preis$25 / 1M TokensUnverändert vs. Opus 4.8; ~50 % von Fable 5
Fast-Modus~2,5× Geschwindigkeit, 2× PreisWie Opus 4.8
Kontextfenster1M Tokens (einzige Stufe)= Fable 5
Max. Output128K Tokens
ReasoningThinking standardmäßig an; Effort-Parameter
DatenaufbewahrungKeine Pflicht-30-Tage-RetentionFable 5 / Mythos 5: 30-Tage-Pflicht
Claude Opus 5 — Benchmark-Kennzahlen (Anthropic offiziell)
Benchmark Opus 5 Ergebnis Relativwert
Frontier-Bench v0.1SWE-Spitze aller Modelle>2× Opus 4.8, niedrigere Kosten/Task
CursorBench 3.2 (max)−0,5 % vs. Fable-5-Peak50 % Kosten; bestes P/$ aller Modelle (high/xhigh/max)
ARC-AGI 3Neuartige Probleme3× nächstbestes Modell
OSWorld 2.0Computer-Use> Fable-5-Best bei <⅓ Kosten
Zapier AutomationBenchEnd-to-End-Automatisierung~1,5× nächstbestes; 100 % Account-Health-Workflow
Life Sciences (intern)Spektroskopie / Proteinvarianten+10,2 PP / +7,7 PP vs. Opus 4.8
Box (Enterprise)Datenanalyse / Due Diligence+11 % / +17 %; Gesamt +8 %

Sicherheit: Opus 5 = Anthropics bisher am besten aligniertes Modell (niedrigste Täuschungsrate). Dual-Use-Frontier (Cyberangriff, Biosicherheit) bewusst nicht refreshed — Mythos 5 bleibt Spitze. Cyber-Klassifikator ~85 % weniger Eingriffe als Fable 5; Quellcode-Schwachstellen ja, Binär-Scanning / Pentest / Exploit-Generierung nein.

Cursor-Team: „Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. On CursorBench it's just under Fable 5 and has many of the same behaviors."

03 Claude Opus 5 vs. Fable 5 — Entscheidungsmatrix

Claude Opus 5 vs. Fable 5 — Schlüsseldimensionen (2026-07-24)
Dimension Claude Opus 5 Claude Fable 5
Input / Output Preis$5 / $25 pro 1M Tokensca. $10 / $50 pro 1M Tokens
Relative Kosten~50 % von Fable 5Flaggschiff-Preis
CursorBench 3.2 (max)−0,5 % vs. Fable-5-PeakPeak-Referenz
Kontextfenster1M Tokens1M Tokens
DatenaufbewahrungKeine 30-Tage-Pflicht30-Tage-Retention erforderlich
Claude Max StandardJa (ab 24.07.2026)Nein
Dual-Use-RisikoBewusst unter Mythos 5Stärker; Mythos 5 = limitierter Gipfel
EinsatzszenarioTägliche Coding-Agents, Automatisierung, ComplianceFrontierSWE, Grenz-Reasoning

Wer Fable 5 wegen des Preises gemieden hat, erhält mit Opus 5 „minimaler Leistungsverlust, halbe Kosten" — Anthropics direkte Antwort auf den KI-Preiskrieg.

04 Kimi K3 Destillations-Skandal — Timeline und Benchmarks

Moonshot AI veröffentlichte Kimi K3 am 16. Juli 2026: 2,8T Gesamtparameter, erster Open-Weight-„3T-Klasse"-Satz; Sparse MoE mit 896 Experten / 16 aktiv (~50B aktive Parameter); 1M Kontext + native Vision; KDA + Attention Residuals + Stable LatentMoE (~2,5× Trainingseffizienz vs. K2). Vollgewichte geplant 27. Juli 2026.

Kimi K3 — offizielle Benchmarks (Release-Stand)
Benchmark Kimi K3 Anmerkung
GPQA-Diamond93,5 %Höchster Open-Source-Score zum Release
Terminal-Bench 2.188,3 %−0,5 PP vs. GPT-5.6 Sol
BrowseComp91,2 %Release-Höchstwert
Program Bench77,8 %Gesamtbeste
SWE Marathon42,0 %Gesamtbeste
DeepSearchQA (F1)95,0 %
Destillations-Timeline — datierte Ereignisse
Datum Ereignis Quelle
2026-02Anthropic: 3,4M+ anomale Moonshot-API-CallsAnthropic öffentlich
2026-07-01Fable 5 öffentlich verfügbarAnthropic
2026-07-16Kimi K3 ReleaseMoonshot
2026-07-22/23OSTP-Direktor Kratsios: industrielle Destillation + GB300-ChipsWeißes Haus / X
2026-07-23TechCrunch: Experten bezweifeln Zwei-Wochen-TimelineBraden Hancock, Nathan Lambert
2026-07-24Greenblatt: K3 nennt sich ClaudeGitHub rgreenblatt/which_claude_is_k3
2026-07-27 (geplant)K3 Vollgewichte Open SourceMoonshot

22.–23. Juli 2026: OSTP-Direktor Michael Kratsios warf Moonshot „großangelegte, verdeckte industrielle Destillation" vor, plus unlizenzierte Nvidia GB300-Chips (möglicherweise via Thailand). Finanzminister Scott Bessent: „Wasserzeichen" US-LLMs in chinesischen Modellen — ohne Spezifikation.

„I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation... Fable's only been publicly available since July 1st." — Braden Hancock, Laude Institute / Snorkel AI

„Distillation is becoming less and less impactful over time as the Chinese models get closer to the frontier..." — Nathan Lambert, Allen Institute for AI

Elon Musk gab in einem Prozess zu, xAI habe Grok mit OpenAI-Destillation trainiert — Branchenpraxis; Streitpunkt ist die Grenze zwischen legitimer Technikübernahme und verdecktem industriellen Diebstahl.

05 Greenblatt-Analyse: K3 nennt sich Claude — harte Daten

Redwood Research Chief Scientist Ryan Greenblatt veröffentlichte um den 24. Juli eine Statistik (GitHub: rgreenblatt/which_claude_is_k3) über Identitätsantworten auf „Wer bist du?".

Greenblatt-Befunde — Identitätsverhalten Kimi K3
Befund K3-Verhalten Echtes Claude-Modell
SelbstbezeichnungDisproportional „Claude"Sagt „Claude Sonnet/Opus X.Y"
Deployment-IDsclaude-opus-4-5-20250929, claude-sonnet-4-5-20250929Gibt interne IDs nicht preis
Genauigkeit MetadatenPräziser als Lehrer-ModellOpus 4.5 meldet IDs nicht/freiwillig falsch
Generations-MappingClaude-4.5-Ära (Ende 2025)Aktuell: Fable/Mythos
Vorgänger K2Signal → Claude Sonnet 4 (Mitte 2025)„Generation-für-Generation"-Muster

Greenblatt-Interpretation: Wahrscheinlicher Hinweis auf Trainingsdaten mit Deployment-Metadaten (API-Logs, synthetische Labels) — schwerer durch „Stilimitation" zu erklären. Wichtig: beweist Destillation nicht direkt; Kontamination, Prompt-Leak oder öffentliche Datensätze sind alternative Erklärungen.

Zitierbare Hard Facts (Stand 25.07.2026):

  • Opus 5 Preis: $5 / $25 pro 1M Tokens; ~50 % von Fable 5
  • CursorBench Gap: Opus 5 max vs. Fable 5 Peak = 0,5 %
  • K3 Parameter: 2,8T gesamt; 896/16 MoE; ~50B aktiv
  • Anthropic Feb. 2026: Moonshot 3,4M+ anomale API-Interaktionen
  • Open Weights: K3 geplant 2026-07-27

06 Sechs-Schritte-Auswahl, FAQ und Produktionsempfehlung

Hauptschlachtfeld 2026: Preis-Leistung — Opus 5 halbiert Kosten; K3 drückt Open-Source-Preise; Destillationsdebatte klärt die Frage nach Fähigkeitsherkunft.

  1. Workload definieren: Tägliche Coding-Agents / Automatisierung → Opus 5; FrontierSWE / Grenz-Reasoning → Fable 5; langer Open-Source-Kontext → K3 (ab 27.07.).
  2. Compliance prüfen: Opus 5 ohne 30-Tage-Retention-Pflicht — Vorteil für sensible Unternehmensdaten.
  3. P/$ hart messen: CursorBench −0,5 % + 50 % Kostenersparnis — für Cursor/Claude-Code-Workflows Default-Upgrade H2 2026.
  4. K3 unabhängig verifizieren: Vor 27.07. nur Moonshot-Self-Report; kein Produktionseinsatz in compliance-kritischen Umgebungen.
  5. Lieferkettenrisiko dokumentieren: Destillation, Chip-Export, politische Beschränkungen — Provenance in Architektur-Docs festhalten.
  6. Stabile Host-Umgebung: 7×24 Agent-Gateways brauchen dedizierte Apple-Silicon-Kapazität und launchd-Persistenz — kein Shared-VPS-Overselling.

F: Wie viel günstiger ist Claude Opus 5 als Claude Fable 5?
A: Gleiche Benchmark-Stufe: Opus 5 ~50 % ($5/$25 vs. ca. $10/$50 pro 1M Input/Output); CursorBench-Peak-Differenz <1 %.

F: Ist Claude Opus 5 jetzt das Claude-Max-Standardmodell?
A: Ja, seit 24. Juli 2026 — auch stärkste Claude-Pro-Version.

F: Hat Moonshot Kimi K3 aus Claude destilliert?
A: Unbestätigt. Weißes-Haus ohne öffentliche Belege; Timeline-Kritik; Greenblatt-Statistik stärkster technischer Indizienbeweis, aber nicht konklusiv.

F: Wann Kimi K3 Vollgewichte?
A: Moonshot: 27. Juli 2026 — zum Artikelzeitpunkt noch nicht veröffentlicht.

Reine API-Nutzung birgt versteckte Kosten: Shared-Cloud-Overselling unterbricht Long-Connections, fehlende 7×24-Stabilität für Multi-Modell-A/B-Tests, Compliance erfordert dedizierte Umgebung. Für dauerhaft laufende Claude-Code- / Kimi-Code-Agents ist JEXCLOUD Multi-Region Bare-Metal Mac die robustere Option: dediziertes Apple-Silicon-Unified-Memory, kein Overselling-Jitter, launchd-persistente Gateways, 120-Sekunden-Provisioning. Details: JEXCLOUD-Preisseite.