

GPT-5.5 vs DeepSeek V4. Während ihr schlieft, hat sich die Welt mal wieder gedreht
Gestern hat OpenAI GPT-5.5 veröffentlicht, und heute haben die Chinesen von DeepSeek mit ihrer V4 geantwortet.
Ich verstehe vollkommen, dass ihr bereits 150 identische begeisterte Übersetzungsposts in anderen Kanälen über GPT-5.5 gelesen habt, vielleicht sogar schon von DeepSeek erfahren habt. Alle haben bereits alles diskutiert, die Benchmarks geliked und vergessen.
Aber lasst uns trotzdem das Wichtigste hervorheben.
GPT-5.5
Die entscheidende Metrik ist hier nicht MMLU (wen interessiert das 2026?), sondern Expert-SWE (73,1%). Das bedeutet, dass das Modell 20 Stunden lang in deinem Legacy-Code herumwühlen, debuggen, Tests umschreiben und am Ende einen funktionierenden PR ausspucken kann, statt einer Menge Entschuldigungen. Es verbraucht weniger Tokens für dieselben Aufgaben als 5.4. OpenAI hat verstanden, dass unendliche Kontexterweiterung ohne Kontrolle in die Sackgasse führt.
„Der Verlust des Zugangs zu GPT-5.5 fühlt sich an wie die Amputation einer Gliedmaße“ – Zitat aus der Veröffentlichung.
DeepSeek V4: Chinesische Brechstange gegen US-Sanktionen 🇨🇳
Während Sam Altman über AGI schwadroniert und teure Enterprise-Abonnements verkauft, werfen die Chinesen ein Open-Source-Modell mit 1 Billion Parametern und einem Kontext von 1 Million Tokens raus.
Dank aggressivem MoE (Mixture-of-Experts) werden von dieser Billion bei der Inferenz der Pro-Version nur
~49B Parameter aktiviert, bei der Flash-Version lächerliche 13B. Sie haben keinen Zugang zu den Top-Nvidia-Chips, also setzen sie auf reine Mathematik. Die Architektur Engram Memory und Manifold-Constrained Hyper-Connections (mHC) ermöglicht es ihnen, dieses Monstrum auf lokaler Hardware wie dem Huawei Ascend 950PR zu trainieren und zu betreiben.
Das Ergebnis: Die API kostet einen Appel und ein Ei (von
$0,03 bis $0,30 pro Million Input-Tokens). Das ist dutzende Male billiger als Claude 4.7 und GPT-5.4.Modell auf HF
Warten wir auf die Veröffentlichung von Sber? 😁
Kommentare
0Noch keine Kommentare.