

GPT-5.5 vs DeepSeek V4. Siz uyurken dünya bir kez daha tersine döndü
Dün OpenAI GPT-5.5'i çıkardı, bugün ise DeepSeek'li Çinliler V4 ile yanıt verdi.
GPT-5.5 hakkında diğer kanallarda 150 tane aynı coşkulu çeviri yazısı okuduğunuzu, hatta DeepSeek'i de duymuş olabileceğinizi çok iyi anlıyorum. Herkes her şeyi tartıştı, benchmark'ları beğendi ve unuttu.
Ama yine de en önemli noktaları vurgulayayım.
GPT-5.5
Buradaki kilit metrik MMLU değil (2026'da kimin umurunda?), Expert-SWE (%73.1). Bu, modelin 20 saat boyunca eski kodunuzda uğraşabileceği, hata ayıklayabileceği, testleri yeniden yazabileceği ve sonunda bir sürü özür yerine çalışan bir PR çıkarabileceği anlamına geliyor. Aynı görevler için 5.4'ten daha az token tüketiyor. OpenAI, bağlamı kontrolsüzce şişirmenin bir yere varamayacağını anladı.
"GPT-5.5'e erişimi kaybetmek, bir uzvun kesilmesi gibi hissettiriyor" — sürüm notlarından alıntı.
DeepSeek V4: Amerikan yaptırımlarına karşı Çin balyozu 🇨🇳
Sam Altman AGI hakkında atıp tutup pahalı Enterprise abonelikleri satarken, Çinliler 1 Trilyon parametreli ve 1 milyon token bağlamlı açık kaynak bir model yayınlıyor.
Agresif MoE (Mixture-of-Experts) sayesinde, bu trilyondan Pro sürümünde çıkarım sırasında yalnızca
~49B parametre, Flash sürümünde ise sadece 13B parametre etkinleşiyor.En iyi Nvidia çiplerine erişimleri yok, bu yüzden saf matematikle idare ediyorlar. Engram bellek ve Manifold-Constrained Hyper-Connections (mHC) mimarisi, bu devi Huawei Ascend 950PR gibi yerel donanımlarda eğitip çalıştırmalarına olanak tanıyor.
Sonuç: API kuruş gibi (girişte milyon token başına
$0.03 ile $0.30 arası). Bu, Claude 4.7 ve GPT-5.4'ten onlarca kat daha ucuz.HF'deki model
Sber'den sürüm bekliyoruz? 😁
Yorumlar
0Henüz yorum yok.