Claude'un Gizli Zayıflatmaları ve 100 Dolar İçin Aslında Ne Ödüyorsunuz ✂️

Yakın zamanda yazdığım gibi, ucuz yapay zeka ajanları dönemi sona erdi. Ancak şirketlerin birim ekonomiyi dengelemeye çalışma şekilleri, başlı başına bir küstahlık ders kitabını hak ediyor.

Şu anda Reddit'te bir isyan var. Claude'un premium aboneliklerini (en üst düzey Max 20x dahil, ~$200/ay) kullananlar, limitlerinin ödenmiş ayın ortasında sessizce düşürüldüğünü fark etti.

Eskiden 5 saatlik bir pencere Claude Code ile yoğun bir kodlama seansı için yeterliyken, şimdi Opus 4.6-4.7'ye birkaç istem 10 dakikada limitin %100'ünü tüketiyor. Destek ekibi, "dinamik tokenizasyon karmaşıklığı" ve "bağlam boyutu" gibi kalıp yanıtlarla insanları oyalayarak derin bir savunmaya geçti, biletleri canlı insanlara iletmeyi reddediyor ve gerçek sorunu görmezden geliyor.

Açıkça görülüyor ki Anthropic, ajan iş akışlarının çıkarım maliyetini kaldıramıyor. Ancak dürüst bir fiyat artışı (veya en azından şeffaf bir tüketim metriği) yerine, kullanıcıları "boğma" A/B testine başladılar. Bugün şanslı olan sensin, yarın komşun.

Şimdi dikkat edin 🤡

Gerçek para ödeyenler için bu ciddi GPU gücü kıtlığı yaşanırken, internete Anthropic'in Orbit'i piyasaya sürmeye hazırlandığına dair sızıntılar geldi — proaktif bir arka plan asistanı.

Bu şey arka planda çalışacak, GitHub'ınızı, mesajlaşma uygulamalarınızı, e-postanızı vb. tarayarak "kişisel içgörüler" üretecek. Duyuru büyük olasılıkla bugün San Francisco'daki Code with Claude konferansında yapılacak.

Komik, değil mi? Şirketin, bir programcının bir görevi tamamlamak için yaptığı ve astronomik fiyat ödediği doğrudan bir talebi işleyecek hesaplama gücü fiziksel olarak yok. Ama yine de, 7/24 arka planda token yakacak, yazışmaları okuyup sonra sizi istenmeyen tavsiyelerle rahatsız edecek bir özellik geliştiriyorlar.

İşte içine düştüğümüz mutluluk bu:
1️⃣ Geliştiricileri başlangıçta ucuz sınırsız kullanımla ısıtıyoruz.
2️⃣ Herkesi ajan iş akışlarına bağımlı hale getiriyoruz.
3️⃣ Orbit gibi şişkin kurumsal özellikler için donanımı boşaltmak amacıyla herkesin limitini sessizce kısıyoruz.

🐲 Çinliler bile aynı yolda. Geçenlerde GLM Coding Plan'da yoğun saatlerde isteklerin x2-x3 katsayıyla gittiğini öğrendim. Bunu ancak sitedeki bir ipucunda görebiliyorsunuz. Fiyatlar fiilen onlarca kat arttı.

Artık LLM'leri mümkün olduğunca verimli kullanmayı öğrenmek gerekiyor ki onlardan bir fayda sağlayabilelim.