
Açık kaynak model, 13 saat boyunca otonom olarak eski kodu yeniden düzenliyor 🤌
Moonshot AI, Kimi K2.6'yı açık kaynak olarak yayınladı.
Bu sürümde ilginç olan şeyler:
1️⃣ Uzun Süreli Yürütme (Long-Horizon Execution)
Blog yazısında örnek bir vaka anlatıldı. İlki: model, Mac'te yerel Qwen'in çıkarımını optimize etmeye zorlandı. K2.6, 12 saatte 4000'den fazla araç çağrısı yaptı ve backend'i Zig'e (Zig, Karl!) yeniden yazarak verimi LM Studio'dan %20 daha yükseğe çıkardı.
İkincisi: 8 yıllık bir finans motoru olan
exchange-core'un yeniden düzenlenmesi. Model, 13 saat boyunca otonom olarak CPU alev grafiklerini ve bellek tahsislerini analiz etti, 1000'den fazla araç çağrısı yaptı, 4000 satır kod yeniden yazdı ve iş parçacığı topolojisini değiştirdi. Sonuç: verim %185 arttı. 2️⃣ Steroidli Ajan Sürüleri (Agent Swarms)
Mimari artık yatay olarak 300 alt ajana kadar ölçeklenebiliyor ve bunlar paralel olarak 4000 adıma kadar yürütebiliyor. Görevi kendileri parçalıyorlar.
3️⃣ Proaktif Ajanlar (Proactive Agents)
Moonshot'ın iç RL altyapı ekibi, K2.6 tabanlı bir ajana 5 gün boyunca otonom olarak izlemeyi yönetme, olaylara yanıt verme ve sistemi düzeltme görevi verdi. Deri torbaların katılımı olmadan. DevOps mühendisleri, nasılsınız?
🛠 Model, SWE-Bench Pro ve HLE'de (Humanity's Last Exam) GPT-5.4'ü (xhigh modunda) ve Claude Opus 4.6'yı (max effort) yeniyor.
Bağlam penceresi 262k token.
Yerel INT4 niceleme var, vLLM, SGLang veya KTransformers ile çalıştırılabiliyor.
Ağırlıklar HF'de mevcut: huggingface.co/moonshotai/Kimi-K2.6
Yorumlar
0Henüz yorum yok.