⚡️ Yapay Zeka Modeli Qwen 3.5-Omni, Video Kılavuzlarından Kod Yazıyor

Alibaba, Qwen 3.5-Omni'yi yayınladı - çok modlu LLM'nin yeni bir sürümü. Sinir ağı, metin, grafik, ses ve video verilerini aynı anda işleyebiliyor.

Qwen 3.5-Omni'nin en önemli farkı, 256 bin tokenlik bağlam penceresidir. Bu sayede yapay zeka, 10 saatten fazla sesi veya 720p çözünürlükte yaklaşık 400 saniyelik videoyu tek seferde işleyebiliyor. Konuşma tanıma, 113 dil ve lehçeyi kapsıyor.
Model, 100 milyon saatten fazla ses ve video verisi üzerinde eğitildi.

Model, sesli talimatlar içeren ekran kaydını "izliyor" ve bu verilere dayanarak metin ipuçları olmadan çalışan kod yazıyor.

⁉️ Bu yetenek, eğitim olmadan tesadüfen ortaya çıktı)

Buradan alabilirsiniz.