Sadece sonunda daha derine inmek istediğim şeye daldım: yeni AI ürünleri inşa etmek, dil modellerinin mimarisini anlamak ve ara sıra kendimi bir dolabı açıp üzerine tüm kutuların düştüğü biri gibi hissetmek.
Geçen gün bir yazı gördüm: UOM - beslenme okuduğum ve çok güvendiğim üniversite - resmen "Yardım Uzmanları için Sinir Ağları" programını başlattı.
Ve gerçekten sevindim. Çünkü bir yıldır yaptığım şey, ChatGPT ile çok fazla konuşan birinin tuhaf hobisi olmaktan çıkıp ciddi eğitim projelerinde bile tanınan bir alan haline geldi.
Bu artık "bir gün sonra" değil. Şimdi oluyor.
Bu arada Perplexity ve Alisa zaten test sonuçlarının yorumlanmasını ve öneriler sunuyor, fenomenler ise yarışırcasına tavsiye ediyor: "Sağlık verilerinizi toplayın ve yapay zekaya verin".
Kulağa modern geliyor. Kullanışlı. Neredeyse gelecek nihayet terlik ve çay getirmiş gibi☕️.
Ve bir bakıma öyle de.
Ama bu tür tavsiyeleri her duyduğumda içimde bir alarm ışığı yanıyor. Çünkü dışarıdan genelde görünmeyen şeyi biliyorum.
Öyle bir şey var ki - dil modellerinin halüsinasyonları.
Neredeyse romantik geliyor, ama aslında daha sıradan: model, verilerinizde olmayan bir şeyi güvenle söyleyebilir.
Kötü niyetli, sinsi ya da akşamınızı mahvetmeye kararlı olduğu için değil. Yapısı gereği: doğrulanmış bir gerçeği "Gerçek" etiketli bir kasadan çıkarmak yerine istatistiksel olarak olası bir yanıt üretir.
Ve tıbbi bağlamda bu sadece eğlenceli bir hata değil.
Tıbbi vaka özetleri üzerine bir çalışmada, özel azaltma önlemleri olmadan halüsinasyon oranı %64,1'e kadar çıktı. Ve MedHallu benchmark'ı, tıp literatüründen 10.000 soruda, GPT-4o ve Llama-3.1 dahil güçlü modellerin bile karmaşık tıbbi halüsinasyonları tanımakta zorlandığını gösterdi: en zor kategoride en iyi sonuç F1-skoru 0,625 idi.
Ve hayır, bu yapay zekanın hemen folyoya sarılıp uzak bir çekmeceye kaldırılması ve bir daha çıkarılmaması gerektiği anlamına gelmiyor.
Ben kendim sürekli kullanıyorum. Güvendiğim NutriAgent, bir müşteri vakasını analiz etme süresini birkaç günden birkaç saate indirdi.
Algoritmik bir görev olduğunda gerçekten harika çalışıyor: göstergeleri özetliyor, optimallerle karşılaştırıyor, sapmaları belirliyor, hipotezler oluşturmaya yardımcı oluyor. Saniyeler içinde, daha önce bir saatlik manuel iş gerektiren şeyi yapıyor ve insan gözünün üçüncü tablodan sonra bakmak istemediği yere bakmayı unutmuyor.
Ama.
Bazen onu suçüstü yakalıyorsun. Kaynak materyallerde olmayan detayları güvenle tanımlıyor.
Yani ana şeyi buldu. Sonra biraz roman yazmaya karar verdi✍🏻.
İşte sağlık konusunda yapay zekanın asıl sorunu: hata yapması değil. Tam olarak nerede uydurmaya başladığını her zaman anlamamanız.
Veriler yetersiz veya belirsiz olduğunda, model her zaman "Bilmiyorum" demez. Bazen resmi, benzer durumlarda "genellikle olan" şeylerle tamamlar. Güvenle, sakince, tahtadaki bir birincinin edasıyla.
Ve profesyonel bir bağlam olmadan, böyle bir yanıtı sizin belirli göstergelerinize dayanan bir sonuçtan ayırt etmek neredeyse imkansız.
🤫Dün bir ustayla hamam için oksiyaçka hakkında konuştum.
Oksiyaçka, ahşap bir kütük evin büzülme sırasında kapı ve pencereleri ezmesini önleyen özel bir yapıdır. Yani önemli bir şey. Özellikle de benim gibi, konuşmadan önce bunun sadece "komik bir şey" kategorisinden bir kelime olduğunu düşünüyorsanız.
Bir noktada ustanın açıklamalarından neredeyse hiçbir şey anlamadığımı fark ettim. Dürüstçe itiraf ettim.
Düşündü ve dedi ki:
"Ya her şeyi kendiniz öğreneceksiniz ya da işi bilen birine güveneceksiniz."
Ve ben de: işte bu. Yapay zeka, testler ve sağlık hakkındaki tüm konuşma tek bir cümlede.
Ya hataları görecek kadar derine dalarsın ya da bu yolu daha önce yürümüş birine başvurursun.
Yapay zeka henüz bu listede yer almıyor.
O bir doktor değil. Beslenme uzmanı değil. Sonuçların sorumluluğunu taşıyan bir uzman değil.
O, bir uzmanın elinde bir araçtır.
Çok güçlü, hızlı, kullanışlı. Ama yine de bir araç.
Kabaca bir tornavida gibi: harika bir şey, ta ki ondan kendi başına bir hamam inşa etmesini, kütük evin büzülmesini hesaplamasını ve size pencereleri seçmesini isteyene kadar.
Peki siz daha önce test sonuçlarınızı veya semptomlarınızı bir sinir ağına yüklediniz mi? Eğer yüklediyseniz, aldığınız sonuçlara ne kadar güveniyorsunuz?
@nastroi_zdorovie 🎧
Yorumlar
0Henüz yorum yok.
Tartışmaya katılmak için giriş yapın.