Google araştırmacıları tarafından geliştirilen bir sohbet botu, tabiplerden daha iyi performans gösterdi. Model, hastalarla gerçekleştirilen görüşmelerde teşhis ve empati konusunda tabipleri geçti.

Her gün bizi daha da şaşırtan yapay zekâ teknolojileri, farklı alanlarda insanların yerini doldurabilecek yetenekler kazanıyor. Tıp da bunlardan biri. Daha önce birkaç defa yapay zekânın tabiplerden daha iyi performans verdiğini görmüştük. Şu Anda bunlara bir yenisi daha eklendi.
Google, kendi geliştirdiği bir lisan modelini (LLM) temel alan bir sohbet botu hakkında çalışma yayımladı. Çalışmada, sohbet botunun tıbbi görüşmelerde hekimlerden daha iyi performans sergilediği görüldü.
Doktorlardan daha iyi hastalık teşhis etti, daha iyi empati kurdu

Articulate Medical Intelligence Explorer (AMIE) ismi verilen model, hastalarla konuşma ve hastaların tıbbi geçmişine dayanarak mümkün teşhisleri listeleme konusunda doktorlardan daha başarılı oldu. Şimdi akran değerlendirmesinden geçmeyen çalışma, 11 Ocak’ta arXiv’de ön baskı olarak yayımlandı.
Google araştırmacıları, modelin teneffüs ve kardiyovasküler hastalıkları daha iyi teşhis edebildiğini söylüyor. Ayrıyeten görüşmelerde gerçek hekimlerle miktar bilgiyi elde edebildiğini, hatta daha iyi empati kurabildiğini de ekliyor.
Ancak modelin şimdi gerçek hastalar üzerinde test edilmediğini vurgulamak gerek. Çalışmada, yalnızca hastaları canlandıran aktörler kullanıldı. Zati araştırmacılar da modeli “deneysel” olarak nitelendirdi ve şimdi bir şey söylemek için çok erken olduğunu aktardı.
20 oyuncu, çalışma kapsamında 149 farklı klinik senaryoyu simüle ettiler. Görüşmeler de yüz yüze değil, metin tabanlı olarak gerçekleştirildi. Oyuncular, görüşmeler sırasında gerçek hekimlerle mı yoksa sohbet botuyla mı konuştuklarını bilmiyorlardı. Bir grup uzman da AMIE’nin ve tabiplerin performansını değerlendirdi. Nezaket, durumu ve tedaviyi açıklama, dürüst görünme, teşhis benzeri şeylerin incelendiği çalışmalar sonucunda ise sohbet botunun 26 kriterin 24’ünde tabipleri geçtiği görüldü.
AMIE, hekimlerden daha iyi sonuçlar verse de onların yerini almayacak

Tabii ki bu sonuçlar yapay zekânın hekimlerin yerini alacağı manasına gelmiyor. Google araştırmacısı Alan Karthikesalingam da mevzuya ilişkin “Bu, hiçbir şekilde bir lisan modelinin tıbbi görüşmelerde tabiplerden daha iyi olduğu manasına gelmez.” ifadelerini kullandı. Öte yandan Harvard’da tabip olarak görev yapan Adam Rodman da aracın yararlı olabileceğini lakin hekimlerin yerine geçemeyeceğini söyledi: “Tıp, bilgi toplamaktan daha fazlasıdır. Tamamen insan bağlantılarıyla alakalıdır.”
Araştırmayla ilgili şunu da eklemek gerek. Katılan tabipler hiç bu türlü metin tabanlı görüşmeler gerçekleştirmeye alışık değillerdi. Bu da performanslarını etkileyip yapay zekânın öne geçmesine neden olmuş olabilir.
Yine de çalışma, yapay zekânın empati kurabilen ve hastanın geçmişinden yola çıkarak teşhis koyabilen bir hekimlere şekilde performans gösterme potansiyelinin olduğunun göstergesi. Bu araştırmanın sonraki adımı da potansiyel ön yargıları pahalandırmak ve sistemin farklı popülasyonlarda sonuçlar vermesini sağlamak için daha detaylı çalışmalar yapmak.
Daha önce de tıp alanında benzeyenyapay zekâ gelişmeleri görmüştük. Bunlardan kimilerine aşağıdaki içeriklerimizden göz atabilirsiniz: