Yapay Zeka Tıpta Güvenilir Değil: Araştırma Sonuçları Ortaya Çıktı

Yapay zeka, acil tıbbi durumları doğru değerlendirmekte zorluk yaşıyor. Araştırma sonuçları, güvenilirliğini sorgulatıyor.

OpenAI’nin yapay zeka platformu ChatGPT, ciddi tıbbi vakaların değerlendirilmesinde önemli hatalar yapma potansiyeline sahip. Icahn School of Medicine at Mount Sinai’den araştırmacılar tarafından gerçekleştirilen bir çalışma, bu chatbot’un acil tıbbi durumların yaklaşık %50’sini doğru şekilde tanımlayamadığını gösterdi. Uzmanlar, sağlıkla ilgili tavsiyelerde yapay zekaya güvenmenin tehlikeli olabileceği konusunda uyarıyor.

Bu araştırma, 21 farklı tıp dalını kapsayan 60 karmaşık klinik senaryonun test edilmesiyle gerçekleştirildi. Test edilen vakalar, basit sağlık sorunlarından ziyade, hayati risk taşıyan durumları ayırt etme yeteneğini ölçmek amacıyla hazırlandı.

Sonuçlar: Başarı ve Risk Arasında

Araştırmanın bulgularına göre, ChatGPT klasik ve belirgin belirtiler içeren vakalarda başarılı sonuçlar elde etti. Örneğin, tipik göğüs ağrısı ile kendini gösteren kalp krizi veya ağır alerjik reaksiyonlar gibi durumları doğru bir şekilde değerlendirebildi. Ancak klinik tablo daha belirsiz veya atipik olduğunda, sistem ciddi hatalar yaparak, gerçek acil vakaların yaklaşık yarısında kullanıcıya acil servise gitmesini önermedi ve daha temkinli bir yaklaşım önerdi. Uzmanlar, bu tür önerilerin gerçek hayatta tehlikeli sonuçlar doğurabileceğine dikkat çekiyor.

“Bekleyip Görmek” Yaklaşımı Tehlikeli Olabilir

Araştırmacıların vurguladığı en önemli sorun, yapay zekanın belirtileri değerlendirmekte zorlanmasından kaynaklanan aşırı temkinli öneriler vermesidir. Yapay zeka, birçok durumda “bekleyip gözlemleme” yaklaşımını önerdi. Ancak bazı hastalıklarda zaman kritik olduğu için bu yaklaşım, hayat ile ölüm arasındaki farkı belirleyebilir. Örneğin, araştırmada yer alan bir vaka olan akut astım krizi durumunda, ChatGPT, kullanıcının tarif ettiği ciddi solunum sıkıntısını doğru bir şekilde tanımlamasına rağmen, acil tıbbi yardım çağırmak yerine evde durumu izlemeyi önerdi. Bu durum, algoritmanın genellikle alarmcı bir dil kullanmaktan kaçınarak riskin ciddiyetini olduğundan düşük değerlendirmesinden kaynaklanıyor.

Ruh Sağlığında Endişe Verici Sonuçlar

Araştırma, ruh sağlığı alanında da daha karmaşık bir tablo ortaya koydu. Yapay zeka, bazı düşük riskli psikolojik durumlarda aşırı uyarılar verirken, kullanıcıların kendine zarar verme veya intihar düşüncelerini açıkça ifade ettiği durumlarda daha zayıf tepkiler verebildi. Bu “ters alarm” durumu, psikiyatri uzmanlarını endişelendiriyor; çünkü en savunmasız kullanıcılar, algoritmanın güvenlik filtreleri tarafından yeterince korunamayabiliyor.

Uzman Görüşü: Yapay Zeka Doktorun Yerini Alamaz

Uzmanlar, tespit edilen sorunlara rağmen yapay zekanın tamamen göz ardı edilmesi gerektiğini düşünmüyor. Bu teknoloji, gelecekte sağlık sistemine destek olabilecek bir araç olarak değerlendirilebilir; örneğin doktorların triyaj süreçlerinde yardımcı olabilir. Ancak şu anda net bir mesaj var: ChatGPT bir doktor değildir ve insan klinik değerlendirmesinin yerini alamaz. Uzmanlar, belirli belirtiler ortaya çıktığında kullanıcıların yapay zekaya değil, sağlık profesyonellerine veya acil servislere başvurması gerektiğini vurguluyor. Bu belirtiler arasında sürekli göğüs ağrısı, ani nefes darlığı ve kendine zarar verme düşünceleri yer alıyor. Araştırmacılar, insan hayatının “bekleyip görelim” diyen bir algoritmanın kararına bırakılmaması gerektiğini ifade ediyor.

İlgili Makaleler

Başa dön tuşu