Kişisel blog yazarı Antoine, omzundaki sakatlığın ardından hastanede çektirdiği MR (Manyetik Rezonans Görüntüleme - MRI) taraması sonuçlarını, Anthropic'in yazılım geliştirme ajanı Claude Code üzerinden Opus 4.8 modeline analiz ettirerek ikinci bir tıbbi görüş almayı denedi. Yapay zekanın bulguları ile uzman doktorun teşhisi arasındaki radikal farklar, yapay zekanın gelecekte sağlık sektörünü nasıl dönüştürebileceğine dair çarpıcı bir örnek sunuyor.
Doktorun Teşhisi ve Güven Sarsıcı Tedavi Yöntemleri
Antoine, yaklaşık 2-3 haftadır sağ omzunda hissettiği ağrı nedeniyle bir ortopediste başvurdu. Doktorun yönlendirmesiyle çekilen MR sonucunda hastaneden şu teşhis çıktı: Subscapularis tendonunun apikal insersiyosunda Grade III (>%50 genişlikte) parsiyel (kısmi) yırtık.
Klinik derhal yoğun bir tedavi programına başladı ve ilk seansta hastaya şok dalga terapisi (shockwave therapy) uygulayıp omuz bölgesine Traumeel enjeksiyonu yaptı. Ancak Antoine, hastaneden çıktıktan sonra durumdan şüphelenerek tedavi detaylarını GPT 5.5 Pro modeline danıştı. GPT 5.5 Pro'nun analizleri klinikte yapılan işlemlerle ilgili iki büyük çelişkiyi ortaya koydu:
- Güncel klinik uygulama kılavuzları, kireçlenme (calcification) olmayan rotator manşet tendinopatilerinde şok dalga terapisinin kullanılmamasını önermektedir. Ultrason taramasında hastanın omzunda kireçlenme olmadığı net bir şekilde belirtilmiştir.
- Enjekte edilen Traumeel maddesi, Almanya'da tıbbi terapötik endikasyonu olmayan (homeopatik) bir ilaç olarak kayıtlıdır.
Doktorun tedavi yöntemlerindeki bu bilim dışı yaklaşımlar, hastanın kliniğe olan güvenini tamamen sarstı ve onu ham MR verilerini bizzat incelemeye yöneltti.
Claude Code ve Opus 4.8 ile MR Analizi
Antoine, klinikten teslim aldığı yaklaşık 266 MB boyutundaki, yüzlerce uzantısız dosyadan oluşan standart DICOM (Tıpta Dijital Görüntüleme ve İletişim) paketini analiz etmek üzere bilgisayarının başına geçti. Kod çalıştırma ve harici kütüphane yükleme yeteneklerine sahip olan Claude Code arayüzü üzerinden Opus 4.8 (xhigh) modelini devreye soktu.
Gerekli Python paketlerini kuran Opus 4.8, MR görüntülerini işleyip detaylı bir tıbbi rapor hazırladı. Ancak yapay zekanın sunduğu ilk rapor şok ediciydi: Uzman radyoloğun Grade III yırtık gördüğü tendonda, Opus 4.8 tendonun tamamen sağlam (intact) olduğunu rapor etti!
Çelişkili Sonuçlar ve Yapay Zeka Hakem Analizi
İki rapor arasındaki bu uçurumu çözmek isteyen Antoine, Claude bünyesinde bağımsız alt ajanlar (subagents) kurarak tarafsız bir Hakem Analizi (Arbitration Analysis) başlattı. Bu kez yapay zekaya sadece raporları değil, ChatGPT ile yaptığı ve omzundaki hareket kısıtlılıklarını, güç testlerini içeren klinik semptom verilerini de sağladı.
Yaklaşık bir saatlik ek çalışmanın ardından yapay zeka hakeminin nihai kararı şu oldu:
Hakemin Kararı: Kanıtlar kesin olarak Opus'un ilk analizini (Reader A) destekliyor (orta-yüksek güven oranı). Tendonda hafif derecede insersiyonel tendinosis (yıpranma/dejenerasyon) gözlenmiş olup, apikal insersiyo da dahil olmak üzere herhangi bir belirgin parsiyel veya tam yırtık tespit edilmemiştir.
Yapay Zekaya Sağlıkta Ne Kadar Güvenebiliriz?
İnsan uzmanların teşhisleriyle yapay zekanın bulgularının bu derece farklı çıkması, hastayı ciddi bir kararsızlık (limbo) içinde bıraktı. Tıbbi kararların hayati önem taşıdığı bu senaryoda yapay zekaya da tamamen güvenmek henüz mümkün değil. Yazar yazısını şu temenni ile bitiriyor:
"Umarım birkaç model jenerasyonu sonra, yapay zekanın MR sonuçlarımızı incelemesine de bugün e-postalarımızın yazım hatalarını düzeltmesine güvendiğimiz kadar güvenebiliriz."
Kaynak: Hacker News (Öne Çıkanlar)
Bu habere henüz yorum yapılmadı.