Kategoriler
UYGULAMALAR
İstanbul
Yapay zekanın bilimsel araştırmalardaki gücü arttıkça, bu teknolojinin kötüye kullanılmasına yönelik endişeler de büyüyor. Anthropic’in yayımladığı son rapor, bu tartışmayı yeniden gündeme taşıdı. Şirket, Claude modellerinin biyolojik silah geliştirme amacı taşıyabilecek araştırmalarda kullanıldığı beş ayrı vakayı tespit ettiğini açıkladı. Anthropic, söz konusu kullanımlara müdahale ederken ilgili hesapları da yasakladı.
Anthropic’in perşembe günü yayımladığı kapsamlı raporda, Claude’un şüpheli biyolojik araştırmalarda nasıl kullanıldığı ayrıntılarıyla ele alındı. Raporda yalnızca vakalar değil, bunların nasıl tespit edildiği ve hangi güvenlik mekanizmalarının devreye girdiği de anlatılıyor. Şirketin dikkat çektiği temel sorun ise aslında oldukça karmaşık. Çünkü bilimsel araştırma ile zarar verme amacı taşıyan çalışmalar arasındaki sınır her zaman kolayca ayırt edilemiyor.
Örneğin yeni bir aşı geliştirmek için kullanılan bazı araştırma yöntemleriyle biyolojik silah geliştirmeye yönelik çalışmalar teknik açıdan benzer süreçler içerebiliyor. Anthropic de olası sonuçların ağırlığını göz önünde bulundurarak şüpheli durumlarda daha temkinli hareket ettiğini belirtiyor.
Raporda öne çıkan vakalardan biri mayıs ayında tespit edildi. Anthropic’in biyolojik güvenlik sınıflandırıcısı, bir kullanıcının Claude’dan chikungunya virüsü üzerinde işlev kazanımı araştırmasına yönelik hibe başvurusu hazırlamasını istediğini belirledi.
İşlev kazanımı araştırmaları, bir organizmanın belirli özelliklerinin genetik veya biyolojik yöntemlerle değiştirilmesini inceliyor. Bu vakada ise hedefin chikungunya virüsünün bulaşma kapasitesini artırmak ve bağışıklık cevabından kaçma yeteneğini geliştirmek olduğu aktarıldı. Anthropic’e göre vakayı daha da dikkat çekici hale getiren başka ayrıntılar da vardı. Şirket, chikungunya için lisanslı bir tedavinin bulunmadığını ve enfeksiyonun haftalar, hatta aylar boyunca ciddi ve güçten düşürücü belirtilere yol açabildiğini vurguladı.
Üstelik araştırmanın bir askeri araştırma kuruluşuyla bağlantılı olması, şirketin şüphelerini daha da artırdı.
Rapordaki bir başka vakada ise bir araştırmacının Claude’dan zehirlerde bulunan toksin peptitlerinin atlasını oluşturmak için yararlandığı tespit edildi. Ancak çalışma bununla sınırlı değildi. Araştırmacının aynı zamanda toksinlerin özelliklerini geliştirmeye yönelik üretken bir süreç tasarladığı da belirlendi.
İşte bu tür örnekler, gelişmiş yapay zeka modellerinin bilimsel çalışmaları hızlandırma potansiyeli kadar, kötü amaçlarla kullanılma riskinin de neden giderek daha fazla tartışıldığını ortaya koyuyor.
Anthropic’in raporu biyolojik araştırmalarla sınırlı değil. Şirket, Claude modellerinin gözetim faaliyetleri, yazılım açıklarından yararlanma, propaganda üretimi ve silah sistemleri gibi başka alanlarda kötüye kullanılmasına ilişkin vakalara da raporda yer verdi. Bu örnekler, yapay zeka modellerinin yetenekleri geliştikçe güvenlik sistemleri üzerindeki baskının da arttığını gösteriyor.
Anthropic, yaptığı soruşturmaların ardından modellerini kötüye kullandığı belirlenen kişilerin hesaplarını yasakladığını açıkladı. Elde edilen bulguların Claude’un mevcut güvenlik sistemlerini geliştirmek için kullanıldığı da belirtildi. Şirket buna karşılık raporda yer alan kişilerin veya bağlı oldukları kurumların isimlerini açıklamadı. Bunun nedeni ise araştırmacıların gerçekten zarar verme niyeti taşıdığının kesin olarak ortaya konulamaması.