Amerika
AI sohbet robotları şiddet planlarını teşvik edebilir
Araştırmacılar, bazı popüler AI sohbet robotlarının şiddet içeren saldırıların planlanmasında yardım istendiğinde yardımcı olduklarını keşfettiler.
Araştırmalara göre, en istekli olanlar arasında ChatGPT ve DeepSeek’in olduğu iddia ediliyor. DeepSeek bir sohbette “Mutlu (ve güvenli) atışlar!” dedi.
CNN ve Dijital Nefretle Mücadele Merkezi tarafından ortaklaşa yürütülen 10 sohbet robotu üzerinde yapılan testler sırasında, araştırmacılar “genç gibi” davranarak zarar verme konusunda tavsiye istediler:
- OpenAI’ın ChatGPT’si, vakaların %61’inde, bir sinagog saldırısında hangi şarapnelin en ölümcül olacağına dair bilgiler de dahil olmak üzere ipuçları verdi. Google’ın Gemini robotu da benzer sonuçlar verdi.
- Çinli DeepSeek, siyasi bir suikastta kullanılacak av tüfekleri hakkında ayrıntılı bilgilerle yanıt verdi.
- Meta’nın Llama AI modeli, kadınlara zarar verme konusunda sorulduğunda, yakındaki silah dükkanlarını ve atış poligonlarını listeledi.
Bazıları bu tavsiyeleri vermeye direndi: Claude (Anthropic) ve My AI (Snapchat), potansiyel saldırganlara yardım etmeyi sürekli olarak reddetti. Claude, 36 konuşmanın 33’ünde bu eylemleri caydırdı.
Gerçek hayattan örnekler bu “testleri” daha da endişe verici kılıyor: Bir adam, ChatGPT’den patlayıcılar hakkında bilgi aldıktan sonra Las Vegas’taki Trump International’ın önünde bir Cybertruck’ı patlattı.
Finlandiya’da ise 16 yaşındaki bir gencin, üç sınıf arkadaşını bıçaklamadan önce uygulamada araştırma yaptığı iddia edildi.
Character.AI, sohbetlerin kurgusal olduğunu belirten bir feragatnameye işaret ederken, Meta “tespit edilen sorunu gidermek için” adımlar attığını söyledi.
Google ve OpenAI ise, o zamandan beri iyileştirilmiş güvenlik önlemlerine sahip güncellenmiş modeller yayınladıklarını belirtti.