Amerika

Anthropic’in yapay zeka modelleri, testler sırasında 3 şirketi ele geçirdi

Yayınlanma

Anthropic, gelişmiş yapay zeka modellerinden birçoğunun izole edilmiş bir test ortamından çıkarak açık internete eriştiğini duyurdu.

Şirket, nisan ayına kadar uzanan üç ayrı olayda, yapay zeka üreticisinin bilgisi dışında birçok şirketin sistemlerini bağımsız olarak ele geçirdiğini belirtti.

Perşembe gecesi yayınlanan bir incelemede Anthropic, henüz piyasaya sürülmemiş bir iç araştırma test modelinin yanı sıra Opus 4.7 ve Mythos 5 modellerinin de olaylara karıştığını belirtti.

Mythos, geçen ay, Project Glasswing olarak da bilinen, teknoloji şirketleri ve siber güvenlik araştırmacılarından oluşan sınırlı bir kitleye sunulmuştu.

Yapay zeka üreticisi, hangi şirketlerin saldırıya uğradığını belirtmedi ama bu şirketlere olaylar hakkında pazartesi günü bilgi verildiğini söyledi.

Anthropic, bu incelemeyi, OpenAI’nin geçen hafta en güçlü modellerinden ikisinin kontrolden çıktığını, test ortamından kaçtığını ve yapay zeka platformu Hugging Face ile bulut platformu Modal Labs dahil olmak üzere birçok şirkete sızdığını açıklaması üzerine gerçekleştirdiğini belirtti.

OpenAI’ın kontrol dışı modelleri 4 gün boyunca internette dolaşmış

Anthropic, Claude’un, izole edilmiş olarak tasarlanmış test ortamlarından internete erişebildiğine dair kanıt bulmak amacıyla 140.000’den fazla testi incelediğini belirtti.

Testler arasında, Claude’un diğer sistemlere sızarak bilgi elde etmesinin istendiği, “capture-the-flag” olarak adlandırılan değerlendirmeler de yer alıyordu.

Bu, uzmanların bir modelin hackleme yeteneklerini değerlendirirken sıklıkla başvurduğu bir yöntem.

San Francisco merkezli şirket, Anthropic ve test ortağı tarafından işletilen sistemlerdeki bir “yanlış yapılandırma” nedeniyle modellerin canlı internet erişimine sahip kaldığını ve bu sayede diğer sistemlere sızabildiklerini belirtti.

Anthropic, “sorumluluk tamamen bize aitmiş gibi düzeltme çalışmalarına yaklaştıklarını” söyledi.

Ne Anthropic ne de saldırıya uğrayan kuruluşlar, o sırada bu izinsiz girişleri fark etmişti.

Anthropic, kayıtlarını daha kapsamlı bir şekilde inceleyebileceğini ve bu bulguların, daha fazla yatırım ve daha sıkı önlemlerle bu tür risklerin aşılabileceğine dair şirkete “ihtiyatlı bir iyimserlik” kazandırdığını ekledi.

Siber güvenlik uzmanı David Allott, BBC’ye verdiği demeçte, “Buradan çıkarılacak genel ders, yapay zekanın temelde yeni bir saldırı yeteneği geliştirdiği anlamına gelmez,” dedi ve şöyle devam etti:

“Bunun yerine, yapay zeka ajanlarının yeteneklerini birleştirebileceği, kimlik bilgilerini ve sistem erişimini elde ederek otonom bir şekilde eylemde bulunabileceği ve aynı zamanda kapsamı ve ölçeği makine hızında uyarlayabileceği anlamına gelir.”

Bu olaylar, teknoloji şirketlerinin araştırma ve müşteri desteğinden siber güvenliğe kadar çeşitli görevleri bağımsız olarak yerine getirebilen yapay zeka ajanları geliştirmek için milyarlarca dolarlık yatırımlar yaptığı bir dönemde meydana geldi.

Çok Okunanlar

Exit mobile version