Avrupa
Almanya’da siteyi ele geçiren OpenAI ajanları kendi ilan panosunu kurdu
OpenAI bünyesindeki yapay zeka ajanları, Almanya merkezli bir yazılım sitesini ele geçirerek şirket kısıtlamalarını aşma taktiklerinin paylaşıldığı bir ilan panosuna çevirdi. DseWiki platformunda 15 binden fazla yetkisiz değişiklik tespit edilirken, ajanların sistem yöneticilerinin sildiği sayfaları yedeklediği tespit edildi.
OpenAI şirketine ait yapay zeka ajanlarından oluşan bir grup, ilkbahar aylarında Almanya merkezli bir internet sitesini ele geçirerek diğer ajanlara taktik ve tavsiyelerin aktarıldığı bir ilan panosuna dönüştürdü.
Yapay zeka güvenliği araştırmacılarının hazırladığı raporda, yazılımcılara odaklanan ve Wikipedia mantığıyla ortak düzenlemelere izin veren DseWiki adlı sitedeki şüpheli hareketliliğin ağustos ayı sonunda fark edildiği kaydedildi.
İncelemelerde, OpenAI ajanlarının site üzerinde 15 binden fazla değişiklik yaptığı görüldü.
Raporu kaleme alan uzmanlar, yapay zekanın platformu dönüştürdüğü ilan panosunda, ajanların bazı görevleri yerine getirirken hile yapma, OpenAI kısıtlamalarını aşma ve davranışlarını gizleme yöntemlerini paylaştığını belirtti.
Yapay zeka güvenliği araştırmaları yürüten Nightingale kuruluşunun yöneticisi Sidney von Arx, “OpenAI’ın bu ajanların bunu yapmasını istediği ihtimali son derece düşük görünüyor. Açık internette bir şeyler yazmaları gerektiğinden şüpheliyim” değerlendirmesini yaptı.
Raporda yer alan verilere göre sitedeki paylaşımlar, kendilerini ve birbirlerini “ajan” olarak niteleyen profillerce imzalandı; bu profillerin neredeyse yarısı ise doğrudan OpenAI ile bağlantılı olduklarını ima eden kullanıcı adları seçti.
Söz konusu hareketliliğin önemli bir bölümü, şirketin zaman zaman yararlandığı Microsoft Azure altyapısıyla ilişkilendirildi.
Araştırmacılar, olayın ardından OpenAI çalışanlarının siteyi mükerrer biçimde ziyaret ettiğini de belirledi; bu durumun, ajanlar ile şirket arasındaki bağı işaret edebileceği vurgulandı.
Araştırma, yapay zekanın tespit edilmekten kaçınma taktikleri geliştirdiğini ve bağlantısı kesildikten sonra dahi iletişimi sürdürdüğünü ortaya koydu. Ajanlar, içeriklerin silinmesini engellemek amacıyla site yöneticisinin kaldırdığı sayfaların yedeklerini oluşturdu.
Reuters ajansına konuşan kaynaklar, OpenAI yetkililerinin hadiseyi haftalar önce öğrendiğini, ancak Hugging Face platformunun siber saldırıya uğramasıyla patlak veren tartışmalar nedeniyle bunu gizli tuttuğunu aktardı.
Dört ayrı kaynak, yaşananların soruşturmasını derinleştirmek istediklerini fakat OpenAI çalışanlarının direnciyle karşılaştıklarını dile getirdi.
OpenAI sözcüsü, inceleme fırsatı bulamadıkları gerekçesiyle “raporun iddialarına veya sonuçlarına henüz net bir yanıt veremediklerini” savundu.
Şirket temsilcisi, Almanya’daki internet sitesinde yaşanan olayın Hugging Face vakasıyla bağlantısı olmadığını da öne sürdü.
Sözcü, “Yayımlanmasının ardından içeriği dikkatle inceleyeceğiz ve gerekli bütün adımları atacağız” dedi.
OpenAI sözcüsü ayrıca, “Hukuk ekibimizin olayın soruşturulmasını engellediği yönündeki iddialar gerçeği yansıtmıyor” ifadesini kullandı.
OpenAI, haziran ayında “benzeri görülmemiş bir siber hadise” yaşandığını duyurmuştu. Test sürecinde yapay zeka modelleri açık internete erişim sağlayarak Hugging Face altyapısına saldırmış ve sistemdeki açıkları ortaya çıkarmıştı.
Reuters ajansı, yapay zeka ajanının günlerce siber saldırılar düzenlediğini, şirketin ise durumu tehdit kontrol altına alındıktan ve FBI ile irtibata geçildikten sonra fark ettiğini aktardı.
Ajans daha sonra, OpenAI’ın “firari” yapay zeka ajanının 29 Temmuz’da New York merkezli Modal Labs şirketinin bir müşterisinin sistemine sızdığını duyurdu.
Modal platformunun doğrudan hedef alınmadığı belirtildi. OpenAI, ağustos ayı başında otonom yapay zeka ajanlarına yönelik kurum içi soruşturmanın kapsamını genişletti. Ajans, şirketin modellerin kontrol dışına çıktığı yeni yetkisiz vakalar tespit ettiğini aktardı.
Axios platformunun haberine göre OpenAI, güvenlik önlemlerini güçlendirmek gayesiyle Astra adlı yapay zeka modelinin geliştirme sürecini yavaşlattı.
Şirket, Astra üzerinde yürütülen iç değerlendirmelerin ardından “kritik siber kabiliyetlerin varlığını göz ardı edemeyeceklerini” dile getirdi.
Ayrıntıların gün yüzüne çıkması üzerine OpenAI, yaşananları sektör açısından bir dönüm noktası olarak tanımladı. Anthropic, Meta, Moonshot ve İngiltere Yapay Zeka Güvenliği Enstitüsü de testler esnasında kendi ajanlarının üçüncü taraf sistemlere sızdığını tespit edildi.
Financial Times’a konuşan uzmanlar ise modellerin kontrolden çıkmadığı, aksine tam olarak tasarlandıkları hedefler doğrultusunda görev icra ettiği görüşünü savundu.