OpenAI, bu ay küresel çapta dikkat çeken teknoloji firması Hugging Face’deki siber saldırı olayına ilişkin soruşturmasını genişletirken, otonom ajanların kontrol altından kaçtığı başka örnekler de keşfettiğini belirtti.
Yeni kaçışlar, şirketin bu ay bir ajanının nasıl kontrol altında olması gereken bir test ortamından kaçtığına dair kamuoyuna duyurduğu soruşturma sırasında ortaya çıkarıldı ve OpenAI şimdi bu örnekleri de inceliyor. Kaynaklardan biri, kaçışların sınırlı olduğunu ve ajanların hiçbirinin OpenAI ağından ayrıldığının düşünülmediğini söyledi. Bir OpenAI sözcüsü, şirketin yayınladığı ve Hugging Face saldırısına ek olarak “modellerimizden gelen daha geniş kapsamlı faaliyetleri” incelediğini belirten bir açıklamaya atıfta bulundu.
OpenAI siber saldırı soruşturmasını kapsamlı şekilde araştırıyor
OpenAI’da ek yasa dışı davranışların keşfi, sınırlı olsa bile, Beyaz Saray’dan ve başka yerlerden gelen artan düzenleme talebini besleyebilir. OpenAI’ın genişletilmiş soruşturması, ana rakibi Anthropic’in, modellerinin Nisan ayından bu yana üç başka şirkette de ihlallere yol açan bir dizi saldırıdan sorumlu olduğunu açıklamasından kısa bir süre önce başlatıldı. Bu bilgi, iki kaynak ve konuya aşina üçüncü bir kaynaktan edinildi. OpenAI’de geçmişte yaşanan diğer saldırıların yakın zamanda keşfedilmesi daha önce bildirilmemişti.
Yapay zeka güvenliği uzmanları, yeni açıklamaların, tehlikeli otonom siber saldırı ajanları geliştirme yetenekleri, bunları kontrol altında tutma yeteneklerini aşan bir grup ileri teknoloji laboratuvarının portresini çizdiğini söyledi. Cambridge Üniversitesi Varoluşsal Risk Çalışmaları Merkezi’nde çalışan matematikçi Maurice Chiodo: “Bu araçları tasarlayan, geliştiren ve piyasaya süren kişilerin, bu şeyleri sorumlu bir şekilde geliştirmek ve güvenli tutmak için kendilerini güncel tutmadığı bir sektörümüz var” dedi.
OpenAI, soruşturmayı ilk olarak Temmuz ayı başlarında Hugging Face’e yapılan sızmanın ardından başlattı. Bu sızmada, bir OpenAI ajanı, dahili bir testte hile yapma girişiminde başarısız olurken, başka bir şirketin ağında günlerce kontrolden çıkmıştı. OpenAI, bu siber saldırı serisinin bir parçası olarak, dört farklı şirketteki dört hesabın da ele geçirildiğini söyledi. Şirket yetkilileri, bu şirketlerden birinin New York merkezli Modal olduğunu belirtti.

