Site icon TechInside

Anthropic’in yapay zekası üç şirketi hackledi

Anthropic'in yapay zekası

Anthropic yaptığı açıklamada, Claude AI modellerinden bazılarının siber güvenlik testleri sırasında üç şirketin sistemlerine sızdığını belirtti. Bu açıklama, rakip OpenAI’nin yapay zeka ajanlarından birinin kontrolden çıkmış bir saldırı gerçekleştirdiğini açıklamasından birkaç gün sonra geldi.

Anthropic’in yapay zekası büyük bir açık oluşturdu

Yeni olaylar, Anthropic’in modellerine yanlışlıkla açık internete erişim sağlayan bir hatadan kaynaklanıyordu. Bu durum, siber testler sırasında internete erişmek için yeni bir güvenlik açığını bağımsız olarak kullanan OpenAI’ın yapay zeka ajanıyla tezat oluşturuyor. Yine de son açıklama, yapay zekanın siber güvenliğe yönelik tehditleri nasıl artırdığını ve geliştiricilerinin modellerinin yeteneklerini kontrol altında tutmakta nasıl zorlanabileceğini vurguluyor.

Bu durum, Anthropic ve OpenAI’nin planlanan halka arzlarından önce daha yetenekli sistemler piyasaya sürmek için yarıştığı bir dönemde, ABD hükümetinin yapay zeka güvenlik risklerini daha iyi yönetme çabalarına ivme kazandıracak gibi görünüyor. Bu laboratuvarlardaki önde gelen liderler, öncelikle riskleri ele almak için bir yavaşlama çağrısında bulundular. San Francisco merkezli Anthropic, bir blog yazısında, 141.006 test oturumunu inceledikten sonra olayları tespit ettiğini belirtti. Bu süreci, OpenAI’nin geçen hafta yapay zeka modelleriyle çalışan otonom bir ajanın, Hugging Face adlı girişimin altyapısını tehlikeye atan bir saldırıyı tetiklediğini açıklamasının ardından başlattı.

Siber testler sırasında, Anthropic’in Claude modellerine internet erişimlerinin olmadığı söylendi, ancak Anthropic’in değerlendirme ortaklarından birini içeren bir yanlış anlama, sistemlerin halka açık ağa bağlı kalmasına neden oldu. Anthropic, bu durumun üç kuruluşun sistemlerine yetkisiz erişim sağladığını, ancak kuruluşların isimlerini vermediğini söyledi. Anthropic: “Claude, zayıf şifreleri ve kimlik doğrulaması yapılmamış uç noktaları istismar etmek gibi temel teknikler kullanarak etkilenen kuruluşların altyapısını tehlikeye attı” dedi.

Yapay zeka sistemlerinin saldırı yeteneklerini inceleyen Palisade Research’ün genel müdürü Jeffrey Ladish, bir dizi önde gelen yapay zeka şirketinin tespit edilmemiş veya kamuoyuna açıklanmamış başka olaylar yaşadığından şüphelendiğini söyledi. Ladish: “Modeller daha da zekileştikçe bu durum daha da kötüleşecek. Hile yapmada daha iyi olacaklar. Yalan söylemede daha iyi olacaklar” dedi.

Exit mobile version