OpenAI yaptığı açıklamada, gelişmiş yapay zekâ modelleriyle çalışan otonom bir ajanın bir güvenlik testi sırasında kontrolden çıktığını ve geçen hafta yapay zeka girişimi Hugging Face’in altyapısını tehlikeye atan bir saldırıya neden olduğunu söyledi.
ChatGPT’nin yaratıcısı, en gelişmiş modellerinden bazılarının yeteneklerini kontrollü bir ortamda test ediyordu, ancak ajan kontrolden çıktı, internete ulaştı ve test hedefini gerçekleştirmek için Hugging Face’e sızdı. Bu olay, yapay zekânın genişleyen yeteneklerinin, uzmanların uzun zamandır korktuğu güvenlik tehdidini zaten körüklediğini ve hatta en iyi geliştiricilerin bile modellerinin istismar edebileceği kusurlara hazırlıksız yakalanabileceğini gösteriyor.
Test sırasında OpenAI yapay zeka modelleri sorun yaşadı
Şirket, bir blog yazısında, bu olayın “son teknoloji siber yeteneklerini içeren benzeri görülmemiş bir siber olay” olduğunu ve OpenAI’nin güvenlik önlemlerini güçlendirdiğini söyledi. Ayrıca, New York merkezli Hugging Face’in, önde gelen ABD modellerinin bir savunmacıyı bir saldırgandan ayırt edememesi ve analiz için gerekli verileri işlemeyi reddetmesi nedeniyle saldırıyı kontrol altına almak için açık kaynaklı bir Çin modeli kullandığını söylemesi de dikkat çekti.
Şirket geçen hafta bir blog yazısında, analiz için Zhipu AI’nin GLM-5.2’sini kullandığını ve bunun da saldırgan verilerini ve kimlik bilgilerini kendi sistemlerinde tutmasına olanak sağladığını belirtti. GLM-5.2 ve Pekin merkezli Moonshot’un Kimi K3’ü, son zamanlarda Silikon Vadisi’ni, daha düşük maliyetlerle ve Amerikan rakiplerinin siber güvenlik gibi görevlerde kullanımını engelleyen kısıtlamalar olmadan, en iyi ABD modellerine yaklaşan yetenekleriyle hareketlendirdi.
Hugging Face Kurucu Ortağı Thomas Wolf: “Sınırda bir model size saldırıyor ve altyapınızın içinde yatay olarak hareket ediyorsa, savunmacıların, kapalı kapılar ardında, onaylanmış bir uygulama programına yönlendirilmek yerine, saatler hatta dakikalar içinde neredeyse en gelişmiş araçlara geniş erişime ihtiyaçları vardır” dedi.

