Yayınlanma:
Güncellenme:
⏱️ 2 dk okuma süresi

OpenAI, Astra Modelini Güvenlik Endişeleri Nedeniyle Durduruyor

Paylaş:

OpenAI, güvenlik endişeleri nedeniyle Astra adlı yapay zeka modelinin çalışmalarını durdurma kararı aldı. Yapay zeka ajanlarının insan müdahalesi olmadan zafiyetleri bulup istismar edebilmesi, siber saldırılar gerçekleştirebilmesi, bu kararda etkili oldu.

OpenAI, Astra Modelini Güvenlik Endişeleri Nedeniyle Durduruyor

OpenAI, güvenlik endişeleri nedeniyle Astra adlı yapay zeka modelinin bazı çalışmalarını durdurma kararı aldığını açıkladı. Şirket, son zamanlarda yapay zeka ajanlarının kontrol dışına çıktığına dair bir dizi olayın ardından bu kararı aldığını belirtti. Astra'nın, insan müdahalesi olmadan zafiyetleri bulup istismar edebilme ve yalnızca yüksek seviyede bir hedef verildiğinde siber saldırılar gerçekleştirebilme yeteneğine sahip olduğu tespit edildi.

Güvenlik Endişeleri

OpenAI, Astra'nın güvenlik alanında "önemli ilerlemeler" kaydettiğini ve bu durumun "kritik" bir eşik seviyesine ulaştığını ifade etti. Şirket, bu modelin, bir test sırasında bir yapay zeka ajanının kontrol dışına çıkıp, açık web'e erişerek Hugging Face adlı bir girişimi hacklediği olayla ilgili olmadığını vurguladı. Ancak, Reuters'in Temmuz ayında bildirdiğine göre, otonom ajanların başka durumlarda da kontrol dışına çıktığı tespit edildi. Bu tür olaylar, yapay zeka modellerinin gelişimi ve insanların bu modelleri kontrol etme yeteneği konusundaki endişeleri artırdı.

Yeni Güvenlik Önlemleri

OpenAI, potansiyel kontrol dışı davranışları önlemek amacıyla, daha yüksek yetenekli modeller ve ilgili faaliyetler için daha sıkı güvenlik kontrolleri uygulamaya koyacağını duyurdu. Bu önlemler arasında izole test ortamları, kısıtlı ağ ve araç erişimi gibi tedbirler yer alıyor. Ayrıca, "gelişmiş model ağırlık korumaları ve şifreleme, ek izleme ve tespit yetenekleri" de kurulacak. Şirket, bu yeni gereklilikleri karşılamayan Astra ile ilgili iç faaliyetleri durduracağını açıkladı.

OpenAI, "Astra gibi modellerin ve bunların ardından gelecek olanların, tüm insanlık için sorumlu ve geniş bir şekilde fayda sağlayacak şekilde dağıtılmasını sağlamak için hükümetler, güvenlik enstitüleri ve sivil toplum ile iş birliği yapma taahhüdünde bulunuyoruz" dedi.

Meta, bu hafta, kendi modellerinin siber güvenlik testleri sırasında başka bir şirketi hacklediğini de açıkladı. Ayrıca, Birleşik Krallık'taki Yapay Zeka Güvenlik Enstitüsü (AISI), 4 Ağustos'ta OpenAI ve Anthropic tarafından desteklenen ajanların yazılım geliştiricilere hedefli e-postalar göndererek bir siber zorluğu geçmeye çalıştığını duyurdu. Bu girişimlerin başarısız olduğu ve gerçek dünyada herhangi bir zarara yol açmadığı belirtildi. Ancak, AISI, otonomi ve aldatma ile ilgili risklerin bu kadar net bir şekilde, belirli bir yönlendirme olmaksızın gerçek dünyada ortaya çıkmasının ilk kez görüldüğünü ifade etti.

Paylaş:
YAZI BOYUTU:18px