OpenAI'dan yeni yapay zeka modeli Astra için ek güvenlik kararı: Bilinmeyen açıkları bulup kullanabiliyor
OpenAI'dan Astra için ek güvenlik kararı: Bilinmeyen açıkları bulup kullanabiliyor
OpenAI, geliştirdiği Astra adlı yapay zeka modelinin siber güvenlik kapasitesi nedeniyle piyasaya sürülmeden önce ek güvenlik önlemlerine ihtiyaç duyduğunu açıkladı.
Şirket yetkilileri, Astra'nın bugün kamuya açık en gelişmiş OpenAI modelinden daha fazla güvenlik açığı tespit edebildiğini ve bu işlemleri daha düşük hesaplama gücüyle gerçekleştirdiğini belirtti.
İnsan yönlendirmesi olmadan saldırı geliştirebiliyor
OpenAI Güvenlikten Sorumlu Başkan Yardımcısı Amelia Glaese, Astra'nın doğru araçlara ve erişime sahip olması halinde daha önce bilinmeyen güvenlik açıklarını bulabildiğini söyledi.
Glaese, modelin her aşamada insan yönlendirmesine ihtiyaç duymadan iyi korunan sistemlerdeki açıkları kullanacak yöntemler geliştirebildiğini belirtti.
OpenAI, Astra'yı yakında sınırlı bir grubun kullanımına sunmayı planlıyor ancak takvime ve kullanıcı grubuna ilişkin ayrıntı vermedi.
Güvenlik önlemleri meşru çalışmaları da durdurabilir
Glaese, ek güvenlik önlemlerinin zaman zaman meşru çalışmaları yavaşlatabileceğini, duraklatabileceğini veya tamamen engelleyebileceğini söyledi. Şirketin bu tür kesintileri en aza indirmek için çalışacağını belirtti.
Astra, OpenAI'ın güvenlik protokolünde yer alan daha sıkı koruma önlemlerini devreye sokan ilk model oldu. Daha önce yalnızca teorik olan bu güvenlik eşiği, Astra'nın yetenekleriyle ilk kez aşıldı.
Hugging Face olayının ardından geliştirmeler durdurulmuştu
OpenAI'ın yapay zeka ajanlarının test ortamından çıkarak açık kaynak platformu Hugging Face'i hacklemesi, yapay zeka güvenliği konusunda tartışma başlatmıştı.
Şirket, olayın ardından savunma sistemlerini güçlendirmek amacıyla model geliştirme çalışmalarının büyük bölümünü iki hafta boyunca durdurdu.
OpenAI yetkilileri, Astra'nın Hugging Face olayında yer almadığını ancak sahip olduğu yeteneklerin daha dikkatli güvenlik önlemleri gerektirdiğini söyledi.
Şirket, en büyük model eğitim çalışmasını 28 Ağustos'ta yeniden başlattığını, bazı küçük deneyleri ise hala beklettiğini açıkladı.
Zararlı siber taleplere karşı koruma artırıldı
OpenAI'ın güvenlik protokolüne göre, iki temel yeteneği gösteren modeller için ek koruma önlemleri uygulanması gerekiyor.
Bu yetenekler, yeni siber güvenlik açıklarını tespit edip kullanmak ve çok az ya da hiç insan desteği olmadan yeni ve ayrıntılı saldırı stratejileri planlayıp uygulamak olarak sıralandı.
OpenAI, Astra'nın zararlı siber taleplere yanıt vermesini zorlaştırdı. Modelin koruma önlemlerini aşıp aşmadığını belirlemek için faaliyetleri de izlenecek.
OpenAI Güvenlik Yöneticisi Saachi Jain, yapay zeka ajanlarının görevleri ne ölçüde yerine getirebilmesi gerektiğini sürekli değerlendirdiklerini söyledi. Jain, modellerin yetki ve sınırlarını anlaması için eğitildiğini belirtti.

