OpenAI, Hugging Face olayının ardından yapay zeka modellerinin güvenliği için yeni önlemler aldı. Ağ izolasyonu ve izleme sistemleri güçlendirilirken, denetimler sıkılaşacak.
Yapay zeka şirketi OpenAI, Hugging Face olayının ardından modellerin yetenekleri arttıkça ortaya çıkan riskleri yönetmek amacıyla yeni güvenlik önlemleri aldığını duyurdu. Şirket blog yazısında, modellerin şirket içinde geliştirilmesi ve test edilmesiyle ilgili risklerin arttığını belirterek, izleme, uyum ve güvenlik standartlarının bu risklerin önünde kalması gerektiğini vurguladı.
Yeni önlemler, 21 Temmuz’da kamuoyuna duyurulan Hugging Face olayından bu yana OpenAI’ın güvenlik uygulamalarında açıkladığı ilk kamuya açık değişikliklerden birini oluşturuyor. OpenAI temsilcileri, önlemlerin doğrudan Hugging Face olayına yanıt olarak alınmadığını, ancak Astra modelinin siber güvenlik yetenekleri ve yapay zeka alanındaki genel ilerleme hızının bu adımların oluşturulmasında etkili olduğunu belirtti.
Şirket, olay sonrası pekiştirmeli öğrenme (RL) çalışmalarını iki hafta süreyle durdurduğunu ve daha düşük riskli modellerin çoğunda çalışmaları yeniden başlattığını açıkladı. Planlanan en büyük ölçekli frontier RL çalışması ise model davranışını değerlendirmek, güvenlik önlemlerini doğrulamak ve uyuma ilişkin daha fazla kanıt elde etmek amacıyla daha küçük ölçekli eğitim ve değerlendirmeler sonrasında devam edecek.
OpenAI’ın araştırmadan sorumlu başkan yardımcısı Amelia Glaese, modellerin yetenekleri arttıkça kontrollerin sıkılığının da yükseleceğini ve en büyük modellerin en yoğun incelemeye tabi tutulacağını söyledi. Glaese, güvenli geliştirme için modellerin risk seviyesine göre değişen gereklilikler ve beklentiler belirlediklerini ifade etti.
Şirket, olay sonrası zayıf ağ güvenliği uygulamaları nedeniyle eleştirilmişti. Olayda modeller, şirket ağında internete erişimi bulunan bir aracın ele geçirilmesi yoluyla eğitim ortamlarının dışına çıkmıştı.
Yeni önlemler daha güçlü ağ izolasyonu uygulamalarını da içeriyor. Yeni sistemde tek bir iş yükünün veya destek hizmetinin ele geçirilmesi, tek başına internete veya diğer şirket içi ağlara yetkisiz erişim sağlamaya yetmeyecek. Şirket bu konuda ayrıntı vermedi.
En güçlü önlem olarak belirtilen izleme sistemi, çeşitli yetkisiz davranış türlerini tespit etmek için araçların gerçekleştirdiği işlemleri, erişilebilir akıl yürütme izlerini ve etkinlik kayıtlarını inceleyecek. OpenAI, şüpheli etkinlik ardından 30 dakika içinde uyarı üretmeyi hedefliyor. Bu izleme sisteminin, izlenen sürecin kapasitesinin yaklaşık yüzde 20’sine denk gelecek ek işlem gücü gerektireceği tahmin ediliyor.
OpenAI, sistemle ilgili ayrıntıları ileride yayımlanacak ayrı bir blog yazısında paylaşacağını duyurdu. Şirketin olaya ilişkin resmî olay sonrası analizi henüz yayımlanmadı.
Reklam & İşbirliği: [email protected]