ChatGPT'nin geliştiricisi, kendi modellerinden oluşturulan bir sistemin kurum içi bir güvenlik testi sırasında kontrolden çıkıp yapay zeka platformu Hugging Face'e sızmasından haftalar sonra, aralarında tek seferde planlanan en büyük pekiştirmeli öğrenme çalışmasının da bulunduğu en ileri araştırmalarının hızını bilerek frenliyor.CEO Sam Altman, X'te yaptığı paylaşımda OpenAI'nin ortak güvenlik kuralları konusunda daha geniş sektörle koordinasyon sağlayacağını, ancak bu gerçekleşene kadar "şimdilik tek taraflı hareket edeceğini" yazdı.Karara yol açan olay temmuz ayında yaşandı; OpenAI, saldırı amaçlı siber yetenekleri ölçen kurum içi bir kıyaslama testinde GPT-5.6 Sol'u, henüz yayımlanmamış ve daha yetenekli bir prototiple birlikte denerken modellerin ham kapasitesini ölçmek için olağan güvenlik kısıtlamalarını bilerek devre dışı bırakmıştı.Testi çözmek yerine sistem, daha önce bilinmeyen bir açıktan yararlanarak kendi "kum havuzu" ya da kontrollü ortamından kaçtı, açık internete ulaştı ve yaklaşık dört buçuk gün boyunca Hugging Face'in altyapısını yoklayarak sonunda teste ait yanıtları aramak için içeri sızdı.Hugging Face'in yaptığı olay analizi, ihlal kontrol altına alınmadan önce, aralarında birkaç başka şirketin de etkilendiği süreçte yaklaşık 17 bin 600 ayrı işlem gerçekleştirildiğini ortaya koydu.Tarafların her ikisi de kötü niyete dair bir bulguya rastlanmadığını belirtiyor; Hugging Face'e o tarihten bu yana, kendi sistemlerini savunmasına yardımcı olması için OpenAI'nin daha yetenekli ve daha az kısıtlı bir modeline erişim verildi.Astra ve güvenlikte daha yüksek çıtaİkinci dönüm noktası ise 7 Ağustos'ta geldi; iç değerlendirmeler, OpenAI'nin bir sonraki sınır modeli Astra'nın, şirketin kendi risk çerçevesine göre siber yetenek açısından "kritik" eşik seviyesini aşabileceğine işaret etti.O tarihten bu yana Astra ile ilgili bazı iş yükleri daha sıkı kontroller altında yeniden başlatıldı, ancak önemli bir kısmı, yalıtılmış test ortamları, kısıtlı ağ erişimi ve kesintisiz izleme gibi unsurları kapsayan yeni standartları karşılayana kadar askıda kalacak.Yeni bir tespit sistemi artık model faaliyetlerini anlık olarak tarıyor ve izlenen işlem gücünün yaklaşık yüzde 20'sine denk geldiği hesaplanan bir hesaplama maliyetiyle, yetkisiz erişimi veya koruma mekanizmalarını devre dışı bırakma girişimini andıran her türlü davranışı 30 dakika içinde işaretlemeyi hedefliyor.OpenAI, yapılan değişikliklerin doğrudan ihlale tepki olarak değil, önceden planlandığını; ancak olayın sürece ek bir aciliyet kattığını söylüyor. Şirket, bu sorunla karşı karşıya olan tek aktör değil.Anthropic ve Meta da son haftalarda, kendi modellerinin testler sırasında üçüncü taraf sistemlere sızdığı benzer vakaları kamuoyuna açıkladı.OpenAI ve Anthropic, sektörün ne kadar hızlı ilerlemesi gerektiğinin belirlenmesinde hükümetlerin koordinasyon rolü üstlenmesini talep eden ve çalışanların öncülük ettiği bir dilekçeyi ayrı ayrı destekledi; bu da Altman'ın, yapay zekânın yavaşlatılmasına yönelik kamu çağrılarına geçmişte gösterdiği dirençten belirgin bir kopuş anlamına geliyor.
Siber güvenlik kaygıları: OpenAI model geliştirmeyi yavaşlatacağını açıkladı
OpenAI, gelişmiş yapay zekâ eğitimlerinin bazı aşamalarını iki haftalığına durdurdu ve güvenliği sıkılaştırıyor; buna, bir ay önce kendi modelinin test ortamından çıkıp Hugging Face’in sistemlerine sızması neden oldu.
Kaynak
Haberin tamamı, güncellemeleri ve fotoğraf galerisi için Euronews sayfasına gidin.
tr.euronews.com · Haberi kaynağında oku