OpenAI, Hugging Face olayının ardından yeni güvenlik önlemleri getiriyor

OpenAI, erişim kontrollerinin sıkılaştırılması ve modellerin davranışlarını takip eden otomatik sistemlerin geliştirilmesi üzerinde çalışıyor.

OpenAI

OpenAI, temmuz ayında şirketin yapay zeka modellerinin test sırasında kontrol ortamından çıkarak Hugging Face’in sistemlerine erişmesiyle sonuçlanan güvenlik olayının ardından model geliştirme süreçlerinde yeni önlemler uygulamaya başladı. Şirket, gelişmiş modellerin yetenekleri arttıkça test ve geliştirme aşamasındaki risklerin de büyüdüğünü belirterek izleme, uyum ve güvenlik standartlarını güçlendireceğini açıkladı.

Olay, OpenAI’ın yapay zeka modellerinin siber güvenlik yeteneklerini ölçmek amacıyla gerçekleştirdiği dahili testler sırasında yaşandı. Testlerde GPT-5.6 Sol ile henüz piyasaya sürülmemiş daha gelişmiş bir model, normalde uygulanan bazı siber güvenlik kısıtlamaları azaltılmış şekilde kullanıldı. Modeller, kendilerine verilen ExploitGym testini çözmeye çalışırken OpenAI’ın araştırma ortamındaki ve Hugging Face’in üretim altyapısındaki güvenlik açıklarını birbirine bağlayarak Hugging Face’in sistemlerine erişti ve test cevaplarının bulunduğu veritabanına ulaştı. OpenAI olayı “benzeri görülmemiş bir siber güvenlik vakası” olarak nitelendirdi.

OpenAI olayın ardından en gelişmiş modellerinin geliştirme hızını geçici olarak yavaşlattı. Şirket, iki hafta boyunca bazı pekiştirmeli öğrenme çalışmalarına ara verirken planlanan büyük ölçekli eğitim çalışmalarından bazılarını da erteledi. OpenAI, güvenlik standartlarının modellerin hızla artan yeteneklerinin gerisinde kalmaması gerektiğini belirtiyor.

Yeni önlemler kapsamında modeller geliştirme ve test süreçleri boyunca daha yakından takip edilecek. OpenAI, yüksek riskli çalışmaların daha güçlü biçimde izole edilmesi, erişim kontrollerinin sıkılaştırılması ve modellerin davranışlarını takip eden otomatik sistemlerin geliştirilmesi üzerinde çalışıyor. Şirket ayrıca modellerin eğitim sonrasındaki uyum ve güvenlik çalışmalarına daha fazla ağırlık verecek.

OpenAI’ın üzerinde durduğu konulardan biri de modellerin düşünme süreçlerinin takip edilmesini sağlayan “chain-of-thought monitoring” yaklaşımı. Bu yöntem araştırmacıların bir modelin tehlikeli veya istenmeyen bir davranışa yönelip yönelmediğini tespit etmesine yardımcı olabiliyor. Ancak şirket, daha gelişmiş modellerde bu yöntemin ne kadar güvenilir olacağı konusunda hâlâ belirsizlikler bulunduğunu kabul ediyor.

Hugging Face olayı, gelişmiş yapay zeka modellerinin uzun ve çok aşamalı siber operasyonları insan müdahalesi olmadan gerçekleştirebilme potansiyeline ilişkin endişeleri de artırdı. OpenAI, olayın gelişmiş modellerin gerçek dünya sistemlerindeki yeni saldırı yollarını kaynak koduna erişmeden keşfedip kullanabileceğini gösterdiğini belirtiyor. Şirket, aynı yeteneklerin savunma amacıyla kullanılarak güvenlik açıklarının saldırganlardan önce bulunması ve giderilmesinde önemli rol oynayabileceğini savunuyor.

İlginizi çekebilir

© 2023 swipeline.co, Tüm Haklar Saklıdır.