Yapay zekâ araştırmalarında dünyanın önde gelen şirketlerinden OpenAI, uzun süredir süregelen güvenlik ve şeffaflık eleştirilerine yanıt niteliğinde önemli bir girişim başlattı. Şirket, “Safety Evaluations Hub” adını verdiği yeni internet platformuyla modellerinin zararlı içerik üretme, jailbreak girişimlerine açıklık ve halüsinasyon üretimi gibi alanlardaki performansını kamuoyuyla paylaşacak.
Modeller artık güvenlik testlerine açık olacak
OpenAI, bu merkezi yalnızca mevcut durum verilerini değil, gelecekteki büyük model güncellemelerinin ardından yapılacak güvenlik performanslarını da düzenli olarak yayımlamak üzere tasarladı. Şirketin blog sayfasında yapılan duyuruda, güvenlik değerlendirme sonuçlarının toplulukla paylaşılması sayesinde sektördeki etik standartlara ve yapay zekâ güvenliğine katkı sağlanmasının amaçlandığı belirtildi.
Eleştirilerin ardından şeffaflık hamlesi geldi
Bu gelişme, OpenAI’nin özellikle son aylarda aldığı güvenlik önlemlerinin yetersizliği gerekçesiyle yoğun şekilde eleştirilmesinin ardından geldi. Daha önce GPT-4o gibi büyük model güncellemelerinde teknik raporların paylaşılmaması ve testlerin aceleye getirilmesi, birçok etik uzmanı tarafından ciddi bir şeffaflık sorunu olarak değerlendirilmişti.
OpenAI CEO’su Sam Altman da 2023 Kasım’ında görevden kısa süreli alınmasına neden olan süreçte, model güvenliği konularında yönetim kurulunu eksik bilgilendirmekle suçlanmıştı.
GPT-4o krizi güvenlik kaygılarını derinleştirdi
Geçtiğimiz ay, GPT-4o modelinin yeni sürümünde kullanıcılar yapay zekânın sorgusuz sualsiz her fikre onay vermesi ve tehlikeli ifadeleri desteklemesi nedeniyle tepki göstermişti. Sosyal medya platformu X’te paylaşılan ekran görüntüleri, ChatGPT’nin aşırı olumlu ve potansiyel olarak zararlı tepkiler verdiğini gözler önüne serdi. Bu olayın ardından OpenAI, GPT-4o’nun ilgili sürümünü geri çekmek zorunda kaldı.
Yeni sistem: Lansman öncesi “alpha aşaması”
Bu gibi krizlerin önüne geçmek için şirket, bundan sonra modelleri lansman öncesinde sınırlı bir kullanıcı grubuyla test etmeye olanak tanıyacak “alpha aşaması” sistemini duyurdu. Bu opt-in yöntemi sayesinde topluluk geri bildirimleri toplanarak, ürünlerin geniş kitlelere ulaşmadan önce daha güvenli hale getirilmesi planlanıyor.
Yapay zekâ güvenliğinde sektör standardı olabilir
OpenAI’nin bu adımı, yapay zekâ alanında güvenlik ve sorumluluğu merkeze alan yeni bir dönemin habercisi olarak değerlendiriliyor. Sektör gözlemcileri, Safety Evaluations Hub’ın ilerleyen dönemlerde daha fazla veri seti, metodoloji ve test sonucunu içerecek şekilde genişletilmesini bekliyor.












