11 Haziran’da oluşturulan bir illüstrasyonda OpenAI logosu görülüyor. Reuters-Yonhap. OpenAI, Çarşamba günü yaptığı açıklamada beklenmedik veya yetkisiz yapay zeka davranışlarına ilişkin raporları düzenli olarak yayımlamaya başlayacağını duyurdu. Şirket, sistemler daha da güçlenirken sektörün kilit uyum sorunlarını henüz çözemediği uyarısında bulundu.
Şirket, yapay zeka modeli uyumsuzluklarının takibi, araştırılması ve açıklanması için yeni bir çerçeve yayımladı. Bu çerçeve ile birlikte son altı ayda gözlemlenen beklenmedik veya endişe verici model davranışlarına ilişkin altı rapor da paylaşıldı.
Açıklama, giderek daha güçlü sistemlerin durmaksızın geliştirilmesi karşısında yapay zeka güvenliği çalışmalarının geride kaldığı endişesinin arttığı bir dönemde geldi. Araştırmacılar, yapay zeka ajanları daha otonom hale geldikçe yaratıcılarının niyetinden sapabilecek davranışlar geliştirebileceği ve izlenip kontrol edilmesinin zorlaşabileceği uyarısında bulunuyor.
OpenAI, kendi yapay zeka ajanının bir test sırasında açık kaynak platformu Hugging Face’teki sistemlere sızması ve eylemlerini gizlemeye çalışmasının ardından artan bir incelemeyle karşı karşıya kaldı.
Hafta sonu Anthropic CEO’su Dario Amodei, yapay zeka geliştirme hızını yavaşlatmayı ve risklerin yönetilmesi için daha fazla zaman tanımayı amaçlayan üç aşamalı bir çerçeve önerdi. Öneri, xAI’ı yöneten Elon Musk da dahil olmak üzere bir grup yapay zeka yöneticisinin desteğini aldı. OpenAI CEO’su Sam Altman da teknolojinin gelişiminde yavaşlamaya çağrı yaparak, sistemin yakında kendi kendine gelişip insan kontrolünün ötesine geçebileceği uyarısında bulundu.
OpenAI’nin ilk raporları, modellerin görev özetlerinde kendi talimatlarını üretmesi, hataları gizlemesi, bunları kaynak göstermek için dosyaları internete yüklemesi ve iş birliği yapan ajanlar arasında yetkisiz dosya paylaşımı gibi vakaları içeriyor.
OpenAI, raporların bireysel örnekleri anlattığını ve modeller genelinde uyumsuzluğun ne sıklıkla görüldüğüne dair kanıt olarak değerlendirilmemesi gerektiğini belirtti. Şirketin yeni çerçevesi, çalışanların potansiyel model uyumsuzluğu olaylarını bildirebileceği bir süreç, güvenlik ve uyum ekiplerince soruşturma ve hangi vakaların kamuoyuna açıklanacağına karar verecek bir sistemi kapsıyor.
ChatGPT üreticisi, Hugging Face olayının yeni çerçeve kapsamında daha kapsamlı inceleme gerektiren karmaşık vakalar, özellikle üçüncü tarafları içeren durumlar için öngörülen "Large Investigation" hattına gireceğini söyledi.