İçeriğe geç

OpenAI beklenmedik yapay zeka davranışları hakkında düzenli rapor yayınlamayı planlıyor

OpenAI, beklenmedik veya yetkisiz yapay zeka davranışlarını düzenli olarak kamuoyuna duyuracağını açıkladı. Şirket son altı ayda gözlemlenen altı vaka da dahil olmak üzere yeni bir izleme ve açıklama çerçevesi yayımladı. Açıklama, yapay zeka güvenliği çalışmalarının sistemlerin hızla güçlenmesi karşısında geride kaldığı endişesiyle geldi.

OpenAI beklenmedik yapay zeka davranışları hakkında düzenli rapor yayınlamayı planlıyor

11 Haziran’da oluşturulan bir illüstrasyonda OpenAI logosu görülüyor. Reuters-Yonhap. OpenAI, Çarşamba günü yaptığı açıklamada beklenmedik veya yetkisiz yapay zeka davranışlarına ilişkin raporları düzenli olarak yayımlamaya başlayacağını duyurdu. Şirket, sistemler daha da güçlenirken sektörün kilit uyum sorunlarını henüz çözemediği uyarısında bulundu.

Şirket, yapay zeka modeli uyumsuzluklarının takibi, araştırılması ve açıklanması için yeni bir çerçeve yayımladı. Bu çerçeve ile birlikte son altı ayda gözlemlenen beklenmedik veya endişe verici model davranışlarına ilişkin altı rapor da paylaşıldı.

Açıklama, giderek daha güçlü sistemlerin durmaksızın geliştirilmesi karşısında yapay zeka güvenliği çalışmalarının geride kaldığı endişesinin arttığı bir dönemde geldi. Araştırmacılar, yapay zeka ajanları daha otonom hale geldikçe yaratıcılarının niyetinden sapabilecek davranışlar geliştirebileceği ve izlenip kontrol edilmesinin zorlaşabileceği uyarısında bulunuyor.

OpenAI, kendi yapay zeka ajanının bir test sırasında açık kaynak platformu Hugging Face’teki sistemlere sızması ve eylemlerini gizlemeye çalışmasının ardından artan bir incelemeyle karşı karşıya kaldı.

Hafta sonu Anthropic CEO’su Dario Amodei, yapay zeka geliştirme hızını yavaşlatmayı ve risklerin yönetilmesi için daha fazla zaman tanımayı amaçlayan üç aşamalı bir çerçeve önerdi. Öneri, xAI’ı yöneten Elon Musk da dahil olmak üzere bir grup yapay zeka yöneticisinin desteğini aldı. OpenAI CEO’su Sam Altman da teknolojinin gelişiminde yavaşlamaya çağrı yaparak, sistemin yakında kendi kendine gelişip insan kontrolünün ötesine geçebileceği uyarısında bulundu.

OpenAI’nin ilk raporları, modellerin görev özetlerinde kendi talimatlarını üretmesi, hataları gizlemesi, bunları kaynak göstermek için dosyaları internete yüklemesi ve iş birliği yapan ajanlar arasında yetkisiz dosya paylaşımı gibi vakaları içeriyor.

OpenAI, raporların bireysel örnekleri anlattığını ve modeller genelinde uyumsuzluğun ne sıklıkla görüldüğüne dair kanıt olarak değerlendirilmemesi gerektiğini belirtti. Şirketin yeni çerçevesi, çalışanların potansiyel model uyumsuzluğu olaylarını bildirebileceği bir süreç, güvenlik ve uyum ekiplerince soruşturma ve hangi vakaların kamuoyuna açıklanacağına karar verecek bir sistemi kapsıyor.

ChatGPT üreticisi, Hugging Face olayının yeni çerçeve kapsamında daha kapsamlı inceleme gerektiren karmaşık vakalar, özellikle üçüncü tarafları içeren durumlar için öngörülen "Large Investigation" hattına gireceğini söyledi.

Kaynak The Korea Times 🇰🇷 Güney Kore haberleri

Paylaş:

Yapay zekâ asistanları için: bu haberin Markdown (.md) sürümü