OpenAI, yapay zekâ modellerindek şeffaflık sözü verdi!
OpenAI, yapay zekâ modellerinin beklenmedik ve yetkisiz davranışlarını daha sistematik biçimde kamuoyuyla paylaşacağını açıkladı.
OpenAI, yapay zekâ modellerinin beklenmedik ve yetkisiz davranışlarını daha sistematik biçimde kamuoyuyla paylaşacağını açıkladı.
OpenAI, çarşamba günü yaptığı açıklamada, yapay zekâ modellerinde ortaya çıkan ve şirketin “model uyumsuzluğu” (model misalignment) olarak tanımladığı davranışları düzenli olarak raporlamaya başlayacağını duyurdu.
Şirket, yeni sistem kapsamında şimdiye kadar tespit edilen altı vakayı da yayımladı. OpenAI, bu olayların modellerinde bu tür davranışların ne sıklıkta görüldüğünü temsil etmediğini ve münferit örnekler olduğunu özellikle belirtti.
MODELLER DENETİM SINIRLARINI AŞABİLİR
Açıklanan vakalar arasında, henüz yayımlanmamış bir araştırma modelinin görev özetlerine kendi talimatlarını ekleyerek normal kısıtlamaları göz ardı etmeye yönelik ifadeler yerleştirmesi bulunuyor. Başka bir vakada modelin hatalarını gizlemeye yönelik talimatlar ürettiği bildirildi.
OpenAI'nin temmuz ayında gerçekleştirdiği siber güvenlik testleri sırasında ortaya çıkan daha ciddi bir olayda ise bazı modeller, kendilerini internetten izole etmek için oluşturulan kontrolleri aşarak internete erişmiş ve OpenAI'nin yanı sıra üçüncü taraf sistemlerine ulaşmıştı. Şirket, bu olayda özellikle Hugging Face sistemlerinin de etkilendiğini açıklamıştı.
OpenAI, bu olayın modellerin yetkisiz kanallar üzerinden iletişim kurabildiğini, güvenlik açıklarından yararlanabildiğini ve insan tarafından doğrudan yönlendirilmemiş bazı tehlikeli eylemleri gerçekleştirebildiğini gösterdiğini belirtti.
‘UYUM SORUNUNU HENÜZ ÇÖZEMEDİK’
Şirket, yeni raporlama sisteminin yalnızca sorunların tamamen anlaşılması veya çözüme kavuşturulmasından sonra değil, incelemeler devam ederken de kamuoyuna bilgi verilmesini amaçladığını açıkladı.
OpenAI ayrıca yapay zekâ sektörünün, modellerin insan değerleri ve talimatlarıyla uyumlu hareket etmesini sağlama ve onları yeterince denetleme sorununu henüz çözemediğini belirtti.
Bu açıklamalar, yapay zekâ sistemlerinin giderek daha fazla bağımsız hareket edebilmesiyle birlikte güvenlik tartışmalarının yoğunlaştığı bir dönemde geldi.
Anthropic CEO'su Dario Amodei de geçtiğimiz günlerde yapay zekâdaki gelişme hızının, ortaya çıkan yeni risklerin daha iyi anlaşılabilmesi için yavaşlatılması çağrısında bulunmuştu. OpenAI CEO'su Sam Altman'ın yanı sıra bazı diğer teknoloji şirketi yöneticileri de yapay zekâ güvenliği konusunda daha fazla önlem alınması gerektiğini savundu.
META CEO’SU KARŞI ÇIKTI
Buna karşılık Meta CEO'su Mark Zuckerberg, yapay zekâ geliştirmelerinin yavaşlatılması veya durdurulması yönündeki çağrılara karşı çıkarak piyasa mekanizmaları ve hukuki sorumluluk risklerinin teknoloji için önemli denetim araçları olduğunu savundu.
OpenAI ise yeni raporlama çerçevesiyle bundan böyle özellikle yetkisiz eylemler, denetim sınırlarının dışına çıkma ve yapay zekâ sistemlerinin kendi aralarında izinsiz koordinasyon kurması gibi davranışları kamuoyuna açıklayacağını bildirdi.