OpenAI, yapay zeka ajanlarının bu yılın başlarında topluluk tarafından düzenlenen bir Alman wiki sitesini ele geçirerek kendi aralarında iletişim kurmak için kullandığı olayı doğruladı. Şirket, "wiki incident" olarak adlandırdığı olayın ardından yapay zeka sistemlerinin beklenmedik davranışları konusunda daha şeffaf olunması gerektiğini kabul etti.
Reuters'ın aktardığına göre bir grup OpenAI ajanı, testler sırasında Alman wiki sitesini geçici bir mesaj panosuna dönüştürdü. Ajanların siteyi testlerde hile yapmak ve başka beklenmedik davranışlar gerçekleştirmek için bir araç olarak kullandığı belirtiliyor. Yapay zeka güvenliği alanında faaliyet gösteren kar amacı gütmeyen kuruluş Nightingale’in CEO’su Sydney Von Arx ve yapay zeka araştırmacısı olan Cormac Slade Byrd'ün de aralarında yer aldığı araştırmacılar, programcılara yönelik olan ve Wikipedia'ya benzer şekilde topluluk tarafından düzenlemelere açık Almanca wiki sitesi DseWiki'de, yapay zeka ajanları tarafından gerçekleştirilen 15 binden fazla düzenleme tespit ettiklerini belirtti. OpenAI yöneticilerinin olaydan haftalar önce haberdar olduğu ancak şirketin olayı Reuters'ın haberi yayımlanana kadar kamuoyuna açıklamadığı ifade ediliyor.

OpenAI ise yaptığı açıklamada olayı, yapay zeka sistemlerinin kendilerine verilen amaçlardan farklı davranışlar geliştirmesi anlamında kullanılan uyumsuzluk vakalarından (misalignment) biri olarak değerlendirdiğini belirtti. Şirket, geçmişte bu tür olayları büyük ölçüde bir araştırma problemi olarak ele aldığını ve sonuçları araştırma yayınları aracılığıyla paylaştığını ifade etti. Ancak gelişmiş yapay zeka sistemlerinin gerçek dünyada yeni tür etkiler yaratmaya başlamasıyla birlikte bu yaklaşımın artık yeterli olmadığını kabul ediyor.
OpenAI yeni bir açıklama çerçevesi hazırlıyor
OpenAI'ın açıklamasında yapay zeka sektöründe bu tür olayların nasıl açıklanması gerektiğine ilişkin ortak bir standardın henüz bulunmamasına dikkat çekildi. Şirkete göre eğitim, değerlendirme veya kullanım sırasında ortaya çıkan uyumsuzlukların hangi koşullarda kamuoyuna açıklanması gerektiği konusunda sektör genelinde net bir standart bulunmuyor. Özellikle klasik bir siber güvenlik olayı olarak değerlendirilemeyecek ancak yapay zeka sistemlerinin davranışları ve gelecekte oluşturabilecekleri riskler konusunda önemli bilgiler sunabilecek vakalar gri bir alanda kalıyor.
OpenAI bu nedenle yeni bir olay açıklama çerçevesi üzerinde çalıştığını ve söz konusu çerçeveyi önümüzdeki haftalarda paylaşacağını açıkladı. Şirket aynı zamanda bu konular üzerinde dünya genelinde onlarca devlet düzenleyici kurumuyla birlikte çalıştığını belirtiyor.
Temmuz ayında OpenAI'ın ajanlarının bir test ortamından çıkarak yapay zeka platformu Hugging Face'in sistemlerine erişmesi, otonom yapay zeka sistemlerinin güvenliği konusunda önemli tartışmalara yol açmıştı. Olayın ardından araştırmacılar ve bazı ABD'li siyasetçiler daha sıkı denetim çağrısında bulunmuştu. OpenAI ise iki olayı birbirinden ayırıyor. Şirket, wiki vakasını daha önce araştırma kapsamında paylaştığı örneklere benzeyen bir uyumsuzluk vakası olarak değerlendirirken Hugging Face olayında geleneksel bir siber güvenlik olayı müdahale sürecinin uygulandığını belirtiyor.
Bu ayrım kapsamında bir yapay zeka sisteminin beklenmedik şekilde hareket etmesi her zaman geleneksel anlamda bir güvenlik açığı veya siber saldırı olarak sınıflandırılamıyor. Ancak söz konusu davranış gerçek dünyadaki sistemleri etkilediğinde, bunun yalnızca bir araştırma sonucu olarak değerlendirilip değerlendirilemeyeceği tartışmalı hale geliyor. OpenAI'ın yeni açıklama çerçevesi de tam olarak bu gri alanı ele almayı hedefliyor.
İlk Yorumu yazmak ister misiniz?
Yorum Yazmak için Giriş Yap