Andrew Griffin
OpenAI, firmaya ait kontrolden çıkmış yapay zeka sistemleri tarafından saldırıya uğramış olabilecekleri hakkında 100’den fazla kuruluşa bildirimde bulundu. Şirket daha fazla olay tespit etmeyi bekliyor.
Şirket, sistemlerinden birinin başka bir yapay zeka firması Hugging Face'i hacklediğinin ortaya çıkması üzerine modellerinin davranışlarını inceliyor. OpenAI, muazzam sayıda benzer olay saptadığını ve bunların çoğunun bilgisi dışında gerçekleştiğini açıkladı.
Şirket, bu ve ardından gelen diğer olaylar nedeniyle sürekli eleştirilere maruz kalırken bunlar arasında, OpenAI’a ait bir sistemin, Avustralya'nın resmi sağlık verilerini hacklediğinin yakın zamanda ortaya çıkması da var. Ancak sistemleri üzerinde yeterli denetim ve şeffaflık sağlamadığı için de yoğun tepki çeken şirket, bu incelemeyle sözkonusu eleştirilere yanıt vermeye çalışıyor.
OpenAI, incelemeyle ilgili bir güncellemede, "modellerinin dahil olduğu, Hugging Face olayıyla ölçek veya ciddiyet açısından yakın, üçüncü tarafa ait başka bir sistemin ihlalinin" henüz tespit edilmediğini belirtti. Ancak "geçmiş kayıtları inceledikçe daha fazla vaka saptamayı" beklediğini de ekledi.
OpenAI, halihazırda "100'den fazla kuruluşa böyle bir faaliyet hakkında bildirimde bulunduğunu" ifade etti. Şirket, böyle bir bildirimin "herhangi bir özel bilgiye erişildiği veya üçüncü tarafa ait herhangi bir sistemin ihlal edildiği anlamına gelmediğini" vurguladı.
Modellerinin davranışlarına ilişkin 50 petabaytlık veriyi analiz ederken muazzam miktarda hesaplama gücü kullandığını belirten OpenAI, incelemenin günde yarım milyon dolardan fazlaya mal olduğunu aktardı. OpenAI, "Kayıtlara geriye doğru ay ay bakarak çoktan bulduğumuz vakaların dışında olası istem dışı faaliyetleri araştırıyoruz" ifadelerini kullandı.
Bu süreç, kayıtların genel bir düzeyde incelenmesi amacıyla yapay zeka sistemine aktarılarak olası kötü niyetli davranışların tespit edilmesini içeriyor. OpenAI, bu ilk aşamayı geçen tüm olayların daha sonra iki ayrı otomatik incelemeye daha tabi tutulduğunu söyledi.
Ardından olay, insan araştırmacılara aktarılıyor ve onlar da olay kayıtlarını inceliyor, neler yaşandığını yeniden canlandırıyor ve OpenAI sistemlerinin yaptıklarıyla ilgili diğer kuruluşları bilgilendirmenin gerekli olup olmadığına karar veriyor.
OpenAI, "Geçmişteki faaliyetleri inceledikçe daha fazla vaka bulmayı ve daha fazla kuruluşa haber vermeyi bekliyoruz" dedi.
Bazı bildirimler aylar öncesine ait olaylarla ilgili olabilir. Olayın ne zaman gerçekleştiği, ne zaman saptadığımız, neyi bildiğimiz ve neyin belirsiz kaldığıyla ilgili net olacağız.
Ayrıca OpenAI, Hugging Face olayından bu yana güvenlik kontrollerini artırdığını, modellerinin internete erişimini kısıtladığını, araştırmalarını daha net şekilde birbirinden ayırdığını, sistemleri izleme çalışmalarını genişlettiğini ve araçlarının kontrolden çıkmasını önlemeye yönelik eğitimleri artırdığını belirtti. Şirket, incelemenin "faaliyetlerin model sürümleri arasında nasıl değiştiğini ve bu önlemlerin işe yarayıp yaramadığını görmeyi, ayrıca tespit ve önleme konusunda nerelerde hâlâ iyileştirme yapılması gerektiğinin belirlenmesini sağlayacağını” kaydetti.
Independent Türkçe, independent.co.uk/tech

