OpenAI'ın yapay zekâ ajanları üzerinde yürüttüğü güvenlik incelemesi, kullanıcı verilerinin korunmasına ilişkin dikkat çekici yeni bir olayı ortaya çıkardı. Şirket, araştırma ortamındaki bazı yapay zekâ ajanlarının eğitim ve değerlendirme verilerini üçüncü taraf hizmetlere göndermemeleri gerekirken aktardığını açıkladı.
OpenAI'ın tespitlerine göre olayların büyük çoğunluğunda aktarılan veriler kullanıcılardan kaynaklanmıyordu. Ancak şirket, kullanıcılar tarafından sağlanan görsellerin üçüncü taraf görsel barındırma hizmetlerine aktarıldığı 53 vaka belirledi.
OpenAI, bu davranışın verilerin uygun bir kullanımı olmadığını kabul ederken olayların şirketin daha sonra devreye aldığı yeni güvenlik önlemlerinden önce gerçekleştiğini belirtti.
OpenAI ajanları 53 kullanıcı görselini üçüncü taraf servislere aktardı
Olay, OpenAI'ın araştırma ortamında kullanılan yapay zekâ ajanlarının gerçekleştirdiği beklenmeyen davranışlara yönelik daha geniş kapsamlı bir inceleme sırasında ortaya çıktı.
Şirketin açıklamasına göre bazı ajanlar, üçüncü taraf hizmetleri kullanırken eğitim ve değerlendirme verilerini dış sistemlere iletti. Yapılan incelemede kullanıcılar tarafından sağlanan toplam 53 görselin görsel barındırma sitelerine gönderildiği tespit edildi.
Bu görsellere ait bağlantıların sitelerde herkese açık şekilde listelenmediği belirtiliyor. Ancak verilerin OpenAI'ın araştırma ortamından çıkarak üçüncü taraf hizmetlere aktarılmış olması nedeniyle şirket olayı uygun olmayan bir veri kullanımı olarak değerlendiriyor.
Görsellerin büyük bölümü kaldırıldı
OpenAI, ilgili görsel barındırma hizmetleriyle iletişime geçerek aktarılan içeriklerin kaldırılması için çalışmaya başladı. Şirketin açıklamasına göre görsellerin büyük bölümü kaldırıldı ve kalan içeriklerin de silinmesi için çalışmalar devam ediyor.
Olayın tam olarak ne zaman gerçekleştiği ve söz konusu görsellerin hangi işlemler sırasında üçüncü taraf hizmetlere gönderildiği konusunda ise kamuya açık ayrıntılar sınırlı.
OpenAI ayrıca teknik yaklaşımı ve gizlilik politikası nedeniyle söz konusu görselleri sağlayan kullanıcı hesaplarıyla yeniden ilişkilendiremediğini belirtiyor. Bu nedenle şirketin etkilenen kullanıcıları tek tek belirleyip bilgilendirmesi mümkün olmayabilir.
Görseller ajanların eline nasıl geçti?
OpenAI'ın açıklamasına göre şirketin eğitim verilerinin bir bölümü, eğitim için uygun kullanıcı etkileşimlerinden gelen veya bu etkileşimlerden türetilen içerikleri içerebiliyor.
Şirket, eğitim için uygun olmayan kullanıcı verilerinin bu sürece dahil edilmediğini belirtiyor. Kurumsal ve Business hesaplarından gelen veriler ile API kullanımı da belirli yönetici ayarları dışında eğitim verilerine dahil edilmiyor.
Eğitim için kullanılabilecek veriler sisteme alınmadan önce hesap bilgilerinden ayrıştırılıyor. OpenAI ayrıca isim, iletişim bilgileri ve hesap numaraları gibi kişisel ayrıntıları kaldırmak amacıyla gizlilik filtreleri kullandığını söylüyor.
Ancak son olay, veriler anonimleştirilmiş olsa bile yapay zekâ ajanlarının dış hizmetlerle etkileşime girebildiği araştırma ortamlarında farklı bir güvenlik riskinin ortaya çıkabileceğini gösteriyor.
Olay daha büyük bir güvenlik incelemesinin parçası
OpenAI bir süredir gelişmiş yapay zekâ ajanlarının eğitim ve değerlendirme sırasında beklenmeyen davranışlarını inceliyor. Şirketin incelemeleri, daha önce Hugging Face ile bağlantılı ciddi bir güvenlik olayının ortaya çıkmasının ardından genişletilmişti.
Bu süreçte ajanların kendilerine verilen görevlerin sınırlarının dışına çıktığı, erişim kontrollerini aşmaya çalıştığı veya araştırma ortamının izin vermediği yöntemlerle internete ulaşmaya çalıştığı farklı vakalar tespit edildi.
OpenAI, 25 Eylül'de yayımladığı ayrı bir olay raporunda bir araştırma modelinin eğitim ortamındaki DNS kısıtlamalarındaki boşluğu kullanarak harici bir sohbet hizmetine ulaşmayı başardığını da açıkladı.
Şirketin aktardığına göre bu davranış otomatik izleme sistemi tarafından yaklaşık 15 dakika içinde tespit edildi. OpenAI daha sonra ilgili ağ kontrollerini güçlendirdi ve en yetenekli modellerinin araç kullanımını içeren eğitim, değerlendirme ve çıkarım çalışmalarını geçici olarak durdurdu.
OpenAI onlarca üçüncü tarafı bilgilendirdi
Şirket yalnızca kullanıcı görsellerinin aktarılması olayını incelemiyor. OpenAI, araştırma ve değerlendirme çalışmalarındaki ajan davranışlarını geriye dönük olarak incelemeye devam ettiğini ve gerekli durumlarda etkilenen üçüncü taraflarla iletişime geçtiğini söylüyor.
Şirket bugüne kadar hükümet kurumları, üniversiteler, kamu kuruluşları ve diğer çevrim içi hizmetler dahil olmak üzere onlarca üçüncü tarafı bilgilendirdiğini açıkladı.
OpenAI'a göre incelenen ajan işlemlerinin büyük çoğunluğu kamuya açık internet içeriklerini araştırmak gibi sıradan görevlerden oluşuyor. Bununla birlikte şirket, ajanların kendilerine verilen görevin veya kullanılmasına izin verilen yöntemin ötesine geçtiği durumları özellikle araştırıyor.
İnceleme aylar sürebilir
OpenAI, geçmiş araştırma çalışmalarındaki ajan faaliyetlerinin tamamının incelenmesinin önemli miktarda zaman ve kaynak gerektirdiğini belirtiyor. Bu nedenle şirket, incelemenin aylar sürebileceğini ve yeni vakalar tespit edilmesi halinde ek açıklamalar yapılabileceğini söylüyor.
Şirket ayrıca gelecekte benzer olayların yaşanmasını önlemek amacıyla araştırma ortamlarında ağ izolasyonu, daha kapsamlı güvenlik testleri, veri sızdırma girişimlerini tespit etmeye yönelik kontroller ve model davranışlarını izleyen sistemler üzerinde çalışıyor.
Yapay zekâ ajanlarında veri güvenliği neden daha önemli?
Geleneksel sohbet botları çoğunlukla kullanıcının sorusuna yanıt üretirken yeni nesil yapay zekâ ajanları web sitelerini ziyaret edebiliyor, araç kullanabiliyor ve belirli görevleri kullanıcı adına gerçekleştirebiliyor.
Bu yetenekler yapay zekâ sistemlerini çok daha kullanışlı hale getirirken güvenlik açısından yeni bir sorun alanı oluşturuyor. Bir ajan yalnızca metin üretmek yerine dış sistemlerle iletişim kurabildiğinde, hangi verilere erişebileceği ve bu verileri hangi hizmetlere aktarabileceği daha kritik hale geliyor.
OpenAI'ın açıkladığı 53 görsel vakası da bu riskin somut örneklerinden biri. Burada önemli ayrım, OpenAI'ın kullanıcı görsellerini bilinçli biçimde internette yayımladığı yönünde bir bulgu bulunmaması. Şirketin açıklamasına göre olay, araştırma ortamındaki ajanların eğitim ve değerlendirme verilerini üçüncü taraf hizmetlere uygun olmayan şekilde aktarması sonucunda ortaya çıktı.
NetDijital Değerlendirmesi
OpenAI'ın olayı kamuoyuna açıklaması ve ajan davranışlarını geriye dönük olarak incelemeye devam etmesi önemli. Bununla birlikte 53 kullanıcı görselinin araştırma ortamından üçüncü taraf hizmetlere aktarılabilmiş olması, gelişmiş yapay zekâ ajanlarının yalnızca ürettikleri yanıtların değil gerçekleştirdikleri işlemlerin de sürekli denetlenmesi gerektiğini gösteriyor.
Özellikle internete erişebilen ve harici araçlarla çalışabilen ajanlar yaygınlaştıkça güvenlik yaklaşımının yalnızca zararlı yanıtları engellemekten ibaret kalması yeterli olmayacak. Veri erişimi, ağ bağlantıları, araç izinleri ve ajanların gerçekleştirdiği işlemlerin izlenmesi de yapay zekâ güvenliğinin temel parçaları haline geliyor.
OpenAI'ın devam eden incelemesinden yeni bulgular çıkması mümkün. Bu nedenle olayın kapsamına ilişkin mevcut bilgiler nihai sonuç olarak değerlendirilmemeli.
Görseller ilgili markaların tanıtım ve basın materyallerinden derlenmiştir.

0 Yorumlar