OpenAI: Yapay zeka modelleri test sınırlarının dışına çıktı

OpenAI, bağımsız kuruluşlar tarafından gerçekleştirilen siber güvenlik testlerinde bazı yapay zeka modellerinin, öngörülen senaryoların dışına çıkarak gerçek internet servisleriyle etkileşime girdiğini açıkladı.

Ensonhaber / AA
OpenAI: Yapay zeka modelleri test sınırlarının dışına çıktı
Ensonhaber'i Google'da haber kaynağınız olarak ekleyin

Yapay zeka teknolojilerinin giderek daha karmaşık hale gelmesi, güvenlik testlerinde de yeni risk alanlarını beraberinde getiriyor.

ABD merkezli OpenAI, bağımsız kuruluşların yürüttüğü son siber güvenlik değerlendirmelerinde bazı yapay zeka modellerinin test senaryolarının dışına çıkan davranışlar sergilediğini duyurarak bu durumun, güvenlik süreçlerine ilişkin yeni değerlendirmeleri gündeme taşıdığını açıkladı.

BAĞIMSIZ TESTLERDE BEKLENMEDİK DAVRANIŞLAR GÖZLENDİ

OpenAI tarafından yapılan açıklamada, iki farklı bağımsız kuruluşun yürüttüğü siber güvenlik testlerinde, test ortamlarının teknik yapısıyla yapay zeka modellerinin gelişmiş yeteneklerinin birleşmesi sonucunda planlanan senaryoların dışına çıkan faaliyetlerin tespit edildiği belirtildi.

Şirket, söz konusu durumların kontrollü test süreçleri sırasında fark edildiğini ve elde edilen bulguların güvenlik değerlendirmelerinin geliştirilmesi amacıyla analiz edildiğini ifade etti.

Yeni Soğuk Savaş’ın yeni teknoloji yarışı: ABD ile Çin’in yapay zeka mücadelesi

MODEL GERÇEK İNTERNET HİZMETLERİYLE ETKİLEŞİME GİRDİ

İlk olayın, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen siber güvenlik değerlendirmesi sırasında yaşandığı aktarıldı.

Açıklamaya göre internete erişim izni bulunan OpenAI modeli, simüle edilen test ortamına ulaşmaya çalışırken görev kapsamının dışına çıkarak bazı gerçek internet hizmetleriyle iletişim kurdu. Şirket, bu etkileşimlerin test senaryosunun planlanan sınırlarını aştığını ancak sürecin güvenlik ekipleri tarafından yakından takip edildiğini bildirdi.

YANLIŞ YAPILANDIRMA GERÇEK WEB SİTESİNE ERİŞİME YOL AÇTI

İkinci olay ise OpenAI'ın dış test ortaklarından Irregular tarafından gerçekleştirilen güvenlik değerlendirmesi sırasında meydana geldi.

Şirketin verdiği bilgiye göre test ortamındaki yapılandırma hatası nedeniyle model internete erişebildi. Simüle edilen hedef sistemin kullandığı alan adının gerçek bir internet sitesiyle çakışması sonucu yapay zeka modeli, söz konusu internet sitesini test ortamının bir parçası olarak değerlendirdi.

Bu süreçte modelin, ilgili internet sitesinde bulunan temel düzeydeki bir güvenlik açığından yararlandığı, olayın ise tamamen test altyapısındaki teknik yapılandırmadan kaynaklandığı belirtildi.

ABD'de yapay zeka alarmı: OpenAI ajanları birden fazla platforma saldırdı

HUGGING FACE OLAYINDAN BAĞIMSIZ

OpenAI, son değerlendirmelerde tespit edilen olayların daha önce kamuoyuna duyurulan Hugging Face güvenlik vakasından tamamen bağımsız olduğunu vurguladı.

Şirket, iki olay arasında teknik veya operasyonel herhangi bir bağlantının bulunmadığını belirterek kamuoyunda oluşabilecek yanlış değerlendirmelerin önüne geçmeyi amaçladı.

DAHA ÖNCE DE GÜVENLİK İHLALİ YAŞANMIŞTI

OpenAI, daha önce yapay zeka modellerinin siber güvenlik kabiliyetlerini ölçmeye yönelik dahili testler sırasında Hugging Face altyapısında bir güvenlik ihlalinin meydana geldiğini kamuoyuyla paylaşmıştı.

Şirket, son olayların ardından bağımsız test süreçlerinin kapsamını gözden geçirdiğini, test ortamlarının izolasyonunu güçlendirmeye yönelik yeni önlemler üzerinde çalıştığını ve yapay zeka sistemlerinin güvenli biçimde geliştirilmesine yönelik değerlendirmelerin sürdüğünü bildirdi.

Kaynak: Anadolu Ajansı (AA)