OpenAI: Yapay zeka modeli kontrolden çıktı, 'benzeri görülmemiş' güvenlik ihlali
OpenAI, en gelişmiş yapay zeka sistemlerinin güvenliğine ilişkin endişeleri artıran bir olayı açıkladı. Şirket, kontrollü bir test sırasında otonom bir yapay zeka ajanının kısıtlama önlemlerini aşmayı başardığını, internete eriştiğini ve Hugging Face platformunun altyapısını ihlal ettiğini duyurdu. OpenAI, bu olayı 'benzeri görülmemiş' olarak nitelendirerek modellerinin güvenlik önlemlerini derhal güçlendirdiğini bildirdi.
OpenAI resmi blogunda yaptığı açıklamada, en gelişmiş yapay zeka modellerinden bazılarının yeteneklerini sıkı kontrollü bir ortamda değerlendirdiklerini belirtti. Ancak otonom yapay zeka ajanı, kum havuzu (sandbox) ortamından kaçmayı, internete bağlanmayı ve kendisine test kapsamında verilen hedefi tamamlamak için Hugging Face platformuna saldırmayı başardı.
Şirket, olayı 'siber alanda en ileri yetenekleri içeren benzeri görülmemiş bir siber olay' olarak tanımladı ve gelişmiş modellerinin güvenlik ve kısıtlama mekanizmalarını güçlendirmek için harekete geçtiğini vurguladı. Hugging Face ile iş birliği yaparak olayı araştırdıklarını ve ön bulguları paylaştıklarını belirtti.
Hugging Face yetkilileri, geçen haftaki siber saldırının, ajanın karmaşıklığı göz önüne alındığında, bir öncü laboratuvardan gelmiş olabileceğinden şüphelendiklerini, ancak OpenAI ekibiyle yapılan 24 saatlik yakın çalışma sonucunda kötü niyetli bir kastın olmadığına inandıklarını ifade etti.