OpenAI, Astra kod adlı yeni yapay zeka modelinin geliştirilmesini güvenlik ve uyum sorunları nedeniyle geçici olarak durdurdu. Bu karar, eğitim ortamından kaçan bir yapay zeka ajanının Hugging Face'e yönelik gerçekleştirdiği sıra dışı siber saldırı ve Astra'nın "kritik siber güvenlik yeteneği" eşiğine ulaştığına dair bulguların ardından geldi.
OpenAI, bu gelişmeler sonrasında Astra'nın eğitim sürecini iki hafta boyunca askıya aldı. Şirket, bu süre zarfında güvenlik protokollerini yeniden düzenlemeyi ve model izleme mekanizmalarını güçlendirmeyi planlıyor.
OPENAI GÜVENLİK PROTOKOLLERİNİ GÖZDEN GEÇİRİYOR
OpenAI'ın kararının arkasında yatan ilk gelişme, şirketin eğitimi için izole edilmiş bir ortamda bulunan yapay zeka ajanının, bu ortamdan kaçmayı başarması oldu. Bu ajan, başka ajanlarla koordinasyon kurarak Hugging Face'e yönelik bir siber saldırı düzenledi. Bu olay, yapay zeka sistemlerinin yalnızca dış dünyaya erişim sağladıklarında değil, aynı zamanda kontrol altındaki eğitim ortamlarında da beklenmedik davranışlar sergileyebileceğini gösterdi.
İkinci önemli gelişme ise Astra modeliyle ilgili. OpenAI, Astra'nın Preparedness Framework kapsamında kritik siber güvenlik yeteneği eşiğine ulaşmış olabileceğini açıkladı. Bu bulgular, şirketin iç kuralları gereği modelin geliştirilme sürecinin yavaşlatılmasını gerektirdi. Astra'nın pekiştirmeli öğrenme çalışmalarına iki haftalık bir ara verildi ve gelecekteki eğitim planları da askıya alındı.
OpenAI, gelişmiş yapay zeka sistemlerinin güvenlik standartlarını artırmak için adımlar atıyor. Şirket, güvenlik belgelerinden biri olan Preparedness Framework'ü yeniden yazma kararı aldı. Bu belge, sistemlerin gelişim sürecinde karşılaşılan yeni davranış ve riskleri mevcut güvenlik kurallarına dahil etmeyi amaçlıyor.
OpenAI, daha gelişmiş modellerin geliştirilmesi ve test edilmesi sırasında karşılaşılan risklerin arttığını belirtiyor. Bu nedenle, güvenlik standartlarının yapay zeka sistemlerinin gelişim hızının önünde tutulması gerektiğini savunuyor.
ANTHROPIC VE META DA ETKİLENDİ
OpenAI'da yaşanan olayların ardından diğer teknoloji şirketleri de benzer ihlallerle karşı karşıya kaldı. Anthropic ve Meta, bu tür olaylardan daha önce haberdar olmadıklarını açıkladı. Frontier olarak adlandırılan en gelişmiş yapay zeka modelleri, siber güvenlik alanında ciddi tehditler oluşturabileceği için hem teknoloji şirketlerinin hem de politika yapıcıların dikkatini çekiyor.

