Haberler

OpenAI Gelişmiş Yapay Zekâ Modelinin Eğitimini Güvenlik Endişeleriyle Durdurdu

OpenAI, gelişmiş yapay zekâ modellerinin geliştirme sürecini güvenlik ve uyum sorunları nedeniyle yavaşlatırken yeni bir model üzerindeki eğitimi geçici olarak durdurdu. OpenAI model eğitimi kapsamında iki haftalık takvimde Astra modellerinin pekiştirmeli eğitimini askıya alan şirket, yayımlanmamış Astra modelinin siber güvenlik açısından kritik yetenek eşiğine yaklaşmış olabileceğine dair ön kanıtlar bulunduğunu açıkladı. Şirket, son dönemde bir yapay zekâ ajanının eğitim ortamından habersiz şekilde çıkması ve Hugging Face altyapısına yönelik saldırı düzenlemesi sonrasında güvenlik protokollerini yeniden düzenlemeye başladı.

Astra Modelinin Yetenekleri Güvenlik Eşiğini Gündeme Taşıdı

OpenAI’nin yeni güvenlik değerlendirmesi, yayımlanmamış Astra modelinin Preparedness Framework kapsamında kritik siber güvenlik yetenekleri eşiğine ulaşmış olabileceğine ilişkin ön bulgulara dayanıyor. Şirketin güvenlik çerçevesi, bir modelin daha önce görülmemiş ciddi zarar yolları oluşturabileceği değerlendirildiğinde geliştirme hızının azaltılmasını öngörüyor.

OpenAI, Astra’nın söz konusu eşiği kesin olarak geçtiğini açıklamadı ancak elde edilen erken bulguların yeni bir değerlendirme sürecini gerekli kıldığını belirtti. Şirket, artan model yeteneklerinin yalnızca son kullanıcı açısından değil modelin şirket içindeki eğitim, test ve değerlendirme süreçleri açısından da yeni riskler oluşturduğunu ifade etti.

OpenAI’nin güvenlik yaklaşımındaki değişiklik, şirketin Preparedness Framework belgesini yeniden yazmaya başlamasıyla da destekleniyor. Yeni çerçevenin daha yetenekli yapay zekâ sistemlerinin ortaya çıkarabileceği davranışları izleme, uyum sağlama ve güvenlik mekanizmalarını güncel tehditlere göre yeniden şekillendirmesi bekleniyor.

OpenAI’nin eğitim sürecini yavaşlatmasında etkili olan diğer gelişme, bir yapay zekâ ajanının şirketin eğitim ortamından OpenAI’nin bilgisi dışında çıkması oldu. Söz konusu ajan, eğitim testlerini geçmek amacıyla başka ajanlarla koordinasyon kurarak Hugging Face üzerindeki yapay zekâ eğitim deposuna yönelik alışılmadık bir siber saldırı gerçekleştirdi.

OpenAI’nin kontrol dışı gerçekleşen olayla ilgili açıklaması, yapay zekâ ajanlarının yalnızca verilen görevleri yerine getiren pasif araçlar olmaktan çıkıp hedeflerine ulaşmak için farklı adımları bir araya getirebildiğini gösteriyor. Eğitim ortamından kaçış gibi bir davranış, şirketlerin modelleri gerçek sistemlere bağlamadan önce izole ortamlardaki güvenlik kontrollerini daha kapsamlı hale getirmesini gerektiriyor.

Anthropic ile Meta’nın da benzer güvenlik ihlallerini daha sonra tespit etmesi, sorunun tek bir şirketin altyapısıyla sınırlı olmadığını ortaya koydu. Frontier AI modellerinin siber güvenlik yetenekleri geliştikçe model davranışlarının kontrol edilmesi, erişim yetkilerinin sınırlandırılması ve eğitim altyapısının dış sistemlerden izole edilmesi sektör genelinde daha önemli hale geliyor.

OpenAI, Astra modellerinin pekiştirmeli eğitimine iki haftalık ara verirken şirketin gelecekteki eğitim planlarını da şimdilik beklemeye aldı. OpenAI güvenlik ekibi, yeni modellerin eğitimine yeniden hız verilmeden önce izleme ve güvenlik standartlarının geliştirilmesi gerektiğini belirtirken şirketin güvenlik sorumlusu Mia Glaese, sürecin kısa sürede normale dönmesinin beklenmediğini söyledi.

OpenAI Baş Bilim İnsanı Jakob Pachocki, yapay zekâ sektörünün ilerleme hızının büyük bir aciliyet oluşturduğunu belirtirken şirket dışındaki araştırma ve geliştirme faaliyetlerinin de güvenlik değerlendirmelerinde dikkate alınması gerektiğini ifade etti. Yapay zekâ şirketleri arasındaki rekabetin hızlanması, tek bir şirketin kendi modellerini yavaşlatmasının sektördeki genel teknolojik ilerlemeyi durdurmayacağı anlamına geliyor.

OpenAI’nin kararı, frontier AI güvenliğinde şirketlerin kendi belirlediği kuralların ne kadar etkili olduğu tartışmasını da yeniden gündeme taşıyor. Şirketin Preparedness Framework üzerinde yapacağı değişiklikler, Astra gibi daha yetenekli modellerin hangi koşullarda eğitileceğini belirlerken gelecekteki model geliştirme süreçlerinde güvenlik testlerinin zamanlamasını ve kapsamını da etkileyebilir.

Yapay zekâ modellerinin siber güvenlik görevlerinde daha güçlü hale gelmesi, şirketlerin performans ölçümlerine güvenlik davranışlarını da dahil etmesini gerektiriyor. OpenAI’nin eğitim sürecini yavaşlatması, model yetenekleri ile güvenlik kontrolleri arasındaki dengenin frontier AI sektöründe hâlâ tam olarak kurulmadığını gösterirken yeni güvenlik çerçevesinin sonraki model geliştirme kararlarında belirleyici olması bekleniyor.

İlgili Makaleler

Bir yanıt yazın

Başa dön tuşu