Yapay zekâ geliştiricileri, son dönemde ürünlerinin kötü niyetli aktörler tarafından istismar edilmesini engellemek amacıyla sıkı güvenlik protokolleri ve doğrulama süreçleri devreye soktu. Ancak bu durum, siber güvenlik alanında çalışan uzmanlar arasında ciddi endişelere yol açtı. Uzmanlar, alınan bu tedbirlerin yalnızca siber saldırganları değil, sistemleri korumaya çalışan araştırmacıları da engellediğini savunuyor.
Anthropic tarafından geliştirilen Mythos ve Fable adlı modeller, ABD hükümeti tarafından Haziran ayında ihracat kısıtlamalarına tabi tutuldu. Bu kararın arkasında, modellerin güvenlik bariyerlerinin aşılarak zararlı siber saldırılar geliştirilebileceğine dair hazırlanan bir raporun etkili olduğu ifade edildi. Kısıtlamaların ardından Fable 5 üzerindeki yasaklar 1 Temmuz itibarıyla kaldırılırken, Mythos 5 modeli yalnızca Amerika Birleşik Devletleri içinde doğrulanmış kuruluşların kullanımına yeniden açıldı.
Sektördeki bu yaklaşım, araştırmacılar tarafından sert bir dille eleştiriliyor. Deneyimli güvenlik araştırmacısı Mark Dowd, büyük teknoloji şirketlerinin güvenlik konusunda neyin güvenli olduğuna dair keyfi kararlar almasından rahatsızlık duyduğunu dile getirdi. NCC Group baş bilim insanı Chris Anley ise konuya farklı bir boyut getirerek, bir yazılım açığını tespit etmenin o açığı kapatmanın en önemli yolu olduğunu vurguladı. Anley, yapay zekâ modellerinin güvenlik gerekçesiyle bu tür talepleri reddetmesinin, savunma ekiplerini saldırganlardan daha fazla zor durumda bıraktığını belirtti.
Uzmanlar, aynı aracın hem saldırı hem de savunma amacıyla kullanılabildiğini, bu ikisinin birbirinden tamamen ayrılmasının mümkün olmadığını ifade ediyor. Bu engellerle karşılaşan araştırmacılar, genellikle herhangi bir kullanım kısıtlaması olmayan açık kaynaklı yapay zekâ modellerine yöneliyor. Paolo Stagno gibi uzmanlar, hassas güvenlik verilerinin bulut hizmetlerine yüklenmesi durumunda sızma riski taşıdığını veya gelecekteki eğitimlerde kullanılabileceğini belirterek, çalışmalarını kendi sistemlerindeki açık kaynaklı modellerle sürdürdüklerini aktarıyor.
Söz konusu tartışma, Hugging Face platformunda yaşanan bir güvenlik testi sırasında da gündeme geldi. Saldırı sırasında GPT-5.6 Sol veya Claude Fable 5 gibi ticari modellerin güvenlik kısıtlamaları nedeniyle savunma amaçlı analizlerin yapılamadığı görüldü. Bu nedenle şirket, saldırıyı analiz etmek için Çinli Z.AI firmasının geliştirdiği açık kaynaklı GLM5.2 modelini kullanmayı tercih etti.