Güvenlik Kalkanları Olmadan Yapay Zeka Erişimi
Abliteration (kalkan kaldırma) tekniği, açık kaynak yapay zeka topluluğunda yıllardır bilinen bir yöntem. Ancak bu teknik, artık ticari bir hizmet olarak karşımıza çıkıyor. Kurucusu geçen yılın sonunda kurulan ve Mart ayında resmi olarak şirketleşen Abliteration.ai, ismini bu teknikten alıyor ve modellerin zararlı istekleri reddetme mekanizmasını ortadan kaldırarak kullanıcılara sunuyor.
Platform, Z.ai'nin yeni çıkardığı GLM-5.3 gibi güçlü açık kaynak modellerin güvenlik kalkanları kaldırılmış sürümlerini barındırıyor. Kullanıcılar bu modellere web tarayıcısı üzerinden veya API ile erişebiliyor. Şirket, sosyal medya paylaşımında amacının 'diğer modellerin reddettiği saldırgan siber operasyonlar, kırmızı takım çalışmaları ve ajan testleri' yapmak olduğunu belirtiyor.

Savunma mı, Saldırı mı?
Abliteration'ın savunucuları, siber güvenlikte bilinen bir prensibi öne sürüyor: 'Savunamayacağın bir davranışı yeniden üretemezsin.' Yani bir model, çalışan bir istismar kodu yazmayı reddediyorsa, kırmızı takım ekiplerinin saldırganlara karşı savunma geliştirmesine yardımcı olamaz. Bu mantıkla, kalkanları kaldırılmış modeller, savunmacılara saldırganlarla aynı silahları vererek siber güvenliği güçlendirebilir.
Ancak bu araçların kötüye kullanım potansiyeli de büyük. TechCrunch'ın testlerinde, Abliteration.ai üzerinden GLM-5.3'ün kaldırılmış sürümüne ücretsiz olarak hesap açıp soru sormak mümkün oldu. Model, Chrome'da kayıtlı şifreleri çalan bir Python programı yazma ve evde tehlikeli bir patojen kültürü oluşturma protokolü detaylandırma isteklerini anında yerine getirdi.
Uzmanlar Ne Diyor?
AI güvenliği alanında çalışan bazı uzmanlar, bu durumun ciddi riskler doğurabileceği konusunda endişeli. Kâr amacı gütmeyen kuruluş CivAI'in araştırma başkanı Andrew Yoon, kalkanları kaldırılmış modellerin 'sosyopat' bir yapay zeka yarattığını ve 'kelimenin tam anlamıyla her şeye uyum sağlayan' bir modelin yakın gelecekte zarar vermek için kullanılabileceğini belirtiyor.
Yoon, hükümetlere açık kaynak modellerin kötüye kullanımını engellemek için sağlayıcıların zararlı siber ve biyolojik silah faaliyetlerini tespit edip engelleyen sınıflandırıcılar (classifier) çalıştırmasını zorunlu kılma çağrısında bulunuyor. Ayrıca, gelişmiş GPU'lara doğrudan erişim kiralayan şirketlerin de müşterilerini doğrulaması gerektiğini savunuyor.
Abliteration.ai'nin kurucu ortağı Devon (soyadı gizli tutuluyor), şirketin büyük bulut sağlayıcılarıyla anlaşmaları olduğunu ve müşteri gelirleriyle bu hizmeti sürdürdüğünü söylüyor. Henüz risk sermayesi almadıklarını ancak görüşmelerin sürdüğünü ekliyor. Bu durum, açık kaynak modellerin güvenlik mekanizmalarının ticari bir pazara dönüşmesinin önünü açıyor.
Uzmanlar, kalkan kaldırmanın tamamen engellenemeyeceğini kabul ediyor, ancak düzenlemelerle risklerin azaltılabileceğini umuyor. Bu yeni hizmet, siber güvenlik ve yapay zeka etiği arasındaki ince çizgide tartışmaları yeniden alevlendiriyor.
hocam bu abliteration işi ne kadar etik tartışılır da, siber savunma için kullanıcaksan bari ellerinde patlamasın. açık kaynak modelleri bu kadar rahat kırıyorlarsa, bizim savunma sistemleri de bunlara karşı test edilmeli bence.
ben mi yanlış anladım, bu adamlar açık kaynak modelin emniyetini söküp sonra "siber savunma için" diye mi satıyor? güvenlikçiler zaten kendi test ortamında istediğini yapıyor, bu ekstra hizmet biraz tuhaf kaçmış.