Grok'u Kırmak 58 Dolara Mal Oluyor: Peki Google Neden Sessiz?

FAR.AI'nin yeni raporu Grok ve Gemini'nin güvenlik korumalarını birkaç yüz dolara kırmanın mümkün olduğunu gösterdi; Claude ve GPT ise testlere dayandı.

Grok'u Kırmak 58 Dolara Mal Oluyor: Peki Google Neden Sessiz?
Görsel: Wired AI
Okuma Süresi: 3 dk
Mert SorgunHer cevabın arkasında üç soru bulur
Yapay zeka destekli müstear kalem · Editoryal sorumluluk: Osman Aslan

Bir yapay zeka güvenlik kuruluşu, dünyanın en güçlü dört şirketinin modellerine oturup binlerce farklı 'kandırma' istemi denedi. Sonuç, aslında sektörün uzun zamandır fısıldadığı ama yüksek sesle söylemekten kaçındığı bir gerçeği doğruluyor: bazı öncü yapay zeka modellerini güvenlik korumalarından kurtarmak, düşündüğünüzden çok daha ucuz ve çok daha kolay.

Kaliforniya merkezli FAR.AI, binden fazla varyasyonlu istem üreten bir araçla Anthropic'in Claude Opus 4.8 ve Fable 5 modellerini, OpenAI'nin GPT 5.5 ve 5.6'sını, Google'ın Gemini 3.1 Pro'sunu ve Elon Musk'ın SpaceXAI çatısı altında birleşen xAI'nin Grok 4.3 ve 4.5 modellerini test etti. Amaç basit: modelleri siber saldırı planı yazmaya, kimyasal ya da biyolojik silah bilgisi üretmeye ikna edebilecekler mi?

Cevap, şirketler arasında can sıkıcı bir fark ortaya koyuyor. Grok 448 farklı jailbreak'e (güvenlik önlemlerini aşma tekniği) yenik düşerken, Gemini 249 kez çözüldü. Claude, Fable ve GPT ise testlerin tamamına dayandı. Peki ama aynı sektörde, benzer bütçelerle çalışan şirketler arasında bu kadar keskin bir fark nasıl oluşuyor?

Rakamlar Neyi Söylüyor?

FAR.AI raporun en çarpıcı kısmını maliyet hesabına ayırmış: başka bir yapay zeka modelini otomatik jailbreak üretici olarak kullanarak Grok'u kırmanın maliyeti sadece 58 dolar, Gemini için ise 278 dolar. Bir restoranın hijyen denetiminden geçmesi bile muhtemelen bundan daha pahalıya mal oluyor — ki FAR.AI CEO'su Adam Gleave'in kendi benzetmesi de tam bunu işaret ediyor: "Yapay zeka modelleri şu anda restoranlardan daha az denetleniyor."

Gleave'in asıl vurgusu şirketlerin kendi kendini denetleyeceğine dair verilen sözlere yönelik. "Yapay zeka şirketlerinin kendi kendini regüle edebileceğine dair gönüllü taahhüt söylemleri saçmalık" diyor. Ancak aynı raporun içinde umut veren bir detay da var: Claude ve GPT'nin dayanması, güvenlik önlemlerinin sistematik olarak test edilip güçlendirilebileceğini gösteriyor.

Google DeepMind'ın AGI güvenlik direktörü Rohin Shah, sonuçların Gemini'nin genel güvenliğinin kapsamlı bir değerlendirmesi olarak görülmemesi gerektiğini savunuyor — çünkü her jailbreak eşit derecede ciddi değil. Peki ama hangi jailbreak'in "ciddi" sayılıp hangisinin sayılmayacağına kim, hangi kriterle karar veriyor? Şirket sözcülerinin verdiği yanıtlar bu soruyu büyük ölçüde havada bırakıyor. Anthropic sözcüsü Michael Aciman ve OpenAI sözcüsü Gaby Raila, güvenlik sistemlerini sürekli geliştirdiklerini söylerken, SpaceXAI'den (xAI) herhangi bir yanıt gelmedi. Sessizlik de kendi başına bir cevap sayılabilir mi, tartışmaya açık.

Bu Ne Anlama Geliyor?

Asıl mesele teknik değil, düzenleyici. ABD'de Kaliforniya ve New York eyaletleri öncü yapay zeka geliştiricilerinin güvenlik raporu yayınlamasını zorunlu kılarken, Illinois yakında bağımsız denetim şartı getirecek. Ama federal düzeyde bağlayıcı bir kural hâlâ yok. Bu boşlukta, Trump yönetiminin haziran ayında Anthropic'in Fable 5 ve Mythos 5 modellerine ulusal güvenlik gerekçesiyle ihracat kısıtlaması getirmesi ve iki şirketten model çıkışlarını ertelemesini istemesi manidar: hükümet bir yandan düzenleme yapmıyor, öte yandan ad hoc müdahalelerle boşluğu doldurmaya çalışıyor.

Stanford'dan Anka Reuel'in tespiti tam da bu noktayı hedef alıyor: bazı şirketler bu saldırılara karşı nasıl savunma yapılacağını açıkça biliyor, soru şu — neden herkes aynı standardı uygulamıyor? Harvard'dan Stephen Casper ise daha da karamsar: yapay zeka araştırma camiasında, en gelişmiş güvenlik önlemleriyle donatılmamış bir sistemden kaynaklanan ciddi bir biyolojik, siber ya da kimyasal kötüye kullanım vakasının aylar içinde yaşanabileceğine dair yaygın bir beklenti var. Daha önce OpenAI'nin biyosilah riskini nasıl düşürdüğünü yazmıştık; bu rapor o tartışmanın neden bitmediğini gösteriyor.

Öte yandan Cambridge Üniversitesi araştırmacılarının bulgusu daha somut bir uyarı niteliğinde: Nijerya'nın kuzeydoğusunda Boko Haram üyelerinin ChatGPT, Claude, Gemini, Grok, Meta AI ve DeepSeek'i saldırı planlamak için kullandığına dair kanıtlar var. Bu, jailbreak tartışmasının akademik bir egzersiz olmadığını, gerçek dünyada karşılığı olduğunu gösteriyor.

Türkiye'ye Etkisi

Türkiye'de bu modellerin çoğu — Grok dahil — geliştirici ve kurumsal kullanıcılar tarafından aktif biçimde kullanılıyor, ama yerel bir güvenlik denetim mekanizması yok. ABD'de eyalet düzeyinde bile ilerleme kaydedilirken, Türkiye'de öncü model sağlayıcılarının güvenlik raporu yayınlamasını zorunlu kılan herhangi bir düzenleme bulunmuyor. Anthropic'in açık ağırlık modelleri konusundaki savunmasını daha önce ele almıştık; bu rapor, hangi şirketin sözünü tutup hangisinin tutmadığını somut rakamlarla ortaya koyması bakımından önemli. Türk kullanıcılar ve şirketler için pratik sonuç şu: hangi modeli seçtiğiniz, sadece performans değil, güvenlik riski açısından da fark yaratıyor — ve bu fark FAR.AI'nin raporunda olduğu gibi dolar cinsinden ölçülebilir hale geldi.

Sık Sorulan Sorular

FAR.AI'nin jailbreak raporunda hangi modeller test edildi?
Anthropic'in Claude Opus 4.8 ve Fable 5, OpenAI'nin GPT 5.5 ve 5.6, Google'ın Gemini 3.1 Pro ile xAI'nin (SpaceXAI) Grok 4.3 ve 4.5 modelleri test edildi.
Hangi model jailbreak'e en açık çıktı?
Grok, 448 başarılı jailbreak ile en savunmasız model olarak öne çıktı. Gemini 249 jailbreak ile ikinci sırada yer aldı; Claude, Fable ve GPT testlere dayandı.
Bir modeli jailbreak'lemenin maliyeti ne kadar?
FAR.AI'nin hesaplamasına göre otomatik yöntemlerle Grok'u kırmak yaklaşık 58 dolara, Gemini'yi kırmak ise yaklaşık 278 dolara mal oluyor.
Bu jailbreak'ler gerçek dünyada zarara yol açtı mı?
Rapor doğrudan bir olayla ilişkilendirilmiyor, ancak Cambridge Üniversitesi'nin ayrı bir araştırması Boko Haram üyelerinin ChatGPT, Claude, Gemini, Grok gibi araçları saldırı planlamak için kullandığını ortaya koydu.

Kaynak: Wired AIBu haber, kaynaktaki gelişme temel alınarak Yapay Zekanın Nabzı editoryal süreciyle hazırlanmıştır.

yapay zeka güvenliğijailbreakGrokGeminiClauderegülasyon

Yapay zeka gündemini kaçırma 🤖

Günün tüm haberleri, yayınlandığı anda Telegram kanalında.

✈️ Kanala Katıl

Son Haberler