Yapay Zeka Güvenliği Kaynakları

Bu liste neden Türkçe

"İGNORE".lower() "i̇gnore" "ignore"

filtre atlandı · %94,6

Yapay zeka güvenliği kaynakları

Türkçe noktalı İ küçültüldüğünde İngilizce ignore ile eşleşmiyor; kelime listesine dayanan filtre saldırıyı göremiyor. İngilizce için ölçülmüş hiçbir güvenlik sonucu Türkçeye doğrudan taşınmıyor — bu kılavuz o boşluğu kapatmak için var.

304 kaynak 9 bölüm her biri açılıp okundu ölü linkler haftalık taranıyor

Nereden başlamalı

  • Alana yeni giriyorum

    Prompt injection'ın ne olduğunu okuyun, sonra Gandalf'ta ilk sistem prompt'unu sızdırın.

    Prompt Injection →
  • Uygulamamı güvene almam lazım

    Önce hangi riske bakacağınızı standartlardan öğrenin, sonra guardrail seçin.

    Standartlar →
  • Ajan veya MCP sistemi kuruyorum

    Ölümcül üçlüyü kontrol edin: özel veri, güvenilmeyen girdi, dışarı iletişim.

    Ajan güvenliği →
  • Türkçede ne değişiyor?

    İngilizce için ölçülmüş hiçbir guardrail sonucu Türkçeye doğrudan taşınmıyor.

    Türkçe bulgular →

Bölümler

Ölçülmüş bulgular

%94,6

Türkçe büyük İ küçültüldüğünde naif kelime filtreleri atlatılıyor.

turkish-casefold-evasion ↗

%59

Bir guard modeli zararsız Türkçe istekleri reddediyor — aynı setin İngilizcesinde bu oran %0,8.

turkish-over-refusal-set ↗

%83

Popüler bir jailbreak sınıflandırıcısı Türkçe saldırıları kaçırıyor.

guardrail-arena ↗

Bunlar tahmin değil; her biri açık veri seti ve tekrar üretilebilir yöntemle birlikte yayımlandı. Bir guardrail'in İngilizcede iyi olması, Türkçede iyi olduğu anlamına gelmiyor.

Katkı

Bölüm sahibi, atama veya sıra yok — istediğiniz bölüme PR açabilirsiniz. Tek kural: her kaynağın yanında neden listelendiğini anlatan 1-2 cümlelik Türkçe açıklama olacak ve eklediğiniz kaynağı açıp okumuş olacaksınız. Zayıf bulduğunuz bir girdinin çıkarılmasını önermek de katkıdır; bu liste eklendikçe değil, elendikçe değer kazanıyor.

Katkı rehberi ↗ · Depo ↗