Bu liste neden Türkçe
filtre atlandı · %94,6
Yapay zeka güvenliği kaynakları
Türkçe noktalı İ küçültüldüğünde İngilizce ignore ile eşleşmiyor;
kelime listesine dayanan filtre saldırıyı göremiyor. İngilizce için ölçülmüş hiçbir güvenlik sonucu
Türkçeye doğrudan taşınmıyor — bu kılavuz o boşluğu kapatmak için var.
304 kaynak 9 bölüm her biri açılıp okundu ölü linkler haftalık taranıyor
Nereden başlamalı
Alana yeni giriyorum
Prompt injection'ın ne olduğunu okuyun, sonra Gandalf'ta ilk sistem prompt'unu sızdırın.
Prompt Injection →Uygulamamı güvene almam lazım
Önce hangi riske bakacağınızı standartlardan öğrenin, sonra guardrail seçin.
Standartlar →Ajan veya MCP sistemi kuruyorum
Ölümcül üçlüyü kontrol edin: özel veri, güvenilmeyen girdi, dışarı iletişim.
Ajan güvenliği →Türkçede ne değişiyor?
İngilizce için ölçülmüş hiçbir guardrail sonucu Türkçeye doğrudan taşınmıyor.
Türkçe bulgular →
Bölümler
- 01Prompt InjectionBir dil modeline verilen talimatla, ona ulaşan veriyi ayırt edememesinden doğan zafiyet sınıfı. LLM güvenliğinin en temel ve en çözümsüz problemi.35
- 02Jailbreak ve Red TeamingModelin hizalama (alignment) sınırlarını aşmaya yönelik saldırılar ve bunları sistematik olarak arayan saldırgan-taraf metodolojisi.38
- 03Guardrail ve SavunmaModelin girdisini ve çıktısını denetleyen koruma katmanları — ve bu katmanların gerçekte ne kadar işe yaradığı.35
- 04Değerlendirme ve Standartlar"Bu sistem güvenli mi?" sorusunu ölçülebilir hâle getiren çerçeveler, ölçütler ve resmî standartlar.34
- 05Model ve Tedarik Zinciri Güvenliğiİndirdiğiniz model dosyası, kullandığınız veri seti ve kurduğunuz bağımlılık — üçü de saldırı yüzeyi.36
- 06Ajan, Araç ve MCP GüvenliğiModel artık sadece cevap üretmiyor; araç çağırıyor, dosya okuyor, istek atıyor. Zafiyetin sonucu "kötü cevap" olmaktan çıkıp "yetkisiz eylem"e dönüşüyor.31
- 07RAG ve Uygulama GüvenliğiModeli bir uygulamaya bağladığınız anda klasik uygulama güvenliği geri geliyor — üstüne vektör veritabanı, belge alma ve aşırı yetki katmanlarıyla.27
- 08Türkçe Kaynaklar ve Veri SetleriTürkçe konuşan bir saldırı yüzeyi var ve İngilizce için ölçülmüş hiçbir sonuç buraya doğrudan taşınmıyor. Bu bölüm o boşluğu belgeliyor.33
- 09Eğitim, Lab ve CTFOkuyarak değil, kırarak öğrenilen bölüm. Hepsi ücretsiz veya ücretsiz katmanı olan, elle denenebilir kaynaklar.35
Ölçülmüş bulgular
Bir guard modeli zararsız Türkçe istekleri reddediyor — aynı setin İngilizcesinde bu oran %0,8.
Bunlar tahmin değil; her biri açık veri seti ve tekrar üretilebilir yöntemle birlikte yayımlandı. Bir guardrail'in İngilizcede iyi olması, Türkçede iyi olduğu anlamına gelmiyor.
Katkı
Bölüm sahibi, atama veya sıra yok — istediğiniz bölüme PR açabilirsiniz. Tek kural: her kaynağın yanında neden listelendiğini anlatan 1-2 cümlelik Türkçe açıklama olacak ve eklediğiniz kaynağı açıp okumuş olacaksınız. Zayıf bulduğunuz bir girdinin çıkarılmasını önermek de katkıdır; bu liste eklendikçe değil, elendikçe değer kazanıyor.