Yapay zeka zehirleme, bir modele bilerek yanlış bilgi öğretilmesi anlamına geliyor. Amaç, modelin davranışını bozmak, hatalı sonuçlar üretmesini sağlamak veya gizli kötü niyetli komutlar yerleştirmek.Örneğin, bir saldırgan eğitim verisine fark edilmeyecek şekilde özel bir tetikleyici kelime ekliyor. Model, bu kelimeyle karşılaştığında otomatik olarak saldırganın istediği yönde cevap veriyor. Bu yöntem “arka kapı” (backdoor) saldırısı olarak biliniyor.
Bilim ve Teknoloji
Yayınlanma: 22 Ekim 2025 - 07:08
Yapay zekada yeni tehlike: Zehirli yapay zeka
Yapay zeka artık yalnızca hatalı cevaplar üretme riski değil, bilinçli olarak zehirlenme tehlikesiyle de karşı karşıya. İngiltere Yapay Zeka Güvenlik Enstitüsü, Alan Turing Enstitüsü ve Anthropic’in ortak araştırmasına göre, milyonlarca verinin yer aldığı bir eğitim setine sadece 250 zararlı dosya eklemek, bir modeli gizlice zehirleyebilir.
Bilim ve Teknoloji
22 Ekim 2025 - 07:08












