Yapay zeka modelleri, tıpkı bir öğrenci gibi kendisine gösterilen örneklerden öğrenir. Peki ders kitabına biri gizlice yanlış bilgiler eklerse ne olur? İşte Zehirli Veri Saldırısı tam olarak bu mantıkla çalışır. Saldırganlar, bir yapay zekanın eğitim verisine fark ettirmeden bozuk, yanıltıcı veya kötü amaçlı veriler sızdırır. Model bu veriyle "öğrenince" gerçek dünyada tuhaf, hatalı hatta tehlikeli kararlar verebilir. Örneğin bir görüntü tanıma sistemi, zehirlenmiş verilerle eğitildiğinde bir dur işaretini hız sınırı işareti sanabilir. En sinsi yanı, saldırı fark edilmeden aylarca sürebilir; çünkü sorun modelin kendisinde değil, ona öğretilen bilgide gizlidir.
Zehirli Veri Saldırısı (Data Poisoning)
Zehirli Veri Saldırısı, yapay zekaları eğitirken kullanılan verilere kasıtlı olarak yanlış veya zararlı bilgiler karıştırarak sistemin hatalı öğrenmesini sağlayan bir siber saldırı türüdür.