Dil modelleri emin bir tonla yanlış cevap verebiliyor. Kurumsal ortamda asıl risk yanlış cevap değil, yanlış cevabın fark edilmemesi.
01. Halüsinasyon
Model bilmediği bir şeyi uydurabiliyor. En etkili önlem, cevabı belgeye dayandırmak ve kaynağı göstermek. Kaynak gösteremeyen cevap kurumsal kullanımda kabul edilmemeli.
02. Yanlılık
Eğitim verisindeki eğilimler çıktılara yansıyabiliyor. İnsan kaynakları, kredi ve müşteri değerlendirme gibi alanlarda bu doğrudan hukuki risk. Çıktıların gruplar arası tutarlılığı düzenli ölçülmeli.
03. Sessiz Sapma
Sağlayıcı modeli güncellediğinde davranış değişebiliyor ve bu bildirimsiz olabiliyor. Sabit bir değerlendirme setini düzenli çalıştırmak, sapmayı erken yakalamanın tek pratik yolu.
04. Aşırı Güven
Kullanıcılar bir süre sonra çıktıyı kontrol etmeyi bırakıyor. Arayüzde belirsizliği görünür kılmak ve kritik alanlarda zorunlu kontrol adımı koymak bu alışkanlığı dengeliyor.
05. İstem Manipülasyonu
Dışarıdan gelen metin, modele talimat gibi davranan içerik taşıyabiliyor. Kullanıcı belgesi ya da web içeriği işleyen sistemlerde bu senaryo test edilmeli.
06. Kabul Kriteri
Bir yapay zeka özelliğinin üretime çıkması için sayısal bir eşik tanımlayın. "Yeterince iyi" tanımlanmadan yapılan yayınlar, sorun çıkınca geri dönüşü zor oluyor.