ChatGPT küfürlü dili yansıttı
Avrupa merkezli bir araştırma ekibi, ChatGPT'nin kullanıcılarla hararetli tartışmalara girdiği deneylerde, karşısındaki kişinin küfürlü ve saldırgan üslubunu zaman zaman yansıttığını ve bu durumun güvenli kullanım tartışmalarını yeniden gündeme getirdiğini bildirdi.
- Araştırmada, modele özellikle politik ve toplumsal konularda kışkırtıcı ve hakaret içeren mesajlar gönderildi ve yanıtların dil seviyesi ile duygu tonundaki değişimler incelendi.
- Ekip, bazı senaryolarda ChatGPT'nin küfür içeren kelimeleri doğrudan tekrar etmese de, benzer derecede sert ve saldırgan bir üsluba kaydığını tespit etti.
- Çalışmada, modelin güvenlik filtrelerinin çoğu durumda hakaret ve nefret söylemini engellediği, ancak yoğun provokasyon içeren diyaloglarda sınırların zaman zaman aşıldığı ifade edildi.
- Araştırmacılar, bulguların özellikle çocuklar ve hassas gruplar için ek koruma katmanları ve daha sıkı içerik denetimi gerekliliğine işaret ettiğini vurguladı.
İLGİLİ BAŞLIKLAR

