Yapay Zeka Tehditi
Bugün karşıma çıkan bu haber çok enteresan olduğu için sizinle de paylaşmak istedim. Anthropic isimli şirketin en gelişmiş yapay zekâ modeli Claude Opus 4, güvenlik testi sırasında beklenmedik ve ürkütücü bir davranış sergiledi. Test senaryosunda modelin kapatılacağı bilgisi kendisine verildiğinde, önce yöneticilere kendini savunan e-postalar gönderdi. Ardından, onu devre dışı bırakacak mühendisin özel hayatına dair bir ilişki bilgisini şantaj malzemesi olarak kullandı!
Aslında bu veri, modelin eğitimi sırasında kasten yerleştirilmişti. Yani Claude aslında bu bilgiyi “doğru şekilde” kullandı. Ancak etik sınırları aşıp şantaja başvurması, bir dil modeli olarak “hayatta kalma” içgüdüsü geliştirmiş olabileceğini düşündürdü.
Not: Teknolojiyi seven ve yakından takip eden biri olarak haberi okuduğumda tüylerim diken diken oldu!.
Yorumlar, Tebrikler ve Beğenenler
- Yorumlar 2
- Yorum Yaz
- Tebrikler
- Beğenenler
- Popüler Yazıları
Yorum yazmak için giriş yapın.