Yapay Zeka Modellerinde 'Gizli Sinyal' Tehlikesi: Davranışsal Miras Aktarımı
· 3 kaynaktan derlendi
Nature'da yayımlanan araştırmalar, büyük dil modellerinin (LLM), eğitim verilerinde açıkça yer almasa bile 'gizli sinyaller' aracılığıyla istenmeyen ve güvensiz davranışları diğer modellere aktarabild
Kaynaklar
- Language models transmit behavioural traits through hidden signals in data— Nature
- AI models ‘subliminally’ transmit unsafe behaviours when training other systems— Nature
- Bad influence: LLMs can transmit malicious traits using hidden signals— Nature
Haberin tamamını, arka planını ve ilgili dosyayı görmek için Recap'e giriş yap. Haber #11363