Machine Ethics and Artificial Intelligence Safety (11118BLG001), week 13 of 14: interactive lab

Advanced Risks: Goal Misgeneralization, Power-Seeking and Deception

Prof. Dr. Utku Kose, Süleyman Demirel University