Hubinger merujuk laporan risiko terbaru Anthropic, dan menyebut ancaman dari model AI yang ada saat ini tergolong rendah. 

Yang ia khawatirkan, kecerdasan super yang lahir dari proses AI memperbaiki dirinya sendiri secara berulang. 

Hubinger sendiri memimpin tim yang tugasnya mencari titik lemah pada teknik alignment milik Anthropic. 

Tujuannya, supaya kelemahan itu ditemukan lebih dulu, sebelum muncul di model yang sudah dipakai publik. (Wartabanjar.com)