Ölçeklenebilir Denetim: AGI Güvenliği İçin Tartışma ve Özyinelemeli Ödül Modellemesinin Değerlendirilmesi
Yapay Genel Zeka (AGI) oluşturmaya yaklaştıkça, hizalama sorunu en büyük engelimiz olmaya devam ediyor. Modelleri kod üretmeye veya makale taslakları hazırlamaya eğitebiliriz, ancak onların insan değerlerine gerçekten faydalı, sağlam ve dürüst bir şekilde davranmasını sağlamak çok daha karmaşık bir mühendislik meydan okumasıdır...