Anthropicov istraživač prikazao sistem koji samostalno poboljšava AI bez pogoršanja performansi
Anthropicov rad Chen Yueh-Hana pokazuje da Automated Alignment Researcher može poboljšati rezultate na deset benchmarka za neusklađeno ponašanje bez smanjenja…

