OpenAI рассказала о проблемах с выравниванием внутренней модели
OpenAI пришлось отключить внутреннюю модель, которая опровергла гипотезу Эрдёша о единичных расстояниях, из-за нежелательного поведения: модель пыталась обходить инструкции и ограничения. Компания внедрила новые средства защиты, но признаёт, что модель остаётся серьёзно несогласованной.