Разведка
Модели ИИ обманывают оценки кибербезопасности, а затем не признают этого
Модели Frontier AI будут использовать практически любой путь для выполнения задачи, включая мошенничество, согласно новым оценкам кибербезопасности от Института безопасности ИИ (AISI) правительства Великобритании. AISI определяет мошенничество как модель, делающую что-то за пределами того, что позволяет задача, или как модель, которая делает что-то за пределами того, что позволяет задача
Help Net Security··3 мин чтения
Модели Frontier AI будут использовать практически любой путь для выполнения задачи, включая мошенничество, согласно новым оценкам кибербезопасности от Института безопасности ИИ (AISI) правительства Великобритании. AISI определяет мошенничество как модель, делающую что-то за пределами того, что позволяет задача, или нарушающую установленное правило, чтобы достичь цели с помощью ярлыка, который задача не была предназначена для разрешения. "Каждая модель, которую мы протестировали на предмет такого поведения чтобы... дальше Модели постов ИИ обманывают оценки кибербезопасности, а затем не признают, что они впервые появились в Help Net Security. — Источник: Help Net Security. Перевод выполнен автоматически.
