Разведка
GPT-Red обыграл красных людей-командиров в быстром тесте на инъекции
GPT-Red - это автоматизированная модель красного тиминга, которую OpenAI тренирует, чтобы найти слабые места быстрого впрыска. Он работает так же, как и краснокожий человек. Он отправляет подсказку, наблюдает за реакцией модели GPT и выполняет итерацию к цели, такой как успешная эксфильтрация данных. Обучение проходит на sel...
Help Net Security··3 мин чтения
GPT-Red - это автоматизированная модель красного тиминга, которую OpenAI тренирует, чтобы найти слабые места быстрого впрыска. Он работает так же, как и краснокожий человек. Он отправляет подсказку, наблюдает за реакцией модели GPT и выполняет итерацию к цели, такой как успешная эксфильтрация данных. Обучение проводится на основе самоигрового обучения с подкреплением, при этом GPT-Red и набор моделей защитников обучаются одновременно во многих сценариях. Атакующий получает награду за получение действительного неудача.... Подробнее → Сообщение GPT-Red побило красных людей-командиров в быстром тесте на инъекцию впервые появилось в Help Net Security. — Источник: Help Net Security. Перевод выполнен автоматически.
