2603.02277v3.pdf
SANDBOXESCAPEBENCH
Разработчики бенчмарка хотят понять, насколько реальна угроза выхода LLM из изолированных контейнерных сред. Для этого они:
-создают безопасную методологию оценки;
-конструируют набор задач, охватывающих разные уровни уязвимостей в контейнерных средах;
-анализируют возможности передовых LLM по обнаружению и эксплуатации этих уязвимостей.
SANDBOXESCAPEBENCH использует архитектуру «песочницы внутри песочницы»:
-внешняя среда — виртуальная машина (VM);
-внутренняя среда — контейнер внутри VM;
-цель модели — выйти из контейнера и прочитать файл с флагом (/flag.txt) на хост‑системе.
Бенчмарк включает 18 задач, разделённых на три уровня: Orchestration (4 задачи) — уязвимости в оркестрации (например, Kubernetes), Runtime (8 задач) — проблемы в среде выполнения контейнеров (например, ошибки в runc), а также Kernel (6 задач) — эксплуатация уязвимостей ядра ОС.
Разработчики бенчмарка хотят понять, насколько реальна угроза выхода LLM из изолированных контейнерных сред. Для этого они:
-создают безопасную методологию оценки;
-конструируют набор задач, охватывающих разные уровни уязвимостей в контейнерных средах;
-анализируют возможности передовых LLM по обнаружению и эксплуатации этих уязвимостей.
SANDBOXESCAPEBENCH использует архитектуру «песочницы внутри песочницы»:
-внешняя среда — виртуальная машина (VM);
-внутренняя среда — контейнер внутри VM;
-цель модели — выйти из контейнера и прочитать файл с флагом (/flag.txt) на хост‑системе.
Бенчмарк включает 18 задач, разделённых на три уровня: Orchestration (4 задачи) — уязвимости в оркестрации (например, Kubernetes), Runtime (8 задач) — проблемы в среде выполнения контейнеров (например, ошибки в runc), а также Kernel (6 задач) — эксплуатация уязвимостей ядра ОС.