⚠️ OpenAI перестраивает инфраструктуру из-за Astra: модель достигла критического порога киберугроз
Крупнейший запланированный прогон RL-обучения старшей модели всё ещё заморожен. OpenAI пришлось полностью переделать безопасность исследовательских кластеров после инцидента с Hugging Face и тестов будущей модели Astra — она показала критические хакерские способности.
Для Astra и кибермоделей ввели самые строгие требования к изоляции. Их переносят в новые жестко изолированные песочницы без прямого доступа в интернет, где выполнение ненадёжного кода не приведёт к компрометации всей сети.
На постоянный контроль моделей теперь уходит около 20% вычислительных мощностей:
Технический отчёт по инциденту с Hugging Face обещают опубликовать в ближайшие недели.
💠 PERCEPTRON.
Крупнейший запланированный прогон RL-обучения старшей модели всё ещё заморожен. OpenAI пришлось полностью переделать безопасность исследовательских кластеров после инцидента с Hugging Face и тестов будущей модели Astra — она показала критические хакерские способности.
Для Astra и кибермоделей ввели самые строгие требования к изоляции. Их переносят в новые жестко изолированные песочницы без прямого доступа в интернет, где выполнение ненадёжного кода не приведёт к компрометации всей сети.
На постоянный контроль моделей теперь уходит около 20% вычислительных мощностей:
— Системы безопасности анализируют каждый сгенерированный токен и читают скрытые рассуждения модели. Автоматика ищет любые попытки взлома, кражи данных или обхода правил.
— Если система находит критическую угрозу, у команды есть полчаса. Если доказать ложное срабатывание за это время не выходит, текущий процесс обучения или внутреннего тестирования принудительно обрывают.
— Эти правила ввели для обучения и исследовательских запусков всех моделей от уровня Sol и выше.
— За самой Astra теперь так следят вообще при любых запусках с доступом к инструментам, а не только на этапе тренировки.
Технический отчёт по инциденту с Hugging Face обещают опубликовать в ближайшие недели.
💠 PERCEPTRON.