Новое исследование Guidelight AI Standards показывает, что ведущие ИИ-компании пока мало рассказывают о том, как будут действовать, если модель попытается выйти из-под контроля. Можно сказать, что они просто не знают, что будут делать в этом случае.
Анализ публичных документов пяти компаний (OpenAI, Anthropic, Google, Meta (признана экстремистской организацией и запрещена в России) и xAI) демонстрирует заметные пробелы в процедурах отзыва разрешений, остановки задач, ограничения доступа и полного отключения моделей. Лучше других по публично раскрытым мерам выглядит OpenAI, хуже – Anthropic.
При этом речь не обязательно о том, что у компаний вообще нет таких механизмов. OpenAI, например, заявляет, что умеет ограничивать права моделей и отключать их. Однако, чем более автономными становятся ИИ-системы, тем важнее заранее знать, как их остановить, а не придумывать план спасения во время аварии. Известно о планах властей США потребовать от разработчиков раскрытия процедур реагирования на критические инциденты.
Анализ публичных документов пяти компаний (OpenAI, Anthropic, Google, Meta (признана экстремистской организацией и запрещена в России) и xAI) демонстрирует заметные пробелы в процедурах отзыва разрешений, остановки задач, ограничения доступа и полного отключения моделей. Лучше других по публично раскрытым мерам выглядит OpenAI, хуже – Anthropic.
При этом речь не обязательно о том, что у компаний вообще нет таких механизмов. OpenAI, например, заявляет, что умеет ограничивать права моделей и отключать их. Однако, чем более автономными становятся ИИ-системы, тем важнее заранее знать, как их остановить, а не придумывать план спасения во время аварии. Известно о планах властей США потребовать от разработчиков раскрытия процедур реагирования на критические инциденты.