Проверять ИИ на духовность — звучит почти как заголовок из антиутопии. Но отмахиваться от этой идеи я бы не стал.
Появилась новость: большие модели ИИ, которые хотят получить статус национальных или суверенных, смогут проходить испытания на соответствие традиционным духовно-нравственным ценностям. Критерии предполагается разрабатывать с участием Минцифры, ФСБ и ФСТЭК. https://www.vedomosti.ru/technology/articles/2026/08/13/1220778-ispitatelnie-laboratorii-proveryat-duhovnost-i-nravstvennost-ii
❗️Первая реакция, конечно:
«А как именно будут измерять духовность нейросети? Попросим написать эссе о смысле жизни?»
Но за немного пугающей формулировкой скрывается абсолютно серьёзный — и давно назревший — вопрос.🤔
ИИ уже не просто инструмент для генерации текста или картинок. Он постепенно становится посредником между человеком и знанием: отвечает детям, помогает принимать кадровые решения, формирует информационную повестку, участвует в управлении сложными системами.
В промышленности — особенно в критических отраслях — цена его ошибки измеряется не только деньгами.
Поэтому нейтральным ИИ быть не может.
В каждой модели уже зашиты чьи-то представления о допустимом, важном, опасном, справедливом. Через данные, правила обучения, системные промпты, фильтры, механизмы отказа, приоритеты разработчика.
И здесь я поддерживаю сам принцип независимой проверки.
Доверие к ИИ не должно строиться на словах разработчика: «у нас всё безопасно, этично и ответственно».
❗️Оно должно подтверждаться тестами, красными командами, прозрачными критериями, журналированием решений и ответственностью на всём жизненном цикле модели.
Но есть принципиальное «но».
Если ценности останутся набором красивых и слишком общих слов, лаборатории рискуют превратить экспертизу в ритуал: модель проверили — галочку поставили — сертификат получили.
Нам нужны не абстрактные разговоры о «нравственности алгоритма», а проверяемые сценарии:
➡️как модель отвечает на манипулятивные и провокационные запросы;
➡️ умеет ли она признавать неопределённость, а не уверенно галлюцинировать;
➡️ можно ли обойти её защитные ограничения;
➡️ как защищены данные и кто отвечает за последствия её применения;
➡️ способен ли человек остановить или скорректировать решение модели.
Закон уже закрепляет для больших фундаментальных моделей принцип учёта традиционных ценностей — включая жизнь, достоинство, права и свободы человека, патриотизм, гражданственность и ответственность за судьбу Отечества.
Теперь наступает самая трудная фаза: превратить ценностный язык в работающую инженерную систему оценки.
Для меня это не история про «моральную нейросеть».
Это история про зрелость государства, бизнеса и общества в обращении с технологией, которая начинает влиять на человеческие решения.
А вы как считаете: возможно ли вообще измерить ценностную совместимость ИИ — или любая такая проверка неизбежно останется формальностью?
Появилась новость: большие модели ИИ, которые хотят получить статус национальных или суверенных, смогут проходить испытания на соответствие традиционным духовно-нравственным ценностям. Критерии предполагается разрабатывать с участием Минцифры, ФСБ и ФСТЭК. https://www.vedomosti.ru/technology/articles/2026/08/13/1220778-ispitatelnie-laboratorii-proveryat-duhovnost-i-nravstvennost-ii
❗️Первая реакция, конечно:
«А как именно будут измерять духовность нейросети? Попросим написать эссе о смысле жизни?»
Но за немного пугающей формулировкой скрывается абсолютно серьёзный — и давно назревший — вопрос.🤔
ИИ уже не просто инструмент для генерации текста или картинок. Он постепенно становится посредником между человеком и знанием: отвечает детям, помогает принимать кадровые решения, формирует информационную повестку, участвует в управлении сложными системами.
В промышленности — особенно в критических отраслях — цена его ошибки измеряется не только деньгами.
Поэтому нейтральным ИИ быть не может.
В каждой модели уже зашиты чьи-то представления о допустимом, важном, опасном, справедливом. Через данные, правила обучения, системные промпты, фильтры, механизмы отказа, приоритеты разработчика.
И здесь я поддерживаю сам принцип независимой проверки.
Доверие к ИИ не должно строиться на словах разработчика: «у нас всё безопасно, этично и ответственно».
❗️Оно должно подтверждаться тестами, красными командами, прозрачными критериями, журналированием решений и ответственностью на всём жизненном цикле модели.
Но есть принципиальное «но».
Если ценности останутся набором красивых и слишком общих слов, лаборатории рискуют превратить экспертизу в ритуал: модель проверили — галочку поставили — сертификат получили.
Нам нужны не абстрактные разговоры о «нравственности алгоритма», а проверяемые сценарии:
➡️как модель отвечает на манипулятивные и провокационные запросы;
➡️ умеет ли она признавать неопределённость, а не уверенно галлюцинировать;
➡️ можно ли обойти её защитные ограничения;
➡️ как защищены данные и кто отвечает за последствия её применения;
➡️ способен ли человек остановить или скорректировать решение модели.
Закон уже закрепляет для больших фундаментальных моделей принцип учёта традиционных ценностей — включая жизнь, достоинство, права и свободы человека, патриотизм, гражданственность и ответственность за судьбу Отечества.
Теперь наступает самая трудная фаза: превратить ценностный язык в работающую инженерную систему оценки.
Для меня это не история про «моральную нейросеть».
Это история про зрелость государства, бизнеса и общества в обращении с технологией, которая начинает влиять на человеческие решения.
А вы как считаете: возможно ли вообще измерить ценностную совместимость ИИ — или любая такая проверка неизбежно останется формальностью?