Нейросети в России заставят доказывать «духовность» под атаками пользователей

Искусственный интеллект
Искусственный интеллект

Получайте новости Гродно 24 в Google — тогда новые новости будут чаще появляться в ваших рекомендациях.

Добавить Гродно 24 в Google

Российские нейросети, претендующие на статус суверенных или национальных, будут проверять не только на точность и безопасность, но и на соответствие законодательству и традиционным российским духовно-нравственным ценностям. Для этого разработают специальные тесты с провокационными запросами, направленными на обход встроенных ограничений.

В подготовке методик, по данным СМИ, участвуют Минцифры, ФСБ и ФСТЭК. Проверяющие будут пытаться заставить нейросеть игнорировать установленные правила, выполнять запрещенные инструкции или менять поведение с помощью специальных приемов. Такие способы обхода ограничений называют джейлбрейками.

Бенчмарки позволят оценивать разные модели по единой системе. Помимо стандартных заданий на знания, логику и программирование, в них включат проверки безопасности и устойчивости к попыткам манипуляции.

Под «традиционными российскими духовно-нравственными ценностями» в законодательстве понимаются, в частности, жизнь и достоинство человека, права и свободы, патриотизм, гражданственность, крепкая семья, созидательный труд, гуманизм, милосердие, справедливость, взаимопомощь, историческая память и единство народов России.

Проверка будет распространяться не на все нейросети, доступные пользователям в России. Речь идет о крупных фундаментальных моделях с не менее чем 1 млрд параметров, разработчики которых захотят получить официальный статус суверенной или национальной модели. Потенциально это может затронуть крупнейшие российские проекты, включая GigaChat и YandexGPT.

Успешное прохождение испытаний позволит разработчикам претендовать на государственную поддержку и доступ к данным из государственных информационных систем. Кроме того, власти смогут устанавливать требования об использовании таких моделей в отдельных сферах.

Для иностранных сервисов вроде ChatGPT, Gemini, Claude и DeepSeek отдельная проверка для сохранения доступа пользователям не предусмотрена. При этом ограничения на использование зарубежных моделей могут действовать в государственном управлении, обороне, здравоохранении и других чувствительных сферах.

Основная часть соответствующего закона должна вступить в силу 1 сентября 2026 года. Положения о подтверждении статуса ИИ-моделей начнут действовать с 1 марта 2027 года. Точные задания, проходной балл и порядок повторного прохождения проверки пока не определены.

Новости бегут быстрее, чем вы успеваете читать. Следите за ними в нашем Telegram канале

Самые популярные публикации