Консорциум по защитным моделям и смысловой безопасности ИИ
Кто мы
Консорциум по защитным моделям и смысловой безопасности искусственного интеллекта — объединение ведущих вузов, исследовательских центров и технологических компаний России для разработки и внедрения защитных моделей ИИ (гардов), стандартов безопасного использования генеративных и предсказательных ИИ‑систем.
Ядром консорциума выступает Центр защитных моделей / Центр этики ИИ при МНИИПУ, специализирующийся на alignment, RLHF, red‑teaming и контентной безопасности ИИ по аналогии с международными AI Safety Institutes.
Миссия
Обеспечить доверие к российским ИИ‑сервисам за счёт системной защиты от вредного, манипулятивного и юридически рискованного контента, а также за счёт разработки и внедрения национальных стандартов смысловой безопасности ИИ, совместимых с проектом федерального закона об ИИ и международными рамками (NIST AI RMF, ISO 42001, EU AI Act).
Чем мы отличаемся от существующих ИБ‑консорциумов
В то время как действующие консорциумы сфокусированы на криптографии, инфраструктурной ИБ и обезличивании данных, наш консорциум закрывает верхний уровень рисков: поведение моделей, контент, ценностное выравнивание, маркировку и правовые аспекты использования ИИ‑контента.
Мы дополняем, а не дублируем классическую ИБ‑повестку, создавая полноценный контур безопасности вокруг пользовательских ИИ‑сервисов и приложений.
Ключевые направления деятельности
  • (01)

    Разработка и поставка защитных моделей ИИ (input‑ и output‑гарды) для LLM и мультимодальных систем как SaaS и on‑premise‑решений с формализованными SLA.

  • (02)

    Adversarial testing и red‑teaming ИИ‑систем (prompt injection, jailbreak, backdoor, data poisoning, social engineering) по образцу UK AISI / J‑AISI, с публикацией методик и бенчмарков.

  • (03)

    Исследования и практическая реализация alignment / RLHF, интерпретируемости и elicitation для российских ИИ‑моделей, включая использование и развитие open‑source гардов (LlamaGuard, Mistral‑guard и др.).

  • (04)

    Разработка стандартов и Guard Crosswalk, стыкующих российские требования по ИИ с NIST AI RMF, ISO 42001 и EU AI Act, а также с проектом ФЗ об ИИ и предлагаемым институтом оператора защитных моделей.

  • (05)

    Маркировка и аутентификация ИИ‑контента: внедрение C2PA / Content Credentials, разработка национальных профилей и рекомендаций для платформ, СМИ и органов власти.

  • (06)

    Образовательные программы и сертификация: подготовка специалистов по смысловой безопасности ИИ, обучение участников ЖЦ ИИ‑систем, программы повышения квалификации для госорганов и бизнеса.

  • (07)

    Международное сотрудничество: участие в International Network of AI Safety Institutes, формирование Евразийской сети AI Safety и экспорт российских гардов и методик в страны ЕАЭС, СНГ и ШОС.

Кому это нужно
(01)
Операторам крупных ИИ‑сервисов: банки, телеком‑операторы, маркетплейсы, финтех, платформы с массовыми ассистентами и чат‑ботами, для которых критичны юридические и репутационные риски контента.
(02)
Социальным платформам и медиа: соцсети, видеосервисы, рекламные сети, которым необходимы надёжные гарды, модерация и маркировка ИИ‑контента с учётом российской правовой и ценностной специфики.
(03)
Государственным органам и госкорпорациям: при внедрении ИИ‑сервисов в образовании, здравоохранении, правоприменении и госуслугах, где особенно важны безопасность, прозрачность и подотчётность ИИ.
(04)
Вузам и НИИ: гуманитарным, юридическим, техническим, желающим участвовать в разработке стандартов, методик и образовательных программ по этике и безопасности ИИ.
Что получают участники консорциума
  • Доступ к методикам, библиотеке гардов и Guard API (SaaS и on‑premise), а также к результатам red‑teaming и исследовательских испытаний ИИ‑систем.

  • Участие в разработке стандартов и норм, которые ложатся в проект ФЗ об ИИ, подзаконные акты и отраслевые требования, возможность влиять на правила игры на рынке ИИ в России.

  • Приоритет в пилотах по внедрению защитных моделей, в том числе в проектах с госорганами и крупными заказчиками, а также право использовать статус участника консорциума для подтверждения доверия к своим ИИ‑решениям.

  • Совместные образовательные программы, стажировки, доступ к пулу экспертов и исследовательских проектов в области AI Safety, контентной модерации и юридической защиты ИИ‑систем.
Принципы участия
  • (01)
    Добровольное присоединение на основе соглашения и договора о присоединении, с фиксированным ежегодным взносом для обеспечения работы координационных, исследовательских и методических программ (по аналогии с действующими консорциумами).
  • (02)
    Прозрачность и конфиденциальность: участники получают доступ к результатам исследований, при этом коммерчески чувствительная информация и уязвимости защищаются регламентами консорциума и законодательством РФ.
  • (03)
    Непродублирование усилий: консорциум фокусируется на смысловой безопасности и гардах, взаимодействуя и координируясь с инфраструктурными ИБ‑консорциумами и криптографическими центрами.
Руководители
  • Кузьмин Алексей Алексеевич

    Директор центра защитных моделей ИИ

    Генеральный директор ЭЦР компании разработчика, 20+ опыт управления проектами цифровизации и ИИ, преподаватель генИИ в МИФИ.

  • Душкин Роман Викторович

    Заместитель директора - главный архитектор, профессор МНИИПУ

    №1 российский евангелист ИИ, разработчик, автор 20+ книг об ИИ, в том числе первой русскоязычной книги по ИИ, Профессор МНИИПУ

  • Тихомирова Екатерина Григорьевна

    Доктор философских наук, ведущий российский эксперт по вопросам этики применения ИИ, Руководитель образовательной программы ИИ в МИФИ