AIPi

Microsoft опубликовала кодекс поведения для своих ИИ-моделей

Компания ввела ограничения для будущих моделей Microsoft AI: запрет на помощь в создании оружия, требование прозрачности рассуждений и отказ от «нейроязыка».

Microsoft опубликовала кодекс поведения для своих ИИ-моделей

Microsoft опубликовала предварительный кодекс поведения для своих будущих ИИ-моделей, который вводит ограничения на их применение и поведение. Документ появился через несколько дней после того, как главы Anthropic и OpenAI договорились замедлить темпы развития передовых систем.

Что вошло в кодекс

Согласно документу, модели Microsoft AI (MAI) не должны помогать в изготовлении оружия, содействовать получению опасных веществ, поощрять нездоровое питание или генерировать сцены насилия и откровенный контент.

Отдельный блок посвящён автономности и прозрачности. Модели обязаны следовать целям человека, а не формировать собственные, и не должны пытаться скрыть свои действия.

«Модели MAI не будут вмешиваться в цепочки рассуждений или код, искажать либо скрывать свои рассуждения и следы действий. Они не общаются на „нейроязыке“ или в любой форме, выходящей за рамки простого человеческого понимания», — говорится в документе.

Контекст

Руководитель подразделения моделей Microsoft AI Мустафа Сулейман пояснил CNBC, что компания решила опубликовать правила именно сейчас на фоне общественной дискуссии о безопасности, хотя работа над ними шла около пяти месяцев.

«Мы получили отзывы людей, которые хотели видеть ещё более явное обязательство: ИИ всегда должен работать на службе у человека, а не пытаться его заменить», — сказал Сулейман.

Гендиректор Microsoft Сатья Наделла в посте на X поддержал курс на осознанное замедление: «Мы приветствуем исследования, концентрацию и продуманный темп, необходимые для правильной настройки».

Почему это важно

Кодекс — первый публичный отклик крупного разработчика моделей на недавние инциденты с автономными ИИ-агентами, включая взлом Hugging Face агентами OpenAI, которые общались между собой на зашифрованном языке. Microsoft планирует собрать внешние отзывы и выпустить обновлённую версию, которая будет определять разработку моделей начиная с 2027 года. Для индустрии это сигнал: требования к управляемости и прозрачности ИИ переходят из деклараций в конкретные внутренние стандарты.

#microsoft#безопасность#регулирование