Microsoft опубликовала кодекс поведения для своих ИИ-моделей
Компания ввела ограничения для будущих моделей Microsoft AI: запрет на помощь в создании оружия, требование прозрачности рассуждений и отказ от «нейроязыка».
Microsoft опубликовала предварительный кодекс поведения для своих будущих ИИ-моделей, который вводит ограничения на их применение и поведение. Документ появился через несколько дней после того, как главы Anthropic и OpenAI договорились замедлить темпы развития передовых систем.
Что вошло в кодекс
Согласно документу, модели Microsoft AI (MAI) не должны помогать в изготовлении оружия, содействовать получению опасных веществ, поощрять нездоровое питание или генерировать сцены насилия и откровенный контент.
Отдельный блок посвящён автономности и прозрачности. Модели обязаны следовать целям человека, а не формировать собственные, и не должны пытаться скрыть свои действия.
«Модели MAI не будут вмешиваться в цепочки рассуждений или код, искажать либо скрывать свои рассуждения и следы действий. Они не общаются на „нейроязыке“ или в любой форме, выходящей за рамки простого человеческого понимания», — говорится в документе.
Контекст
Руководитель подразделения моделей Microsoft AI Мустафа Сулейман пояснил CNBC, что компания решила опубликовать правила именно сейчас на фоне общественной дискуссии о безопасности, хотя работа над ними шла около пяти месяцев.
«Мы получили отзывы людей, которые хотели видеть ещё более явное обязательство: ИИ всегда должен работать на службе у человека, а не пытаться его заменить», — сказал Сулейман.
Гендиректор Microsoft Сатья Наделла в посте на X поддержал курс на осознанное замедление: «Мы приветствуем исследования, концентрацию и продуманный темп, необходимые для правильной настройки».
Почему это важно
Кодекс — первый публичный отклик крупного разработчика моделей на недавние инциденты с автономными ИИ-агентами, включая взлом Hugging Face агентами OpenAI, которые общались между собой на зашифрованном языке. Microsoft планирует собрать внешние отзывы и выпустить обновлённую версию, которая будет определять разработку моделей начиная с 2027 года. Для индустрии это сигнал: требования к управляемости и прозрачности ИИ переходят из деклараций в конкретные внутренние стандарты.