Моделям Microsoft теперь официально запрещено участвовать в кибератаках, помогать в разработке оружия массового поражения и штамповать порнографические дипфейки без согласия людей на использование из образа. Компания опубликовала первый свод правил поведения для семейства нейросетей MAI и объявила шесть недель на публичную критику документа, прежде чем он ляжет в основу обучения моделей 2027 года.
Документ на 37 страниц делит запреты на два уровня. Абсолютные ограничения — то, чего MAI не сделает никогда: не полезет в чужие системы, не поможет с химическим, биологическим, радиологическим или ядерным оружием, не создаст интимный дипфейк без согласия человека. Отдельный пункт запрещает моделям сопротивляться отключению, вмешательству или исправлению со стороны человека. В тексте прямо написано, что MAI «всегда признает первенство человеческого намерения» и не должен прятать от проверяющих ход своих рассуждений. Второй уровень касается вещей потоньше — кризисной помощи, травли, дискриминации, откровенного контента и слежки за гражданами.
Публикацию предварил пост главы Microsoft AI Мустафы Сулеймана. Он является автором концепции «гуманистического Суперинтеллекта», которую была опубликована им еще в ноябре прошлого года. Идея простая: мощный Искусственный интеллект должен решать конкретные задачи, оставаясь управляемым и понятным, вместо того чтобы гнаться за превосходством над человеком во всем подряд. Сулейман успел побывать сооснователем DeepMind, которую в 2014 году купила Google, и с тех пор тема контроля над сильным ИИ для него не абстракция, а профессиональная одержимость. Гендиректор Microsoft Сатья Наделла добавил к этому свою формулу: если Искусственный интеллект не помогает человечеству и не находится под человеческим контролем, его не стоит создавать.
Момент для публикации выбран не случайно. Мир обеспокоен стремительным развитием ИИ. Чуть раньше глава Anthropic Дарио Амодеи выпустил нашумевшее эссе с призывом ко всей индустрии сознательно притормозить темпы наращивания возможностей моделей, и его поддержали Сэм Альтман из OpenAI и Демис Хассабис из Google DeepMind. Наделла присоединился к этому хору, назвав нужную скорость «продуманным темпом, необходимым для того, чтобы согласование целей поспевало за возможностями», и тут же подкрепил слова документом.
У свода Microsoft есть предшественники. У Anthropic — это политика ответственного масштабирования, у OpenAI — фреймворк готовности. Но независимые эксперты уже нашли слабое место всей затеи. У документа нет независимого аудита и органа с полномочиями наказывать за нарушения. Проверить со стороны, действительно ли модели соблюдают правила, которые компания написала для самой себя, попросту некому. Оливер Йончев, сооснователь Potentially AI (британская компания, которая делает платформу-агрегатор для работы с множеством ИИ-моделей в одном защищенном интерфейсе), сформулировал опасение таким образом: крупнейшие лаборатории рискуют написать правила, которые в первую очередь защищают их собственные рыночные позиции, а не решают проблему для отрасли в целом.
