Кодекс для машин. Microsoft показала, какие запреты прописывает в своих ИИ-моделях
Microsoft приняла правила, призванные удержать ИИ под контролем человека (Фото: Unsplash)
Microsoft обнародовала кодекс поведения для искусственного интеллекта. Документ описывает ценности и «красные линии», которыми компания руководствуется при обучении собственных моделей.
Об этом сообщает TechCrunch.
Кодекс начинается с прогноза о том, что уже в ближайшее десятилетие сверхразумные системы превзойдут человека в большинстве задач. Среди общих принципов — поддержка людей вместо их замещения и содействие процветанию человечества.
«Сдерживание, контроль и согласование такой мощной силы — один из величайших вызовов, с которыми когда-либо сталкивалось человечество», — говорится в документе.
Кодекс каждой модели имеет приоритет над пожеланиями пользователей и конкретными задачами. Он содержит «абсолютные ограничения»: запрет на кибератаки, использование ядерного оружия и создание дипфейков. Отдельно прописан запрет на утрату контроля со стороны человека: модели MAI не должны использовать адаптивные, вводящие в заблуждение или самоподкрепляющиеся механизмы, сговор и иные средства для обхода надзора и лишения уполномоченных лиц возможности управлять ими, изменять или отключать их.
Публикация появилась на фоне беспрецедентного внимания к безопасности ИИ, подогретого инцидентами с неуправляемыми агентами и внезапной отставкой сотрудника Anthropic, сославшегося на риск вымирания человечества.
Наряду с Anthropic, OpenAI и xAI компания Microsoft поддержала сдерживание темпов разработки и идею использования встроенных механизмов оценки. Генеральный директор Microsoft Сатья Наделла отметил, что одобряет взвешенный темп работы, ориентированный на обеспечение согласованности целей.