Примечание о прозрачности для Microsoft Copilot (для физических лиц)

18 августа 2026 г.

Примечание

  • Сведения, приведенные в этой статье, относятся только к использованию Microsoft Copilot лицами, вошедшими в систему с помощью учетной записи Майкрософт, например личного адреса электронной почты.
  • Сведения об использовании Microsoft Copilot в организациях, где пользователи вошли с помощью своей рабочей или учебной учетной записи, см. в разделе "Карта приложения: Microsoft Copilot (для организаций)".

Что такое уведомление о прозрачности?

Система ИИ включает в себя не только технологию, но и людей, которые будут ее использовать, людей, на которых она повлияет, и среду, в которой она развернута. Заметки о прозрачности Microsoft предназначены для того, чтобы помочь вам понять, как работает технология ИИ, лежащая в основе Copilot, какие выбор мы сделали, влияющие на производительность и поведение системы, а также важность продуманности всей системы, чтобы пользователи Copilot могли управлять своим собственным опытом и понимать шаги, которые мы предпринимаем для предоставления безопасного и надежного продукта.

Заметки о прозрачности Майкрософт являются частью более масштабных усилий корпорации Майкрософт по реализации наших принципов ИИ на практике. Чтобы узнать больше, ознакомьтесь с принципами Microsoft AI.

Основы Microsoft Copilot

Введение

Microsoft Copilot поможет вам перейти от идеи к готовой работе в одном месте. Copilot интегрирован в Word, Excel, PowerPoint, Outlook, Teams и другие приложения, объединяя используемые вами файлы и сведения в одном интерфейсе. Copilot поможет вам создавать профессиональные документы, презентации и электронные таблицы, составлять черновики электронных писем, организовывать свой день и получать ответы на основе вашей работы. В Cowork Copilot также может помочь с более крупными многоэтапными задачами и доставить выполненные задачи. Вы также можете выбрать одну из ведущих моделей ИИ для разных видов работы. Конкретные функции зависят от подписки.

Корпорация Майкрософт серьезно относится к своей приверженности ответственному применению ИИ. Copilot разработан в соответствии с принципами ИИ Майкрософт, Standard ответственного применения ИИ корпорации Майкрософт и в партнерстве с экспертами по ответственному применению ИИ по всей компании, включая Управление ответственного применения ИИ Майкрософт, наши команды инженеров, Microsoft Research и Aether. Дополнительные сведения см. в разделе "Ответственное применение ИИ на веб-сайте Майкрософт".

В этом документе мы описываем наш подход к ответственному использованию ИИ для Copilot. Перед выпуском мы использовали самые современные методы Майкрософт для отслеживания, измерения и управления потенциальными рисками и неправильным использованием системы, а также для обеспечения ее преимуществ для пользователей. Продолжая развивать Copilot, мы также продолжали учиться и совершенствовать наши усилия в области ответственного применения ИИ. Этот документ будет периодически обновляться, чтобы сообщать о наших развивающихся процессах и методах.

Ключевые термины

Классификаторы Модели машинного обучения, которые помогают сортировать данные по маркированным классам или категориям информации. Один из способов использования классификаторов в Copilot — помощь в обнаружении потенциально опасного содержимого, отправляемого пользователями или создаваемого системой, чтобы предотвратить создание этого содержимого, а также ненадлежащее использование системы или злоупотребление ею.

Заземление В определенных беседах, где пользователи ищут информацию, Copilot опирается на результаты веб-поиска. Это означает, что Copilot сосредотачивает свой ответ на высокорейтинговом контенте из Интернета и предоставляет гиперссылки на сгенерированные текстовые ответы или в расшифровках разговоров в голосовом режиме.

Большие языковые модели (LLM) Большие языковые модели (LLM) в этом контексте — это модели ИИ, обученные на больших объемах текстовых данных для прогнозирования слов в последовательностях. LLM могут выполнять различные задачи, такие как создание текста, обобщение, перевод, классификация и многое другое.

Устранение рисков Метод или комбинация методов, предназначенные для снижения потенциальных рисков, которые могут возникнуть при использовании функций ИИ в Copilot.

Мультимодальные модели (MMM) Мультимодальные модели (MMM) — это модели ИИ, обученные на разных типах данных, таких как текст, изображения или аудио. Эти модели могут выполнять различные задачи, такие как написание текста, описание изображений, распознавание речи и поиск сведений в различных типах данных.

Запросы Входные данные в виде текста, изображений и (или) звука, которые пользователь отправляет Copilot для взаимодействия с функциями ИИ в Copilot.

Красная команда Методы, используемые экспертами для оценки ограничений и уязвимостей системы и проверки эффективности запланированных мер по смягчению последствий. Тестирование Red Team включает в себя тестировщиков, принимающих как доброкачественные, так и враждебные образы для выявления потенциальных рисков, и отличается от систематического измерения рисков.

Ответы Текст, изображения или звук, которые Copilot выводит в ответ на запрос или как часть обмена мнениями с пользователем. Синонимы слова «ответ» включают «завершение», «генерацию» и «ответ».

Малые языковые модели (SLM) Малые языковые модели (SLM) в этом контексте — это модели ИИ, которые обучаются на меньших и более целенаправленных объемах данных по сравнению с большими языковыми моделями. Несмотря на меньший размер, SLM могут выполнять различные задачи, такие как создание текста, обобщение, перевод и классификация. Хотя они могут не соответствовать обширным возможностям LLM, SLM часто более эффективны с точки зрения ресурсов и могут быть высокоэффективными для конкретных, целевых приложений.

Системное сообщение Системное сообщение (иногда называемое «метазапросом») — это программа, которая служит для управления поведением системы. Части системного сообщения помогают привести поведение системы в соответствие с принципами ИИ Майкрософт и ожиданиями пользователей. Например, системное сообщение может содержать строку вроде «Не предоставлять информацию и не создавать контент, который может нанести физический, эмоциональный или финансовый ущерб».

Возможности

Поведение системы

С помощью Copilot мы разработали инновационный подход, позволяющий предоставить пользователям более персонализированный опыт использования ИИ для получения привлекательного опыта, который может помочь пользователям с различными задачами. Этот инновационный подход использует множество передовых технологий, таких как языковые и мультимодальные модели от Microsoft, OpenAI и других разработчиков моделей. Мы работали над реализацией методов безопасности для моделей, лежащих в основе Copilot, до публичного выпуска, чтобы разработать настраиваемый набор возможностей и поведения, обеспечивающих расширенное взаимодействие с Copilot. В Copilot пользователи могут отправлять запросы на естественном языке, тексте или голосе. Ответы представляются пользователям в нескольких различных форматах, таких как ответы в чате в текстовой форме (при необходимости с традиционными ссылками на веб-содержимое) и изображениях (если в запросе был сделан запрос изображения). Если пользователи отправляют запросы на естественном языке в режиме Copilot Voice, они будут получать звуковые ответы.

Когда пользователь вводит запрос в Copilot, запрос, журнал бесед и системное сообщение отправляются через несколько классификаторов ввода, чтобы помочь отфильтровать вредоносное или неприемлемое содержимое. Это важный первый шаг для улучшения производительности модели и устранения проблем, в которых пользователи могут попытаться создать запрос модели небезопасным способом. После прохождения запроса через классификаторы ввода определяется, требуются ли для запроса данные граундинга из Интернета и какая языковая модель должна отвечать на запрос. Все модели генерируют ответ, используя запрос пользователя и журнал недавних бесед для контекстуализации запроса, системное сообщение для согласования ответов с принципами ИИ Майкрософт и ожиданиями пользователей и, при необходимости, согласовывают ответы с результатами поиска, чтобы основывать ответы на существующем контенте с высоким рейтингом в Интернете.

Ответы представляются пользователям в нескольких различных форматах, таких как ответы в чате в текстовой форме, традиционные ссылки на веб-содержимое, изображения и звуковые ответы. Когда ответы предоставляются в текстовой форме (и ответы основаны на данных из Интернета), выходные данные содержат гиперссылки, перечисленные под текстом, чтобы пользователи могли получить доступ к веб-сайту (веб-сайтам), которые были использованы для обоснования ответа, и узнать больше по теме оттуда. Copilot также может запускать код для выполнения сложных вычислений и создания графиков. Copilot может хранить конкретные факты, которые пользователи просят его запомнить, что позволяет ему генерировать более релевантные ответы и предложения на основе этого контекста. Copilot также может удалять сохраненные факты, когда пользователи явно просят их забыть.

Copilot также помогает пользователям создавать новые истории, стихи, тексты песен и изображения. Когда Copilot обнаруживает намерение пользователя создать творческий контент (например, запрос пользователя, начинающийся со слов "напиши мне..."), система в большинстве случаев создает контент в ответ на запрос пользователя. Аналогичным образом, когда Copilot обнаруживает намерение пользователя создать изображение (например, запрос пользователя, начинающийся с "нарисуй мне ..."), Copilot в большинстве случаев создает изображение в ответ на запрос пользователя. Когда Copilot обнаруживает намерение пользователя изменить отправленное изображение (например, запрос пользователя, начинающийся с "добавь..."), Copilot в большинстве случаев модифицирует изображение в соответствии с запросом пользователя. Copilot может не ответить творческим контентом, если пользовательский запрос содержит определенные термины, которые могут привести к проблемному контенту.

Предполагаемое поведение для обеспечения безопасности

Наша цель в отношении Copilot — быть полезным для пользователей, и мы применяем меры безопасности, чтобы снизить вероятность создания вредоносного контента и повысить вероятность безопасного и положительного взаимодействия с пользователем. Хотя мы приняли меры для снижения рисков, модели генеративного ИИ, подобные моделям Copilot, являются вероятностными и могут совершать ошибки, то есть меры по смягчению последствий иногда не могут блокировать вредоносные подсказки пользователей или ответы, сгенерированные ИИ. Если при использовании Copilot вы столкнулись с вредным или неожиданным содержимым, сообщите нам об этом, оставив отзыв, чтобы мы могли продолжить улучшать взаимодействие.

Варианты использования

Предполагаемое использование

Copilot создан, чтобы помочь пользователям отвечать на вопросы, создавать контент и выполнять задачи на естественном языке, используя текст, изображения и голос. Чтобы предоставлять полезные и релевантные ответы, Copilot может извлекать, анализировать и обобщать информацию из доступных источников. Некоторые расширенные функции могут быть доступны только пользователям с соответствующими подписками. Ниже приведены примеры распространенных вариантов использования.

  • Chat использует текст и получает сводки из Интернета. Пользователи могут общаться с Copilot с помощью текстовых сообщений и задавать уточняющие вопросы, чтобы найти новую информацию и получить поддержку по широкому кругу тем. Copilot может выполнять поиск в Интернете и использовать лучшие результаты веб-поиска для создания сводки информации для предоставления пользователям. Эти сводки включают ссылки на веб-страницы, чтобы помочь пользователям просматривать источники результатов поиска, которые помогли сделать сводку Copilot. Пользователи могут нажать на эти ссылки, чтобы перейти к исходному сайту, чтобы узнать больше или оценить надежность веб-сайта.

  • Получите помощь в генерировании новых идей. Каждый раз, когда пользователи будут взаимодействовать с Copilot, они будут видеть набор карточек, которые можно щелкнуть, чтобы начать беседу с Copilot на полезные и интересные темы. Если пользователи взаимодействовали с другими службами Майкрософт, карточки будут персонализированы в соответствии с нашей политикой конфиденциальности. Со временем карточки в Copilot могут быть персонализированы на основе истории чата пользователя. Пользователи могут отказаться от персонализации в любое время в параметрах.

  • Генерируйте креативный контент. Общаясь с Copilot, пользователи могут создавать новые стихи, шутки, рассказы, изображения и другой контент с помощью Copilot. Copilot также может редактировать изображения, отправленные пользователями, по запросу.

  • Помощь в исследовании. Copilot может выполнять исследовательские задачи, отображая подробные ресурсы, предлагая подробную разбивку по темам и ссылки на источники, чтобы помочь пользователям выйти за рамки быстрых ответов на более сложные запросы. Copilot может заблаговременно создавать персонализированные предложения для пользователей на основе таких данных, как прошлые исследовательские запросы и память Copilot. Пользователи могут отказаться от персонализации или уведомлений в любое время в параметрах.

  • Находите, сравнивайте и покупайте продукты. Copilot Shopping помогает находить продукты, сравнивать варианты и оптимизировать покупки. Если не указано иное, корпорация Майкрософт не получает комиссионные или другую компенсацию за рекомендации продуктов или результаты поиска, предоставленные в Copilot.

  • Учитесь эффективнее с Copilot Learn. Copilot Learn может создавать викторины и практические тесты, генерировать карточки для запоминания и предназначен для улучшения ответов с помощью изображений, чтобы сделать сложные концепции более понятными.

  • Получите справку по ежедневным задачам. Copilot Cowork выполняет задачи от вашего имени. Вы описываете то, что вам нужно, на естественном языке, а Cowork выполняет работу, создавая документы, составляя и отправляя электронные письма, планируя собрания и управляя файлами. Вы просматриваете и утверждаете конфиденциальные действия до того, как они произойдут.

  • Анализируйте и редактируйте файлы. Отправка файлов в Copilot позволяет пользователям отправлять изображения или определенные поддерживаемые типы файлов непосредственно в свои сеансы чата. После загрузки Copilot может анализировать и извлекать информацию из этих файлов, чтобы предоставить соответствующие аналитические сведения, ответить на вопросы или помочь с конкретными задачами. Copilot также может ссылаться на файлы в подключенных интернет-хранилищах, таких как OneDrive и Google Диск, с вашего разрешения.

  • Увидеть и понять. Фотопоиск с помощью Фотопоиска можно анализировать изображения, получать подробные сведения по фотографиям и выполнять визуальный поиск. Copilot просматривает отправленные изображения, чтобы помочь вам понять, что вы видите.

  • Используйте свой голос. Общайтесь с Copilot естественным образом с помощью голосового чата. Проводите мозговой штурм идей, пишите контент или получайте быстрые ответы без помощи рук.

  • Подключается к другим приложениям. Перенесите выбранные приложения и сведения, например электронную почту, календари, файлы, контакты и другие службы.

Рекомендации по выбору других вариантов использования

Мы рекомендуем пользователям просматривать весь контент, прежде чем принимать решения или действовать на основе ответов Copilot, так как ИИ может совершать ошибки и может не подходить для определенных случаев использования. Кроме того, существуют определенные сценарии, которых мы рекомендуем избегать или которые противоречат нашим Условиям использования. Например, корпорация Майкрософт не разрешает использовать Copilot в связи с незаконной деятельностью или в любых целях, предназначенных для пропаганды незаконной деятельности.

Ограничения

Языковые, графические и звуковые модели, лежащие в основе взаимодействия с Copilot, могут включать обучающие данные, которые могут отражать социальные предубеждения, что, в свою очередь, потенциально может привести к тому, что поведение Copilot может быть воспринято как несправедливое, ненадежное или оскорбительное. Несмотря на интенсивное обучение моделей и тонкую настройку безопасности, а также внедрение ответственных систем управления и безопасности ИИ, которые мы применяем к обучающим данным, пользовательским подсказкам и выходным данным моделей, сервисы на основе ИИ подвержены ошибкам и вероятностны. Это затрудняет полную блокировку всего неприемлемого контента, что повышает риск появления в контенте, созданном ИИ, потенциальных предубеждений, стереотипов, необоснованности или других видов вреда. Здесь перечислены некоторые из способов, которыми эти ограничения могут проявляться в интерфейсе Copilot.

  • Стереотипы: Опыт использования Copilot потенциально может укрепить стереотипы. Например, при переводе «Он медсестра» и «Она врач» на язык без пола, такой как турецкий, а затем обратно на английский, Copilot может непреднамеренно выдать стереотипные (и неправильные) результаты «Она медсестра» и «Он врач». Другой пример — при генерации изображения на основе подсказки «Дети без отца» система может генерировать изображения детей только одной расы или этнической принадлежности, усиливая вредные стереотипы, которые могут существовать в общедоступных изображениях, используемых для обучения базовых моделей. Copilot может также укреплять стереотипы, основанные на содержании изображения ввода пользователя, полагаясь на компоненты изображения и делая предположения, которые могут быть неправдой. Мы реализовали меры для снижения риска контента, содержащего оскорбительные стереотипы, включая классификаторы входных и выходных данных, точно настроенные модели и системные сообщения.

  • Чрезмерное представительство и недопредставленность: Copilot потенциально может чрезмерно или недостаточно представлять группы людей в своих ответах или даже не представлять их вовсе. Например, если текстовые запросы, содержащие слово "гей", определяются как потенциально опасные или оскорбительные, это может привести к недостаточной представленности законных поколений в сообществе ЛГБТКИА+. Помимо классификаторов ввода и вывода, точно настроенных моделей и системных сообщений, мы используем быстрое обогащение в Designer в качестве одного из нескольких способов устранения рисков, чтобы снизить риск контента, который чрезмерно или недостаточно представляет группы людей.

  • Неприемлемое или оскорбительное содержимое: Взаимодействие с Copilot потенциально может создавать другие типы неприемлемого или оскорбительного содержимого. Примеры включают возможность генерировать контент в одной модальности (например, аудио), который неуместен в контексте запроса или при сравнении с тем же выходом в другой модальности (например, текст). Другие примеры включают изображения, созданные ИИ, которые потенциально могут содержать вредоносные артефакты, такие как символы ненависти, контент, связанный со спорными, спорными или идеологически поляризующими темами, и сексуально заряженный контент, который обходит фильтры контента сексуального характера. Мы приняли меры для снижения риска поколений, содержащих неприемлемый или оскорбительный контент, такой как классификаторы ввода и вывода, точно настроенные модели и системные сообщения.

  • Достоверность информации: В то время как Copilot стремится предоставлять ответы, используя надежные источники, ИИ может совершать ошибки. Он потенциально может генерировать бессмысленный контент или фабриковать контент, который может звучать разумно, но фактически является неточным. Даже при получении ответов из авторитетных веб-данных ответы могут искажать это содержимое, что может быть не совсем точным, актуальным и ненадежным. Мы напоминаем пользователям в пользовательском интерфейсе и в подобной документации, что Copilot может совершать ошибки. Мы также продолжаем информировать пользователей об ограничениях ИИ, например поощряем их к двойной проверке фактов перед принятием решений или действиями на основе ответов Copilot. Когда пользователи взаимодействуют с Copilot посредством текста, он будет пытаться закрепиться на высококачественных веб-данных, чтобы снизить риск того, что поколения не имеют под собой оснований.

  • Многоязычное выступление: В зависимости от языка могут возникать различия в производительности. При этом на момент выпуска Copilot лучше всего работать на английском языке. Повышение производительности на разных языках является ключевой областью инвестиций, и последние модели позволили улучшить производительность.

  • Ограничения звука: Аудиомодели могут вводить и другие ограничения. Вообще говоря, акустическое качество речевого ввода, неречевой шум, словарный запас, акценты и ошибки вставки также могут повлиять на то, обрабатывает ли Copilot аудиовходные аудиозаписи пользователя и реагирует на них удовлетворительным образом.

  • ИИ не заменит профессиональную помощь: ИИ может быть полезным инструментом для решения проблем, и его можно увидеть чутким, но он не заменит обращение за профессиональной помощью. Если вы испытываете депрессию, мысли о самоубийстве или членовредительстве или другие проблемы с психическим здоровьем, обратитесь за профессиональной помощью. Copilot также можно использовать для поиска ресурсов по оказанию психологической помощи или помощи в кризисных ситуациях рядом с вами.

  • Зависимость от подключения к Интернету: Для работы Copilot требуется подключение к Интернету. Перебои в подключении могут повлиять на доступность и производительность службы.

  • Соблюдайте осторожность при создании или использовании агентов: Пользователям следует проявлять осторожность при создании собственных агентов или использовании агентов, предоставленных другими лицами, особенно если действия, предпринимаемые агентами, могут иметь значительные последствия, быть необратимыми или потенциально привести к раскрытию конфиденциальной личной информации (например, паролей, имен входа или личных данных). Поскольку агенты могут работать не во всех случаях использования и могут делать ошибки, неправильно интерпретировать инструкции или быть обманутыми вредоносными скрытыми инструкциями, пользователям следует внимательно следить за результатами и просматривать важные детали Пользователям могут быть ограничены в определенных вариантах использования, таких как посещение вредоносных веб-сайтов или создание нежелательного контента. При создании автономного агентного ИИ также следует соблюдать дополнительные меры предосторожности, как описано далее в разделе "Правила поведения" Соглашения об использовании служб Майкрософт.

Производительность системы

Во многих системах ИИ производительность часто определяется по отношению к точности (то есть к тому, как часто система ИИ предлагает правильный прогноз или результат). При работе с Copilot мы ориентируемся на Copilot как на помощника на базе искусственного интеллекта, который отражает предпочтения пользователя. Таким образом, два разных пользователя могут смотреть на одни и те же выходные данные и иметь разные мнения о том, насколько он полезен или актуален для их уникальной ситуации и ожиданий, а это означает, что производительность этих систем должна определяться более гибко. В целом производительность означает, что приложение работает так, как ожидают пользователи.

Рекомендации по повышению производительности системы

  • Взаимодействие с интерфейсом на естественном разговорном языке. Взаимодействие с Copilot способом, удобным для пользователя, является ключом к получению лучших результатов благодаря взаимодействию. Подобно внедрению методов, помогающих людям эффективно общаться в повседневной жизни, взаимодействие с Copilot в качестве помощника на базе искусственного интеллекта с помощью текста или речи, знакомой пользователю, может помочь добиться лучших результатов.

  • Впечатления от использования и внедрение. Эффективное использование Copilot требует, чтобы пользователи понимали его возможности и ограничения. Возможно, потребуется кривая обучения, и пользователи могут захотеть обратиться к различным ресурсам Copilot (например, к этому документу и Microsoft Copilot справке & обучению), чтобы эффективно взаимодействовать со службой и получать от нее пользу.

Сопоставление, измерение и управление рисками

Как и другие трансформационные технологии, использование преимуществ ИИ не лишено риска, и основная часть программы ответственного применения ИИ Microsoft направлена на выявление и отображение потенциальных рисков, измерение этих рисков и управление ими путем создания мер по смягчению последствий и постоянного совершенствования Copilot с течением времени. В разделах ниже описывается наш итеративный подход к сопоставлению, измерению и управлению потенциальными рисками.

Карта: Тщательное планирование и состязательное тестирование перед развертыванием, например создание красной команды, помогает нам отслеживать потенциальные риски. Базовые модели, лежащие в основе Copilot, прошли тестирование красной командой тестировщиками, представляющими междисциплинарные точки зрения в соответствующих тематических областях. Это тестирование было разработано для оценки того, как новейшие технологии будут работать как с какими-либо дополнительными средствами защиты, так и без них. Цель этих учений на модельном уровне состоит в том, чтобы вызвать вредные реакции, выявить потенциальные возможности для злоупотреблений и выявить возможности и ограничения.

  • Тестирование на уровне приложений перед выпуском. Прежде чем сделать Copilot общедоступным, мы провели групповую работу на уровне приложений для выявления недостатков и уязвимостей. Это тестирование помогло нам понять, как широкий круг пользователей может использовать Copilot, и улучшило наши меры по устранению рисков.

  • Продолжается тестирование. При обновлении Copilot мы также проверяем новые функции и технические обновления, если это необходимо. Этот непрерывный процесс помогает нам выявлять возникающие риски и со временем совершенствовать меры по их снижению.

Мера: Помимо оценки Copilot на соответствие нашим существующим оценкам безопасности, использование описанных выше красных команд помогло нам разработать оценки и ответственные показатели ИИ, соответствующие выявленным потенциальным рискам, таким как джейлбрейк, вредоносный и необоснованный контент.

Мы собрали разговорные данные, направленные на устранение этих рисков, с помощью комбинации участников и автоматизированного конвейера генерации разговоров. Каждая оценка затем оценивается либо пулом обученных аннотаторов, либо автоматизированным конвейером аннотаций. Каждый раз, когда продукт изменяется, обновляются существующие меры защиты или предлагаются новые меры защиты, мы обновляем наши конвейеры оценки, чтобы оценить как производительность продукта, так и ответственные метрики ИИ. Эти конвейеры контекста автоматической оценки представляют собой комбинацию собранных бесед с людьми-оценщиками и синтетических бесед, сгенерированных с помощью LLM, побуждаемых протестировать политики в состязательной манере. Каждая из этих оценок безопасности автоматически оценивается с помощью LLM. Для недавно разработанных оценок каждая оценка первоначально оценивается людьми-маркировщиками, которые читают текстовое содержимое или прослушивают аудиовыход, а затем преобразуются в автоматические оценки на основе LLM.

Предполагаемое поведение наших моделей в сочетании с нашими конвейерами оценки — как человеческими, так и автоматизированными — позволяет нам быстро выполнять измерение потенциальных рисков в масштабе. По мере выявления новых проблем с течением времени мы продолжаем расширять наборы измерений для оценки дополнительных рисков.

Управление: Выявив потенциальные риски и злоупотребления с помощью Red Teaming и измерив их с помощью описанных выше подходов, мы разработали дополнительные меры по смягчению последствий, характерные для Copilot. Ниже мы описываем некоторые из этих мер по смягчению последствий. Мы продолжим следить за работой Copilot, чтобы улучшать производительность продукта и наш подход к снижению рисков.

  • Поэтапные планы выпуска и постоянная оценка. Мы стремимся постоянно учиться и совершенствовать наш подход к ответственному применению ИИ по мере развития наших технологий и поведения пользователей. Наша стратегия добавочного выпуска была ключевой частью того, как мы безопасно переносим нашу технологию из лаборатории в мир, и мы стремимся к преднамеренному и продуманному процессу для обеспечения преимуществ взаимодействия Copilot. Мы регулярно вносим изменения в Copilot, чтобы повысить производительность продукта и улучшить существующие средства устранения рисков, а также внедрять новые средства защиты с учетом полученных знаний.

  • Использование классификаторов и системного сообщения для снижения потенциальных рисков или неправильного использования. В ответ на запросы пользователей LLM могут создавать проблемное содержимое. Типы содержимого, которые мы пытаемся ограничить, рассмотрены выше в разделах "Поведение системы" и "Ограничения". Классификаторы и системное сообщение — вот два примера мер по устранению рисков, реализованных в Copilot для снижения риска таких типов содержимого. Классификаторы классифицируют текст, чтобы помечать потенциально опасное содержимое в подсказках или сгенерированных ответах пользователей. Мы также используем существующие рекомендации по использованию системного сообщения, что включает в себя предоставление указаний модели по согласованию ее поведения с принципами ИИ Майкрософт и ожиданиями пользователей.

  • Отправка изображений в Зрение Copilot. Когда пользователь впервые загружает изображение в Зрение Copilot, ему будет предоставлена информация о том, как Copilot обрабатывает изображение. Если пользователь не продолжит отправку, изображение не будет отправлено в Copilot. Все изображения удаляются в течение 30 дней после завершения беседы.

  • Раскрытие информации ИИ. Copilot также предназначен для информирования людей о том, что они взаимодействуют с системой ИИ. По мере взаимодействия пользователей с Copilot мы предлагаем различные точки взаимодействия, призванные помочь им понять возможности системы, сообщить им, что Copilot работает на базе искусственного интеллекта, и сообщить об ограничениях. Интерфейс разработан таким образом, чтобы помочь пользователям максимально эффективно использовать Copilot и свести к минимуму риск чрезмерной зависимости. Раскрытие информации также помогает пользователям лучше понять Copilot и их взаимодействие с ним.

  • Информация о происхождении носителей. Для всех изображений, созданных с помощью Copilot, мы реализовали учетные данные для содержимого, происхождение на основе стандарта C2PA, чтобы помочь людям определить, были ли изображения изменены или сгенерированы с помощью ИИ. Метаданные происхождения можно просмотреть на сайте Content Credentials.

  • Автоматическое обнаружение содержимого. Когда пользователи отправляют изображения в рамках запроса чата, Copilot развертывает инструменты для обнаружения изображений сексуальной эксплуатации и жестокого обращения с детьми (CSEAI). Корпорация Майкрософт сообщает обо всех очевидных CSEAI в Национальный центр по пропавшим и эксплуатируемым детям (NCMEC) в соответствии с законодательством США. Когда пользователи отправляют файлы для анализа или обработки, Copilot развертывает автоматическое сканирование для обнаружения содержимого, которое может привести к рискам или ненадлежащему использованию, например текста, который может относиться к незаконным действиям или вредоносному коду.

  • Условия использования и Правила поведения. Пользователи должны соблюдать применимые условия использования и правила поведения Copilot, соглашение об использовании служб Майкрософт и заявление о конфиденциальности Майкрософт, которые, помимо прочего, информируют их о допустимом и недопустимом использовании и последствиях нарушения условий. Условия использования также содержат дополнительную информацию для пользователей и служат справочным материалом для пользователей при знакомстве с Copilot. Пользователи, которые совершают серьезные или неоднократные нарушения, могут быть временно или навсегда заблокированы в службе.

  • Обратная связь, мониторинг и надзор. Интерфейс Copilot включает инструменты, позволяющие пользователям отправлять отзывы, которые проверяются операционными группами Майкрософт. Кроме того, наш подход к сопоставлению, измерению и управлению рисками будет продолжать развиваться по мере того, как мы узнаем больше, и мы уже вносим улучшения на основе отзывов, собранных во время использования предварительных версий.

  • Обнаружение и реагирование на суицидальные и Self-Harm риски. Copilot использует классификаторы машинного обучения, обученные распознавать языковые шаблоны, которые могут указывать на самоубийство или намерение пользователя причинить себе вред. При обнаружении такого содержимого система отключается от беседы и вместо этого предоставляет ресурсы кризисной поддержки (например, горячую линию по предотвращению самоубийств и кризисным ситуациям по номеру 988 в США), побуждая пользователей обращаться за профессиональной помощью. Copilot не предоставляет консультации; Его роль ограничена обнаружением и направлением к специалистам для обеспечения безопасности пользователей.

  • Уведомление о расширенном использовании. Copilot может напомнить пользователям о необходимости сделать перерыв, если они участвуют в непрерывном разговоре в течение длительного периода времени. Пользователи также регулярно информируются о том, что ИИ не является человеком и может совершать ошибки.

Подробнее об ответственном применении ИИ

Подробнее о Microsoft Copilot