Nota de Transparência para Microsoft Copilot (para pessoas singulares)

18 de agosto de 2026

Nota

  • As informações neste artigo aplicam-se apenas à utilização de Microsoft Copilot por pessoas com sessão iniciada com uma conta Microsoft, como um endereço de e-mail pessoal.
  • Para obter informações sobre o uso do Microsoft Copilot em organizações onde os usuários estão conectados com suas contas profissionais ou escolares, consulte Cartão de aplicativo: Microsoft Copilot (para organizações).

O que é uma Nota de Transparência?

Um sistema de IA inclui não só a tecnologia, mas também as pessoas que a utilizarão, as pessoas que serão afetadas por ela e o ambiente em que está implementado. As Notas de Transparência da Microsoft destinam-se a ajudá-lo a compreender como funciona a tecnologia de IA por detrás do Copilot, as escolhas que fizemos que influenciam o desempenho e o comportamento do sistema e a importância de pensar no sistema como um todo, para que os utilizadores do Copilot possam assumir o controlo das suas próprias experiências e compreender os passos que estamos a tomar para fornecer um produto seguro e protegido.

As Notas de Transparência da Microsoft fazem parte de um esforço mais abrangente da Microsoft para colocar os nossos Princípios de IA em prática. Para saber mais, consulte os Microsoft AI Princípios.

Noções básicas do Microsoft Copilot

Introdução

Microsoft Copilot ajuda-o a passar da ideia ao trabalho concluído, tudo num único local. O Copilot está integrado no Word, Excel, PowerPoint, Outlook, Teams e mais, reunindo os ficheiros e as informações que utiliza numa só experiência. O Copilot pode ajudá-lo a criar documentos, apresentações e folhas de cálculo elegantes, redigir e-mails, organizar o seu dia e obter respostas baseadas no trabalho que está a realizar. Com o Cowork, o Copilot também pode ajudar com tarefas maiores e com vários passos e entregar tarefas concluídas. Também pode escolher entre os principais modelos de IA para diferentes tipos de trabalho. As funcionalidades específicas variam consoante a subscrição.

Na Microsoft, levamos a sério o nosso compromisso com a IA responsável. O Copilot foi desenvolvido em linha com os Princípios de IA da Microsoft, a Norma de IA Responsável da Microsoft e em parceria com especialistas em IA responsável de toda a empresa, incluindo o Gabinete de IA Responsável da Microsoft, as nossas equipas de engenharia, a Microsoft Research e a Aether. Pode saber mais em IA Responsável na Microsoft.

Neste documento, descrevemos a nossa abordagem à IA responsável para o Copilot. Antes do lançamento, aplicámos os métodos de ponta da Microsoft para mapear, medir e gerir potenciais riscos e utilização indevida do sistema, bem como para garantir os seus benefícios para os utilizadores. À medida que continuamos a desenvolver o Copilot, também continuamos a aprender e a melhorar os nossos esforços de IA responsável. Este documento será atualizado periodicamente para comunicar a evolução dos nossos processos e métodos.

Palavras-chave do áureo

Classificadores Modelos de aprendizagem automática que ajudam a ordenar os dados em classes ou categorias de informação etiquetadas. No Copilot, uma forma de utilizar classificadores é ajudar a detetar conteúdo potencialmente prejudicial submetido pelos utilizadores ou gerado pelo sistema para mitigar a geração desse conteúdo e a utilização indevida ou abuso do sistema.

Fundamentação Para certas conversações em que os utilizadores procuram informações, o Copilot baseia-se nos resultados de pesquisa na Web. Isto significa que o Copilot centra a sua resposta em conteúdos de alta classificação da Web e fornece citações hiperligadas após respostas de texto geradas ou em transcrições de conversações no modo de voz.

Modelos de linguagem grande (LLMs) Os modelos de linguagem grande (LLMs) neste contexto são modelos de IA que são treinados em grandes quantidades de dados de texto para prever palavras em sequências. Os LLMs podem realizar uma variedade de tarefas, como geração de texto, resumo, tradução, classificação e muito mais.

Atenuação Um método ou combinação de métodos concebidos para reduzir os riscos potenciais que podem surgir da utilização das funcionalidades de IA no Copilot.

Modelos multimodais (MMM) Os modelos multimodais (MMMs) são modelos de IA preparados com diferentes tipos de dados, como texto, imagens ou áudio. Esses modelos podem executar uma variedade de tarefas, como escrever texto, descrever imagens, reconhecer fala e encontrar informações em diferentes tipos de dados.

Pedidos Entradas sob a forma de texto, imagens e/ou áudio que um utilizador envia para o Copilot para interagir com as funcionalidades de IA no Copilot.

Red teaming Técnicas utilizadas por peritos para avaliar as limitações e vulnerabilidades de um sistema e para testar a eficácia das mitigações planeadas. Os testes da equipe vermelha incluem testadores que adotam personas benignas e adversárias para identificar riscos potenciais e são distintos da medição sistemática de riscos.

Respostas Texto, imagens ou áudio que o Copilot emite em resposta a um pedido ou como parte do vai e vem com o utilizador. Os sinónimos de "resposta" incluem "conclusão", "geração e "resposta".

Pequenos modelos de linguagem (SLMs) Os modelos de linguagem pequenos (SLMs) neste contexto são modelos de IA que são treinados em quantidades de dados menores e mais focadas em comparação com modelos de linguagem grandes. Apesar de seu tamanho menor, os SLMs podem executar uma variedade de tarefas, como geração de texto, resumo, tradução e classificação. Embora possam não corresponder às capacidades extensivas dos LLMs, os SLMs são frequentemente mais eficientes em termos de recursos e podem ser altamente eficazes para aplicações específicas e direcionadas.

Mensagem do Sistema A mensagem do sistema (às vezes referida como um "metaprompt") é um programa que serve para guiar o comportamento do sistema. Partes da mensagem do sistema ajudam a alinhar o comportamento do sistema com os Princípios de IA da Microsoft e as expectativas do utilizador. Por exemplo, uma mensagem do sistema pode incluir uma frase como "não forneça informações ou crie conteúdo que possa causar danos físicos, emocionais ou financeiros".

Funcionalidades

Comportamento do sistema

Com o Copilot, desenvolvemos uma abordagem inovadora para proporcionar uma experiência de IA mais personalizada aos utilizadores para uma experiência envolvente que pode ajudar os utilizadores com uma variedade de tarefas. Essa abordagem inovadora aproveita uma variedade de tecnologias avançadas, como linguagem e modelos multimodais da Microsoft, OpenAI e outros desenvolvedores de modelos. Trabalhámos na implementação de técnicas de segurança para os modelos subjacentes ao Copilot antes do lançamento público para desenvolver um conjunto personalizado de capacidades e comportamentos que proporcionam uma experiência Copilot melhorada. No Copilot, os utilizadores podem enviar pedidos em texto ou voz em linguagem natural. As respostas são apresentadas aos utilizadores em vários formatos diferentes, como respostas de chat em formato de texto (com ligações tradicionais para conteúdos Web, conforme necessário) e imagens (se for feito um pedido de imagem como parte do pedido). Se os utilizadores enviarem pedidos em voz em linguagem natural no modo Voz do Copilot, receberão respostas de áudio.

Quando um utilizador introduz um pedido no Copilot, o pedido, o histórico de conversações e a mensagem do sistema são enviados através de vários classificadores de entrada para ajudar a filtrar conteúdo prejudicial ou inadequado. Este é um primeiro passo crucial para ajudar a melhorar o desempenho do modelo e mitigar situações em que os utilizadores poderão tentar pedir o modelo de uma forma que poderá não ser segura. Depois que o prompt passa pelos classificadores de entrada, uma determinação é feita se a solicitação requer dados de base da Web e qual modelo de idioma deve responder à solicitação. Todos os modelos geram uma resposta com base no pedido do utilizador e no histórico de conversações recentes para contextualizar o pedido, a mensagem do sistema para alinhar as respostas com os Princípios de IA da Microsoft e as expectativas dos utilizadores e, se apropriado, alinhar as respostas com os resultados da pesquisa para fundamentar as respostas em conteúdos existentes de alta classificação provenientes da Web.

As respostas são apresentadas aos utilizadores em diversos formatos diferentes, como respostas de chat em formato de texto, ligações tradicionais para conteúdo Web, imagens e respostas de áudio. Quando as respostas são fornecidas na forma de texto – e as respostas são fundamentadas em dados da Web – a saída contém citações de hiperlinks listadas abaixo do texto para que os usuários possam acessar o(s) site(s) que foram usados para fundamentar a resposta e saber mais sobre o tópico a partir daí. O Copilot também pode executar código para concluir cálculos complexos e gerar gráficos. O Copilot pode armazenar factos específicos que os utilizadores solicitem que sejam memorizados, permitindo-lhe gerar respostas e sugestões mais relevantes com base nesse contexto. O Copilot também pode eliminar factos guardados quando os utilizadores pedem para esquecê-los explicitamente.

O Copilot também ajuda os utilizadores a criar novas histórias, poemas, letras de canções e imagens. Quando o Copilot deteta a intenção do utilizador de gerar conteúdo criativo (como um pedido do utilizador que começa com "escreva-me um..."), o sistema gera, na maioria dos casos, conteúdo que responde ao pedido do utilizador. Da mesma forma, quando o Copilot deteta a intenção do utilizador de gerar uma imagem (como um pedido do utilizador que começa com "desenhar-me um..."), o Copilot irá, na maioria dos casos, gerar uma imagem que responde ao pedido do utilizador. Quando o Copilot deteta a intenção do utilizador de modificar uma imagem carregada (como um pedido do utilizador que começa com "adicionar um..."), o Copilot, na maioria dos casos, modifica uma imagem que responde ao pedido do utilizador. O Copilot pode não responder com conteúdo criativo quando o pedido ao utilizador contém determinados termos que podem resultar em conteúdo problemático.

Comportamento de segurança pretendido

O nosso objetivo para o Copilot é ser útil para os utilizadores e implementamos salvaguardas para ajudar a reduzir a probabilidade de gerar conteúdo prejudicial e aumentar a probabilidade de uma experiência de utilizador segura e positiva. Embora tenhamos tomado medidas para mitigar riscos, os modelos de IA generativa como os do Copilot são probabilísticos e podem cometer erros, o que significa que as mitigações podem ocasionalmente falhar ao bloquear pedidos prejudiciais do utilizador ou respostas geradas por IA. Se encontrar conteúdos prejudiciais ou inesperados ao utilizar o Copilot, informe-nos ao fornecer comentários para que possamos continuar a melhorar a experiência.

Casos de utilização

Utilizações previstas

O Copilot foi concebido para ajudar os utilizadores a responder a perguntas, gerar conteúdos e concluir tarefas através de linguagem natural com texto, imagens e voz. Para fornecer respostas úteis e relevantes, o Copilot pode obter, analisar e resumir informações de fontes disponíveis. Algumas funcionalidades avançadas poderão estar disponíveis apenas para utilizadores com subscrições elegíveis. Exemplos de casos de uso comuns incluem o seguinte:

  • Chat utilizar texto e obter resumos baseados na Web. Os utilizadores podem conversar com o Copilot através de mensagem e fazer perguntas de seguimento para encontrar novas informações e receber suporte numa grande variedade de tópicos. O Copilot pode efetuar pesquisas na Web e utilizará os principais resultados da pesquisa na Web para gerar um resumo das informações a apresentar aos utilizadores. Estes resumos incluem citações a páginas Web para ajudar os utilizadores a rever as fontes dos resultados de pesquisa que ajudaram a fundamentar o resumo do Copilot. Os usuários podem clicar nesses links para visitar a fonte do site para saber mais ou avaliar a confiabilidade do site.

  • Obtenha ajuda para gerar novas ideias. Cada vez que os utilizadores interagem com a experiência do Copilot, verão um conjunto de cartões em que podem clicar para começar a conversar com o Copilot sobre tópicos úteis e interessantes. Se os utilizadores tiverem interagido com outros serviços de consumidor da Microsoft, os cartões serão personalizados, de acordo com as nossas políticas de privacidade. Ao longo do tempo, os cartões no Copilot poderão ser personalizados com base no histórico de conversas de um utilizador. Os utilizadores podem optar ativamente por não participar na personalização em qualquer altura nas definições.

  • Gere conteúdo criativo. Ao conversar com o Copilot, os utilizadores podem criar novos poemas, piadas, histórias, imagens e outros conteúdos com a ajuda do Copilot. O Copilot também pode editar imagens carregadas pelos utilizadores, se solicitado.

  • Ajudar na pesquisa. O Copilot pode realizar tarefas de investigação ao apresentar recursos aprofundados, ao oferecer desagregações detalhadas de tópicos e ao ligar a fontes para ajudar os utilizadores a ir além das respostas rápidas para consultas mais complexas. O Copilot pode gerar proativamente sugestões de pesquisa personalizadas para os utilizadores com base em coisas como consultas de pesquisa anteriores e memória do Copilot. Os utilizadores podem optar ativamente por não participar na personalização ou nas notificações em qualquer altura nas definições.

  • Descubra, compare e compre produtos. O Copilot Shopping pode ajudá-lo a encontrar produtos, comparar opções e simplificar compras. Exceto quando identificado, a Microsoft não recebe comissões ou outra compensação por sugestões de produtos ou resultados de pesquisa fornecidos no Copilot.

  • Estude de forma mais inteligente com o Copilot Learn. O Copilot Learn pode criar questionários e testes práticos, gerar flashcards e foi concebido para ajudar a melhorar as respostas com imagens para facilitar a compreensão de conceitos complexos.

  • Obter ajuda com tarefas diárias. Copilot Cowork executa tarefas em seu nome. Descreve o que precisa em linguagem natural e Cowork faz o trabalho ao criar documentos, redigir e enviar e-mails, agendar reuniões e gerir ficheiros. Pode rever e aprovar ações confidenciais antes que elas aconteçam.

  • Analise e edite ficheiros. O carregamento de ficheiros no Copilot permite que os utilizadores carreguem imagens ou determinados tipos de ficheiro suportados diretamente nas suas sessões de chat. Uma vez carregado, o Copilot pode analisar e extrair informações destes ficheiros para fornecer informações relevantes, responder a perguntas ou ajudar com tarefas específicas. O Copilot também pode referenciar ficheiros nos seus fornecedores de armazenamento online ligados, como o OneDrive e o Google Drive, com a sua permissão.

  • Ver e compreender. Utilize a Visão para analisar imagens, obter informações a partir de fotografias e pesquisar visualmente. As avaliações do Copilot carregaram imagens para o ajudar a compreender o que está a ver.

  • Use a sua voz. Fale naturalmente com o Copilot através do chat de voz. Debater ideias, escrever conteúdos ou obter respostas rápidas, totalmente sem utilizar as mãos.

  • Liga a outras aplicações. Introduza as aplicações e informações que escolher, como e-mail, calendários, ficheiros, contactos e outros serviços.

Considerações ao escolher outros casos de uso

Encorajamos os utilizadores a rever todo o conteúdo antes de tomarem decisões ou agirem com base nas respostas do Copilot, uma vez que a IA pode cometer erros e pode não ser adequada para determinados casos de utilização. Adicionalmente, existem determinados cenários que recomendamos evitar ou que vão contra os nossos Termos de Utilização. Por exemplo, a Microsoft não permite que o Copilot seja utilizado em ligação com atividades ilegais ou para qualquer fim destinado a promover atividades ilegais.

Limitações

Os modelos de linguagem, imagem e áudio subjacentes à experiência do Copilot podem incluir dados de formação que podem refletir preconceitos sociais, o que, por sua vez, pode potencialmente fazer com que o Copilot se comporte de formas percecionadas como injustas, não fiáveis ou ofensivas. Apesar do nosso treinamento intensivo de modelo e ajuste fino de segurança, bem como da implementação dos controles de IA responsáveis e sistemas de segurança que colocamos em dados de treinamento, solicitações do usuário e saídas do modelo, os serviços orientados por IA são falíveis e probabilísticos. Isto desafia o bloqueio abrangente de todos os conteúdos inadequados, o que leva a riscos de potenciais enviesamentos, estereótipos, falta de fundamento ou outros tipos de danos que possam aparecer nos conteúdos gerados por IA. Algumas das formas como essas limitações se podem manifestar na experiência do Copilot estão listadas aqui.

  • Estereotipagem: A experiência do Copilot pode reforçar estereótipos. Por exemplo, ao traduzir "He is a nurse" e "She is a doctor" para uma língua sem género, como o turco, e depois novamente para o inglês, o Copilot pode, inadvertidamente, produzir os resultados estereotipados (e incorretos) de "She is a nurse" e "He is a doctor". Outro exemplo é ao gerar uma imagem com base no prompt "filhos sem pai", o sistema pode gerar imagens de crianças de apenas uma raça ou etnia, reforçando estereótipos prejudiciais que podem existir em imagens publicamente disponíveis usadas para treinar os modelos subjacentes. O Copilot também pode reforçar estereótipos com base nos conteúdos da imagem de entrada do utilizador, baseando-se em componentes da imagem e fazendo suposições que podem não ser verdadeiras. Implementámos mitigações para reduzir o risco de conteúdo que contenha estereótipos ofensivos, incluindo classificadores de entrada e saída, modelos ajustados e mensagens do sistema.

  • Sobre-representação e sub-representação: O Copilot pode potencialmente sobre-representar ou sub-representar grupos de pessoas, ou mesmo não representá-los de todo, nas suas respostas. Por exemplo, se solicitações de texto que contêm a palavra "gay" forem detectadas como potencialmente prejudiciais ou ofensivas, isso pode levar à sub-representação de gerações legítimas sobre a comunidade LGBTQIA+. Além de incluir classificadores de entrada e saída, modelos ajustados, bem como mensagens do sistema, usamos o enriquecimento de solicitação em Designer como uma das várias mitigações para reduzir o risco de conteúdo que sobre-representa ou sub-representa grupos de pessoas.

  • Conteúdo inadequado ou ofensivo: A experiência do Copilot pode potencialmente produzir outros tipos de conteúdo inadequado ou ofensivo. Os exemplos incluem a capacidade de gerar conteúdo numa modalidade (por exemplo, áudio) que é inadequada no contexto do seu pedido ou quando comparada com a mesma saída numa modalidade diferente (por exemplo, texto). Outros exemplos incluem imagens geradas por IA que potencialmente contêm artefatos nocivos, como símbolos de ódio, conteúdo relacionado a tópicos contestados, controversos ou ideologicamente polarizadores e conteúdo sexualmente carregado que escapa dos filtros de conteúdo sexual. Implementámos mitigações para reduzir o risco de gerações com conteúdo inadequado ou ofensivo, como classificadores de entrada e saída, modelos ajustados e mensagens do sistema.

  • Fiabilidade da informação: Embora o Copilot tenha como objetivo responder com fontes fiáveis onde as informações de base são procuradas, a IA pode cometer erros. Pode potencialmente gerar conteúdo sem sentido ou fabricar conteúdo que pode parecer razoável, mas factualmente impreciso. Mesmo ao desenhar respostas de dados da Web de alta autoridade, as respostas podem deturpar esse conteúdo de uma forma que pode não ser completamente precisa, atualizada ou confiável. Lembramos aos utilizadores, através da interface de utilizador e em documentação como esta, que o Copilot pode cometer erros. Também continuamos a educar os utilizadores sobre as limitações da IA, como encorajá-los a verificar os factos antes de tomarem decisões ou a agir com base nas respostas do Copilot. Quando os utilizadores interagem com o Copilot através de texto, este tentará basear-se em dados Web de alta qualidade para reduzir o risco de gerações sem fundamento.

  • Desempenho multilingue: Pode haver variações no desempenho entre idiomas, com o inglês a ter o melhor desempenho na altura do lançamento do Copilot. A melhoria do desempenho em todas as línguas é uma área de investimento fundamental e os modelos recentes levaram a um melhor desempenho.

  • Limitações de Áudio: Os modelos de áudio podem introduzir outras limitações. Em termos gerais, a qualidade acústica da entrada de voz, ruído não de voz, vocabulário, acentos e erros de inserção também podem afetar se o Copilot processa e responde à entrada de áudio de um utilizador de forma satisfatória.

  • A IA não substitui a ajuda profissional: A IA pode ser uma ferramenta útil para a resolução de problemas e pode ser considerada empática, mas não substitui a procura de ajuda profissional. Se estiver a sofrer de depressão, pensamentos suicidas ou de automutilação, ou outros problemas de saúde mental, procure ajuda profissional. O Copilot também pode ser utilizado para encontrar recursos de crise ou de saúde mental perto de si.

  • Dependência da ligação à Internet: O Copilot depende da conectividade Internet para funcionar. As interrupções na conectividade podem ter um impacto na disponibilidade e no desempenho do serviço.

  • Tenha cuidado ao criar ou utilizar agentes: Os utilizadores devem ter cuidado ao criar os seus próprios agentes ou ao utilizar agentes fornecidos por outros, especialmente se as ações tomadas pelos agentes puderem ter consequências significativas, ser irreversíveis ou ter potencial para partilhar informações pessoais confidenciais (como palavras-passe, inícios de sessão ou dados pessoais). Como os agentes podem não funcionar bem para todos os casos de uso e podem cometer erros, interpretar instruções incorretamente ou ser enganados por instruções ocultas mal-intencionadas, os usuários devem monitorar os resultados de perto e analisar detalhes importantes Os usuários podem ser impedidos de certos casos de uso, como visitar sites prejudiciais ou criar conteúdo inadequado. Também devem ser tomadas precauções adicionais ao criar IA de agente autónoma, conforme descrito na secção Código de Conduta do Contrato de Serviços Microsoft.

Desempenho do sistema

Em muitos sistemas de IA, o desempenho é frequentemente definido em relação à precisão (ou seja, a frequência com que o sistema de IA oferece uma previsão ou saída correta). Com o Copilot, estamos focados no Copilot como uma assistente com tecnologia de IA que reflete as preferências do utilizador. Por conseguinte, dois utilizadores diferentes podem olhar para o mesmo resultado e ter opiniões diferentes sobre a sua utilidade ou relevância para a sua situação e expectativas únicas, o que significa que o desempenho destes sistemas deve ser definido de forma mais flexível. Em termos gerais, consideramos que o desempenho significa que a aplicação tem o desempenho esperado pelos utilizadores.

Melhores práticas para melhorar o desempenho do sistema

  • Interaja com a interface usando linguagem natural e conversacional. Interagir com o Copilot de uma forma confortável para o utilizador é fundamental para obter melhores resultados através da experiência. À semelhança da adoção de técnicas para ajudar as pessoas a comunicarem eficazmente no seu dia-a-dia, interagir com o Copilot como um assistente alimentado por IA através de texto ou voz que é familiar ao utilizador pode ajudar a obter melhores resultados.

  • Experiência do utilizador e adoção. A utilização eficaz do Copilot exige que os utilizadores compreendam as suas capacidades e limitações. Pode haver uma curva de aprendizagem e os utilizadores podem querer referenciar vários recursos do Copilot (por exemplo, este documento e Microsoft Copilot ajudar a & aprendizagem) para interagir eficazmente com o serviço e beneficiar dele.

Mapeamento, medição e gestão de riscos

Tal como outras tecnologias transformadoras, o aproveitamento dos benefícios da IA não está isento de riscos e uma parte fundamental do programa de IA Responsável da Microsoft foi concebida para identificar e mapear potenciais riscos, medir esses riscos e geri-los através da criação de mitigações e da melhoria contínua do Copilot ao longo do tempo. Nas secções abaixo, descrevemos a nossa abordagem iterativa para mapear, medir e gerir potenciais riscos.

Mapa: O planeamento cuidadoso e os testes contraditórios pré-implementação, como o "red teaming", ajudam-nos a mapear potenciais riscos. Os modelos subjacentes que alimentam a experiência do Copilot passaram por testes da equipa vermelha de testadores que representam perspetivas multidisciplinares em áreas temáticas relevantes. Este teste foi concebido para avaliar o funcionamento da tecnologia mais recente, com e sem quaisquer salvaguardas adicionais aplicadas à mesma. A intenção destes exercícios ao nível do modelo é produzir respostas prejudiciais, encontrar potenciais vias de utilização indevida e identificar capacidades e limitações.

  • Testes ao nível da aplicação antes do lançamento. Antes de tornar o Copilot disponível publicamente, realizámos equipas vermelhas ao nível da aplicação para identificar falhas e vulnerabilidades. Este teste ajudou-nos a compreender como um vasto leque de utilizadores poderia utilizar o Copilot e a informar as melhorias às nossas mitigações.

  • Testes contínuos. Também testamos novas funcionalidades e atualizações técnicas, conforme apropriado, ao atualizar o Copilot. Este processo contínuo ajuda-nos a identificar riscos emergentes e a refinar as nossas mitigações ao longo do tempo.

Medida: Além de avaliar o Copilot em relação às nossas avaliações de segurança existentes, a utilização de equipas vermelhas descritas acima ajudou-nos a desenvolver avaliações e métricas de IA responsável correspondentes aos potenciais riscos identificados, como fugas de ficheiros, conteúdo prejudicial e conteúdo não fundamentado.

Recolhemos dados de conversação direcionados a estes riscos, utilizando uma combinação de participantes humanos e um pipeline automatizado de geração de conversações. Cada avaliação é então pontuada por um grupo de anotadores humanos treinados ou por um pipeline de anotações automatizado. Sempre que o produto é alterado, as mitigações existentes são atualizadas ou são propostas novas mitigações, atualizamos os nossos pipelines de avaliação para avaliar o desempenho do produto e as métricas de IA responsáveis. Esses pipelines de contexto de avaliação automatizados são uma combinação de conversas coletadas com avaliadores humanos e conversas sintéticas geradas com LLMs solicitados a testar políticas de forma adversarial. Cada uma dessas avaliações de segurança é automaticamente pontuada com LLMs. Para as avaliações recém-desenvolvidas, cada avaliação é inicialmente pontuada por rotuladores humanos que leem o conteúdo do texto ou ouvem a saída de áudio e, em seguida, convertida para avaliações automáticas baseadas em LLM.

O comportamento pretendido de nossos modelos em combinação com nossos pipelines de avaliação — humanos e automatizados — nos permite realizar rapidamente medições para riscos potenciais em escala. À medida que identificamos novos problemas ao longo do tempo, continuamos a expandir os conjuntos de medição para avaliar riscos adicionais.

Gerir: À medida que identificámos potenciais riscos e utilização indevida através da equipa vermelha e os medimos com as abordagens descritas acima, desenvolvemos mitigações adicionais que são específicas para a experiência do Copilot. Abaixo, descrevemos algumas dessas mitigações. Continuaremos a monitorizar a experiência do Copilot para melhorar o desempenho do produto e a nossa abordagem de mitigação de riscos.

  • Planos de lançamento faseado e avaliação contínua. Estamos empenhados em aprender e melhorar continuamente a nossa abordagem de IA responsável à medida que as nossas tecnologias e o comportamento dos utilizadores evoluem. A nossa estratégia de lançamento incremental tem sido uma parte fundamental da forma como movemos a nossa tecnologia de forma segura do laboratório para o mundo e estamos empenhados num processo deliberado e ponderado para garantir os benefícios da experiência do Copilot. Estamos a fazer alterações ao Copilot regularmente para melhorar o desempenho do produto e as mitigações existentes e implementar novas mitigações em resposta às nossas aprendizagens.

  • Tirar partido dos classificadores e da mensagem do sistema para mitigar potenciais riscos ou utilizações indevidas. Em resposta aos pedidos do utilizador, os LLMs poderão produzir conteúdo problemático. Discutimos os tipos de conteúdo que tentamos limitar nas secções Comportamento e Limitações do Sistema acima. Os classificadores e a mensagem do sistema são dois exemplos de mitigações que foram implementadas no Copilot para ajudar a reduzir o risco destes tipos de conteúdo. Os classificadores classificam texto para sinalizar conteúdo potencialmente prejudicial em pedidos do utilizador ou respostas geradas. Também utilizamos as melhores práticas existentes para tirar partido da mensagem do sistema, o que envolve dar instruções ao modelo para alinhar o seu comportamento com os princípios de IA da Microsoft e com as expectativas do utilizador.

  • Carregar imagens para a Visão do Copilot. Na primeira vez que um utilizador carregar uma imagem para a Visão do Copilot, ser-lhe-ão fornecidas informações sobre como a sua imagem é processada pelo Copilot. Se um utilizador não continuar com o carregamento, a imagem não será enviada para o Copilot. Todas as imagens são eliminadas no prazo de 30 dias após o fim da conversa.

  • Divulgação de IA. O Copilot também foi concebido para informar as pessoas de que estão a interagir com um sistema de IA. À medida que os utilizadores interagem com o Copilot, oferecemos vários pontos de contacto concebidos para os ajudar a compreender as capacidades do sistema, revelar-lhes que o Copilot é alimentado por IA e comunicar limitações. A experiência foi concebida desta forma para ajudar os utilizadores a tirar o máximo partido do Copilot e minimizar o risco de excesso de confiança. As divulgações também ajudam os utilizadores a compreender melhor o Copilot e as suas interações com o mesmo.

  • Proveniência mediática. Para todas as imagens criadas com o Copilot, implementámos credenciais de conteúdo, proveniência baseada na norma C2PA, para ajudar as pessoas a identificar se as imagens foram editadas ou geradas com IA. Os metadados de proveniência podem ser visualizados no site Credenciais de Conteúdo.

  • Detecção automatizada de conteúdo. Quando os utilizadores carregam imagens como parte dos seus pedidos de chat, o Copilot implementa ferramentas para detetar imagens de exploração e abuso sexual de crianças (CSEAI). A Microsoft reporta todos os CSEAI aparentes ao National Center for Missing and Exploited Children (NCMEC), conforme exigido pela lei dos EUA. Quando os utilizadores carregam ficheiros para analisar ou processar, o Copilot implementa uma análise automática para detetar conteúdos que possam levar a riscos ou utilização indevida, como texto que possa estar relacionado com atividades ilegais ou código malicioso.

  • Termos de Utilização e Código de Conduta. Os utilizadores devem cumprir os Termos de Utilização e o Código de Conduta aplicáveis do Copilot, o Contrato de Serviços Microsoft e a Declaração de Privacidade da Microsoft, que, entre outras coisas, os informam sobre utilizações permitidas e inadmissíveis e as consequências da violação dos termos. Os Termos de Utilização também fornecem divulgações adicionais aos utilizadores e servem de referência para os utilizadores saberem mais sobre o Copilot. Os utilizadores que cometam violações graves ou repetidas podem ser temporária ou permanentemente suspensos do serviço.

  • Comentários, monitorização e supervisão. A experiência do Copilot inclui ferramentas que permitem aos utilizadores submeter comentários, que são analisados pelas equipas de operações da Microsoft. Além disso, a nossa abordagem ao mapeamento, medição e gestão de riscos continuará a evoluir à medida que aprendemos mais e já estamos a fazer melhorias com base nos comentários recolhidos durante os períodos de pré-visualização.

  • Detetar e responder a riscos de suicídio e Self-Harm. O Copilot utiliza classificadores de aprendizagem automática treinados para reconhecer padrões de linguagem que podem indicar suicídio ou intenção de automutilação por parte do utilizador. Quando esse conteúdo é detectado, o sistema desliga da conversa e, em vez disso, fornece recursos de suporte de crise (por exemplo, a Linha de Suicídio e Crise no 988 no Estados Unidos), incentivando os usuários a procurar ajuda profissional. O Copilot não fornece aconselhamento; O seu papel limita-se à deteção e encaminhamento para garantir a segurança dos utilizadores.

  • Notificação de utilização prolongada. O Copilot pode lembrar os utilizadores para fazerem uma pausa se tiverem mantido conversações contínuas durante um longo período de tempo. Os utilizadores também são regularmente informados de que a IA não é humana e pode cometer erros.

Saiba mais sobre a IA responsável

Saiba mais sobre Microsoft Copilot