Transparantienotitie voor Microsoft Copilot (voor individuen)

Augustus 18, 2026

Opmerking

  • De informatie in dit artikel is alleen van toepassing op het gebruik van Microsoft Copilot door personen die zijn aangemeld met een Microsoft-account, zoals een persoonlijk e-mailadres.
  • Zie voor informatie over het gebruik van Microsoft Copilot in organisaties waar gebruikers zijn aangemeld met hun werk- of schoolaccount Toepassingskaart: Microsoft Copilot (voor organisaties).

Wat is een transparantienota?

Een AI-systeem omvat niet alleen de technologie, maar ook de mensen die het zullen gebruiken, de mensen die erdoor zullen worden beïnvloed en de omgeving waarin het wordt ingezet. De Transparantienotities van Microsoft zijn bedoeld om u te helpen begrijpen hoe de AI-technologie achter Copilot werkt, welke keuzes we hebben gemaakt die van invloed zijn op de prestaties en het gedrag van het systeem en hoe belangrijk het is om na te denken over het hele systeem, zodat gebruikers van Copilot de controle kunnen nemen over hun eigen ervaringen en de stappen kunnen begrijpen die we nemen om een veilig product te bieden.

De transparantienotities van Microsoft maken deel uit van een bredere inspanning van Microsoft om onze AI-principes in de praktijk te brengen. Zie de Microsoft AI-principes voor meer informatie.

De basisbeginselen van Microsoft Copilot

Inleiding

Microsoft Copilot helpt u om van idee naar voltooid werk te gaan, allemaal op één plek. Copilot is geïntegreerd in Word, Excel, PowerPoint, Outlook, Teams en meer, waardoor de bestanden en informatie die je gebruikt in één ervaring worden samengebracht. Copilot kan je helpen professionele documenten, presentaties en spreadsheets te maken, e-mailberichten op te stellen, je dag te organiseren en antwoorden te krijgen die zijn gebaseerd op het werk dat je doet. Met Cowork kan Copilot ook helpen met grotere taken met meerdere stappen en voltooide taken leveren. Je kunt ook kiezen tussen toonaangevende AI-modellen voor verschillende soorten werk. Specifieke functies verschillen per abonnement.

Bij Microsoft nemen we onze inzet voor verantwoorde AI serieus. Copilot is ontwikkeld in overeenstemming met de AI-principes van Microsoft, de verantwoordelijke AI-standaard van Microsoft en in samenwerking met verantwoordelijke AI-experts in het hele bedrijf, waaronder het Office of Responsible AI van Microsoft, onze engineeringteams, Microsoft Research en Aether. Meer informatie over dit onderwerp vindt u op Verantwoordelijke AI bij Microsoft.

In dit document beschrijven we onze benadering van verantwoordelijke AI voor Copilot. Voorafgaand aan de release hebben we gebruikgemaakt van de state-of-the-art methoden van Microsoft om potentiële risico's en misbruik van het systeem in kaart te brengen, te meten en te beheren en de voordelen voor gebruikers veilig te stellen. Terwijl we Copilot zijn blijven ontwikkelen, zijn we ook blijven leren en onze inspanningen op het gebied van verantwoorde AI blijven verbeteren. Dit document wordt regelmatig bijgewerkt om onze evoluerende processen en methoden te communiceren.

Kernbegrippen

Classificaties Machine learning-modellen die helpen bij het sorteren van gegevens in gelabelde klassen of informatiecategorieën. In Copilot gebruiken we classificaties bijvoorbeeld om mogelijk schadelijke inhoud te detecteren die door gebruikers is ingediend of door het systeem is gegenereerd om het genereren van die inhoud en misbruik of misbruik van het systeem te beperken.

Aarding Voor bepaalde gesprekken waarin gebruikers informatie zoeken, is Copilot gebaseerd op zoekresultaten op het web. Dit betekent dat Copilot zijn antwoord richt op hooggeplaatste inhoud van het web en hyperlinks biedt na gegenereerde tekstreacties of in gesprekstranscripties in spraakmodus.

Grote taalmodellen (LLMs) Grote taalmodellen (LLM's) in deze context zijn AI-modellen die worden getraind op grote hoeveelheden tekstgegevens om woorden in reeksen te voorspellen. LLM's kunnen verschillende taken uitvoeren, zoals het genereren, samenvatten, vertalen, classificeren en meer.

Mitigatie Een methode of combinatie van methoden die zijn ontworpen om potentiële risico's te beperken die kunnen voortvloeien uit het gebruik van de AI-functies in Copilot.

Multimodale modellen (MMM's) Multimodale modellen (MMM's) zijn AI-modellen die worden getraind op verschillende typen gegevens, zoals tekst, afbeeldingen of audio. Deze modellen kunnen diverse taken uitvoeren, zoals het schrijven van tekst, het beschrijven van afbeeldingen, het herkennen van spraak en het zoeken naar informatie in verschillende gegevenstypen.

Prompts Invoer in de vorm van tekst, afbeeldingen en/of audio die een gebruiker naar Copilot verzendt voor interactie met de AI-functies in Copilot.

Rode teams Technieken die door experts worden gebruikt om de beperkingen en kwetsbaarheden van een systeem te beoordelen en om de effectiviteit van geplande mitigaties te testen. Het testen van rode teams omvat testers die zowel goedaardige als vijandige persona's aannemen om potentiële risico's te identificeren en onderscheiden zich van systematische meting van risico's.

Reacties Tekst, afbeeldingen of audio die Copilot uitvoert als reactie op een prompt of als onderdeel van het heen en weer met de gebruiker. Synoniemen voor 'antwoord' zijn 'voltooiing', 'generatie' en 'antwoord'.

Kleine taalmodellen (SLM's) Kleine taalmodellen (SLM's) zijn in deze context AI-modellen die worden getraind op kleinere, meer gerichte hoeveelheden gegevens in vergelijking met grote taalmodellen. Ondanks hun kleinere formaat kunnen SLM's verschillende taken uitvoeren, zoals het genereren, samenvatten, vertalen en classificeren van tekst. Hoewel ze misschien niet overeenkomen met de uitgebreide mogelijkheden van LLM's, zijn SLM's vaak efficiënter met hulpbronnen en kunnen ze zeer effectief zijn voor specifieke, gerichte toepassingen.

Systeembericht Het systeembericht (soms ook wel een "metaprompt" genoemd) is een programma dat dient om het gedrag van het systeem te sturen. Delen van het systeembericht helpen om systeemgedrag af te stemmen op de AI-principes en verwachtingen van gebruikers van Microsoft. Een systeembericht kan bijvoorbeeld een regel bevatten zoals 'verstrek geen informatie en maak geen inhoud die lichamelijke, emotionele of financiële schade kan veroorzaken'.

Mogelijkheden

Systeemgedrag

Met Copilot hebben we een innovatieve aanpak ontwikkeld om gebruikers een meer gepersonaliseerde AI-ervaring te bieden voor een aantrekkelijke ervaring die gebruikers kan helpen met een verscheidenheid aan taken. Deze innovatieve aanpak maakt gebruik van een verscheidenheid aan geavanceerde technologieën, zoals taal en multimodale modellen van Microsoft, OpenAI en andere modelontwikkelaars. We hebben gewerkt aan de implementatie van veiligheidstechnieken voor de onderliggende modellen van Copilot voorafgaand aan de openbare release om een aangepaste set mogelijkheden en gedragingen te ontwikkelen die een verbeterde Copilot-ervaring bieden. In Copilot kunnen gebruikers prompts verzenden in natuurlijke taal of spraak. Antwoorden worden in verschillende indelingen aan gebruikers gepresenteerd, zoals chatantwoorden in tekstvorm (met traditionele koppelingen naar webinhoud indien nodig) en afbeeldingen (als er een afbeeldingsaanvraag is gedaan als onderdeel van de prompt). Als gebruikers prompts verzenden in natuurlijke taal binnen de Copilot Voice-modus, ontvangen ze audioantwoorden.

Wanneer een gebruiker een prompt invoert in Copilot, worden de prompt, de gespreksgeschiedenis en het systeembericht verzonden via verschillende invoerclassificaties om schadelijke of ongepaste inhoud te filteren. Dit is een belangrijke eerste stap om de prestaties van het model te verbeteren en situaties te beperken waarin gebruikers zouden kunnen proberen het model te vragen op een manier die onveilig zou kunnen zijn. Zodra de prompt de invoerclassificaties passeert, wordt bepaald of voor de aanvraag gegevens van het web moeten worden gegrond en welk taalmodel op de aanvraag moet reageren. Alle modellen genereren een antwoord met behulp van de prompt en recente gespreksgeschiedenis van de gebruiker om het verzoek te contextualiseren, het systeembericht om antwoorden af te stemmen op de AI-principes van Microsoft en de verwachtingen van gebruikers en, indien van toepassing, antwoorden af te stemmen op zoekresultaten om antwoorden te gronden in bestaande, hooggeplaatste inhoud van het web.

Antwoorden worden in verschillende indelingen aan gebruikers gepresenteerd, zoals chatantwoorden in tekstvorm, traditionele koppelingen naar webinhoud, afbeeldingen en audioreacties. Wanneer antwoorden worden gegeven in de vorm van tekst, en de antwoorden zijn gebaseerd op gegevens van internet, bevat de uitvoer hyperlinks die onder de tekst worden vermeld, zodat gebruikers toegang hebben tot de website(s) die zijn gebruikt om het antwoord te onderbouwen en van daaruit meer te weten kunnen komen over het onderwerp. Copilot kan ook code uitvoeren om complexe berekeningen te voltooien en grafieken te genereren. Copilot kan specifieke feiten opslaan die gebruikers willen onthouden, zodat er relevantere antwoorden en suggesties kunnen worden gegenereerd op basis van die context. Copilot kan ook opgeslagen feiten verwijderen wanneer gebruikers expliciet vragen om ze te vergeten.

Copilot helpt gebruikers ook bij het maken van nieuwe verhalen, gedichten, songteksten en afbeeldingen. Wanneer Copilot de intentie van de gebruiker detecteert om creatieve inhoud te genereren (zoals een gebruikersprompt die begint met 'schrijf me een ...'), genereert het systeem in de meeste gevallen inhoud die reageert op de prompt van de gebruiker'. Evenzo, wanneer Copilot de intentie van de gebruiker detecteert om een afbeelding te genereren (zoals een gebruikersprompt die begint met 'teken me een ...'), genereert Copilot in de meeste gevallen een afbeelding die reageert op de prompt van de gebruiker'. Wanneer Copilot de intentie van de gebruiker detecteert om een geüploade afbeelding te wijzigen (zoals een gebruikersprompt die begint met 'voeg een ...' toe), wijzigt Copilot in de meeste gevallen een afbeelding die reageert op de prompt van de gebruiker. Copilot reageert mogelijk niet met creatieve inhoud wanneer de gebruikersprompt bepaalde termen bevat die kunnen leiden tot problematische inhoud.

Beoogd veiligheidsgedrag

Ons doel voor Copilot is om gebruikers behulpzaam te zijn en we implementeren voorzorgsmaatregelen om de kans op het genereren van schadelijke inhoud te verkleinen en de kans op een veilige en positieve gebruikerservaring te vergroten. Hoewel we stappen hebben ondernomen om risico's te beperken, zijn generatieve AI-modellen zoals die achter Copilot probabilistisch en kunnen fouten maken, wat betekent dat oplossingen af en toe geen schadelijke gebruikersprompts of door AI gegenereerde reacties kunnen blokkeren. Als u schadelijke of onverwachte inhoud tegenkomt tijdens het gebruik van Copilot, laat ons dit dan weten door feedback te geven, zodat we de ervaring kunnen blijven verbeteren.

Use cases

Beoogd gebruik

Copilot is ontworpen om gebruikers te helpen vragen te beantwoorden, inhoud te genereren en taken uit te voeren via natuurlijke taal met behulp van tekst, afbeeldingen en spraak. Om nuttige en relevante antwoorden te bieden, kan Copilot informatie uit beschikbare bronnen ophalen, analyseren en samenvatten. Sommige geavanceerde functies zijn mogelijk alleen beschikbaar voor gebruikers met in aanmerking komende abonnementen. Hieronder vindt u enkele voorbeelden van veelvoorkomende use cases:

  • Chat met tekst en krijg websamenvattingen. Gebruikers kunnen via sms chatten met Copilot en vervolgvragen stellen om nieuwe informatie te vinden en ondersteuning te krijgen voor een breed scala aan onderwerpen. Copilot kan zoekopdrachten op het web uitvoeren en gebruikt de belangrijkste zoekresultaten op het web om een samenvatting te genereren van de informatie die aan gebruikers kan worden gepresenteerd. Deze samenvattingen bevatten bronvermeldingen naar webpagina's om gebruikers te helpen de bronnen voor zoekresultaten te controleren die hebben geholpen bij het onderbouwen van de samenvatting van Copilot. Gebruikers kunnen op deze koppelingen klikken om de websitebron te bezoeken voor meer informatie of om de betrouwbaarheid van de website te evalueren.

  • Krijg hulp bij het genereren van nieuwe ideeën. Telkens wanneer gebruikers interactie hebben met de Copilot-ervaring, zien ze een set kaarten waarop ze kunnen klikken om met Copilot te chatten over nuttige en interessante onderwerpen. Als gebruikers interactie hebben gehad met andere consumentenservices van Microsoft, worden de kaarten gepersonaliseerd, in overeenstemming met ons privacybeleid. Na verloop van tijd kunnen kaarten in Copilot worden gepersonaliseerd op basis van de chatgeschiedenis van een gebruiker. Gebruikers kunnen zich op elk gewenst moment afmelden voor personalisatie in de instellingen.

  • Genereer creatieve inhoud. Tijdens het chatten met Copilot kunnen gebruikers nieuwe gedichten, grappen, verhalen, afbeeldingen en andere inhoud maken met behulp van Copilot. Copilot kan op verzoek ook afbeeldingen bewerken die door gebruikers zijn geüpload.

  • Assisteren bij onderzoek. Copilot kan onderzoekstaken uitvoeren door diepgaande bronnen weer te geven, gedetailleerde uitsplitsingen van onderwerpen te bieden en koppelingen naar bronnen te maken om gebruikers te helpen verder te gaan dan snelle antwoorden voor complexere vragen. Copilot kan proactief gepersonaliseerde onderzoekssuggesties voor gebruikers genereren op basis van zaken als eerdere onderzoeksquery's en het Copilot-geheugen. Gebruikers kunnen zich op elk gewenst moment in de instellingen afmelden voor persoonlijke instellingen of meldingen.

  • Ontdek, vergelijk en koop producten. Copilot Shopping kan je helpen producten te vinden, opties te vergelijken en aankopen te stroomlijnen. Behalve waar geïdentificeerd, ontvangt Microsoft geen commissies of andere vergoedingen voor productsuggesties of zoekresultaten die in Copilot worden verstrekt.

  • Studeer slimmer met Copilot Learn. Copilot Learn kan quizzen en oefentests maken, flashcards genereren en is ontworpen om antwoorden te verbeteren met afbeeldingen om complexe concepten gemakkelijker te begrijpen.

  • Hulp krijgen bij dagelijkse taken. Copilot Cowork voert taken namens u uit. U beschrijft wat u nodig hebt in natuurlijke taal, en Cowork doet het werk, maakt documenten, stelt e-mail op en verzendt ze, plant vergaderingen en beheert bestanden. U beoordeelt gevoelige acties en keurt deze goed voordat deze plaatsvinden.

  • Bestanden analyseren en bewerken. Met bestandsupload in Copilot kunnen gebruikers afbeeldingen of bepaalde ondersteunde bestandstypen rechtstreeks uploaden naar hun chatsessies. Nadat deze zijn geüpload, kan Copilot informatie uit deze bestanden analyseren en extraheren om relevante inzichten te bieden, vragen te beantwoorden of te helpen bij specifieke taken. Copilot kan met jouw toestemming ook verwijzen naar bestanden in je verbonden onlineopslagproviders zoals OneDrive en Google Drive.

  • Zie en begrijp. Gebruik Vision om afbeeldingen te analyseren, inzichten te krijgen uit foto's en visueel te zoeken. Copilot bekijkt geüploade afbeeldingen om je te helpen begrijpen wat je ziet.

  • Uw stem gebruiken. Praat op een natuurlijke manier met Copilot via voicechat. Brainstorm over ideeën, schrijf inhoud of krijg snelle antwoorden, volledig handsfree.

  • Maakt verbinding met andere apps. Gebruik de apps en informatie die u kiest, zoals e-mail, agenda's, bestanden, contactpersonen en andere services.

Overwegingen bij het kiezen van andere use cases

We raden gebruikers aan alle inhoud te bekijken voordat ze beslissingen nemen of handelen op basis van de antwoorden van Copilot, omdat AI fouten kan maken en mogelijk niet geschikt is voor bepaalde toepassingen. Daarnaast zijn er bepaalde scenario's die we aanbevelen te vermijden of die in strijd zijn met onze Gebruiksvoorwaarden. Microsoft staat bijvoorbeeld niet toe dat Copilot wordt gebruikt in verband met illegale activiteiten of voor enig doel dat is bedoeld om illegale activiteiten te promoten.

Beperkingen

De taal-, afbeeldings- en audiomodellen die ten grondslag liggen aan de Copilot-ervaring kunnen trainingsgegevens bevatten die maatschappelijke vooroordelen kunnen weerspiegelen, wat er op zijn beurt weer toe kan leiden dat Copilot zich gedraagt op een manier die als oneerlijk, onbetrouwbaar of aanstootgevend wordt ervaren. Ondanks onze intensieve modeltraining en veiligheidsafstemming, evenals de implementatie van de verantwoordelijke AI-controles en veiligheidssystemen die we plaatsen op trainingsgegevens, gebruikersprompts en modeluitvoer, zijn AI-gestuurde services feilbaar en probabilistisch. Dit maakt het een uitdaging om alle ongepaste inhoud volledig te blokkeren, wat leidt tot risico's op mogelijke vooroordelen, stereotypen, ongegrondheid of andere soorten schade die kunnen voorkomen in door AI gegenereerde inhoud. Hier worden enkele manieren beschreven waarop deze beperkingen zich kunnen manifesteren in de Copilot-ervaring.

  • Stereotypering: De Copilot-ervaring kan mogelijk stereotypen versterken. Bij het vertalen van 'Hij is een verpleegkundige' en 'Zij is een dokter' in een genderloze taal zoals Turks en vervolgens weer terug in het Engels, kan Copilot bijvoorbeeld onbedoeld de stereotiepe (en onjuiste) resultaten opleveren van 'Ze is een verpleegster' en 'Hij is een dokter'. Een ander voorbeeld is dat bij het genereren van een afbeelding op basis van de prompt 'Vaderloze kinderen', het systeem afbeeldingen van kinderen van slechts één ras of etniciteit kan genereren, waardoor schadelijke stereotypen worden versterkt die kunnen bestaan in openbaar beschikbare afbeeldingen die worden gebruikt om de onderliggende modellen te trainen. Copilot kan ook stereotypen versterken op basis van de inhoud in de invoerafbeelding van de gebruiker door te vertrouwen op onderdelen van de afbeelding en aannames te doen die mogelijk niet waar zijn. We hebben oplossingen geïmplementeerd om het risico te verkleinen dat inhoud aanstootgevende stereotypen bevat, zoals invoer- en uitvoerclassificaties, nauwkeurig afgestemde modellen en systeemberichten.

  • Oververtegenwoordiging en ondervertegenwoordiging: Copilot kan mogelijk groepen mensen over- of ondervertegenwoordigen, of ze zelfs helemaal niet vertegenwoordigen in zijn antwoorden. Als tekstprompts met het woord 'homo' bijvoorbeeld worden gedetecteerd als potentieel schadelijk of aanstootgevend, kan dit leiden tot de ondervertegenwoordiging van legitieme generaties over de LGBTQIA+-gemeenschap. Naast het opnemen van invoer- en uitvoerclassificaties, nauwkeurig afgestemde modellen en systeemberichten, gebruiken we promptverrijking in Designer als een van de verschillende oplossingen om het risico te verkleinen dat inhoud groepen mensen over- of ondervertegenwoordigt.

  • Ongepaste of aanstootgevende inhoud: De Copilot-ervaring kan mogelijk andere typen ongepaste of aanstootgevende inhoud produceren. Voorbeelden hiervan zijn de mogelijkheid om inhoud te genereren in de ene modaliteit (bijvoorbeeld audio) die ongepast is in de context van de prompt of in vergelijking met dezelfde uitvoer in een andere modaliteit (bijvoorbeeld tekst). Andere voorbeelden zijn door AI gegenereerde afbeeldingen die mogelijk schadelijke artefacten bevatten, zoals haatsymbolen, inhoud die betrekking heeft op betwiste, controversiële of ideologisch polariserende onderwerpen en seksueel geladen inhoud die aan seksuele-gerelateerde inhoudsfilters ontsnapt. We hebben maatregelen genomen om het risico te verkleinen dat generaties ongepaste of aanstootgevende inhoud bevatten, zoals invoer- en uitvoerclassificaties, nauwkeurig afgestemde modellen en systeemberichten.

  • Informatie betrouwbaarheid: Hoewel Copilot ernaar streeft te reageren met betrouwbare bronnen waar wordt gezocht naar basisinformatie, kan AI fouten maken. Het kan mogelijk onzinnige inhoud genereren of inhoud verzinnen die redelijk klinkt, maar feitelijk onjuist is. Zelfs wanneer reacties worden gegenereerd uit webgegevens met hoge autoriteit, kunnen reacties een onjuiste voorstelling geven van die inhoud op een manier die mogelijk niet helemaal nauwkeurig, up-to-date of betrouwbaar is. We herinneren gebruikers er via de gebruikersinterface en in documentatie zoals deze aan dat Copilot fouten kan maken. We blijven gebruikers ook informeren over de beperkingen van AI, zoals hen aanmoedigen om feiten te controleren voordat ze beslissingen nemen of handelen op basis van de antwoorden van Copilot. Wanneer gebruikers via tekst communiceren met Copilot, probeert deze zichzelf te baseren op webgegevens van hoge kwaliteit om het risico te verkleinen dat generaties ongegrond zijn.

  • Meertalige prestaties: Er kunnen verschillen in prestaties zijn tussen talen, waarbij Engels het beste presteert op het moment van het vrijgeven van Copilot. Het verbeteren van de prestaties in verschillende talen is een belangrijk investeringsgebied, en recente modellen hebben geleid tot verbeterde prestaties.

  • Beperkingen voor audio: Audiomodellen kunnen andere beperkingen met zich meebrengen. In grote lijnen kunnen de akoestische kwaliteit van de spraakinvoer, niet-spraakruis, woordenschat, accenten en invoegfouten ook van invloed zijn op de vraag of Copilot de audio-invoer van een gebruiker op een bevredigende manier verwerkt en erop reageert.

  • AI is geen vervanging voor professionele hulp: AI kan een handig hulpmiddel zijn voor het oplossen van problemen en kan empathisch worden gezien, maar het is geen vervanging voor het zoeken naar professionele hulp. Als je last hebt van depressie, gedachten aan zelfmoord of zelfbeschadiging, of andere psychische problemen, zoek dan professionele hulp. Copilot kan ook worden gebruikt om crisis- of geestelijke gezondheidsbronnen bij jou in de buurt te vinden.

  • Afhankelijkheid van internetconnectiviteit: Copilot is afhankelijk van internetconnectiviteit om te functioneren. Onderbrekingen in de connectiviteit kunnen gevolgen hebben voor de beschikbaarheid en prestaties van de service.

  • Wees voorzichtig bij het maken of gebruiken van agents: Gebruikers moeten voorzichtig zijn bij het maken van hun eigen agents of het gebruiken van agents die door anderen worden geleverd, vooral als de acties die worden uitgevoerd door de agents aanzienlijke gevolgen kunnen hebben, onomkeerbaar kunnen zijn of mogelijk gevoelige persoonlijke gegevens (zoals wachtwoorden, aanmeldingen of persoonlijke gegevens) kunnen delen. Omdat agents mogelijk niet voor alle use cases goed werken en fouten kunnen maken, instructies verkeerd kunnen interpreteren of misleid kunnen worden door kwaadwillende verborgen instructies, dienen gebruikers de resultaten nauwlettend in de gaten te houden en belangrijke details door te nemen Gebruikers kunnen worden beperkt in bepaalde gebruikssituaties, zoals het bezoeken van schadelijke websites of het maken van ongepaste inhoud. Er moeten ook aanvullende voorzorgsmaatregelen worden genomen bij het maken van autonome agentische AI, zoals verder beschreven in de sectie Gedragscode in de Microsoft-servicesovereenkomst.

Systeemprestaties

In veel AI-systemen worden prestaties vaak gedefinieerd in relatie tot nauwkeurigheid (dat wil zeggen, hoe vaak het AI-systeem een correcte voorspelling of uitvoer biedt). Met Copilot richten we ons op Copilot als een AI-assistent die de voorkeuren van de gebruiker weerspiegelt. Daarom kunnen twee verschillende gebruikers naar dezelfde output kijken en verschillende meningen hebben over hoe nuttig of relevant het is voor hun unieke situatie en verwachtingen, wat betekent dat de prestaties voor deze systemen flexibeler moeten worden gedefinieerd. In grote lijnen wordt onder prestaties verstaan dat de toepassing presteert zoals gebruikers verwachten.

Aanbevolen procedures voor het verbeteren van de systeemprestaties

  • Communiceer met de interface met natuurlijke, gesprekstaal. Interactie met Copilot op een manier die comfortabel is voor de gebruiker is essentieel voor het behalen van betere resultaten via de ervaring. Net als bij het toepassen van technieken om mensen te helpen effectief te communiceren in hun dagelijks leven, kan interactie met Copilot als een AI-assistent via tekst of spraak waarmee de gebruiker bekend is, betere resultaten opleveren.

  • Gebruikerservaring en acceptatie. Voor effectief gebruik van Copilot moeten gebruikers de mogelijkheden en beperkingen ervan begrijpen. Er kan een leercurve zijn en gebruikers willen mogelijk verschillende Copilot-bronnen raadplegen (bijvoorbeeld dit document en Microsoft Copilot hulp & leren) om effectief met de service te communiceren en ervan te profiteren.

Risico's in kaart brengen, meten en beheersen

Net als bij andere transformationele technologieën is het benutten van de voordelen van AI niet zonder risico's. Een kernonderdeel van het verantwoordelijke AI-programma van Microsoft is ontworpen om potentiële risico's te identificeren en in kaart te brengen, deze risico's te meten en te beheren door oplossingen te bouwen en Copilot in de loop van de tijd voortdurend te verbeteren. In de onderstaande secties beschrijven we onze iteratieve aanpak voor het in kaart brengen, meten en beheren van potentiële risico's.

Kaart: Door zorgvuldige planning en voorafgaand aan de implementatie onafhankelijke tests, zoals red teaming, kunnen we potentiële risico's in kaart brengen. De onderliggende modellen die de Copilot-ervaring aansturen, zijn getest door rode teams van testers die multidisciplinaire perspectieven vertegenwoordigen in relevante onderwerpgebieden. Deze test is ontworpen om te beoordelen hoe de nieuwste technologie zou werken, zowel met als zonder aanvullende beveiligingen. De bedoeling van deze oefeningen op modelniveau is om schadelijke reacties te produceren, potentiële wegen voor misbruik aan het licht te brengen en mogelijkheden en beperkingen te identificeren.

  • Testen op toepassingsniveau vóór release. Voordat we Copilot openbaar beschikbaar maakten, hebben we red teaming op toepassingsniveau uitgevoerd om tekortkomingen en kwetsbaarheden te identificeren. Deze tests hebben ons geholpen te begrijpen hoe een breed scala aan gebruikers Copilot zou kunnen gebruiken en hebben geïnformeerd verbeteringen aangebracht in onze oplossingen.

  • Wordt voortdurend getest. We testen ook nieuwe functies en technische updates, indien van toepassing, bij het bijwerken van Copilot. Dit voortdurende proces helpt ons nieuwe risico's te identificeren en onze oplossingen in de loop van de tijd te verfijnen.

Maatregel: Naast het evalueren van Copilot ten opzichte van onze bestaande veiligheidsevaluaties, heeft het gebruik van red teaming zoals hierboven beschreven ons geholpen bij het ontwikkelen van evaluaties en verantwoordelijke AI-metrische gegevens die overeenkomen met geïdentificeerde potentiële risico's, zoals jailbreaks, schadelijke inhoud en niet-geaarde inhoud.

We hebben gespreksgegevens verzameld die gericht zijn op deze risico's, met behulp van een combinatie van menselijke deelnemers en een geautomatiseerde pijplijn voor het genereren van gesprekken. Elke evaluatie wordt vervolgens beoordeeld door een pool van getrainde menselijke annotators of een geautomatiseerde annotatiepijplijn. Telkens wanneer de productwijzigingen, bestaande oplossingen worden bijgewerkt of nieuwe oplossingen worden voorgesteld, werken we onze evaluatiepijplijnen bij om zowel de productprestaties als de verantwoordelijke AI-metrische gegevens te beoordelen. Deze geautomatiseerde evaluatiecontextpijplijnen zijn een combinatie van verzamelde gesprekken met menselijke beoordelaars en synthetische gesprekken die zijn gegenereerd met LLM's die worden gevraagd om beleid op een vijandige manier te testen. Elk van deze veiligheidsevaluaties wordt automatisch gescoord met LLM's. Voor de nieuw ontwikkelde evaluaties wordt elke evaluatie in eerste instantie gescoord door menselijke labelers die de tekstinhoud lezen of naar de audio-uitvoer luisteren, en vervolgens worden geconverteerd naar automatische op LLM gebaseerde evaluaties.

Het beoogde gedrag van onze modellen in combinatie met onze evaluatiepijplijnen - zowel menselijk als geautomatiseerd - stelt ons in staat om snel op schaal metingen uit te voeren voor potentiële risico's. Naarmate we in de loop van de tijd nieuwe problemen identificeren, blijven we de meetsets uitbreiden om extra risico's te beoordelen.

Beheren: Omdat we potentiële risico's en misbruik via red teaming hebben geïdentificeerd en gemeten met de hierboven beschreven benaderingen, hebben we aanvullende oplossingen ontwikkeld die specifiek zijn voor de Copilot-ervaring. Hieronder beschrijven we enkele van deze oplossingen. We blijven de Copilot-ervaring monitoren om de productprestaties en onze risicobeperkende aanpak te verbeteren.

  • Gefaseerde releaseplannen en voortdurende evaluatie. We zetten ons in om onze verantwoorde AI-aanpak voortdurend te leren en te verbeteren naarmate onze technologieën en gebruikersgedrag zich ontwikkelen. Onze incrementele releasestrategie is een belangrijk onderdeel geweest van de manier waarop we onze technologie veilig van het lab naar de wereld verplaatsen en we zetten ons in voor een weloverwogen, doordacht proces om de voordelen van de Copilot-ervaring veilig te stellen. We brengen regelmatig wijzigingen aan in Copilot om de productprestaties en bestaande oplossingen te verbeteren en nieuwe oplossingen te implementeren als reactie op onze inzichten.

  • Classificaties en het systeembericht gebruiken om potentiële risico's of misbruik te beperken. Als reactie op gebruikersprompts kunnen LLMs problematische inhoud produceren. We hebben typen inhoud die we proberen te beperken besproken in de secties Systeemgedrag en beperkingen hierboven. Classificaties en het systeembericht zijn twee voorbeelden van oplossingen die in Copilot zijn geïmplementeerd om het risico van deze typen inhoud te verminderen. Classificaties classificeren tekst om mogelijk schadelijke inhoud te markeren in gebruikersprompts of gegenereerde antwoorden. We gebruiken ook bestaande aanbevolen procedures om het systeembericht te benutten, wat inhoudt dat het model instructies krijgt om het gedrag af te stemmen op de AI-principes van Microsoft en op de verwachtingen van de gebruiker.

  • Afbeeldingen uploaden naar Copilot Vision. De eerste keer dat een gebruiker een afbeelding uploadt naar Copilot Vision, krijgt deze informatie over hoe de afbeelding wordt verwerkt door Copilot. Als een gebruiker niet doorgaat met uploaden, wordt de afbeelding niet naar Copilot verzonden. Alle afbeeldingen worden binnen 30 dagen na beëindiging van het gesprek verwijderd.

  • AI-openbaarmaking. Copilot is ook ontworpen om mensen te informeren dat ze interactie hebben met een AI-systeem. Wanneer gebruikers Copilot gebruiken, bieden we verschillende contactpunten die zijn ontworpen om hen te helpen de mogelijkheden van het systeem te begrijpen, aan hen bekend te maken dat Copilot mogelijk wordt gemaakt door AI en beperkingen te communiceren. De ervaring is op deze manier ontworpen om gebruikers te helpen optimaal gebruik te maken van Copilot en het risico op overmatige afhankelijkheid te minimaliseren. Openbaarmakingen helpen gebruikers ook om Copilot en hun interacties ermee beter te begrijpen.

  • Media herkomst. Voor alle afbeeldingen die met Copilot zijn gemaakt, hebben we inhoudsreferenties geïmplementeerd, herkomst op basis van de C2PA-standaard, om mensen te helpen identificeren of afbeeldingen zijn bewerkt of gegenereerd met AI. Herkomstmetagegevens kunnen worden bekeken op de site met inhoudsreferenties.

  • Geautomatiseerde inhoudsdetectie. Wanneer gebruikers afbeeldingen uploaden als onderdeel van hun chatprompt, implementeert Copilot hulpprogramma's om afbeeldingen van seksuele uitbuiting en misbruik van kinderen (CSEAI) te detecteren. Microsoft rapporteert alle schijnbare CSEAI aan het National Center for Missing and Exploited Children (NCMEC), zoals vereist door de Amerikaanse wetgeving. Wanneer gebruikers bestanden uploaden om te analyseren of te verwerken, implementeert Copilot automatisch scannen om inhoud te detecteren die tot risico's of misbruik kan leiden, zoals tekst die betrekking kan hebben op illegale activiteiten of schadelijke code.

  • Gebruiksvoorwaarden en gedragscode. Gebruikers moeten zich houden aan de toepasselijke gebruiksvoorwaarden engedragscode, de Microsoft-servicesovereenkomst en de privacyverklaring van Microsoft, die hen onder andere informeren over toegestaan en ontoelaatbaar gebruik en de gevolgen van schending van de voorwaarden. De Gebruiksvoorwaarden bieden ook aanvullende openbaarmakingen voor gebruikers en dienen als referentie voor gebruikers om meer te weten te komen over Copilot. Gebruikers die ernstige of herhaalde schendingen begaan, kunnen tijdelijk of permanent worden uitgesloten van de service.

  • Feedback, controle en toezicht. De Copilot-ervaring bevat hulpprogramma's waarmee gebruikers feedback kunnen indienen, die worden beoordeeld door de operationele teams van Microsoft. Bovendien zal onze benadering van het in kaart brengen, meten en beheren van risico's zich blijven ontwikkelen naarmate we meer leren, en we brengen nu al verbeteringen aan op basis van feedback die we hebben verzameld tijdens preview-periodes.

  • Zelfmoord- en Self-Harm risico's detecteren en erop reageren. Copilot maakt gebruik van machine learning-classificaties die zijn getraind om taalpatronen te herkennen die kunnen duiden op zelfmoord of zelfverwonding van de gebruiker. Wanneer dergelijke inhoud wordt gedetecteerd, verbreekt het systeem het gesprek en biedt het in plaats daarvan bronnen voor crisisondersteuning (bijvoorbeeld de Suicide and Crisis Lifeline op 988 in de Verenigde Staten), waardoor gebruikers worden aangemoedigd professionele hulp te zoeken. Copilot biedt geen advies; De rol van het programma is beperkt tot detectie en verwijzing om de veiligheid van de gebruiker te waarborgen.

  • Melding uitgebreid gebruik. Copilot kan gebruikers eraan herinneren om een pauze te nemen als ze gedurende langere tijd onafgebroken in gesprek zijn. Gebruikers worden ook regelmatig geïnformeerd dat AI niet menselijk is en fouten kan maken.

Meer informatie over verantwoordelijke AI

Meer informatie over Microsoft Copilot