Transparenzhinweis für Microsoft Copilot (für Einzelpersonen)

Dienstag, 18. August 2026

Hinweis

  • Die Informationen in diesem Artikel gelten nur für die Verwendung von Microsoft Copilot durch Personen, die mit einem Microsoft-Konto angemeldet sind, z. B. einer privaten E-Mail-Adresse.
  • Informationen zur Verwendung von Microsoft Copilot in Organisationen, in denen Benutzer mit ihrem Geschäfts-, Schul- oder Unikonto angemeldet sind, finden Sie unter Anwendungs-Karte: Microsoft Copilot (für Organisationen).

Was ist ein Transparenzhinweis?

Ein KI-System umfasst nicht nur die Technologie, sondern auch die Menschen, die es verwenden werden, die Menschen, die davon betroffen sein werden, und die Umgebung, in der es eingesetzt wird. Die Transparenzhinweise von Microsoft sollen Ihnen helfen zu verstehen, wie die KI-Technologie hinter Copilot funktioniert, welche Entscheidungen wir getroffen haben, die die Leistung und das Verhalten des Systems beeinflussen, und wie wichtig es ist, das gesamte System zu berücksichtigen, damit Benutzer von Copilot die Kontrolle über ihre eigenen Erfahrungen übernehmen und die Schritte verstehen können, die wir unternehmen, um ein sicheres und geschütztes Produkt bereitzustellen.

Die Transparenzhinweise von Microsoft sind Teil umfassender Bemühungen bei Microsoft, unsere KI-Prinzipien in die Praxis umzusetzen. Weitere Informationen finden Sie unter den Microsoft AI-Grundsätzen.

Die Grundlagen von Microsoft Copilot

Einführung

Microsoft Copilot hilft Ihnen, von der Idee zur fertigen Arbeit zu gelangen, alles an einem Ort. Copilot ist in Word, Excel, PowerPoint, Outlook, Teams und mehr integriert, sodass die Dateien und Informationen, die Sie verwenden, in einer einzigen Oberfläche zusammengeführt werden. Copilot kann Ihnen helfen, ansprechende Dokumente, Präsentationen und Tabellenkalkulationen zu erstellen, E-Mails zu entwerfen, Ihren Tag zu organisieren und Antworten zu erhalten, die in Ihrer Arbeit verankert sind. Mit Cowork kann Copilot auch bei größeren, mehrstufigen Aufgaben helfen und erledigte To-Dos liefern. Sie können auch zwischen führenden KI-Modellen für verschiedene Arten von Arbeit wählen. Spezifische Features variieren je nach Abonnement.

Bei Microsoft nehmen wir unser Engagement für verantwortungsvolle KI ernst. Copilot wurde in Übereinstimmung mit den KI-Grundsätzen von Microsoft, dem Responsible AI Standard von Microsoft und in Zusammenarbeit mit Experten für verantwortungsvolle KI im gesamten Unternehmen entwickelt, darunter das Office of Responsible AI von Microsoft, unsere Entwicklungsteams, Microsoft Research und Aether. Weitere Informationen finden Sie unter Verantwortungsvolle KI bei Microsoft.

In diesem Dokument beschreiben wir unseren Ansatz für verantwortungsvolle KI für Copilot. Vor der Veröffentlichung nutzten wir die hochmodernen Methoden von Microsoft, um potenzielle Risiken und Missbrauch des Systems abzubilden, zu messen und zu verwalten und um die Vorteile für die Benutzer zu sichern. Im Zuge der Weiterentwicklung von Copilot haben wir auch unsere verantwortungsvollen KI-Bemühungen weiter gelernt und verbessert. Dieses Dokument wird regelmäßig aktualisiert, um unsere sich entwickelnden Prozesse und Methoden zu kommunizieren.

Schlüsselbegriffe

Klassifizierer Modelle des maschinellen Lernens, die dabei helfen, Daten in beschriftete Klassen oder Informationskategorien zu sortieren. Eine Möglichkeit, Klassifizierer in Copilot zu verwenden, besteht darin, potenziell schädliche Inhalte zu erkennen, die von Benutzern übermittelt oder vom System generiert werden, um die Generierung dieser Inhalte und den Missbrauch oder Missbrauch des Systems zu minimieren.

Erdung Bei bestimmten Unterhaltungen, in denen Benutzer nach Informationen suchen, basiert Copilot auf den Websuchergebnissen. Das bedeutet, dass Copilot seine Antwort auf hochrelevante Inhalte aus dem Internet konzentriert und nach generierten Textantworten oder in Gesprächstranskripten im Sprachmodus verlinkte Zitate bereitstellt.

Große Sprachmodelle (LLMs) Große Sprachmodelle (LLMs) sind in diesem Zusammenhang KI-Modelle, die mit großen Mengen von Textdaten trainiert werden, um Wörter in Sequenzen vorherzusagen. LLMs können eine Vielzahl von Aufgaben ausführen, z. B. Textgenerierung, Zusammenfassung, Übersetzung, Klassifizierung und mehr.

Risikominderung Eine Methode oder Kombination von Methoden, die entwickelt wurde, um potenzielle Risiken zu reduzieren, die durch die Verwendung der KI-Features in Copilot entstehen können.

Multimodale Modelle (MMMs) Multimodale Modelle (MMMs) sind KI-Modelle, die mit verschiedenen Datentypen wie Text, Bildern oder Audio trainiert werden. Diese Modelle können eine Vielzahl von Aufgaben ausführen, z. B. das Schreiben von Text, das Beschreiben von Bildern, das Erkennen von Sprache und das Auffinden von Informationen über verschiedene Datentypen.

Prompts Eingaben in Form von Text, Bildern und/oder Audio, die ein Benutzer an Copilot sendet, um mit den KI-Features in Copilot zu interagieren.

Red Teaming Techniken, die von Experten verwendet werden, um die Einschränkungen und Schwachstellen eines Systems zu bewerten und die Wirksamkeit geplanter Abhilfemaßnahmen zu testen. Red-Teamtests umfassen Tester, die sowohl gutartige als auch gegnerische Persönlichkeiten annehmen, um potenzielle Risiken zu identifizieren, und unterscheiden sich von der systematischen Messung von Risiken.

Antworten Text, Bilder oder Audio, die Copilot als Reaktion auf eine Eingabeaufforderung oder als Teil des Hin und Her mit dem Benutzer ausgibt. Synonyme für "Antwort" sind "Ausführung" und "Antwort".

Kleine Sprachmodelle (Small Language Models, SLMs) Kleine Sprachmodelle (SLMs) sind in diesem Zusammenhang KI-Modelle, die im Vergleich zu großen Sprachmodellen mit kleineren, fokussierteren Datenmengen trainiert werden. Trotz ihrer geringeren Größe können SLMs eine Vielzahl von Aufgaben ausführen, z. B. Textgenerierung, Zusammenfassung, Übersetzung und Klassifizierung. Obwohl sie möglicherweise nicht mit den umfangreichen Funktionen von LLMs mithalten können, sind SLMs oft ressourceneffizienter und können für bestimmte, gezielte Anwendungen sehr effektiv sein.

Systemmeldung Die Systemnachricht (manchmal auch als "Metaprompt" bezeichnet) ist ein Programm, das dazu dient, das Verhalten des Systems zu steuern. Teile der Systemmeldung helfen dabei, das Systemverhalten mit den KI-Prinzipien von Microsoft und den Benutzererwartungen in Einklang zu bringen. Eine Systemmeldung kann z. B. eine Zeile enthalten wie "Geben Sie keine Informationen an und erstellen Sie keine Inhalte, die physischen, emotionalen oder finanziellen Schaden verursachen könnten".

Funktionen

Systemverhalten

Mit Copilot haben wir einen innovativen Ansatz entwickelt, um Benutzern ein personalisierteres KI-Erlebnis für eine ansprechende Erfahrung zu bieten, die Benutzern bei einer Vielzahl von Aufgaben helfen kann. Dieser innovative Ansatz nutzt eine Vielzahl fortschrittlicher Technologien, z. B. Sprach- und multimodale Modelle von Microsoft, OpenAI und anderen Modellentwicklern. Wir haben vor der Veröffentlichung an der Implementierung von Sicherheitstechniken für die Copilot zugrunde liegenden Modelle gearbeitet, um einen Satz maßgeschneiderter Funktionen und Verhaltensweisen zu entwickeln, die eine verbesserte Copilot-Erfahrung bieten. In Copilot können Benutzer Prompts in natürlicher Sprache oder Text senden. Die Antworten werden den Benutzern in verschiedenen Formaten angezeigt, z. B. Chatantworten in Textform (erforderlichenfalls mit herkömmlichen Links zu Webinhalten) und Bildern (wenn im Rahmen der Eingabeaufforderung ein Bild angefordert wurde). Wenn Benutzer Anweisungen in natürlicher Sprache im Copilot Voice-Modus senden, erhalten sie Audioantworten.

Wenn ein Benutzer eine Eingabeaufforderung in Copilot eingibt, werden die Eingabeaufforderung, der Unterhaltungsverlauf und die Systemnachricht über mehrere Eingabeklassifizierer gesendet, um schädliche oder unangemessene Inhalte herauszufiltern. Dies ist ein wichtiger erster Schritt, um die Leistung des Modells zu verbessern und Situationen zu verringern, in denen Benutzer versuchen könnten, das Modell auf eine Weise aufzufordern, die unsicher sein könnte. Sobald die Eingabeaufforderung die Eingabeklassifizierer durchlaufen hat, wird entschieden, ob die Anforderung Grounding-Daten aus dem Web erfordert und welches Sprachmodell auf die Anforderung reagieren soll. Alle Modelle generieren eine Antwort anhand der Eingabeaufforderung des Benutzers und des letzten Unterhaltungsverlaufs, um die Anforderung zu kontextualisieren, der Systemnachricht, um die Antworten mit den KI-Prinzipien von Microsoft und den Benutzererwartungen in Einklang zu bringen und gegebenenfalls Antworten mit Suchergebnissen auszurichten, um Antworten in vorhandenen, hochrangigen Inhalten aus dem Web zu gründen.

Die Antworten werden den Benutzern in verschiedenen Formaten angezeigt, z. B. Chatantworten in Textform, herkömmliche Links zu Webinhalten, Bilder und Audioantworten. Wenn Antworten in Form von Text bereitgestellt werden – und die Antworten basieren auf Daten aus dem Internet – enthält die Ausgabe unter dem Text verlinkte Zitate, sodass Benutzer auf die Websites zugreifen können, die zur Grundlage der Antwort verwendet wurden, und von dort aus mehr über das Thema erfahren können. Copilot kann auch Code ausführen, um komplexe Berechnungen durchzuführen und Diagramme zu generieren. Copilot kann bestimmte Fakten speichern, die Benutzer ihm merken möchten, sodass basierend auf diesem Kontext relevantere Antworten und Vorschläge generiert werden können. Copilot kann auch gespeicherte Fakten löschen, wenn Benutzer sie explizit vergessen möchten.

Copilot hilft Benutzern auch beim Erstellen neuer Geschichten, Gedichte, Songtexte und Bilder. Wenn Copilot die Absicht des Benutzers erkennt, kreative Inhalte zu generieren (z. B. eine Eingabeaufforderung, die mit "Schreib mir ein ..."), generiert das System in den meisten Fällen Inhalte, die auf die Eingabeaufforderung des Benutzers reagieren. Wenn Copilot die Absicht des Benutzers erkennt, ein Bild zu generieren (z. B. eine Eingabeaufforderung, die mit "Zeichne mir ein ..."), generiert Copilot in den meisten Fällen ein Bild, das auf die Eingabeaufforderung des Benutzers reagiert. Wenn Copilot die Absicht des Benutzers erkennt, ein hochgeladenes Bild zu ändern (z. B. eine Benutzereingabeaufforderung, die mit "Fügen Sie ein ..." beginnt), ändert Copilot in den meisten Fällen ein Bild, das auf die Eingabeaufforderung des Benutzers reagiert. Copilot antwortet möglicherweise nicht mit kreativen Inhalten, wenn die Benutzeraufforderung bestimmte Begriffe enthält, die zu problematischen Inhalten führen könnten.

Bestimmungsgemäßes Sicherheitsverhalten

Unser Ziel für Copilot ist es, den Benutzern zu helfen, und wir implementieren Sicherheitsvorkehrungen, um die Wahrscheinlichkeit zu verringern, dass schädliche Inhalte generiert werden, und die Wahrscheinlichkeit einer sicheren und positiven Benutzererfahrung zu erhöhen. Obwohl wir Schritte zur Risikominderung unternommen haben, sind generative KI-Modelle wie die hinter Copilot probabilistisch und können Fehler machen, was bedeutet, dass Abhilfemaßnahmen gelegentlich daran scheitern können, schädliche Benutzeraufforderungen oder KI-generierte Antworten zu blockieren. Wenn bei der Verwendung von Copilot schädliche oder unerwartete Inhalte auftreten, teilen Sie uns dies mit, indem Sie uns Feedback geben, damit wir die Erfahrung weiter verbessern können.

Anwendungsfälle

Verwendungszweck

Copilot wurde entwickelt, um Benutzern dabei zu helfen, Fragen zu beantworten, Inhalte zu generieren und Aufgaben durch natürliche Sprache mit Text, Bildern und Sprache zu erledigen. Um hilfreiche und relevante Antworten zu geben, kann Copilot Informationen aus verfügbaren Quellen abrufen, analysieren und zusammenfassen. Einige erweiterte Features sind möglicherweise nur für Benutzer mit berechtigten Abonnements verfügbar. Beispiele für häufige Anwendungsfälle sind die folgenden:

  • Chatten Sie per Text, und erhalten Sie webbasierte Zusammenfassungen. Benutzer können mit Copilot per SMS chatten und Folgefragen stellen, um neue Informationen zu finden und Unterstützung zu einer Vielzahl von Themen zu erhalten. Copilot kann Websuchen durchführen und verwendet die Top-Ergebnisse der Websuche, um eine Zusammenfassung der Informationen zu generieren, die den Benutzern präsentiert werden sollen. Diese Zusammenfassungen enthalten Zitate von Webseiten, die Benutzern helfen, die Quellen für Suchergebnisse zu überprüfen, die zur Grundlage der Zusammenfassung von Copilot beigetragen haben. Benutzer können auf diese Links klicken, um die Websitequelle zu besuchen, um mehr zu erfahren oder die Zuverlässigkeit der Website zu bewerten.

  • Erhalten Sie Hilfe beim Generieren neuer Ideen. Jedes Mal, wenn Benutzer mit der Copilot-Erfahrung interagieren, sehen sie einen Satz Karten, die sie anklicken können, um mit Copilot über nützliche und interessante Themen zu chatten. Wenn Benutzer mit anderen Microsoft-Benutzerdiensten interagiert haben, werden die Karten gemäß unseren Datenschutzrichtlinien personalisiert. Im Laufe der Zeit können Karten in Copilot basierend auf dem Chatverlauf eines Benutzers personalisiert werden. Benutzer können die Personalisierung jederzeit in den Einstellungen deaktivieren.

  • Kreative Inhalte generieren. Beim Chatten mit Copilot können Benutzer mithilfe von Copilot neue Gedichte, Witze, Geschichten, Bilder und andere Inhalte erstellen. Copilot kann auf Wunsch auch Bilder bearbeiten, die von Benutzern hochgeladen wurden.

  • Unterstützung bei der Recherche. Copilot kann Rechercheaufgaben durchführen, indem es detaillierte Ressourcen anzeigt, detaillierte Aufschlüsselungen von Themen bietet und Links zu Quellen herstellt, damit Benutzer bei komplexeren Fragen mehr als nur schnelle Antworten erhalten. Copilot kann proaktiv personalisierte Forschungsvorschläge für Benutzer generieren, die auf Elementen wie früheren Forschungsanfragen und dem Copilot-Speicher basieren. Benutzer können die Personalisierung oder Benachrichtigung jederzeit in den Einstellungen deaktivieren.

  • Produkte entdecken, vergleichen und kaufen. Copilot Shopping kann Ihnen helfen, Produkte zu finden, Optionen zu vergleichen und Einkäufe zu optimieren. Sofern nicht anders angegeben, erhält Microsoft keine Provisionen oder andere Vergütungen für Produktvorschläge oder Suchergebnisse, die in Copilot bereitgestellt werden.

  • Intelligenter lernen mit Copilot Learn. Copilot Learn kann Quizze und Übungstests erstellen, Lernkarten generieren und soll dazu beitragen, Antworten mit Bildern zu verbessern, um komplexe Konzepte leichter verständlich zu machen.

  • Erhalten Sie Hilfe bei täglichen Aufgaben. Copilot Cowork führt Aufgaben in Ihrem Namen aus. Sie beschreiben in natürlicher Sprache, was Sie benötigen, und Cowork erledigt die Arbeit, erstellt Dokumente, erstellt und sendet E-Mails, plant Besprechungen und verwaltet Dateien. Sie überprüfen und genehmigen vertrauliche Aktionen, bevor sie ausgeführt werden.

  • Analysieren und Bearbeiten von Dateien. Der Dateiupload in Copilot ermöglicht es Benutzern, Bilder oder bestimmte unterstützte Dateitypen direkt in ihre Chatsitzungen hochzuladen. Nach dem Hochladen kann Copilot Informationen aus diesen Dateien analysieren und extrahieren, um relevante Erkenntnisse zu liefern, Fragen zu beantworten oder bei bestimmten Aufgaben zu unterstützen. Copilot kann mit Ihrer Erlaubnis auch auf Dateien in Ihren verbundenen Onlinespeichern wie OneDrive und Google Drive verweisen.

  • Sehen und verstehen. Verwenden Sie Vision, um Bilder zu analysieren, Erkenntnisse aus Fotos zu gewinnen und visuell zu suchen. Copilot überprüft hochgeladene Bilder, damit Sie besser verstehen, was Sie sehen.

  • Verwenden Sie Ihre Stimme. Sprechen Sie ganz natürlich mit Copilot über den Sprachchat. Brainstorming von Ideen, Schreiben von Inhalten oder Erhalten Sie schnelle Antworten – völlig freihändig.

  • Stellt eine Verbindung zu anderen Apps her. Binden Sie die Apps und Informationen ein, die Sie auswählen, z. B. E-Mails, Kalender, Dateien, Kontakte und andere Dienste.

Überlegungen bei der Auswahl anderer Anwendungsfälle

Wir empfehlen Benutzern, alle Inhalte zu überprüfen, bevor sie Entscheidungen treffen oder basierend auf den Antworten von Copilot handeln, da KI Fehler machen kann und für bestimmte Anwendungsfälle möglicherweise nicht geeignet ist. Darüber hinaus gibt es bestimmte Szenarien, die wir zu vermeiden empfehlen oder die gegen unsere Nutzungsbedingungen verstoßen. Microsoft erlaubt beispielsweise nicht die Verwendung von Copilot in Verbindung mit illegalen Aktivitäten oder für Zwecke, die darauf abzielen, illegale Aktivitäten zu fördern.

Beschränkungen

Die Sprach-, Bild- und Audiomodelle, die der Copilot-Erfahrung zugrunde liegen, können Trainingsdaten enthalten, die gesellschaftliche Vorurteile widerspiegeln können, was wiederum dazu führen kann, dass sich Copilot auf eine Weise verhält, die als unfair, unzuverlässig oder anstößig empfunden wird. Trotz unseres intensiven Modelltrainings und der Sicherheitsfeinabstimmung sowie der Implementierung der verantwortlichen KI-Steuerungen und Sicherheitssysteme, die wir auf Trainingsdaten, Benutzereingabeaufforderungen und Modellausgaben anwenden, sind KI-gesteuerte Dienste fehlbar und probabilistisch. Dies macht es schwierig, alle unangemessenen Inhalte umfassend zu blockieren, was zu Risiken führt, dass potenzielle Vorurteile, Stereotypen, Bodenlosigkeit oder andere Arten von Schaden in KI-generierten Inhalten auftreten könnten. Einige der Möglichkeiten, wie sich diese Einschränkungen in der Copilot-Erfahrung manifestieren können, finden Sie hier.

  • Stereotypisierung: Die Copilot-Erfahrung könnte möglicherweise Stereotypen verstärken. Bei der Übersetzung von "Er ist Krankenschwester" und "Sie ist Arzt" in eine geschlechtsneutrale Sprache wie Türkisch und dann zurück ins Englische, könnte Copilot versehentlich die stereotypen (und falschen) Ergebnisse von "Sie ist Krankenschwester" und "Er ist Arzt" liefern. Ein weiteres Beispiel ist die Generierung eines Bildes basierend auf der Eingabeaufforderung "Vaterlose Kinder", bei der das System Bilder von Kindern nur einer Rasse oder ethnischen Zugehörigkeit generieren kann, wodurch schädliche Stereotypen verstärkt werden, die in öffentlich zugänglichen Bildern vorhanden sein könnten, die zum Trainieren der zugrunde liegenden Modelle verwendet werden. Copilot kann auch Stereotype basierend auf den Inhalten im Eingabebild des Benutzers verstärken, indem es sich auf Komponenten des Bilds verlässt und Annahmen trifft, die möglicherweise nicht wahr sind. Wir haben Maßnahmen zur Risikominderung implementiert, um das Risiko von Inhalten zu verringern, die anstößige Stereotypen enthalten, einschließlich Eingabe- und Ausgabeklassifizierern, optimierten Modellen und Systemmeldungen.

  • Über- und Unterrepräsentation: Copilot könnte Personengruppen in seinen Antworten möglicherweise über- oder unterrepräsentieren oder gar nicht repräsentieren. Wenn beispielsweise Textprompts, die das Wort "schwul" enthalten, als potenziell schädlich oder anstößig erkannt werden, könnte dies dazu führen, dass legitime Generationen in der LGBTQIA+-Community unterrepräsentiert sind. Zusätzlich zur Einbeziehung von Eingabe- und Ausgabeklassifizierern, fein abgestimmten Modellen sowie Systemnachrichten verwenden wir die Promptanreicherung in Designer als eine von mehreren Abhilfemaßnahmen, um das Risiko von Inhalten zu verringern, die Personengruppen über- oder unterrepräsentieren.

  • Unangemessene oder anstößige Inhalte: Die Copilot-Erfahrung kann potenziell andere Arten von unangemessenen oder anstößigen Inhalten produzieren. Beispiele hierfür sind die Möglichkeit, Inhalte in einer Modalität (z. B. Audio) zu generieren, die im Kontext ihrer Eingabeaufforderung oder im Vergleich zur gleichen Ausgabe in einer anderen Modalität (z. B. Text) unangemessen sind. Weitere Beispiele sind KI-generierte Bilder, die potenziell schädliche Artefakte wie Hasssymbole enthalten, Inhalte, die sich auf umstrittene, kontroverse oder ideologisch polarisierende Themen beziehen, und sexuell aufgeladene Inhalte, die sich den Filtern sexueller Inhalte entziehen. Wir haben Gegenmaßnahmen ergriffen, um das Risiko von Generationen zu verringern, die unangemessene oder anstößige Inhalte enthalten, z. B. Eingabe- und Ausgabeklassifizierer, optimierte Modelle und Systemnachrichten.

  • Zuverlässigkeit der Informationen: Während Copilot darauf abzielt, mit zuverlässigen Quellen zu reagieren, wenn erdende Informationen gesucht werden, kann KI Fehler machen. Sie könnte möglicherweise unsinnige Inhalte generieren oder Inhalte erfinden, die vernünftig klingen, aber sachlich ungenau sind. Selbst wenn Antworten aus Webdaten mit hoher Autorität abgerufen werden, können Antworten diesen Inhalt auf eine Weise falsch darstellen, die möglicherweise nicht ganz genau, aktuell oder zuverlässig ist. Wir erinnern Benutzer über die Benutzeroberfläche und in Dokumentationen wie dieser daran, dass Copilot Fehler machen kann. Darüber hinaus klären wir die Benutzer auch weiterhin über die Grenzen der KI auf und ermutigen sie beispielsweise, die Fakten zu überprüfen, bevor sie Entscheidungen treffen oder aufgrund der Antworten von Copilot handeln. Wenn Benutzer mit Copilot per Text interagieren, versucht es, sich auf qualitativ hochwertige Webdaten zu stützen, um das Risiko zu verringern, dass Generationen nicht mehr geerdet sind.

  • Mehrsprachige Leistung: Es kann Leistungsunterschiede zwischen den Sprachen geben, wobei Englisch zum Zeitpunkt der Veröffentlichung von Copilot am besten abschneidet. Die Verbesserung der Leistung in allen Sprachen ist ein wichtiger Investitionsbereich, und die jüngsten Modelle haben zu einer verbesserten Leistung geführt.

  • Audiobeschränkungen: Bei Audiomodellen können andere Einschränkungen gelten. Grob gesagt können sich auch die akustische Qualität der Spracheingabe, Nicht-Sprachgeräusche, Vokabular, Akzente und Einfügefehler darauf auswirken, ob Copilot die Audioeingabe eines Benutzers zufriedenstellend verarbeitet und darauf reagiert.

  • KI ist kein Ersatz für professionelle Hilfe: KI kann ein nützliches Werkzeug zur Problemlösung sein und ist einfühlsam zu sehen, aber sie ist kein Ersatz für die Suche nach professioneller Hilfe. Wenn Sie unter Depressionen, Selbstmordgedanken oder Selbstverletzung oder anderen psychischen Problemen leiden, suchen Sie bitte professionelle Hilfe auf. Copilot kann auch verwendet werden, um Krisen- oder psychische Gesundheitsressourcen in Ihrer Nähe zu finden.

  • Abhängigkeit von der Internetverbindung: Copilot ist auf Internetverbindung angewiesen, um zu funktionieren. Unterbrechungen der Konnektivität können sich auf die Verfügbarkeit und Leistung des Diensts auswirken.

  • Seien Sie vorsichtig beim Erstellen oder Verwenden von Agents: Benutzer sollten Vorsicht walten lassen, wenn sie eigene Agenten erstellen oder von anderen bereitgestellte Agenten verwenden, insbesondere wenn die von den Agenten ergriffenen Aktionen erhebliche Folgen haben könnten, irreversibel sind oder das Potenzial haben, vertrauliche personenbezogene Informationen (wie Kennwörter, Benutzernamen oder personenbezogene Daten) weiterzugeben. Da Agents möglicherweise nicht für alle Anwendungsfälle gut funktionieren und Fehler machen, Anweisungen falsch interpretieren oder durch böswillige, versteckte Anweisungen getäuscht werden können, sollten Benutzer die Ergebnisse genau überwachen und wichtige Details überprüfen. Benutzer können von bestimmten Anwendungsfällen ausgeschlossen werden, z. B. vom Besuch schädlicher Websites oder der Erstellung unangemessener Inhalte. Zusätzliche Vorsichtsmaßnahmen sollten auch beim Erstellen autonomer agentischer KI getroffen werden, wie im Abschnitt "Verhaltensregeln" im Microsoft-Servicevertrag näher beschrieben.

Systemleistung

In vielen KI-Systemen wird die Leistung häufig in Bezug auf die Genauigkeit definiert (d. h. wie oft das KI-System eine korrekte Vorhersage oder Ausgabe liefert). Bei Copilot konzentrieren wir uns auf Copilot als KI-gestützten Assistenten, der die Vorlieben des Benutzers widerspiegelt. Daher können zwei verschiedene Benutzer denselben Output betrachten und unterschiedliche Meinungen darüber haben, wie nützlich oder relevant er für ihre einzigartige Situation und ihre Erwartungen ist, was bedeutet, dass die Leistung für diese Systeme flexibler definiert werden muss. Wir verstehen unter Leistung im allgemeinen, dass die Anwendung so funktioniert, wie es die Benutzer erwarten.

Best Practices zur Verbesserung der Systemleistung

  • Interagieren Sie mit der Benutzeroberfläche in natürlicher Konversationssprache. Die Interaktion mit Copilot auf eine für den Benutzer angenehme Weise ist der Schlüssel, um bessere Ergebnisse durch die Erfahrung zu erzielen. Ähnlich wie bei der Einführung von Techniken, die Menschen dabei helfen, in ihrem täglichen Leben effektiv zu kommunizieren, kann die Interaktion mit Copilot als KI-gestützter Assistent entweder über Text oder Sprache, die dem Benutzer vertraut ist, dazu beitragen, bessere Ergebnisse zu erzielen.

  • Benutzererfahrung und Akzeptanz. Für eine effektive Nutzung von Copilot müssen die Benutzer die Funktionen und Einschränkungen verstehen. Möglicherweise gibt es eine Lernkurve, und Benutzer möchten möglicherweise auf verschiedene Copilot-Ressourcen verweisen (z. B. auf dieses Dokument und Microsoft Copilot Hilfe & Lernens), um effektiv mit dem Dienst zu interagieren und davon zu profitieren.

Abbilden, Messen und Verwalten von Risiken

Wie bei anderen transformationsorientierten Technologien ist die Nutzung der Vorteile von KI nicht risikofrei, und ein Kernbestandteil des Microsoft-Programms für verantwortungsvolle KI ist darauf ausgelegt, potenzielle Risiken zu identifizieren und abzubilden, diese Risiken zu messen und sie zu verwalten, indem Abhilfemaßnahmen entwickelt und Copilot im Laufe der Zeit kontinuierlich verbessert wird. In den folgenden Abschnitten wird unser iterativer Ansatz zum Zuordnen, Messen und Verwalten potenzieller Risiken beschrieben.

Karte: Sorgfältige Planung und gegnerische Tests vor der Bereitstellung, wie z. B. Red Teaming, helfen uns bei der Zuordnung potenzieller Risiken. Die zugrunde liegenden Modelle, die der Copilot-Erfahrung zugrunde liegen, wurden durch Red-Teamtests von Testern durchlaufen, die multidisziplinäre Perspektiven in relevanten Themenbereichen vertreten. Diese Tests wurden entwickelt, um zu bewerten, wie die neueste Technologie sowohl mit als auch ohne zusätzliche Sicherheitsvorkehrungen funktionieren würde. Die Absicht dieser Übungen auf Modellebene besteht darin, schädliche Reaktionen hervorzurufen, potenzielle Möglichkeiten für Missbrauch aufzudecken und Fähigkeiten und Einschränkungen zu identifizieren.

  • Testen auf Anwendungsebene vor der Veröffentlichung. Bevor wir Copilot öffentlich verfügbar machten, führten wir Red Teaming auf Anwendungsebene durch, um Mängel und Sicherheitsrisiken zu identifizieren. Diese Tests haben uns geholfen zu verstehen, wie eine Vielzahl von Benutzern Copilot verwenden könnte, und haben zu Verbesserungen unserer Risikominderungen beigetragen.

  • Laufende Tests. Wir testen gegebenenfalls auch neue Features und technische Updates, wenn wir Copilot aktualisieren. Dieser fortlaufende Prozess hilft uns, neu auftretende Risiken zu erkennen und unsere Risikominderungen im Laufe der Zeit zu verfeinern.

Kennzahl: Zusätzlich zur Bewertung von Copilot anhand unserer bestehenden Sicherheitsbewertungen hat uns die oben beschriebene Verwendung von Red Teaming geholfen, Bewertungen und verantwortungsvolle KI-Metriken zu entwickeln, die identifizierten potenziellen Risiken wie Jailbreaks, schädlichen Inhalten und nicht fundierten Inhalten entsprechen.

Wir haben Konversationsdaten gesammelt, die auf diese Risiken abzielen, indem wir eine Kombination aus menschlichen Teilnehmern und einer automatisierten Konversationsgenerierungspipeline verwenden. Jede Bewertung wird dann entweder von einem Pool trainierter menschlicher Annotatoren oder einer automatisierten Annotationspipeline bewertet. Jedes Mal, wenn sich das Produkt ändert, vorhandene Risikominderungen aktualisiert oder neue Risikominderungen vorgeschlagen werden, aktualisieren wir unsere Bewertungspipelines, um sowohl die Produktleistung als auch die verantwortlichen KI-Metriken zu bewerten. Diese automatisierten Bewertungskontext-Pipelines sind eine Kombination aus gesammelten Gesprächen mit menschlichen Bewertern und synthetischen Gesprächen, die mit LLMs generiert werden, die aufgefordert werden, Richtlinien kontradiktorisch zu testen. Jede dieser Sicherheitsbewertungen wird automatisch mit LLMs bewertet. Für die neu entwickelten Bewertungen wird jede Bewertung zunächst von menschlichen Labelern bewertet, die den Textinhalt lesen oder die Audioausgabe hören, und dann in automatische LLM-basierte Bewertungen umgewandelt.

Das beabsichtigte Verhalten unserer Modelle in Kombination mit unseren Bewertungspipelines – sowohl menschlich als auch automatisiert – ermöglicht es uns, schnell Messungen für potenzielle Risiken im großen Stil durchzuführen. Da wir im Laufe der Zeit neue Probleme identifizieren, erweitern wir die Messsätze weiter, um zusätzliche Risiken zu bewerten.

Verwalten: Da wir potenzielle Risiken und Missbrauch durch Red Teaming identifiziert und mit den oben beschriebenen Ansätzen gemessen haben, haben wir zusätzliche Risikominderungen entwickelt, die spezifisch für die Copilot-Erfahrung sind. Im Folgenden werden einige dieser Risikominderungen beschrieben. Wir werden die Erfahrungen mit Copilot weiterhin überwachen, um die Produktleistung und unseren Ansatz zur Risikominderung zu verbessern.

  • Stufenweise Veröffentlichungspläne und kontinuierliche Bewertung. Wir sind bestrebt, unseren verantwortungsvollen KI-Ansatz kontinuierlich zu erlernen und zu verbessern, während sich unsere Technologien und unser Benutzerverhalten weiterentwickeln. Unsere Strategie der inkrementellen Veröffentlichung war ein zentraler Bestandteil der Art und Weise, wie wir unsere Technologie sicher aus dem Labor in die Welt bringen, und wir verpflichten uns zu einem bewussten, durchdachten Prozess, um die Vorteile der Copilot-Erfahrung zu sichern. Wir nehmen regelmäßig Änderungen an Copilot vor, um die Produktleistung und vorhandene Risikominderungen zu verbessern und neue Risikominderungen als Reaktion auf unsere Erkenntnisse zu implementieren.

  • Nutzung von Klassifizierern und der Systemnachricht, um potenzielle Risiken oder Missbrauch zu minimieren. Als Reaktion auf Benutzeraufforderungen können LLMs problematische Inhalte erstellen. Inhaltstypen, die wir einzuschränken versuchen, haben wir in den Abschnitten "Systemverhalten" und "Einschränkungen" weiter oben besprochen. Klassifizierer und die Systemnachricht sind zwei Beispiele für Risikominderungen, die in Copilot implementiert wurden, um das Risiko dieser Art von Inhalten zu reduzieren. Klassifizierer klassifizieren Text, um potenziell schädliche Inhalte in Benutzereingabeaufforderungen oder generierten Antworten zu kennzeichnen. Wir nutzen auch vorhandene bewährte Methoden für die Nutzung der Systemnachricht, was beinhaltet, dass wir dem Modell Anweisungen geben, um sein Verhalten an den KI-Prinzipien von Microsoft und den Erwartungen der Benutzer auszurichten.

  • Hochladen von Bildern in Copilot Vision. Wenn ein Benutzer zum ersten Mal ein Bild in Copilot Vision hochlädt, erhält er Informationen darüber, wie sein Bild von Copilot verarbeitet wird. Wenn ein Benutzer den Upload nicht fortsetzt, wird das Bild nicht an Copilot gesendet. Alle Bilder werden innerhalb von 30 Tagen nach Beendigung der Unterhaltung gelöscht.

  • KI-Offenlegung. Copilot soll die Benutzer auch darüber informieren, dass sie mit einem KI-System interagieren. Für die Interaktion der Benutzer mit Copilot bieten wir verschiedene Berührungspunkte an, die ihnen helfen sollen, die Funktionen des Systems zu verstehen, ihnen zu verdeutlichen, dass Copilot auf KI basiert, und Einschränkungen zu kommunizieren. Die Erfahrung wurde auf diese Weise entwickelt, um Benutzern zu helfen, Copilot optimal zu nutzen und das Risiko einer übermäßigen Abhängigkeit zu minimieren. Die Offenlegungen helfen den Benutzern auch, Copilot und ihre Interaktionen damit besser zu verstehen.

  • Medienherkunft. Für alle mit Copilot erstellten Bilder haben wir Inhaltsnachweise implementiert, deren Herkunft auf dem C2PA-Standard basiert, damit Benutzer erkennen können, ob die Bilder mit KI bearbeitet oder generiert wurden. Provenienzmetadaten können auf der Website mit den Inhaltsanmeldeinformationen angezeigt werden.

  • Automatisierte Inhaltserkennung. Wenn Benutzer Bilder als Teil ihrer Chataufforderung hochladen, setzt Copilot Tools zur Erkennung von Bildern von sexueller Ausbeutung und sexuellem Missbrauch von Kindern (CSEAI) ein. Microsoft meldet alle offensichtlichen CSEAI an das National Center for Missing and Exploited Children (NCMEC), wie es das US-Recht vorschreibt. Wenn Benutzer Dateien hochladen, um sie zu analysieren oder zu verarbeiten, setzt Copilot automatisierte Scans ein, um Inhalte zu erkennen, die zu Risiken oder Missbrauch führen könnten, wie z. B. Text, der sich auf illegale Aktivitäten oder bösartigen Code beziehen könnte.

  • Nutzungsbedingungen und Verhaltensregeln. Benutzer sollten sich an die geltenden Nutzungsbedingungen und Verhaltensregeln, den Microsoft-Servicevertrag und die Microsoft-Datenschutzerklärung von Copilot halten, die sie unter anderem über zulässige und unzulässige Nutzungen und die Folgen eines Verstoßes gegen die Bedingungen informieren. Die Nutzungsbedingungen enthalten auch zusätzliche Informationen für Benutzer und dienen als Referenz für Benutzer, um mehr über Copilot zu erfahren. Benutzer, die schwerwiegende oder wiederholte Verstöße begehen, können vorübergehend oder dauerhaft vom Dienst ausgeschlossen werden.

  • Feedback, Überwachung und Aufsicht. Die Copilot-Erfahrung umfasst Tools, mit denen Benutzer Feedback übermitteln können, das von den Betriebsteams von Microsoft überprüft wird. Darüber hinaus wird sich unser Ansatz für die Kartierung, Messung und Verwaltung von Risiken weiterentwickeln, wenn wir mehr erfahren, und wir nehmen bereits Verbesserungen auf der Grundlage des Feedbacks vor, das wir während der Vorschauzeiträume gesammelt haben.

  • Erkennen und Reagieren auf Suizid- und Self-Harm Risiken. Copilot verwendet Klassifizierer für maschinelles Lernen, die darauf trainiert sind, Sprachmuster zu erkennen, die auf Selbstmord oder Selbstverletzungsabsichten des Benutzers hinweisen können. Wenn solche Inhalte erkannt werden, löst sich das System von der Unterhaltung und stellt stattdessen Krisenunterstützungsressourcen bereit (z. B. die Selbstmord- und Krisenhilfe unter 988 in den USA), wodurch Benutzer ermutigt werden, professionelle Hilfe zu suchen. Copilot bietet keine Beratung an; Seine Rolle ist auf die Erkennung und Weiterleitung beschränkt, um die Sicherheit der Benutzer zu gewährleisten.

  • Erweiterte Nutzungsbenachrichtigung. Copilot kann Benutzer daran erinnern, eine Pause einzulegen, wenn sie über einen längeren Zeitraum an einer kontinuierlichen Unterhaltung beteiligt waren. Die Nutzer werden auch regelmäßig darüber informiert, dass KI nicht menschlich ist und Fehler machen kann.

Weitere Informationen zu verantwortungsvoller KI

Weitere Informationen zu Microsoft Copilot