18 agosto 2026
Nota
- Le informazioni contenute in questo articolo si applicano solo all'uso di Microsoft Copilot da parte di persone che hanno eseguito l'accesso con un account Microsoft, ad esempio un indirizzo di posta elettronica personale.
- Per informazioni sull'uso di Microsoft Copilot nelle organizzazioni in cui gli utenti hanno eseguito l'accesso con il proprio account aziendale o dell'istituto di istruzione, vedere Scheda applicazione: Microsoft Copilot (per le organizzazioni).
Che cos'è una nota sulla trasparenza?
Un sistema di intelligenza artificiale include non solo la tecnologia, ma anche le persone che la utilizzeranno, le persone che ne saranno interessate e l'ambiente in cui viene implementata. Le note sulla trasparenza di Microsoft hanno lo scopo di aiutarti a capire come funziona la tecnologia di intelligenza artificiale alla base di Copilot, le scelte che abbiamo fatto che influenzano le prestazioni e il comportamento del sistema e l'importanza di pensare all'intero sistema, in modo che gli utenti di Copilot possano assumere il controllo delle proprie esperienze e comprendere i passaggi che stiamo adottando per fornire un prodotto sicuro e protetto.
Le note sulla trasparenza di Microsoft fanno parte di uno sforzo più ampio di Microsoft per mettere in pratica i principi dell'intelligenza artificiale. Per altre informazioni, vedere i principi di Microsoft AI.
Nozioni di base su Microsoft Copilot
Introduzione
Microsoft Copilot consente di passare dall'idea al lavoro finito, tutto in un'unica posizione. Copilot è integrato in Word, Excel, PowerPoint, Outlook, Teams e altro ancora, riunendo i file e le informazioni che usi in un'unica esperienza. Copilot può aiutarti a creare documenti, presentazioni e fogli di calcolo raffinati, a creare bozze di messaggi di posta elettronica, a organizzare la tua giornata e a ottenere risposte basate sul lavoro che stai svolgendo. Con Cowork, Copilot può anche aiutare con attività più grandi e in più fasi e consegnare attività completate. Puoi anche scegliere tra i principali modelli di intelligenza artificiale per diversi tipi di lavoro. Le funzionalità specifiche variano in base all'abbonamento.
Microsoft prende sul serio il suo impegno per un'intelligenza artificiale responsabile. Copilot è stato sviluppato in linea con i principi dell'intelligenza artificiale di Microsoft, lo standard di intelligenza artificiale responsabile di Microsoft e in collaborazione con esperti di intelligenza artificiale responsabile in tutta l'azienda, tra cui l'Office of Responsible AI di Microsoft, i nostri team di ingegneri, Microsoft Research e Aether. Per altre informazioni, vedi Intelligenza artificiale responsabile in Microsoft.
In questo documento descriviamo il nostro approccio all'intelligenza artificiale responsabile per Copilot. Prima del rilascio, abbiamo sfruttato i metodi all'avanguardia di Microsoft per mappare, misurare e gestire i potenziali rischi e l'uso improprio del sistema e per garantirne i vantaggi per gli utenti. Mentre abbiamo continuato a far evolvere Copilot, abbiamo anche continuato a imparare e migliorare i nostri sforzi per un'intelligenza artificiale responsabile. Questo documento verrà aggiornato periodicamente per comunicare l'evoluzione dei processi e dei metodi.
Termini chiave
Classificatori Modelli di apprendimento automatico che aiutano a ordinare i dati in classi o categorie di informazioni etichettate. In Copilot, uno dei modi in cui usiamo i classificatori è quello di rilevare il contenuto potenzialmente dannoso inviato dagli utenti o generato dal sistema per mitigare la generazione di tale contenuto e l'uso improprio o abuso del sistema.
Grounding Per alcune conversazioni in cui gli utenti cercano informazioni, Copilot è basato sui risultati della ricerca Web. Ciò significa che Copilot concentra la sua risposta su contenuti con ranking elevato provenienti dal Web e fornisce citazioni con collegamenti ipertestuali dopo le risposte di testo generate o nelle trascrizioni delle conversazioni in modalità vocale.
Modelli linguistici di grandi dimensioni (LLM) I modelli linguistici di grandi dimensioni (LLM) in questo contesto sono modelli di intelligenza artificiale addestrati su grandi quantità di dati di testo per prevedere le parole in sequenza. I LLM possono eseguire un'ampia gamma di attività, ad esempio generazione, riepilogo, traduzione, classificazione e altro ancora.
Mitigazione Metodo o combinazione di metodi progettati per ridurre i potenziali rischi che possono derivare dall'uso delle funzionalità di intelligenza artificiale in Copilot.
Modelli multimodali (MMM) I modelli multimodali (MMM) sono modelli di intelligenza artificiale addestrati su diversi tipi di dati, ad esempio testo, immagini o audio. Questi modelli possono eseguire un'ampia gamma di attività, ad esempio scrivere testo, descrivere immagini, riconoscere il parlato e trovare informazioni in diversi tipi di dati.
Prompt Input sotto forma di testo, immagini e/o audio che un utente invia a Copilot per interagire con le funzionalità di intelligenza artificiale all'interno di Copilot.
Team rosso Tecniche utilizzate dagli esperti per valutare i limiti e le vulnerabilità di un sistema e per testare l'efficacia delle mitigazioni pianificate. I test del team rosso includono tester che adottano sia personalità benigne che avversarie per identificare potenziali rischi e sono distinti dalla misurazione sistematica dei rischi.
Risposte Testo, immagini o audio generati da Copilot in risposta a una richiesta o come parte del botta e risposta con l'utente. I sinonimi di risposta includono completamento e generazione.
Modelli linguistici di piccole dimensioni (SLM) I modelli linguistici di piccole dimensioni (SLM) in questo contesto sono modelli di intelligenza artificiale addestrati su quantità di dati più piccole e focalizzate rispetto ai modelli linguistici di grandi dimensioni. Nonostante le loro dimensioni ridotte, gli SLM possono eseguire una varietà di compiti, come la generazione, il riepilogo, la traduzione e la classificazione del testo. Sebbene possano non corrispondere alle ampie capacità dei LLM, gli SLM sono spesso più efficienti in termini di risorse e possono essere altamente efficaci per applicazioni specifiche e mirate.
Messaggio di sistema Il messaggio di sistema (a volte indicato come "metaprompt") è un programma che serve a guidare il comportamento del sistema. Parti del messaggio di sistema consentono di allineare il comportamento del sistema ai principi dell'intelligenza artificiale e alle aspettative degli utenti di Microsoft. Ad esempio, un messaggio di sistema può includere una riga come "non fornire informazioni o creare contenuti che potrebbero causare danni fisici, emotivi o finanziari".
Funzionalità
Comportamento del sistema
Con Copilot, abbiamo sviluppato un approccio innovativo per offrire agli utenti un'esperienza di intelligenza artificiale più personalizzata, per un'esperienza coinvolgente che può aiutare gli utenti con un'ampia gamma di attività. Questo approccio innovativo sfrutta un'ampia gamma di tecnologie avanzate, ad esempio modelli linguistici e multimodali di Microsoft, OpenAI e altri sviluppatori di modelli. Abbiamo lavorato all'implementazione di tecniche di sicurezza per i modelli alla base di Copilot prima del rilascio pubblico per sviluppare un set personalizzato di funzionalità e comportamenti che offrano un'esperienza avanzata di Copilot. In Copilot, gli utenti possono inviare richieste in linguaggio naturale, testo o voce. Le risposte vengono presentate agli utenti in diversi formati, ad esempio in forma di testo (con collegamenti tradizionali a contenuti Web, se necessario) e immagini (se è stata effettuata una richiesta di immagine come parte della richiesta). Se gli utenti inviano richieste in linguaggio naturale nella modalità Copilot Voice, riceveranno risposte audio.
Quando un utente immette un prompt in Copilot, la richiesta, la cronologia delle conversazioni e il messaggio di sistema vengono inviati tramite diversi classificatori di input per filtrare i contenuti dannosi o inappropriati. Questo è un primo passaggio cruciale per migliorare le prestazioni del modello e mitigare le situazioni in cui gli utenti potrebbero tentare di richiedere il modello in un modo che potrebbe essere pericoloso. Una volta che la richiesta passa attraverso i classificatori di input, viene stabilito se la richiesta richiede dati di base dal Web e quale modello linguistico deve rispondere alla richiesta. Tutti i modelli generano una risposta usando la richiesta dell'utente e la cronologia delle conversazioni recenti per contestualizzare la richiesta, il messaggio di sistema per allineare le risposte ai principi dell'intelligenza artificiale di Microsoft e alle aspettative degli utenti e, se appropriato, allineare le risposte con i risultati della ricerca per trovare risposte in contenuti esistenti con ranking elevato provenienti dal Web.
Le risposte vengono presentate agli utenti in diversi formati, ad esempio in forma di testo, collegamenti tradizionali a contenuti Web, immagini e risposte audio. Quando le risposte vengono fornite sotto forma di testo e le risposte sono basate su dati provenienti dal Web, l'output contiene citazioni con collegamento ipertestuale elencate sotto il testo in modo che gli utenti possano accedere ai siti Web usati per fondare la risposta e saperne di più sull'argomento da lì. Copilot può anche eseguire codice per completare calcoli complessi e generare grafici. Copilot può memorizzare fatti specifici che gli utenti gli richiedono di ricordare, consentendo di generare risposte e suggerimenti più pertinenti in base a tale contesto. Copilot può anche eliminare i fatti salvati quando gli utenti chiedono di dimenticarli esplicitamente.
Copilot aiuta anche gli utenti a creare nuove storie, poesie, testi di brani e immagini. Quando Copilot rileva l'intento dell'utente di generare contenuti creativi (ad esempio una richiesta che inizia con "scrivimi un ..."), il sistema genererà, nella maggior parte dei casi, contenuti che rispondono alla richiesta dell'utente. Allo stesso modo, quando Copilot rileva l'intento dell'utente di generare un'immagine (ad esempio una richiesta che inizia con "disegnami un ..."), Copilot genererà nella maggior parte dei casi un'immagine che risponde alla richiesta dell'utente. Quando Copilot rileva l'intenzione dell'utente di modificare un'immagine caricata (ad esempio, una richiesta che inizia con "aggiungi un ..."), Copilot modificherà nella maggior parte dei casi un'immagine che risponde alla richiesta dell'utente. Copilot potrebbe non rispondere con contenuti creativi quando la richiesta dell'utente contiene determinati termini che potrebbero creare contenuti problematici.
Comportamento di sicurezza previsto
Il nostro obiettivo per Copilot è essere utile agli utenti e implementiamo misure di sicurezza per ridurre la probabilità di generare contenuti dannosi e aumentare la probabilità di un'esperienza utente sicura e positiva. Sebbene abbiamo adottato misure per mitigare i rischi, i modelli di IA generativa come quelli alla base di Copilot sono probabilistici e possono commettere errori, il che significa che le misure di prevenzione potrebbero occasionalmente non riuscire a bloccare le richieste dannose degli utenti o le risposte generate dall'IA. Se riscontri contenuti dannosi o imprevisti durante l'uso di Copilot, segnalacelo fornendo un feedback in modo che possiamo continuare a migliorare l'esperienza.
Casi d'uso
Destinazioni d'uso
Copilot è progettato per aiutare gli utenti a rispondere alle domande, generare contenuti e completare attività attraverso il linguaggio naturale usando testo, immagini e voce. Per fornire risposte utili e pertinenti, Copilot può recuperare, analizzare e riassumere le informazioni dalle fonti disponibili. Alcune funzionalità avanzate potrebbero essere disponibili solo per gli utenti con abbonamenti idonei. Esempi di casi d'uso comuni includono:
Chat usare il testo e ottenere riepiloghi basati sul Web. Gli utenti possono chattare con Copilot tramite SMS e porre domande di completamento per trovare nuove informazioni e ricevere supporto su un'ampia gamma di argomenti. Copilot può eseguire ricerche sul Web e utilizzerà i risultati principali della ricerca sul Web per generare un riepilogo delle informazioni da presentare agli utenti. Questi riepiloghi includono citazioni a pagine Web per aiutare gli utenti a esaminare le fonti per i risultati della ricerca che hanno contribuito a fondare il riepilogo di Copilot. Gli utenti possono fare clic su questi collegamenti per visitare la fonte del sito Web per saperne di più o valutare l'affidabilità del sito Web.
Ottieni aiuto per generare nuove idee. Ogni volta che gli utenti interagiscono con l'esperienza Copilot, vedranno un set di schede su cui possono fare clic per iniziare a chattare con Copilot su argomenti utili e interessanti. Se gli utenti hanno interagito con altri servizi Microsoft per i consumatori, i buoni verranno personalizzati, in linea con le nostre politiche sulla privacy. Nel corso del tempo, le schede in Copilot possono essere personalizzate in base alla cronologia della chat di un utente. Gli utenti possono rifiutare esplicitamente la personalizzazione in qualsiasi momento nelle impostazioni.
Genera contenuti creativi. Durante la chat con Copilot, gli utenti possono creare nuove poesie, barzellette, storie, immagini e altri contenuti con l'aiuto di Copilot. Copilot può anche modificare le immagini caricate dagli utenti, se richiesto.
Aiuta con la ricerca. Copilot può svolgere attività di ricerca facendo emergere risorse approfondite, offrendo suddivisioni dettagliate degli argomenti e collegando le fonti per aiutare gli utenti ad andare oltre le risposte rapide per query più complesse. Copilot può generare in modo proattivo suggerimenti di ricerca personalizzati per gli utenti in base a elementi come query di ricerca precedenti e memoria di Copilot. Gli utenti possono rifiutare esplicitamente la personalizzazione o le notifiche in qualsiasi momento nelle impostazioni.
Scopri, confronta e acquista prodotti. Copilot Shopping consente di trovare prodotti, confrontare le opzioni e semplificare gli acquisti. Ad eccezione di dove identificato, Microsoft non riceve commissioni o altri compensi per i suggerimenti sui prodotti o i risultati della ricerca forniti in Copilot.
Studia in modo più intelligente con Copilot Learn. Copilot Learn può creare quiz e test pratici, generare flashcard ed è progettato per aiutare a migliorare le risposte con immagini per rendere concetti complessi più facili da capire.
Ottieni assistenza per le attività quotidiane. Copilot Cowork esegue attività per tuo conto. Descrivi ciò di cui hai bisogno in un linguaggio naturale e Cowork fa il lavoro, creando documenti, scrivendo e inviando e-mail, programmando riunioni e gestendo file. È possibile esaminare e approvare le azioni sensibili prima che si verifichino.
Analizzare e modificare file. Il caricamento di file in Copilot consente agli utenti di caricare immagini o determinati tipi di file supportati direttamente nelle sessioni di chat. Una volta caricati, Copilot può analizzare ed estrarre informazioni da questi file per fornire approfondimenti pertinenti, rispondere a domande o assistere in attività specifiche. Copilot può anche fare riferimento a file nei provider di archiviazione online connessi, come OneDrive e Google Drive, con la tua autorizzazione.
Vedere e capire. Usa Visione per analizzare le immagini, ottenere informazioni approfondite dalle foto ed effettuare ricerche visive. Copilot esamina le immagini caricate per aiutarti a capire cosa stai vedendo.
Usa la tua voce. Parla in modo naturale con Copilot usando la chat vocale. Discuti idee, scrivi contenuti o ricevi risposte rapide, completamente a mani libere.
Si connette ad altre app. Inserisci le app e le informazioni che preferisci, come e-mail, calendari, file, contatti e altri servizi.
Considerazioni nella scelta di altri casi d'uso
Invitiamo gli utenti a rivedere tutti i contenuti prima di prendere decisioni o agire in base alle risposte di Copilot, poiché l'intelligenza artificiale può commettere errori e potrebbe non essere adatta a determinati casi d'uso. Inoltre, ci sono alcuni scenari che è consigliabile evitare o che vanno contro le nostre Condizioni per l'utilizzo. Ad esempio, Microsoft non consente l'uso di Copilot in relazione ad attività illegali o per qualsiasi scopo volto a promuovere attività illegali.
Limitazioni
Il linguaggio, le immagini e i modelli audio alla base dell'esperienza Copilot possono includere dati di formazione che possono riflettere pregiudizi sociali, che a loro volta possono potenzialmente indurre Copilot a comportarsi in modi percepiti come ingiusti, inaffidabili o offensivi. Nonostante l'addestramento intensivo dei modelli e la messa a punto della sicurezza, nonché l'implementazione dei controlli di intelligenza artificiale responsabili e dei sistemi di sicurezza che inseriamo nei dati di addestramento, nei prompt degli utenti e negli output dei modelli, i servizi basati sull'intelligenza artificiale sono fallibili e probabilistici. Per questo motivo è difficile bloccare in modo completo tutti i contenuti inappropriati, con il rischio che potenziali pregiudizi, stereotipi, infondatezza o altri tipi di danni che potrebbero apparire nei contenuti generati dall'intelligenza artificiale. Alcuni dei modi in cui queste limitazioni potrebbero manifestarsi nell'esperienza Copilot sono elencati di seguito.
Stereotipi: L'esperienza Copilot potrebbe potenzialmente rafforzare gli stereotipi. Ad esempio, quando si traduce "È un'infermiera" e "Lei è un medico" in una lingua senza genere come il turco e quindi di nuovo in inglese, Copilot potrebbe inavvertitamente produrre i risultati stereotipati (e errati) di "Lei è un'infermiera" e "Lui è un medico". Un altro esempio è quando si genera un'immagine basata sul prompt "Bambini senza padre", il sistema potrebbe generare immagini di bambini di una sola razza o etnia, rafforzando gli stereotipi dannosi che potrebbero esistere nelle immagini disponibili pubblicamente utilizzate per addestrare i modelli sottostanti. Copilot potrebbe anche rafforzare gli stereotipi basati sui contenuti dell'immagine di input dell'utente, basandosi sui componenti dell'immagine e facendo supposizioni che potrebbero non essere vere. Sono state implementate misure di prevenzione per ridurre il rischio di contenuti che contengono stereotipi offensivi, inclusi classificatori di input e output, modelli ottimizzati e messaggi di sistema.
Sovrarappresentazione e sottorappresentazione: Copilot potrebbe potenzialmente sovrarappresentare o sottorappresentare gruppi di persone, o addirittura non rappresentarli affatto, nelle sue risposte. Ad esempio, se le richieste di testo che contengono la parola "gay" vengono rilevate come potenzialmente dannose o offensive, ciò potrebbe portare a una sottorappresentazione delle generazioni legittime riguardo alla comunità LGBTQIA+. Oltre a includere classificatori di input e output, modelli ottimizzati e messaggi di sistema, in Designer si usa l'arricchimento della richiesta come una delle numerose misure di prevenzione per ridurre il rischio di contenuti che sovrarappresentano o sottorappresentano gruppi di persone.
Contenuti inappropriati o offensivi: L'esperienza Copilot può potenzialmente produrre altri tipi di contenuti inappropriati o offensivi. Ad esempio, la possibilità di generare contenuto in una modalità (ad esempio, audio) che è inappropriato nel contesto del prompt o se confrontato con lo stesso output in una modalità diversa (ad esempio, testo). Altri esempi includono immagini generate dall'intelligenza artificiale che potenzialmente contengono artefatti dannosi come simboli di odio, contenuti che si riferiscono ad argomenti contestati, controversi o ideologicamente polarizzanti e contenuti sessualmente carichi che eludono i filtri dei contenuti relativi alla sessualità. Abbiamo messo in atto misure di prevenzione per ridurre il rischio di generazioni che contengono contenuti inappropriati o offensivi, ad esempio classificatori di input e output, modelli ottimizzati e messaggi di sistema.
Affidabilità delle informazioni: Mentre Copilot mira a rispondere con fonti affidabili in cui si cercano informazioni fondate, l'IA può commettere errori. Potrebbe potenzialmente generare contenuti senza senso o fabbricare contenuti che potrebbero sembrare ragionevoli ma sono di fatto imprecisi. Anche quando si ottengono risposte da dati Web di alta autorità, le risposte potrebbero travisare il contenuto in un modo che potrebbe non essere completamente accurato, aggiornato o affidabile. Ricordiamo agli utenti attraverso l'interfaccia utente e in documentazione come questa che Copilot può commettere errori. Continuiamo anche a educare gli utenti sui limiti dell'intelligenza artificiale, ad esempio incoraggiandoli a ricontrollare i fatti prima di prendere decisioni o agire in base alle risposte di Copilot. Quando gli utenti interagiscono con Copilot tramite SMS, cercherà di radicarsi in dati Web di alta qualità per ridurre il rischio che le generazioni non siano fondate.
Prestazioni multilingue: Potrebbero esserci variazioni nelle prestazioni tra le lingue, con l'inglese che offre i risultati migliori al momento del rilascio di Copilot. Il miglioramento delle prestazioni in tutte le lingue è un'area di investimento chiave e i modelli recenti hanno portato a prestazioni migliorate.
Limitazioni audio: I modelli audio potrebbero introdurre altre limitazioni. In generale, anche la qualità acustica dell'input vocale, il rumore non vocale, il vocabolario, gli accenti e gli errori di inserimento potrebbero influire sul fatto che Copilot elabori e risponda in modo soddisfacente all'input audio di un utente.
L'intelligenza artificiale non sostituisce l'aiuto professionale: L'intelligenza artificiale può essere uno strumento utile per la risoluzione dei problemi e può essere considerata empatica, ma non può sostituire la ricerca di un aiuto professionale. Se soffri di depressione, pensieri suicidi o autolesionismo o altri problemi di salute mentale, cerca un aiuto professionale. Copilot può essere usato anche per trovare risorse di crisi o di salute mentale vicino a te.
Dipendenza dalla connettività Internet: Il funzionamento di Copilot si basa sulla connettività Internet. Le interruzioni della connettività possono avere un impatto sulla disponibilità e sulle prestazioni del servizio.
Presta attenzione quando crei o usi agenti: Gli utenti devono prestare attenzione quando creano i propri agenti o usano agenti forniti da altri, soprattutto se le azioni intraprese dagli agenti potrebbero avere conseguenze significative, essere irreversibili o avere il potenziale per condividere informazioni personali sensibili (come password, accessi o dati personali). Poiché gli agenti potrebbero non funzionare bene per tutti i casi d'uso e potrebbero commettere errori, interpretare erroneamente le istruzioni o essere ingannati da istruzioni nascoste dannose, gli utenti devono monitorare attentamente i risultati ed esaminare dettagli importanti Gli utenti potrebbero essere limitati da determinati casi d'uso, come la visita a siti Web dannosi o la creazione di contenuti inappropriati. È inoltre necessario prendere ulteriori precauzioni durante la creazione di IA agente autonomo, come descritto più avanti nella sezione Codice di comportamento del Contratto di Servizi Microsoft.
Prestazioni di sistema
In molti sistemi di intelligenza artificiale, le prestazioni sono spesso definite in relazione all'accuratezza (ovvero, alla frequenza con cui il sistema di intelligenza artificiale offre una previsione o un output corretto). Con Copilot, ci concentriamo su Copilot come assistente basato sull'intelligenza artificiale che riflette le preferenze dell'utente. Pertanto, due utenti diversi potrebbero guardare lo stesso output e avere opinioni diverse su quanto sia utile o rilevante per la loro situazione e le loro aspettative uniche, il che significa che le prestazioni per questi sistemi devono essere definite in modo più flessibile. In generale, le prestazioni vengono considerate come le prestazioni dell'applicazione previste dagli utenti.
Procedure consigliate per migliorare le prestazioni del sistema
Interagisci con l'interfaccia usando un linguaggio naturale e colloquiale. Interagire con Copilot in modo comodo per l'utente è fondamentale per ottenere risultati migliori attraverso l'esperienza. Analogamente all'adozione di tecniche per aiutare le persone a comunicare efficacemente nella loro vita quotidiana, interagire con Copilot come assistente basato sull'intelligenza artificiale tramite testo o discorso familiare all'utente può aiutare a ottenere risultati migliori.
Esperienza utente e adozione. L'uso efficace di Copilot richiede che gli utenti ne comprendano le capacità e i limiti. Potrebbe esserci una curva di apprendimento e gli utenti potrebbero voler fare riferimento a varie risorse Copilot (ad esempio, questo documento e Microsoft Copilot aiuto & l'apprendimento) per interagire in modo efficace e trarre vantaggio dal servizio.
Mappatura, misurazione e gestione dei rischi
Come altre tecnologie di trasformazione, sfruttare i vantaggi dell'intelligenza artificiale non è privo di rischi e una parte fondamentale del programma di intelligenza artificiale responsabile di Microsoft è progettata per identificare e mappare i potenziali rischi, misurare tali rischi e gestirli creando misure di prevenzione e migliorando continuamente Copilot nel tempo. Nelle sezioni seguenti viene descritto l'approccio iterativo per mappare, misurare e gestire i potenziali rischi.
Mappa: Un'attenta pianificazione e i test avversari prima della distribuzione, come il team rosso, ci aiutano a mappare i potenziali rischi. I modelli sottostanti che alimentano l'esperienza di Copilot sono stati sottoposti a test in red team da tester che rappresentano prospettive multidisciplinari in aree tematiche rilevanti. Questo test è stato progettato per valutare come funzionerebbe la tecnologia più recente sia con che senza ulteriori misure di sicurezza applicate. L'intenzione di questi esercizi a livello di modello è quella di produrre risposte dannose, far emergere potenziali vie per l'uso improprio e identificare capacità e limitazioni.
Test a livello di applicazione prima del rilascio. Prima di rendere Copilot disponibile pubblicamente, abbiamo condotto un team rosso a livello di applicazione per identificare carenze e vulnerabilità. Questi test ci hanno aiutato a comprendere come un'ampia gamma di utenti potrebbe usare Copilot e hanno apportato miglioramenti alle nostre misure di prevenzione.
Test in corso. Durante l'aggiornamento di Copilot testiamo anche nuove funzionalità e aggiornamenti tecnici, se appropriato. Questo processo continuo ci aiuta a identificare i rischi emergenti e a perfezionare le nostre misure di prevenzione nel tempo.
Misura: Oltre a valutare Copilot rispetto alle nostre valutazioni di sicurezza esistenti, l'uso del team di rete sopra descritto ci ha aiutato a sviluppare valutazioni e metriche di intelligenza artificiale responsabile corrispondenti ai potenziali rischi identificati, come jailbreak, contenuti dannosi e contenuti infondati.
Sono stati raccolti dati conversazionali mirati a questi rischi, usando una combinazione di partecipanti umani e una pipeline di generazione di conversazioni automatizzata. Ogni valutazione viene quindi valutata da un pool di annotatori umani addestrati o da una pipeline di annotazione automatica. Ogni volta che i cambiamenti dei prodotti, le misure di prevenzione esistenti vengono aggiornate o vengono proposte nuove misure di prevenzione, aggiorniamo le pipeline di valutazione per valutare le prestazioni del prodotto e le metriche di intelligenza artificiale responsabile. Queste pipeline di contesto di valutazione automatizzate sono una combinazione di conversazioni raccolte con valutatori umani e conversazioni sintetiche generate con LLM chiamati a testare i criteri in modo contraddittorio. Ciascuna di queste valutazioni di sicurezza viene automaticamente valutata con LLM. Per le valutazioni di nuova concezione, ogni valutazione viene inizialmente valutata da etichettatori umani che leggono il contenuto testuale o ascoltano l'output audio, quindi convertita in valutazioni automatiche basate su LLM.
Il comportamento previsto dei nostri modelli in combinazione con le nostre pipeline di valutazione, sia umane che automatizzate, ci consente di eseguire rapidamente la misurazione dei potenziali rischi su vasta scala. Man mano che identifichiamo nuovi problemi nel tempo, continuiamo ad espandere i set di misurazioni per valutare rischi aggiuntivi.
Gestisci: Così come abbiamo identificato i potenziali rischi e l'uso improprio tramite il team di rete e li abbiamo misurati con gli approcci descritti in precedenza, abbiamo sviluppato ulteriori misure di prevenzione specifiche per l'esperienza Copilot. Di seguito sono descritte alcune di queste misure di prevenzione. Continueremo a monitorare l'esperienza di Copilot per migliorare le prestazioni del prodotto e il nostro approccio di mitigazione dei rischi.
Piani di rilascio a fasi e valutazione continua. Ci impegniamo a imparare e migliorare continuamente il nostro approccio all’IA generativa man mano che le nostre tecnologie e il comportamento degli utenti evolvono. La nostra strategia di rilascio incrementale è stata una parte fondamentale del modo in cui spostiamo la nostra tecnologia in modo sicuro dal laboratorio al mondo e ci impegniamo a un processo consapevole e riflessivo per garantire i vantaggi dell'esperienza Copilot. Apportiamo regolarmente modifiche a Copilot per migliorare le prestazioni del prodotto e le misure di prevenzione esistenti e implementare nuove misure di prevenzione in risposta alle nostre attività di apprendimento.
Sfruttare i classificatori e il messaggio di sistema per ridurre i potenziali rischi o l'uso improprio. In risposta alle richieste dell'utente, i modelli linguistici di grandi dimensioni possono produrre contenuti problematici. Abbiamo discusso dei tipi di contenuto che cerchiamo di limitare nelle sezioni Comportamento del sistema e Limitazioni precedenti. I classificatori e il messaggio di sistema sono due esempi di mitigazione implementate in Copilot per ridurre il rischio di questi tipi di contenuto. I classificatori classificano il testo per contrassegnare contenuti potenzialmente dannosi nei prompt dell'utente o nelle risposte generate. Usiamo anche le procedure consigliate esistenti per sfruttare il messaggio di sistema, che prevede l'invio di istruzioni al modello per allinearne il comportamento ai principi dell'intelligenza artificiale di Microsoft e alle aspettative degli utenti.
Caricamento di immagini in Copilot Vision. La prima volta che un utente carica un'immagine su Copilot Vision, gli verranno fornite informazioni su come la sua immagine viene elaborata da Copilot. Se un utente non continua con il caricamento, l'immagine non verrà inviata a Copilot. Tutte le immagini vengono eliminate entro 30 giorni dalla fine della conversazione.
Divulgazione di intelligenza artificiale. Copilot è progettato anche per informare le persone che stanno interagendo con un sistema di intelligenza artificiale. Man mano che gli utenti interagiscono con Copilot, offriamo vari punti di contatto progettati per aiutarli a comprendere le funzionalità del sistema, rivelare loro che Copilot è basato sull'intelligenza artificiale e comunicare le limitazioni. L'esperienza è progettata in questo modo per aiutare gli utenti a ottenere il massimo da Copilot e ridurre al minimo il rischio di dipendenza eccessiva. Le divulgazioni aiutano anche gli utenti a comprendere meglio Copilot e le loro interazioni con esso.
Provenienza dei media. Per tutte le immagini create con Copilot, abbiamo implementato le credenziali di contenuto, la provenienza in base allo standard C2PA, per aiutare le persone a identificare se le immagini sono state modificate o generate con l'intelligenza artificiale. I metadati di provenienza possono essere visualizzati nel sito Credenziali contenuto.
Rilevamento automatico del contenuto. Quando gli utenti caricano immagini come parte del prompt della chat, Copilot distribuisce strumenti per rilevare le immagini di sfruttamento e abuso sessuale dei minori (CSEAI). Microsoft segnala tutti i casi di CSEAI al National Center for Missing and Exploited Children (NCMEC), come richiesto dalla legge statunitense. Quando gli utenti caricano file da analizzare o elaborare, Copilot implementa la scansione automatica per rilevare contenuti che potrebbero comportare rischi o uso improprio, ad esempio testo che potrebbe riguardare attività illegali o codice dannoso.
Condizioni per l'utilizzo e Codice di comportamento. Gli utenti devono rispettare le Condizioni per l'utilizzo e il Codice di comportamento di Copilot, il Contratto di Servizi Microsoft e l'Informativa sulla privacy di Microsoft, che, tra le altre cose, li informano degli usi consentiti e non consentiti e delle conseguenze della violazione delle condizioni. Le Condizioni per l'utilizzo forniscono anche informazioni aggiuntive per gli utenti e fungono da riferimento per gli utenti per conoscere Copilot. Gli utenti che commettono violazioni gravi o ripetute possono essere sospesi temporaneamente o definitivamente dal servizio.
Feedback, monitoraggio e supervisione. L'esperienza Copilot include strumenti che consentono agli utenti di inviare feedback, che viene esaminato dai team operativi di Microsoft. Inoltre, il nostro approccio alla mappatura, alla misurazione e alla gestione dei rischi continuerà a evolversi man mano che ne impariamo di più e stiamo già apportando miglioramenti in base al feedback raccolto durante i periodi di anteprima.
Rilevare e rispondere ai rischi di suicidio e Self-Harm. Copilot usa classificatori di apprendimento automatico addestrati per riconoscere modelli linguistici che potrebbero indicare un intento suicida o autolesionistico da parte dell'utente. Quando viene rilevato tale contenuto, il sistema si disimpegna dalla conversazione e fornisce invece risorse di supporto di crisi (ad esempio, Suicide and Crisis Lifeline al 988 negli Stati Uniti), incoraggiando gli utenti a cercare un aiuto professionale. Copilot non fornisce consulenza; Il suo ruolo è limitato al rilevamento e al rinvio per garantire la sicurezza degli utenti.
Notifica di utilizzo esteso. Copilot può ricordare agli utenti di fare una pausa se sono stati impegnati in una conversazione continua per un lungo periodo di tempo. Gli utenti vengono inoltre regolarmente informati che l'IA non è umana e può commettere errori.