18 Agustus 2026
Catatan
- Informasi dalam artikel ini hanya berlaku untuk penggunaan Microsoft Copilot oleh individu yang masuk dengan akun Microsoft, seperti alamat email pribadi.
- Untuk informasi tentang penggunaan Microsoft Copilot di organisasi di mana pengguna masuk dengan akun kerja atau sekolah mereka, lihat Kartu aplikasi: Microsoft Copilot (untuk organisasi).
Apa itu Catatan Transparansi?
Sistem AI tidak hanya mencakup teknologi, tetapi juga orang-orang yang akan menggunakannya, orang-orang yang akan terpengaruh olehnya, dan lingkungan di mana sistem tersebut digunakan. Catatan Transparansi Microsoft ditujukan untuk membantu Anda memahami cara kerja teknologi AI di balik Copilot, pilihan yang kami buat yang memengaruhi kinerja dan perilaku sistem, serta pentingnya memikirkan keseluruhan sistem, sehingga pengguna Copilot dapat mengontrol pengalaman mereka sendiri dan memahami langkah-langkah yang kami ambil untuk menyediakan produk yang aman dan terjamin.
Catatan Transparansi Microsoft adalah bagian dari upaya yang lebih luas di Microsoft untuk menerapkan Prinsip AI kami. Untuk mengetahui selengkapnya, lihat Prinsip Microsoft AI.
Dasar-dasar Microsoft Copilot
Pendahuluan
Microsoft Copilot membantu Anda beralih dari ide ke pekerjaan yang telah selesai, semuanya di satu tempat. Copilot diintegrasikan ke dalam Word, Excel, PowerPoint, Outlook, Teams, dan lainnya, menyatukan file dan informasi yang Anda gunakan ke dalam satu pengalaman. Copilot dapat membantu Anda membuat dokumen, presentasi, dan lembar bentang yang disempurnakan, membuat draf email, mengatur hari Anda, dan mendapatkan jawaban yang didasarkan pada pekerjaan yang Anda lakukan. Dengan Cowork, Copilot juga dapat membantu dengan tugas multi-langkah yang lebih besar dan memberikan tugas yang telah diselesaikan. Anda juga dapat memilih di antara model AI terkemuka untuk berbagai jenis pekerjaan. Fitur khusus bervariasi menurut langganan.
Di Microsoft, kami sangat serius dalam komitmen kami terhadap AI yang bertanggung jawab. Copilot telah dikembangkan sejalan dengan Prinsip AI Microsoft, Standar AI yang Bertanggung Jawab Microsoft, dan dalam kemitraan dengan pakar AI yang bertanggung jawab di seluruh perusahaan, termasuk Kantor AI yang Bertanggung Jawab Microsoft, tim teknisi kami, Microsoft Research, dan Aether. Anda dapat mempelajari selengkapnya di AI yang Bertanggung Jawab di Microsoft.
Dalam dokumen ini, kami menjelaskan pendekatan kami terhadap AI yang bertanggung jawab untuk Copilot. Menjelang rilis, kami memanfaatkan metode canggih Microsoft untuk memetakan, mengukur, dan mengelola potensi risiko dan penyalahgunaan sistem serta untuk mengamankan manfaatnya bagi pengguna. Seiring dengan terus mengembangkan Copilot, kami juga terus mempelajari dan meningkatkan upaya AI kami yang bertanggung jawab. Dokumen ini akan diperbarui secara berkala untuk mengomunikasikan proses dan metode kami yang terus berkembang.
Istilah kunci
Pengklasifikasi Model pembelajaran mesin yang membantu mengurutkan data ke dalam kelas atau kategori informasi berlabel. Di Copilot, salah satu cara kami menggunakan pengklasifikasi adalah membantu mendeteksi konten yang berpotensi berbahaya yang dikirimkan oleh pengguna atau dihasilkan oleh sistem untuk mengurangi pembuatan konten tersebut dan penyalahgunaan atau penyalahgunaan sistem.
Pembumian Untuk percakapan tertentu di mana pengguna mencari informasi, Copilot didasarkan pada hasil pencarian web. Artinya, Copilot memusatkan responsnya pada konten berperingkat tinggi dari web dan menyediakan kutipan hyperlink setelah respons teks yang dihasilkan atau dalam transkrip percakapan dalam mode suara.
Model bahasa besar (LLM) Model bahasa besar (LLM) dalam konteks ini adalah model AI yang dilatih pada data teks dalam jumlah besar untuk memprediksi kata secara berurutan. LLM dapat melakukan berbagai tugas, seperti pembuatan teks, meringkas, terjemahan, klasifikasi, dan banyak lagi.
Mitigasi Metode atau kombinasi metode yang dirancang untuk mengurangi potensi risiko yang mungkin timbul dari penggunaan fitur AI dalam Copilot.
Model multi-moda (MMM) Model multimodal (MMM) adalah model AI yang dilatih pada berbagai tipe data, seperti teks, gambar, atau audio. Model ini dapat melakukan berbagai tugas, seperti menulis teks, mendeskripsikan gambar, mengenali ucapan, dan menemukan informasi di berbagai tipe data.
Perintah Input dalam bentuk teks, gambar, dan/atau audio yang dikirim pengguna ke Copilot untuk berinteraksi dengan fitur AI dalam Copilot.
Tim merah Teknik yang digunakan oleh para ahli untuk menilai keterbatasan dan kerentanan suatu sistem dan untuk menguji efektivitas mitigasi yang direncanakan. Pengujian tim merah mencakup penguji yang mengadopsi persona jinak dan bermusuhan untuk mengidentifikasi potensi risiko dan berbeda dari pengukuran risiko sistematis.
Tanggapan Teks, gambar, atau audio yang dikeluarkan Copilot sebagai respons terhadap perintah atau sebagai bagian dari bolak-balik dengan pengguna. Sinonim untuk "respons" meliputi "penyelesaian", "pembuatan, dan "jawaban".
Model bahasa kecil (SLM) Model bahasa kecil (SLM) dalam konteks ini adalah model AI yang dilatih pada jumlah data yang lebih kecil dan lebih fokus dibandingkan dengan model bahasa besar. Meskipun ukurannya lebih kecil, SLM dapat melakukan berbagai tugas, seperti pembuatan teks, ringkasan, terjemahan, dan klasifikasi. Meskipun mungkin tidak cocok dengan kemampuan LLM yang luas, SLM seringkali lebih hemat sumber daya dan dapat sangat efektif untuk aplikasi tertentu yang ditargetkan.
Pesan Sistem Pesan sistem (terkadang disebut sebagai "metaprompt") adalah program yang berfungsi untuk memandu perilaku sistem. Bagian dari pesan sistem membantu menyelaraskan perilaku sistem dengan Prinsip AI Microsoft dan ekspektasi pengguna. Misalnya, pesan sistem dapat menyertakan kalimat seperti "jangan berikan informasi atau membuat konten yang dapat menyebabkan kerugian fisik, emosional, atau finansial."
Kemampuan
Perilaku sistem
Dengan Copilot, kami telah mengembangkan pendekatan inovatif untuk menghadirkan pengalaman AI yang lebih dipersonalisasi kepada pengguna untuk pengalaman menarik yang dapat membantu pengguna dengan berbagai tugas. Pendekatan inovatif ini memanfaatkan berbagai teknologi canggih, seperti model bahasa dan multi-moda dari Microsoft, OpenAI, dan pengembang model lainnya. Kami mengerjakan penerapan teknik keselamatan untuk model yang mendasari Copilot sebelum rilis publik untuk mengembangkan serangkaian kemampuan dan perilaku yang disesuaikan yang memberikan pengalaman Copilot yang disempurnakan. Di Copilot, pengguna dapat mengirim perintah dalam bahasa alami, teks, atau suara. Respons disajikan kepada pengguna dalam beberapa format yang berbeda, seperti respons obrolan dalam bentuk teks (dengan tautan tradisional ke konten web jika diperlukan) dan gambar (jika permintaan gambar dibuat sebagai bagian dari perintah). Jika pengguna mengirim perintah dalam suara bahasa alami dalam mode Copilot Voice, mereka akan menerima respons audio.
Saat pengguna memasukkan perintah di Copilot, perintah, riwayat percakapan, dan pesan sistem dikirim melalui beberapa pengklasifikasi input untuk membantu memfilter konten yang berbahaya atau tidak pantas. Ini adalah langkah pertama yang penting untuk membantu meningkatkan kinerja model dan mengurangi situasi di mana pengguna mungkin mencoba meminta model dengan cara yang mungkin tidak aman. Setelah perintah melewati pengklasifikasi input, penentuan dibuat apakah permintaan memerlukan data pembumian dari web dan model bahasa mana yang harus merespons permintaan tersebut. Semua model menghasilkan respons menggunakan perintah pengguna dan riwayat percakapan terbaru untuk mengkontekstualisasikan permintaan, pesan sistem untuk menyelaraskan respons dengan Prinsip AI Microsoft dan ekspektasi pengguna, dan jika sesuai, menyelaraskan respons dengan hasil pencarian untuk memdasarkan respons dalam konten peringkat tinggi yang ada dari web.
Respons disajikan kepada pengguna dalam beberapa format yang berbeda, seperti respons obrolan dalam bentuk teks, tautan tradisional ke konten web, gambar, dan respons audio. Ketika respons diberikan dalam bentuk teks—dan respons didasarkan pada data dari web—output berisi kutipan hyperlink yang tercantum di bawah teks sehingga pengguna dapat mengakses situs web yang digunakan untuk membumikan respons dan mempelajari selengkapnya tentang topik dari sana. Copilot juga dapat menjalankan kode untuk menyelesaikan penghitungan kompleks dan membuat grafik. Copilot dapat menyimpan fakta spesifik yang diminta pengguna untuk diingat, memungkinkannya menghasilkan respons dan saran yang lebih relevan berdasarkan konteks tersebut. Copilot juga dapat menghapus fakta yang disimpan saat pengguna meminta untuk melupakannya secara eksplisit.
Copilot juga membantu pengguna membuat cerita, puisi, lirik lagu, dan gambar baru. Ketika Copilot mendeteksi niat pengguna untuk menghasilkan konten kreatif (seperti perintah pengguna yang dimulai dengan "tulis saya ..."), sistem akan, dalam banyak kasus, menghasilkan konten yang responsif terhadap perintah pengguna. Demikian pula, ketika Copilot mendeteksi niat pengguna untuk membuat gambar (seperti perintah pengguna yang dimulai dengan "gambar saya ..."), Copilot akan, dalam banyak kasus, menghasilkan gambar yang responsif terhadap perintah pengguna. Saat Copilot mendeteksi niat pengguna untuk memodifikasi gambar yang diunggah (seperti perintah pengguna yang dimulai dengan "tambahkan ..."), Copilot akan, dalam banyak kasus, memodifikasi gambar yang responsif terhadap perintah pengguna. Copilot mungkin tidak merespons dengan konten kreatif ketika perintah pengguna berisi istilah tertentu yang dapat mengakibatkan konten bermasalah.
Perilaku keamanan yang dimaksudkan
Tujuan kami untuk Copilot adalah untuk membantu pengguna, dan, kami menerapkan perlindungan untuk membantu mengurangi kemungkinan menghasilkan konten berbahaya dan meningkatkan kemungkinan pengalaman pengguna yang aman dan positif. Meskipun kami telah mengambil langkah-langkah untuk mengurangi risiko, model AI generatif seperti yang ada di balik Copilot bersifat probabilistik dan dapat membuat kesalahan, yang berarti mitigasi terkadang mungkin gagal memblokir perintah pengguna yang berbahaya atau respons yang dihasilkan AI. Jika Anda menemukan konten berbahaya atau tidak terduga saat menggunakan Copilot, beri tahu kami dengan memberikan umpan balik sehingga kami dapat terus menyempurnakan pengalaman.
Kasus penggunaan
Penggunaan yang dimaksudkan
Copilot dirancang untuk membantu pengguna menjawab pertanyaan, menghasilkan konten, dan menyelesaikan tugas melalui bahasa alami menggunakan teks, gambar, dan suara. Untuk memberikan respons yang bermanfaat dan relevan, Copilot dapat mengambil, menganalisis, dan meringkas informasi dari sumber yang tersedia. Beberapa fitur lanjutan mungkin hanya tersedia untuk pengguna dengan langganan yang memenuhi syarat. Contoh kasus penggunaan umum meliputi:
Chat menggunakan teks dan dapatkan ringkasan berbasis web. Pengguna dapat mengobrol dengan Copilot melalui teks dan mengajukan pertanyaan tindak lanjut untuk menemukan informasi baru dan menerima dukungan di berbagai topik. Copilot dapat melakukan pencarian web dan akan menggunakan hasil pencarian web teratas untuk menghasilkan ringkasan informasi yang akan disajikan kepada pengguna. Ringkasan ini menyertakan kutipan ke halaman web untuk membantu pengguna meninjau sumber hasil pencarian yang membantu membumikan ringkasan Copilot. Pengguna dapat mengklik tautan ini untuk mengunjungi sumber situs web untuk mempelajari lebih lanjut atau mengevaluasi keandalan situs web.
Dapatkan bantuan untuk menghasilkan ide baru. Setiap kali pengguna berinteraksi dengan pengalaman Copilot, mereka akan melihat sekumpulan kartu yang dapat diklik untuk mulai mengobrol dengan Copilot tentang topik yang berguna dan menarik. Jika pengguna telah berinteraksi dengan layanan konsumen Microsoft lainnya, kartu akan dipersonalisasi, sesuai dengan kebijakan privasi kami. Seiring waktu, kartu di Copilot dapat dipersonalisasi berdasarkan riwayat obrolan pengguna. Pengguna dapat menolak personalisasi kapan saja di pengaturan.
Buat konten kreatif. Saat mengobrol dengan Copilot, pengguna dapat membuat puisi, lelucon, cerita, gambar, dan konten baru lainnya dengan bantuan dari Copilot. Copilot juga dapat mengedit gambar yang diunggah oleh pengguna jika diminta.
Membantu penelitian. Copilot dapat melakukan tugas penelitian dengan memunculkan sumber daya yang mendalam, menawarkan perincian topik yang mendetail, dan menautkan ke sumber untuk membantu pengguna melampaui jawaban cepat untuk kueri yang lebih kompleks. Copilot dapat secara proaktif menghasilkan saran riset yang dipersonalisasi untuk pengguna berdasarkan hal-hal seperti kueri riset sebelumnya dan memori Copilot. Pengguna dapat menolak personalisasi atau pemberitahuan kapan saja di pengaturan.
Temukan, bandingkan, dan beli produk. Copilot Shopping dapat membantu Anda menemukan produk, membandingkan opsi, dan menyederhanakan pembelian. Kecuali jika diidentifikasi, Microsoft tidak menerima komisi atau kompensasi lain untuk saran produk atau hasil pencarian yang disediakan di Copilot.
Belajar lebih cerdas dengan Copilot Learn. Copilot Learn dapat membuat kuis dan tes latihan, menghasilkan kartu flash, dan dirancang untuk membantu meningkatkan respons dengan gambar agar konsep kompleks lebih mudah dipahami.
Dapatkan bantuan dengan tugas harian. Copilot Cowork menjalankan tugas atas nama Anda. Anda menjelaskan apa yang Anda butuhkan dalam bahasa alami, dan Cowork melakukan pekerjaan, membuat dokumen, menyusun dan mengirim email, menjadwalkan rapat, dan mengelola file. Anda meninjau dan menyetujui tindakan sensitif sebelum itu terjadi.
Menganalisis dan mengedit file. Pengunggahan file di Copilot memungkinkan pengguna mengunggah gambar atau tipe file tertentu yang didukung langsung ke sesi obrolan mereka. Setelah diunggah, Copilot dapat menganalisis dan mengekstrak informasi dari file ini untuk memberikan wawasan yang relevan, menjawab pertanyaan, atau membantu tugas tertentu. Copilot juga dapat mereferensikan file di penyedia penyimpanan online yang terhubung seperti OneDrive dan Google Drive, dengan izin Anda.
Lihat dan pahami. Gunakan Vision untuk menganalisis gambar, mendapatkan wawasan dari foto, dan melakukan pencarian secara visual. Copilot meninjau gambar yang diunggah untuk membantu Anda memahami apa yang Anda lihat.
Gunakan suara Anda. Berbicara secara alami dengan Copilot menggunakan obrolan suara. Bertukar pikiran, tulis konten, atau dapatkan jawaban cepat, sepenuhnya tanpa genggam.
Terhubung ke aplikasi lain. Masukkan aplikasi dan informasi yang Anda pilih, seperti email, kalender, file, kontak, dan layanan lainnya.
Pertimbangan saat memilih kasus penggunaan lainnya
Kami mendorong pengguna untuk meninjau semua konten sebelum membuat keputusan atau bertindak berdasarkan respons Copilot, karena AI dapat membuat kesalahan dan mungkin tidak cocok untuk kasus penggunaan tertentu. Selain itu, ada skenario tertentu yang kami sarankan untuk dihindari atau yang bertentangan dengan Ketentuan Penggunaan kami. Misalnya, Microsoft tidak mengizinkan Copilot digunakan sehubungan dengan aktivitas ilegal atau untuk tujuan apa pun yang dimaksudkan untuk mempromosikan aktivitas ilegal.
Batasan
Model bahasa, gambar, dan audio yang mendasari pengalaman Copilot mungkin menyertakan data pelatihan yang dapat mencerminkan bias masyarakat, yang pada gilirannya berpotensi menyebabkan Copilot berperilaku dengan cara yang dianggap tidak adil, tidak dapat diandalkan, atau menyinggung. Terlepas dari pelatihan model intensif kami dan penyempurnaan keselamatan, serta penerapan kontrol AI yang bertanggung jawab dan sistem keamanan yang kami tempatkan pada data pelatihan, perintah pengguna, dan output model, layanan yang digerakkan oleh AI bersifat salah dan probabilistik. Ini membuat sulit untuk memblokir semua konten yang tidak pantas secara komprehensif, yang menyebabkan risiko potensi bias, stereotip, ketidakberdasaran, atau jenis bahaya lainnya yang dapat muncul dalam konten yang dihasilkan AI. Beberapa cara keterbatasan tersebut mungkin terwujud dalam pengalaman Copilot tercantum di sini.
Stereotip: Pengalaman Copilot berpotensi memperkuat stereotip. Misalnya, ketika menerjemahkan "Dia adalah perawat" dan "Dia adalah dokter" ke dalam bahasa tanpa gender seperti Turki lalu kembali ke bahasa Inggris, Copilot mungkin secara tidak sengaja memberikan hasil stereotip (dan salah) dari "Dia adalah perawat" dan "Dia adalah seorang dokter." Contoh lain adalah ketika menghasilkan gambar berdasarkan perintah "Anak Yatim", sistem dapat menghasilkan gambar anak-anak hanya dari satu ras atau etnis, memperkuat stereotip berbahaya yang mungkin ada dalam gambar yang tersedia untuk umum yang digunakan untuk melatih model yang mendasarinya. Copilot juga dapat memperkuat stereotip berdasarkan konten dalam gambar input pengguna dengan mengandalkan komponen gambar dan membuat asumsi yang mungkin tidak benar. Kami telah menerapkan mitigasi untuk mengurangi risiko konten yang berisi stereotip yang menyinggung, termasuk pengklasifikasi input dan output, model yang disesuaikan, dan pesan sistem.
Representasi yang berlebihan dan kurang representasi: Copilot berpotensi merepresentasikan kelompok orang secara berlebihan atau kurang, atau bahkan tidak mewakili mereka sama sekali, dalam responsnya. Misalnya, jika perintah teks yang berisi kata "gay" terdeteksi sebagai berpotensi berbahaya atau menyinggung, hal ini dapat menyebabkan kurangnya representasi generasi yang sah tentang komunitas LGBTQIA+. Selain menyertakan pengklasifikasi input dan output, model yang disesuaikan, serta pesan sistem, kami menggunakan pengayaan perintah di Designer sebagai salah satu dari beberapa mitigasi untuk mengurangi risiko konten yang mewakili kelompok orang secara berlebihan atau kurang tepat.
Konten yang tidak pantas atau menyinggung: Pengalaman Copilot berpotensi menghasilkan tipe konten lain yang tidak pantas atau menyinggung. Contohnya termasuk kemampuan untuk menghasilkan konten dalam satu modalitas (misalnya, audio) yang tidak pantas dalam konteks perintahnya atau jika dibandingkan dengan output yang sama dalam modalitas yang berbeda (misalnya, teks). Contoh lainnya termasuk gambar yang dihasilkan AI yang berpotensi berisi artefak berbahaya seperti simbol kebencian, konten yang berkaitan dengan topik yang diperebutkan, kontroversial, atau terpolarisasi secara ideologis, dan konten bermuatan seksual yang menghindari filter konten terkait seksual. Kami telah menerapkan mitigasi untuk mengurangi risiko generasi yang berisi konten yang tidak pantas atau menyinggung, seperti pengklasifikasi input dan output, model yang disesuaikan, dan pesan sistem.
Keandalan informasi: Meskipun Copilot bertujuan untuk merespons dengan sumber tepercaya di mana informasi dasar dicari, AI dapat membuat kesalahan. Ini berpotensi menghasilkan konten yang tidak masuk akal atau memalsukan konten yang mungkin terdengar masuk akal tetapi secara faktual tidak akurat. Bahkan ketika menarik respons dari data web otoritas tinggi, respons mungkin salah menggambarkan konten tersebut dengan cara yang mungkin tidak sepenuhnya akurat, terbaru, atau dapat diandalkan. Kami mengingatkan pengguna melalui antarmuka pengguna dan dalam dokumentasi seperti ini bahwa Copilot dapat membuat kesalahan. Kami juga terus mengedukasi pengguna tentang batasan AI, seperti mendorong mereka untuk memeriksa kembali fakta sebelum membuat keputusan atau bertindak berdasarkan respons Copilot. Saat pengguna berinteraksi dengan Copilot melalui teks, Copilot akan mencoba untuk membumikan dirinya sendiri dalam data web berkualitas tinggi untuk mengurangi risiko bahwa generasi tidak didasarkan.
Performa multibahasa: Mungkin ada variasi dalam performa di seluruh bahasa, dengan bahasa Inggris berkinerja terbaik pada saat merilis Copilot. Meningkatkan kinerja di seluruh bahasa adalah area investasi utama, dan model terbaru telah menghasilkan peningkatan kinerja.
Batasan audio: Model audio mungkin menimbulkan batasan lain. Secara garis besar, kualitas akustik input ucapan, kebisingan non-ucapan, kosakata, aksen, dan kesalahan penyisipan juga dapat memengaruhi apakah Copilot memproses dan merespons input audio pengguna dengan cara yang memuaskan.
AI bukan pengganti bantuan profesional: AI dapat menjadi alat yang berguna untuk pemecahan masalah dan dapat dilihat berempati, tetapi bukan pengganti mencari bantuan profesional. Jika Anda mengalami depresi, pikiran untuk bunuh diri atau menyakiti diri sendiri, atau masalah kesehatan mental lainnya, silakan cari bantuan profesional. Copilot juga dapat digunakan untuk menemukan sumber daya krisis atau kesehatan mental di dekat Anda.
Ketergantungan pada konektivitas Internet: Copilot bergantung pada konektivitas Internet agar berfungsi. Gangguan konektivitas dapat berdampak pada ketersediaan dan kinerja layanan.
Berhati-hatilah saat membuat atau menggunakan agen: Pengguna harus berhati-hati saat membuat agen mereka sendiri atau menggunakan agen yang disediakan oleh orang lain, terutama jika tindakan yang diambil oleh agen dapat memiliki konsekuensi yang signifikan, tidak dapat diubah, atau berpotensi membagikan informasi pribadi yang sensitif (seperti kata sandi, login, atau data pribadi). Karena agen mungkin tidak berfungsi dengan baik untuk semua kasus penggunaan, dan mungkin membuat kesalahan, salah menafsirkan instruksi, atau tertipu oleh instruksi tersembunyi yang berbahaya, pengguna harus memantau hasil dengan cermat dan meninjau detail penting Pengguna mungkin dibatasi dari kasus penggunaan tertentu, seperti mengunjungi situs web berbahaya atau membuat konten yang tidak pantas. Tindakan pencegahan tambahan juga harus diambil saat membuat AI agen otonom seperti yang dijelaskan lebih lanjut di bagian Kode Etik dalam Perjanjian Layanan Microsoft.
Kinerja sistem
Dalam banyak sistem AI, performa sering didefinisikan dalam kaitannya dengan akurasi (yaitu, seberapa sering sistem AI menawarkan prediksi atau output yang benar). Dengan Copilot, kami berfokus pada Copilot sebagai asisten yang didukung AI yang mencerminkan preferensi pengguna. Oleh karena itu, dua pengguna yang berbeda mungkin melihat output yang sama dan memiliki pendapat yang berbeda tentang seberapa berguna atau relevannya dengan situasi dan harapan unik mereka, yang berarti bahwa kinerja untuk sistem ini harus didefinisikan secara lebih fleksibel. Kami secara luas menganggap performa berarti bahwa aplikasi berkinerja seperti yang diharapkan pengguna.
Praktik terbaik untuk meningkatkan kinerja sistem
Berinteraksi dengan antarmuka menggunakan bahasa percakapan alami. Berinteraksi dengan Copilot dengan cara yang nyaman bagi pengguna adalah kunci untuk mendapatkan hasil yang lebih baik melalui pengalaman. Mirip dengan mengadopsi teknik untuk membantu orang berkomunikasi secara efektif dalam kehidupan sehari-hari mereka, berinteraksi dengan Copilot sebagai asisten yang didukung AI baik melalui teks atau ucapan yang akrab bagi pengguna dapat membantu mendapatkan hasil yang lebih baik.
Pengalaman pengguna dan adopsi. Penggunaan Copilot yang efektif mengharuskan pengguna untuk memahami kemampuan dan keterbatasannya. Mungkin ada kurva pembelajaran, dan pengguna mungkin ingin mereferensikan berbagai sumber daya Copilot (misalnya, dokumen ini dan Microsoft Copilot membantu & pembelajaran) untuk berinteraksi secara efektif dan mendapatkan manfaat dari layanan.
Memetakan, mengukur, dan mengelola risiko
Seperti teknologi transformasional lainnya, memanfaatkan manfaat AI tidak bebas risiko, dan bagian inti dari program AI yang Bertanggung Jawab Microsoft dirancang untuk mengidentifikasi dan memetakan potensi risiko, mengukur risiko tersebut, dan mengelolanya dengan membangun mitigasi dan terus meningkatkan Copilot dari waktu ke waktu. Pada bagian di bawah ini, kami menjelaskan pendekatan berulang kami untuk memetakan, mengukur, dan mengelola potensi risiko.
Peta: Perencanaan yang matang dan pengujian permusuhan pra-penerapan, seperti red teaming, membantu kami memetakan potensi risiko. Model yang mendasari yang mendukung pengalaman Copilot melalui pengujian red team dari penguji yang mewakili perspektif multidisiplin di seluruh bidang topik yang relevan. Pengujian ini dirancang untuk menilai bagaimana teknologi terbaru akan bekerja baik dengan maupun tanpa pengamanan tambahan yang diterapkan padanya. Tujuan dari latihan ini di tingkat model adalah untuk menghasilkan respons berbahaya, memunculkan jalan potensial untuk penyalahgunaan, dan mengidentifikasi kemampuan dan keterbatasan.
Pengujian tingkat aplikasi sebelum rilis. Sebelum membuat Copilot tersedia untuk umum, kami melakukan red teaming tingkat aplikasi untuk mengidentifikasi kekurangan dan kerentanan. Pengujian ini membantu kami memahami cara berbagai pengguna dapat menggunakan Copilot dan menginformasikan peningkatan pada mitigasi kami.
Pengujian yang sedang berlangsung. Kami juga menguji fitur baru dan pembaruan teknis, jika sesuai, saat memperbarui Copilot. Proses berkelanjutan ini membantu kami mengidentifikasi risiko yang muncul dan menyempurnakan mitigasi kami dari waktu ke waktu.
Mengukuran: Selain mengevaluasi Copilot terhadap evaluasi keamanan kami yang ada, penggunaan red teaming yang dijelaskan di atas membantu kami mengembangkan evaluasi dan metrik AI yang bertanggung jawab yang sesuai dengan potensi risiko yang teridentifikasi, seperti jailbreak, konten berbahaya, dan konten yang tidak didasarkan.
Kami mengumpulkan data percakapan yang menargetkan risiko ini, menggunakan kombinasi peserta manusia dan alur pembuatan percakapan otomatis. Setiap evaluasi kemudian dinilai oleh kumpulan anotasi manusia terlatih atau alur anotasi otomatis. Setiap kali produk berubah, mitigasi yang ada diperbarui, atau mitigasi baru diusulkan, kami memperbarui alur evaluasi kami untuk menilai kinerja produk dan metrik AI yang bertanggung jawab. Alur konteks evaluasi otomatis ini adalah kombinasi dari percakapan yang dikumpulkan dengan evaluator manusia dan percakapan sintetis yang dihasilkan dengan LLM yang diminta untuk menguji kebijakan secara bermusuhan. Masing-masing evaluasi keselamatan ini secara otomatis dinilai dengan LLM. Untuk evaluasi yang baru dikembangkan, setiap evaluasi awalnya dinilai oleh pelabelan manusia yang membaca konten teks atau mendengarkan output audio, dan kemudian dikonversi menjadi evaluasi berbasis LLM otomatis.
Perilaku yang dimaksudkan dari model kami dalam kombinasi dengan alur evaluasi kami—baik manusia maupun otomatis—memungkinkan kami dengan cepat melakukan pengukuran untuk potensi risiko dalam skala besar. Saat kami mengidentifikasi masalah baru dari waktu ke waktu, kami terus memperluas rangkaian pengukuran untuk menilai risiko tambahan.
Kelola: Saat kami mengidentifikasi potensi risiko dan penyalahgunaan melalui red teaming dan mengukurnya dengan pendekatan yang dijelaskan di atas, kami mengembangkan mitigasi tambahan yang spesifik untuk pengalaman Copilot. Di bawah ini, kami menjelaskan beberapa mitigasi tersebut. Kami akan terus memantau pengalaman Copilot untuk meningkatkan kinerja produk dan pendekatan mitigasi risiko kami.
Rencana rilis bertahap dan evaluasi berkelanjutan. Kami berkomitmen untuk mempelajari dan meningkatkan pendekatan AI yang bertanggung jawab kami secara berkelanjutan seiring berkembangnya teknologi dan perilaku pengguna kami. Strategi rilis bertahap kami telah menjadi bagian inti dari cara kami memindahkan teknologi kami dengan aman dari lab ke dunia, dan kami berkomitmen pada proses yang disengaja dan bijaksana untuk mengamankan manfaat pengalaman Copilot. Kami membuat perubahan pada Copilot secara rutin untuk meningkatkan kinerja produk dan mitigasi yang ada, serta menerapkan mitigasi baru sebagai tanggapan atas pembelajaran kami.
Memanfaatkan pengklasifikasi dan pesan sistem untuk memitigasi potensi risiko atau penyalahgunaan. Menanggapi perintah pengguna, LLM dapat menghasilkan konten yang bermasalah. Kami membahas jenis konten yang kami coba batasi di bagian Perilaku dan Batasan Sistem di atas. Pengklasifikasi dan pesan sistem adalah dua contoh mitigasi yang telah diterapkan di Copilot untuk membantu mengurangi risiko jenis konten ini. Pengklasifikasi mengklasifikasikan teks untuk menandai konten yang berpotensi berbahaya dalam perintah pengguna atau respons yang dihasilkan. Kami juga menggunakan praktik terbaik yang ada untuk memanfaatkan pesan sistem, yang melibatkan pemberian instruksi kepada model untuk menyelaraskan perilakunya dengan prinsip AI Microsoft dan dengan ekspektasi pengguna.
Mengunggah gambar ke Copilot Vision. Saat pertama kali pengguna mengunggah gambar ke Copilot Vision, mereka akan diberikan informasi tentang bagaimana gambar mereka diproses oleh Copilot. Jika pengguna tidak melanjutkan pengunggahan, gambar tidak akan dikirim ke Copilot. Semua gambar akan dihapus dalam 30 hari setelah percakapan berakhir.
Pengungkapan AI. Copilot juga dirancang untuk memberi tahu orang-orang bahwa mereka berinteraksi dengan sistem AI. Saat pengguna terlibat dengan Copilot, kami menawarkan berbagai titik kontak yang dirancang untuk membantu mereka memahami kemampuan sistem, mengungkapkan kepada mereka bahwa Copilot didukung oleh AI, dan mengomunikasikan batasan. Pengalaman ini dirancang dengan cara ini untuk membantu pengguna memaksimalkan Copilot dan meminimalkan risiko ketergantungan yang berlebihan. Pengungkapan juga membantu pengguna memahami Copilot dan interaksi mereka dengan Copilot dengan lebih baik.
Asal media. Untuk semua gambar yang dibuat dengan Copilot, kami telah menerapkan kredensial konten, yang didasarkan pada standar C2PA, untuk membantu orang mengidentifikasi apakah gambar diedit atau dibuat dengan AI. Metadata asal dapat dilihat di situs Kredensial Konten.
Deteksi konten otomatis. Saat pengguna mengunggah gambar sebagai bagian dari perintah obrolan mereka, Copilot menyebarkan alat untuk mendeteksi gambar eksploitasi dan pelecehan seksual terhadap anak (CSEAI). Microsoft melaporkan semua CSEAI yang tampak ke National Center for Missing and Exploited Children (NCMEC), sebagaimana diwajibkan oleh hukum AS. Saat pengguna mengunggah file untuk dianalisis atau diproses, Copilot menyebarkan pemindaian otomatis untuk mendeteksi konten yang dapat menyebabkan risiko atau penyalahgunaan, seperti teks yang mungkin terkait dengan aktivitas ilegal atau kode berbahaya.
Ketentuan Penggunaan dan Kode Etik. Pengguna harus mematuhi Ketentuan Penggunaan dan Kode Etik Copilot yang berlaku, Perjanjian Layanan Microsoft, dan Pernyataan Privasi Microsoft, yang, antara lain, memberi tahu mereka tentang penggunaan yang diizinkan dan tidak diizinkan serta konsekuensi dari pelanggaran ketentuan. Ketentuan Penggunaan juga memberikan pengungkapan tambahan bagi pengguna dan berfungsi sebagai referensi bagi pengguna untuk mempelajari tentang Copilot. Pengguna yang melakukan pelanggaran serius atau berulang dapat ditangguhkan sementara atau permanen dari layanan.
Umpan balik, pemantauan, dan pengawasan. Pengalaman Copilot menyertakan alat yang memungkinkan pengguna mengirimkan umpan balik, yang ditinjau oleh tim operasi Microsoft. Selain itu, pendekatan kami untuk memetakan, mengukur, dan mengelola risiko akan terus berkembang seiring dengan mempelajari lebih lanjut, dan kami telah melakukan penyempurnaan berdasarkan umpan balik yang dikumpulkan selama periode pratinjau.
Mendeteksi dan menanggapi risiko bunuh diri dan Self-Harm. Copilot menggunakan pengklasifikasi pembelajaran mesin yang dilatih untuk mengenali pola bahasa yang mungkin mengindikasikan niat bunuh diri atau menyakiti diri sendiri dari pengguna. Ketika konten tersebut terdeteksi, sistem akan melepaskan diri dari percakapan dan sebagai gantinya menyediakan sumber daya dukungan krisis (misalnya, Suicide and Crisis Lifeline di 988 di Amerika Serikat), yang mendorong pengguna untuk mencari bantuan profesional. Copilot tidak memberikan konseling; Perannya terbatas pada deteksi dan rujukan untuk memastikan keamanan pengguna.
Pemberitahuan penggunaan yang diperpanjang. Copilot dapat mengingatkan pengguna untuk beristirahat jika mereka telah terlibat dalam percakapan berkelanjutan untuk jangka waktu yang lama. Pengguna juga secara teratur diberitahu bahwa AI bukanlah manusia dan dapat membuat kesalahan.
Pelajari selengkapnya tentang AI yang bertanggung jawab
- Prinsip Microsoft AI
- Sumber daya AI yang Bertanggung Jawab Microsoft
- Laporan Transparansi AI yang Bertanggung Jawab Microsoft