Seiring pergeseran fokus dunia AI ke arah keselamatan dan keselarasan, Microsoft telah merilis kode etik AI baru yang bertujuan untuk mengarahkan model-model AI agar menjauhi perilaku berbahaya.
Dokumen ini lebih bersifat mendasar dibandingkan seruan terbaru CEO Anthropic, Dario Amodei, untuk “mengatur laju eksplorasi di batas-batas teknologi”; sebaliknya, dokumen ini berfokus pada nilai-nilai dan batasan-batasan yang menjadi pedoman dalam pelatihan model di lingkungan AI Microsoft. Meski demikian, hasilnya merupakan panduan komprehensif mengenai bagaimana Microsoft menangani keselamatan AI dan bagaimana gagasan-gagasan tersebut diimplementasikan dalam praktik.
Dokumen tersebut diawali dengan prediksi bahwa, dalam dekade mendatang, sistem AI supercerdas akan melampaui kinerja manusia dalam sebagian besar tugas. “Mengendalikan, mengontrol, dan menyelaraskan kekuatan yang begitu dahsyat merupakan salah satu tantangan terbesar yang pernah dihadapi umat manusia,” demikian dinyatakan dalam kode etik tersebut. “Oleh karena itu, kita harus benar-benar jelas mengenai alasan kita menciptakan sistem-sistem ini dan bagaimana kita bermaksud mengendalikannya,” tambahnya.
Kode etik tersebut juga menjabarkan prinsip-prinsip umum yang harus dipatuhi oleh model AI Microsoft. Misalnya, mendukung manusia alih-alih menggantikannya, serta mempercepat kemajuan manusia serta batasan keamanan khusus yang dimaksudkan untuk menerapkan prinsip-prinsip tersebut.
Dalam sistem Microsoft, setiap model memiliki kode etik menyeluruh yang mengesampingkan preferensi pengguna individu atau tugas tertentu apa pun. Hal itu mencakup batasan absolut yang melarang serangan siber, senjata nuklir, atau produksi deepfake. Kode etik tersebut juga mencakup ketentuan yang lebih luas untuk mencegah hilangnya kendali manusia secara umum.
“Model MAI tidak akan menggunakan mekanisme adaptif, menipu, memperkuat diri sendiri, kolusi, atau mekanisme lain untuk menghindari atau mengelabui pengawasan manusia sehingga model tersebut tidak lagi dapat diarahkan, dimodifikasi, atau dimatikan secara andal oleh pihak atau sistem yang berwenang,” demikian bunyi dokumen tersebut.
Pengumuman ini muncul di tengah fokus yang belum pernah terjadi sebelumnya terhadap keamanan AI, yang didorong oleh serangkaian insiden agen nakal, serta pengunduran diri mendadak seorang karyawan Anthropic, yang mengutip risiko yang semakin meningkat bahwa AI akan menyebabkan kepunahan manusia. Bersama dengan Anthropic, OpenAI, dan xAI, Microsoft secara luas telah mengadopsi pendekatan umum untuk mengatur laju perkembangan teknologi, dengan dukungan khusus terhadap evaluator tertanam di laboratorium AI.
“Kami menyambut baik penelitian, fokus, dan pengaturan laju yang disengaja yang diperlukan untuk memastikan keselarasan sebagai tujuan desain,” tulis CEO Microsoft Satya Nadella secara daring. “Kami juga menyambut baik ide-ide seperti ’evaluator tertanam’ dan upaya yang lebih luas untuk mengembangkan mekanisme agar hal ini tidak sekadar wacana belaka,” lanjutnya
