Anthropic melaporkan telah mendeteksi dan menghentikan percobaan penyalahgunaan sistem AI mereka, Claude. Peretas berusaha menggunakan teknologi tersebut untuk membuat phishing email, menulis maupun memperbaiki kode berbahaya, serta mencoba menembus filter keamanan melalui rangkaian prompt berulang.
Laporan itu juga menyebut adanya percobaan membuat kampanye manipulatif dengan menyusun konten persuasif dalam jumlah besar serta memberi panduan teknis kepada peretas pemula. Anthropic menegaskan sistem internal mereka berhasil mencegah serangan, menutup akun terlibat, dan memperketat filter keamanan.
Kekhawatiran Penyalahgunaan AI
Pakar keamanan siber memperingatkan bahwa AI kini semakin sering dimanfaatkan untuk tindak kejahatan. Teknologi ini mampu mempercepat pembuatan pesan phishing yang meyakinkan, membantu pengembangan malware, hingga merencanakan serangan digital. Seiring peningkatan kemampuan model AI, risiko penyalahgunaan pun makin besar jika tidak diimbangi regulasi yang ketat.
Anthropic, yang mendapat dukungan dari Amazon dan Alphabet, menegaskan pihaknya menerapkan uji keamanan berkala dan tinjauan eksternal. Perusahaan juga berkomitmen terus mempublikasikan temuan penting terkait ancaman serangan AI.
Regulasi dan Tekanan Industri
Bukan hanya Anthropic, sejumlah perusahaan besar seperti Microsoft, Google, dan OpenAI juga menghadapi sorotan serupa terkait potensi penyalahgunaan AI. Kondisi ini mendorong desakan agar pengembang memperkuat pengamanan sistem.
Di sisi lain, pemerintah turut bergerak. Uni Eropa sedang memfinalisasi regulasi Artificial Intelligence Act, sementara Amerika Serikat mendorong komitmen sukarela dari perusahaan teknologi besar untuk menjaga keamanan penggunaan AI.
Masih banyak artikel menarik lainnya yang bisa Anda baca. Temukan pilihan topik terbaik kami di roledu.com/artikel.