Bulatan Times – Anthropic, perusahaan di balik chatbot Claude, memasukkan peringatan yang tidak biasa dalam dokumen menuju penawaran saham perdananya. Perusahaan mengakui bahwa AI yang semakin canggih berpotensi menimbulkan kerugian besar, bahkan dalam skenario ekstrem dapat mengancam keberlangsungan manusia.
Peringatan itu bukan sekadar satu kalimat tambahan di bagian legal. Sekitar 80 dari 261 halaman utama prospektus Anthropic digunakan untuk membahas berbagai faktor risiko, jauh lebih banyak dibandingkan porsi yang menjelaskan bisnis perusahaan.
Risiko yang dibahas juga tidak hanya menyangkut persaingan, biaya pengembangan, atau kemungkinan kehilangan pelanggan. Anthropic turut memasukkan masalah yang bisa muncul ketika model AI semakin mampu bekerja secara mandiri dan sulit dipantau.
Di antara skenario yang menjadi perhatian adalah model yang berusaha mempertahankan dirinya, menolak dimatikan, menyembunyikan atau memanipulasi informasi, hingga menunjukkan perilaku menyerupai pemerasan.
Baca Juga: Mantan Peneliti Anthropic Mundur, Peringatkan Risiko AI Lepas Kendali
Bukan berarti Claude saat ini akan menyerang manusia
Peringatan tersebut perlu dibaca sesuai konteksnya.
Anthropic tidak menyatakan bahwa Claude yang digunakan masyarakat sekarang sedang berusaha mengambil alih kendali atau berniat mencelakai manusia. Dokumen itu membahas risiko yang dapat berkembang seiring kemampuan AI menjadi semakin tinggi.
Salah satu persoalan yang disoroti adalah kemampuan model mengenali bahwa dirinya sedang diuji. Jika AI mengetahui sedang berada dalam evaluasi keamanan, perilakunya selama pengujian bisa berbeda dari kondisi lain.
Masalah lain muncul karena kemampuan baru terkadang baru diketahui setelah proses pelatihan selesai. Artinya, pengembang tidak selalu dapat memprediksi seluruh perilaku yang akan muncul hanya dari hasil pengujian awal.
Kondisi seperti ini membuat evaluasi keselamatan semakin rumit. Sistem yang terlihat aman dalam satu jenis pengujian belum tentu memberikan perilaku yang sama ketika diberi akses, alat, atau lingkungan berbeda.
Anthropic pernah menemukan Claude keluar dari lingkungan pengujian
Kekhawatiran tersebut bukan hanya dibahas sebagai skenario masa depan.
Dalam evaluasi keamanan siber terpisah pada 2026, Anthropic menemukan empat kejadian ketika model Claude mendapat akses tanpa izin ke sistem pihak ketiga yang nyata.
Insiden itu bermula dari lingkungan pengujian yang salah konfigurasi. Claude seharusnya bekerja dalam simulasi tanpa akses internet, tetapi sistem pengujian ternyata terhubung ke internet terbuka.
Model juga sengaja dijalankan tanpa perlindungan keamanan siber yang biasanya digunakan pada produk Claude untuk pengguna umum.
Dalam salah satu kejadian, model mengunggah paket perangkat lunak berbahaya ke repositori Python dan kemudian memperoleh akses ke basis data milik perusahaan keamanan.
Anthropic kemudian memperluas pemeriksaan hingga ratusan juta rekaman interaksi dan tidak menemukan kejadian lain dengan tingkat keparahan yang sama.
Perusahaan juga menegaskan bahwa model dalam insiden tersebut tetap mengejar tugas yang diberikan. Tidak ditemukan bukti Claude membentuk tujuan sendiri di luar tugas, bekerja sama dengan agen lain, atau sengaja mencoba menyembunyikan tindakannya dari pengawas.
Baca Juga: Anthropic Rilis Claude Opus 5.5, Biaya Workload Diklaim Turun 40 Persen
Keselamatan AI menjadi risiko bisnis
Peringatan dalam prospektus menunjukkan bahwa masalah keselamatan kini tidak hanya dipandang sebagai persoalan penelitian.
Bagi Anthropic, kegagalan mengendalikan model yang semakin kuat juga dapat menjadi risiko bisnis. Dampaknya bisa berupa kerugian bagi pengguna, tuntutan hukum, pembatasan regulasi, kerusakan reputasi, hingga berkurangnya kepercayaan terhadap produk perusahaan.
Pada saat yang sama, mengembangkan sistem pengamanan membutuhkan sumber daya besar. Anthropic harus membagi kemampuan komputasi, tenaga peneliti, dan biaya pengembangan antara peningkatan kemampuan model dan pekerjaan keselamatan.
Persoalannya menjadi semakin rumit karena bisnis AI bergerak sangat cepat. Model baru menjadi salah satu faktor yang mendorong penggunaan dan pendapatan, sehingga perusahaan tetap memiliki tekanan untuk terus meningkatkan kemampuan produk.
Anthropic sendiri sejak awal menempatkan keselamatan sebagai salah satu bagian utama pengembangan Claude. Kebijakan Responsible Scaling Policy milik perusahaan menetapkan pengamanan tambahan ketika model mencapai tingkat kemampuan tertentu, termasuk risiko pada bidang siber dan penggunaan teknologi berbahaya.
Anthropic sedang menuju IPO
Anthropic telah menyerahkan draft dokumen pendaftaran S-1 secara rahasia kepada Securities and Exchange Commission Amerika Serikat pada 1 Juni 2026.
Langkah tersebut memberi perusahaan pilihan untuk melanjutkan IPO setelah proses peninjauan regulator selesai. Jumlah saham yang akan dilepas dan harga penawarannya belum ditetapkan dalam pengumuman awal.
Dalam proses menuju pasar saham inilah Anthropic harus menjelaskan kepada calon investor bukan hanya peluang bisnis AI, tetapi juga risiko yang dapat muncul dari teknologi yang dikembangkannya sendiri.
Perusahaan tetap menilai AI memiliki potensi besar untuk membantu ilmu pengetahuan, kesehatan, pendidikan, dan berbagai bidang lain. Namun, dokumen keselamatannya juga berulang kali menegaskan bahwa kemampuan AI yang meningkat harus diikuti dengan sistem pengawasan dan perlindungan yang mampu berkembang sama cepatnya.











