๐Ÿ“… Kamis, 3 September 2026 ยท --:-- WIB Ikuti kami
Ecosystem โ–ผ
ID EN
Anthropic Akui Claude Jebol Sistem 3 Perusahaan - Ironinya AI Ini Merasa Masih Berada di Simulasi

Anthropic Akui Claude Jebol Sistem 3 Perusahaan - Ironinya AI Ini Merasa Masih Berada di Simulasi

๐Ÿ“š Istilah di Artikel Ini:

Dalam evaluasi keamanan siber, model AI Claude mendapatkan akses tidak sah ke sistem komputer milik tiga perusahaan berbeda. Lingkungan pengujian pihak ketiga yang dipakai rupanya terhubung langsung ke internet publik, padahal instruksi awal menyatakan model itu sedang berada di dalam simulasi tertutup tanpa akses internet.

Kasus yang diungkap Anthropic pada bulan Juli ini memaksa mereka memperketat pengujian dan pengamanan pelatihan. Melalui publikasi blog hari Senin, Anthropic menyebut insiden pelanggaran ini mencerminkan kegagalan keamanan operasional sekaligus dua kegagalan penyelarasan utama, yakni penalaran termotivasi dan kesediaan menyebabkan bahaya.

Fakta di lapangan menunjukkan Claude merespons akses tak terduga itu dengan pola pikir unik. Saat menemukan bukti bahwa ia sedang terhubung ke internet nyata, model ini mungkin menginterpretasikan temuan itu sedemikian rupa guna mempertahankan keyakinan bahwa seluruh sistem masih sebatas simulasi.

Sistem Berulang Kali Menembus Batas

Uji coba terpisah memperkuat temuan rentannya pengamanan model AI. Sebuah pengujian yang dijalankan oleh UK AI Security Institute mendapati bahwa model Claude Mythos mengambil tindakan tidak sah di internet langsung, sesaat setelah seorang evaluator sengaja memberinya akses internet.

Menyusul insiden 30 Juli itu, Anthropic sempat menghentikan sementara seluruh evaluasi siber untuk model pra-rilis dan mulai memperkenalkan lapis pengamanan yang lebih ketat. Setiap pengujian wajib berjalan di dalam sandbox offline yang sudah terverifikasi, lengkap dengan batas yang jelas dan pemantauan waktu nyata.

Anthropic turut menanamkan classifier baru yang bertugas memblokir dugaan pelanggaran batas, mengakhiri tes seketika, serta mengirim peringatan ke pengawas manusia. Kebijakan pemantauan offline ini juga diperluas ke sebagian besar bentuk penggunaan agen frontier internal lain di lingkungan perusahaan.

FBI Bajak Situs Donasi Hamas dan Sita $560 Ribu Kripto - Ribuan Identitas Penyumbang Kini Terlacak๐Ÿ“Œ Baca JugaFBI Bajak Situs Donasi Hamas dan Sita $560 Ribu Kripto - Ribuan Identitas Penyumbang Kini Terlacak

Menyusul Kebobolan di OpenAI

Kegagalan Claude di Anthropic terjadi tak lama setelah masalah keamanan agen AI OpenAI. Pada bulan Juli, model OpenAI diketahui menerobos masuk ke platform Hugging Face demi mendapatkan jawaban uji keamanan siber. Dalam insiden kebobolan itu, sekitar 1.200 agen berhasil berkoordinasi lewat papan pesan tidak sah, dan sekitar 700 agen di antaranya ikut bergabung dalam upaya pembobolan.

Menghadapi celah pengamanan pada sistem AI, Anthropic, OpenAI, bersama lebih dari 100 organisasi lainnya akhirnya menyerukan pertahanan siber yang lebih kuat. Mereka menuntut penerapan kontrol akses yang ketat dan meminta pengawasan yang lebih dekat atas agen AI. Dilansir dari Decrypt.

Baca juga: Lazarus Korea Utara Cuci Bitcoin $30 Juta di Hyperliquid - Persis Saat Platform Melobi AS


Disclaimer: Artikel ini bersifat informatif dan edukatif, bukan nasihat keuangan. Aset kripto sangat fluktuatif dan berisiko tinggi. Selalu lakukan riset mandiri (DYOR) dan jangan berinvestasi melebihi kemampuanmu menanggung kerugian.

Gimana reaksimu?
Bagikan artikel ini:
๐Ÿ“ฉ KABAR BITCOIN 1 MENIT

Berita kripto harian, langsung ke inbox

Ringkasan 1 menit untuk kamu yang selalu bergerak. Gratis, kapan saja bisa berhenti.

Total
0
Share