IPD – 29 Maret 2026 | Anthropic, perusahaan rintisan AI yang berbasis di Amerika Serikat, secara tidak sengaja mengungkapkan rincian teknis model kecerdasan buatan terbarunya, Claude Mythos, melalui sebuah kebocoran data pada 26 Maret 2026. Kebocoran tersebut terjadi akibat konfigurasi yang keliru pada sistem manajemen konten (CMS) internal, yang membuat sejumlah dokumen draft dan catatan internal dapat diakses publik lewat sebuah URL terbuka. Penelusuran dokumen oleh dua peneliti keamanan siber, Roy Paz dari LayerX Security dan Alexandre Pauwels dari Universitas Cambridge, mengungkapkan fakta-fakta penting tentang kemampuan dan risiko model baru tersebut.
Claude Mythos, yang dalam kode internal disebut “Capybara,” diklaim oleh Anthropic sebagai model AI paling kuat yang pernah dikembangkan perusahaan itu. Menurut dokumen yang bocor, model ini melampaui performa Claude Opus 4.6, produk andalan Anthropic sebelumnya, terutama dalam pengujian pemrograman akademik dan kemampuan penalaran. Hasil benchmark menunjukkan peningkatan signifikan pada metrik akurasi dan kecepatan pemrosesan, menjadikan Mythos sebagai “new tier” dalam rangkaian model AI modern.
Namun, di balik keunggulan teknisnya, dokumen tersebut menyoroti “risiko keamanan siber yang signifikan” yang muncul akibat kemampuan model ini untuk menemukan dan mengeksploitasi kerentanan perangkat lunak. Anthropic mengakui bahwa Mythos dapat mengidentifikasi lebih dari 500 kerentanan zero‑day kritis pada proyek open‑source, termasuk 22 celah pada browser Firefox milik Mozilla. Meskipun pada fase pengujian awal model hanya berhasil menghasilkan exploit fungsional untuk dua kerentanan, kemampuan pencarian celah dan penyusunan skenario serangan secara otomatis menimbulkan kekhawatiran bahwa dalam tangan penyerang, model ini dapat menjadi katalisator serangan siber yang lebih canggih.
Para peneliti yang menemukan kebocoran menilai bahwa model ini memiliki potensi untuk mengotomatisasi proses “vulnerability hunting” dan “exploit generation” pada tingkat yang melampaui upaya tim pertahanan siber tradisional. “Jika Mythos dimanfaatkan oleh aktor jahat, mereka dapat mempercepat siklus pengembangan exploit, mengurangi waktu yang dibutuhkan untuk mengubah celah menjadi serangan yang dapat dieksekusi,” ujar Roy Paz dalam wawancara dengan media.
Pengungkapan ini memicu reaksi berantai di pasar dan industri. Saham perusahaan keamanan siber, termasuk Palo Alto Networks, mengalami penurunan tajam setelah laporan tentang potensi dampak ekonomi dan operasional dari penyalahgunaan Claude Mythos. Analis pasar menilai bahwa eksposur model AI yang begitu kuat dapat mengubah lanskap ancaman siber, memaksa perusahaan keamanan untuk menginvestasikan sumber daya lebih besar dalam mitigasi berbasis AI.
Anthropic merespon dengan cepat, menutup akses ke dokumen yang bocor dan mengeluarkan pernyataan resmi yang mengakui adanya “masalah dengan alat CMS eksternal” serta menegaskan bahwa semua materi yang terpublikasi merupakan draft internal yang belum final. Perusahaan juga menegaskan bahwa Claude Mythos masih berada dalam fase pengujian terbatas, dengan akses awal hanya diberikan kepada sejumlah klien terpilih. “Model ini tidak siap untuk peluncuran massal dan biayanya sangat tinggi, sehingga penggunaannya tetap terbatas pada skenario yang sangat terkontrol,” jelas juru bicara Anthropic.
Di sisi lain, kebocoran ini menimbulkan pertanyaan etis tentang transparansi dan tanggung jawab pengembangan AI. Kritikus menilai bahwa perusahaan AI harus lebih proaktif dalam mengidentifikasi dan mengkomunikasikan risiko keamanan yang melekat pada teknologi mereka, terutama ketika kemampuan model dapat disalahgunakan untuk tujuan kriminal.
Sejumlah regulator dan lembaga standar keamanan siber kini mulai mengevaluasi kebutuhan regulasi khusus untuk AI generatif yang memiliki kemampuan ofensif. Diskusi mengenai pembatasan distribusi model, audit keamanan pra‑peluncuran, dan persyaratan pelaporan kerentanan diperkirakan akan menjadi agenda utama dalam pertemuan industri mendatang.
Secara keseluruhan, kebocoran Claude Mythos menyoroti paradoks antara inovasi AI yang semakin canggih dan ancaman keamanan yang semakin kompleks. Sementara Anthropic berupaya memanfaatkan potensi teknologi untuk meningkatkan produktivitas dan solusi cerdas, risiko penyalahgunaan yang diidentifikasi mengharuskan seluruh ekosistem teknologi, regulator, dan pengguna untuk bersama‑sama mengembangkan kerangka kerja keamanan yang memadai.
Ke depan, perhatian utama akan tertuju pada bagaimana Anthropic dan pemain industri lainnya mengelola risiko ini, serta bagaimana pasar merespons potensi perubahan dinamika ancaman siber yang dipicu oleh model AI generatif berkapabilitas tinggi.
