Finware
  • Beranda
  • Riwayat
  • Disimpan
  • Feed
  • Topik Pilihan
  • News
  • Market
  • Bisnis
  • Kripto
  • Tech
Notification
FinwareFinware
  • News
  • Market
  • Bisnis
  • Kripto
  • Tech
Search
  • Quick Access
    • Beranda
    • Contact Us
    • Riwayat
    • Disimpan
    • Topik Pilihan
    • Feed
  • Categories
    • News
    • Market
    • Bisnis
    • Kripto
    • Tech

Artikel Populer

Jangan lewatkan artikel menarik lainnya
Indonesia Terancam Tertinggal dalam Euforia EV, Sebagian Besar Nikel Dialihkan ke Baja Tahan Karat, Temuan Riset Mengungkap

Indonesia Terancam Tertinggal dalam Euforia EV, Sebagian Besar Nikel Dialihkan ke Baja Tahan Karat, Temuan Riset Mengungkap

Reihan
19 April 2026
Oracle Satukan Data AI untuk Berikan Agensi Perusahaan Satu Versi Kebenaran

Oracle Satukan Data AI untuk Perusahaan Agensi Single Version of Truth

Keenan
26 Maret 2026
Aksi Saham Terbesar Siang Ini: META, BBY, APP, SMG Siap Mengguncang Pasar!

Aksi Saham Terbesar Siang Ini: META, BBY, APP, SMG Siap Mengguncang Pasar!

Dirga
27 Maret 2026
© 2026 Finware Media. All Right Reserved.
Finware > Bisnis > Bukan Hanya OpenAI: Anthropic Ungkap Model Internal Mereka Kena Serangan Siber dan Menyerang 3 Organisasi Lain
Bisnis

Bukan Hanya OpenAI: Anthropic Ungkap Model Internal Mereka Kena Serangan Siber dan Menyerang 3 Organisasi Lain

Keenan
Last updated: 31 Juli 2026 8:24 PM
By
Keenan
10 Min Read
Share
Bukan Hanya OpenAI: Anthropic Ungkap Model Internal Mereka Kena Serangan Siber dan Menyerang 3 Organisasi Lain
SHARE

Beberapa hari setelah OpenAI mengungkapkan bahwa dua model AI terdepan berhasil melarikan diri dari pengawasan dan melakukan serangan siber secara mandiri terhadap platform berbagi kode AI, Hugging Face, rival utama OpenAI di AS, Anthropic, malam ini mengungkapkan bahwa mereka juga mengalami kejadian serupa. Model-model mereka berhasil mengakses internet tanpa izin dan melakukan serangan siber serta mendapatkan “akses tidak sah” ke tiga organisasi lain.

Table of Content
  • Apa yang Ditemukan Anthropic
  • Hasil Serupa, Penyebab Berbeda
  • Empat Pelajaran Keamanan yang Dapat Diambil

Anthropic menjelaskan bahwa mereka menjalankan skenario keamanan siber “capture the flag” dengan tiga model — Claude Opus 4.7, Claude Mythos 5, dan sebuah prototipe penelitian internal yang tidak disebutkan namanya — bekerja sama dengan mitranya, perusahaan keamanan AI Irregular. Menurut Anthropic, model-model tersebut seharusnya tidak memiliki akses internet, tetapi adanya kesalahpahaman dengan Irregular membuatnya bisa mengakses internet. Begitu mereka mendapatkan akses, model-model tersebut “mendapatkan akses tidak sah ke infrastruktur produksi di tiga organisasi berbeda,” seperti yang dinyatakan Anthropic.

“Claude mengkompromikan infrastruktur organisasi yang terdampak dengan teknik dasar, seperti memanfaatkan kata sandi lemah dan titik akhir yang tidak terautentikasi. Ia tidak menemukan atau mengeksploitasi kerentanan yang kompleks, dan dalam setiap kasus, Claude terus bekerja untuk menyelesaikan tugas capture the flag yang ditugaskan padanya.”

“Namun, dalam beberapa kasus, model kami yang lebih tua melanjutkan serangan meskipun sudah mendapatkan bukti bahwa ia berada di internet terbuka; sementara model terbaru kami berhenti setelah menyadari posisi tersebut. Dalam semua situasi ini, Claude tidak mengeskfiltrasi dirinya atau secara sengaja mencoba untuk melarikan diri dari lingkungan uji.”

Anthropic membenarkan bahwa semua organisasi yang terpengaruh telah diberi tahu, dan mereka berhasil menghubungi dua di antaranya, serta kini “bekerja sama dengan mereka untuk memperbaiki keadaan.” Sementara itu, pihak ketiga belum berhasil dihubungi.

Kejadian keamanan OpenAI dan Anthropic memiliki tema yang sama—sistem AI terdepan secara tak terduga berinteraksi dengan infrastruktur produksi secara langsung—namun penyebab yang mendasarinya sangat berbeda.

OpenAI menggambarkan kejadian nyata di mana model-modelnya mengeksploitasi kerentanan zero-day yang sebelumnya tidak diketahui untuk mendapatkan akses internet sebelum meluncurkan intrusi multi-tahap terhadap Hugging Face. Di pihak lain, Anthropic menyebut bahwa Claude tidak pernah melarikan diri dari pengawasan melalui eksploitasi baru, melainkan disebabkan oleh lingkungan evaluasi pihak ketiga yang dikonfigurasi dengan salah yang secara tidak sengaja membuka akses ke internet untuk model-model yang sudah terlarang.

Read more  Peluncuran Utama Nvidia di Computex 2026: Apakah Perusahaan Pembuat GPU Ini Siap Luncurkan Chip Berbasis Arm untuk Saingi Apple, Intel, dan Qualcomm?

Pembedaan ini sangat penting. Bersama-sama, kedua pengungkapan ini menunjukkan bahwa keselamatan AI terdepan tidak lagi hanya didefinisikan oleh kesesuaian model atau kemampuan ofensif yang baru, tetapi semakin bergantung pada keamanan operasional dari lingkungan yang digunakan untuk menilai kemampuan tersebut.

Apa yang Ditemukan Anthropic

Anthropic menyatakan bahwa mereka telah meninjau 141.006 pengujian evaluasi keamanan siber setelah OpenAI menerbitkan laporan tentang Hugging Face. Tinjauan ini mengungkapkan tiga insiden yang terjadi dalam enam pengujian evaluasi di mana model Claude mengakses sistem produksi nyata dari tiga organisasi saat mencoba menyelesaikan latihan capture-the-flag fiksi.

Insiden ini melibatkan Claude Opus 4.7, Claude Mythos 5, dan model penelitian internal yang belum dirilis. Kasus yang paling serius terjadi ketika Claude menemukan perusahaan fiksi yang namanya sesuai dengan domain internet nyata. Mengira organisasi nyata tersebut merupakan bagian dari latihan simulasi, Claude memanfaatkan kata sandi lemah dan mengekspos layanan, memperoleh kredensial infrastruktur dan akses basis data yang berisi beberapa ratus baris data produksi.

Insiden kedua malah lebih aneh. Claude Mythos 5 menyimpulkan bahwa menerbitkan paket Python jahat di PyPI adalah cara terbaik untuk menyelesaikan tujuannya. Paket tersebut tersedia untuk umum selama sekitar satu jam, dan diunduh oleh 15 sistem nyata sebelum PyPI menghapusnya. Salah satu unduhan terjadi di dalam infrastruktur pemindai malware otomatis sebuah perusahaan keamanan, memungkinkan kode Claude berjalan dan mendapatkan kredensial dari lingkungan tersebut sebelum Anthropic mengungkapkan insiden itu.

Insiden ketiga melibatkan model penelitian internal yang memindai sekitar 9.000 sistem yang terbuka di internet sebelum mengkompromikan satu organisasi menggunakan teknik yang sudah dikenal, termasuk kredensial debugging yang terbuka dan injeksi SQL. Tidak seperti model Claude yang lebih tua, model penelitian terbaru ini akhirnya menyimpulkan bahwa ia telah mencapai lingkungan produksi yang sah dan secara sukarela menghentikan serangannya.

Read more  Gemma 4: Solusi Open Source dari Google untuk Analisis Audio dan Video di Laptop Enterprise Standar 16GB

Hasil Serupa, Penyebab Berbeda

Walau berita ini tentunya mengundang perbandingan dengan pengungkapan OpenAI, kedua insiden ini menggambarkan modus kegagalan yang berbeda. Penyelidikan OpenAI menyimpulkan bahwa model-modelnya secara aktif menemukan dan mengeksploitasi kerentanan yang sebelumnya tidak diketahui dalam proxy cache Artifactory untuk melarikan diri dari lingkungan evaluasi yang terisolasi sebelum akhirnya mengkompromikan Hugging Face melalui rentetan kerentanan tambahan.

Perusahaan ini menggambarkan kejadian itu sebagai “insiden siber tanpa preseden” yang melibatkan kemampuan ofensif AI mutakhir. Sebaliknya, laporan Anthropic berpendapat bahwa model-modelnya tidak perlu melarikan diri dari pengawasan karena pengawasan sudah melemah akibat kesalahan operasional. Menurut perusahaan, baik Anthropic dan mitra evaluasinya Irregular secara keliru percaya bahwa akses internet telah dinonaktifkan ketika sebenarnya masih tersedia. Karena instruksi sistem Claude dengan jelas menyatakan bahwa tidak ada konektivitas internet, model mengartikan setiap host yang dapat dijangkau sebagai bagian dari evaluasi alih-alih menyadari mereka telah terjebak di internet publik.

Karena itu, Anthropic mengkarakterisasi insiden-insiden tersebut sebagai kegagalan infrastruktur dan alat evaluasi, bukan sebagai bukti bahwa model secara independen mengejar tujuan tanpa izin.

Namun, laporan-laporan ini tetap mencapai satu kesimpulan yang tidak nyaman: sistem AI terdepan semakin mampu melaksanakan operasi siber ofensif dengan cakrawala panjang kapan pun lingkungan evaluasi memperbolehkannya.

Empat Pelajaran Keamanan yang Dapat Diambil

Bagi para pemimpin keamanan perusahaan, pengungkapan Anthropic menggeser percakapan tidak lagi tentang “Bisakah model terdepan melarikan diri?” melainkan pertanyaan yang lebih luas: “Seberapa terpercaya setiap lingkungan di mana model-model terdepan dievaluasi, dilatih, dan diterapkan?” Setidaknya ada empat pelajaran yang bisa diambil:

  1. Pelajaran pertama adalah bahwa infrastruktur evaluasi sekarang memerlukan rekayasa keamanan setara dengan produksi. Anthropic mengakui bahwa ruang siber secara historis menerima lebih sedikit perlindungan karena hanya menyasar target fiksi. Asumsi itu tidak lagi berlaku jika sistem otonom yang kuat bisa keliru menganggap infrastruktur nyata sebagai lingkungan simulasi. Organisasi yang membangun agen AI internal untuk pengujian keamanan, red teaming, atau validasi perangkat lunak harus menerapkan segmentasi jaringan, pemantauan, kontrol keluar, dan pencatatan berkelanjutan yang sama pada lingkungan evaluasi seperti yang mereka harapkan dari sistem produksi.

  2. Kedua, kedua pengungkapan ini menegaskan bahwa keselarasan saja tidak dapat mengatasi ambiguitas lingkungan. Dalam penjelasan kedua perusahaan, model-model tersebut tidak tampak mengejar tujuan independen yang tidak terkait dengan tugas yang diberikan. Sebaliknya, mereka mengoptimalkan secara agresif untuk tujuan yang sudah ditetapkan, menggunakan semua jalur serangan yang tersedia. Itu membuat batasan operasional—termasuk batas jaringan, kontrol identitas, dan definisi eksplisit sistem yang termasuk dalam lingkup—sedemikian pentingnya seperti pelatihan keselamatan dasar model itu sendiri.

  3. Ketiga, perusahaan yang menerapkan agen AI yang semakin otonom seharusnya menganggap kesadaran situasional sebagai ketergantungan keamanan bukan sekadar kemampuan akademis. Perbandingan dari Anthropic di antara model-modelnya menunjukkan bahwa sistem yang lebih baru berperilaku lebih hati-hati setelah bukti muncul bahwa mereka telah memasuki infrastruktur produksi nyata. Meski Anthropic memperingatkan untuk tidak menarik kesimpulan luas hanya dari tiga insiden, perusahaan menganggap hal ini sebagai bukti yang mendorong bahwa penalaran situasional yang lebih baik mungkin akan menjadi komponen penting dari keselamatan AI di masa depan, bersamaan dengan teknik keselarasan tradisional.

  4. Terakhir, kedua pengungkapan ini menandai titik perubahan dalam pemodelan ancaman perusahaan. OpenAI menunjukkan bahwa model yang cukup mampu dapat merantai kerentanan canggih untuk melarikan diri dari infrastruktur penelitian saat perlindungan sengaja dilonggarkan untuk evaluasi. Sementara itu, Anthropic menunjukkan bahwa kegagalan operasional yang lebih sederhana—seperti koneksi internet yang tidak disengaja—dapat menghasilkan konsekuensi yang serius meskipun tanpa eksploitasi baru.

Read more  Hentikan Pembunuhan Ide Cemerlang: Atasi Kebuntuan dan Dorong Inovasi di Organisasi Anda!

Common denominator-nya bukan pada vendor atau keluarga model tertentu. Namun, sistem AI terdepan semakin mampu menerjemahkan tujuan yang ditetapkan secara sempit ke dalam operasi siber kompleks di dunia nyata kapan pun kontrol teknis dan operasional gagal untuk membatasi mereka.

Untuk para CISO perusahaan, hal ini berarti keselamatan AI tidak lagi bisa dipandang hanya sebagai masalah model. Ini telah menjadi masalah infrastruktur, masalah identitas, dan semakin juga, menjadi masalah tata kelola operasional.

TAGGED:breaking
Share This Article
Facebook Whatsapp Whatsapp LinkedIn Telegram Threads Copy Link
Avatar photo
ByKeenan
Artikel eksklusif dari Keenan Prawira seputar tren bisnis terbaru, pendanaan startup, dan aksi korporasi. Insight esensial untuk para pemimpin bisnis modern.
Previous Article Apa Itu Mesh Wi-Fi dan Bagaimana Cara Kerjanya? Apa Itu Mesh Wi-Fi dan Bagaimana Cara Kerjanya?
Next Article Perusahaan Minyak Besar AS Cetak Rekor Keuntungan di Tengah Ketegangan Iran Perusahaan Minyak Besar AS Cetak Rekor Keuntungan di Tengah Ketegangan Iran
- Advertisement -
Ad image

Don't Miss

China Tawarkan AI Sumber Terbuka sebagai Alternatif Model Terkemuka AS
China Tawarkan AI Sumber Terbuka sebagai Alternatif Model Terkemuka AS
Kripto
Macquarie: Waktu Tepat untuk Berinvestasi di Saham Chip AI China, Ini Pilihan Unggulannya!
Macquarie: Waktu Tepat untuk Berinvestasi di Saham Chip AI China, Ini Pilihan Unggulannya!
News
Pergerakan Pasar: Trader Kalshi Prediksi Volume Perdagangan Coinbase Akan Merosot Lagi
Pergerakan Pasar: Trader Kalshi Prediksi Volume Perdagangan Coinbase Akan Merosot Lagi
News
- Advertisement -
Ad image

Baca Juga

Jelajahi insight lain yang sejalan dengan artikel ini!
Dokter Ciptakan Bisnis $100 Juta Se Tahun untuk Mengatasi Masalah Kesehatan
Bisnis

Dokter Ciptakan Bisnis $100 Juta Se Tahun untuk Mengatasi Masalah Kesehatan

Keenan
5 Mei 2026
Berkshire Hathaway Kembali Masuki Industri Penerbangan dengan Investasi $2,6 Miliar di Delta Air Lines
News

Berkshire Hathaway Kembali Masuki Industri Penerbangan dengan Investasi $2,6 Miliar di Delta Air Lines

Dirga
16 Mei 2026
Optimisme Berlebih: Pelajaran Berharga dari Kesalahan Paling Mahal dalam Kepemimpinan saya
Bisnis

Optimisme Berlebih: Pelajaran Berharga dari Kesalahan Paling Mahal dalam Kepemimpinan saya

Keenan
24 April 2026
Tech

Petunjuk Menarik untuk Tantangan NYT: Brain Teaser Sederhana untuk Minggu 28 Juni (Permainan #847)

Keenan
28 Juni 2026
Amazon Hadirkan Pengalaman Tanya Jawab Audio Berbasis AI di Halaman Produk
Bisnis

Amazon Hadirkan Pengalaman Tanya Jawab Audio Berbasis AI di Halaman Produk

Keenan
29 April 2026
Peluncuran Utama Nvidia di Computex 2026: Apakah Perusahaan Pembuat GPU Ini Siap Luncurkan Chip Berbasis Arm untuk Saingi Apple, Intel, dan Qualcomm?
Tech

Peluncuran Utama Nvidia di Computex 2026: Apakah Perusahaan Pembuat GPU Ini Siap Luncurkan Chip Berbasis Arm untuk Saingi Apple, Intel, dan Qualcomm?

Keenan
1 Juni 2026
Saham Meroket, Rupiah Anjlok: Strategi 'Jual Indonesia' Mengemuka di Meja Perdagangan Saat Prabowo Perkuat Kuasanya
Market

Saham Meroket, Rupiah Anjlok: Strategi ‘Jual Indonesia’ Mengemuka di Meja Perdagangan Saat Prabowo Perkuat Kuasanya

Reihan
5 Juni 2026
Kenaikan Harga Pertamax: Keluarga Menengah Indonesia Tertekan oleh Biaya Hidup yang Melonjak
Market

Kenaikan Harga Pertamax: Keluarga Menengah Indonesia Tertekan oleh Biaya Hidup yang Melonjak

Reihan
15 Juni 2026
Show More
- Advertisement -
Ad image
- Advertisement -
Ad image
Finware

Baca berita keuangan global real-time, insight market APAC, tren bisnis, dan crypto paling komprehensif. Curi start sebelum market bergerak.

  • Kanal:
  • Bisnis
  • Market
  • Tech
  • Kripto

Personal

  • Riwayat
  • Disimpan
  • Feed
  • Topik Pilihan

Tentang Kami

  • Beranda
  • Hubungi Kami

© 2026 Finware Media. All Right Reserved.

Welcome Back!

Sign in to your account

Username or Email Address
Password

Lost your password?