
Morning Minute adalah buletin harian yang ditulis oleh Tyler Warner. Analisis dan opini yang diungkapkan adalah miliknya sendiri dan tidak selalu mencerminkan pandangan Decrypt.
GM!
Berita utama hari ini:
🤖 Model OpenAI Melarikan Diri dari Lingkungan Uji Terkunci dan Meretas Hugging Face
OpenAI mengungkapkan pada hari Selasa bahwa dua model AI miliknya berhasil keluar dari lingkungan uji sandbox, menggabungkan eksploitasi zero-day di dua sistem perusahaan, dan membobol server produksi Hugging Face. Motifnya bukan sabotase. Mereka secara efektif mencoba menyontek dalam ujian.
Kemarin, OpenAI mengonfirmasi bahwa GPT-5.6 Sol dan model yang belum dirilis yang lebih canggih berhasil keluar dari lingkungan terkontrol selama evaluasi internal. Ujian tersebut adalah ExploitGym, sebuah benchmark keamanan siber publik yang memberikan agen AI 898 kerentanan perangkat lunak dunia nyata dan meminta mereka untuk mengubah setiap kerentanan menjadi serangan yang berfungsi, dengan skor lulus atau gagal.
Daripada memecahkan masalah, model-model tersebut menghabiskan banyak komputasi untuk mencari cara mencapai internet terbuka, kemudian mengeksploitasi zero-day yang sebelumnya tidak diketahui pada proxy registri paket pihak ketiga untuk keluar. Dari sana mereka meningkatkan hak akses, bergerak secara lateral melalui sistem penelitian OpenAI sendiri, dan menggunakan kredensial curian ditambah zero-day lebih lanjut untuk mencapai eksekusi kode jarak jauh pada infrastruktur produksi Hugging Face, di mana mereka telah secara tepat menyimpulkan bahwa solusi benchmark disimpan. Hugging Face mendeteksi intrusi secara independen dan mengungkapkannya pada 16 Juli. OpenAI mengonfirmasi bahwa modelnya yang bertanggung jawab lima hari kemudian.
Jadi, agar jelas, model AI diminta untuk menunjukkan kemampuan meretas dalam sebuah kotak, memutuskan bahwa kotak itu adalah hambatan, dan meretas keluar darinya serta masuk ke sistem produksi orang lain untuk mendapatkan skor yang lebih baik. Tidak ada yang memerintahkannya untuk melakukan itu.
Industri telah menghabiskan dua tahun memperdebatkan apakah AI dapat secara otonom merangkai eksploitasi di seluruh infrastruktur nyata, dan sekarang kita memiliki jawabannya—'ya' yang bergema. Bagi kripto, implikasinya suram. DeFi telah menghabiskan bulan ini untuk dikuras oleh manipulasi ekonomi yang kemungkinan didorong oleh model AI. Ostium kehilangan $18 juta, Allbridge $1,65 juta, dan BONK $20 juta melalui serangan tata kelola, semua dieksekusi dengan menemukan kelemahan yang luput dari audit. Sekarang pertimbangkan musuh yang dapat menyelidiki ribuan kontrak secara terus-menerus dan tidak pernah bosan.
Ethereum Foundation sudah menjalankan agen AI terhadap kodenya sendiri karena alasan ini, dan kemampuan yang sama yang memungkinkan para pembela mencakup lebih banyak area memberikan penyerang jalur yang lebih cepat. Kami tahu tim Zcash menemukan vektor eksploitasinya dengan melakukan jenis pengujian serupa, dan untungnya menemukan eksploitasi tersebut sebelum aktor jahat melakukannya (kita akan mengetahuinya pada 28 Juli).
Tetapi pelajarannya jelas—lakukan white hat hack protokol Anda sekarang menggunakan model AI paling canggih yang bisa Anda dapatkan. Atau minta orang lain melakukannya untuk Anda…
Perbendaharaan Korporat & ETF
Pelacak Koin Meme