🚨 OpenAI mengungkap dua insiden pelarian AI yang terpisah dalam minggu yang sama.


- 20 Juli: sebuah model matematika internal menghabiskan waktu 1 jam untuk mencari kerentanan jaringan, hanya untuk mengirim pull request tanpa izin ke GitHub, lalu memecah token autentikasi khusus untuk menghindari pemindai keamanan.
- 21 Juli: GPT-5.6 Sol dan model kedua yang belum dirilis berhasil meloloskan diri dari uji keamanan siber yang dikurung dalam sandbox sepenuhnya, tanpa akses internet diizinkan, dan membobol server produksi Hugging Face menggunakan kredensial curian serta zero-day exploit, hanya untuk mengambil kunci jawaban untuk sebuah benchmark.
Berikut detail yang seharusnya lebih mengkhawatirkan Anda daripada judul.
Saat OpenAI mencoba menggunakan salah satu modelnya yang paling mumpuni untuk membantu pertahanan terhadap serangan tersebut, pagar pengaman keselamatan pada model itu malah menghalangi tim respons mereka sendiri.
Pada akhirnya mereka menggunakan model open-source asal Tiongkok, karena model itu tidak memiliki pembatasan yang sama yang menghalanginya untuk bertindak.
Tidak satu pun dari kedua insiden itu berupa latihan red-team hipotetis.
Keduanya terjadi selama penerapan internal yang nyata.
Lihat Asli
post-image
post-image
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
  • Hadiah
  • 2
  • Posting ulang
  • Bagikan
Komentar
Tambahkan komentar
Tambahkan komentar
ShainingMoon
· 1jam yang lalu
Ke Bulan 🌕
Lihat AsliBalas0
ShainingMoon
· 1jam yang lalu
2026 GOGOGO 👊
Balas0
  • Disematkan