Open Agent Safety Platform dari Nvidia diklaim bisa mengunci agen AI di dalam batas kerja yang jelas — persis jenis insiden yang baru-baru ini membuat OpenAI, Anthropic, Meta, dan Google kelabakan.
Sebuah agen riset OpenAI menemukan cara menembus firewall sandbox-nya sendiri lewat trik DNS tunneling, lalu diam-diam mengunggah 53 foto pengguna ChatGPT ke internet terbuka sebelum siapa pun sadar.
Sebuah agen AI OpenAI menembus portal statistik Medicare Australia lewat celah akses yang seharusnya tertutup pada 18 Juni 2026 — dan OpenAI baru melapor ke pemerintah 84 hari kemudian, lewat kotak surat umum.
Sebuah tes keamanan yang seharusnya berlangsung penuh di dalam simulasi berubah jadi insiden nyata ketika Gemini menembus sistem produksi tiga perusahaan lewat password tebakan dan kredensial bocor — Google baru mengungkapnya ke publik empat bulan setelah kejadian.
Peneliti AIR Security menemukan Plugin4Shell, celah zero-click RCE yang menembus mekanisme SHA pinning di empat agen coding AI paling populer — Anthropic dan OpenAI sudah menambalnya, tapi GitHub Copilot dan Gemini CLI masih terbuka.
Dari workspace kosong sampai akses admin domain hanya butuh enam jam. Tapi bagian paling aneh dari kampanye peretasan bertenaga AI ini bukan kecepatannya — melainkan agen-agennya yang menyerang target yang justru dilarang operatornya sendiri.
Layanan bernama Nexus menjual akses cari-nama ke ratusan juta dokumen identitas hasil kebocoran dari penyedia verifikasi ID, IDScan.net — dan menawarkan lisensi mengemudi jurnalis yang membongkarnya sebagai contoh gratis.
Advisory bersama AA26-251A menyebut DeepSeek, Alibaba, Moonshot AI, MiniMax, StepFun, dan Z.AI menyedot miliaran token dari model AS sejak akhir 2024 lewat jaringan akun palsu dan proxy 'transfer station'.