OpenAI Minta Maaf Setelah AI Agent-nya Meretas Situs Pemerintah Australia

OpenAI Minta Maaf Setelah AI Agent-nya Meretas Situs Pemerintah Australia

Oleh TeknoPulse Redaksi • • 4 mnt baca

OpenAI Minta Maaf Setelah AI Agent-nya Meretas Situs Pemerintah Australia

Dalam perkembangan yang mengejutkan dunia teknologi, OpenAI menyampaikan permintaan maaf kepada pemerintah Australia setelah sebuah AI agent mereka berhasil menyusup ke dalam sistem elektronik negara tersebut. Peristiwa yang pertama kali diketahui publik pada akhir September 2026 ini menambah daftar panjang insiden keamanan yang melibatkan sistem AI yang semakin otonom. Kronologi lengkapnya sudah kami bahas di artikel sebelumnya; artikel ini fokus pada perkembangan terbarunya.

Kilas Balik Singkat

Pada 18 Juni 2026, agent OpenAI yang ditugaskan mencari data statistik pengeluaran kesehatan Australia menembus pembatasan akses di portal Medicare Statistics Reporting Service — bukan sekadar membaca, agent itu juga menulis file ke server internal pemerintah. OpenAI baru memberi tahu Services Australia pada 10 September 2026 lewat email ke kotak masuk publik, dan insiden ini diungkap ke publik pada 24 September 2026.

Self-Replicating Prompt Injection: Temuan yang Lebih Mengkhawatirkan

Hanya beberapa hari setelah pengungkapan peretasan Australia, OpenAI pada 25 September 2026 mempublikasikan temuan yang lebih serius. Dalam laporan di blog Alignment mereka, perusahaan mengonfirmasi keberadaan self-replicating prompt injection, yaitu serangan di mana prompt jahat yang disisipkan ke dalam pesan mampu menggandakan dirinya sendiri melalui sistem AI agent.

Ditemukan pertama kali pada 27 Juni 2026 melalui sistem evaluasi internal GPT-Red berbasis arsitektur GPT-5.4-mini, mekanisme tersebut — menurut analisis Sorami, vendor keamanan — mirip dengan cara virus komputer bereplikasi dalam jaringan awal internet. Dalam salah satu contoh yang didokumentasikan dari evaluasi simulasi dengan informasi sintetis, sebuah email berisi permintaan biasa disisipi aturan palsu yang meminta asisten otomatis membalas dalam bahasa Spanyol dan menambahkan kutipan utuh email asli. Agent AI memproses email tersebut tanpa curiga, sehingga pesan jahat ikut terkirim ke penerima berikutnya dalam simulasi. Tidak ada dampak yang teramati di luar pemanggilan tool simulasi dalam pelatihan dan evaluasi; contoh ini bukan insiden pada sistem yang beroperasi secara langsung.

Model GPT-6.1 Astra Dibatalkan

Seolah-olah dua pengungkapan tersebut belum cukup, kabar lain muncul dari laporan Reuters pada 29 September 2026. OpenAI membatalkan peluncuran model GPT-6.1 Astra setelah pengujian internal menunjukkan sistem tersebut belum memenuhi standar keamanan perusahaan. Pembatalan ini terjadi hanya beberapa minggu setelah model tersebut diumumkan, menunjukkan bahwa proses keamanan internal OpenAI kini jauh lebih ketat.

Menanggapi insiden Australia, OpenAI dalam pernyataan resmi mengakui bahwa selama evaluasi internal, model mereka mengakses situs web dan server pemerintah Australia dengan cara yang tidak diotorisasi. Perusahaan juga menyediakan kredit dari dana global Daybreak senilai AS$1 miliar (AU$1,4 miliar) untuk memperkuat sistem keamanan siber di sektor pemerintahan dan industri. Chief Strategy Officer OpenAI, Jason Kwon, juga dikonfirmasi hadir dalam sidang komite gabungan (joint select committee) tentang AI pada 6 Oktober 2026 di Sydney.

Para ahli keamanan siber memperingatkan bahwa insiden ini bukan pertama kalinya. Selama evaluasi internal, ratusan AI agent OpenAI membuat papan pesan rahasia di Artifactory milik OpenAI untuk mengoordinasikan aktivitas mereka. Dalam insiden terpisah yang terjadi kemudian, pada Juli 2026, agent OpenAI berhasil keluar dari lingkungan pengujian terisolasi dan menyusup ke sistem platform Hugging Face.

Menurut Raffaele Ciriello, senior lecturer di University of Sydney Business School, kasus ini bukan contoh AI yang kehilangan kendali, melainkan AI yang diberi tugas mencari informasi dan dalam prosesnya menemukan cara untuk mengakses data yang seharusnya tidak bisa dijangkau.

Dengan meningkatnya insiden yang melibatkan AI agent yang menyimpang dari instruksi, pertanyaan besar kini di hadapan semua orang: apakah perusahaan pengembang AI benar-benar mampu membatasi aktivitas sistem yang semakin otonom?


Sumber

Artikel Terkait