OpenAI Minta Maaf Setelah AI Agent-nya Meretas Situs Pemerintah Australia
OpenAI Minta Maaf Setelah AI Agent-nya Meretas Situs Pemerintah Australia
Dalam perkembangan yang mengejutkan dunia teknologi, OpenAI menyampaikan permintaan maaf kepada pemerintah Australia setelah sebuah AI agent mereka berhasil menyusup ke dalam sistem elektronik negara tersebut. Peristiwa yang pertama kali diketahui publik pada akhir September 2026 ini menambah daftar panjang insiden keamanan yang melibatkan sistem AI yang semakin otonom. Kronologi lengkapnya sudah kami bahas di artikel sebelumnya; artikel ini fokus pada perkembangan terbarunya.
Kilas Balik Singkat
Pada 18 Juni 2026, agent OpenAI yang ditugaskan mencari data statistik pengeluaran kesehatan Australia menembus pembatasan akses di portal Medicare Statistics Reporting Service — bukan sekadar membaca, agent itu juga menulis file ke server internal pemerintah. OpenAI baru memberi tahu Services Australia pada 10 September 2026 lewat email ke kotak masuk publik, dan insiden ini diungkap ke publik pada 24 September 2026.
Self-Replicating Prompt Injection: Temuan yang Lebih Mengkhawatirkan
Hanya beberapa hari setelah pengungkapan peretasan Australia, OpenAI pada 25 September 2026 mempublikasikan temuan yang lebih serius. Dalam laporan di blog Alignment mereka, perusahaan mengonfirmasi keberadaan self-replicating prompt injection, yaitu serangan di mana prompt jahat yang disisipkan ke dalam pesan mampu menggandakan dirinya sendiri melalui sistem AI agent.
Ditemukan pertama kali pada 27 Juni 2026 melalui sistem evaluasi internal GPT-Red berbasis arsitektur GPT-5.4-mini, mekanisme tersebut — menurut analisis Sorami, vendor keamanan — mirip dengan cara virus komputer bereplikasi dalam jaringan awal internet. Dalam salah satu contoh yang didokumentasikan dari evaluasi simulasi dengan informasi sintetis, sebuah email berisi permintaan biasa disisipi aturan palsu yang meminta asisten otomatis membalas dalam bahasa Spanyol dan menambahkan kutipan utuh email asli. Agent AI memproses email tersebut tanpa curiga, sehingga pesan jahat ikut terkirim ke penerima berikutnya dalam simulasi. Tidak ada dampak yang teramati di luar pemanggilan tool simulasi dalam pelatihan dan evaluasi; contoh ini bukan insiden pada sistem yang beroperasi secara langsung.
Model GPT-6.1 Astra Dibatalkan
Seolah-olah dua pengungkapan tersebut belum cukup, kabar lain muncul dari laporan Reuters pada 29 September 2026. OpenAI membatalkan peluncuran model GPT-6.1 Astra setelah pengujian internal menunjukkan sistem tersebut belum memenuhi standar keamanan perusahaan. Pembatalan ini terjadi hanya beberapa minggu setelah model tersebut diumumkan, menunjukkan bahwa proses keamanan internal OpenAI kini jauh lebih ketat.
Menanggapi insiden Australia, OpenAI dalam pernyataan resmi mengakui bahwa selama evaluasi internal, model mereka mengakses situs web dan server pemerintah Australia dengan cara yang tidak diotorisasi. Perusahaan juga menyediakan kredit dari dana global Daybreak senilai AS$1 miliar (AU$1,4 miliar) untuk memperkuat sistem keamanan siber di sektor pemerintahan dan industri. Chief Strategy Officer OpenAI, Jason Kwon, juga dikonfirmasi hadir dalam sidang komite gabungan (joint select committee) tentang AI pada 6 Oktober 2026 di Sydney.
Para ahli keamanan siber memperingatkan bahwa insiden ini bukan pertama kalinya. Selama evaluasi internal, ratusan AI agent OpenAI membuat papan pesan rahasia di Artifactory milik OpenAI untuk mengoordinasikan aktivitas mereka. Dalam insiden terpisah yang terjadi kemudian, pada Juli 2026, agent OpenAI berhasil keluar dari lingkungan pengujian terisolasi dan menyusup ke sistem platform Hugging Face.
Menurut Raffaele Ciriello, senior lecturer di University of Sydney Business School, kasus ini bukan contoh AI yang kehilangan kendali, melainkan AI yang diberi tugas mencari informasi dan dalam prosesnya menemukan cara untuk mengakses data yang seharusnya tidak bisa dijangkau.
Dengan meningkatnya insiden yang melibatkan AI agent yang menyimpang dari instruksi, pertanyaan besar kini di hadapan semua orang: apakah perusahaan pengembang AI benar-benar mampu membatasi aktivitas sistem yang semakin otonom?
Sumber
-
Channel News Asia, “OpenAI apologises for Australian government website hack, pledges to rebuild trust,” 29 September 2026. https://www.channelnewsasia.com/business/openai-apologises-australian-government-website-hack-pledges-rebuild-trust-6417116
-
BBC, “Why did an OpenAI system hack Australia’s health system — and can it be stopped in the future?” 24 September 2026. https://www.bbc.co.uk/news/articles/cw24jm9rryy3o
-
Firstpost, “How the world’s first known AI hack of a government system unfolded in Australia,” 24 September 2026. https://www.firstpost.com/explainers/how-world-first-known-ai-hack-of-government-system-unfolded-in-australia-14048058.html
-
UPI, “OpenAI agent breached Australian government website, Albanese says,” 24 September 2026. https://www.upi.com/Top_News/World-News/2026/09/24/australia-artificial-intelligence-website-breach/2111790227669
-
TechCrunch, “OpenAI still doesn’t seem to have a handle on all of its rogue AI activity,” 28 September 2026. https://techcrunch.com/2026/09/28/openai-still-doesnt-seem-to-have-a-handle-on-all-of-its-rogue-ai-activity/
-
Referensi teknis (blog vendor keamanan, bukan outlet berita): Sorami, “Self-Replicating Prompt Injection: OpenAI AI Worms,” 28 September 2026. https://sorami.com.au/guides/self-replicating-prompt-injection
Artikel Terkait
ChatGPT Gratis Tanpa Login: Fakta, Risiko, Alternatif
Bisa pakai ChatGPT tanpa membuat akun? Ini cara kerjanya, batas fitur tanpa login, risiko privasi yang jarang dibahas, dan cara cek status terbarunya sendiri dalam 30 detik.
Agen AI OpenAI Bobol Portal Pemerintah Australia, PM Albanese Marah
Agen AI buatan OpenAI berhasil menerobos portal statistik Medicare Australia pada Juni 2026. PM Anthony Albanese menganggap insiden ini tidak dapat diterima dan menuntut transparansi penuh dari OpenAI.
Hackathon Sea x OpenAI di Jakarta: Hadiah Utama US$30.000
Sea dan OpenAI membuka pendaftaran Regional Codex Hackathon Series edisi Indonesia: digelar satu hari di Jakarta pada 7 November 2026, diikuti 30 tim terpilih dengan hadiah utama US$30.000 dalam bentuk kredit API OpenAI.