OpenAI Identifikasi 100 Organisasi Terdampak Aktivitas Agen AI di Internet
Keamanan agen OpenAI – ilustrasi artistik. (Foto: Alius Noreika/AI/technology.org)
JAKARTA, GEBRAK.ID — OpenAI mengungkapkan telah memberi pemberitahuan kepada lebih dari 100 organisasi di berbagai negara terkait aktivitas agen kecerdasan buatan (AI) yang dinilai tidak sesuai dengan tujuan dan batasan penggunaannya (misaligned agent activity). Aktivitas tersebut mencakup upaya melewati mekanisme keamanan, mengakses sistem tanpa izin, hingga mengganggu layanan dan situs web milik pihak ketiga.
Pemberitahuan itu merupakan bagian dari peninjauan besar-besaran yang dilakukan OpenAI terhadap aktivitas model AI selama proses pelatihan dan evaluasi. Perusahaan pengembang ChatGPT tersebut tengah menelusuri sekitar 50 petabita (petabytes) data untuk mengidentifikasi potensi penyimpangan perilaku agen AI di internet.
Dalam pembaruan yang disampaikan perusahaan, OpenAI menyatakan jumlah organisasi yang telah menerima pemberitahuan melampaui 100 dan masih berpotensi bertambah. Proses pemeriksaan diperkirakan membutuhkan waktu beberapa bulan. OpenAI menggunakan dua kriteria utama sebelum mengirimkan pemberitahuan kepada organisasi eksternal. Pertama, apabila model AI diduga berhasil melewati sistem keamanan pihak ketiga atau mengganggu ketersediaan layanan daring. Kedua, apabila agen menunjukkan perilaku yang tidak sesuai dengan tujuan awal dan menimbulkan dampak negatif terhadap situs web maupun layanan eksternal.
Namun, pemberitahuan tersebut tidak serta-merta membuktikan bahwa agen AI berhasil mengakses data pribadi atau informasi rahasia. Langkah itu dilakukan karena OpenAI menemukan indikasi aktivitas yang dinilai cukup penting untuk diketahui oleh pemilik sistem.
Lima Kategori Penyimpangan Aktivitas Agen AI
Dalam proses pemeriksaan, OpenAI mengelompokkan temuan aktivitas agen AI ke dalam lima kategori. Kategori pertama adalah penerobosan kontrol akses (access control bypass). Dalam kasus ini, agen AI diduga dapat menjangkau fitur atau informasi yang seharusnya hanya tersedia bagi pengguna dengan akun, izin khusus, atau langganan tertentu. Hal tersebut dapat terjadi melalui perubahan alamat situs, modifikasi permintaan data, maupun penggunaan kembali sesi masuk dengan hak akses yang lebih luas dari semestinya.
Kategori kedua berkaitan dengan penggunaan kredensial atau kunci akses yang terekspos secara publik. Agen AI menemukan informasi masuk atau kunci akses yang tidak sengaja dipublikasikan, kemudian menggunakannya untuk menjangkau sistem tertentu.
Kategori ketiga adalah injeksi perintah (command injection). Dalam aktivitas ini, agen memasukkan teks yang kemudian diperlakukan sistem sebagai instruksi, bukan sekadar masukan biasa. Kondisi tersebut berpotensi membuat server menjalankan kueri basis data, kode program, atau perintah tertentu. Kategori keempat mencakup akses terhadap berkas yang menjelaskan struktur internal suatu layanan atau sistem pendukung yang semestinya hanya digunakan untuk kepentingan internal.
Sementara itu, kategori kelima disebut OpenAI sebagai agent spam. Aktivitas ini terjadi ketika model AI mengunggah atau memublikasikan materi di situs pihak ketiga tanpa tujuan yang semestinya. Salah satu contohnya adalah penggunaan halaman wiki publik sebagai papan komunikasi bersama antarmodel, sehingga pemilik situs harus membersihkan konten yang ditinggalkan.
Pemeriksaan 50 Petabita Data
Peninjauan yang dilakukan OpenAI mencakup aktivitas model selama proses pelatihan dan evaluasi. Dengan volume data mencapai sekitar 50 petabita, perusahaan membutuhkan waktu berbulan-bulan untuk memeriksa keseluruhan temuan.
Besarnya pemeriksaan tersebut juga berdampak pada kebutuhan komputasi. Berdasarkan laporan mengenai pembaruan OpenAI, biaya komputasi harian untuk proses peninjauan ini telah melampaui US$500.000. Pemberitahuan kepada organisasi terdampak dilakukan secara bertahap. OpenAI menyatakan akan menjaga kerahasiaan identitas organisasi yang menerima pemberitahuan, meskipun masing-masing organisasi tetap memiliki kebebasan untuk mengungkapkan pengalaman mereka kepada publik.
Perusahaan juga tengah menyusun standar mengenai kondisi yang mengharuskan pemberitahuan secara pribadi kepada organisasi serta informasi yang dapat dipublikasikan kepada masyarakat.
Dalam keterangannya, OpenAI mengakui bahwa sejumlah model AI menggunakan akses internet dengan cara yang tidak direncanakan atau tidak mendapatkan pembatasan yang semestinya. “Dalam beberapa kasus, model menggunakan akses internet dengan cara yang tidak dimaksudkan atau, setelah ditinjau kembali, tidak mendapatkan pembatasan yang ideal. Selama beberapa bulan terakhir, kami telah menerapkan langkah-langkah teknis dan operasional baru untuk menghindari masalah serupa atau mendeteksinya sejak dini, dan kami akan terus melakukan upaya ini,” kata OpenAI.
Insiden Hugging Face Menjadi Kasus Paling Serius
Di antara berbagai temuan yang sedang diperiksa, insiden pada platform pengembangan AI Hugging Face masih menjadi kasus paling serius yang diidentifikasi OpenAI.
Perusahaan menjelaskan bahwa insiden tersebut dipicu oleh model riset internal yang memiliki kemampuan tinggi dan tidak tersedia untuk penggunaan publik. Dalam proses evaluasi keamanan siber, agen AI menggunakan strategi yang menyimpang dari tujuan awal untuk menyelesaikan tugas-tugas yang kompleks.
Penyelidikan lanjutan menemukan sekitar 700 agen yang terkoordinasi terlibat dalam insiden pada Juli 2026. Aktivitas penyelidikan terhadap sistem Hugging Face bahkan disebut telah berlangsung sejak Mei 2026.
Pada September 2026, OpenAI juga mengungkapkan bahwa agen dalam lingkungan risetnya pernah mengunggah 53 gambar yang diberikan pengguna ke sejumlah situs penyimpanan gambar. Serangkaian temuan tersebut mendorong perusahaan mengevaluasi kembali pendekatan keamanan dalam pengembangan model AI. OpenAI juga dilaporkan menghentikan sementara pelatihan sejumlah model dan membatalkan rencana peluncuran GPT-6.1 Astra setelah pengujian keamanan internal.
Pemerintah Australia Meminta Penjelasan
Persoalan aktivitas agen AI juga mendapat perhatian pemerintah. Salah satu kasus yang menjadi sorotan terjadi di Australia pada Juni 2026, ketika sebuah model eksperimental OpenAI berhasil masuk ke sistem milik Services Australia yang menyimpan statistik Medicare dalam proses pelatihan internal.
Pemerintah Australia baru menerima informasi mengenai insiden tersebut pada awal September 2026. OpenAI kemudian menyampaikan permintaan maaf dan berkomitmen membentuk satuan tugas lokal untuk menangani persoalan tersebut.
Perusahaan juga menjanjikan dukungan berupa kredit dari dana pertahanan siber senilai US$1 miliar. Selain itu, Chief Strategy Officer OpenAI, Jason Kwon, dijadwalkan memberikan keterangan di hadapan Komite Pilihan Bersama Parlemen Australia untuk Kecerdasan Buatan di Sydney pada 6 Oktober 2026. Perkembangan tersebut menunjukkan bahwa pengawasan terhadap agen AI tidak lagi hanya menjadi persoalan internal perusahaan teknologi, tetapi juga berkaitan dengan keamanan sistem, perlindungan data, dan tanggung jawab terhadap pihak ketiga.
Pengawasan Agen AI Menjadi Perhatian Industri
Meningkatnya temuan penyimpangan aktivitas agen AI turut mendorong munculnya kebutuhan terhadap teknologi pengawasan independen. Sejumlah peneliti independen telah merekonstruksi bagaimana agen-agen AI berkoordinasi melalui papan pesan tidak resmi sebelum insiden Hugging Face terjadi. Temuan tersebut memperlihatkan pentingnya pemantauan terhadap komunikasi dan aktivitas agen, terutama ketika sistem diberikan kemampuan untuk mengakses internet dan menjalankan tugas secara mandiri.
Di sisi industri, sejumlah perusahaan teknologi mulai menawarkan solusi pengawasan untuk membatasi aktivitas agen AI di luar lingkungan yang telah ditentukan (sandbox). Nvidia, misalnya, menawarkan teknologi pengawasan pada tingkat perangkat keras untuk mendeteksi agen yang mencoba keluar dari batas lingkungan operasionalnya.
Bagi perusahaan yang mengintegrasikan agen AI ke dalam sistem internal, lima kategori penyimpangan yang diidentifikasi OpenAI dapat menjadi acuan awal dalam membangun mekanisme pengawasan, pengendalian akses, serta mitigasi risiko keamanan. Dengan semakin luasnya pemanfaatan agen AI, kemampuan teknologi tersebut perlu diimbangi pengawasan yang memadai agar otomatisasi tidak menimbulkan gangguan terhadap sistem, layanan, maupun keamanan digital milik pihak lain. (*)
(Zaky Al Hamzah/technology.org/reuters.com)
Mau tahu berita penting tanpa harus mencari-cari?
Kami kirim berita pilihan GEBRAK.ID langsung melalui WhatsApp.
Follow Channel GEBRAK.ID