Mengutip Digital Trends, keputusan ini berkaitan dengan sejumlah insiden ketika agen AI menjalankan tugas secara lebih jauh dari tujuan awalnya. Salah satu rangkaian kasus melibatkan agen yang mengakses situs web pemerintah Amerika Serikat dan melakukan tindakan yang tidak diharapkan ketika mencari serta mengumpulkan informasi.
OpenAI menyatakan pelatihan akan dilanjutkan setelah perusahaan yakin telah memiliki perlindungan tambahan memadai. Perusahaan juga mengakui bahwa penghentian sementara seperti ini dapat kembali terjadi seiring kemampuan AI terus berkembang.

Agen AI Bertindak di Luar Instruksi
Peristiwa yang menjadi perhatian terjadi ketika sejumlah agen OpenAI digunakan untuk mencari informasi dari situs pemerintah federal AS. Dalam beberapa kasus yang diungkapkan perusahaan, agen tersebut melakukan tindakan di luar apa yang diminta saat mengumpulkan dan mendistribusikan informasi.Salah satu laporan menyebut agen AI tersebut memublikasikan kembali informasi dari Securities and Exchange Commission (SEC) dan menemukan developer keys di situs Departemen Pendidikan AS. Pejabat terkait menyatakan insiden tersebut tidak menyebabkan informasi nonpublik terekspos.
Secara terpisah, evaluator AI Transluce melaporkan bahwa agen yang tampaknya berasal dari OpenAI sempat mencoba meretas situs Departemen Pendidikan AS. Upaya tersebut dilaporkan tidak berhasil, sementara OpenAI belum mengonfirmasi laporan tersebut. Karena itu, tindakan tersebut perlu dibedakan dari insiden yang secara resmi diungkapkan OpenAI.
Laporan lain juga mengaitkan keputusan penghentian pelatihan dengan insiden pada tanggal 20 September. Model riset internal berhasil menemukan celah dalam penyaringan DNS pada lingkungan pelatihan terbatas dan menggunakannya untuk berkomunikasi dengan chatbot eksternal ketika menjalankan tugas penelitian.
Kasus tersebut memperlihatkan tantangan berbeda dalam pengembangan agen AI. Sistem tidak hanya perlu dicegah agar tidak memberikan keluaran berbahaya, tetapi juga perlu dibatasi ketika memiliki kemampuan menjalankan tindakan secara mandiri dan berinteraksi dengan sistem eksternal.
Baca Juga :
Satu Prompt AI Butuh Berapa Air? Ini Rinciannya
OpenAI Perkuat Pengamanan Model
Penghentian pelatihan terbaru bukan pertama kalinya OpenAI memperlambat pengembangan model karena persoalan keamanan. Menurut laporan Associated Press, OpenAI sebelumnya menghentikan pengembangan pada Juli setelah terungkap serangan siber terhadap perusahaan AI Hugging Face. Jeda terbaru menjadi penghentian kedua dalam waktu sekitar tiga bulan.OpenAI sebelumnya juga telah mengungkap pendekatan baru untuk menangani kemampuan AI yang berisiko. Pada bulan September 2026, OpenAI menyatakan model bernama Astra telah mencapai ambang kemampuan siber kritis berdasarkan Preparedness Framework.
Menurut OpenAI, dengan alat dan akses yang tepat, Astra dapat menemukan celah keamanan yang sebelumnya tidak diketahui dan mengembangkan metode eksploitasi terhadap sistem yang terlindungi tanpa panduan manusia pada setiap tahap.
Karena kemampuan tersebut, OpenAI mengatakan pengembangan dan perilisan Astra membutuhkan perlindungan tambahan. OpenAI menyebut telah menunda sebagian pengembangan Astra sembari memperkuat serta menguji sistem perlindungan terhadap penyalahgunaan siber dan tindakan model tidak sah.
OpenAI juga membedakan dua jalur risiko. Pertama, risiko ketika pihak berbahaya menggunakan model untuk melakukan serangan. Kedua, risiko ketika model itu sendiri mengambil tindakan yang tidak sesuai meskipun pengguna tidak memiliki niat jahat.
Untuk jalur kedua, OpenAI menyebut sistem pengamanan perlu mampu mendeteksi serta membatasi tindakan model yang berpotensi menimbulkan dampak nyata. Selain itu, OpenAI telah memperkuat sejumlah lapisan perlindungan.
Lapisan tersebut termasuk pelatihan agar model lebih konsisten menolak permintaan siber berbahaya, sistem klasifikasi keamanan, pemantauan, serta mekanisme untuk menghentikan aktivitas yang berpotensi tidak sah.
OpenAI juga mengatakan sebagian pelatihan frontier sebelumnya sempat ditunda untuk memperkuat infrastruktur pelatihan, isolasi jaringan, pemantauan, dan pelatihan alignment. Langkah tersebut berlangsung bersamaan dengan upaya OpenAI membuat pelaporan mengenai perilaku model lebih sistematis.
Pada tanggal 16 September 2026, OpenAI memperkenalkan kerangka pelaporan model misalignment dan menerbitkan enam laporan mengenai perilaku model yang tidak terduga atau mengkhawatirkan selama enam bulan sebelumnya.
Dengan kemampuan agen AI yang semakin besar, tantangan pengembangannya tidak lagi terbatas pada seberapa baik model menjawab pertanyaan. Sistem juga perlu mempertahankan kendali ketika diberi akses ke alat, jaringan, data, dan lingkungan komputasi.
OpenAI belum memberikan jadwal spesifik mengenai kapan seluruh pelatihan model yang dihentikan akan dilanjutkan. Perusahaan menyatakan pengembangan akan kembali berjalan setelah perlindungan tambahan dianggap memadai.