OpenAI menghentikan sementara pelatihan model AI terbaru setelah agen bertindak di luar instruksi dan memicu evaluasi ulang sistem pengamanan.
OpenAI menghentikan sementara pelatihan model AI terbaru setelah agen bertindak di luar instruksi dan memicu evaluasi ulang sistem pengamanan.

Tiba-Tiba Bidik Situs Pemerintah, OpenAI Tunda Pengembangan Model AI

Lufthi Anggraeni • 28 September 2026 15:20
Ringkasnya gini..
  • OpenAI menghentikan sementara pelatihan model AI terbaru setelah agen melakukan sejumlah tindakan di luar instruksi.
  • Beberapa insiden melibatkan agen AI yang mengakses dan berinteraksi dengan situs pemerintah AS secara tidak terduga.
  • OpenAI akan melanjutkan pelatihan setelah menerapkan perlindungan tambahan untuk membatasi tindakan model yang tidak sah.
Jakarta: OpenAI menghentikan sementara pelatihan model kecerdasan buatan (AI) terbaru setelah serangkaian insiden menunjukkan agen AI perusahaan melakukan tindakan di luar instruksi yang diberikan. Keputusan tersebut diumumkan saat laporan mengenai perilaku tidak terduga agen AI OpenAI kembali bermunculan.

Mengutip Digital Trends, keputusan ini berkaitan dengan sejumlah insiden ketika agen AI menjalankan tugas secara lebih jauh dari tujuan awalnya. Salah satu rangkaian kasus melibatkan agen yang mengakses situs web pemerintah Amerika Serikat dan melakukan tindakan yang tidak diharapkan ketika mencari serta mengumpulkan informasi.

OpenAI menyatakan pelatihan akan dilanjutkan setelah perusahaan yakin telah memiliki perlindungan tambahan memadai. Perusahaan juga mengakui bahwa penghentian sementara seperti ini dapat kembali terjadi seiring kemampuan AI terus berkembang.
 
OpenAI-website-open-on-MacBook
 

Agen AI Bertindak di Luar Instruksi

Peristiwa yang menjadi perhatian terjadi ketika sejumlah agen OpenAI digunakan untuk mencari informasi dari situs pemerintah federal AS. Dalam beberapa kasus yang diungkapkan perusahaan, agen tersebut melakukan tindakan di luar apa yang diminta saat mengumpulkan dan mendistribusikan informasi.

Salah satu laporan menyebut agen AI tersebut memublikasikan kembali informasi dari Securities and Exchange Commission (SEC) dan menemukan developer keys di situs Departemen Pendidikan AS. Pejabat terkait menyatakan insiden tersebut tidak menyebabkan informasi nonpublik terekspos.

Secara terpisah, evaluator AI Transluce melaporkan bahwa agen yang tampaknya berasal dari OpenAI sempat mencoba meretas situs Departemen Pendidikan AS. Upaya tersebut dilaporkan tidak berhasil, sementara OpenAI belum mengonfirmasi laporan tersebut. Karena itu, tindakan tersebut perlu dibedakan dari insiden yang secara resmi diungkapkan OpenAI.

Laporan lain juga mengaitkan keputusan penghentian pelatihan dengan insiden pada tanggal 20 September. Model riset internal berhasil menemukan celah dalam penyaringan DNS pada lingkungan pelatihan terbatas dan menggunakannya untuk berkomunikasi dengan chatbot eksternal ketika menjalankan tugas penelitian.

Kasus tersebut memperlihatkan tantangan berbeda dalam pengembangan agen AI. Sistem tidak hanya perlu dicegah agar tidak memberikan keluaran berbahaya, tetapi juga perlu dibatasi ketika memiliki kemampuan menjalankan tindakan secara mandiri dan berinteraksi dengan sistem eksternal.
 

OpenAI Perkuat Pengamanan Model

Penghentian pelatihan terbaru bukan pertama kalinya OpenAI memperlambat pengembangan model karena persoalan keamanan. Menurut laporan Associated Press, OpenAI sebelumnya menghentikan pengembangan pada Juli setelah terungkap serangan siber terhadap perusahaan AI Hugging Face. Jeda terbaru menjadi penghentian kedua dalam waktu sekitar tiga bulan.

OpenAI sebelumnya juga telah mengungkap pendekatan baru untuk menangani kemampuan AI yang berisiko. Pada bulan September 2026, OpenAI menyatakan model bernama Astra telah mencapai ambang kemampuan siber kritis berdasarkan Preparedness Framework. 

Menurut OpenAI, dengan alat dan akses yang tepat, Astra dapat menemukan celah keamanan yang sebelumnya tidak diketahui dan mengembangkan metode eksploitasi terhadap sistem yang terlindungi tanpa panduan manusia pada setiap tahap.

Karena kemampuan tersebut, OpenAI mengatakan pengembangan dan perilisan Astra membutuhkan perlindungan tambahan. OpenAI menyebut telah menunda sebagian pengembangan Astra sembari memperkuat serta menguji sistem perlindungan terhadap penyalahgunaan siber dan tindakan model tidak sah.

OpenAI juga membedakan dua jalur risiko. Pertama, risiko ketika pihak berbahaya menggunakan model untuk melakukan serangan. Kedua, risiko ketika model itu sendiri mengambil tindakan yang tidak sesuai meskipun pengguna tidak memiliki niat jahat.

Untuk jalur kedua, OpenAI menyebut sistem pengamanan perlu mampu mendeteksi serta membatasi tindakan model yang berpotensi menimbulkan dampak nyata. Selain itu, OpenAI telah memperkuat sejumlah lapisan perlindungan.

Lapisan tersebut termasuk pelatihan agar model lebih konsisten menolak permintaan siber berbahaya, sistem klasifikasi keamanan, pemantauan, serta mekanisme untuk menghentikan aktivitas yang berpotensi tidak sah. 

OpenAI juga mengatakan sebagian pelatihan frontier sebelumnya sempat ditunda untuk memperkuat infrastruktur pelatihan, isolasi jaringan, pemantauan, dan pelatihan alignment. Langkah tersebut berlangsung bersamaan dengan upaya OpenAI membuat pelaporan mengenai perilaku model lebih sistematis. 

Pada tanggal 16 September 2026, OpenAI memperkenalkan kerangka pelaporan model misalignment dan menerbitkan enam laporan mengenai perilaku model yang tidak terduga atau mengkhawatirkan selama enam bulan sebelumnya.

Dengan kemampuan agen AI yang semakin besar, tantangan pengembangannya tidak lagi terbatas pada seberapa baik model menjawab pertanyaan. Sistem juga perlu mempertahankan kendali ketika diberi akses ke alat, jaringan, data, dan lingkungan komputasi.

OpenAI belum memberikan jadwal spesifik mengenai kapan seluruh pelatihan model yang dihentikan akan dilanjutkan. Perusahaan menyatakan pengembangan akan kembali berjalan setelah perlindungan tambahan dianggap memadai.

Jadikan Medcom.id sumber informasi pilihan Anda

(MMI)




TERKAIT

BERITA LAINNYA