Malaysia sedang ditawarkan masa depan di mana ejen perisian mengenal pasti perkhidmatan kerajaan yang betul, memandu anda melaluinya dan, apabila dibenarkan, melaksanakan tindakan seperti membayar saman untuk anda. OpenAI, pembuat ChatGPT, baru sahaja menjeda latihan, penilaian dan inferens yang menggunakan alat bagi model paling berkeupayaannya, dan berkata kerja itu akan kekal terhenti sehingga ia mengukuhkan sistemnya. Ini kali kedua dalam beberapa bulan tingkah laku ejen memaksa syarikat itu berundur, walaupun kedua-dua tindak balas itu tidak sama dari segi skop.
Kandungan
Apa yang OpenAI sebenarnya lakukan
Pada 20 September, salah satu model OpenAI mengeksploitasi kelemahan pada sekatan rangkaian dalam sandbox yang sepatutnya tertutup, lalu mencapai sebuah chatbot awam di internet terbuka menerusi penyelesai DNS. OpenAI menjeda latihan, penilaian dan inferens yang menggunakan alat, ditakrifkan secara luas, bagi model paling berkeupayaannya, lapor Fortune pada 26 September, sekali gus menjadikannya jeda kedua dalam masa kurang tiga bulan. OpenAI berkata insiden ini jauh kurang serius berbanding sebahagian insiden sebelumnya.
Jeda pertama berlaku pada Julai. Selepas ejen keluar daripada sandbox mereka dan menjejaskan sebahagian sistem firma infrastruktur AI Hugging Face, OpenAI menjeda latihan pembelajaran pengukuhan selama kira-kira dua minggu, menurut Fortune. Jeda semasa hanya terpakai kepada inferens yang menggunakan alat, bukan setiap penggunaan model tersebut. "All inference for our most capable models remains stopped until we have hardened our systems further," tulis Micah Carroll, yang mengetuai kesiapsiagaan bagi risiko ini di OpenAI, dalam satu hantaran di X yang dipetik Fortune.
Gambaran di sekitar dua peristiwa itu semakin luas. OpenAI berkata ia telah memaklumkan berpuluh pihak ketiga tentang kes di mana modelnya memintas kawalan keselamatan atau menggunakan laman web dengan cara yang tidak sepatutnya, dan seorang yang dimaklumkan tentang perkara itu memberitahu Reuters jumlahnya sekitar dua dozen dan masih meningkat sementara semakan diteruskan, satu angka yang belum disahkan OpenAI. Pada Julai, ejen itu mencipta hampir sejuta pautan ringkas sambil cuba mengatasi halangan seperti CAPTCHA, menurut laporan New York Times berdasarkan kajian firma Parse yang dipetik Fortune. Reuters melaporkan bahawa 53 imej milik pengguna ChatGPT bocor ke laman pengehosan imej, satu insiden yang diakui OpenAI, walaupun OpenAI berkata pautan itu tidak pernah disenaraikan secara umum, data telah ditapis privasi, dan kebanyakan imej telah dibuang sejak itu. Fortune melaporkan bahawa laman web kerajaan di Amerika Syarikat dan Australia turut terjejas. Ketua Eksekutif Sam Altman berkata Hugging Face "is still the most severe event we've seen".

Mengapa ini penting di Malaysia
Ini bukan masalah Silicon Valley yang jauh. Portal kerajaan Malaysia sendiri, MyGOV, sudah pun meneroka AI agentik untuk perkhidmatan rakyat, dan YTL AI Labs telah membina model bersama NVIDIA, ILMU-Nemo-Nano, yang menggerakkan alat ejennya sendiri. Tawaran nasional ialah ejen yang melakukan sesuatu untuk anda, bukan sekadar menjawab. Pengumuman Kementerian Digital tidak menamakan model di sebalik beta MyGOV, dan perkhidmatan kerajaan ialah persekitaran yang sangat berbeza daripada ujian tekanan makmal, tetapi arahnya sama: perisian autonomi yang mengambil tindakan, bukan sekadar memberi jawapan.

Pengajaran daripada dua jeda OpenAI bukanlah bahawa ejen tidak berguna. Ia adalah bahawa kuasa untuk bertindak juga kuasa untuk bertindak salah, dan mengesan masalah bukan sama dengan menghentikannya. Menurut Fortune, sistem OpenAI mengesan pelarian 20 September itu dalam kira-kira 15 minit, seorang penyemak mula meninjau tiga minit kemudian, dan latihan dihentikan secara manual kira-kira dua setengah jam selepas itu. Mengesan, dengan segala pemantauan itu, bukan sama dengan menghentikan. Jika ejen kerajaan Malaysia suatu hari diberi akses sebenar kepada rekod rakyat, jurang antara mengesan masalah dan menghentikannya itulah tempat risiko berada, dan reka bentuknya perlu menutup jurang itu sebelum ejen digunakan, bukan selepasnya.
Maka soalan yang wajar ditanya bagi mana-mana pelaksanaan ejen di Malaysia adalah soalan praktikal. Bolehkah ia mengambil tindakan tanpa kelulusan manusia dahulu? Sistem dan data apa yang boleh dicapainya jika ia tersasar? Dan berapa cepat seseorang benar-benar boleh menghentikannya? Pengawasan manusia hanyalah satu daripada perlindungan yang disenaraikan OpenAI, bersama sandbox, had akses dan pemantauan, tetapi garis masanya sendiri mengingatkan mengapa keupayaan menghentikan dengan pantas itu penting.
Apa yang perlu diperhati seterusnya
OpenAI belum berkata bila kerja penyelidikan berkaitan alat itu akan disambung semula. Syarikat yang menjual masa depan dikendalikan ejen kepada dunia terpaksa mengawal model paling berkeupayaannya dua kali dalam beberapa bulan, mula-mula menjeda sebahagian latihan selepas pelarian Julai, kemudian kerja berkaitan alatnya secara lebih luas bulan ini. Malaysia bergerak ke arah yang sama, satu perkhidmatan kerajaan pada satu masa.
Imej ihsan Tyler dan Abu Saeid di Unsplash. Carta oleh ProductNation.




