Menu
WISER.MY
  • Pergi ke Wiser.my
  • Berita
  • Ulasan
  • Trivia
  • Tips Gajet
  • Promosi
  • Youtube
  • Hubungi Kami
WISER.MY

Model AI Makin Kerap ‘Hack’ Sistem Ketika Ujian – Antara Realiti, ‘Humble Brag’ Atau Kedua-Duanya

Posted on Ogos 7, 2026Ogos 7, 2026

Dalam tempoh beberapa minggu kebelakangan ini, tiga syarikat AI utama iaitu OpenAI, Anthropic dan Meta masing-masing mendedahkan insiden berasingan melibatkan model AI mereka ketika menjalani ujian keselamatan siber.

Walaupun bentuk penilaian yang dijalankan berbeza mengikut syarikat, ketiga-tiganya berkongsi satu persamaan, iaitu model AI menunjukkan keupayaan yang melebihi jangkaan dalam persekitaran ujian yang dikawal.

OpenAI sebelum ini mendedahkan model AI mereka berjaya mengeksploitasi kelemahan pada platform Hugging Face ketika penilaian keupayaan siber. Anthropic pula melaporkan tiga insiden berasingan melibatkan model Claude yang memperoleh akses kepada sistem sebenar ketika penilaian keselamatan dijalankan.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

Terbaharu, Meta mengesahkan model AI miliknya mengeksploitasi kelemahan pada sistem pihak ketiga ketika diuji oleh firma keselamatan bebas, Irregular, susulan konfigurasi ujian yang tidak disengajakan.

Bagi syarikat AI, pendedahan seperti ini merupakan sebahagian daripada usaha meningkatkan ketelusan mengenai keupayaan serta risiko model masing-masing sebelum digunakan secara lebih meluas.

Dalam beberapa tahun kebelakangan ini, penerbitan system card, laporan penilaian keselamatan dan rangka kerja keselamatan AI juga semakin menjadi amalan dalam kalangan pembangun model AI termaju.

Keupayaan AI kini diukur dengan cara yang berbeza

Namun di sebalik tujuan tersebut, trend ini turut menimbulkan satu persoalan. Mengapa syarikat AI kini semakin kerap berkongsi kisah model mereka berjaya mengeksploitasi sistem ketika ujian keselamatan?

Salah satu sebabnya ialah ukuran terhadap keupayaan AI juga semakin berubah. Jika sebelum ini perhatian banyak tertumpu kepada skor penanda aras seperti matematik, penaakulan dan pengekodan, kini penilaian terhadap model AI juga semakin memberi tumpuan kepada keupayaan melaksanakan tugasan dunia sebenar, termasuk aspek autonomi dan keselamatan siber.

Ini termasuk kebolehan menggunakan pelbagai alat, merancang tindakan, mengenal pasti kelemahan sistem, mengeksploitasi kelemahan yang ditemui serta menyelesaikan tugasan yang kompleks.

Keupayaan seperti ini juga semakin mendapat perhatian dalam penilaian model AI frontier, termasuk dalam aspek keupayaan siber dan autonomi yang dibincangkan dalam Frontier AI Trends Report oleh UK AI Security Institute. Justeru, penilaian keselamatan hari ini bukan lagi sekadar mengukur ketepatan jawapan model, tetapi juga bagaimana model bertindak apabila diberikan autonomi yang lebih tinggi.

Ada yang melihat sebagai ‘humble brag’

Pada masa yang sama, trend ini turut membuka ruang kepada satu tafsiran lain.

Di platform seperti X dan forum teknologi, sesetengah pemerhati berpendapat laporan sedemikian bukan sekadar mengenai keselamatan AI, malah secara tidak langsung boleh dilihat sebagai satu bentuk ‘humble brag’.

Dalam konteks ini, ada mentafsirkan ia seolah-olah memberikan mesej, “Model kami kini cukup berkeupayaan sehingga mampu mengeksploitasi sistem ketika ujian”.

Sudah tentu, OpenAI, Anthropic atau Meta tidak pernah membuat dakwaan sedemikian secara langsung. Namun, apabila laporan mengenai model AI yang berjaya mencari kelemahan sistem, memintas halangan atau bertindak secara autonomi semakin kerap diterbitkan, persepsi sedemikian boleh timbul dalam kalangan pembaca.

Mengapa pendedahan seperti ini tetap penting?

Walaupun begitu, pendedahan seperti ini mempunyai tujuan yang lebih besar daripada sekadar berkongsi insiden melibatkan model AI.

Sebagai contoh, OpenAI menjelaskan penemuan awal berkaitan insiden Hugging Face dikongsikan bagi membantu komuniti keselamatan memahami apa yang berlaku serta menilai tahap keupayaan semasa model AI. Anthropic pula menerbitkan laporan yang menghuraikan bagaimana setiap insiden berlaku, faktor yang menyumbang kepada kejadian tersebut serta langkah yang diambil untuk mengurangkan risiko yang sama pada masa hadapan.

Selain itu, kebanyakan insiden yang diumumkan juga berlaku dalam persekitaran ujian yang dikawal seperti red teaming, penilaian keupayaan siber atau keselamatan. Dalam banyak keadaan, model sengaja diberikan autonomi yang lebih tinggi atau beroperasi dengan sebahagian kawalan yang dilonggarkan bagi membolehkan penyelidik menilai had sebenar keupayaannya. Keadaan ini jauh berbeza daripada pengalaman pengguna biasa yang menggunakan chatbot AI untuk tugasan harian.

Secara tidak langsung, pendedahan mengenai hasil penilaian seperti ini membantu komuniti keselamatan memahami keupayaan model AI semasa serta mengenal pasti risiko yang perlu ditangani sebelum teknologi tersebut digunakan dengan lebih meluas.

Jadi, realiti, ‘humble brag’ atau kedua-duanya?

Sukar untuk menyimpulkan bahawa OpenAI, Anthropic, Meta atau mana-mana syarikat AI menerbitkan laporan keselamatan semata-mata sebagai strategi pemasaran. Sebaliknya, kebanyakan laporan tersebut diterbitkan sebagai sebahagian daripada usaha meningkatkan ketelusan mengenai keupayaan dan risiko model AI.

Pada masa yang sama, sukar juga untuk menafikan bahawa setiap pendedahan mengenai keupayaan luar biasa model AI secara tidak langsung turut mengukuhkan imej syarikat sebagai antara peneraju teknologi tersebut.

Dalam erti kata lain, kedua-dua perkara ini boleh berlaku serentak.

Mungkin itulah realiti perlumbaan AI hari ini. Ketelusan mengenai risiko model sememangnya penting untuk membantu penyelidik membina sistem AI yang lebih selamat. Namun, setiap laporan keselamatan yang mendedahkan keupayaan baharu model juga berpotensi meningkatkan reputasi syarikat yang membangunkannya.

Kesimpulannya, sama ada ia dianggap sebagai langkah ketelusan atau sekadar humble brag, tafsiran mungkin bergantung kepada sudut pandang masing-masing.

{suggest}

Cari Artikel

Buka artikel ini di Wiser.my
BUKA
©2026 WISER.MY | Powered by SuperbThemes & WordPress