YTL AI Labs hari ini mengumumkan pelancaran Nemotron-Personas-Malaysia, sebuah set data terbuka yang dibangunkan dengan kerjasama NVIDIA bagi mencerminkan kepelbagaian rakyat Malaysia menerusi 1.35 juta persona sintetik.
Set data ini menggunakan sumber rasmi seperti Jabatan Perangkaan Malaysia, OpenDOSM, MyCensus dan eStatistik, mewakili kumpulan etnik utama termasuk Melayu, Cina, India, Kadazan-Dusun, Bajau, Murut, Iban, Bidayuh dan Melanau.
Dengan memperluas 150,000 rekod asas kepada 1.35 juta persona, ia merangkumi demografi, pekerjaan dan personaliti berdasarkan model OCEAN, memastikan AI mencerminkan realiti sosial Malaysia dengan lebih tepat dan inklusif.
Menariknya, set data ini merupakan yang pertama menampilkan Bahasa Melayu sebagai bahasa utama.
Set data ini menghimpunkan profil demografi yang merangkumi pelbagai kaum, agama, wilayah, dan pekerjaan tanpa melibatkan sebarang data peribadi individu sebenar.
Setiap persona merangkumi 39 medan maklumat, termasuk umur, jantina, pekerjaan, serta sifat personaliti berasaskan model psikologi OCEAN.
Ketua Pegawai Eksekutif YTL AI Labs, Foong Chee Mun, menegaskan bahawa generasi AI masa hadapan bukan sekadar ditentukan oleh saiz model, tetapi sejauh mana teknologi tersebut memahami konteks tempatan dan masyarakat yang dilayaninya.
Inisiatif ini melengkapi portfolio teknologi AI berdaulat YTL, termasuk siri model ILMU dan infrastruktur YTL AI Cloud.
Set data Nemotron-Personas-Malaysia ini boleh diakses secara terbuka di platform Hugging Face.
{suggest}
