Sejarah Penyusunan Kamus Dewan Perdana
Perancangan Penyusunan Kamus Dewan Perdana
Sewaktu Kamus Dewan Perdana dirancang penyusunannya pada tahun 1990, Dewan Bahasa dan Pustaka (DBP) sedang berunding dengan pihak Universiti Sains Malaysia (USM) untuk membina Korpus DBP, Pangkalan Data Leksikon dan Sistem Penulisan Kamus yang dijangka akan mempermudah penyusunannya. Dengan andaian ketiga-tiga projek ini terlaksana dalam tempoh yang singkat, kamus ini disasarkan terbit pada tahun 2000. Walau bagaimanapun, disebabkan pelbagai kekangan dan kendala, hanya Korpus DBP yang dapat dilaksanakan. Saiznya pula, sehingga tahun 1998, cuma mencapai 26 juta kata berbanding dengan 200 juta kata yang diperlukan untuk penyusunan kamus ini. Dalam keadaan ini, yang mampu dilaksanakan ialah kerja-kerja asas seperti penyediaan sistem penyusunan, perakaman kata baharu pada kad bahan dan kajian struktur entri dan subentri Kamus Dewan Edisi Ketiga.
Sementara menunggu Korpus DBP mencapai saiz yang memadai untuk menghasilkan entri kata umum, beberapa strategi digunakan pada tahun 1998 untuk membina entri. Antaranya termasuklah bekerjasama dengan 82 informan untuk membina entri dialek dan bahasa serumpun. Selain itu, khidmat lebih daripada 45 orang pakar dimanfaatkan untuk menyemak, mengesahkan dan menambah entri pelbagai bidang ilmu. Pendrafan dan pengeditan kata umum dilaksanakan dari tahun 2000 hingga 2017.
Penggunaan Korpus dalam Penyusunan Kamus Dewan Perdana
Pada penghujung tahun 1980-an, penggunaan komputer dalam penyusunan kamus di DBP hanya sebagai alat perakaman dan penyimpanan data. Pada masa itu, dunia leksikografi Barat telah pun membina pangkalan data berkomputer yang dapat dimanipulasikan oleh penyusun kamus untuk mencapai dan menganalisis data, serta mendraf dan mengedit entri kamus.
Bagi memastikan perkamusan Melayu seiring dengan perkembangan di Barat ini, DBP dengan kerjasama USM telah membangunkan Korpus DBP yang termuat data mentah daripada pelbagai sumber bercetak. Himpunan data ini penting bagi penyusun kamus untuk mendapatkan gambaran penggunaan sebenar penutur asli bahasa Melayu.
Pemasukan data ke dalam sistem bermula pada pertengahan tahun 1990-an dan bertambah dari tahun ke tahun dan sehingga tahun 2018 berjumlah lebih daripada 113 juta. Walaupun jumlah ini kelihatan besar, namun bagi penyusunan kamus umum dan komprehensif, jumlah ini jauh daripada mencukupi. Oleh yang demikian, para penyusun terpaksa merujuk sumber data yang lain seperti web dan Malay Concordance Project (MCP).
Adam Kilgarriff dan Gregory Grefenstette dalam "Introduction to the Special Issue on the Web as Corpus" (Thierry Fontenelle ed. Practical Lexicography: A Reader, 2008: 89) pernah menyatakan bahawa: "The Web is immense, free, and available by mouse click. It contains hundreds of billions of words of text and can be used for all manner of language research."
Memang diakui bahawa web merupakan sumber data bahasa yang amat besar dan pelbagai serta berpotensi digunakan sebagai korpus. Dari satu segi, walaupun lombong data ini tidak ternilai kegunaannya tetapi dari segi yang lain, data dalam web menimbulkan beberapa isu, antaranya sama ada penyumbang data merupakan penutur asli bahasa Melayu atau tidak, kesahihan sumber data, kerancuan bahasa, serta pertindanan dan perulangan data. Oleh itu, penyusun kamus mengambil sikap berhati-hati dan membuat penilaian serta tapisan sebelum memilih data untuk dianalisis.
Selain web, para penyusun turut merujuk MCP terutamanya apabila menangani entri kata klasik. MCP yang mengandungi 165 teks Melayu lama dengan jumlah 5.8 juta kata dibangunkan oleh Australian National University dan boleh diakses secara percuma dalam talian. Antara teks yang ada dalam MCP termasuklah Hikayat Hang Tuah, Syair Bayan Budiman dan Misa Melayu.
Korpus DBP digunakan untuk mengoutput data kata carian bagi mendapatkan profil entri atau subentri yang ditangani untuk menentukan makna, pecahan makna, kelas kata, laras kata, bentuk terbitan, ayat contoh dan lain-lain.
Entri dan Subentri Baharu
Semasa menyediakan senarai entri Kamus Dewan Perdana, para penyusun menggunakan Kamus Dewan Edisi Keempat sebagai sumber utama. Senarai yang disediakan, walau bagaimanapun, perlu dilengkapkan selaras dengan kemunculan kata-kata baharu hasil kepesatan perkembangan ilmu dan keperluan komunikasi akibat perubahan dalam kehidupan. Kata baharu yang dijadikan entri dan subentri termasuklah kata umum, kata nama khas, istilah khusus, kata dialek, slanga, kata klasik dan lain-lain. Kata baharu dikumpulkan daripada pelbagai sumber seperti Korpus DBP, Pusat Rujukan Persuratan Melayu (PRPM), terbitan bercetak dan digital, laman sesawang kerajaan dan persendirian, media massa, media sosial, maklum balas pengguna melalui Gerbang Kata dan surat-menyurat serta informan dialek dan bahasa serumpun.
Bukti dalam Leksikografi
Sejak penyusunan Kamus Dewan lagi, bukti penggunaan kata penting dalam kerja perkamusan. Penyusun Kamus Dewan menggunakan bukti penggunaan dalam bentuk petikan yang tercatat pada tiga juta kad bahan untuk membina entri dan subentri kamus. Petikan ini diambil daripada pelbagai sumber yang dipilih dan merentasi pelbagai genre.
Dengan kemajuan bidang leksikografi, bukti penggunaan kini dihimpunkan dalam bentuk korpus berkomputer yang besar. Data korpus ini kemudiannya dimanipulasikan oleh penyusun kamus untuk pendeskripsian entri dan subentri yang lebih tepat dan menyeluruh. Kamus Dewan Perdana tidak ketinggalan dalam hal ini dengan memanfaatkan Korpus DBP yang sebahagian besar pembangunannya adalah untuk penyusunan kamus. Daripada Korpus DBP ini, konkordans dalam bentuk baris-baris yang mengandungi kata yang dicari dalam konteks, dapat dijana untuk dianalisis dan disintesiskan. Analisis inilah yang digunakan untuk mensahihkan kewujudan sesuatu entri atau subentri, mencari bentuk terbitan baharu, serta menentukan makna, penggunaan, kelas kata, laras dan lain-lain.
Maklumat Baharu
Sebagai kamus umum yang baharu, Kamus Dewan Perdana berusaha memberikan maklumat baharu bagi entri dan subentri yang dimuatkan. Maklumat tersebut ialah ejaan Jawi, transkripsi fonetik, kelas kata, maklumat etimologi dan takrif. Semua maklumat ini diperoleh melalui penganalisisan data, penelitian bahan rujukan dan penyelidikan pakar.
Ejaan Jawi melengkapi hampir semua entri dan subentri kecuali entri tertentu seperti singkatan, nama tokoh dan imbuhan. Ejaan Jawi disediakan berpandukan Pedoman Umum Ejaan Jawi Bahasa Melayu di dalam Daftar Kata Bahasa Melayu, Rumi-Sebutan-Jawi Edisi Kedua (2016), dan disisipkan selepas entri atau subentri.
Kesalahan menyebut sesuatu kata biasa terjadi dalam masyarakat, terutamanya bagi kata baharu dan kata yang dipinjam daripada bahasa lain. Sebagai langkah membimbing pengguna bahasa menyebut dengan betul, Kamus Dewan Perdana menyediakan maklumat sebutan dengan menggunakan lambang fonetik berasaskan abjad fonetik antarabangsa (IPA) SIL Manuscript. Untuk memudahkan pengguna, bunyi lambang fonetik diberikan pada bahagian awalan ini. Pada asasnya, maklumat sebutan yang diberikan dalam Kamus Dewan Perdana berdasarkan Pedoman Umum Sebutan Baku Bahasa Melayu yang terkandung dalam Daftar Kata Bahasa Melayu, Rumi-Sebutan-Jawi, Edisi Kedua (2008). Walau bagaimanapun, bagi beberapa entri yang kata dasarnya bermula dengan huruf vokal atau diftong yang menerima awalan meN- dan peN-, variasi sebutan lazim turut dimasukkan.
Pedoman utama bagi kelas kata ialah Tatabahasa Dewan Edisi Ketiga. Selain itu, buku-buku tatabahasa lain seperti Nahu Melayu Mutakhir (Asmah Haji Omar, 2009), Petunjuk Tatabahasa Bahasa Melayu (Mohd. Asraf Abdul Wahab, 2007) dan The Morphology of Malay (Abdullah Hassan, 2006) turut dirujuk.
Dalam Kamus Dewan Perdana, kelas kata terbahagi kepada kata nama, kata kerja, kata adjektif dan kata tugas. Sebahagian besar kata kerja dipecahkan kepada kata kerja transitif dan kata kerja tak transitif, manakala kata tugas pula dibahagikan kepada kata adverba, kata seru, kata hubung, kata sendi, kata bilangan, kata nafi, kata bantu, kata perintah, kata tanya, kata pangkal ayat, kata penegas, kata penekan, kata pembenar, kata pembenda, kata pemeri dan kata penguat.
Turut dinyatakan bentuk pasif bagi kata terbitan berimbuhan meN-, meN-...-i, meN-...-kan, mempeR-, mempeR-...-i dan mempeR-...-kan yang kelas katanya kata kerja transitif. Terdapat juga entri dan subentri yang mempunyai lebih daripada satu kelas kata. Penentuan kelas kata tersebut berdasarkan penggunaan kata dalam ayat-ayat yang terakam dalam konkordans yang dianalisis.
Satu lagi maklumat baharu dalam Kamus Dewan Perdana ialah maklumat etimologi yang julung kalinya dimasukkan dalam kamus yang diterbitkan oleh Dewan Bahasa dan Pustaka. Walaupun terdapat maklumat etimologi dalam Kamus Dewan tetapi hanya pada tingkat bahasa sumber sahaja. Dalam Kamus Dewan Perdana, maklumat etimologi diberikan oleh pakar etimologi bahasa Melayu, Prof. Dr. Nothofer dan Dr. Adelaar berasaskan dapatan kajian daripada tesis, esei, jurnal, kamus dan buku. Sekitar 7000 entri kata warisan dan kata pinjaman dalam kamus ini dilengkapkan dengan maklumat etimologi pada bahagian akhir entri.
Dalam Kamus Dewan Perdana juga, maklumat bahasa sumber sesuatu kata pinjaman yang diperoleh daripada Kamus Dewan Edisi Keempat berasaskan label seperti Ar (Arab), C (Cina), Ing (Inggeris), Jepun dan Tamil diletakkan pada bahagian akhir entri.
Bagi pekamus ekabahasa termasuklah penyusun Kamus Dewan Perdana, aspek yang paling penting ialah pemerian makna. Dalam hal ini, penyusun Kamus Dewan Perdana juga menyedari hakikat bahawa makna sesuatu kata atau pecahannya tidak mungkin dapat dihuraikan secara tepat dan tuntas disebabkan sempadan makna yang kabur, dan makna hanya terserlah apabila kata itu hadir dalam konteks. Pada masa yang sama, berlaku pertindanan antara makna kata dalam satu set leksikal dengan pecahan-pecahan makna sesuatu kata. Bagi menangani hal ini, penyusun Kamus Dewan Perdana berusaha sedaya upaya menjelaskan makna yang tipikal dan diketahui umum.
Kamus Dewan Perdana menggunakan dua strategi utama untuk menyediakan takrif, iaitu menghuraikan makna dalam bentuk frasa atau ayat penuh yang kadangkala melebihi satu ayat, dan memberikan sinonim atau frasa antonim yang terhampir. Huraian makna dalam bentuk ayat digunakan terutamanya bagi mentakrif entri flora, fauna, alat muzik, masakan, tokoh, negara dan sebagainya.
Secara umumnya, penyusun Kamus Dewan Perdana membina takrif dengan menggunakan struktur yang disarankan oleh Newell dalam bukunya Handbook on Lexicography for Philippine and Other Languages (1995: 271-273). Newel membahagikan takrif kepada tiga bahagian, iaitu genus, ciri pembeza dan komen. Struktur ini digunakan terutamanya dalam pentakrifan entri kata nama umum dan kata kerja.
Pencapaian dan Kelestarian Kamus Dewan Perdana
Hasrat dan impian DBP dan penyusun Kamus Dewan Perdana adalah untuk menghasilkan sebuah kamus yang lengkap yang disusun berasaskan analisis baharu berbantukan Korpus DBP, yang setanding dengan kamus ekabahasa bahasa-bahasa besar yang lain. Penyusunan kamus-kamus ini diusahakan berasaskan korpus yang besar yang melebihi 100 juta kata, dan berbantukan pangkalan data leksikon serta sistem penulisan kamus. Walaupun pasukan penyusun Kamus Dewan Perdana tidak dilengkapkan dengan semua prasarana dan teknologi tersebut, penyusun kamus ini tetap memanfaatkan perkembangan teknologi komputer melalui penggunaan Korpus DBP.
Akhirnya, setelah melalui tempoh penyusunan yang panjang dan penuh cabaran, DBP berjaya menerbitkan Kamus Dewan Perdana pada tahun 2020. Kamus ini menjadi mercu tanda penting dalam sejarah perkamusan Melayu dan mencerminkan transformasi perkamusan daripada kaedah tradisional kepada sistem kamus moden yang berteraskan teknologi digital. Seiring dengan perkembangan bahasa Melayu yang dinamik, pengemaskinian dan penambahbaikan kamus ini akan terus dilaksanakan dari semasa ke semasa bagi memastikan kerelevanan dan kewibawaannya sebagai sumber rujukan utama bahasa Melayu.