PM Proofreading
Tahap 41, Vista Menara, Intermark,
Jln Tun Razak, 50400 KL
Jam Kerja
Setiap hari: 10 jam 7 malam

Jika terdapat satu tanda baca yang telah mentakrifkan "Era AI" penulisan akademik, ia pastinya bukan tempohnya, dan ia pastinya bukan koma Oxford. Ia adalah baris panjang yang penuh dengan gangguan yang dikenali sebagai tanda sempang (—).
Pada tahun 2026, jika saya membuka tesis daripada seorang pelajar di UM atau ISLAM dan saya nampak tiga tanda sempang dalam perenggan abstrak pertama, saya tidak perlu menjalankannya melalui Turnitin. Saya sudah tahu. Anda meminta Model Bahasa Besar (LLM), anda menyalin output dan menampalnya terus ke dalam manuskrip anda.
Ia telah menjadi "bahasa kasar" penulisan digital — satu kepura-puraan yang kedengaran canggih kepada mesin tetapi meletihkan kepada pemeriksa manusia.
Bagi AI, tanda pemuka (em dash) merupakan penyambung yang berguna. Bagi penyelia Malaysia, ia merupakan tanda amaran. Ia menjerit, "Saya tidak menulis ini; saya menjananya menggunakan AI."
Dalam catatan ini, kita akan membincangkan Em Dash. Kita juga akan meneroka mengapa algoritma ketagih dengannya, mengapa ia merosakkan aliran akademik anda dan bagaimana anda boleh melakukan "Detoks Tanda Baca" untuk menjimatkan skor AI anda.
Before we analyze why the bots love it, we have to understand what it actually adalah.
In the hierarchy of horizontal lines, the em dash is the biggest brother of them all.
Dalam tatabahasa Inggeris tradisional, tanda sempang (em dash) ialah “Kad Liar”. Ia sangat versatil. Ia boleh berfungsi sebagai koma, titik dua atau sepasang kurungan — tetapi dengan kesan yang lebih dramatik.
Tanda sempang em mewujudkan pemisah keras dalam ayat. Ia memaksa pembaca berhenti, menarik nafas, dan melihat maklumat yang tersepit di antara baris. Ia adalah alat untuk penekanan.
Dan itulah sebabnya AI menyukainya. Ia berfikir segala-galanya wajar diberi penekanan.
Jika anda meminta ChatGPT, Gemini, Claude, Deepseek atau Perplexity untuk “menulis semula perenggan ini agar kedengaran lebih akademik,” perkara pertama yang akan mereka lakukan ialah menyuntik tanda sempang. Mengapa?
Ia bergantung kepada bagaimana Model Bahasa Besar (LLM) dilatih dan bagaimana ia meramalkan teks. Kerana set data yang digunakan untuk melatih mereka mengandungi banyak LLM!
LLM dilatih menggunakan set data teks "berkualiti tinggi" yang luas daripada internet. Ini termasuk berjuta-juta artikel daripada saluran seperti The New York Times, Atlantik, The New Yorker, Wikipedia dan jurnal akademik peringkat tinggi.
Dalam kewartawanan mewah dan bukan fiksyen kreatif, tanda hubung merupakan gaya yang menarik. Penulis menggunakannya untuk kedengaran bernas. Oleh kerana AI cuba meniru "penulisan pintar," ia secara statistiknya mengaitkan tanda hubung dengan "kecerdasan tinggi".
Apabila anda meminta AI untuk menulis pengenalan tesis, ia akan menggunakan "Persona Intelektual" ini secara lalai. Ia berfikir: "Orang pintar menggunakan tanda sempang untuk memasukkan pemikiran yang kompleks; oleh itu, saya akan menggunakan tanda sempang untuk menunjukkan bahawa saya pintar."
Inilah sebab teknikalnya. LLM berfungsi dengan meramalkan perkataan (token) seterusnya dalam satu urutan.
Apabila AI menghasilkan ayat yang panjang dan kompleks, ia sering memerlukan cara untuk menambah penjelasan tanpa memulakan ayat baharu (yang memerlukan perancangan struktur tatabahasa baharu) atau menggunakan perkataan peralihan yang kaku (seperti "namun" atau "tambahan lagi").
Sengkang em adalah yang terbaik "Penyambung Selamat."
Contoh Logik AI:
Penjana: "Data kualitatif mencadangkan korelasi..." Keputusan AI: Saya ingin menambah lebih banyak butiran tentang sumber data. Pilihan 1 (Ayat Baharu): ". Data ini datang daripada klinik luar bandar." (Terlalu tidak menentu). Pilihan 2 (Koma): “, which came from rural clinics,” (A bit weak). Pilihan 3 (Sengkang Em): “— gathered primarily from rural clinics —” (Perfect. It connects the thought instantly and keeps the sentence moving).
Bagi enjin kebarangkalian, tanda hubung (em dash) ialah laluan yang paling kurang rintangannya. Ia merupakan "pita saluran" penulisan AI — ia menyatukan ayat-ayat kompleks tanpa memerlukan tatabahasa yang kompleks.
Jadi, mengapa ini menjadi masalah? Jika New York Times menggunakannya, mengapa pelajar PhD tidak boleh KATANYA menggunakannya?
Masalahnya ialah Kekerapan dan Konteks.
Penulis manusia menggunakan 'em dash' seperti garam — secubit di sana sini untuk meningkatkan rasa. AI menggunakan 'em dash' seperti nasi — ia adalah bahagian utama hidangan.
Apabila seorang penyelia membaca tesis di mana setiap perenggan mengandungi struktur ayat seperti:
"Subjek — penghuraian — kata kerja."
...ia mewujudkan pengalaman membaca yang tercungap-cungap dan tersentak-sentak. Ia terasa "dibuat". Manusia secara semula jadinya mengubah struktur ayat mereka. Kita menggunakan koma. Kita menggunakan noktah. Kita menggunakan kurungan. Apabila kita melihat halaman dengan 15 sengkang 'em', ia kelihatan berbeza secara visual. Ia kelihatan seperti corak.
Tabiat AI yang paling menjengkelkan ialah menggunakan tanda hubung untuk "memperjelaskan" konsep yang tidak perlu dijelaskan.
AI Hukuman:
"Kajian ini menggunakan pendekatan kuantitatif — khususnya kaedah tinjauan — untuk mengumpul data."
Reaksi Manusia: Kami tidak memerlukan tanda sempang di sana. "Khususnya kaedah tinjauan" bukanlah pendedahan dramatik; ia hanyalah perincian. Manusia akan menulis: "Kajian ini menggunakan kaedah tinjauan kuantitatif."
AI menggunakan papan sengkang untuk mencipta Nuansa Palsu. Ia cuba menjadikan ayat mudah kelihatan rumit dengan memecahkannya. Bagi pemeriksa Malaysia yang berpengalaman, ini kelihatan seperti "pengisian". Ia kelihatan seperti seorang pelajar yang cuba meningkatkan bilangan perkataan mereka atau kedengaran lebih bijak daripada mereka yang sebenarnya.
Akhirnya, terdapat satu tanda tanya yang sering berlaku di universiti-universiti di Malaysia.
Pemproses kata yang berbeza mengendalikan sengkang dengan cara yang berbeza.
-- untuk —.--.---.Apabila pelajar menyalin daripada ChatGPT (yang memaparkan sengkang dengan sempurna) dan menampalnya ke dalam dokumen Word yang mempunyai tetapan pemformatan yang berbeza, sengkang sering muncul dalam fon atau saiz yang sedikit berbeza daripada teks di sekelilingnya. Atau, lebih teruk lagi, pelajar mencampurkannya.
Saya telah melihat tesis yang mengandungi:
"Tanda Baca Frankenstein" ini adalah bukti langsung tentang tindakan salin-tampal. Ia memberitahu pemeriksa bahawa anda bukan sahaja menggunakan AI; anda tidak cukup peduli untuk menyemak pemformatan.
Mari kita lihat contoh khusus bagaimana ini merosakkan aliran akademik.
Segera: “Tulis satu pernyataan masalah tentang demam denggi di Selangor.”
The Likely AI Output:
"Peningkatan insiden Denggi di Selangor — sebuah negeri yang terkenal dengan pembandaran yang pesat dan kepadatan penduduk yang tinggi — merupakan cabaran kritikal bagi pegawai kesihatan awam — yang sedang bergelut untuk membendung vektor tersebut."
The Critique: Lihat ayat itu. Ia seperti "Anak Patung Rusia" yang penuh dengan gangguan.
Ini adalah Linear Thinking. The AI is generating the thought in real-time, adding qualifiers as it goes.
The Human Rewrite (Scholarly):
"Peningkatan insiden Denggi di Selangor merupakan cabaran kritikal bagi pegawai kesihatan awam. Sebagai sebuah negeri yang dicirikan oleh pembandaran yang pesat dan kepadatan penduduk yang tinggi, Selangor menghadapi kesukaran unik dalam membendung vektor."
Adakah anda merasakan perbezaannya? Versi manusia mengumpulkan idea-idea secara logik. Ia menggunakan noktah untuk memisahkan "Masalah" daripada "Konteks". Ia berwibawa. Versi AI ialah aliran kesedaran berterusan yang disatukan oleh sempang.
Jika anda sedang melihat draf yang dipenuhi dengan garisan mendatar yang panjang, jangan panik. Anda tidak perlu memadam semuanya. Anda hanya perlu menterjemahkan them back into human academic English.
Berikut ialah protokol “Detoks Tanda Baca” anda.
Untuk menyah-bot tesis anda, anda perlu menggantikan tanda sempang dengan tanda baca yang digunakan oleh AI mencuba untuk mengelakkan.
Bot itu: "Penyelidikan kualitatif — yang menumpukan pada data bukan berangka — telah dipilih untuk kajian ini." Menetapkan: Gunakan koma. Manusia: "Penyelidikan kualitatif, yang menumpukan pada data bukan berangka, telah dipilih untuk kajian ini." Mengapa: Koma adalah standard. Ia tidak menarik perhatian kepada diri sendiri. Ia membiarkan ayat mengalir.
Bot itu: "Keputusan adalah signifikan — p < 0.05." Menetapkan: Use a semicolon or parentheses. Manusia: "Keputusan adalah signifikan (p < 0.05)." Mengapa: Dalam penulisan akademik, nilai statistik biasanya diletakkan dalam kurungan, bukan dilekatkan pada akhir ayat seperti pendedahan dramatik.
Bot itu: “We analyzed three factors — cost, time, and quality.” Menetapkan: Gunakan kolon. Manusia: “We analyzed three factors: cost, time, and quality.” Mengapa: Tanda titik bertindih merupakan alat tatabahasa yang betul untuk memperkenalkan senarai. AI mengelakkan tanda titik bertindih kerana ia memerlukan klausa bebas yang lengkap sebelum ini. Manusia tahu cara menggunakannya dengan betul.
Sebelum anda menghantar tesis anda kepada IPS (Institut Pengajian Pascasiswazah), lakukan audit 2 minit ini. Sudah tentu jika anda menggunakan AI kandungan, anda perlu menjadikan manusia kerja anda juga. Ia akan menjimatkan masa anda untuk menerangkan kemudian.
Saya tidak mengatakan anda sepatutnya tidak pernah gunakan tanda sempang. Saya katakan anda patut mendapatkannya.
Dalam penulisan akademik tahun 2026, tanda hubung (em dash) ialah “Power Move.” Ia digunakan untuk menekankan penemuan yang mengganggu atau bercanggah.
Penggunaan yang Baik:
“The literature predicted a linear growth model. Our data suggested the opposite — a complete collapse of the variable after Week 4.”
Here, the dash works. It creates a pause. It highlights the shock of the finding. It isn’t just connecting two boring clauses; it is spotlighting a discovery.
Peraturan Emas: Gunakan tanda sempang hanya apabila anda mahu pembaca physically stop and look at what comes next. If the information is just a detail, use a comma.
Dalam penulisan akademik anda, tanda baca anda adalah cap jari unik anda sendiri.
An AI writes in a flat, predictable rhythm, glued together by endless em dashes. A human writes with variety. We use short sentences. We use colons. We use semicolons (sparingly). We treat punctuation not just as a way to connect words, but as a way to control the nafas pembaca. AI mempunyai burstiness atau variasi panjang ayat yang rendah. Ia monoton. Manusia, sebaliknya, menulis dengan burstiness yang tinggi. Panjang ayat mereka berubah secara semula jadi.
Don’t let a chatbot dictate the rhythm of your research. Reclaim your comma. Master the colon. And leave the em dash for those rare moments when you truly have something dramatic to say.