Text/Clean

Merapikan karakter lebar penuh, setengah lebar, dan karakter tak terlihat

Temukan dan rapikan huruf lebar penuh, NBSP, spasi lebar nol, BOM, dan jamo Hangul terpisah (NFD) yang membuat pencarian, VLOOKUP, dan hapus duplikat gagal.

Jika VLOOKUP di Excel tidak menemukan nilai yang jelas-jelas ada, tautan tagar yang disalin tidak berfungsi, atau huruf Hangul pada nama berkas tampak terurai seperti ㅎㅏㄴㄱㅡㄹ, kemungkinan besar penyebabnya adalah perbedaan karakter yang tak terlihat. Meski di layar tampak sebagai huruf yang sama, yang dibandingkan komputer adalah kode karakternya.

Karakter yang sering ditemui

  • Huruf, angka, dan simbol lebar penuh: ABC123!@ dalam rentang Unicode U+FF01~U+FF5E. Karakter ini diketik dengan mode lebar penuh pada metode input Tionghoa-Jepang-Korea dan kodenya berbeda dari ASCII setengah lebar (U+0021~U+007E). Angka lebar penuh bisa tidak dikenali sebagai angka di lembar kerja, dan alamat email yang memuat lebar penuh akan dianggap salah format.
  • Spasi lebar penuh (U+3000): spasi selebar satu huruf yang dipakai dalam dokumen Tionghoa-Jepang-Korea.
  • NBSP (U+00A0): spasi tanpa jeda baris.   dalam HTML adalah karakter ini, dan sering tercampur dalam teks yang disalin dari halaman web. Fungsi TRIM di Excel hanya menghapus spasi biasa, sehingga NBSP tetap tersisa.
  • Spasi lebar nol (U+200B): lebarnya 0 sehingga sama sekali tidak terlihat. Karakter ini terselip dalam teks yang disalin dari editor web atau aplikasi pesan dan memutus tagar atau URL.
  • BOM (U+FEFF): penanda urutan bita yang menempel di awal berkas. Jika berkas UTF-8 ber-BOM disalin dengan Notepad atau sejenisnya, karakter ini bersembunyi di depan nilai pertama pada baris pertama dan menjadi penyebab hanya nilai pertama yang gagal dibandingkan.

Jamo Hangul terpisah (NFC dan NFD)

Unicode mengizinkan dua cara menulis suku kata Korea : sebagai satu kode (U+D55C, NFC) atau sebagai tiga jamo (U+1112) (U+1161) (U+11AB) (NFD). Keduanya tampil sebagai huruf yang sama, tetapi berbeda sebagai string. Nama berkas yang dibuat di macOS atau sebagian teks yang dipindahkan dari macOS bisa mengandung Hangul NFD, dan bila dilihat di lingkungan yang tidak mampu merangkai NFD, jamonya tampak terurai. Meski tampilannya normal, jika dibandingkan dengan Hangul NFC nilainya berbeda sehingga pencarian dan penghapusan duplikat gagal. Hal yang sama berlaku untuk huruf Latin beraksen seperti é.

Pipeline perapian

  1. Rapikan karakter tak terlihat dan tanda kutip — dengan opsi bawaan, jamo terpisah digabung lewat normalisasi NFC, karakter lebar nol dan BOM dihapus, dan spasi khusus seperti NBSP diubah menjadi spasi biasa. Tanda kutip melengkung juga menjadi kutip lurus.
  2. Konversi lebar penuh ↔ setengah lebar — jika arahnya diatur ke 'Lebar penuh → setengah lebar', karakter U+FF01~U+FF5E diubah menjadi ASCII. Jika 'Ubah spasi juga' aktif, spasi lebar penuh juga menjadi spasi biasa.
  3. Hapus spasi di awal dan akhir — menghapus spasi hasil konversi yang berada di awal dan akhir baris.
KIM minsu​@example.com
合計:1,200円

Masukan di atas (setelah KIM ada spasi lebar penuh, dan setelah minsu tersembunyi spasi lebar nol) dirapikan menjadi seperti berikut.

KIM minsu@example.com
合計:1,200円

Hal yang perlu diperhatikan

  • Lebar penuh → setengah lebar tidak mengubah Hangul, Hanzi/Kanji, dan kana, tetapi tanda baca lebar penuh dalam kalimat Jepang atau Tionghoa ( ) juga diubah menjadi setengah lebar. Untuk naskah yang bentuk kalimatnya harus dijaga, terapkan hanya pada bagian yang berisi huruf dan angka.
  • Simbol won (U+FFE6) dan simbol yen (U+FFE5) berada di luar rentang konversi (U+FF01~U+FF5E) sehingga tidak berubah.
  • Opsi 'Katakana setengah lebar → lebar penuh' hanya berlaku bila arahnya 'Setengah lebar → lebar penuh'.
  • Normalisasi NFC hanya menggabungkan jamo terpisah menjadi suku kata utuh; karakter kompatibilitas seperti tidak diubah menjadi 1 kg IV. Karakter seperti ini tetap dalam bentuk aslinya.
  • Sebaliknya, 'Setengah lebar → lebar penuh' dipakai untuk mengisi formulir yang mewajibkan masukan lebar penuh, seperti formulir Jepang. Dalam hal ini spasi biasa juga diubah menjadi spasi lebar penuh, jadi matikan 'Ubah spasi juga' bila tidak diperlukan.
  • Jika penghubung lebar nol (U+200D) dihapus, emoji gabungan seperti 👨‍👩‍👧 terurai menjadi emoji terpisah. Untuk tulisan yang emojinya harus dipertahankan, matikan 'Hapus karakter lebar nol & BOM'.

Dari mana karakter ini masuk

  • Situs Jepang dan Tionghoa, dokumen lama instansi pemerintah Korea, dan nilai yang diketik dengan mode lebar penuh pada metode input Tionghoa-Jepang-Korea mudah bercampur dengan huruf dan angka lebar penuh.
  • Saat menyalin halaman web, NBSP yang ditulis sebagai   ikut terbawa. Karakter ini sering berada di akhir kalimat atau di antara nama.
  • Teks yang disalin dari pratinjau tautan di aplikasi pesan dan media sosial, atau dari editor, kadang disisipi spasi lebar nol.

Fungsi CLEAN di Excel menghapus karakter kendali berkode 0–31, sehingga tidak menangani NBSP, spasi lebar nol, atau karakter lebar penuh. Nilai yang tidak dapat diatasi di lembar kerja bisa dirapikan dengan alat ini lalu ditempel kembali.

Cara menemukan karakter tersembunyi

Jika sebelum merapikan Anda ingin melihat baris mana yang bermasalah, atur Filter baris ke 'Simpan hanya baris yang memuatnya' dengan 'Regex', lalu isi teks yang dicari dengan [ ​ !-~]. Hanya baris yang memuat karakter tersebut yang tersisa, sehingga Anda bisa memeriksa data penyebabnya. Setelah selesai, matikan atau hapus langkah ini.

Daftar periksa

  • Jika perbandingan gagal, curigai karakter tak terlihat terlebih dahulu.
  • Letakkan rapikan karakter tak terlihat dan tanda kutip sebelum konversi lebar penuh.
  • Untuk naskah bahasa Jepang atau Tionghoa, gunakan konversi lebar penuh hanya pada sebagian teks.

Terakhir diperbarui: 2026-09-23