Menu

Negara dan bahasa itu berbeda: tiga lapisan pelokalan

Bahasa dan negara adalah dua sumbu yang saling memotong, sehingga keduanya tidak bisa saling disimpulkan. Artikel ini memisahkan tiga lapisan pelokalan dan menyusun cara menyampelnya.

Diterbitkan

  • bahasa
  • pelokalan
  • data uji

Negara dan bahasa itu berbeda, dan justru karena keduanya sering muncul berdampingan di dalam satu formulir, banyak tim memperlakukannya sebagai satu sumbu. Satu negara bisa memakai beberapa bahasa resmi, dan satu bahasa bisa dipakai di banyak negara. Hubungan keduanya berbentuk silang, bukan berpasangan satu lawan satu.

Halaman ini memisahkan pelokalan menjadi tiga lapisan yang bisa diuji sendiri-sendiri, lalu menunjukkan cara menyusun sampel uji yang tidak mengasumsikan pasangan tetap antara bahasa dan negara.

Mengapa negara dan bahasa tidak bisa saling disimpulkan?

Menyimpulkan bahasa dari negara berarti mengabaikan wilayah yang memakai lebih dari satu bahasa, dan menyimpulkan negara dari bahasa berarti mengabaikan kenyataan bahwa bahasa yang sama dipakai di banyak tempat dengan aturan data yang berbeda.

Akibat paling praktisnya terlihat pada data yang dihasilkan sistem. Ketika bahasa dijadikan penentu format, data dari dua negara berbahasa sama akan dipaksa mengikuti satu bentuk, sementara data dari dua wilayah berbahasa berbeda di negara yang sama akan dipaksa mengikuti dua bentuk yang tidak sesuai dengan wilayahnya.

Kesalahan ini jarang terlihat di negara asal tim, karena di sana bahasa dan wilayah kebetulan berimpit. Kesalahan baru muncul ketika pengguna datang dari luar, dan biasanya muncul bersamaan dengan keluhan bahwa data yang benar justru ditolak.

Pelokalan sebenarnya terdiri dari tiga lapisan

Pelokalan bukan satu pekerjaan, melainkan tiga pekerjaan yang boleh memiliki nilai berbeda pada satu pengguna yang sama.

Lapisan Yang diatur Contoh pertanyaan yang dijawab
Bahasa antarmuka Teks yang dibaca pengguna Apakah label, tombol, dan pesan galat sudah dalam bahasa yang dipahami?
Wilayah konten Isi dan kebiasaan yang ditampilkan Satuan, contoh, dan urutan informasi apa yang wajar di sana?
Format data Bentuk nilai yang disimpan dan divalidasi Bagaimana tanggal, angka, urutan nama, dan baris alamat ditulis?

Ketiganya sering dipaksa seragam supaya pengaturan menjadi sederhana. Cara itu memang mengurangi jumlah kombinasi, tetapi bayarannya adalah bug yang sulit dijelaskan: pengguna memilih bahasa tertentu, lalu tiba-tiba format tanggal berubah mengikuti bahasa itu, padahal wilayahnya tidak berubah.

Pemisahan tiga lapisan juga memudahkan pengujian, karena setiap lapisan bisa diuji dengan data yang kecil dan terarah. Lapisan teks diuji dengan teks, lapisan konten diuji dengan contoh isi, dan lapisan format diuji dengan nilai yang berbeda antarwilayah.

Pembagian tugas antara label bahasa dan kode wilayah

Label bahasa menjawab pertanyaan tentang bahasa apa yang dipakai sebuah teks. Kode wilayah menjawab pertanyaan tentang aturan mana yang dipakai untuk nilai data. Keduanya punya bentuk penulisan yang mirip, dan justru kemiripan itulah yang membuat keduanya sering tertukar.

Aturan sederhana yang bisa dipegang: label bahasa tidak boleh dipakai sebagai sakelar format. Bila label bahasa dipakai untuk memilih bentuk tanggal atau aturan kode pos, maka pengguna yang mengganti bahasa akan ikut mengubah arti data yang sudah tersimpan.

Sebaliknya, kode wilayah sebaiknya tidak dipakai untuk memilih bahasa antarmuka, kecuali memang diputuskan demikian dan ada cara bagi pengguna untuk menimpanya. Banyak orang membaca antarmuka dalam bahasa yang berbeda dari bahasa resmi wilayah tempatnya tinggal, dan sistem yang mengunci keduanya akan sering salah menebak.

Kesalahan apa yang muncul saat format ditebak dari bahasa?

Kesalahan yang paling sering muncul adalah penolakan terhadap data yang sah. Dua negara yang kebetulan memakai bahasa resmi yang sama tetap memiliki aturan kode pos, aturan nomor identitas, dan kebiasaan penulisan alamat yang berbeda; menerapkan aturan satu negara kepada negara lain karena bahasanya sama akan menolak nilai yang sebenarnya benar.

Kesalahan kedua adalah kebalikannya, yaitu pelolosan data yang salah. Ketika aturan satu wilayah diterapkan terlalu longgar karena dianggap mewakili semua penutur bahasa itu, nilai yang tidak sah akan lolos dan baru terlihat sebagai masalah di hilir, misalnya saat pengiriman atau penagihan gagal.

Kesalahan ketiga bersifat tampilan. Teks dalam bahasa yang sama tetap berbeda panjangnya di berbagai negara, terutama pada nama tempat, gelar, dan istilah administrasi. Tombol, kolom tabel, dan aturan pemotongan yang diuji hanya dengan satu negara akan rusak ketika negara lain masuk.

Kesalahan keempat berkaitan dengan urutan penulisan nama dan alamat. Cara suatu bahasa menulis nama orang dan baris alamat adalah urusan lain lagi, dan pembahasannya ada di panduan data nama menurut lokal agar halaman ini tetap fokus pada pemisahan dua sumbu.

Cara menyusun sampel matriks uji

Sampel yang baik dibuat dari dua daftar terpisah, bukan dari daftar pasangan. Susun satu daftar bahasa yang mewakili bentuk teks yang berbeda, lalu susun satu daftar wilayah yang mewakili aturan data yang berbeda, dan ambil sampel dari kedua daftar itu secara terpisah.

Dengan cara itu, jumlah kasus uji tumbuh secara wajar, dan setiap kasus memiliki alasan yang jelas untuk ada. Yang perlu dipastikan hanya satu: ada beberapa kasus di mana bahasa dan wilayah tidak berpasangan seperti dugaan umum, karena justru kasus itulah yang menguji pemisahan lapisan.

Perbarui catatan tentang sampel ini setiap kali bahasa atau wilayah baru ditambahkan. Sampel yang tidak pernah ditinjau ulang akan berhenti mewakili kenyataan, dan pengujian akan terus lulus pada kombinasi yang sudah tidak relevan.

Catatan untuk pengembang: biarkan format mengikuti wilayah, bukan bahasa

Simpan nilai bahasa dan nilai wilayah sebagai dua kolom yang terpisah, walaupun di sebagian besar kasus keduanya berisi nilai yang tampak sejalan. Pisahkan sejak awal, karena menggabungkan dua kolom jauh lebih murah daripada memisahkan satu kolom yang sudah dipakai bertahun-tahun.

Saat menentukan aturan format, bacalah kolom wilayah. Saat menentukan teks, bacalah kolom bahasa. Bila ada kebutuhan untuk menyimpang dari aturan ini, tuliskan alasan dan masa berlakunya, supaya penyimpangan itu bisa ditinjau ulang.

Sediakan nilai bawaan untuk kolom wilayah yang belum diisi, dan jangan menebaknya dari bahasa. Nilai bawaan yang jelas lebih mudah diperbaiki daripada tebakan yang tampak masuk akal.

Pengujian kontrol pemilihan bahasa dan wilayah sendiri, termasuk daftar pilihan yang muncul di antarmuka, dibahas di panduan pengujian kolom pilih negara. Sedangkan cara mengelompokkan wilayah untuk keperluan laporan dibahas di panduan pengelompokan wilayah dan tingkat pasar, karena pengelompokan itu juga tidak boleh diambil dari bahasa.

Semua kombinasi bahasa dan wilayah, nama kolom, serta nilai contoh di halaman ini adalah data sintetis yang disusun untuk ilustrasi, tidak menggambarkan sebaran pengguna yang sesungguhnya, dan tidak boleh dipakai sebagai dasar keputusan pelokalan.

Langkah berikutnya

Periksa formulir yang Anda miliki, lalu tanyakan untuk setiap aturan format apakah ia membaca kolom wilayah atau kolom bahasa. Sebagai bahan uji, buka direktori negara dan wilayah, pilih beberapa negara dengan bahasa yang berbeda, lalu bandingkan apakah setiap aturan menghasilkan bentuk yang sesuai dengan wilayahnya.

Lanjut membaca

Artikel tentang Format alamat dan identitas per negara