ESC

Pengesan Bahasa

Cuba contoh:
Keyakinan: 0%
Bahasa lain yang mungkin:

Bahasa Yang Disokong

  • English
  • Turkish (Türkçe)
  • Spanish (Español)
  • German (Deutsch)
  • French (Français)
  • Italian (Italiano)
  • Portuguese
  • Dutch
  • Polish
  • Swedish
  • Danish / Norwegian
  • Finnish
  • Japanese (日本語)
  • Chinese (中文)
  • Korean (한국어)
  • Arabic (العربية)
  • Russian (Русский)
  • Hebrew (עברית)
  • Hindi (हिन्दी)
  • Thai (ภาษาไทย)
  • Greek (Ελληνικά)
Semua pengesanan berlaku dalam penyemak imbas anda. Tiada teks dihantar ke mana-mana pelayan.

Ciri-ciri

Pengesanan Serta-merta

Keputusan muncul semasa anda menaip dengan lengah 300ms — tidak perlu klik

Lebih 20 Bahasa

Mengesan bahasa Eropah, Asia dan Timur Tengah termasuk skrip bukan Latin

Skor Keyakinan

Menunjukkan keyakinan pengesanan dan calon bahasa alternatif teratas

Privasi Diutamakan

Semua pemprosesan dilakukan secara tempatan dalam penyemak imbas anda — teks anda tidak pernah meninggalkan peranti anda

Cara Menggunakannya?

1

Tampal Teks Anda

Taip atau tampal mana-mana teks ke dalam kawasan input. Sekurang-kurangnya 20 aksara memberikan ketepatan terbaik.

2

Lihat Hasilnya

Bahasa yang dikesan, skor keyakinannya dan kemungkinan alternatif ditunjukkan serta-merta.

3

Salin atau Teruskan

Salin hasilnya ke papan klip atau cuba teks lain dengan butang Kosongkan.

Soalan Lazim

Alatan ini menggunakan dua kaedah saling melengkapi. Untuk skrip bukan-Latin, analisis julat aksara digunakan: aksara Jepun (Hiragana, Katakana, Kanji), Arab, Ibrani, Rusia/Cyrillic, Korea (Hangul), Cina, Hindi (Devanagari), Thai, dan Yunani semuanya mempunyai julat Unicode yang berbeza yang membolehkan pengesanan segera tanpa kekeliruan. Untuk bahasa skrip-Latin (Inggeris, Sepanyol, Perancis, Jerman, Itali, Portugis, Belanda, Poland, Sweden, Norway, Denmark, Finland), alatan ini menggunakan analisis kekerapan kata berhenti — setiap bahasa mempunyai set kata fungsi yang sangat umum (de, the, le, die, et) dan bahasa yang senarai kata berhentinya mempunyai padanan terbanyak akan menang. Keyakinan berdasarkan sejauh mana pemenang mengatasi alternatif lain dengan jelas.

Alatan ini memerlukan sekurang-kurangnya 20 aksara. Untuk hasil terbaik, gunakan ayat lengkap atau lebih (50+ aksara). Teks pendek adalah kabur — frasa dua perkataan seperti "Bonjour monde" boleh dikesan sebagai Perancis, tetapi perkataan tunggal seperti "pasta" boleh jadi Itali, Inggeris, atau kata nama khas dalam mana-mana bahasa. Untuk bahasa skrip-Latin, ketepatan meningkat dengan ketara dengan teks yang lebih panjang kerana lebih banyak kata berhenti berpeluang untuk muncul. Skrip bukan-Latin (Jepun, Arab, Rusia, dll.) boleh dikesan walaupun daripada sampel yang sangat pendek kerana set aksaranya sendiri adalah diagnostik.

Pengesanan campuran bahasa secara intrinsiknya sukar untuk mana-mana pengesan bahasa. Jika teks anda mengandungi satu bahasa dominan dengan kata asing sekali-sekala, pengesan biasanya akan mengenal pasti bahasa dominan dengan betul. Jika teks adalah kira-kira 50/50 antara dua bahasa, keputusannya tidak boleh dipercayai. Peralihan kod (peralihan ayat dalam dua bahasa) biasanya akan mengenali mana-mana bahasa yang mempunyai lebih banyak perkataan. Skor keyakinan memberi anda isyarat: keyakinan rendah (di bawah 60%) menunjukkan teks mungkin pelbagai bahasa atau input terlalu pendek untuk penentuan yang boleh dipercayai.

Tidak. Pengesan mengenal pasti bahasa, bukan dialek atau varieti serantau. Inggeris British, Inggeris Amerika, dan Inggeris Australia semuanya akan dikenal pasti sebagai Inggeris. Portugis Eropah dan Portugis Brazil dikenal pasti sebagai Portugis. Sepanyol Castilian dan Sepanyol Amerika Latin dikenal pasti sebagai Sepanyol. Untuk pengesanan dialek, model NLP khusus yang dilatih pada data dialek diperlukan. Alatan ini memfokuskan pada pengenalan tahap bahasa, yang merangkumi sebahagian besar kes penggunaan praktikal.

Inggeris, Turki, Sepanyol, Jerman, Perancis, Itali, Portugis, Belanda, Poland, Sweden, Norway, Denmark, Finland, Jepun, Cina, Korea, Arab, Rusia, Ibrani, Hindi, Thai, dan Yunani — 21 bahasa secara keseluruhan. Bahasa skrip-Latin Eropah disertakan dengan baik, dan semua skrip bukan-Latin utama (Arab, CJK, Cyrillic, Devanagari, Ibrani, Thai) disokong. Bahasa yang tidak ada dalam senarai ini (cth. Vietnam, Swahili, Melayu, Indonesia) akan mengembalikan Unknown atau positif palsu untuk bahasa yang kelihatan serupa.

Alatan ini berguna untuk memahami pendekatan pengesanan, tetapi untuk pengesanan bahasa dalam produksi aplikasi web, gunakan pustaka sisi pelayan: franc (Node.js), langdetect (Python), atau lingua (pelbagai bahasa). Pustaka ini lebih tepat dan menyokong lebih banyak bahasa. Pendekatan berasaskan pelayar yang ditunjukkan di sini sesuai untuk alatan yang dihadapi pengguna di mana pengesanan anggaran sudah memadai (cth. memilih secara auto bahasa UI berdasarkan kandungan yang ditampal oleh pengguna) tetapi tidak harus digunakan untuk pemodenan kandungan automatik atau penapisan kepatuhan di mana ketepatan adalah kritikal.

Tidak. Keseluruhan algoritma pengesanan berjalan di dalam pelayar anda menggunakan JavaScript. Teks anda, tanpa mengira apa yang terkandung di dalamnya, tidak pernah meninggalkan peranti anda. Alatan ini berfungsi sepenuhnya luar talian sebaik sahaja halaman dimuatkan.

Skor keyakinan mencerminkan sejauh mana bahasa pemenang mengatasinya berbanding alternatif lain. Keyakinan tinggi (85-100%) bermaksud bahasa yang dikesan hampir pasti betul. Keyakinan sederhana (60-85%) bermaksud pengesanan berkemungkinan betul tetapi teks mempunyai sedikit kekaburan. Keyakinan rendah (di bawah 60%) bermaksud teks adalah pendek, campuran bahasa, atau menggunakan kosa kata luar biasa yang menjadikan pengesanan tidak boleh dipercayai — anggap keputusan sebagai cadangan, bukan jawapan muktamad. Senarai "bahasa lain yang mungkin" menunjukkan calon tempat kedua, yang boleh menjadi informatif apabila keyakinan rendah.

Apakah Pengesan Bahasa?

Pengesan bahasa adalah alat yang menganalisis sekeping teks dan mengenal pasti bahasa manusia yang digunakan. Pengesan bahasa dalam talian percuma ini berfungsi sepenuhnya dalam penyemak imbas anda — tanpa akaun, tanpa muat naik, tanpa pelayan diperlukan. Ia menyokong 21 bahasa termasuk bahasa skrip Latin dan skrip bukan Latin seperti Jepun, Cina, Korea, Arab, Rusia, Ibrani, Hindi, Thai dan Greek.

Mengapa Menggunakan Alat Ini?

Pengesan bahasa berasaskan penyemak imbas ini berguna untuk pembangun yang memproses input pengguna, moderator kandungan yang menyemak penghantaran berbilang bahasa, penterjemah yang mengenal pasti teks sumber, pendidik yang bekerja dengan pelajar berbilang bahasa, dan sesiapa yang menerima teks dalam bahasa yang tidak diketahui. Oleh kerana semuanya berjalan dalam JavaScript sebelah klien, dokumen sensitif boleh dianalisis tanpa sebarang risiko privasi.

Keselamatan dan Privasi

Keselamatan data anda adalah keutamaan kami

Pemprosesan Tempatan

Semua pemprosesan berlaku dalam pelayar anda

Tiada Pemindahan Data

Data anda tidak dihantar ke pelayan kami

Tiada Penyimpanan Data

Tiada data disimpan atau dikongsi

Penyulitan SSL

Penyulitan SSL untuk sambungan selamat

Langkah Seterusnya

Lebih Banyak di MoreOnlineTools