ESC

Rilevatore di Lingua

Prova un esempio:
Attendibilità: 0%
Altre possibili lingue:

Lingue Supportate

  • English
  • Turkish (Türkçe)
  • Spanish (Español)
  • German (Deutsch)
  • French (Français)
  • Italian (Italiano)
  • Portuguese
  • Dutch
  • Polish
  • Swedish
  • Danish / Norwegian
  • Finnish
  • Japanese (日本語)
  • Chinese (中文)
  • Korean (한국어)
  • Arabic (العربية)
  • Russian (Русский)
  • Hebrew (עברית)
  • Hindi (हिन्दी)
  • Thai (ภาษาไทย)
  • Greek (Ελληνικά)
Tutto il rilevamento avviene nel tuo browser. Nessun testo viene inviato a nessun server.

Funzionalità

Rilevamento Istantaneo

I risultati appaiono mentre si digita con un ritardo di 300ms — senza bisogno di cliccare

Oltre 20 Lingue

Rileva lingue europee, asiatiche e mediorientali, inclusi sistemi di scrittura non latini

Punteggio di Attendibilità

Mostra l'attendibilità del rilevamento e i principali candidati di lingue alternative

Privacy Prima di Tutto

Tutta l'elaborazione avviene localmente nel tuo browser — il tuo testo non lascia mai il tuo dispositivo

Come si usa?

1

Incolla il tuo Testo

Digita o incolla qualsiasi testo nell'area di input. Almeno 20 caratteri garantiscono la migliore precisione.

2

Visualizza il Risultato

La lingua rilevata, il suo punteggio di attendibilità e le possibili alternative vengono mostrate istantaneamente.

3

Copia o Continua

Copia il risultato negli appunti o prova un altro testo con il pulsante Cancella.

Domande Frequenti

Lo strumento utilizza due metodi complementari. Per gli script non latini, viene utilizzata l'analisi dell'intervallo dei caratteri: i caratteri giapponesi (Hiragana, Katakana, Kanji), l'arabo, l'ebraico, il russo/cirillico, il coreano (Hangul), il cinese, l'hindi (Devanagari), il tailandese e il greco hanno tutti intervalli Unicode distinti che consentono un rilevamento immediato e univoco. Per le lingue con script latini (inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, polacco, svedese, norvegese, danese, finlandese), lo strumento utilizza l'analisi della frequenza delle stopword — ogni lingua ha un set di parole funzione altamente comuni (de, the, le, die, et) e la lingua la cui lista di stopword ha più corrispondenze vince. La confidenza si basa su quanto chiaramente il vincitore superi le alternative.

Lo strumento richiede almeno 20 caratteri. Per i migliori risultati, usa una frase completa o più (50+ caratteri). I testi brevi sono ambigui — una frase di due parole come "Bonjour monde" è identificabile come francese, ma una singola parola come "pasta" potrebbe essere italiana, inglese o un nome proprio in qualsiasi lingua. Per le lingue con script latini, l'accuratezza migliora significativamente con testi più lunghi perché più stopword hanno la possibilità di apparire. Gli script non latini (giapponese, arabo, russo, ecc.) sono rilevabili anche da campioni molto brevi perché l'insieme di caratteri stesso è diagnostico.

Il rilevamento di lingue miste è intrinsecamente difficile per qualsiasi rilevatore di lingua. Se il tuo testo contiene una lingua dominante con occasionali parole straniere, il rilevatore generalmente identificherà correttamente la lingua dominante. Se il testo è approssimativamente 50/50 tra due lingue, il risultato non è affidabile. Il code-switching (alternanza di frasi in due lingue) identificherà tipicamente la lingua che ha più parole. Il punteggio di confidenza ti fornisce un segnale: una bassa confidenza (sotto il 60%) suggerisce che il testo potrebbe essere multilingue o che l'input è troppo breve per una determinazione affidabile.

No. Il rilevatore identifica le lingue, non i dialetti o le varietà regionali. L'inglese britannico, l'inglese americano e l'inglese australiano saranno tutti identificati come inglese. Il portoghese europeo e il portoghese brasiliano vengono identificati come portoghese. Lo spagnolo castigliano e lo spagnolo latinoamericano vengono identificati come spagnolo. Per il rilevamento dei dialetti, sarebbero necessari modelli NLP dedicati addestrati su dati dialettali. Questo strumento si concentra sull'identificazione a livello di lingua, che copre la stragrande maggioranza dei casi d'uso pratici.

Inglese, turco, spagnolo, tedesco, francese, italiano, portoghese, olandese, polacco, svedese, norvegese, danese, finlandese, giapponese, cinese, coreano, arabo, russo, ebraico, hindi, tailandese e greco — 21 lingue in totale. Le lingue europee con script latini sono ben coperte, e tutti i principali script non latini (arabo, CJK, cirillico, Devanagari, ebraico, tailandese) sono supportati. Le lingue non presenti in questa lista (ad esempio vietnamita, swahili, malese, indonesiano) restituiranno Unknown o un falso positivo per una lingua dall'aspetto simile.

Questo strumento è utile per comprendere l'approccio di rilevamento, ma per il rilevamento della lingua in produzione nelle applicazioni web, usa una libreria lato server: franc (Node.js), langdetect (Python), o lingua (molteplici lingue). Queste librerie sono più accurate e supportano più lingue. L'approccio basato su browser mostrato qui è adatto per strumenti rivolti all'utente dove un rilevamento approssimativo è sufficiente (ad esempio, la selezione automatica di una lingua dell'interfaccia utente basata sul contenuto incollato dall'utente) ma non dovrebbe essere usato per la moderazione automatizzata dei contenuti o per il filtraggio di conformità dove l'accuratezza è critica.

No. L'intero algoritmo di rilevamento viene eseguito nel tuo browser utilizzando JavaScript. Il tuo testo, indipendentemente da ciò che contiene, non lascia mai il tuo dispositivo. Lo strumento funziona completamente offline una volta caricata la pagina.

Il punteggio di confidenza riflette quanto chiaramente la lingua vincente abbia superato le alternative. Una confidenza alta (85-100%) significa che la lingua rilevata è quasi certamente corretta. Una confidenza media (60-85%) significa che il rilevamento è probabilmente corretto ma il testo presentava qualche ambiguità. Una bassa confidenza (sotto il 60%) significa che il testo è breve, multilingue o utilizza un vocabolario insolito che rende il rilevamento inaffidabile — tratta il risultato come un suggerimento, non come una risposta definitiva. L'elenco delle "altre lingue possibili" mostra i candidati di secondo posto, che possono essere informativi quando la confidenza è bassa.

Cos'è un Rilevatore di Lingua?

Un rilevatore di lingua è uno strumento che analizza un pezzo di testo e identifica in quale lingua umana è scritto. Questo rilevatore di lingua online gratuito funziona interamente nel tuo browser — nessun account, nessun caricamento, nessun server richiesto. Supporta 21 lingue, incluse lingue con scrittura latina e scritture non latine come giapponese, cinese, coreano, arabo, russo, ebraico, hindi, tailandese e greco.

Perché usare questo strumento?

Questo rilevatore di lingua basato su browser è utile per sviluppatori che elaborano input utente, moderatori di contenuti che esaminano invii multilingue, traduttori che identificano il testo sorgente, educatori che lavorano con studenti multilingue e chiunque riceva testo in una lingua sconosciuta. Poiché tutto viene eseguito in JavaScript lato client, i documenti sensibili possono essere analizzati senza alcun rischio per la privacy.

Sicurezza e Privacy

La sicurezza dei vostri dati è la nostra priorità

Elaborazione Locale

Tutta l'elaborazione avviene nel vostro browser

Nessun Trasferimento Dati

I vostri dati non vengono inviati ai nostri server

Nessun Archiviazione Dati

Nessun dato viene memorizzato o condiviso

Crittografia SSL

Crittografia SSL per connessione sicura

Passo Successivo

Anche su MoreOnlineTools