ESC

Sprachenerkenner

Ein Beispiel ausprobieren:
Zuverlässigkeit: 0%
Andere mögliche Sprachen:

Unterstützte Sprachen

  • English
  • Turkish (Türkçe)
  • Spanish (Español)
  • German (Deutsch)
  • French (Français)
  • Italian (Italiano)
  • Portuguese
  • Dutch
  • Polish
  • Swedish
  • Danish / Norwegian
  • Finnish
  • Japanese (日本語)
  • Chinese (中文)
  • Korean (한국어)
  • Arabic (العربية)
  • Russian (Русский)
  • Hebrew (עברית)
  • Hindi (हिन्दी)
  • Thai (ภาษาไทย)
  • Greek (Ελληνικά)
Die gesamte Erkennung erfolgt in Ihrem Browser. Es werden keine Texte an einen Server gesendet.

Funktionen

Soforterkennung

Ergebnisse erscheinen beim Tippen mit 300ms Verzögerung — kein Klicken erforderlich

20+ Sprachen

Erkennt europäische, asiatische und nahöstliche Sprachen einschließlich nicht-lateinischer Schriften

Zuverlässigkeitswert

Zeigt die Erkennungszuverlässigkeit und die wichtigsten alternativen Sprachkandidaten an

Datenschutz zuerst

Die gesamte Verarbeitung erfolgt lokal in Ihrem Browser — Ihr Text verlässt Ihr Gerät nie

Wie benutze ich es?

1

Text einfügen

Tippen oder fügen Sie einen beliebigen Text in das Eingabefeld ein. Mindestens 20 Zeichen liefern die beste Genauigkeit.

2

Ergebnis anzeigen

Die erkannte Sprache, ihr Zuverlässigkeitswert und Alternativen werden sofort angezeigt.

3

Kopieren oder fortfahren

Kopieren Sie das Ergebnis in die Zwischenablage oder versuchen Sie einen anderen Text mit der Löschen-Schaltfläche.

Häufig gestellte Fragen

Das Tool verwendet zwei komplementäre Methoden. Für nicht-lateinische Schriften wird eine Analyse des Zeichenbereichs verwendet: Japanische Schriftzeichen (Hiragana, Katakana, Kanji), Arabisch, Hebräisch, Russisch/Kyrillisch, Koreanisch (Hangul), Chinesisch, Hindi (Devanagari), Thai und Griechisch haben alle eindeutige Unicode-Bereiche, die eine sofortige, eindeutige Erkennung ermöglichen. Für Sprachen mit lateinischem Alphabet (Englisch, Spanisch, Französisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Polnisch, Schwedisch, Norwegisch, Dänisch, Finnisch) nutzt das Tool eine Stopword-Frequenzanalyse — jede Sprache hat eine Reihe sehr häufiger Funktionswörter (de, the, le, die, et) und die Sprache, deren Stopword-Liste die meisten Übereinstimmungen aufweist, gewinnt. Die Konfidenz basiert darauf, wie deutlich der Gewinner die Alternativen übertrifft.

Das Tool benötigt mindestens 20 Zeichen. Für beste Ergebnisse verwenden Sie einen vollständigen Satz oder mehr (50+ Zeichen). Kurze Texte sind mehrdeutig — eine zweiwörtige Phrase wie "Bonjour monde" ist als Französisch erkennbar, aber ein einzelnes Wort wie "pasta" könnte Italienisch, Englisch oder ein Eigenname in einer beliebigen Sprache sein. Bei Sprachen mit lateinischem Alphabet verbessert sich die Genauigkeit bei längeren Texten erheblich, da mehr Stopwords die Chance haben zu erscheinen. Nicht-lateinische Schriften (Japanisch, Arabisch, Russisch usw.) sind sogar aus sehr kurzen Proben erkennbar, da das Zeichensatz selbst diagnostisch ist.

Die Erkennung von gemischten Sprachen ist für jeden Sprachdetektor von Natur aus schwierig. Wenn Ihr Text eine dominante Sprache mit gelegentlichen Fremdwörtern enthält, wird der Detektor normalerweise die dominante Sprache korrekt identifizieren. Wenn der Text zu etwa 50/50 zwischen zwei Sprachen besteht, ist das Ergebnis unzuverlässig. Code-Switching (abwechselnde Sätze in zwei Sprachen) wird typischerweise die Sprache identifizieren, die mehr Wörter enthält. Der Konfidenzwert gibt Ihnen ein Signal: Eine niedrige Konfidenz (unter 60 %) deutet darauf hin, dass der Text möglicherweise mehrsprachig ist oder die Eingabe zu kurz für eine zuverlässige Bestimmung ist.

Nein. Der Detektor identifiziert Sprachen, keine Dialekte oder regionale Varietäten. Britisches Englisch, amerikanisches Englisch und australisches Englisch werden alle als Englisch identifiziert. Europäisches Portugiesisch und brasilianisches Portugiesisch werden als Portugiesisch erkannt. Kastilisch Spanisch und lateinamerikanisches Spanisch werden als Spanisch erkannt. Für die Dialekterkennung wären spezialisierte NLP-Modelle erforderlich, die auf dialektalen Daten trainiert wurden. Dieses Tool konzentriert sich auf die Identifizierung auf Sprachebene, was die überwiegende Mehrheit der praktischen Anwendungsfälle abdeckt.

Englisch, Türkisch, Spanisch, Deutsch, Französisch, Italienisch, Portugiesisch, Niederländisch, Polnisch, Schwedisch, Norwegisch, Dänisch, Finnisch, Japanisch, Chinesisch, Koreanisch, Arabisch, Russisch, Hebräisch, Hindi, Thai und Griechisch — insgesamt 21 Sprachen. Europäische Sprachen mit lateinischem Alphabet sind gut abgedeckt, und alle wichtigen nicht-lateinischen Schriften (Arabisch, CJK, Kyrillisch, Devanagari, Hebräisch, Thai) werden unterstützt. Sprachen, die nicht auf dieser Liste stehen (z. B. Vietnamesisch, Suaheli, Malaiisch, Indonesisch), werden als Unknown oder als ein ähnliches Aussehen von einer anderen Sprache angezeigt.

Dieses Tool ist nützlich, um den Erkennungsansatz zu verstehen, aber für die Spracherkennung in Webanwendungen in der Produktion sollten Sie eine Server-seitige Bibliothek verwenden: franc (Node.js), langdetect (Python) oder lingua (mehrere Sprachen). Diese Bibliotheken sind genauer und unterstützen mehr Sprachen. Der hier gezeigte browserbasierte Ansatz eignet sich für benutzerorientierte Tools, bei denen eine ungefähre Erkennung ausreicht (z. B. automatische Auswahl einer UI-Sprache basierend auf vom Benutzer eingefügtem Inhalt), sollte aber nicht für die automatisierte Content-Moderation oder Compliance-Filter verwendet werden, bei denen Genauigkeit entscheidend ist.

Nein. Der gesamte Erkennungsalgorithmus läuft in Ihrem Browser mittels JavaScript. Ihr Text verlässt unabhängig von seinem Inhalt niemals Ihr Gerät. Das Tool funktioniert vollständig offline, sobald die Seite geladen ist.

Der Konfidenzwert spiegelt wider, wie deutlich die gewinnende Sprache die Alternativen übertroffen hat. Hohe Konfidenz (85-100 %) bedeutet, dass die erkannte Sprache mit fast absoluter Sicherheit korrekt ist. Mittlere Konfidenz (60-85 %) bedeutet, dass die Erkennung wahrscheinlich korrekt ist, der Text aber eine gewisse Mehrdeutigkeit aufwies. Niedrige Konfidenz (unter 60 %) bedeutet, dass der Text kurz ist, gemischte Sprachen enthält oder einen ungewöhnlichen Wortschatz verwendet, der die Erkennung unzuverlässig macht — betrachten Sie das Ergebnis als Vorschlag, nicht als endgültige Antwort. Die Liste der "anderen möglichen Sprachen" zeigt die Nachrangigen an, was bei niedriger Konfidenz informativ sein kann.

Was ist ein Sprachenerkenner?

Ein Sprachenerkenner ist ein Tool, das ein Textstück analysiert und identifiziert, in welcher menschlichen Sprache es geschrieben ist. Dieser kostenlose Online-Sprachenerkenner funktioniert vollständig in Ihrem Browser — kein Konto, kein Upload, kein Server erforderlich. Er unterstützt 21 Sprachen einschließlich lateinischer Schriftsprachen und nicht-lateinischer Schriften wie Japanisch, Chinesisch, Koreanisch, Arabisch, Russisch, Hebräisch, Hindi, Thailändisch und Griechisch.

Warum dieses Tool verwenden?

Dieser browserbasierte Sprachenerkenner ist nützlich für Entwickler, die Benutzereingaben verarbeiten, Content-Moderatoren, die mehrsprachige Einreichungen überprüfen, Übersetzer, die Quelltexte identifizieren, Pädagogen, die mit mehrsprachigen Lernenden arbeiten, und alle, die Text in einer unbekannten Sprache erhalten. Da alles clientseitig in JavaScript läuft, können sensible Dokumente ohne Datenschutzrisiko analysiert werden.

Sicherheit und Datenschutz

Ihre Datensicherheit ist unsere Priorität

Lokale Verarbeitung

Alle Verarbeitung erfolgt in Ihrem Browser

Keine Datenübertragung

Ihre Daten werden nicht an unsere Server gesendet

Keine Datenspeicherung

Es werden keine Daten gespeichert oder geteilt

SSL-Verschlüsselung

SSL-Verschlüsselung für sichere Verbindung

Nächster Schritt

Mehr auf MoreOnlineTools