ESC

Калькулятор длины строки

Все расчёты обновляются мгновенно по мере ввода

Статистика длины

0
Символы
0
Кодовые точки
0
Байты UTF-8
0
Байты UTF-16
0
URL-кодирование
0
Длина Base64
Вся обработка происходит в вашем браузере. Данные не отправляются на сервер.

Примеры использования

ASCII-текст

Рассчитайте длину простого ASCII-текста, где каждый символ занимает 1 байт в UTF-8.

Unicode и эмодзи

Посмотрите, как многобайтовые символы, например японский текст и эмодзи, влияют на подсчёт байтов.

URL-строка

Проверьте, как URL со специальными символами увеличивается при URL-кодировании.

Возможности

Расчёт в реальном времени

Все измерения обновляются мгновенно по мере ввода, без нажатия кнопок

Множество кодировок

Длина в символах, кодовых точках, UTF-8, UTF-16, URL-кодировании и Base64

Поддержка Unicode

Корректная обработка многобайтовых символов, эмодзи и суррогатных пар

Конфиденциальность

Вся обработка выполняется локально в вашем браузере, данные не отправляются на сервер

Как пользоваться?

1

Введите текст

Введите или вставьте текст в поле ввода. Статистика обновляется в реальном времени.

2

Просмотрите длину

Посмотрите все измерения длины: символы, байты в различных кодировках и длину в закодированном виде.

3

Скопируйте статистику

Нажмите кнопку «Копировать статистику», чтобы скопировать все данные о длине в буфер обмена.

Часто задаваемые вопросы

Счётчик «Символы» отражает то, что возвращает string.length в JavaScript — кодовые единицы UTF-16. «Кодовые точки» считают фактические скалярные значения Unicode. Эмодзи и сложные символы создают разницу: простой эмодзи 😊 — это 2 кодовые единицы, но 1 кодовая точка. Для чистого ASCII-текста оба значения совпадают.

UTF-8 — кодировка переменной ширины: символы ASCII занимают 1 байт, латинские и акцентированные символы — 2 байта, большинство символов CJK — 3 байта, эмодзи — 4 байта. UTF-16 использует минимум 2 байта на символ. Поэтому ASCII-текст в UTF-8 всегда вдвое меньше, чем в UTF-16. Текст CJK нередко занимает столько же или меньше места в UTF-16.

URL-кодирование (percent-encoding) преобразует специальные и не-ASCII символы в формат %XX. Пробел становится %20 (3 символа), добавляя 2 символа на каждый пробел. Это значение показывает длину после полного URL-кодирования — полезно для проверки, не превышает ли параметр запроса или URL допустимую длину.

Кодировка Base64 преобразует двоичные данные в ASCII-текст. Каждые 3 байта входных данных становятся 4 символами Base64. Формула: ceil(байты / 3) * 4, с округлением до кратного 4. Это значение полезно при расчёте размеров полезной нагрузки API, вложений электронной почты или длин data URI.

JavaScript использует UTF-16 внутренне. Свойство .length считает кодовые единицы UTF-16, а не символы. Для эмодзи и символов из плоскостей Unicode выше U+FFFF .length возвращает завышенное значение. Для точного подсчёта символов (кодовых точек) используйте Array.from(str).length или [...str].length.

Зависит от конкретного эмодзи. Простой эмодзи 😊: 2 кодовые единицы UTF-16, 1 кодовая точка, 4 байта UTF-8. Флаговый эмодзи 🇩🇪: 4 кодовые единицы UTF-16, 2 кодовые точки, 8 байт UTF-8. Эмодзи семьи, составленные из ZWJ-последовательностей, занимают ещё больше. Инструмент корректно считает каждый уровень.

Кодовая точка Unicode — это число, присвоенное символу (например, U+1F60A для 😊). Кодовая единица — единица хранения конкретной кодировки: UTF-8 использует 8-битные единицы, UTF-16 — 16-битные. Большинство символов умещается в одну кодовую единицу UTF-16. Символы вне BMP (Basic Multilingual Plane) требуют двух кодовых единиц UTF-16 (суррогатную пару).

Нет. Все расчёты длины выполняются локально в вашем браузере через JavaScript. Вставляйте API-ключи, пароли или конфиденциальный текст без опасений — ничего никуда не передаётся.

Почему длина строки — это не просто .length

Если вас когда-нибудь удивляло, что эмодзи занимает 2 символа в JavaScript или что японская строка в UTF-8 оказывается в 3 раза больше ожидаемого — этот инструмент для вас. Он показывает реальный размер текста в нескольких кодировках, чтобы вы точно знали, с чем имеете дело.

Шесть измерений одним взглядом

Количество символов, кодовые точки Unicode, байты UTF-8, байты UTF-16, длина URL-кодирования и длина Base64 — всё обновляется в реальном времени по мере ввода. Не нужно писать код или читать документацию, чтобы узнать реальный размер строки.

Когда это нужно разработчикам

Проверка размеров столбцов базы данных перед вставкой, контроль ограничений длины URL, расчёт размера полезной нагрузки для API, отладка проблем с кодировкой в международном тексте или выяснение, почему эмодзи сломал ваш столбец VARCHAR(255). Это реальные задачи, которые этот инструмент решает мгновенно.

Правильная работа с Unicode

Инструмент корректно обрабатывает суррогатные пары, комбинирующие символы и последовательности эмодзи. Он различает то, что JavaScript называет «length», и то, что Unicode определяет как кодовые точки — различие, которое важно при работе с международным текстом или контентом с эмодзи.

Без сервера, без отслеживания

Всё работает в браузере на JavaScript. Вставляйте API-ключи, пароли или конфиденциальные данные без опасений — ничего никуда не передаётся. Расчёты выполняются локально на вашем устройстве.

Безопасность и конфиденциальность

Безопасность ваших данных — наш приоритет

Локальная обработка

Вся обработка происходит в вашем браузере

Без передачи данных

Ваши данные не отправляются на наши серверы

Без хранения данных

Данные не хранятся и не передаются

SSL-шифрование

SSL-шифрование для безопасного соединения

Также на MoreOnlineTools