Чем байты отличаются от символов
Размер текста в байтах и количество символов — разные вещи. Символ — это один печатный знак, а байт — единица объёма данных. В самой распространённой кодировке UTF-8 один символ может занимать от одного до четырёх байт: латинские буквы и цифры — по 1 байту, кириллические буквы — по 2 байта, а эмодзи и редкие символы — по 3–4 байта. Поэтому русский текст в байтах почти вдвое «тяжелее», чем его длина в символах.
Считать текст в байтах нужно разработчикам и всем, кто работает с ограничениями по объёму данных: длина полей в базах данных и API часто задаётся в байтах, а не в символах; лимиты имён файлов, cookie, заголовков и метаданных тоже измеряют в байтах. Если ориентироваться только на число символов, легко превысить байтовый лимит на кириллице или эмодзи. Этот счётчик показывает точный размер в байтах UTF-8, чтобы такого не случилось.
Расчёт идёт прямо в браузере средствами кодировщика UTF-8, тот же результат вы получите, сохранив текст в файл в кодировке UTF-8 (без учёта служебной метки BOM). Рядом счётчик показывает количество символов с пробелами и без, буквы и слова, чтобы можно было сравнить объём в символах и в байтах.