Ctrl + K
Текст в двоичный код UTF-8
Преобразуйте русский и английский текст в байты UTF-8 и обратно в двоичном, восьмеричном, десятичном или HEX-виде.
Текст в двоичный код UTF-8
Преобразуйте русский и английский текст в байты UTF-8 и обратно в двоичном, восьмеричном, десятичном или HEX-виде.
Перевод текста в двоичный код UTF-8
Конвертер показывает реальное байтовое представление строки, а не только номера символов ASCII.
Обратное преобразование строго проверяет формат и диапазон каждого байта, поэтому посторонний текст не удаляется молча.
Возможности
- двоичный, восьмеричный, десятичный и HEX-вид
- русский, английский текст и эмодзи
- обратное декодирование UTF-8
- проверка полных байтов и диапазона 0–255
- копирование обоих результатов
Формулы
- Сначала строка кодируется TextEncoder в байты UTF-8.
- Каждый байт переводится в выбранное основание; для двоичного вида используется ровно 8 бит.
- При декодировании байты проверяются и передаются TextDecoder в строгом режиме UTF-8.
Как пользоваться
- Выберите систему счисления.
- Введите текст и скопируйте последовательность байтов.
- Для обратной операции вставьте байты в нижнее поле.
- Исправьте отмеченную ошибку, если последовательность не образует допустимый UTF-8.
Примеры
Латинская буква AA01000001 в двоичном виде, 65 в десятичном и 41 в HEX.
Эмодзи💩UTF-8 состоит из четырех байтов: F0 9F 92 A9.
Ограничения
- Результат является UTF-8, а не UTF-16-кодом JavaScript и не двоичной записью Unicode code point.
- Для восьмеричного и десятичного ввода байты должны быть разделены пробелом, запятой или точкой с запятой.
Частые вопросы
Почему русская буква дает два двоичных байта?
Кириллические символы находятся за пределами ASCII и в UTF-8 обычно кодируются двумя байтами.
Чем UTF-8 отличается от ASCII в этом инструменте?
ASCII-символы сохраняют однобайтовые значения 0–127, а остальные символы Unicode представлены последовательностями из двух–четырех байтов.