Преобразование текста в двоичный код
Коротко об инструменте
Обратная задача к расшифровке: вы пишете обычную фразу, а получаете ряд байтов из нулей и единиц, разделённых пробелами. Пригодится, когда нужно показать студенту, как хранится строка в памяти, оформить надпись на футболке или открытке, спрятать короткое послание в подписи профиля либо подготовить материал для урока информатики. Кодирование считает сама страница, введённая фраза не уходит на сервер и не сохраняется между сеансами. Смотрите также: расшифровать двоичный код обратно в текст, получить HEX-коды символов строки, закодировать фразу азбукой Морзе.
Строка кодируется в UTF-8, а в этой кодировке кириллический символ занимает два байта. Поэтому слово из пяти русских букв превращается в десять восьмиразрядных групп, а не в пять. Это не ошибка инструмента: ровно так же строка лежит в памяти и передаётся по сети. Если вам нужен один байт на букву, исходную строку сначала придётся перевести в однобайтовую кодировку вроде CP1251.
Обычно четыре, то есть тридцать два разряда, а составные эмодзи с модификаторами цвета кожи или объединяющим символом могут давать восемь и больше байтов. Из-за этого короткая фраза со смайликами разворачивается в неожиданно длинную ленту нулей и единиц. Если результат нужен компактным, оставьте в тексте только латиницу и цифры.
Перенос строки кодируется как отдельный байт 00001010, поэтому многострочный текст остаётся многострочным по смыслу, но в результате все байты выстраиваются в один непрерывный ряд через пробелы. При обратной расшифровке переносы вернутся на свои места, если вы не потеряете эти байты при копировании.
Используйте парный инструмент «Двоичный код в текст» из этого же раздела: он ждёт ровно такой формат, какой выдаёт эта страница, — байты по восемь разрядов через пробел. Скопируйте результат кнопкой «Копировать», откройте декодер, вставьте и нажмите «Конвертировать».
Страница всегда ставит пробел между группами, потому что без разделителя код почти невозможно читать глазами. Если вам нужна сплошная лента, уберите пробелы в любом текстовом редакторе через замену. Учтите, что после этого обратная расшифровка потребует ручного разбиения на группы по восемь разрядов.
Отдельного ограничения нет, но помните про рост объёма: каждый латинский символ превращается в девять знаков результата вместе с пробелом. Страница текста разворачивается примерно в двадцать тысяч символов двоичного кода, и такой объём браузер обрабатывает без труда. Книгу целиком вставлять не стоит — вкладка заметно задумается.
До: Hi
После: 01001000 01101001
До: A B
После: 01000001 00100000 01000010
Оценка и фидбек помогают понять, что улучшать дальше.