Экранирование Unicode

Экранировать не-ASCII символы в \uXXXX или восстановить \uXXXX / \xXX

Кодировать Декодировать
Символов: {{ inputText.length }}
HTML-сущности →

Об экранировании Unicode

Экранирование Unicode (записывается как \uXXXX) использует 4 шестнадцатеричные цифры для представления кодовой точки символа. Это стандартный способ выразить не-ASCII символы в JavaScript, Java, JSON и аналогичных языках. Экранирование не-ASCII символов в \uXXXX делает текст состоящим только из ASCII, поэтому он может безопасно передаваться по ASCII-каналам и восстанавливаться в пункте назначения.

При кодировании этот инструмент сохраняет печатные ASCII-символы без изменений и экранирует только остальное; при декодировании он поддерживает как форму \uXXXX, так и \xXX, сохраняя буквальный текст.

Примеры

Входные данные: Привет, мир! → Результат: \u041f\u0440\u0438\u0432\u0435\u0442, \u043c\u0438\u0440!

Обратно — Входные данные: \u041f\u0440\u0438\u0432\u0435\u0442, \u043c\u0438\u0440! → Результат: Привет, мир!

Часто задаваемые вопросы

В: В чём разница между \u и \x?
О: \uXXXX — это 4-значная шестнадцатеричная кодовая точка (охватывает всю Basic Multilingual Plane), а \xXX — 2-значная шестнадцатеричная (только 0-255). Этот инструмент декодирует обе.
В: Почему английские буквы не экранируются?
О: Чтобы результаты оставались читаемыми и компактными, печатные ASCII-символы (буквы, цифры, пунктуация) сохраняются как есть; только не-ASCII символы экранируются в \uXXXX.