Конвертер Юникод

Преобразуйте текст в escape-последовательности Unicode или наоборот.

Что такое Юникод?

Unicode — это международный стандарт кодирования, представления и обработки текста. Он присваивает уникальный номер (кодовую точку) каждому символу каждой системы письма, а также символам, смайликам и управляющим символам. Юникод стремится стать универсальным набором символов, который в настоящее время содержит более 149 000 символов, охватывающих 161 алфавит.

Кодировки Юникод

Кодовые точки Unicode могут быть закодированы в разных форматах: UTF-8 (переменные 1–4 байта, совместимые с ASCII), UTF-16 (2 или 4 байта, используемые JavaScript/Windows) и UTF-32 (фиксированные 4 байта). UTF-8 стала доминирующей кодировкой в ​​Интернете, поддерживая все языки, оставаясь при этом эффективной для текста ASCII.

Общие случаи использования
  • Отладка проблем с кодировкой в тексте
  • Поиск кодовых точек специальных символов
  • Преобразование экранированных последовательностей Юникода
  • Анализ состава персонажей
  • Работа с интернационализацией (i18n)
Форматы обозначений
U+XXXX Стандартная нотация Unicode (например, U+0041 для буквы «A»)
\uXXXX Escape-последовательность JavaScript/JSON
&#DDDD; Десятичный объект HTML
&#xHHHH; Шестнадцатеричный объект HTML
Часто задаваемые вопросы

В чем разница между UTF-8 и Unicode?

Юникод — это набор символов (сопоставление символов числам). UTF-8 — это один из способов кодирования этих чисел в байтах. Другие кодировки включают UTF-16 и UTF-32.

Почему некоторые символы выглядят как прямоугольники или вопросительные знаки?

Это происходит, когда в вашей системе нет шрифта, содержащего этот символ, или когда кодировка определена неправильно. Персонаж существует, но не может быть отображен.