Konwerter Unicode – darmowe online
Przekonwertować na Unicode online za pomocą darmowego narzędzia Konwerter Unicode. Praktyczne narzędzie dla programistów – działa całkowicie lokalnie, bez przesyłania danych.
Konwerter Unicode – koduj i dekoduj sekwencje Unicode, encje HTML, ucieczki CSS i kodowanie URL
Kodowanie Unicode jest wszędzie w web developmencie: JSON z sekwencjami \uXXXX, HTML z encjami &#xXXXX;, CSS z ucieczkami \XXXX i adresy URL z kodowaniem procentowym. Ten konwerter obsługuje pięć popularnych formatów w jednym narzędziu, z natychmiastowym przełączaniem koduj/dekoduj i bez wysyłania na serwer.
Obsługiwane formaty
- Unicode \uXXXX – sekwencje JavaScript/JSON, np.
\u00e9dla é. - HTML hex &#xXXXX; – szesnastkowe encje HTML, np.
é. - HTML dec &#DDDD; – dziesiętne encje HTML, np.
é. - CSS \XXXX – ucieczki CSS używane we właściwości content.
- URL %XX – kodowanie procentowe w query string i ścieżkach.
Dla kogo
Programiści frontendu debugujący „krzaki" w odpowiedziach API, inżynierowie backendu normalizujący Unicode przed zapisem, specjaliści SEO sprawdzający kodowanie URL dla znaków międzynarodowych, twórcy maili pracujący z encjami HTML i każdy, kto kiedykolwiek zobaczył \uXXXX w logu i musiał odczytać to jako tekst.
Jak używać
- Wybierz format kodowania z listy.
- Wklej lub wpisz tekst – wynik aktualizuje się od razu.
- Przełącz Koduj/Dekoduj, by zmienić kierunek.
- Skopiuj wynik albo zamień go z wejściem do dalszego przetwarzania.
Punkty kodowe, jednostki kodowe i dlaczego mają znaczenie
Znak taki jak 😀 wygląda jak jeden symbol, ale pod spodem może być pojedynczym punktem kodowym (U+1F600) zakodowanym jako jeden lub więcej bajtów UTF-8 i jedna lub dwie jednostki kodowe UTF-16. Ten konwerter pokazuje wszystkie trzy warstwy – punkt kodowy, sekwencję bajtów UTF-8 i reprezentację UTF-16 – więc wytropisz błędy kodowania w bazach, ładunkach sieciowych i plikach źródłowych.
Zastosowania
- Mojibake w bazie – wklej zniekształcony ciąg i sprawdź faktyczną sekwencję bajtów, by ustalić, czy to podwójnie zakodowany UTF-8 czy Latin-1 wzięty za UTF-8.
- Zgodność emoji – potwierdź, czy emoji to jeden punkt kodowy, czy sekwencja łączona znakiem zerowej szerokości (ZWJ), np. 👨👩👧 to pięć złączonych punktów kodowych.
- Analiza bezpieczeństwa – wykryj ataki homograficzne, w których cyrylickie „а" wygląda identycznie jak łacińskie „a", czytając punkty kodowe.
- Normalizacja URL i nazw plików – sprawdź, czy wizualnie identyczne ciągi mają tę samą formę kanoniczną (NFC / NFD), zanim zapiszesz je jako klucze.
- Przegląd kodu – wypatrz niewidoczne znaki (spacja zerowej szerokości, znacznik RTL) używane w atakach na łańcuch dostaw.
Co możesz przekonwertować
Wklej dowolny tekst, by zobaczyć jego punkty kodowe dziesiętnie i szesnastkowo, sekwencję bajtów UTF-8, reprezentację UTF-16 i rozbicie znak po znaku. Konwertuj w drugą stronę, wklejając punkty kodowe U+XXXX, ucieczki \uXXXX lub sekwencje bajtów i odczytując wynikowy tekst.
Prywatność i przetwarzanie w przeglądarce
Całe kodowanie i dekodowanie odbywa się w Twojej przeglądarce. Tekst nigdy nie opuszcza urządzenia. Ma to znaczenie przy pracy z danymi prywatnymi, wewnętrznymi logami i każdym tekstem, którego nie powinno się wysyłać do zewnętrznej usługi.
Powiązane narzędzia
Osoby używające konwertera Unicode często korzystają też z kodowania URL, kodowania Base64, HTML na Markdown oraz formatowania JSON.
Najczęściej zadawane pytania
Czy konwerter Unicode jest darmowy?
Tak. Narzędzie działa za darmo w przeglądarce i nie wymaga zakładania konta.
Czy muszę coś instalować?
Nie. Wszystko działa w zwykłej, nowoczesnej przeglądarce – na komputerze i na telefonie, bez dodatkowych programów.
Czy mój tekst jest wysyłany na serwer?
Nie. Całe kodowanie i dekodowanie odbywa się lokalnie w przeglądarce. Tekst nie opuszcza Twojego urządzenia.
Jakie formaty są obsługiwane?
Sekwencje Unicode (uXXXX), szesnastkowe i dziesiętne encje HTML, ucieczki CSS oraz kodowanie procentowe URL – pięć formatów w jednym narzędziu.
Do czego przydaje się rozbicie na punkty kodowe?
Do debugowania błędów kodowania, wykrywania ataków homograficznych i niewidocznych znaków oraz sprawdzania, czy emoji to jeden znak, czy sekwencja łączona.
Czym jest mojibake?
To zniekształcony tekst powstały, gdy bajty są interpretowane w złym kodowaniu. Podgląd sekwencji bajtów pomaga ustalić, czy to podwójnie zakodowany UTF-8, czy Latin-1 wzięty za UTF-8.