Декодер кракозябр онлайн — восстановление битой кодировки текста
Возвращает русский текст из кракозябр: перебирает пары UTF-8, CP1251, KOI8-R и Latin-1 и сортирует варианты по похожести на русский.
В выгрузке вместо названий товаро⠫Привет». Письмо из старой системы открывается набором «Ð¿Ñ€Ð¸Ð²ÐµÑ‚». Файл цел. Буквы на месте, просто их прочитали не тем алфавитом: сохранили в одной кодировке, открыли в другой.
Вставьте испорченный текст в поле выше, предварительно отметив галочку над инструментом. Он переберёт частые пары кодировок и покажет варианты, в которых снова появляется русский.
Где чаще всего вылезает
- Выгрузка товаров из старой учётной системы.
- Письма и рассылки из 1С или из самописной CRM.
- База клиентов, собранная во времена Windows-1251.
- Архивные дампы, которые открыли не той программой.
Файл загрузить нельзя, поле принимает только текст. Откройте битый CSV или дамп в блокноте, скопируйте кусок и вставьте сюда. Для пробы хватит нескольких строк: кодировка у всего файла одна.
Как читать варианты
Ответов будет до пяти, отсортированных сверху вниз, и у каждого стоит подпись с парой кодировок и процент. Процент показывает, сколько кириллицы получилось среди букв, а за ромбы с вопросом оценка ещё и снижается. Это похожесть на русский, а не уверенность в кодировке, но верный вариант обычно оказывается первым.
Рядом с каждым вариантом кнопка «Копировать», забирайте нужный и возвращайте его в свою таблицу или в письмо.
Что делать с подписью
Подпись это диагноз для источника. Вариант «CP1251 → UTF-8» означает, что текст был в UTF-8, а программа прочитала его как CP1251. Пометка «×2» говорит про двойную перекодировку: так бывает, когда файл прошёл через несколько разных систем подряд.
Если кракозябры повторяются из выгрузки в выгрузку, чинить надо не текст, а настройку экспорта или импорта. Разовая правка спасает конкретный файл, причина остаётся на месте.
Как закрыть причину
Смотреть надо туда, где файл рождается, и туда, где его открывают. У выгрузки почти всегда есть параметр кодировки: выставьте UTF-8 и повторите экспорт. Если получатель упрямо ждёт CP1251, отдавайте ему CP1251, но тогда фиксируйте это в регламенте обмена.
Отдельная боль это Excel. Он открывает CSV в системной кодировке и ломает русский на ровном месте. Лечится двумя способами: сохранять CSV в UTF-8 с BOM или заходить через импорт, где кодировка выбирается руками. С 1С разговор тот же: у правил обмена и у почтовой рассылки кодировка задаётся в настройках, а не подбирается сама.
Когда кракозябры идут потоком, дело обычно в устаревшем обмене. Это уже история про обновление устаревших систем, про интеграционную шину и про обмен с маркетплейсами, где кодировку задают один раз и навсегда.
Когда вернуть текст не получится
- В тексте стоят ромбы с вопросом. Это символ замены: байты уже потеряны, восстанавливать нечего.
- Кракозябры пришли картинкой или скриншотом. Нужен текст, который можно скопировать в поле.
- Текст не русский. Перебор заточен под кириллицу, поэтому для других языков верхний вариант может оказаться не тем, просмотрите все пять.
- Поломка экзотическая. Инструмент знает шесть частых пар и один двойной случай, всё остальное проходит мимо.
- Вариантов не нашлось вовсе, и тогда появится строка про то, что текст, возможно, уже в порядке. Проверьте шрифт и настройки программы.
Тексты остаются у вас: перекодировка идёт в браузере встроенными средствами, на сервер ничего не отправляется.
Частые вопросы
Какие кодировки поддерживаются?
Основные для русского текста: UTF-8, Windows-1251 (CP1251), KOI8-R и Latin-1. Инструмент перебирает шесть пар между ними и отдельно проверяет двойную перекодировку, когда файл прошёл через две системы подряд.
Почему показывается несколько вариантов?
Точная причина сбоя заранее неизвестна, поэтому инструмент показывает до пяти кандидатов и сортирует их по похожести на русский. Верный обычно идёт первым, но пролистать весь список иногда полезно.
Текст обрабатывается приватно?
Да. Все перекодировки выполняются в браузере встроенными TextEncoder и TextDecoder, текст не покидает вашу страницу и никуда не отправляется.
Что делать, если ни один вариант не подошёл?
Сначала проверьте, нет ли в тексте ромбов с вопросом: эти байты потеряны навсегда, и вернуть их нечем. Если ромбов нет, поломка редкая. Возьмите исходный файл, а не пересланную копию, и вставьте кусок побольше. Иногда виноват шрифт, а не кодировка: текст цел, просто его нечем нарисовать.
Какие поломки инструмент не ловит?
В переборе шесть частых пар кодировок плюс один двойной случай, когда UTF-8 дважды прочитали как CP1251. Другие двойные и тройные поломки проходят мимо. Ещё оценка считает долю кириллицы, поэтому для нерусских текстов верхний вариант может оказаться не тем.
Можно ли загрузить файл?
Нет, поле принимает только вставленный текст. Откройте битый CSV или дамп в блокноте и скопируйте оттуда фрагмент. Хватит нескольких строк: кодировка у файла одна на всё содержимое.
Похожие инструменты
Чистка невидимых символов в тексте — найти и удалить онлайн
Считает невидимые символы по типам и отдаёт очищенный текст. Неразрывные пробелы меняет на обычные, а переносы строк и табуляцию оставляет на месте.
Очистка форматирования текста от HTML и мусора Word/Google Docs
Убирает из вставленного текста стили, классы и обёртки Word. На выходе чистый текст или минимальная разметка: абзацы, списки, ссылки, жирный и курсив.
Конвертер CSV в JSON и обратно онлайн
Переводит CSV в JSON и обратно прямо в браузере. Понимает кавычки, переносы строк и любой разделитель, показывает предпросмотр таблицы.