Текст

Вместо текста — Привет: как вернуть русский TXT без гадания

Файл цел, буквы тоже на месте — программа просто прочитала байты не по тем правилам. Поэтому русский текст превращается в набор Ð, Ñ или вопросительных знаков. Чем меньше вы сохраняете такой файл поверх оригинала, тем выше шанс вернуть всё без потерь.

Вместо текста — Привет: как вернуть русский TXT без гадания
Собственная иллюстрация FormatZ по теме материала.

Что важно понять сразу

TXT не хранит оформление и часто не сообщает кодировку однозначно. Русские старые программы любят Windows-1251, современные сайты и приложения — UTF-8. Если байты UTF-8 прочитать как однобайтовую кодировку, появляются характерные «кракозябры».

Короткий ответ

Строка вида Привет обычно означает, что UTF‑8 прочитали как Windows‑1251 или другую однобайтовую кодировку. Откройте копию с явным выбором кодировки и сохраните в UTF‑8 только после появления нормального текста.

Короткое правило

Сохраните исходник отдельно. Просмотр, исправление и конвертацию выполняйте с копией — так любая ошибка останется обратимой.

Как это устроено без технического тумана

Сделайте копию, откройте её в редакторе с выбором кодировки и попробуйте UTF-8, Windows-1251, реже KOI8-R. Правильный вариант узнаётся сразу по связному тексту. Затем сохраните новую копию в UTF-8, не перезаписывая исходник.

Пошаговый план

1

Не нажимайте «Сохранить» сразу

Повторное сохранение в неверной кодировке может окончательно заменить символы.

2

Попробуйте UTF-8

Это стандартный выбор для современных приложений и веба.

3

Проверьте Windows-1251

Она часто встречается в старых русскоязычных базах и выгрузках.

4

Сохраните новую копию

Дайте понятное имя с пометкой UTF-8 и проверьте в другом приложении.

Если что-то пошло не так

Что вы видитеЧто делать
Видны Ð и ÑСкорее всего UTF-8 ошибочно прочитан как однобайтовая кодировка.
Везде знаки вопросаСимволы могли быть уже заменены при прошлом сохранении; нужен оригинал.
Текст нормальный, кроме нескольких строкФайл мог быть собран из фрагментов с разными кодировками.
Excel портит CSVИмпортируйте через мастер данных и явно выберите UTF-8 и разделитель.

Какой вариант выбрать

После восстановления храните обменную копию в UTF-8. Если файл предназначен для конкретной старой системы, уточните её требования и оставьте отдельную версию Windows-1251. Не меняйте расширение TXT на DOCX: кодировка от этого не исправится.

После исправления проверьте места, где ошибка заметнее всего: букву ё, кавычки, тире, символ рубля, номера телефонов и строки с латиницей. Затем закройте файл и откройте новую копию повторно — именно так проявляется неверно выбранная кодировка при сохранении. Если данные будут импортироваться в программу, сначала прогоните несколько строк и сравните результат, а не загружайте весь массив сразу.

Попробовать на копии файла

Работайте с отдельной копией. Перед использованием результата убедитесь: исправились начало и конец файла; кавычки, тире и знак рубля читаются; программа‑получатель открывает UTF‑8‑копию.

Открыть копию в TXT-редакторе

Практический пример и проверка

Не нажимайте «Сохранить» поверх исходника с кракозябрами: повторное кодирование может окончательно потерять байты. Сравните несколько русских слов, кавычки и тире.

Перед тем как удалить исходник

  • исправились начало и конец файла
  • кавычки, тире и знак рубля читаются
  • программа‑получатель открывает UTF‑8‑копию

Основной справочный источник: объяснение Unicode Consortium. Описания меню могут немного отличаться между версиями программ.

Строка вида Привет обычно означает, что UTF‑8 прочитали как Windows‑1251 или другую однобайтовую кодировку. Откройте копию с явным выбором кодировки и сохраните в UTF‑8 только после появления нормального текста.
Не нажимайте «Сохранить» поверх исходника с кракозябрами: повторное кодирование может окончательно потерять байты. Сравните несколько русских слов, кавычки и тире.
исправились начало и конец файла; кавычки, тире и знак рубля читаются; программа‑получатель открывает UTF‑8‑копию.