Вместо текста — Привет: как вернуть русский TXT без гадания
Файл цел, буквы тоже на месте — программа просто прочитала байты не по тем правилам. Поэтому русский текст превращается в набор Ð, Ñ или вопросительных знаков. Чем меньше вы сохраняете такой файл поверх оригинала, тем выше шанс вернуть всё без потерь.

Что важно понять сразу
TXT не хранит оформление и часто не сообщает кодировку однозначно. Русские старые программы любят Windows-1251, современные сайты и приложения — UTF-8. Если байты UTF-8 прочитать как однобайтовую кодировку, появляются характерные «кракозябры».
Короткий ответ
Строка вида Привет обычно означает, что UTF‑8 прочитали как Windows‑1251 или другую однобайтовую кодировку. Откройте копию с явным выбором кодировки и сохраните в UTF‑8 только после появления нормального текста.
Короткое правило
Сохраните исходник отдельно. Просмотр, исправление и конвертацию выполняйте с копией — так любая ошибка останется обратимой.
Как это устроено без технического тумана
Сделайте копию, откройте её в редакторе с выбором кодировки и попробуйте UTF-8, Windows-1251, реже KOI8-R. Правильный вариант узнаётся сразу по связному тексту. Затем сохраните новую копию в UTF-8, не перезаписывая исходник.
Пошаговый план
Не нажимайте «Сохранить» сразу
Повторное сохранение в неверной кодировке может окончательно заменить символы.
Попробуйте UTF-8
Это стандартный выбор для современных приложений и веба.
Проверьте Windows-1251
Она часто встречается в старых русскоязычных базах и выгрузках.
Сохраните новую копию
Дайте понятное имя с пометкой UTF-8 и проверьте в другом приложении.
Если что-то пошло не так
| Что вы видите | Что делать |
|---|---|
| Видны Ð и Ñ | Скорее всего UTF-8 ошибочно прочитан как однобайтовая кодировка. |
| Везде знаки вопроса | Символы могли быть уже заменены при прошлом сохранении; нужен оригинал. |
| Текст нормальный, кроме нескольких строк | Файл мог быть собран из фрагментов с разными кодировками. |
| Excel портит CSV | Импортируйте через мастер данных и явно выберите UTF-8 и разделитель. |
Какой вариант выбрать
После восстановления храните обменную копию в UTF-8. Если файл предназначен для конкретной старой системы, уточните её требования и оставьте отдельную версию Windows-1251. Не меняйте расширение TXT на DOCX: кодировка от этого не исправится.
После исправления проверьте места, где ошибка заметнее всего: букву ё, кавычки, тире, символ рубля, номера телефонов и строки с латиницей. Затем закройте файл и откройте новую копию повторно — именно так проявляется неверно выбранная кодировка при сохранении. Если данные будут импортироваться в программу, сначала прогоните несколько строк и сравните результат, а не загружайте весь массив сразу.
Попробовать на копии файла
Работайте с отдельной копией. Перед использованием результата убедитесь: исправились начало и конец файла; кавычки, тире и знак рубля читаются; программа‑получатель открывает UTF‑8‑копию.
Открыть копию в TXT-редактореПрактический пример и проверка
Не нажимайте «Сохранить» поверх исходника с кракозябрами: повторное кодирование может окончательно потерять байты. Сравните несколько русских слов, кавычки и тире.
Перед тем как удалить исходник
- исправились начало и конец файла
- кавычки, тире и знак рубля читаются
- программа‑получатель открывает UTF‑8‑копию
Основной справочный источник: объяснение Unicode Consortium. Описания меню могут немного отличаться между версиями программ.
Частые вопросы
Читайте также
ДанныеВам прислали JSON: как открыть его, найти нужное и не сломать одной запятой
Как читать JSON без знаний программирования, красиво отформатировать данные и безопасно перевести таблицу в CSV или XLSX.
PDFPDF/A для архива: когда нужен и как проверить файл
Когда нужен PDF/A, чем он отличается от обычного PDF, какую версию выбрать по требованиям архива и как проверить соответствие валидатором.
ФотоGoogle Takeout выгрузил тысячи JSON рядом с фото: удалять их или спасать даты?
Что означают JSON-файлы в экспорте Google Photos, где остались даты и подписи и как разобрать Takeout без потери метаданных.