Перейти к содержимому

Как utf 8 перевести в текст в excel

  • автор:

Выбор кодировки текста при открытии и сохранении файлов

Как правило, при совместной работе с текстовыми файлами нет необходимости вникать в технические аспекты хранения текста. Однако если необходимо поделиться файлом с человеком, который работает с текстами на других языках, скачать текстовый файл из Интернета или открыть его на компьютере с другой операционной системой, может потребоваться задать кодировку при его открытии или сохранении.

Когда вы открываете текстовый файл в Microsoft Word или другой программе (например, на компьютере, язык операционной системы на котором отличается от того, на котором написан текст в файле), кодировка помогает программе определить, в каком виде нужно вывести текст на экран, чтобы его можно было прочитать.

В этой статье

  • Общие сведения о кодировке текста
  • Выбор кодировки при открытии файла
  • Выбор кодировки при сохранении файла
  • Поиск кодировок, доступных в Word

Общие сведения о кодировке текста

То, что отображается на экране как текст, фактически хранится в текстовом файле в виде числового значения. Компьютер преобразует числические значения в видимые символы. Для этого используется кодикон.

Кодировка — это схема нумерации, согласно которой каждому текстовому символу в наборе соответствует определенное числовое значение. Кодировка может содержать буквы, цифры и другие символы. В различных языках часто используются разные наборы символов, поэтому многие из существующих кодировок предназначены для отображения наборов символов соответствующих языков.

Различные кодировки для разных алфавитов

Сведения о кодировке, сохраняемые с текстовым файлом, используются компьютером для вывода текста на экран. Например, в кодировке «Кириллица (Windows)» знаку «Й» соответствует числовое значение 201. Когда вы открываете файл, содержащий этот знак, на компьютере, на котором используется кодировка «Кириллица (Windows)», компьютер считывает число 201 и выводит на экран знак «Й».

Однако если тот же файл открыть на компьютере, на котором по умолчанию используется другая кодировка, на экран будет выведен знак, соответствующий числу 201 в этой кодировке. Например, если на компьютере используется кодировка «Западноевропейская (Windows)», знак «Й» из исходного текстового файла на основе кириллицы будет отображен как «É», поскольку именно этому знаку соответствует число 201 в данной кодировке.

Юникод: единая кодировка для разных алфавитов

Чтобы избежать проблем с кодированием и декодированием текстовых файлов, можно сохранять их в Юникоде. В состав этой кодировки входит большинство знаков из всех языков, которые обычно используются на современных компьютерах.

Так как Word работает на базе Юникода, все файлы в нем автоматически сохраняются в этой кодировке. Файлы в Юникоде можно открывать на любом компьютере с операционной системой на английском языке независимо от языка текста. Кроме того, на таком компьютере можно сохранять в Юникоде файлы, содержащие знаки, которых нет в западноевропейских алфавитах (например, греческие, кириллические, арабские или японские).

Выбор кодировки при открытии файла

Если в открытом файле текст искажен или выводится в виде вопросительных знаков либо квадратиков, возможно, Word неправильно определил кодировку. Вы можете указать кодировку, которую следует использовать для отображения (декодирования) текста.

  1. Откройте вкладку Файл.
  2. Нажмите кнопку Параметры.
  3. Нажмите кнопку Дополнительно.
  4. Перейдите к разделу Общие и установите флажокПодтверждать преобразование формата файла при открытии.

Примечание: Если установлен этот флажок, Word отображает диалоговое окно Преобразование файла при каждом открытии файла в формате, отличном от формата Word (то есть файла, который не имеет расширения DOC, DOT, DOCX, DOCM, DOTX или DOTM). Если вы часто работаете с такими файлами, но вам обычно не требуется выбирать кодировку, не забудьте отключить этот параметр, чтобы это диалоговое окно не выводилось.

Если почти весь текст выглядит одинаково (например, в виде квадратов или точек), возможно, на компьютере не установлен нужный шрифт. В таком случае можно установить дополнительные шрифты.

Чтобы установить дополнительные шрифты, сделайте следующее:

  1. Нажмите кнопку Пуск и выберите пункт Панель управления.
  2. Выполните одно из указанных ниже действий. В Windows 7
    1. На панели управления выберите раздел Удаление программы.
    2. В списке программ щелкните Microsoft Office или Microsoft Word, если он был установлен отдельно от пакета Microsoft Office, и нажмите кнопку Изменить.

    В Windows Vista

    1. На панели управления выберите раздел Удаление программы.
    2. В списке программ щелкните Microsoft Office или Microsoft Word, если он был установлен отдельно от пакета Microsoft Office, и нажмите кнопку Изменить.

    В Windows XP

    1. На панели управления щелкните элемент Установка и удаление программ.
    2. В списке Установленные программы щелкните Microsoft Office или Microsoft Word, если он был установлен отдельно от пакета Microsoft Office, и нажмите кнопку Изменить.

    Совет: При открытии текстового файла в той или иной кодировке в Word используются шрифты, определенные в диалоговом окне Параметры веб-документа. (Чтобы вызвать диалоговое окно Параметры веб-документа, нажмите кнопку Microsoft Office, затем щелкните Параметры Word и выберите категорию Дополнительно. В разделе Общие нажмите кнопку Параметры веб-документа.) С помощью параметров на вкладке Шрифты диалогового окна Параметры веб-документа можно настроить шрифт для каждой кодировки.

    Выбор кодировки при сохранении файла

    Если не выбрать кодировку при сохранении файла, будет использоваться Юникод. Как правило, рекомендуется применять Юникод, так как он поддерживает большинство символов большинства языков.

    Если документ планируется открывать в программе, которая не поддерживает Юникод, вы можете выбрать нужную кодировку. Например, в операционной системе на английском языке можно создать документ на китайском (традиционное письмо) с использованием Юникода. Однако если такой документ будет открываться в программе, которая поддерживает китайский язык, но не поддерживает Юникод, файл можно сохранить в кодировке «Китайская традиционная (Big5)». В результате текст будет отображаться правильно при открытии документа в программе, поддерживающей китайский язык (традиционное письмо).

    Примечание: Так как Юникод — это наиболее полный стандарт, при сохранении текста в других кодировках некоторые знаки могут не отображаться. Предположим, например, что документ в Юникоде содержит текст на иврите и языке с кириллицей. Если сохранить файл в кодировке «Кириллица (Windows)», текст на иврите не отобразится, а если сохранить его в кодировке «Иврит (Windows)», то не будет отображаться кириллический текст.

    Если выбрать стандарт кодировки, который не поддерживает некоторые символы в файле, Word пометит их красным. Вы можете просмотреть текст в выбранной кодировке перед сохранением файла.

    При сохранении файла в виде кодированного текста из него удаляется текст, для которого выбран шрифт Symbol, а также коды полей.

    Выбор кодировки

    1. Откройте вкладку Файл.
    2. Выберите пункт Сохранить как. Чтобы сохранить файл в другой папке, найдите и откройте ее.
    3. В поле Имя файла введите имя нового файла.
    4. В поле Тип файла выберите Обычный текст.
    5. Нажмите кнопку Сохранить.
    6. Если появится диалоговое окно Microsoft Office Word — проверка совместимости, нажмите кнопку Продолжить.
    7. В диалоговом окне Преобразование файла выберите подходящую кодировку.
    8. Чтобы использовать стандартную кодировку, выберите параметр Windows (по умолчанию).
    9. Чтобы использовать кодировку MS-DOS, выберите параметр MS-DOS.
    10. Чтобы задать другую кодировку, установите переключатель Другая и выберите нужный пункт в списке. В области Образец можно просмотреть текст и проверить, правильно ли он отображается в выбранной кодировке.

    Примечание: Чтобы увеличить область отображения документа, можно изменить размер диалогового окна Преобразование файла.

    Поиск кодировок, доступных в Word

    Word распознает несколько кодировок и поддерживает кодировки, которые входят в состав системного программного обеспечения.

    Ниже приведен список письменностей и связанных с ними кодировок (кодовых страниц).

    Система письменности

    Используемый шрифт

    Юникод (UCS-2 с прямым и обратным порядком байтов, UTF-8, UTF-7)

    Стандартный шрифт для стиля «Обычный» локализованной версии Word

    Windows 1256, ASMO 708

    Китайская (упрощенное письмо)

    GB2312, GBK, EUC-CN, ISO-2022-CN, HZ

    Китайская (традиционное письмо)

    BIG5, EUC-TW, ISO-2022-TW

    Windows 1251, KOI8-R, KOI8-RU, ISO8859-5, DOS 866

    Английская, западноевропейская и другие, основанные на латинице

    Windows 1250, 1252-1254, 1257, ISO8859-x

    VBA Excel. Смена кодировки UTF-8 на ANSI (Windows-1251)

    Перекодировка строки с UTF-8 в ANSI (Windows-1251) может понадобиться в VBA, например, при загрузке данных из CSV-файла с кодировкой UTF-8 на рабочий лист книги Excel.

    Смена кодировки UTF-8 на Windows-1251

    Изменение кодировки текста UTF-8 на ANSI (Windows-1251) для 32-разрядных платформ:

    Private Declare Function MultiByteToWideChar Lib «kernel32.dll» ( ByVal CodePage As Long , ByVal dwFlags As Long , ByVal lpMultiByteStr As String , ByVal cchMultiByte As Long , ByVal lpWideCharStr As Long , ByVal cchWideChar As Long ) As Long

    Function FromUTF8 ( ByVal sText As String ) As String
    Dim nRet As Long , strRet As String
    strRet = String ( Len ( sText ) , vbNullChar )

    nRet = MultiByteToWideChar ( 65001 , & H0 , sText , Len ( sText ) , StrPtr ( strRet ) , Len ( strRet ) )

    FromUTF8 = Left ( strRet , nRet )
    End Function

    Пример перекодировки строки с UTF-8 в ANSI (Windows-1251):

    Sub Primer ( )
    Dim num1 As Integer , a1 As String , str1 As String
    ‘Выбираем файл CSV с кодировкой UTF-8
    a1 = Application . GetOpenFilename ( «Текст с разделителями,*.csv» , , «Выбор файла» )
    If Right ( a1 , 4 ) <> «.csv» Then Exit Sub
    ‘Открываем файл и считываем текст в переменную
    num1 = FreeFile
    Open a1 For Input As num1
    str1 = Input ( LOF ( num1 ) , num1 )
    Close num1
    ‘Меняем кодировку с UTF-8 на Windows-1251
    str1 = FromUTF8 ( str1 )
    ‘Работаем с текстом и вставляем нужные значения на рабочий лист

    Преобразование кодировки ANSI в UTF-8

    Изменение кодировки текста ANSI (Windows-1251) на UTF-8 для 32-разрядных платформ:

    Private Declare Function WideCharToMultiByte Lib «kernel32.dll» ( ByVal CodePage As Long , ByVal dwFlags As Long , ByVal lpWideCharStr As Long , ByVal cchWideChar As Long , ByVal lpMultiByteStr As Long , ByVal cchMultiByte As Long , ByVal lpDefaultChar As Long , ByVal lpUsedDefaultChar As Long ) As Long

    Function ToUTF8 ( ByVal sText As String ) As String
    Dim nRet As Long , strRet As String
    strRet = String ( Len ( sText ) * 2 , vbNullChar )

    nRet = WideCharToMultiByte ( 65001 , & H0 , StrPtr ( sText ) , Len ( sText ) , StrPtr ( strRet ) , Len ( sText ) * 2 , 0 & , 0 & )

    ToUTF8 = Left ( StrConv ( strRet , vbUnicode ) , nRet )
    End Function

    Пример перекодировки строки с ANSI (Windows-1251) в UTF-8:

    str1 = ToUTF8 ( str1 )

    Изменение кодировки в 64-разрядных системах

    Если у вас 64-разрядная версия VBA Excel, добавьте ключевое слово PtrSafe после оператора Declare и замените тип данных Long на LongPtr:

    Private Declare PtrSafe Function MultiByteToWideChar Lib «kernel32.dll» ( ByVal CodePage As LongPtr , ByVal dwFlags As LongPtr , ByVal lpMultiByteStr As String , ByVal cchMultiByte As LongPtr , ByVal lpWideCharStr As LongPtr , ByVal cchWideChar As LongPtr ) As LongPtr

    Private Declare PtrSafe Function WideCharToMultiByte Lib «kernel32.dll» ( ByVal CodePage As LongPtr , ByVal dwFlags As LongPtr , ByVal lpWideCharStr As LongPtr , ByVal cchWideChar As LongPtr , ByVal lpMultiByteStr As LongPtr , ByVal cchMultiByte As LongPtr , ByVal lpDefaultChar As LongPtr , ByVal lpUsedDefaultChar As LongPtr ) As LongPtr

    В среде разработки VBA 7 тип данных LongPtr на 32-разрядных платформах интерпретируется как Long, а в 64-разрядных — как LongLong.

    Содержание рубрики VBA Excel по тематическим разделам со ссылками на все статьи.

    Продукты и готовые блюда на дом! Самокат доставка >>
    Бесплатная доставка продуктов на дом за 15-30 минут
    (Реклама. ООО «Умный ритейл». ИНН: 7811657720)

    Как исправить кодировку текста в Excel?

    Подскажите как исправить символы в Excel? Недавно обнаружил, что поиск не находит обычный текст в Excel.
    Т.е. набираю в поиске «Алена» (а тм куча ячеек с этим именем), пишет ничего не найдено. Но когда в строку поиску вставляю только что скопированный в буфер из ячейки текст, то он волшебным образом находится. Протестировал всё это в notepad++, оказывается там тоже не находит скопированный из ячейки текст если потом в строке поиска набирать вручную.
    Опытным путём через urlencode выяснилось, что первые буквы слов в ячейке в другом формате. Т.е. напр. если написано «Алена Толбухина», то буквы А и Т в формате как я понял ascii, а остальные в unicode. Уж не знаю как так получается в Excel, но это факт (может просто копировал с какого-то нехорошего сайта текст я уж не помню).

    Через URL-encode получается следующее:
    Α — %CE%91
    А — %D0%90

    Τ — %CE%A4
    Т — %D0%A2

    На тостере кстати видно что эти символы даже выглядят по-разному.

    Теперь я не могу эти буквы преобразовать в unicode.
    Вставляю символ Α в notepad++, жму «преобразовать в UTF-8», сохраняю. Но остаётся всё равно старый формат. Т.е. прогоняю этот символ через urlencoder.org, и всё равно получаю %CE%91. Как преобразовать всё в unicode?

    • Вопрос задан более трёх лет назад
    • 504 просмотра

    Что делать, если в текстовом файле неверная кодировка (каракули)?

    Рассмотрим в данной инструкции, что делать, если Вы открыли или загружаете файл, а там «каракули»?

    Файл с неверной кодировкой выглядит примерно так (рис.1):

    Иногда вместо нормально текста в текстовом файле может быть вот такое

    Рисунок 1.

    Причина этому неверная кодировка, поэтому кодировку файла надо изменить. Для этого нам понадобится перейти на сайт Notepad++ и скачать последнюю актуальную версию программы. На текущий момент актуальная версия 8.1.4, скачиваем программу и устанавливаем (рис.2).

    Нам понадобится скачать и установить программу Notepad++ вот отсюда

    Рисунок 2.

    Далее кликом правой клавиши мыши откройте Ваш файл через Notepad++ и через меню «Кодировки»- «Преобразовать в UTF-8» или «Encoding» -«Convert to UTF-8» преобразуйте кодировку файла, далее сохраните файл (рис. 3.).

    Далее открываем нужный файл через программу Notepad++ и через меню

    «Преобразовать в UTF-8″ исправляем кодировку файла» />
    Рисунок 3.

    Готово. Мы рассмотрели, что делать, если Ваш файл имеет неверную кодировку.

    Другие статьи по теме

    • Договор и документы
    • Дополнительные сервисы
    • Можно ли выкупить магазин в облаке/купить лицензию для магазина в облаке?
    • На каком языке программирования реализован магазин?
    • Через какое время сайт появится в поисковых системах?

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

https://kapelnicza.vyvod-iz-zapoya-na-domu-voronezh.ru/