FoxTools v.2.0
Кодировка (кодовая страница) – это набор байт, соответствующий печатному символу. Это правила по которым компьютер представляет текстовые данные пользователю.
В разных странах и системах могут использоваться разные кодовые страницы.
Для кодирования русскоязычных текстов используются кодировки: Windows-1251, KOI8, MacCyrillic, а также универсальная таблица символов — Юникод (UTF-8).
Только популярные кодировки или все?
Универсальный декодер текста способен автоматически определять кодовую страницу текста. При этом, пользователю предлагаются варинты текста кодированные между разными кодовыми страницами. При включенной опции «только популярные кодировки» количество вариантов будет минимальным, что гораздо удобней при поиске необходимой пары кодовых страниц. Если включить опцию «все кодировки», то в списке будет гораздо больше вариантов кодированного текста, и найти подходящий будет сложно. В большинстве случаев, использование только популярных кодировок вполне оправдано.
Сайт построен на HTML5
Для корректной работы данного сайта требуется HTML5.
Пожалуйста, воспользуйтесь браузером, который поддерживает HTML5. Многие современные браузеры поддерживают HTML5. Например:
Перекодировка текста UTF-8 и WINDOWS-1251
Проблема кодировок часто возникает при написании парсеров, чтении данных из xml и CSV файлов. Ниже представлены способы эту проблему решить.
windows-1251 в UTF-8
UTF-8 в windows-1251
Когда ни что не помогает
Иногда доходит до бреда, но работает:
File_get_contents / CURL
Ещё бывают случаи, когда file_get_contents() возвращает текст в виде:
Это сжатый текст в GZIP, т.к. функция не отправляет правильные заголовки. Решение проблемы через CURL: