Изменение кодировки текста из файла для Python
Написал простой код, который должен выбирать искомые данные со скачанной веб-страницы. Однако, выяснилось, что текст страницы в неподходящей кодировке(если я правильно понимаю, мне нужно сделать текст cp1251?)
Как я могу сменить кодировку средствами Python?
**Побочные вопросы:
Почему попытка создать срез строки после этого символа также приводит к ошибке?
Под первые ответы - прежний код имел примерно такой вид:
f = open('1.html', 'r')
a = f.read()
a = a[11: len(a)]"""Здесь уже ошибка"""
Ответы (2 шт):
Автор решения: Elusha
→ Ссылка
Так как вы не приложили код, то просто предположу, что вам может помочь это:
open(filename, 'r', encoding='utf-8') # или 'cp1251'
Автор решения: Nikassaiop End
→ Ссылка
Решение было найдено координально, я больше не читаю из файла, а скачиваю страницу в переменную с помощью библиотеки urllib. Всем спасибо за помощь!
