Проблемы с HTML при закачке страницы с Авито
В обучающих целях пишу парсер на авито.
Скрипт выдаёт странный результат именно при попытке скачать страницу поиска Авито. Например раздел грампластинки: https://www.avito.ru/rossiya/kollektsionirovanie/gramplastinki-ASgBAgICAUQcjkw
Код возвращает:
%22%3Atrue%2C%22newDoublesUxTest%22%3Afalse%2C%22newDoublesUxRealtyTest%22%3Afalse%2C%22newDoublesMapRealtyTest%22%3Afalse%2C%22simpleCounters%22%3Atrue%2C%22isRatingExperiment%22%3Afalse%2C%22isContactsButtonRedesigned%22%3
*это, само собой, часть)
При этом другие страницы, в том числе страницы внутри объявлений возвращаются нормально в html разметке.
Код:
import requests
class AvitoParser:
def __init__(self):
self.session = requests.Session()
self.session.headers = {
'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/93.0.4577.82 Safari/537.36',
'Accepted-Language': 'ru'
}
def get_page(self, page: int = None):
params = {'s': 104} # параметр сортировки по дате
if page and page > 1:
params['page'] = page
url = 'https://www.avito.ru/rossiya/kollektsionirovanie/gramplastinki-ASgBAgICAUQcjkw'
r = self.session.get(url, params=params)
return r.text
def get_blocks(self):
text = self.get_page(page=1)
print(text)
return
def main():
parcer = AvitoParser()
parcer.get_blocks()
if __name__ == '__main__':
main()
Пробовал также HTMLSession. Результат тот же.
Заранее спасибо за помощь!