Parsing BS4 problem
Нужно взять с сайта определенные цифры, вкратце это сайт таймера, взять эти цифры можно либо из
<title>8 дн. 19:01:27 - Таймер онлайн - Таймер обратного отсчета</title>
либо из самого кода,
<div id="pnl-time" style="display: block; position: relative; width: 662px; height: 128px; left: 536px; top: 135.6px;">
<span id="lbl-time" class="colored digit text-nowrap font-digit" style="font-size: 128px;">8<span class="font-sans text-normal text-rel-40"> дн.</span> 19:01:27</span>
</div>
оба раза когда я находил нужный мне элемент мне писало : C:/Users/b567/PycharmProjects/Bot_tg/parser.py
Таймер онлайн - Таймер обратного отсчета Process finished with exit code 0я думал можно я свойства запуска прописал не так, но вроде все как надо. Но между "Таймер онлайн - Таймер обратного отсчета" есть цифры когда я смотрю через код элемента
import requests
from bs4 import BeautifulSoup
URL = 'https://budilki.ru/timer/#date=2021-05-12T19:40:00'
HEADERS = {'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/90.0.4430.93 Safari/537.36', 'accept': '*/*'}
def get_html(url,params=None):
r = requests.get(url, headers=HEADERS, params=params)
return r
def get_content(html):
soup = BeautifulSoup(html, 'html.parser')
items = soup.find('title')
print(items)
def parse():
html = get_html(URL)
if html.status_code == 200:
get_content(html.text)
else:
print('Error')
parse()
Я подозреваю что тут виноват JS и мне так просто не взять цифры без его выполнения