Выделение новостей по смыслу средствами ЯП Python
Есть сайт https://www.e-disclosure.ru/, на котором публикуются существенные факты. Я бы хотел из всего потока публикаций выделять новости о покупках акций, например, членами советов директоров и прочими значимыми сотрудниками. Примеры:
- https://www.e-disclosure.ru/portal/event.aspx?EventId=Kz8OF64EgkuXBAQ-CI9cC7w-B-B&attempt=1.
- https://e-disclosure.ru/portal/event.aspx?EventId=iDzfJ6upjkSatcSxMjL5yg-B-B&q=xOXt6PHu4iDe8OjpIM7r5ePu4uj3IA%3d%3d
- https://e-disclosure.ru/portal/event.aspx?EventId=226Efm5JkkyXTj3AoHSVoA-B-B&q=weXr7uru7%2fvy7uI%3d
Предполагаю, что будет происходить скачивание страницы, и прогон через некий анализатор (нейронная сеть или типа того).
Прошу подсказать, как можно реализовать данную задачу?
P.S. Готовых решений не прошу