Your browser does not seem to support JavaScript. As a result, your viewing experience will be diminished, and you have been placed in read-only mode.
Please download a browser that supports JavaScript, or enable it if it's disabled (i.e. NoScript).
Есть ли простой способ получить из html кода страницы его текстовую версию? Просто текст, md разметка или другие варианты - всё подошло бы.
document.body.outerText
так пойдёт?
Не совсем, так как будет много мусора (навигация, сайдбары и т.д.), но спасибо.
Решил эту задачу подключением Node.js и библиотеки html-to-text.
@FastSpace said in Таймаут во время выполнения LoadPage data:text/plain:
Уже 100500 раз решение этой проблемы известно.
hello , Can you help me this issue ?
@Fox Большое спасибо, сработало!
@Fox Спасибо за правильное направление. Сжал код через компрессор и сделал по аналогии с вашим постом, вроде сработало. Спасибо большое за помощь! https://community.bablosoft.com/post/69351
@GhostZ А, через "Подробнее" нужно входить. Кек, спасибо!
@brotok said in Как сделать парьсинг то ли html, то ли текстовой страницы (фрагмента)?:
XPATH> //center[contains(text(),'Раздел IV')]/following::table/tbody/tr[4]/td[10] Спасибо! я так понимаю надо просто цифру менять и все, чтобы другие ячейки вылавливать?
XPATH> //center[contains(text(),'Раздел IV')]/following::table/tbody/tr[4]/td[10]
Спасибо! я так понимаю надо просто цифру менять и все, чтобы другие ячейки вылавливать?
Да, если таблицы на других страницах схожие. В ином случае, придется изменять немного xpath