https://docs.google.com/document/d/1PdfKMDfoqFIlF4tN1jKrOf1iZ1rqESy2xVMIj3uuV3g/pub#h.jb66b5al5oaq
https://xsltdev.ru/xpath/starts-with/
http://internetka.in.ua/xpath-start-part3/
Мануалы по xpath..
Xpath получить каждый xml
К примеру, мне нужно спарсить все ссылки которые содержат "profile" с помощью xpath. Как заполнить поля? То что я нагуглил не работает)
@woodenfart нажмите на елементе и выбирете Изучить, а в исходном коде на ссылке можете скопировать как xpath
Спасибо, разобрался с xpath. Сохраняет в файле все в одну строку, при том что стоит "Добавить символ окончание строки". Нужно что бы в столбик записывало. Как решить? И еще, на выходе получаются вот такие ссылки: /profile-example . Возможно ли получить полные ссылки?
@woodenfart said in Как спарсить?:
Спасибо, разобрался с xpath. Сохраняет в файле все в одну строку, при том что стоит "Добавить символ окончание строки". Нужно что бы в столбик записывало. Как решить? И еще, на выходе получаются вот такие ссылки: /profile-example . Возможно ли получить полные ссылки?
Это называется относительные ссылки. На сайтах редко пишут полные. В коде страницы такие ссылки, поэтому и на выходе они такие. Вывод - дописывать начало ссылки вручную. Оно везде будет одинаковое.
Накатал скрипт) Спасибо за помощь! Разработчики молодцы)
@karpekin said in Как спарсить?:
Парсю сайты с помощью Datacol.
Рекламировать свой/чужой софт можно только в "Off topic".