Регулярные выражения - извлечь все данные.
Туда пихаю такую регулярку: <a\ href="+([\s\S]+)"+
Регулярку составлял через онлайн конструктор.
На выходе получаю SCAN RESULT LIST с кучей мусора.
Как грамотно выпарсить только ссылочки со страницы?
Как обычно сразу спрашиваю потом ищу ответ на форуме. Разобрался как через хпатч вытащить все ссылки через получить каждый xml/
Помогите теперь как изменить регулярку //a/@href
что бы парсились только те ссылки, в которых в урл есть вхождение "page"
Никак. "Заканчивается на" это функция второй аргумент которой ("Подстрока") - строковой тип и засунуть туда логическое выражения нельзя, удивительно, что у тебя вообще такая ("2111") || ("1222") конструкция работала.
Если тебе нужно чекать много значений создай отдельную функцию, все значения закидывай в список и в новосозданной функции пробегайся по нему циклом, дальше смотря какой возврат функции нужен.
Блин спасибо большое, я чет не допер до этого, это очень сократило количество действий.