A-Parser - Парсер для многопоточного парсинга данных

Private Software
  • Как выгрузить архив сайта из Wayback Machine: CDX API, чистый HTML и Markdown

    Wayback Machine и A-Parser

    Старые статьи, цены и описания исчезают из живого веба вместе с редизайнами и удалёнными разделами. По данным Pew Research Center, 38% страниц из выборки 2013 года были недоступны к октябрю 2023 года. Снимки Wayback Machine помогают вернуть этот исторический слой, но обычный обход архива медленный и приносит в данные панели Wayback и служебные скрипты.

    В A-Parser для этой задачи есть два практических сценария:

    • 🧩 No-Code-конвейер: Net::HTTP -> HTML::ArticleExtractor получает URL через CDX API, скачивает чистые снимки и сохраняет результат в JSONL.
    • ⚙️ Готовый TypeScript-парсер JS::WaybackCDX: находит снимки, нормализует и дедуплицирует URL, очищает текст через Mozilla Readability и сохраняет отдельные Markdown-файлы с YAML Frontmatter.
    • 🧹 Режим id_: в ссылке на снимок убирает тулбар и внедрённые скрипты Wayback, чтобы в выгрузку попал исходный HTML страницы.

    🚀 Открыть руководство, скачать готовый парсер и пресеты

  • A-Parser 1.2.3593: обход защиты Google /goto, восстановлен SE::Yandex в HTTP и переписан Google Trends

    A-Parser

    Вышло свежее обновление A-Parser 1.2.3593. Коротко о ключевых изменениях:

    • Обход новой защиты Google: поддержан обход редиректов /goto (когда Google скрывает реальные ссылки из выдачи) и обновлен обход защиты.
    • SE::Yandex: восстановлена стабильная работа в режиме HTTP.
    • SE::Google::Trends с нуля: парсер полностью переписан, возвращен стабильный сбор и добавлена опция Parse to level для глубокого парсинга связанных трендов.
    • Стабильность FreeAI::ChatGPT: устранены утечки памяти при длительном сборе, ошибки селекторов и обрезание текста ответов.
    • Яндекс Карты и Whois: исправлены просадки скорости в Maps::Yandex и добавлено 12 новых доменных зон в Net::Whois.
    • А также другие улучшения и исправления.

    Подробный список изменений, инструкции по настройке и обсуждение релиза:
    👉 Читать подробнее на форуме A-Parser

  • Как собрать B2B-базу компаний с e-mail из Google Maps на полном автопилоте?

    Сбор базы компаний с e-mail из Google Maps

    Ручной сбор контактов для B2B-продаж и холодных рассылок отнимает кучу времени: найти организацию на картах, скопировать телефон и адрес, перейти на сайт и вручную искать раздел с контактами. На сотнях и тысячах организаций это превращается в бесконечную рутину.

    В A-Parser эту цепочку можно автоматизировать в один сквозной запуск: связка Maps::Google и HTML::EmailExtractor выгружает карточки организаций (название, телефон, адрес, рейтинг, отзывы, сайт) и сразу находит опубликованные публичные e-mail на их сайтах. Вместо «голого» списка почт получается готовая таблица с полным контекстом для персонализации.

    В статье разобрали пошаговую настройку связки, частые ошибки и приложили готовый пресет для импорта в один клик.

    🔗 Читать статью, посмотреть пример таблицы и скачать готовый пресет

    Telegram Affiliate

  • A-Parser — бонус до 15% на пополнение

    Новый личный кабинет A-Parser и бонус до 15%

    Мы обновили личный кабинет A-Parser. Теперь всё необходимое для работы собрано в одном месте:

    • информация о лицензии;
    • управление прокси;
    • пополнение баланса;
    • история платежей и доступных средств.

    В честь обновления действует специальное предложение на пополнение баланса:

    • при пополнении от $500 — дополнительно 10%;
    • при пополнении от $1,000 — дополнительно 15%.

    Максимальный размер бонуса не ограничен.

    Как это работает:

    • пополняете баланс на $500 — получаете $550;
    • пополняете баланс на $1,000 — получаете $1,150.

    Бонус можно использовать для оплаты продуктов и сервисов A-Parser. Акция действует при любом доступном способе оплаты.

    Пополнить баланс и получить бонус

    Telegram Affiliate

  • A-Parser: Google /goto, Unlimited-прокси и бонус

    Поддержка Google /goto, несколько Unlimited-подписок и бонус до 15%

    В A-Parser 1.2.3614 модуль SE::Google получил нативную поддержку нового формата ссылок Google /goto. Он декодирует ссылки на лету и возвращает прямые URL без дополнительных запросов по редиректам.

    Обновлено управление Unlimited-прокси:

    • несколько подписок в одном аккаунте для разных компьютеров и серверов;
    • отдельные тариф, количество потоков, период и IP-адрес доступа для каждой подписки;
    • автопродление с баланса и уведомления об окончании подписки.

    До 15 сентября действует бонус при пополнении баланса:

    • от $500 — 10%, на баланс поступит $550;
    • от $1 000 — 15%, на баланс поступит $1 150.

    Бонус действует при любом доступном способе оплаты и подходит для оплаты любых продуктов и сервисов A-Parser.

    Читать новость

    Telegram Affiliate

  • Обход /goto в SE::Google, восстановление GoogleAI, eBay, Wildberries и последний день бонуса до 15%

    A-Parser 1.2.3628

    🎁 15 сентября — последний день акции на пополнение баланса

    Напоминаем, что 15 сентября заканчивается специальное предложение на пополнение баланса в личном кабинете A-Parser:

    • при пополнении от $500 — бонус 10% (на баланс поступит $550);
    • при пополнении от $1 000 — бонус 15% (на баланс поступит $1 150).

    Количество пополнений не ограничено, акция действует на все способы оплаты.

    🔗 👉 🎁 Пополнить баланс и получить бонус 🎁

    Вышло обновление A-Parser 1.2.3628

    В этом релизе мы добавили решение проблемы с новой защитой Google, расширили возможности работы с нейросетями и восстановили работу популярных парсеров интернет-магазинов.

    Ключевые изменения релиза:

    • Обход /goto в SE::Google: Google начал скрывать реальные ссылки в выдаче за редиректами /goto. В парсере реализован новый нативный обход, а в переменную $serp добавлено поле $gotolink для точного сопоставления ссылок с исходным кодом страницы. Также обновлена работа парсера под Windows и Linux.
    • Выбор моделей в FreeAI::DeepAI: теперь можно выбирать нужную модель для генерации и анализа (доступны Standard, GPT-4o mini, GPT-5 Nano, Llama 3.3 70B, Gemini 2.5 Flash Lite, DeepSeek V4 Flash и др.).
    • Восстановление парсеров: полностью восстановлена работа Shop::eBay (включая сбор $old_price для Испании) и Shop::Wildberries::ProductInfo. Парсер FreeAI::GoogleAI переписан на Playwright.
    • Исправления в выдаче: в SE::DuckDuckGo добавлен сбор рекламных результатов; в SE::Yandex исправлен сбор доменов рекламы в мобайле и исключены популярные товары из результатов; в FreeAI::ChatGPT восстановлен вывод всех полей; в Net::HTTP исправлен Pages Count; в SE::Google::Images исправлена работа с каптчей.

    🔗 👉 Читать полный релиз и обсуждение на форуме 👈

    Telegram Affiliate

  • Без слов «вред» и «развод»: как искать в Google Suggest вопросы для проверки

    Google Suggest и A-Parser

    Цена, характеристики и преимущества не всегда отвечают на вопросы, которые возникают у человека перед действием. В новом исследовании показали, как собрать такие вопросы из нейтральных поисковых подсказок.

    A-Parser собирает и дедуплицирует фразы Google Suggest на двух уровнях. Gemini через OpenRouter получает полный список по каждому исходному запросу и возвращает короткий перечень возможных вопросов, сомнений и ограничений для проверки редактором. Это не частотность и не готовый диагноз аудитории.

    В теме — методика сбора, результаты и практический сценарий для FAQ, интервью и посадочных страниц.

    Читать исследование на форуме

  • 🍺 Мониторинг Reddit с AI-фильтрацией и алертами в Telegram — на примере r/Oktoberfest

    Мониторинг Reddit и A-Parser

    Новый практический кейс о том, как с помощью A-Parser отслеживать новые публикации на Reddit и получать в Telegram только действительно важные события.

    В качестве примера используется r/Oktoberfest: система ищет предложения и запросы на свободные места за столами, билеты и компанию, отсекая посты про погоду, одежду, транспорт и другие общие обсуждения.

    Цепочка работает полностью автоматически:
    Reddit::Posts → FreeAI::DeepAI → Net::HTTP

    • Сбор без дублей: встроенная база уникализации redditArticleSeen отсекает уже просмотренные записи, исключая повторные запросы к ИИ и дубликаты сообщений.
    • Смысловой фильтр: DeepAI извлекает категорию (SELL, BUY, COMPANY, ALERT) и отделяет целевой сигнал от обычного информационного шума сообщества.
    • Мгновенные алерты: Net::HTTP отправляет форматированное уведомление прямо в Telegram-чат или канал.

    Во время теста монитор обработал ~100 свежих постов и отобрал ровно 18 целевых событий. В статье подробно разобрана архитектура связки, нюансы классификации и приложен готовый пресет для импорта в один клик.

    👉 Читать практический кейс на форуме 👈


    🌐 Новые тарифы Premium Mix Proxy и бесплатный тест на 3 дня

    Мы также расширили линейку Premium Mix Proxy в личном кабинете и добавили 4 новых тарифа под разные сценарии:

    На неделю (под разовые проекты, тесты и небольшие объемы):

    • 20 ГБ на неделю — $19 → $0.95/ГБ (удобно зайти под конкретную задачу)
    • 400 ГБ на неделю — $200 → $0.50/ГБ (всего $0.50 за 1 ГБ для плотной работы)

    На месяц (под постоянные задачи и регулярный поток):

    • 100 ГБ на месяц — $85 → $0.85/ГБ
    • 200 ГБ на месяц — $140 → $0.70/ГБ

    Новые пробные тарифы:

    • Premium Mix Proxy — 3 ГБ на 3 дня БЕСПЛАТНО
    • Premium Proxy — 1 ГБ на 3 дня за $3 для новых пользователей

    Прокси подходят под любой софт, антидетект-браузеры (AdsPower, Dolphin, Octo), парсеры и скрипты (поддержка HTTP и SOCKS5, безлимитные потоки).

    👉 🎁 Подключить триал или выбрать тариф в личном кабинете 🎁

    Telegram Affiliate

  • 🛒 Как собрать поисковую выдачу Amazon в CSV с помощью A-Parser

    Shop::Amazon — поисковая выдача Amazon в CSV

    Подготовили пошаговое руководство по Shop::Amazon: от поискового запроса до готового CSV с данными товаров.

    Что можно собрать:

    • ASIN и название товара
    • текущую и зачёркнутую цену
    • рейтинг и количество отзывов
    • ссылку на товар и валюту

    В тестовом запуске собрали 275 листингов Amazon по запросу wireless headphones и отдельно разобрали цены, рейтинги, отзывы и дубли по ASIN.

    В статье — готовый шаблон CSV, рекомендации по прокси и геолокации, разбор типичных ошибок и готовый пресет A-Parser для импорта.

    Читать руководство и скачать готовые материалы

  • 🗺️ Как спарсить Google Maps в CSV без кода с помощью A-Parser

    Google Maps в CSV с помощью A-Parser

    Подготовили краткое руководство по Maps::Google: от списка поисковых фраз и обхода города до готового CSV с организациями.

    Что можно собрать:

    • названия и категории компаний
    • телефоны, сайты и адреса
    • рейтинги и количество отзывов
    • координаты и ссылки на карточки Google Maps

    В реальном тесте собрали 5 102 строки по автосервисам Санкт-Петербурга за 5 минут 30 секунд. В статье также разобрали 5 096 уникальных карточек, повторы по CID и заполненность полей.

    Внутри — готовый шаблон CSV, настройка прокси и Collect full region, подсказки для Excel и CRM, а также готовый пресет A-Parser для импорта.

    Читать руководство и скачать готовые материалы

  • A-Parser 1.2.3692 — улучшения SE::Google, новый FreeAI::Alice, GPT-6 Luna и восстановление парсеров

    A-Parser 1.2.3692

    Вышла версия 1.2.3692. В обновлении — новый парсер FreeAI::Alice, улучшения SE::Google и поддержка модели GPT-6 Luna.

    Что нового:

    • FreeAI::Alice — получение ответов нейросети Алиса с сайта alice.yandex.ru
    • SE::Google — обновлён обход защиты и подмены поисковой выдачи в desktop- и mobile-режимах
    • FreeAI::DeepAI — добавлена модель GPT-6 Luna
    • Cloudflare — обход снова стабильно работает на Unlimited-прокси

    Также восстановлена работа Rank::MajesticSEO, Shop::eBay и Shop::Wildberries, добавлена поддержка зон .eu, .es и .pt в Net::Whois, исправлены SE::Bing под Windows и сбор отзывов в Maps::Google::Reviews.

    Подробнее об обновлении на форуме

    Telegram Affiliate