vvs35.ru боты, парсеры, серверы
УслугиГотовые решенияБлог принимаем заказы

Парсер сайта с выгрузкой в Excel

Соберу товары, цены, характеристики или контакты в таблицу — разово или по расписанию. Стоит от 2 000 ₽, делается за 1–3 дня. Проверить, как это работает, можно прямо сейчас: демо-парсер обходит каталог у вас на глазах.

Цена
от 2 000 ₽
Срок
1–3 дня
Формат
xlsx, CSV, Google Таблица
Документы
договор и чек

Что и за сколько собираю

ЗадачаЦена отСрок
Разовый сбор каталогаНазвание, цена, наличие, характеристики, фото и ссылка — одним файлом 2 000 ₽ 1–2 дня
Мониторинг цен конкурентовЕжедневный сбор, история изменений, уведомление при падении цены ниже вашей 4 000 ₽ 3–5 дней
Сбор контактов из каталогаКомпании, телефоны, сайты и адреса из открытых справочников и агрегаторов 2 000 ₽ 1–3 дня
Наполнение своего сайтаТовары поставщика приводятся к вашей структуре и загружаются в CMS 3 500 ₽ 2–4 дня
Обработка выгрузки поставщикаРазбор XML или прайса в Excel, сведение остатков, подготовка к импорту 2 000 ₽ 1–2 дня

Цена указана за один источник. Второй сайт со схожей структурой — примерно плюс день. Точную сумму назову, когда посмотрю страницу, с которой нужно собирать.

Прикинуть сумму под свою задачу можно в калькуляторе

Демо: посмотрите, прежде чем платить

работает без регистрации

Честно о границах

чтобы вы не платили за то, что развалится через неделю

Крупные площадки с активной защитой не беру

Авито, Циан, Wildberries и подобные закрываются капчей, проверкой отпечатка браузера и блокировкой по адресу. Такие парсеры живут неделями, ломаются после каждого обновления сайта и создают риски для заказчика. Если у площадки есть официальный API или выгрузка для партнёров — работаю через них, это и надёжнее, и дешевле в поддержке.

Любой парсер однажды сломается

Он зависит от чужой вёрстки, а её меняют без предупреждения. Поэтому в парсер сразу закладывается проверка: если структура страницы изменилась или данных пришло подозрительно мало, вы получаете уведомление в Telegram, а не тишину и пустую таблицу через месяц.

Персональные данные — нет

Сбор общедоступной информации о компаниях и товарах — обычная практика. Сбор личных данных людей — нет, независимо от бюджета.

Скорость упирается в чужой сервер

Сбор идёт асинхронно и в несколько потоков, но с ограничением: сайт-источник нельзя заваливать запросами. Демо на этом сайте собирает сотню позиций за 5,5 секунды — на реальных каталогах в тысячи товаров счёт идёт на минуты, и это нормальный темп, а не медленный.

Как устроен парсер, который не приходится чинить каждую неделю

Асинхронный сбор

Несколько страниц одновременно, но с ограничителем: источник получает предсказуемую нагрузку и не блокирует нас.

Дедупликация

Записи сверяются по идентификатору товара, а не по строке. Иначе ежедневный сбор превращается в свалку дублей.

История цен

Сохраняются изменения, а не только последний снимок. Видно, кто и когда поднял цену.

Запуск по расписанию

Через systemd-таймер, а не cron: при сбое парсер перезапускается, а вы получаете уведомление.

Понятная таблица

Автофильтры, лист сводки, числа как числа. Файл сразу пригоден для работы, а не для ручной доводки.

Логи и уведомления

Каждый запуск оставляет след: сколько собрано, что изменилось, где были ошибки.

Частые вопросы

Сколько стоит парсер сайта?

От 2 000 ₽ за разовый сбор с одного сайта с выгрузкой в Excel. Парсер с расписанием, базой и историей цен — от 4 000 ₽. Каждый следующий источник со схожей структурой добавляет примерно день работы.

Сколько времени занимает разработка?

От 1 до 3 дней для одного источника. Ежедневный сбор с базой и уведомлениями — 3–5 дней.

Законно ли это?

Сбор общедоступных данных, которые сайт показывает любому посетителю, законом не запрещён. Проблемы возникают в трёх случаях: персональные данные, обход защиты и авторизации, публикация чужого контента как своего. Пользовательское соглашение источника при этом остаётся в силе — его нарушение это спор между вами и владельцем сайта, и я предупреждаю о таком заранее.

Можно ли спарсить Авито, Циан или Wildberries?

Не берусь: там активная защита, и такой парсер ломается постоянно. Если у площадки есть официальный API или партнёрская выгрузка — работаю через них.

В каком виде я получу данные?

Файл xlsx с автофильтрами и листом сводки, CSV или Google Таблица. При регулярном сборе данные ещё и копятся в базе, чтобы была видна динамика.

Что если сайт-источник изменится?

Парсер это заметит и пришлёт уведомление, а не будет молча собирать пустоту. Починка после изменений на стороне источника — отдельная небольшая работа, обычно час-два.

Нужен ли для этого сервер?

Для разового сбора — нет, просто передаю файл. Для регулярного нужен VPS от 200 ₽ в месяц: настройку расписания, логов и уведомлений беру на себя.

Пришлите ссылку на страницу, с которой нужно собрать данные. Посмотрю структуру и скажу, реально ли это, сколько займёт и во что обойдётся.

Написать в Telegram @vvs35_bot

Статьи по теме

Другие услуги