Что это. Автоматический сбор цен, карточек товаров или данных реестров с выбранных сайтов в таблицу, CSV, JSON или XML.
От чего цена. От числа источников, объёма, частоты обновления, защиты сайтов, формата выдачи и поддержки после запуска.
Как считаем. Сначала проверяем источники и собираем пробную выборку, цену называем после неё — и по ходу работ она не меняется.
Где работаем. Удалённо по всей России, в том числе с Москвой; офис — в Екатеринбурге.
Код, который забирает данные с одной страницы, пишется быстро. Дорого другое — чтобы данные приходили каждый день, были полными и не ломались, когда сайт-источник что-то поменял. Поэтому стоимость парсинга складывается из двух частей: разовой настройки и сопровождения.
Разовая настройка — это разбор источников, сборщик под каждый сайт, очистка и сведение данных в единый формат, выдача туда, где вы с ними работаете. Сопровождение — наблюдение за тем, что сбор идёт, и правки, когда источник меняет вёрстку.
Каждый сайт устроен по-своему, и под каждый пишется свой сборщик. Десять магазинов на одной платформе обычно обходятся дешевле, чем десять совсем разных сайтов. Поэтому первое, о чём мы спрашиваем, — список ссылок.
Собрать цены со страницы категории — одно, пройти весь каталог с характеристиками, фотографиями и вариантами товара — другое. Важен и объём: сотни карточек и сотни тысяч карточек — разная нагрузка и на источник, и на время сбора.
Раз в месяц для аналитики, раз в день для мониторинга цен или несколько раз в день, если конкуренты меняют цены часто. Чем чаще сбор, тем важнее его устойчивость и тем больше работы в сопровождении.
Открытый каталог собирается просто. Сложнее, если цены видны только после выбора города, подгружаются скриптом, а сайт ограничивает число запросов. Если источник прямо закрывает данные от автоматического сбора, разумнее поискать официальную выгрузку, API или договориться с владельцем данных — это обсуждаем на этапе проверки источников.
Таблица, CSV, JSON или XML — базовые варианты. Работы больше, если данные нужно сопоставить с вашим каталогом (найти «тот же товар» у конкурента под другим названием), загрузить в 1С, CRM или учётную систему либо собирать отчёт об изменениях цен.
Сайты меняют разметку, и тогда сбор требует доработки. Это нормальная часть жизни парсера, а не поломка. Условия сопровождения — кто правит и в какой срок — мы обсуждаем до запуска, чтобы они не стали сюрпризом.
Разовая выгрузка — например, собрать каталог поставщика, чтобы завести товары у себя, — проще и дешевле: сборщик отработал, данные проверены, задача закрыта. Регулярный сбор — это уже маленькая система: расписание, проверка, что данные пришли, уведомление, если источник перестал отдавать страницы, и правки при изменениях сайта. Если вы пока не уверены, что данные будут нужны постоянно, начните с разового сбора и посмотрите, как ими пользуются.
Подробнее об услуге — на странице парсинга сайтов. Если собранные данные потом вручную превращаются в отчёты, посмотрите автоматизацию Excel-отчётов и автоматизацию работы с документами.
Цена зависит от числа источников, объёма, частоты обновления, защиты сайтов, формата выдачи и сопровождения. Мы называем её после проверки источников и пробной выборки, а не по прайсу.
Это парсинг с регулярным обновлением и сопоставлением товаров. Сильнее всего на цену влияют число конкурентов, частота сбора и то, насколько сложно сопоставить их товары с вашими.
Сбор может потребовать доработки. Условия сопровождения — кто правит и в какой срок — согласуем до запуска.
В таблице, CSV, JSON или XML, со ссылкой на источник и датой обновления у каждой записи. Возможна загрузка в вашу учётную систему.
Да. Работаем удалённо по всей России, офис — в Екатеринбурге.
Читайте дальше: Парсинг сайтов: цены, каталоги и реестры, Отчёты вместо ручного Excel, Excel-отчёты на Python — кейс, Фоновые ИИ-агенты по расписанию.
Добавьте ссылки на сайты, нужные поля и частоту обновления. Проверим возможность сбора и предложим формат результата. Обычно отвечаем в тот же рабочий день.