Все локации активны · 99.99% uptime
Руководство по прокси

Что такое прокси-пул и как им управлять?

Работа с одним IP рано или поздно упирается в стену: целевой сайт замечает количество запросов, применяет лимит скорости и в итоге блокирует вас. Пул прокси— это структура, которая решает эту проблему, управляя множеством выходных IP как одним логическим ресурсом. Хорошо построенный пул распределяет запросы, выводит из работы проблемные IP и автоматически компенсирует сбои.

В этой статье мы разбираем технические компоненты пула, логику расчёта его размера и практики управления, работающие в продакшене.

Из скольких слоёв состоит пул?

Пул прокси — это не просто «список IP». Работающий в продакшене пул содержит минимум четыре компонента:

СХЕМАСлои пула прокси
АРХИТЕКТУРАИсточникGateway, статические IP или ваши собственные серверы1Реестр (registry)Протокол, локация, учётные данные и информация о последнем состоянии2Проверка состоянияПериодическое измерение доступности и задержки3Селектор (selector)Какой IP будет выдан следующему запросу?4Обратная связьВнесение результатов 403 / 429 / timeout в пул5

Пул без слоя обратной связи быстро «слепнет»: нездоровые IP продолжают использоваться, и доля успешных запросов падает.

Как рассчитать размер пула?

У вопроса «сколько нужно IP?» нет единственного ответа, но есть вычислимая формула. Смотрите на три переменные: допустимую для цели скорость запросов на один IP, вашу общую скорость запросов и нужный вам запас прочности.

N = H / (T × 0,7)ГРУБАЯ ФОРМУЛА
HВСЕГО ЗАПРОСОВ В СЕКУНДУ
TБЕЗОПАСНАЯ СКОРОСТЬ НА IP
0.7ЗАПАС НА ЗДОРОВЬЕ ПУЛА

Пример: вы будете отправлять 20 запросов в секунду, а целевой сайт без проблем принимает 0,5 запроса в секунду на один IP. Грубый расчёт: 20 / (0,5 × 0,7) ≈ 57 IP. Коэффициент 0,7 здесь — допущение, что в любой момент часть пула будет в карантине или работать медленно.

Совет

Вместо того чтобы гадать о безопасной скорости на IP, измерьте её. Начать с небольшого пула и экспериментально найти порог срабатывания лимита скорости гораздо дешевле, чем сразу покупать большой пул.

Проверка состояния: что измерять?

Недостаточно, чтобы IP просто «работал»; он должен быть достаточно хорош для вашей задачи . На практике отслеживают четыре метрики:

МетрикаЧто измеряетТипичный порогЕсли порог превышен
ДоступностьУстанавливается ли TCP-соединение3 неудачи подрядОтправить в карантин
ЗадержкаВремя до первого байтаВтрое выше медианы пулаСнизить вес
Доля успешных запросовПроцент запросов с ответом 2xxНиже 85%Добавить в список наблюдения
БлокировкиДоля 403 / 429 / CAPTCHAВыше 10%Длительный карантин

Важно выполнять проверку состояния не по целевому сайту, а по нейтральной конечной точке . Каждый проверочный запрос к цели расходует бюджет, выделенный на вашу реальную работу. Наш инструмент проверки прокси использует именно для этого нейтральную контрольную точку и одновременно сообщает выходной IP и уровень анонимности.

СХЕМАЖизненный цикл IP в пуле
КОНЕЧНЫЙ АВТОМАТАКТИВНО3 ошибкиучаствует в выбореНАБЛЮДЕНИЕошибки продолжаютсявес низкийКАРАНТИНвремя истекловне выбораЗАНОВОТЕСТодна попыткаСрок карантина должен расти ступенчато: 1 мин → 5 мин → 30 мин

Ступенчатый карантин вместо окончательного удаления IP не даёт пулу излишне сокращаться из-за временных сетевых проблем.

Стратегии выбора

Выбирать IP из пула можно несколькими способами, и логика выбора напрямую влияет на долю успешных запросов:

01

Round-robin (по очереди)

Самый простой метод: IP используются по порядку. Предсказуемо и справедливо, но не учитывает разницу в скорости; медленный IP тормозит очередь.

02

Взвешенный случайный

Каждому IP присваивается вес по доле успешных запросов и задержке; выбор делается случайно с учётом этих весов. Самый популярный сбалансированный метод в продакшене.

03

Наименее загруженный

Выбирается IP с наименьшим числом открытых соединений на данный момент. В задачах с долгими запросами он действительно балансирует нагрузку.

04

Липкая привязка (sticky)

Определённая сессия или аккаунт всегда подключается к одному и тому же IP. Обязательно в задачах с авторизацией; выстраивается вместе с логикой ротации .

СХЕМАПоведение пула при взвешенном выборе
ВЫБОР60 IPактивный пул1Высокая доля успеха → чащевес растёт2Высокая задержка → режевес падает3IP получил 429 → карантинвременно исключается

Взвешенный выбор позволяет пулу «самоисцеляться»: IP с плохими показателями сами по себе используются реже.

Логика карантина и возврата

Получение IP ответа 429 (Too Many Requests) не означает, что он неисправен; это лишь показывает, что для этой цели он временно использовался слишком интенсивно. Поэтому карантин следует вести по целям . Тот же IP может по-прежнему отлично работать для другого домена.

Практическая схема карантина:

  • 429 / 503: сделайте паузу 60 секунд для этой цели, затем попробуйте одним запросом.
  • 403 постоянный: карантин на 6 часов для этой цели; для других целей продолжайте использовать.
  • CAPTCHA: закройте сессию, откройте новую с новым IP; не используйте тот же IP 30 минут.
  • Ошибка соединения: IP проблемный в целом; карантин на 5 минут для всех целей.

Смешивание источников пула

Пулы из однотипных IP хрупки. Большинство серьёзных операций строит смешанный пул:

СХЕМАРаспределение трафика в смешанном пуле
РАСПРЕДЕЛЕНИЕОчередь запросовпо приоритетуПул datacenterбыстро, дёшево — лёгкие цели%50Пул ISPсредняя стоимость — средняя сложность%25Резидентный пулдорого — только для сложных целей%17Мобильный пулсамый дорогой — последнее средство%8

Отправлять каждый запрос в самый дорогой пул — это излишнее раздувание затрат. Ступенчатое повышение (сначала дешёвое, при неудаче — дорогое) в большинстве операций снижает стоимость вдвое.

Эта ступенчатая модель позволяет выбирать ресурс по уровню сложности цели. О балансе мощности и стоимости разных типов прокси читайте в нашем сравнении резидентных и datacenter прокси, а для выбора типа смотрите резидентный, ISP и datacenter наши страницы продуктов.

Частые ошибки в управлении пулом

Правильные привычки

  • Выполнять проверку состояния по конечной точке, не зависящей от цели.
  • Вести карантин по целям.
  • Постоянно логировать метрики пула (размер, доля здоровых, медианная задержка).
  • Запускать ротацию не по количеству запросов, а по результату.
  • Делать sticky-привязку обязательной в задачах, требующих сессии.

Частые ошибки

  • Окончательно удалять неудачный IP — пул со временем тает.
  • Вести единый список карантина для всех целей.
  • Выполнять проверку состояния по реальной цели и расходовать квоту.
  • Держать пул больше необходимого и раздувать затраты.
  • Делать ротацию посреди сессии и терять авторизации.

Скелет небольшого менеджера пула

СХЕМАЛогика взвешенного выбора и карантина
Python — концептуальный скелет01import time, random0203class Pool:04 def __init__(self, proxies):05 # каждая запись: {"url":..., "w":1.0, "until":0}06 self.items = [{"url": p, "w": 1.0, "until": 0} for p in proxies]0708 def pick(self):09 now = time.time()10 live = [i for i in self.items if i["until"] < now]11 if not live:12 raise RuntimeError("в пуле нет подходящего прокси")13 total = sum(i["w"] for i in live)14 r = random.uniform(0, total)15 for i in live:16 r -= i["w"]17 if r <= 0:18 return i19 return live[-1]2021 def report(self, item, status):22 if status in (200, 204):23 item["w"] = min(2.0, item["w"] * 1.05)24 elif status in (429, 503):25 item["until"] = time.time() + 6026 elif status == 403:27 item["w"] = max(0.1, item["w"] * 0.5)28 item["until"] = time.time() + 900

Этот скелет недостаточен для продакшена (нет персистентности, блокировок параллелизма и карантина по целям), но чётко показывает логику: выбор зависит от веса, а вес — от результата.

Резюме

Пул прокси — это не список IP, а небольшая система из реестра, проверки состояния, выбора и цикла обратной связи. Рассчитывайте размер пула исходя из порога терпимости цели, ведите карантин по целям, привязывайте выбор к метрикам результата и выстраивайте источники по возрастанию стоимости. Для массового тестирования адресов в вашем пуле вы можете использовать инструмент проверки прокси , а для масштабных сценариев прокси для web scraping нашей странице.

Часто задаваемые вопросы

01Сколько прокси достаточно для небольшого проекта?

Проекты, отправляющие несколько тысяч запросов в день и работающие с целями без агрессивной защиты, спокойно обходятся 10–20 IP. Решающим является не общее число запросов, а скорость запросов в секунду на один IP.

02Нужно ли удалять нездоровые IP из пула?

Нет, ступенчатый карантин работает лучше. Временные сетевые ошибки очень распространены, а окончательное удаление со временем излишне сокращает ваш пул. По истечении срока протестируйте IP одним запросом.

03Нужно ли мне управлять пулом в резидентных сервисах, работающих через gateway?

Частично. В модели gateway выбор IP делает провайдер; вам нужно управлять ключами сессий, параллелизмом и задержками по целям. Проверка состояния всё равно необходима, поскольку некоторые выходы оказываются неработоспособными для конкретной цели.

04Как часто нужно выполнять проверку состояния?

Для активного пула достаточно лёгкой проверки каждые 2–5 минут. Для IP в карантине одна попытка по истечении срока и дешевле, и точнее, чем сканирование с фиксированным интервалом.

05Можно ли объединить IP разных провайдеров в одном пуле?

Да, и чаще всего это рекомендуется. Распределение по разным ASN и подсетям не даст вашей операции остановиться при массовой блокировке одного провайдера. Достаточно помечать источник каждого IP на уровне записей.

Связанные статьи и страницы

СЛЕДУЮЩИЙ ШАГ

Усильте свою прокси-инфраструктуру уже сегодня.

Начните с платным тарифом за считанные минуты или сначала попробуйте наш бесплатный список прокси.

FREEPROXY.TR

Ищете бесплатные прокси — вы попали по адресу

Комплексная прокси-платформа, где можно посмотреть актуальные адреса бесплатных прокси, сравнить типы HTTP и SOCKS и проверить свои прокси-подключения бесплатными инструментами.