Tutte le posizioni attive · 99.99% uptime
Guida ai proxy

Cos'è un pool di proxy e come si gestisce?

Le operazioni condotte con un solo IP prima o poi sbattono contro un muro: il sito di destinazione si accorge del numero di richieste, applica un rate limit e alla fine blocca. Pool di proxy, è la struttura che gestisce più IP di uscita come un'unica risorsa logica per risolvere questo problema. Un pool ben configurato distribuisce le richieste, disattiva gli IP problematici e compensa automaticamente i fallimenti.

In questo articolo trattiamo i componenti tecnici del pool, la logica di dimensionamento e i pattern di gestione che funzionano in ambiente di produzione.

Da quanti livelli è composto un pool?

Un pool di proxy non è solo un "elenco di IP". Un pool che funziona in produzione contiene almeno quattro componenti:

FIGURAI livelli di un pool di proxy
ARCHITETTURAFonteGateway, IP statici o i tuoi stessi server1RegistryProtocollo, località, credenziali e informazioni sullo stato attuale2Controllo dello statoMisurazione periodica di disponibilità e latenza3SelectorQuale IP assegnare alla prossima richiesta?4FeedbackRegistrazione nel pool degli esiti 403 / 429 / timeout5

Un pool privo del livello di feedback diventa cieco in poco tempo: gli IP non sani continuano a essere usati e il tasso di successo cala.

Come si calcola la dimensione del pool?

Alla domanda "quanti IP servono?" non c'è una risposta unica, ma esiste un quadro calcolabile. Guarda tre variabili: la frequenza di richieste tollerata per IPdalla destinazione, la tua frequenza totale di richieste e il margine di sicurezza.

N = H / (T × 0.7)FORMULA APPROSSIMATIVA
HRICHIESTE TOTALI AL SECONDO
TFREQUENZA SICURA PER IP
0.7MARGINE DI SALUTE

Esempio: invierai 20 richieste al secondo e il sito di destinazione accetta senza problemi 0,5 richieste al secondo per IP. Calcolo approssimativo: 20 / (0,5 × 0,7) ≈ 57 IP. Il coefficiente 0,7 rappresenta l'ipotesi che in ogni momento una parte del pool sarà in quarantena o lenta.

Suggerimento

Invece di provare a stimare la frequenza sicura per IP, misurala. Partire da un pool piccolo e individuare sperimentalmente la soglia che innesca il rate limit è molto più economico che acquistare subito un pool di grandi dimensioni.

Controllo di stato: cosa misurare?

Non basta che un IP "funzioni"; deve essere abbastanza buono da servire al tuo lavoro . In pratica si monitorano quattro metriche:

MetricaCosa misuraSoglia tipicaSe la soglia viene superata
DisponibilitàLa connessione TCP viene stabilita?3 fallimenti consecutiviMetti in quarantena
LatenzaTempo al primo byte3 volte la mediana del poolRiduci il peso
Tasso di successoPercentuale di richieste con risposta 2xxSotto l'85%Metti in osservazione
BloccoTasso di 403 / 429 / CAPTCHASopra il 10%Quarantena lunga

È importante eseguire il controllo di stato non verso il sito di destinazione, ma verso un endpoint neutro . Ogni richiesta di controllo inviata alla destinazione consuma il budget riservato al lavoro vero. Il nostro strumento di controllo proxy usa esattamente per questo scopo un punto di controllo neutro e riporta insieme l'IP di uscita e il livello di anonimato.

FIGURAIl ciclo di vita di un IP nel pool
MACCHINA A STATIATTIVO3 erroriincluso nella selezioneOSSERVAZIONEl'errore persistepeso bassoQUARANTENAtempo scadutoescluso dalla selezioneDI NUOVOè sufficiente o si sale di livellosingolo tentativoLa durata della quarantena deve crescere progressivamente: 1 min → 5 min → 30 min

Mettere un IP in quarantena progressiva invece di eliminarlo definitivamente evita di rimpicciolire inutilmente il pool in caso di problemi di rete temporanei.

Strategie di selezione

Ci sono più modi per scegliere un IP dal pool e la logica di selezione incide direttamente sul tasso di successo:

01

Round-robin (sequenziale)

Il metodo più semplice: gli IP vengono usati in sequenza. È prevedibile ed equo, ma non tiene conto delle differenze di velocità; un IP lento rallenta la coda.

02

Casuale ponderato

A ogni IP viene assegnato un peso in base al tasso di successo e alla latenza; la selezione avviene in modo casuale secondo questi pesi. È il metodo bilanciato più usato in produzione.

03

Meno utilizzato

Viene scelto l'IP con il minor numero di connessioni aperte in quel momento. Nei lavori con richieste di lunga durata bilancia davvero il carico.

04

Associazione sticky

Una determinata sessione o account si collega sempre allo stesso IP. È obbligatoria nei lavori con login; con la logica di rotazione va progettata insieme.

FIGURAIl comportamento del pool nella selezione ponderata
SCELTA60 IPpool attivo1Tasso di successo alto → più spessoil peso aumenta2Latenza alta → più di radoil peso diminuisce3IP che riceve 429 → quarantenaviene escluso temporaneamente

La selezione ponderata permette al pool di "auto-ripararsi": gli IP con prestazioni scarse vengono usati spontaneamente sempre meno.

Logica di quarantena e reintegro

Il fatto che un IP riceva un 429 (Too Many Requests) non significa che sia guasto; indica soltanto che per quella destinazione è stato usato temporaneamente troppo. Per questo la quarantena va mantenuta per destinazione . Lo stesso IP può funzionare ancora perfettamente per un altro dominio.

Uno schema di quarantena pratico:

  • 429 / 503: fai una pausa di 60 secondi per quella destinazione, poi riprova con una singola richiesta.
  • 403 persistente: 6 ore di quarantena per quella destinazione; continua a usarlo per le altre destinazioni.
  • CAPTCHA: chiudi la sessione, aprine una nuova con un nuovo IP; non usare lo stesso IP per 30 minuti.
  • Errore di connessione: l'IP è problematico in generale; 5 minuti di quarantena per tutte le destinazioni.

Mescolare le fonti del pool

I pool composti da un solo tipo di IP sono fragili. La maggior parte delle operazioni serie costruisce un pool misto:

FIGURADistribuzione del traffico in un pool misto
DISTRIBUZIONECoda delle richiesteordinata per prioritàPool datacenterveloce, economico — destinazioni facili%50Pool ISPcosto medio — difficoltà media%25Pool residentialcostoso — solo destinazioni difficili%17il pool mobileil più costoso — ultima risorsa%8

Inviare ogni richiesta al pool più costoso fa lievitare inutilmente i costi. L'escalation progressiva (prima l'economico, se fallisce il costoso) dimezza i costi nella maggior parte delle operazioni.

Questo modello progressivo ti consente di scegliere la risorsa in base al grado di difficoltà della destinazione. Per l'equilibrio tra potenza e costo dei diversi tipi di proxy consulta il nostro confronto tra residential e datacenter, e per la scelta del tipo residenziale, ISP e datacenter puoi consultare le nostre pagine prodotto.

Errori frequenti nella gestione del pool

Buone abitudini

  • Eseguire il controllo di stato su un endpoint indipendente dalla destinazione.
  • Mantenere la quarantena per destinazione.
  • Loggare costantemente le metriche del pool (dimensione, percentuale di IP sani, latenza mediana).
  • Innescare la rotazione in base all'esito, non al numero di richieste.
  • Rendere obbligatoria l'associazione sticky nei lavori che richiedono una sessione.

Errori frequenti

  • Eliminare definitivamente un IP fallito: il pool si erode nel tempo.
  • Tenere un'unica lista di quarantena per tutte le destinazioni.
  • Eseguire il controllo di stato sulla destinazione reale consumando la quota.
  • Tenere il pool più grande del necessario gonfiando i costi.
  • Ruotare a metà sessione facendo cadere i login.

Lo scheletro di un piccolo gestore di pool

FIGURALogica di selezione ponderata e quarantena
Python — scheletro concettuale01import time, random0203class Pool:04 def __init__(self, proxies):05 # ogni record: {"url":..., "w":1.0, "until":0}06 self.items = [{"url": p, "w": 1.0, "until": 0} for p in proxies]0708 def pick(self):09 now = time.time()10 live = [i for i in self.items if i["until"] < now]11 if not live:12 raise RuntimeError("nessun proxy disponibile nel pool")13 total = sum(i["w"] for i in live)14 r = random.uniform(0, total)15 for i in live:16 r -= i["w"]17 if r <= 0:18 return i19 return live[-1]2021 def report(self, item, status):22 if status in (200, 204):23 item["w"] = min(2.0, item["w"] * 1.05)24 elif status in (429, 503):25 item["until"] = time.time() + 6026 elif status == 403:27 item["w"] = max(0.1, item["w"] * 0.5)28 item["until"] = time.time() + 900

Questo scheletro non è sufficiente per la produzione (mancano persistenza, lock di concorrenza e quarantena per destinazione), ma mostra chiaramente la logica: la selezione dipende dal peso e il peso dall'esito.

Riepilogo

Un pool di proxy non è un elenco di IP; è un piccolo sistema fatto di registry, controlli di stato, selezione e ciclo di feedback. Calcola la dimensione del pool a partire dalla soglia di tolleranza della destinazione, mantieni la quarantena per destinazione, lega la selezione alle metriche di esito e scala le risorse in ordine di costo. Per testare in blocco gli indirizzi del tuo pool puoi Se un datacenter proxy sia sufficiente dipende dal livello di protezione del target, ed è una cosa misurabile. Prendi come riferimento la connessione diretta ed esegui un test comparativo alla stessa velocità; scegli il livello in base al tasso di successo. Costruire una logica di escalation a livelli e accumulare statistiche per target riduce al minimo sia i costi sia la perdita di velocità. Per iniziare usare, e per scenari su larga scala proxy per web scraping puoi consultare la nostra pagina.

Domande frequenti

01Quanti proxy bastano per un piccolo progetto?

I progetti che inviano qualche migliaio di richieste al giorno e lavorano con destinazioni prive di protezioni aggressive procedono senza problemi con 10–20 IP. Il fattore determinante non è il numero totale di richieste, ma la frequenza di richieste al secondo per IP.

02Devo eliminare gli IP non sani dal pool?

No, una quarantena progressiva è preferibile. Gli errori temporanei di rete sono molto comuni e l'eliminazione definitiva rimpicciolisce inutilmente il pool nel tempo. Quando la quarantena scade, ritesta l'IP con una singola richiesta.

03Devo gestire un pool nei servizi residential che usano un gateway?

In parte. Nel modello gateway è il provider a scegliere l'IP; quello che devi gestire tu sono le chiavi di sessione, la concorrenza e i tempi di attesa per destinazione. I controlli di stato restano comunque necessari, perché alcune uscite falliscono a seconda della destinazione.

04Con quale frequenza vanno eseguiti i controlli di stato?

Per il pool attivo è sufficiente un controllo leggero ogni 2–5 minuti. Per gli IP in quarantena, fare un singolo tentativo alla scadenza è più economico e più preciso di una scansione a intervalli fissi.

05Posso unire nello stesso pool IP di provider diversi?

Sì, ed è spesso consigliato. Una distribuzione su ASN e subnet diversi evita che la tua operazione si fermi in caso di blocco massivo di un singolo provider. Basta etichettare la provenienza di ogni IP a livello di registry.

Articoli e pagine correlati

PROSSIMO PASSO

Potenzia oggi la tua infrastruttura proxy.

Inizia in pochi minuti con i pacchetti a pagamento oppure prova prima il nostro elenco di proxy gratuiti.

FREEPROXY.TR

Se cerchi proxy gratuiti, sei nel posto giusto

Una piattaforma proxy completa dove consultare indirizzi proxy gratuiti aggiornati, confrontare i tipi di proxy HTTP e SOCKS e verificare le tue connessioni proxy con strumenti gratuiti.