Quando acquisti proxy residential non ricevi un elenco di migliaia di indirizzi IP. In genere ottieni un solo indirizzo: gateway.saglayici.com:8000. Ciononostante vedi un IP di uscita diverso a ogni richiesta. Questa architettura si chiama backconnect gateway ed è il funzionamento di quasi tutti i servizi proxy moderni.
In questo articolo analizziamo il funzionamento interno del gateway, come avviene l'instradamento delle sessioni e le differenze rispetto al modello a IP diretti.
L'idea di base
Il gateway è un punto di ingresso fisso a cui ti colleghi. Dietro di esso si trovano migliaia di nodi di uscita. Tu invii la richiesta al gateway, il gateway la inoltra a un nodo di uscita scelto dal pool e ti riporta indietro la risposta.
Nella tua configurazione c'è un solo indirizzo; tutta la complessità viene gestita dietro il gateway. Questo semplifica radicalmente il lato client.
Tre modi per dare istruzioni al gateway
Devi comunicare al gateway da quale paese effettuare l'uscita e con quale identificativo di sessione. Nel settore si usano tre metodi:
Il terzo metodo è la chiamata API: la sessione viene creata prima tramite API e ci si collega con l'identificativo restituito. È flessibile, ma richiede un round trip aggiuntivo.
Il metodo che incorpora i parametri nel nome utente nel nostro articolo sull'autenticazione lo abbiamo illustrato nel dettaglio.
Il percorso di una richiesta all'interno del gateway
Il tempo di elaborazione interno del gateway è tipicamente di pochi millisecondi. La maggior parte della latenza totale deriva dalla distanza tra il nodo di uscita e la destinazione.
Per sua natura il modello gateway aggiunge un hop: tu → gateway → uscita → destinazione. Rispetto al modello a IP diretti, 10–40 ms di latenza aggiuntiva sono normali. In cambio, gestione del pool, controlli di stato e rotazione vengono completamente tolti dalle tue mani.
Confronto tra modello gateway e modello a IP diretti
Se devi far riconoscere il tuo IP al sistema di destinazione (whitelist, accesso API) il modello a IP diretti è obbligatorio; con il gateway non è possibile, perché l'IP di uscita è variabile.
Per gli scenari che richiedono un IP statico ISP proxy e datacenter proxy i nostri prodotti funzionano con il modello a IP diretti.
La meccanica interna dell'instradamento delle sessioni
Il gateway deve garantire che le richieste con la stessa chiave di sessione vadano allo stesso nodo di uscita. Lo fa tramite una tabella di associazione:
È per questo che la sessione sticky è "best effort" e non "garantita": se il nodo assegnato cade dalla rete, il gateway è costretto a passare a un nuovo nodo.
Vantaggi e limiti del modello gateway
Vantaggi
- La configurazione lato client si riduce a una sola riga.
- Salute del pool, esclusione degli IP morti e rotazione sono a carico del provider.
- Il targeting geografico cambia all'istante con un parametro.
- Accesso a milioni di IP da un unico indirizzo.
- Scalare non richiede modifiche al codice.
Limiti
- Latenza leggermente più alta a causa dell'hop aggiuntivo.
- IP di uscita imprevedibile: non è possibile impostare una whitelist.
- Il gateway è un singolo punto di guasto.
- Non puoi sapere in anticipo quale IP verrà usato.
- Il debug diventa più astratto.
Debug quando si usa un gateway
Per poter rispondere alla domanda "quale nodo di uscita ha generato questo errore" quando si presenta un problema, devi loggare l'IP di uscita di ogni richiesta. Altrimenti non potrai impostare una quarantena per destinazione né segnalare al provider i nodi problematici.
Rilevare l'IP di uscita a ogni richiesta è costoso. La soluzione pratica: inviare una richiesta di controllo una sola volta per ogni nuova chiave di sessione ed etichettare l'IP su quella sessione.
Targeting geografico e posizione del gateway
La posizione fisica del gateway incide direttamente sulla latenza. Se lavori dalla Turchia e usi uscite europee, scegliere un gateway situato in Europa riduce sensibilmente il tempo totale.
Se il tuo provider offre più posizioni di gateway, scegli quella più vicina al tuo pubblico di riferimento. Per le opzioni di posizione consulta la nostra pagina delle località puoi consultarlo.
Riepilogo
L'architettura gateway ti permette di accedere a milioni di IP tramite un unico indirizzo e delega al provider la complessità di gestione del pool, controlli di stato e rotazione. In cambio accetti un hop di latenza e la perdita di controllo sull'IP di uscita. Per i lavori che richiedono whitelist o la latenza più bassa possibile la scelta giusta è il modello a IP diretti; per quelli che richiedono flessibilità e ampiezza geografica è il modello gateway. Per verificare la tua configurazione Se un datacenter proxy sia sufficiente dipende dal livello di protezione del target, ed è una cosa misurabile. Prendi come riferimento la connessione diretta ed esegui un test comparativo alla stessa velocità; scegli il livello in base al tasso di successo. Costruire una logica di escalation a livelli e accumulare statistiche per target riduce al minimo sia i costi sia la perdita di velocità. Per iniziare puoi usarlo.