Toda automatización que habla con internet sale por alguna dirección IP. La pregunta que decide la arquitectura no es "qué proxy compro", sino qué está automatizando: una identidad o un volumen.
Las dos respuestas llevan a IP opuestas. La automatización de identidad quiere la misma dirección para siempre. La automatización de volumen quiere muchas direcciones y le da igual cuál. Montar la segunda con el producto de la primera (o al revés) es la causa más común de cuentas bloqueadas y de facturas disparadas.
Automatizar una identidad: una IP fija por cuenta
Aquí la automatización actúa en nombre de alguien: publica, responde, gestiona anuncios, mantiene una sesión de WhatsApp, maneja un panel. La plataforma del otro lado asocia esa cuenta a un historial, y el origen de red forma parte de ese historial.
La unidad de compra es la cuenta, no la petición. Una IP exclusiva y fija por identidad, mantenida en el tiempo. Cambiar de dirección a cada rato, o poner diez cuentas detrás de la misma IP de datacenter compartida, es lo que convierte un trabajo organizado en un patrón sospechoso. La lógica está en un proxy por cuenta.
En este grupo entran los bots que gestionan cuentas, las automatizaciones de mensajes y los perfiles de navegador de proxy por contexto en Playwright, donde cada contexto lleva su propia dirección dentro del mismo proceso.
El detalle que más tumba este tipo de automatización no es la dirección en sí, sino volver a iniciar sesión en cada ejecución en lugar de reutilizar la sesión. El patrón correcto está en automatización con sesión e IP fija.
Automatizar volumen: repartir peticiones y pagar por GB
Aquí la automatización lee páginas públicas: precios, catálogos, licitaciones, contenido para alimentar un modelo. No hay cuenta, no hay inicio de sesión, no hay identidad que preservar. Lo que hay es un servidor al otro lado contando cuántas peticiones llegan desde cada dirección.
La unidad de compra pasa a ser el tráfico. Quieres muchas direcciones residenciales, cobradas por GB, y la métrica que importa es cuánto cuesta cada página en bytes; de eso trata consumo de GB en scraping con proxy. Cuando el límite por origen se supera, el servidor responde con un error 429, y la salida es respetar el Retry-After y repartir, no insistir más rápido.
En ProxyBox el residencial rotativo por GB es de Brasil, con filtro por estado y ciudad. Si tus destinos son de otro país, tenlo en cuenta al elegir; la guía de proxy rotativo explica las opciones.
La recopilación para modelos de IA es el caso nuevo de este grupo, con Crawl4AI con proxy, donde el proxy se configura por petición y el ahorro viene de pedir páginas más ligeras.
Nunca mezcles los dos en la misma dirección. El volumen de la recopilación quema la reputación de la IP que sostiene las cuentas con sesión iniciada.
Dónde lee el proxy cada herramienta
Un error frecuente no es elegir la IP equivocada: es configurar el proxy en un sitio que la herramienta no lee, y que la automatización salga por la IP del servidor sin que nadie se entere.
| Herramienta | Dónde entra el proxy |
|---|---|
Python (requests, httpx) |
Por sesión o por petición: proxy en Python requests |
| Selenium | En las opciones del driver, antes de abrir el navegador: proxy en Selenium |
| Playwright | Al lanzar el navegador o en cada contexto: proxy en Playwright y proxy por contexto |
| Puppeteer y navegador headless | Argumento de línea de comandos: proxy en automatización de navegador |
| n8n | En la credencial o en el nodo de petición: proxy en n8n |
| Crawl4AI | Por petición, en la configuración de la ejecución: Crawl4AI con proxy |
En todas, la autenticación es por usuario y contraseña, y el protocolo puede ser HTTP o SOCKS5.
Entre las tres herramientas de navegador, la diferencia que más pesa en la elección es justamente el soporte de proxy con credenciales: nativo en una y trabajoso en las otras. La comparación está en Selenium, Puppeteer o Playwright: cuál usar.
Valida el origen antes de ir a producción
Antes de lanzar la automatización de verdad, haz que el script pida su propia IP y compruebe la respuesta. Es un paso de treinta segundos que evita descubrir la fuga después de mil peticiones. Puedes comprobarlo con la herramienta Mi IP o dentro del propio código.
Si la dirección que vuelve es la de tu servidor, el proxy no se está leyendo. Si es la esperada, regístrala: cuando una cuenta se queje de un origen extraño, vas a querer saber por dónde salió ese día.
Lo que el proxy no resuelve
Un proxy es una capa de red. Cambia el origen, y nada más.
- Límites por cuenta o por token. Cuando la plataforma cuenta las peticiones por clave de API o por bot, cambiar de IP no cambia nada. Es el caso de los límites de envío de un bot de Telegram.
- La huella del navegador. Zona horaria, idioma, fuentes y resolución siguen iguales después de cambiar la dirección. Eso es tema del navegador antidetect.
- El comportamiento. Ritmo humano, horarios, secuencia de acciones. Ninguna IP compensa una automatización que actúa como máquina donde se espera a una persona.
- Las condiciones de uso. Si la plataforma prohíbe automatizar ese flujo, el proxy no lo vuelve permitido. Se aplica nuestra política de uso aceptable.
Cuántas IP, en la práctica
| La automatización | Unidad | Tipo de IP |
|---|---|---|
| Gestiona 1 cuenta | 1 cuenta | 1 IPv4 o ISP fija |
| Gestiona 10 cuentas | 10 cuentas | 10 direcciones fijas, una por identidad |
| Lee 50.000 páginas públicas al mes | Tráfico | Residencial por GB, con rotación automática |
| Consulta una API oficial con clave | Ninguna | En general, ningún proxy |
| Necesita un origen estable en un país para un integrador | 1 sistema | 1 IP fija, registrada en la lista de permitidas del socio |
Si la rotación te confunde, rotación de IP: fija, por sesión o por petición separa los tres modos. Para el caso del integrador, mira proxy con IP fija para API.
Por dónde empezar
Si la automatización gestiona cuentas, el camino es proxy para automatización con direcciones fijas. Si recopila en volumen, mira el residencial por GB. Si alimenta un modelo de IA, proxy para agentes de IA trata ese caso.
Si dudas del tipo, el recomendador en cuatro preguntas resuelve más rápido que leer los cuatro productos, y los precios están en /precios.