proxyapi. från Hugo & Friends AB
← Alla exempel

01 / Python

Web scraping med Python

Hämta en publik sida med timeout, proxy från miljövariabel och tydlig felhantering.

Du bygger

Ett litet, produktionsvänligt requests-flöde

ScrapingRetries
Python
import os
import requests
from requests.adapters import HTTPAdapter
from urllib3.util.retry import Retry

key = os.environ["PROXYAPI_KEY"]
proxy = f"https://{key}-country-se-type-isp:@proxy.proxyapi.se:443"

session = requests.Session()
session.proxies.update({"http": proxy, "https": proxy})
session.mount("https://", HTTPAdapter(max_retries=Retry(
    total=3,
    backoff_factor=0.5,
    status_forcelist=[429, 500, 502, 503, 504],
)))

response = session.get("https://example.com", timeout=20)
response.raise_for_status()
print(response.status_code, len(response.content))

Innan du kör i produktion

  • Kontrollera målplatsens villkor, robots-policy och tillämplig lag innan insamling.
  • Logga status och varaktighet, men skriv aldrig ut API-nyckeln.