Best Proxies for Scrapy 2026 cover

Scrapy سنجیدہ ویب اسکریپنگ کے لیے production Python فریم ورک ہے: تیز، asynchronous، اور بڑے پیمانے کی کرالنگ کے لیے بنایا گیا۔ لیکن اگر آپ ایک datacenter IP سے کسی حقیقی ہدف کو کرال کریں تو چند منٹوں میں rate-limited یا block ہو سکتے ہیں۔ حل یہ ہے کہ Scrapy کی درخواستوں کو پراکسیز کے ذریعے روٹ کیا جائے، ترجیحا residential پراکسیز سے، تاکہ درخواستیں حقیقی صارفین جیسی دکھائی دیں۔ اچھی بات یہ ہے کہ Scrapy میں request.meta['proxy'] کے ذریعے پراکسی سپورٹ پہلے سے موجود ہے، اور rotating gateway کے ساتھ آپ کو IP فہرست بھی منظم نہیں کرنی پڑتی۔ یہ guide صاف طور پر دکھاتی ہے کہ Scrapy کے ساتھ پراکسی کیسے استعمال کریں (ہر درخواست پر، تمام درخواستوں کے لیے middleware، اور rotation)، پھر 2026 میں Scrapy کے لیے 8 بہترین پراکسیز کی ranking کرتی ہے۔ DataImpulse $1/GB پر value baseline ہے۔

میں Andrii Byzov ہوں، ایک AI-Native Fractional CMO جو روزانہ Scrapy کرالرز چلاتا ہے۔ نیچے آپ کو copy-paste setup، middleware-order gotcha، اور وہ providers ملیں گے جو واقعی آپ کے budget کے قابل ہیں۔


اہم حقائق

  • پراکسی کو request.meta['proxy'] کے ساتھ سیٹ کریں: Scrapy کا بلٹ اِن HttpProxyMiddleware اسے پڑھتا ہے اور پراکسی URL (http://user:pass@host:port) سے authentication سنبھال لیتا ہے۔
  • اسے ہر درخواست پر ایک چھوٹے DownloaderMiddleware کے ذریعے لاگو کریں، یا start_requests میں فی درخواست سیٹ کریں۔
  • rotating gateway کا مطلب ہے کہ IP فہرست کی ضرورت نہیں۔ meta['proxy'] کو rotating residential endpoint (جیسے DataImpulse) کی طرف پوائنٹ کریں اور ہر درخواست خود بخود ایک تازہ IP سے باہر نکلے گی۔
  • static IP فہرست کے لیے، scrapy-rotating-proxies استعمال کریں (ROTATING_PROXY_LIST): یہ rotate کرتا ہے، پابندیوں کا پتہ لگاتا ہے، اور order میں HttpProxyMiddleware سے پہلے چلتا ہے (اس کی default priorities پہلے ہی یہی کرتی ہیں)۔
  • Scrapy HTTP/HTTPS پراکسیز کو native طور پر support کرتا ہے (SOCKS5 نہیں): HTTP endpoint (DataImpulse port 823) استعمال کریں۔ اسے $1/GB پر residential، $0.50/GB پر datacenter، $2/GB پر mobile، 90M+ pool اور 195 ممالک کے ساتھ pair کریں۔

Scrapy کے ساتھ پراکسی کیسے استعمال کریں

1. فی درخواست meta['proxy'] کے ذریعے

import scrapy

class IpSpider(scrapy.Spider):
    name = "ip"
    def start_requests(self):
        proxy = "http://YOUR_LOGIN__cr.us:[email protected]:823"  # __cr.us = US
        yield scrapy.Request("https://httpbin.org/ip", meta={"proxy": proxy})

    def parse(self, response):
        self.log(response.text)  # confirm the egress IP

Scrapy کا HttpProxyMiddleware (default طور پر فعال) meta['proxy'] کو پڑھتا ہے اور URL میں موجود اسناد سے Proxy-Authorization ہیڈر سیٹ کر دیتا ہے۔ کسی اضافی کوڈ کی ضرورت نہیں۔

2. ہر درخواست کو پراکسی سے گزارنے کے لیے middleware

پورے پروجیکٹ کے لیے زیادہ صاف طریقہ یہ ہے کہ پراکسی ایک بار سیٹ کریں اور پھر وہ تمام درخواستوں پر لاگو ہو جائے:

# middlewares.py
class DataImpulseProxyMiddleware:
    PROXY = "http://YOUR_LOGIN__cr.us:[email protected]:823"
    def process_request(self, request, spider):
        request.meta["proxy"] = self.PROXY

# settings.py — run BEFORE the built-in HttpProxyMiddleware (750)
DOWNLOADER_MIDDLEWARES = {
    "myproject.middlewares.DataImpulseProxyMiddleware": 350,
}

3. scrapy-rotating-proxies کے ساتھ static IP فہرست کو rotate کرنا

اگر آپ کے پاس rotating gateway کے بجائے پراکسیز کی فہرست ہے تو scrapy-rotating-proxies انہیں rotate کرتا ہے اور پابندیوں کا پتہ لگاتا ہے:

# pip install scrapy-rotating-proxies
# settings.py
ROTATING_PROXY_LIST = [
    "http://YOUR_LOGIN__cr.us:[email protected]:823",
    # ...more endpoints/sessions...
]
DOWNLOADER_MIDDLEWARES = {
    "rotating_proxies.middlewares.RotatingProxyMiddleware": 610,
    "rotating_proxies.middlewares.BanDetectionMiddleware": 620,
}

DataImpulse کے rotating residential gateway کے ساتھ عموما اس کی ضرورت نہیں پڑتی، کیونکہ ایک endpoint پہلے ہی ہر درخواست پر تازہ IP واپس کر دیتا ہے۔ scrapy-rotating-proxies تب استعمال کریں جب آپ بہت سے الگ sessions منظم کر رہے ہوں یا built-in ban detection چاہتے ہوں۔ نوٹ: Scrapy کی پراکسی سپورٹ صرف HTTP/HTTPS ہے، اس لیے HTTP endpoint (port 823) استعمال کریں، SOCKS5 نہیں؛ session parameters کے لیے DataImpulse tutorials دیکھیں۔


Scrapy کے لیے بہترین پراکسیز ایک نظر میں

فراہم کنندہ Scrapy کے لیے بہترین رہائشی قیمت پروٹوکولز قابلِ ذکر
DataImpulse بہترین value، اِن ہاؤس کرالرز $1/GB PAYG HTTP/HTTPS 90M+ پول، روٹیٹنگ گیٹ وے، ٹریفک کبھی ختم نہیں ہوتا
Bright Data enterprise اور managed کام ~$4/GB پرومو؛ $8 ریگولر HTTP/HTTPS/SOCKS5 Web Unlocker، SERP API، datasets
Oxylabs enterprise SLA $6/GB سے HTTP/HTTPS/SOCKS5 175M+ پول، scraper APIs
Decodo mid-market، مکمل geo grid $3.75/GB (~$2 at 1TB+) HTTP/HTTPS 115M+ پول، 24h تک sticky
IPRoyal طویل sticky sessions $7.35/GB سے HTTP/HTTPS/SOCKS5 7 دن تک sticky؛ سستا PAYG
SOAX residential + mobile mix $3.60/GB Starter HTTP/HTTPS 155M+ رہائشی، 33M+ mobile
Webshare budget / self-serve $3.50/mo res سے؛ $2.99/mo DC HTTP/SOCKS5 مفت tier، سب سے سستا datacenter
NetNut ISP-residential استحکام $3.53/GB سے HTTP/HTTPS consumer-ISP static IPs

Best proxies for Scrapy 2026: raw residential per-GB pricing vs managed scraping API per-1,000-requests pricing (heterogeneous units)


انتخاب، مختصرا

DataImpulse Scrapy کرالرز کے لیے value baseline ہے: residential $1/GB pay-as-you-go پر (datacenter $0.50/GB، mobile $2/GB)، 195 ممالک میں 90M+ IPs، ایک rotating HTTP/HTTPS gateway جو ہر درخواست پر نیا IP دیتا ہے، اور username میں country/city/ASN targeting۔ Traffic کبھی expire نہیں ہوتا، اس لیے dev runs subscription ضائع نہیں کرتے۔ شائع شدہ success rate 99.51%؛ G2 4.8/5؛ 24/7 انسانی support۔ بڑے پیمانے کی in-house کرالنگ کے لیے، یہ ہر successful request کی لاگت کو بہت کم رکھتا ہے۔

Bright Data enterprise انتخاب ہے (residential ~$8/GB regular، ~$4 promo) Web Unlocker، SERP API، اور datasets کے ساتھ۔ Oxylabs (from $6/GB، 175M+ pool) scraper APIs کے ساتھ SLA-grade option ہے۔ Decodo (from $3.75/GB، sticky to 24h) balanced mid-market choice ہے۔ IPRoyal (from $7.35/GB، sticky up to 7 days) طویل، session-stable کرالز کے لیے موزوں ہے۔ SOAX ($3.60/GB، 155M+ residential + 33M+ mobile) ایک مضبوط mobile pool بھی دیتا ہے۔ Webshare (free tier، datacenter from $2.99/mo) budget self-serve entry ہے، اور NetNut (from $3.53/GB) ISP-residential stability pick ہے۔


Scrapy کے ساتھ Rotating بمقابلہ Sticky پراکسیز

وسیع پیمانے کی کرالنگ کے لیے rotating residential gateway مثالی ہے۔ ہر Scrapy درخواست کو تازہ IP ملتا ہے، load تقسیم ہو جاتا ہے، اور IP management کے بغیر rate limits سے بچنے میں مدد ملتی ہے۔ stateful flows (login کے بعد follow-up requests) کے لیے sticky session استعمال کریں تاکہ پوری sequence میں وہی IP برقرار رہے، اور cookies کو on رکھیں (Scrapy کا cookies middleware default طور پر on ہوتا ہے)۔ زیادہ تر Scrapy کرالز وسیع اور stateless ہوتے ہیں، اس لیے rotating عموما بہتر default ہے؛ sticky کو authenticated یا multi-step targets کے لیے رکھیں۔

عام Scrapy پراکسی غلطیاں

  • Middleware order. custom proxy middleware یا scrapy-rotating-proxies کو built-in HttpProxyMiddleware سے پہلے run ہونا چاہیے (کم priority number)، ورنہ آپ کی پراکسی apply نہیں ہوگی۔
  • SOCKS5 کے کام کرنے کی توقع رکھنا۔ Scrapy کی proxy support صرف HTTP/HTTPS ہے۔ HTTP endpoint استعمال کریں، SOCKS URL نہیں۔
  • بہت جارحانہ انداز میں کرالنگ کرنا۔ AUTOTHROTTLE_ENABLED اور مناسب CONCURRENT_REQUESTS/DOWNLOAD_DELAY enable کریں تاکہ rotating IPs پر بھی ضرورت سے زیادہ دباؤ نہ پڑے۔
  • محفوظ targets پر Datacenter IPs: وہ جلد block ہو جاتے ہیں؛ anti-bot-heavy sites کے لیے residential استعمال کریں۔
  • Ban handling نہ ہونا۔ retry/ban detection شامل کریں (scrapy-rotating-proxies‘ BanDetectionMiddleware یا custom RETRY_HTTP_CODES) تاکہ blocked responses کو data کے طور پر parse کرنے کے بجائے نئے IP پر retry کیا جائے۔

Scrapy کے لیے کون سی پراکسی قسم: Residential، Datacenter، یا Mobile؟

  • Residential ($1/GB): محفوظ اہداف (ای کامرس، SERPs، سوشل) کے لیے default۔ اگر صرف ایک قسم چننی ہو تو یہی چنیں۔
  • Mobile ($2/GB): سب سے مشکل اہداف اور mobile web surfaces کے لیے حقیقی carrier IPs۔
  • Datacenter ($0.50/GB): کم تحفظ والی کرالنگ، APIs، اور آپ کے اپنے انفراسٹرکچر کے لیے سب سے سستا اور تیز ترین؛ اسے anti-bot-heavy سائٹس پر استعمال نہ کریں۔

DataImpulse ایک pay-as-you-go اکاؤنٹ پر تینوں پیش کرتا ہے، اس لیے ایک ہی Scrapy پروجیکٹ username اور endpoint کے ذریعے ہر درخواست کو درست درجے پر روٹ کر سکتا ہے۔

DataImpulse + Scrapy کے ساتھ کیسے شروع کریں

Step 1. DataImpulse اکاؤنٹ بنائیں اور residential credentials حاصل کریں۔ $5 / 5GB intro کبھی ختم نہیں ہوتا، اس لیے یہ حقیقی testing budget بن جاتا ہے۔

Step 2. ہر درخواست کے لیے request.meta["proxy"] = "http://YOUR_LOGIN__cr.us:[email protected]:823" سیٹ کریں، یا اسے ہر جگہ لاگو کرنے کے لیے one-line proxy middleware شامل کریں۔ geo-targeting کے لیے username میں country code شامل کریں۔

Step 3. AUTOTHROTTLE فعال کریں، retry/ban handling شامل کریں، اور rotating gateway کو ہر درخواست کے لیے تازہ IP دینے دیں۔ DataImpulse tutorials اور residential proxies صفحہ دیکھیں۔


عمومی سوالات

میں Scrapy میں پراکسی کیسے استعمال کروں؟

اپنی requests پر request.meta['proxy'] = 'http://user:pass@host:port' سیٹ کریں۔ Scrapy کا بلٹ اِن HttpProxyMiddleware اسے پڑھتا ہے اور URL سے authentication سنبھال لیتا ہے۔ پورے project کے لیے، ایک چھوٹا DownloaderMiddleware شامل کریں جو ہر request پر request.meta['proxy'] سیٹ کرے۔ DataImpulse کے لیے: http://YOUR_LOGIN__cr.us:[email protected]:823۔

Scrapy کے لیے بہترین پراکسی کون سی ہے؟

محفوظ targets کے لیے residential پراکسیز بہتر رہتی ہیں۔ $1/GB پر DataImpulse بہترین value انتخاب ہے (90M+ IPs، rotating HTTP/HTTPS gateway، traffic کبھی expire نہیں ہوتا)۔ Bright Data اور Oxylabs enterprise options ہیں؛ Webshare شروع کرنے کے لیے سب سے سستا ہے۔ سب Scrapy کے meta['proxy'] کے ساتھ کام کرتے ہیں؛ انتخاب price، pool quality، اور اس بات پر منحصر ہے کہ آیا آپ کو managed APIs درکار ہیں۔

میں Scrapy میں پراکسیز کو rotate کیسے کروں؟

سب سے آسان طریقہ یہ ہے کہ meta['proxy'] کو rotating residential gateway (DataImpulse) کی طرف point کریں۔ ہر request کو خود بخود نیا IP ملتا ہے اور manage کرنے کے لیے کوئی list نہیں رہتی۔ پراکسیز کی static list کے لیے، scrapy-rotating-proxies install کریں، ROTATING_PROXY_LIST سیٹ کریں، اور اس کے middleware کو بلٹ اِن HttpProxyMiddleware سے پہلے رکھیں۔ یہ bans بھی detect کرتا ہے اور نئے IP پر retries کرتا ہے۔

کیا Scrapy SOCKS5 پراکسیز کو support کرتا ہے؟

Native طور پر نہیں۔ Scrapy کا HttpProxyMiddleware صرف HTTP اور HTTPS پراکسیز کو support کرتا ہے۔ residential پراکسیز کے لیے HTTP endpoint (DataImpulse port 823) استعمال کریں۔ SOCKS5 کے لیے custom download handler درکار ہوگا، جس کی عموما ضرورت نہیں پڑتی کیونکہ HTTP gateway Scrapy کرالنگ کو cover کر لیتا ہے۔

میری Scrapy پراکسی کام کیوں نہیں کر رہی؟

اکثر وجہ middleware order ہوتی ہے۔ custom proxy یا scrapy-rotating-proxies middleware کو بلٹ اِن HttpProxyMiddleware سے پہلے چلنا چاہیے (کم priority number)۔ دیگر وجوہات: SOCKS URL استعمال کرنا (HTTP استعمال کریں)، proxy URL میں credentials نہ ہونا، یا کسی محفوظ site پر blocked datacenter IP (residential پر switch کریں)۔ egress IP کو https://httpbin.org/ip کے خلاف check کریں۔

Scrapy پراکسیز کی لاگت کتنی ہوتی ہے؟

Raw residential کی pricing فی GB ہوتی ہے: DataImpulse $1/GB (value floor)، NetNut $3.53 سے، SOAX $3.60، Decodo $3.75، Oxylabs $6 سے، IPRoyal $7.35؛ Webshare $3.50/mo سے budget subscriptions پیش کرتا ہے۔ ایک crawled page ایک GB کا بہت چھوٹا حصہ استعمال کرتا ہے، اس لیے high-volume Scrapy کرالنگ کے لیے per-GB residential، per-record managed APIs کے مقابلے میں کہیں زیادہ سستا ہے؛ managed options سب سے مشکل targets کے لیے موزوں ہیں۔



Share article: