Bloga dön

14 Eylül 2026

2026'da Engellenmeden Web Siteleri Nasıl Scraping Yapılır

Scraping sırasında IP'niz ban mı yiyor? Profesyonellerin anti-bot sistemlerini tetiklemeden ölçekte veri toplamak için kullandığı kanıtlanmış teknikleri öğrenin.

Web Siteleri Neden Sizi Engeller?

Scraper'ınız her istek gönderdiğinde hedef sunucu IP adresinizi, istek başlıklarınızı ve zamanlama kalıplarınızı görür. Anti-bot sistemleri otomatik davranışı ele veren sinyallere bakar:

  • Tek bir IP'den çok fazla istek — insanlar dakikada 500 istek atmaz.
  • Başlıklarda hiç çeşitlilik yok — gerçek bir tarayıcı User-Agent, Accept-Language ve daha fazlasını rastgeleleştirir.
  • Kusursuz düzenli zamanlama — botlar uç noktalara makine saati aralıklarıyla vurur; insanlar öyle yapmaz.
  • Datacenter IP aralıkları — çoğu hosting IP'si WHOIS'te göründüğü anda işaretlenir.

Bu sinyallerden birini tetiklediğinizde CAPTCHA, soft block veya kalıcı IP banıyla karşılaşırsınız. Çözüm tek bir IP ile daha zekice scraping yapmak değil — baştan bot gibi görünmeyi bırakmaktır.


Yüksek Kaliteli Proxy Kullanın

En etkili önlem, isteklerinizi gerçek kullanıcılara benzeyen proxy'ler üzerinden yönlendirmektir. Ancak tüm proxy'ler eşit değildir. Kullanım amacınıza göre doğru türü nasıl seçeceğinizi aşağıda özetledik.

Rotating Residential Proxy'ler

Residential proxy'ler, ISP'ler tarafından gerçek hanelere atanan IP adresleridir. Web siteleri gerçek bir tüketici bağlantısı görür; organik trafikten ayırt etmek neredeyse imkansızdır.

Rotating Residential Proxy hizmetimiz her istekte (veya özel bir aralıkta) büyük bir adres havuzunda otomatik döner. Elde ettiğiniz:

  • 150+ ülkede gerçek cihazlardan IP'ler
  • Otomatik rotasyon — manuel havuz yönetimi yok
  • E-ticaret ve sosyal medya gibi ağır korumalı hedeflerde yüksek başarı oranı

Büyük ölçekli scraping için ilk tercih: Rotating Residential Proxy.

IPv4 Proxy'ler

Dedicated IPv4 Proxy size özel, statik bir IP adresi verir. Şu durumlarda idealdir:

  • Tutarlı bir kimliğe ihtiyacınız olduğunda (hesap yönetimi, reklam doğrulama)
  • Hız en öncelikli olduğunda — paylaşım olmadığı için diğer kullanıcılardan trafik dalgası gelmez
  • Residential-hassas olmayan hedefleri scraping yaptığınızda

Tek kullanıcı olduğunuz için aynı IP üzerinde güven skoru zamanla yükselir.

ISP Proxy'ler

ISP Proxy orta noktadadır: hız için datacenter'da barındırılır ama gerçek ISP blokları altında kayıtlıdır; böylece residential kontrollerinden geçer.

ISP proxy'leri şu durumlarda kullanın:

  • Datacenter düzeyinde throughput ve residential düzeyinde güven istediğinizde
  • Hedefler ASN veya WHOIS sahipliğini kontrol ettiğinde (çoğu eder)
  • Residential havuzdan daha düşük gecikme istediğinizde

ISP Proxy datacenter hızını ISP düzeyinde güvenilirlikle birleştirir.

IPv6 Proxy'ler

IPv6 adres alanı muazzamdır — yani her IPv6 proxy, anti-bot sistemlerinin geçmişi az olan fiilen benzersiz bir bloktan gelir. IPv6 Proxy, IPv6 destekleyen hedefler için uygun maliyetli bir seçenektir:

  • IP başına ultra düşük maliyet
  • Muazzam adres çeşitliliği
  • Basit, düşük sürtünmeli hedeflerde yüksek throughput

IP Adreslerini Döndürün (Rotate)

Büyük bir proxy havuzunuz olsa bile rotasyon biçimi önemlidir.

StratejiNe zaman kullanılır
Her istekte rotateMaksimum anonimlik; yüksek hacimli scraping için en iyisi
Oturum başına rotateLogin akışı boyunca tutarlı kimlik
Ban'de rotate403/429 yanıtlarını tespit edip IP'yi otomatik değiştir

Residential proxy uç noktalarımız sticky session'ları (yapılandırılabilir süre boyunca aynı IP) ve saf rotasyonu destekler — modu istek başlığında seçersiniz, ekstra kod gerekmez.

import requests

proxies = {
    "http":  "http://user-rotate:[email protected]:10000",
    "https": "http://user-rotate:[email protected]:10000",
}

response = requests.get("https://example.com", proxies=proxies)
print(response.status_code)

Oturum tabanlı scraping için (ör. scraping öncesi login), rotate yerine sticky session token kullanın; böylece akış boyunca aynı IP kullanılır.


Rastgele Gecikmeler Ekleyin

Farklı IP'lerle bile makine-kusursuz zamanlama kırmızı bayraktır. İstekler arasına insan benzeri duraklamalar ekleyin:

import time
import random

def human_delay(min_s=1.5, max_s=4.0):
    time.sleep(random.uniform(min_s, max_s))

for url in urls_to_scrape:
    response = requests.get(url, proxies=proxies)
    process(response)
    human_delay()

Rehber:

  • Çoğu sitede sayfa istekleri arasında 1–4 saniye
  • Toplu eylemler arasında (form gönderimi, login) 5–15 saniye
  • Okuma süresini taklit etmek için her N istekte ara sıra daha uzun duraklamalar (20–60 saniye)

Rastgele gecikmeleri IP rotasyonuyla birleştirmek, trafik kalıbınızı gerçek kullanıcı davranışından istatistiksel olarak ayırt edilemez hale getirir.


Yardımcı Ek Teknikler

Başlıkları Rastgeleleştirin

Gerçekçi bir User-Agent string'i ayarlayın ve döndürün. Ayrıca gerçek bir tarayıcı parmak izine uyması için Accept-Language, Accept-Encoding ve Referer başlıklarını ekleyin.

JS Ağırlıklı Siteler İçin Headless Browser Kullanın

İçeriği istemci tarafında render eden siteler Playwright veya Puppeteer gerektirir. Bunları residential proxy'lerimizle eşleştirmek için proxy uç noktasını tarayıcı launch seçeneklerine verin — hem tam JavaScript çalıştırma hem residential IP elde edersiniz.

robots.txt ve Rate Limit'lere Saygı Gösterin

Teknik önlemlerin ötesinde, kibar scraping normları içinde kalmak hedefli engellenme olasılığını düşürür ve birçok yargı bölgesinde yasal olarak da sizi korur.


Sonuç

Engellenmekten kaçınmak tek bir sihirli hile bulmak değildir — doğru araçları katmanlamaktır:

  1. Hedefiniz için doğru proxy türünü seçin (maksimum güven için residential, hız + güven için ISP, dedicated kimlik için IPv4, bütçe hacmi için IPv6).
  2. IP'leri akıllıca rotate edin — istek başına, oturum başına veya hata üzerine.
  3. Rastgele gecikmelerle insan zamanlamasını taklit edin.
  4. Gerçekçi başlıklar oluşturun ve JS ağırlıklı siteler için headless browser düşünün.

Kesintisiz veri toplamaya hazır mısınız? Proxy Satın Al

Fiyatları Görüntüle → · Ücretsiz Hesap Oluştur →