class Scraper:
async def run_scraper(self):
proxy_urls = process_proxy_file('proxy_list.txt')
proxy_configuration = ProxyConfiguration(proxy_urls=proxy_urls)
crawler = PlaywrightCrawler(proxy_configuration=proxy_configuration, headless=False, browser_type='chromium')
@crawler.router.default_handler
async def request_handler(context: PlaywrightCrawlingContext) -> None:
print('Handling request...')
context.request.state(RequestState.UNPROCESSED)
# Scrape logic here
# Return scraped data if needed
request = Request.from_url('https://crawlee.dev')
await crawler.run([request])
return "Example Scraped Data"
class Scraper:
async def run_scraper(self):
proxy_urls = process_proxy_file('proxy_list.txt')
proxy_configuration = ProxyConfiguration(proxy_urls=proxy_urls)
crawler = PlaywrightCrawler(proxy_configuration=proxy_configuration, headless=False, browser_type='chromium')
@crawler.router.default_handler
async def request_handler(context: PlaywrightCrawlingContext) -> None:
print('Handling request...')
context.request.state(RequestState.UNPROCESSED)
# Scrape logic here
# Return scraped data if needed
request = Request.from_url('https://crawlee.dev')
await crawler.run([request])
return "Example Scraped Data"