لطفا جهت اطلاع از آخرین دوره ها و اخبار سایت در
کانال تلگرام
عضو شوید.
آموزش مسترکلاس جامع سلنیوم و بیوتیفول سوپ ۲۰۲۶
- آخرین آپدیت
دانلود The Complete Selenium and Beautiful Soup Masterclass 2026
نکته:
ممکن هست محتوای این صفحه بروز نباشد ولی دانلود دوره آخرین آپدیت می باشد.
نمونه ویدیوها:
توضیحات دوره:
تسلط بر استخراج دادههای وب (Web Scraping) و اتوماسیون: BeautifulSoup، Selenium، Playwright، Scrapy، استقرار ابری و استخراج داده با هوش مصنوعی.
ساخت استخراجکنندههای قدرتمند با استفاده از BeautifulSoup، Requests و lxml.
تجزیه و تحلیل HTMLهای پیچیده با استفاده از CSS Selectors، XPath و Regex.
اتوماسیون هر وبسایتی با Selenium WebDriver – کلیک، تایپ، اسکرول، انتظار و تعامل با المانهای پویا.
مدیریت محتوای رندر شده توسط جاوا اسکریپت، اسکرول نامحدود (Infinite Scroll)، لود تنبل (Lazy Loading) و اپلیکیشنهای تک صفحهای (SPA).
تسلط بر Playwright برای اتوماسیون مدرن مرورگر با قابلیت انتظار خودکار.
استخراج داده از صفحات دارای احراز هویت: فرمهای لاگین، توکنهای JWT، OAuth2 و تایید دو مرحلهای (2FA).
چرخش User-Agentها، ادغام پروکسیها، دور زدن شناسایی باتها و حل CAPTCHAها.
ساخت پروژههای واقعی: ردیاب قیمت، تجمیعکننده آگهیهای شغلی، دانلودر تصاویر، مانیتور تغییرات سایت و داشبوردهای Full-Stack.
ذخیره دادهها در قالب CSV، JSON و SQLite و ساخت دیتابیسهای رابطهای از دادههای استخراج شده.
پیادهسازی Logging، مدیریت خطاها، منطق تلاش مجدد (Retry) و محدود کردن نرخ درخواستها (Rate Limiting) برای سطح صنعتی.
استقرار استخراجکنندهها در فضای ابری با GitHub Actions، Docker، Kubernetes و AWS Lambda.
استفاده از Scrapy برای خزشهای مقیاس بزرگ و همزمان، و asyncio برای درخواستهای با سرعت بالا.
استخراج داده از APIهای موبایل، فایلهای PDF، اکسل و محتواهای بدون ساختار.
بهکارگیری متدهای اخلاقی در استخراج داده، احترام به robots.txt و درک قوانین حقوقی.
بهرهگیری از هوش مصنوعی (LLMs) برای استخراج و تجزیه هوشمند دادهها.
پیشنیازها: اشتیاق به یادگیری عملی – تمامی ابزارها و دستورالعملهای نصب به صورت گامبهگام در دوره پوشش داده شده است.
آشنایی مقدماتی با پایتون (متغیرها، حلقهها، توابع). هیچ تجربه قبلی در Web Scraping یا Selenium نیاز نیست.
یک کامپیوتر (ویندوز، مک یا لینوکس) با دسترسی به اینترنت.
به جامعترین دوره عملی استخراج دادههای وب در Udemy خوش آمدید – بهروزرسانی شده برای سال ۲۰۲۶ با ابزارهای مدرن و تکنیکهای پیشرفته. چه مبتدی مطلق باشید و چه توسعهدهندهای باتجربه که به دنبال ارتقای مهارتهای خود است، این مسترکلاس شما را از صفر به سطح حرفهای در BeautifulSoup، Selenium WebDriver، Playwright، Scrapyو استقرار ابریمیرساند.
شما با مفاهیم پایه شروع خواهید کرد: تجزیه HTML استاتیک با BeautifulSoup و کتابخانه Requests. تسلط بر پیمایش، انتخابگرهای CSS، صفحهبندی (Pagination)، ارسال فرمها و پاکسازی دادههای نامنظم. سپس، عمیقاً وارد Selenium WebDriverمیشوید – اتوماسیون مرورگرهای واقعی، کلیک روی دکمهها، پر کردن فرمها، مدیریت پاپآپها، iframeها، کوکیها و اجرای جاوا اسکریپت. در ادامه، محتواهای پویا شامل اسکرول نامحدود، لود تنبل و اپلیکیشنهای تک صفحهای (SPAs) را با استفاده از Selenium و فریمورک مدرن Playwrightفتح خواهید کرد.
اما این دوره بسیار فراتر از استخراج ساده است. شما ۸ پروژه واقعیخواهید ساخت، از جمله ردیاب قیمت، جمعآوری نقلقولها با بیوگرافی نویسندگان، تجمیعکننده آگهیهای شغلی، استخراج داده از صفحات دارای لاگین، دانلودر تصاویر با اسکرول نامحدود، مانیتور تغییرات وبسایت، داشبورد Full-Stack با Flask و استخراجکننده API توکنمحور. هر پروژه الگوهای حرفهای مانند Logging، مدیریت خطا، منطق Retry و Rate Limiting مودبانه را تقویت میکند.
بخشهای نهایی بر آمادهسازی برای محیط عملیاتی (Production)تمرکز دارد. یاد میگیرید چگونه User-Agentها را بچرخانید، پروکسیها (IPهای مسکونی و چرخشی) را ادغام کنید، شناسایی باتها را دور بزنید، CAPTCHAها را حل کنید و استخراجکنندههای خود را با استفاده از GitHub Actions، Docker، Kubernetes و AWS Lambdaدر ابر مستقر کنید. همچنین استخراج اخلاقی، رعایت robots.txt و قوانین حقوقی (GDPR, CCPA, CFAA) را پوشش میدهیم.
علاوه بر این، مباحث پیشرفتهای را خواهید آموخت: Scrapyبرای خزشهای مقیاس بزرگ، استخراج Async با aiohttp، رهگیری درخواستهای شبکه، اتوماسیون لاگینهای OAuth2 و 2FA و حتی استفاده از LLMs (هوش مصنوعی)برای استخراج داده از HTMLهای بدون ساختار. در پایان، شما ابزارهای کاملی خواهید داشت که در مهندسی داده، تحلیل رقبا، اتوماسیون QA و اتوماسیون فرآیندهای تجاری بسیار پرتقاضا است.
تمامی کدها در قالب Jupyter Notebookهای آماده اجرا به همراه توضیحات صوتی دقیق، تمرینها و پاسخها ارائه شده است. همین حالا ثبتنام کنید و وب را به دیتابیس شخصی خود تبدیل کنید.
سرفصل ها و درس ها
مقدمه
Introduction
مقدمه
Introduction
راهاندازی محیط پایتون (Anaconda, Jupyter, VS Code)
Setting Up Your Python Environment (Anaconda, Jupyter, VS Code)
درک مفاهیم HTTP، HTML و DOM
Understanding HTTP, HTML, and the DOM
بررسی صفحات وب با ابزارهای توسعه مرورگر (DevTools)
Inspecting Web Pages with Browser DevTools
اولین استخراجکننده شما – دریافت صفحه با requests
Your First Scraper – Fetching a Page with requests
مبانی BeautifulSoup
BeautifulSoup Fundamentals
نصب BeautifulSoup و تجزیه HTML
Installing BeautifulSoup and Parsing HTML
پیمایش درخت تجزیه – والدین، فرزندان و همسایهها
Navigating the Parse Tree – Parents, Children, Siblings
متدهای find() و find_all()
The find() and find_all() Methods
فیلتر کردن بر اساس ویژگیها (Attributes) و متن
Filtering by Attributes and Text
انتخابگرهای CSS با select() و select_one()
CSS Selectors with select() and select_one()
استخراج متن و پاکسازی دادهها
Extracting Text and Cleaning Data
کار با لینکها و تصاویر
Working with Links and Images
مدیریت جداول و لیستها
Handling Tables and Lists
ساخت استخراجکننده چندصفحهای با Pagination
Building a Multi-Page Scraper with Pagination
ترکیب requests و BeautifulSoup – یک گردش کار کامل
Combining requests and BeautifulSoup – A Full Workflow
مانیتورینگ تغییرات وبسایت و ارسال هشدار
Monitoring a Website for Changes and Sending Alerts
استخراج Full-Stack: از وب تا داشبورد (Flask/Local)
Full‑Stack Scraping: From Web to Dashboard (Flask/Local)
استخراج داده از صفحات احراز هویت شده و مدیریت توکنها
Scraping Behind Authentication and Handling Tokens
بهترین روشها، عیبیابی و استقرار
Best Practices, Debugging & Deployment
لاگینگ، مدیریت خطا و منطق تلاش مجدد (Retry)
Logging, Error Handling, and Retry Logic
رعایت robots.txt، محدود کردن نرخ درخواست و استخراج اخلاقی
Respecting Robots.txt, Rate Limiting, and Ethical Scraping
User-Agentها، چرخش IP و ادغام پروکسی
User‑Agents, IP Rotation, and Proxy Integration
عیبیابی استخراجکنندهها – اشتباهات رایج و راهکارها
Debugging Scrapers – Common Pitfalls and Solutions
استقرار در ابر (GitHub Actions, AWS Lambda, Schedulers) و جمعبندی نهایی
Deploying Scrapers to the Cloud (GitHub Actions, AWS Lambda, Schedulers) & Final
نمایش نظرات