آموزش مسترکلاس جامع سلنیوم و بیوتیفول سوپ ۲۰۲۶ - آخرین آپدیت

دانلود The Complete Selenium and Beautiful Soup Masterclass 2026

نکته: ممکن هست محتوای این صفحه بروز نباشد ولی دانلود دوره آخرین آپدیت می باشد.
نمونه ویدیوها:
توضیحات دوره: تسلط بر استخراج داده‌های وب (Web Scraping) و اتوماسیون: BeautifulSoup، Selenium، Playwright، Scrapy، استقرار ابری و استخراج داده با هوش مصنوعی. ساخت استخراج‌کننده‌های قدرتمند با استفاده از BeautifulSoup، Requests و lxml. تجزیه و تحلیل HTMLهای پیچیده با استفاده از CSS Selectors، XPath و Regex. اتوماسیون هر وب‌سایتی با Selenium WebDriver – کلیک، تایپ، اسکرول، انتظار و تعامل با المان‌های پویا. مدیریت محتوای رندر شده توسط جاوا اسکریپت، اسکرول نامحدود (Infinite Scroll)، لود تنبل (Lazy Loading) و اپلیکیشن‌های تک صفحه‌ای (SPA). تسلط بر Playwright برای اتوماسیون مدرن مرورگر با قابلیت انتظار خودکار. استخراج داده از صفحات دارای احراز هویت: فرم‌های لاگین، توکن‌های JWT، OAuth2 و تایید دو مرحله‌ای (2FA). چرخش User-Agentها، ادغام پروکسی‌ها، دور زدن شناسایی بات‌ها و حل CAPTCHAها. ساخت پروژه‌های واقعی: ردیاب قیمت، تجمیع‌کننده آگهی‌های شغلی، دانلودر تصاویر، مانیتور تغییرات سایت و داشبوردهای Full-Stack. ذخیره داده‌ها در قالب CSV، JSON و SQLite و ساخت دیتابیس‌های رابطه‌ای از داده‌های استخراج شده. پیاده‌سازی Logging، مدیریت خطاها، منطق تلاش مجدد (Retry) و محدود کردن نرخ درخواست‌ها (Rate Limiting) برای سطح صنعتی. استقرار استخراج‌کننده‌ها در فضای ابری با GitHub Actions، Docker، Kubernetes و AWS Lambda. استفاده از Scrapy برای خزش‌های مقیاس بزرگ و همزمان، و asyncio برای درخواست‌های با سرعت بالا. استخراج داده از APIهای موبایل، فایل‌های PDF، اکسل و محتواهای بدون ساختار. به‌کارگیری متدهای اخلاقی در استخراج داده، احترام به robots.txt و درک قوانین حقوقی. بهره‌گیری از هوش مصنوعی (LLMs) برای استخراج و تجزیه هوشمند داده‌ها. پیشنیازها: اشتیاق به یادگیری عملی – تمامی ابزارها و دستورالعمل‌های نصب به صورت گام‌به‌گام در دوره پوشش داده شده است. آشنایی مقدماتی با پایتون (متغیرها، حلقه‌ها، توابع). هیچ تجربه قبلی در Web Scraping یا Selenium نیاز نیست. یک کامپیوتر (ویندوز، مک یا لینوکس) با دسترسی به اینترنت.

به جامع‌ترین دوره عملی استخراج داده‌های وب در Udemy خوش آمدید – به‌روزرسانی شده برای سال ۲۰۲۶ با ابزارهای مدرن و تکنیک‌های پیشرفته. چه مبتدی مطلق باشید و چه توسعه‌دهنده‌ای باتجربه که به دنبال ارتقای مهارت‌های خود است، این مسترکلاس شما را از صفر به سطح حرفه‌ای در BeautifulSoup، Selenium WebDriver، Playwright، Scrapyو استقرار ابریمی‌رساند.

شما با مفاهیم پایه شروع خواهید کرد: تجزیه HTML استاتیک با BeautifulSoup و کتابخانه Requests. تسلط بر پیمایش، انتخابگرهای CSS، صفحه‌بندی (Pagination)، ارسال فرم‌ها و پاک‌سازی داده‌های نامنظم. سپس، عمیقاً وارد Selenium WebDriverمی‌شوید – اتوماسیون مرورگرهای واقعی، کلیک روی دکمه‌ها، پر کردن فرم‌ها، مدیریت پاپ‌آپ‌ها، iframeها، کوکی‌ها و اجرای جاوا اسکریپت. در ادامه، محتواهای پویا شامل اسکرول نامحدود، لود تنبل و اپلیکیشن‌های تک صفحه‌ای (SPAs) را با استفاده از Selenium و فریم‌ورک مدرن Playwrightفتح خواهید کرد.

اما این دوره بسیار فراتر از استخراج ساده است. شما ۸ پروژه واقعیخواهید ساخت، از جمله ردیاب قیمت، جمع‌آوری نقل‌قول‌ها با بیوگرافی نویسندگان، تجمیع‌کننده آگهی‌های شغلی، استخراج داده از صفحات دارای لاگین، دانلودر تصاویر با اسکرول نامحدود، مانیتور تغییرات وب‌سایت، داشبورد Full-Stack با Flask و استخراج‌کننده API توکن‌محور. هر پروژه الگوهای حرفه‌ای مانند Logging، مدیریت خطا، منطق Retry و Rate Limiting مودبانه را تقویت می‌کند.

بخش‌های نهایی بر آماده‌سازی برای محیط عملیاتی (Production)تمرکز دارد. یاد می‌گیرید چگونه User-Agentها را بچرخانید، پروکسی‌ها (IPهای مسکونی و چرخشی) را ادغام کنید، شناسایی بات‌ها را دور بزنید، CAPTCHAها را حل کنید و استخراج‌کننده‌های خود را با استفاده از GitHub Actions، Docker، Kubernetes و AWS Lambdaدر ابر مستقر کنید. همچنین استخراج اخلاقی، رعایت robots.txt و قوانین حقوقی (GDPR, CCPA, CFAA) را پوشش می‌دهیم.

علاوه بر این، مباحث پیشرفته‌ای را خواهید آموخت: Scrapyبرای خزش‌های مقیاس بزرگ، استخراج Async با aiohttp، رهگیری درخواست‌های شبکه، اتوماسیون لاگین‌های OAuth2 و 2FA و حتی استفاده از LLMs (هوش مصنوعی)برای استخراج داده از HTMLهای بدون ساختار. در پایان، شما ابزارهای کاملی خواهید داشت که در مهندسی داده، تحلیل رقبا، اتوماسیون QA و اتوماسیون فرآیندهای تجاری بسیار پرتقاضا است.

تمامی کدها در قالب Jupyter Notebookهای آماده اجرا به همراه توضیحات صوتی دقیق، تمرین‌ها و پاسخ‌ها ارائه شده است. همین حالا ثبت‌نام کنید و وب را به دیتابیس شخصی خود تبدیل کنید.


سرفصل ها و درس ها

مقدمه Introduction

  • مقدمه Introduction

  • راه‌اندازی محیط پایتون (Anaconda, Jupyter, VS Code) Setting Up Your Python Environment (Anaconda, Jupyter, VS Code)

  • درک مفاهیم HTTP، HTML و DOM Understanding HTTP, HTML, and the DOM

  • بررسی صفحات وب با ابزارهای توسعه مرورگر (DevTools) Inspecting Web Pages with Browser DevTools

  • اولین استخراج‌کننده شما – دریافت صفحه با requests Your First Scraper – Fetching a Page with requests

مبانی BeautifulSoup BeautifulSoup Fundamentals

  • نصب BeautifulSoup و تجزیه HTML Installing BeautifulSoup and Parsing HTML

  • پیمایش درخت تجزیه – والدین، فرزندان و هم‌سایه‌ها Navigating the Parse Tree – Parents, Children, Siblings

  • متدهای find() و find_all() The find() and find_all() Methods

  • فیلتر کردن بر اساس ویژگی‌ها (Attributes) و متن Filtering by Attributes and Text

  • انتخابگرهای CSS با select() و select_one() CSS Selectors with select() and select_one()

  • استخراج متن و پاک‌سازی داده‌ها Extracting Text and Cleaning Data

  • کار با لینک‌ها و تصاویر Working with Links and Images

  • مدیریت جداول و لیست‌ها Handling Tables and Lists

  • ساخت استخراج‌کننده چندصفحه‌ای با Pagination Building a Multi-Page Scraper with Pagination

  • ترکیب requests و BeautifulSoup – یک گردش کار کامل Combining requests and BeautifulSoup – A Full Workflow

تکنیک‌های پیشرفته BeautifulSoup Advanced BeautifulSoup Techniques

  • مدیریت داده‌های گمشده و استخراج شرطی Handling Missing Data and Conditional Extraction

  • استفاده از Regular Expressions در BeautifulSoup Using Regular Expressions with BeautifulSoup

  • استخراج محتوای رندر شده با جاوا اسکریپت توسط requests-html Scraping JavaScript‑Rendered Content with requests-html

  • مدیریت Sessionها و کوکی‌ها با requests.Session Managing Sessions and Cookies with requests.Session

  • شبیه‌سازی ارسال فرم‌ها (GET و POST) Emulating Form Submissions (GET & POST)

  • مدیریت URLهای پویا و پارامترهای Query Handling Dynamic URLs and Query Parameters

  • نوشتن توابع و کلاس‌های استخراج‌کننده قابل استفاده مجدد Writing Reusable Scraper Functions and Classes

آشنایی با Selenium WebDriver Introduction to Selenium WebDriver

  • سلنیوم چیست؟ نصب WebDriver و درایورهای مرورگر What Is Selenium? Installing WebDriver and Browser Drivers

  • اجرای مرورگر و هدایت به یک URL Launching a Browser and Navigating to a URL

  • یافتن المان‌ها – از طریق ID، Name، Class و Tag Finding Elements – By ID, Name, Class, Tag

  • استفاده از XPath و CSS Selectors در سلنیوم XPath and CSS Selectors in Selenium

  • تعامل با المان‌ها – کلیک، ارسال کلیدها، پاک‌سازی Interacting with Elements – Click, Send Keys, Clear

  • تفاوت انتظار Implicit و Explicit Implicit vs. Explicit Waits

  • مدیریت محتوای پویا و AJAX Handling Dynamic Content and AJAX

  • استخراج داده‌ها از صفحه رندر شده Extracting Data from the Rendered Page

سلنیوم سطح متوسط Selenium Intermediate

  • کار با Dropdownها و المان‌های Select Working with Dropdowns and Select Elements

  • مدیریت Alertها، Promptها و دیالوگ‌های تایید Alerts, Prompts, and Confirmation Dialogs

  • کار با iframeها و Frameها Handling iframes and Frames

  • مدیریت چندین پنجره و Tab Managing Multiple Windows and Tabs

  • کوکی‌ها – خواندن، افزودن و حذف Cookies – Reading, Adding, and Deleting

  • گرفتن اسکرین‌شات و ذخیره سورس صفحه Taking Screenshots and Capturing Page Source

  • اجرای جاوا اسکریپت با سلنیوم Executing JavaScript with Selenium

  • زنجیره اقدامات (Action Chains) – هاور موس، کشیدن و رها کردن Action Chains – Mouse Hover, Drag & Drop

  • مرورگرهای Headless و بهینه‌سازی عملکرد Headless Browsers and Performance Optimisation

  • انتظارهای پیشرفته و شرایط سفارشی (Expected Conditions) Advanced Waits and Custom Expected Conditions

ترکیب BeautifulSoup و Selenium Combining BeautifulSoup and Selenium

  • چه زمانی از Selenium استفاده کنیم و چه زمانی از BeautifulSoup؟ When to Use Selenium vs. BeautifulSoup – Decision Framework

  • تزریق سورس صفحه سلنیوم به BeautifulSoup Feeding Selenium’s Page Source into BeautifulSoup

  • مدیریت اسکرول نامحدود و لود تنبل (Lazy Loading) Handling Infinite Scroll and Lazy Loading

  • استخراج داده از اپلیکیشن‌های پیچیده تک صفحه‌ای (SPAs) Scraping Complex Single‑Page Applications (SPAs)

  • استخراج ترکیبی – استخراج داده در چندین مرحله تعاملی Hybrid Scraping – Extracting Data Across Multiple Interaction Steps

  • ساخت استخراج‌کننده‌ای که ابتدا لاگین کرده و سپس داده می‌گیرد Building a Scraper That Logs In Then Scrapes

  • خط لوله داده – ذخیره داده‌ها در CSV، JSON و SQLite Data Pipeline – Storing Scraped Data in CSV, JSON, and SQLite

پروژه‌های دنیای واقعی Real‑World Projects

  • ردیاب قیمت فروشگاه آنلاین (books.toscrape.com) E‑Commerce Price Tracker (books.toscrape.com)

  • جمع‌آوری نقل‌قول‌ها با جزئیات نویسنده (quotes.toscrape.com) Quote Collector with Author Details (quotes.toscrape.com)

  • تجمیع‌کننده آگهی‌های شغلی (سایت دمو) Job Listings Aggregator (demo‑static site)

  • اتوماسیون لاگین و استخراج داده (the-internet.herokuapp.com) Automating Login and Data Extraction (the‑internet.herokuapp.com)

  • دانلودر تصاویر با اسکرول نامحدود (دموی پویا) Infinite Scroll Image Downloader (dynamic demo)

  • مانیتورینگ تغییرات وب‌سایت و ارسال هشدار Monitoring a Website for Changes and Sending Alerts

  • استخراج Full-Stack: از وب تا داشبورد (Flask/Local) Full‑Stack Scraping: From Web to Dashboard (Flask/Local)

  • استخراج داده از صفحات احراز هویت شده و مدیریت توکن‌ها Scraping Behind Authentication and Handling Tokens

بهترین روش‌ها، عیب‌یابی و استقرار Best Practices, Debugging & Deployment

  • لاگینگ، مدیریت خطا و منطق تلاش مجدد (Retry) Logging, Error Handling, and Retry Logic

  • رعایت robots.txt، محدود کردن نرخ درخواست و استخراج اخلاقی Respecting Robots.txt, Rate Limiting, and Ethical Scraping

  • User-Agentها، چرخش IP و ادغام پروکسی User‑Agents, IP Rotation, and Proxy Integration

  • عیب‌یابی استخراج‌کننده‌ها – اشتباهات رایج و راهکارها Debugging Scrapers – Common Pitfalls and Solutions

  • استقرار در ابر (GitHub Actions, AWS Lambda, Schedulers) و جمع‌بندی نهایی Deploying Scrapers to the Cloud (GitHub Actions, AWS Lambda, Schedulers) & Final

نمایش نظرات

آموزش مسترکلاس جامع سلنیوم و بیوتیفول سوپ ۲۰۲۶
جزییات دوره
6.5 hours
60
(آخرین آپدیت)
6
از 5
دارد
ندارد
ندارد
Shayan Janati
جهت دریافت آخرین اخبار و آپدیت ها در کانال تلگرام عضو شوید.

Google Chrome Browser

Internet Download Manager

Pot Player

Winrar

Shayan Janati Shayan Janati

کارشناس برنامه‌نویسی و مدرس زبان انگلیسی