مقدمهای بر PySpark
✅ سرفصل و جزئیات آموزش
این دوره برای مهندسان داده، دانشمندان داده و متخصصان یادگیری ماشین که به دنبال کار کارآمد با مجموعه داده بزرگ هستند، بسیار مناسب است. چه در حال انتقال از ابزارهایی مانند Pandas باشید و چه برای اولین بار وارد دنیای فناوریهای کلانداده میشوید، این دوره مقدمهای قوی بر PySpark و پردازش توزیعشده داده ارائه میدهد.
چرا Spark؟ چرا اکنون؟
سرعت و مقیاسپذیری Apache Spark، چارچوب قدرتمند طراحی شده برای مدیریت کلانداده را کشف کنید. از طریق درسهای تعاملی و تمرینهای عملی، خواهید دید که چگونه پردازش درونحافظهای در Spark، به آن برتری نسبت به چارچوبهای سنتی مانند Hadoop میدهد. شما با راهاندازی سشن های Spark کار را آغاز کرده و در اجزای اصلی مانند مجموعه داده توزیعشده انعطافپذیر (RDDs) و دیتافریمها عمیق خواهید شد. یاد بگیرید که چگونه هنگام کار بر روی مثالهای دنیای واقعی، مجموعه داده را بهسادگی فیلتر، گروهبندی و ادغام کنید.
تقویت مهارتهای Python و SQL خود برای کلانداده
بیاموزید چگونه از PySpark SQL برای کوئری و مدیریت داده با استفاده از سینتکس آشنای SQL بهره ببرید. به سراغ طرحوارهها، انواع داده پیچیده و توابع تعریفشده توسط کاربر (UDFs) بروید، در حالی که مهارتهای خود را در کش کردن و بهینهسازی عملکرد برای سیستمهای توزیعشده میسازید.
اصول کلانداده خود را بسازید.
در پایان این دوره، اعتمادبهنفس لازم برای مدیریت، کوئری و پردازش کلانداده با استفاده از PySpark را خواهید داشت. با این مهارتهای اساسی، آماده بررسی در موضوعات پیشرفته مانند یادگیری ماشین و تحلیل کلانداده خواهید بود.
مقدمهای بر PySpark
-
مقدمه ای بر PySpark None
-
مقدمه ای بر دیتافریمهای PySpark None
-
بیشتر درباره دیتافریمهای Spark None
-
دستکاری داده با دیتافریمها None
-
عملیات پیشرفته دیتافریم None
-
تعریف کنید، استفاده کنید! None
-
مجموعه داده توزیعشده انعطافپذیر (RDDs) در PySpark None
-
مقدمهای بر Spark SQL None
-
تجمعسازی در PySpark None
-
PySpark در مقیاس بزرگ None
-
چه آموختهایم؟ None
مشخصات آموزش
مقدمهای بر PySpark
- تاریخ به روز رسانی: 1404/12/10
- سطح دوره:متوسط
- تعداد درس:11
- مدت زمان :4:00:00
- حجم :260.0MB
- زبان:دوبله زبان فارسی
- دوره آموزشی:AI Academy