اصول کلان داده با PySpark
✅ سرفصل و جزئیات آموزش
در سالهای اخیر هیاهوی زیادی پیرامون کلان داده وجود داشته است و سرانجام برای بسیاری از شرکتها به جریان اصلی تبدیل شده است. اما این کلان داده چیست؟ این دوره مبانی کلان داده را از طریق PySpark پوشش میدهد. Spark یک فریمورک «رایانش خوشهای با سرعت برق» برای کلان داده است. این فریمورک یک موتور پلتفرم پردازش داده عمومی ارائه میدهد و به شما امکان میدهد برنامهها را تا 100 برابر سریعتر در حافظه، یا 10 برابر سریعتر روی دیسک، نسبت به Hadoop اجرا کنید.
شما از PySpark استفاده خواهید کرد، که یک پکیج پایتون برای برنامهنویسی Spark و کتابخانههای قدرتمند و سطح بالای آن مانند SparkSQL ،MLlib (برای یادگیری ماشین) و غیره است. شما آثار ویلیام شکسپیر را بررسی خواهید کرد، دادههای Fifa 2018 را تحلیل میکنید و روی مجموعهداده ژنومی خوشهبندی انجام خواهید داد. در پایان این دوره، درک عمیقی از PySpark و کاربرد آن در تحلیل عمومی کلان داده به دست خواهید آورد.
اصول کلان داده با PySpark
-
کلان داده چیست؟ None
-
PySpark: اسپارک با پایتون None
-
مروری بر برنامهنویسی تابعی در پایتون None
-
انتزاع داده با RDDها None
-
تبدیلها و اکشنهای اولیه در RDD None
-
RDDهای جفتی در PySpark None
-
اکشنهای پیشرفته RDD None
-
انتزاع داده با DataFrameها None
-
کار با DataFrameها در PySpark None
-
تعامل با DataFrameها با استفاده از PySpark SQL None
-
مصورسازی داده در PySpark با استفاده از DataFrameها None
-
مروری بر PySpark MLlib None
-
فیلترینگ مشارکتی None
-
طبقهبندی None
-
خوشهبندی None
-
تبریک! None
مشخصات آموزش
اصول کلان داده با PySpark
- تاریخ به روز رسانی: 1404/12/10
- سطح دوره:پیشرفته
- تعداد درس:16
- مدت زمان :4:00:00
- حجم :321.0MB
- زبان:دوبله زبان فارسی
- دوره آموزشی:AI Academy