دوره آموزشی
The Great Courses
دوبله زبان فارسی

راهنمای عملی راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH

راهنمای عملی راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH

✅ سرفصل و جزئیات آموزش

آنچه یاد خواهید گرفت:

  • یادگیری مدیریت Hadoop و Spark با استفاده از CDH
  • تأمین خوشه از GCP (Google Cloud Platform) برای راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH
  • راه‌اندازی Ansible برای اتوماسیون سرورها و آماده‌سازی پیش‌نیازهای راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH
  • راه‌اندازی یک خوشه 8 نودی از ابتدا با استفاده از CDH
  • آشنایی با معماری HDFS و YARN و Spark و Hive و Hue و موارد دیگر

پیش‌نیازهای دوره

  • مهارت‌های پایه Linux
  • یک رایانه 64 بیتی با حداقل 4 GB RAM
  • سیستم‌عامل - Windows 10 یا مک یا یکی از نسخه‌های Linux

توضیحات دوره

Cloudera یکی از پیشروترین ارائه‌دهندگان توزیع‌های مرتبط با Hadoop و Spark است. در این راهنمای عملی، فرآیند راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH را به‌ صورت گام‌به‌گام یاد خواهید گرفت.

نصب - نمایش درک خود از فرآیند نصب Cloudera Manager و CDH و پروژه‌های اکوسیستم

  • راه‌اندازی یک مخزن محلی CDH
  • انجام پیکربندی در سطح سیستم‌عامل برای نصب Hadoop
  • نصب سرور و ایجنت‌های Cloudera Manager
  • نصب CDH با استفاده از Cloudera Manager
  • افزودن یک نود جدید به خوشه موجود
  • افزودن یک سرویس با استفاده از Cloudera Manager

پیکربندی - انجام پیکربندی‌های پایه و پیشرفته مورد نیاز برای مدیریت مؤثر خوشه Hadoop

  • پیکربندی یک سرویس با استفاده از Cloudera Manager
  • ایجاد دایرکتوری home برای کاربر HDFS
  • پیکربندی NameNode HA
  • پیکربندی ResourceManager HA
  • پیکربندی proxy برای Hiveserver2/Impala

مدیریت - نگهداری و اصلاح خوشه برای پشتیبانی از عملیات‌های روزمره در سازمان

  • متعادل‌سازی مجدد خوشه
  • راه‌اندازی هشدارها برای پر شدن بیش از حد دیسک
  • تعریف و نصب اسکریپت توپولوژی rack
  • نصب نوع جدیدی از کتابخانه فشرده‌سازی I/O در خوشه
  • بازنگری تخصیص منابع YARN بر اساس بازخورد کاربران
  • افزودن و حذف یک نود از سرویس

ایمن‌سازی - فعال‌سازی سرویس‌های مرتبط و پیکربندی خوشه برای دستیابی به اهداف تعریف‌ شده در سیاست امنیتی - نمایش دانش درباره اصول پایه امنیت

  • پیکربندی HDFS ACLs
  • نصب و پیکربندی Sentry
  • پیکربندی مجوزدهی و احراز هویت کاربران Hue
  • فعال‌سازی و پیکربندی redaction برای لاگ و کوئری
  • ایجاد زون‌های رمزنگاری‌ شده در HDFS

تست - بنچ‌مارکینگ متریک‌های عملیاتی خوشه و تست پیکربندی سیستم برای عملکرد و کارایی

  • اجرای فرمان‌های فایل‌ سیستم از طریق HTTPFS
  • کپی مؤثر داده‌ درون یک خوشه و یا بین خوشه‌ها
  • ایجاد و بازیابی snapshot از یک دایرکتوری HDFS
  • دریافت و تنظیم ACLs برای یک فایل یا ساختار دایرکتوری
  • بنچ‌مارک‌ کردن خوشه (I/O و CPU، شبکه)

عیب‌یابی - نمایش توانایی یافتن علت ریشه‌ای یک مشکل، بهینه‌سازی اجرای ناکارآمد و رفع سناریوهای رقابت بر سر منابع

  • رفع خطاها و هشدارها در Cloudera Manager
  • رفع مشکلات عملکرد و خطاها در عملیات خوشه
  • تعیین دلیل شکست اپلیکیشن
  • پیکربندی Fair Scheduler برای رفع تأخیرهای اپلیکیشن

رویکرد ما

  • کار را با ساخت Cloudera QuickStart VM آغاز می‌کنید (در صورتی که لپ‌تاپی با 16 GB RAM و Quad Core داشته باشید). این کار به شما کمک می‌کند با Cloudera Manager راحت‌تر آشنا شوید.
  • شما یک مرور کوتاه از GCP خواهید داشت و 7 تا 8 ماشین مجازی را با استفاده از قالب‌ها تامین می‌کنید. همچنین یک هارددیسک خارجی متصل می‌کنید تا بعداً برای HDFS پیکربندی شود.
  • پس از تامین سرورها، سراغ راه‌اندازی Ansible برای اتوماسیون سرورها می‌روید.
  • مخزن محلی برای Cloudera Manager و Cloudera Distribution of Hadoop را با استفاده از پکیج‌ها آماده می‌کنید.
  • سپس Cloudera Manager را با پایگاه‌ داده سفارشی راه‌اندازی می‌کنید و بعد Cloudera Distribution of Hadoop را با استفاده از Wizard موجود در Cloudera Manager نصب می‌کنید.
  • در فرآیند راه‌اندازی Cloudera Distribution of Hadoop شما HDFS را راه‌اندازی می‌کنید، فرمان‌های HDFS را یاد می‌گیرید، YARN را راه‌اندازی می‌کنید، High Availability در HDFS و YARN را پیکربندی می‌کنید، با Schedulers آشنا می‌شوید، Spark را راه‌اندازی می‌کنید، به Parcels مهاجرت می‌کنید، Hive و Impala را راه‌اندازی کرده و HBase و Kafka را راه‌اندازی می‌کنید.

این دوره برای چه کسانی مناسب است؟

  • مدیران سیستم که می‌خواهند اکوسیستم کلان داده و راه‌اندازی خوشه‌ها را درک کنند.
  • مدیران باتجربه کلان داده که می‌خواهند مدیریت راه‌اندازی خوشه‌های Hadoop و Spark با استفاده از CDH را یاد بگیرند.
  • افراد در سطح مبتدی که می‌خواهند مبانی و راه‌اندازی خوشه‌های کلان داده را یاد بگیرند.

راهنمای عملی راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH

  • مقدمه‌ای بر دوره 05:57
  • CCA 131 - Administrator - صفحه رسمی 03:41
  • درک مهارت‌های مورد نیاز برای این گواهینامه 04:42
  • درک محیطی که هنگام آزمون در اختیار شما قرار می‌گیرد 03:03
  • ثبت‌نام برای آزمون 04:28
  • مقدمه 01:46
  • راه‌اندازی Ubuntu با استفاده از Windows Subsystem 05:28
  • ثبت‌نام در GCP 07:09
  • ایجاد قالب برای سرور کلان داده 04:47
  • تامین سرورها برای خوشه کلان داده 09:52
  • مرور مفاهیم 11:43
  • راه‌اندازی gcloud 12:58
  • راه‌اندازی ansible روی اولین سرور 05:29
  • فرمت‌بندی JBOD 06:06
  • توپولوژی خوشه 11:30
  • مقدمه 08:29
  • مروری بر yum 07:44
  • راه‌اندازی سرویس httpd 10:32
  • راه‌اندازی مخزن محلی yum - بررسی Cloudera Manager 09:48
  • راه‌اندازی مخزن محلی yum - بررسی Cloudera Distribution of Hadoop (CDH) 04:49
  • کپی فایل‌های repo 10:17
  • مقدمه 01:44
  • راه‌اندازی پیش‌نیازها 05:41
  • نصب Cloudera Manager 06:06
  • مجوزدهی و گزینه‌های نصب 05:16
  • نصب CM و CDH روی همه نودها 09:05
  • CM Agents و CM Server 04:44
  • راه‌اندازی Cloudera Management Service 06:03
  • Cloudera Management Service - کامپوننت‌ها 09:13
  • مقدمه 02:12
  • فرآیند یادگیری 05:25
  • راه‌اندازی Zookeeper 10:06
  • مرور ویژگی‌های مهم 06:49
  • مفاهیم Zookeeper 13:45
  • فرمان‌های مهم Zookeeper 10:16
  • مقدمه 06:26
  • راه‌اندازی HDFS 18:40
  • کپی داده‌ به HDFS 08:45
  • ادامه کپی داده‌ به HDFS 10:42
  • کامپوننت‌های HDFS 10:57
  • ادامه کامپوننت‌های HDFS 10:03
  • فایل‌های پیکربندی و ویژگی‌های مهم 19:17
  • مرور رابط‌های کاربری وب و فایل‌های لاگ 16:02
  • Checkpointing 12:11
  • ادامه Checkpointing 09:24
  • فرآیند بازیابی Namenode 07:15
  • پیکربندی Rack Awareness 10:23
  • مقدمه 02:17
  • دریافت لیست فرمان‌ها و راهنما 14:42
  • ایجاد دایرکتوری‌ها و تغییر مالکیت 08:38
  • مدیریت فایل‌ها و مجوزهای فایل - حذف فایل‌ها از HDFS 06:45
  • مدیریت فایل‌ها و مجوزهای فایل - کپی فایل‌ها بین فایل‌ سیستم محلی و HDFS 13:45
  • مدیریت فایل‌ها و مجوزهای فایل - کپی فایل‌ها در HDFS 06:26
  • مدیریت فایل‌ها و مجوزهای فایل - پیش‌نمایش داده‌ در HDFS 05:00
  • مدیریت فایل‌ها و مجوزهای فایل - تغییر مجوزهای فایل 08:43
  • کنترل دسترسی با استفاده از ACLs - فعال‌سازی ACLs در خوشه 02:59
  • کنترل دسترسی با استفاده از ACLs - بررسی ACLs روی فایل‌ها 05:05
  • کنترل دسترسی با استفاده از ACLs - بررسی ACLs روی دایرکتوری‌ها 10:08
  • کنترل دسترسی با استفاده از ACLs - حذف ACLs 04:03
  • Overriding ویژگی‌ها 11:11
  • فرمان‌های استفاده از HDFS و دریافت متادیتا 11:54
  • ایجاد snapshots 05:21
  • استفاده از CLI برای مدیریت 09:06
  • مقدمه 03:38
  • راه‌اندازی YARN + MR2 09:28
  • اجرای یک job ساده MapReduce 07:15
  • کامپوننت‌های YARN و MR2 05:48
  • فایل‌های پیکربندی و ویژگی‌های مهم - مروری کلی 04:10
  • فایل‌های پیکربندی و ویژگی‌های مهم - مرور ویژگی‌های YARN 13:18
  • فایل‌های پیکربندی و ویژگی‌های مهم - مرور ویژگی‌های MapReduce 08:18
  • فایل‌های پیکربندی و ویژگی‌های مهم - اجرای jobs 13:05
  • مرور رابط‌های کاربری وب و فایل‌های لاگ 13:20
  • CLI مربوط به YARN و MR2 14:54
  • چرخه عمر اپلیکیشن در YARN 05:08
  • چرخه عمر اجرای job در MapReduce 18:40
  • مقدمه 01:37
  • High Availability - مروری کلی 04:14
  • پیکربندی HDFS Namenode HA 12:16
  • مرور ویژگی‌ها - HDFS Namenode HA 05:41
  • HDFS Namenode HA - مرور سریع پیکربندی معمول HDFS 07:52
  • HDFS Namenode HA - کاپدوننت‌ها 06:35
  • HDFS Namenode HA - بررسی failover خودکار 05:37
  • پیکربندی YARN Resource Manager HA 03:22
  • بررسی YARN Resource Manager HA 06:10
  • High Availability - نتایج 07:35
  • مقدمه 01:19
  • مروری بر Schedulers 01:57
  • FIFO Scheduler 09:25
  • مقدمه‌ای بر Fair Scheduler 02:41
  • پیکربندی Fair Scheduler - پیکربندی خوشه با Fair Scheduler 05:47
  • پیکربندی Fair Scheduler - اجرای jobs بدون تعیین صف 08:32
  • پیکربندی Fair Scheduler - اجرای jobs با تعیین صف 06:52
  • پیکربندی Fair Scheduler - ویژگی‌های مهم 06:24
  • Scheduler ظرفیت - مقدمه 02:04
  • Scheduler ظرفیت - پیکربندی با استفاده از Cloudera Manager 03:38
  • Scheduler ظرفیت - اجرای jobs نمونه 06:05
  • مقدمه 06:30
  • راه‌اندازی و اعتبارسنجی Spark 1.6.x 13:07
  • مرور ویژگی‌های مهم 05:17
  • چرخه عمر اجرای Spark 12:24
  • تبدیل خوشه به Parcels 13:01
  • راه‌اندازی Spark 2.3.x 11:03
  • اجرای jobs در Spark - بررسی Spark 2.3.x 07:42
  • مقدمه 06:37
  • راه‌اندازی Hive و Impala 08:36
  • اعتبارسنجی Hive و Impala 10:42
  • کامپوننت‌ها و ویژگی‌های Hive 10:42
  • عیب‌یابی مشکلات Hive 07:05
  • فرمان‌ها و کوئری‌های Hive 16:50
  • موتورهای مختلف کوئری 12:35
  • کامپوننت‌ها و ویژگی‌های Impala 09:31
  • اجرای کوئری‌ها با استفاده از Impala - مروری کلی 04:57
  • مقدمه 04:20
  • راه‌اندازی Oozie و Pig و Sqoop و Hue 12:34
  • مرور ویژگی‌های مهم 06:32
  • اجرای نمونه job در Oozie 14:20
  • اجرای job در Pig 06:20
  • اعتبارسنجی Sqoop 07:49
  • مروری بر Hue 06:33
  • مقدمه 03:08
  • مروری بر Kafka 09:08
  • راه‌اندازی Parcels و افزودن سرویس Kafka 08:48
  • اعتبارسنجی Kafka 08:00
  • راه‌اندازی HBase 11:40
  • اعتبارسنجی HBase 07:27
  • مقدمه 00:44
  • راه‌اندازی مخزن محلی CDH 03:23
  • انجام پیکربندی در سطح سیستم‌ عامل 14:14
  • نصب سرور و ایجنت‌های Cloudera Manager 03:21
  • نصب CDH با استفاده از Cloudera Manager 02:26
  • افزودن یک نود جدید به خوشه موجود 13:59
  • نصب - افزودن میزبان به‌عنوان worker 13:40
  • افزودن یک سرویس با استفاده از Cloudera Manager 03:20
  • مقدمه 00:37
  • پیکربندی یک سرویس با استفاده از Cloudera Manager 07:51
  • ایجاد دایرکتوری home برای کاربر HDFS 00:48
  • پیکربندی NameNode HA 01:28
  • پیکربندی ResourceManager HA 01:19
  • پیکربندی proxy برای HiveServer2 و Impala - نصب HA Proxy 07:15
  • پیکربندی proxy برای HiveServer2 08:28
  • پیکربندی proxy برای Impala 04:38
  • مقدمه 01:23
  • متعادل‌سازی مجدد خوشه 06:55
  • راه‌اندازی هشدار برای پر شدن بیش از حد دیسک 09:15
  • تعریف و نصب اسکریپت توپولوژی rack 00:50
  • افزودن کتابخانه فشرده‌سازی I/O 05:37
  • تخصیص منابع YARN 16:49
  • افزودن و حذف یک نود از سرویس 10:41
  • مقدمه 01:27
  • پیکربندی HDFS ACLs 01:15
  • نصب و پیکربندی Sentry 04:57
  • پیکربندی مجوزدهی و احراز هویت کاربران Hue 01:04
  • فعال‌سازی یا پیکربندی redaction برای لاگ و کوئری 06:51
  • ایجاد زون‌های رمزنگاری‌ شده در HDFS - فعال‌سازی رمزنگاری 06:54
  • ایجاد زون‌های رمزنگاری‌ شده در HDFS - ایجاد کلیدها و زون‌های رمزنگاری 10:06
  • مقدمه 01:34
  • اجرای فرمان‌های فایل‌ سیستم از طریق HTTPFS 10:24
  • کپی مؤثر داده‌ درون یک خوشه 00:58
  • کپی مؤثر داده‌ بین خوشه‌ها 07:25
  • ایجاد و بازیابی snapshot از یک دایرکتوری HDFS 06:19
  • دریافت و تنظیم ACLs برای یک فایل یا ساختار دایرکتوری 01:15
  • بنچ‌مارک‌ کردن خوشه (I/O و CPU، شبکه) 15:40
  • رفع خطاها و هشدارها در Cloudera Manager 12:32
  • رفع مشکلات عملکرد/خطاها در عملیات خوشه 19:25

12,476,400 3,119,100 تومان

مشخصات آموزش

راهنمای عملی راه‌اندازی خوشه Hadoop و Spark با استفاده از CDH

  • تاریخ به روز رسانی: 1405/04/02
  • سطح دوره:متوسط
  • تعداد درس:164
  • مدت زمان :20:56:01
  • حجم :18.06GB
  • زبان:دوبله زبان فارسی
  • دوره آموزشی:AI Academy

آموزش های مرتبط

The Great Courses
2,260,000 452,000 تومان
  • زمان: 03:02:02
  • تعداد درس: 14
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
795,000 159,000 تومان
  • زمان: 58:00
  • تعداد درس: 12
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
19,403,000 3,880,600 تومان
  • زمان: 26:02:40
  • تعداد درس: 175
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
8,508,000 1,701,600 تومان
  • زمان: 11:25:13
  • تعداد درس: 94
  • سطح دوره:
  • زبان: دوبله فارسی
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
1,833,000 366,600 تومان
  • زمان: 02:27:39
  • تعداد درس: 24
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
6,100,500 1,220,100 تومان
  • زمان: 08:11:21
  • تعداد درس: 28
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
7,256,500 1,451,300 تومان
  • زمان: 09:44:25
  • تعداد درس: 67
  • سطح دوره:
  • زبان: دوبله فارسی
The Great Courses
3,634,500 726,900 تومان
  • زمان: 04:52:43
  • تعداد درس: 38
  • سطح دوره:
  • زبان: دوبله فارسی

آیا سوالی دارید؟

ما به شما کمک خواهیم کرد تا شغل و رشد خود را افزایش دهید.
امروز با ما تماس بگیرید