دوره آموزشی
دوبله زبان فارسی
تسلط به فناوریهای صوتی هوش مصنوعی
✅ سرفصل و جزئیات آموزش
آنچه یاد خواهید گرفت:
- استفاده از سیستمهای تبدیل متن به گفتار
- توانایی انجام شبیهسازی صدا
- ساخت سیستم صوتی مبتنی بر هوش مصنوعی
- تنظیم دقیق و بهبود سیستم تبدیل متن به گفتار
پیشنیازهای دوره
- مبانی پایتون
توضیحات دوره
دوره: تسلط به فناوریهای صوتی هوش مصنوعی
بخش 1: مقدمهای بر دوره: فناوری صدای هوش مصنوعی
- مروری بر دوره، چگونگی رویکرد به یادگیری، و معرفی ابزارهایی مانند Google Colab و Visual Studio Code برای توسعه TTS
بخش 2: تبدیل متن به گفتار به شیوه قدیمی
- بررسی متدهای سنتی TTS با استفاده از کتابخانههایی مانند pyttsx3 و gTTS، هم بهصورت آفلاین و هم از طریق Google Colab.
بخش 3: ارائهدهندگان بزرگ تبدیل متن به گفتار
- معرفی ارائهدهندگان اصلی TTS مانند 11lab، Speechify و OpenAI، و برجستهسازی خدمات و قابلیتهای آنها
بخش 4: TTS متنباز: VITS
- بررسی عمیق فناوری VITS (تبدیل متن به گفتار با استنتاج متغیر)، شامل چگونگی اجرای آن و اینکه چرا به عنوان روشی قدرتمند برای سنتز گفتار با کیفیت بالا در نظر گرفته میشود.
بخش 5: شبیهسازی صدا با Piper TTS
- بررسی در تکنیکهای شبیهسازی صدا با استفاده از Piper TTS، شامل راهاندازی، آموزش و شبیهسازی صدا در زبانهای متعدد (مانند انگلیسی و ویتنامی)
بخش 6: شبیهسازی صدا با OpenVoices
- معرفی OpenVoices، با تمرکز بر شبیهسازی صدا برای زبان انگلیسی و پشتیبانی چندزبانه برای سنتز صدای بینزبانی
بخش 7: شبیهسازی صدا با Tortoise TTS (XTTS)
- یادگیری درباره Tortoise TTS، یک سیستم پیشرفته برای شبیهسازی صدا، و چگونگی تنظیم دقیق آن برای زبانهای مختلف، از جمله انگلیسی، ویتنامی و زبانهای دیگر.
این دوره برای چه کسانی مناسب است؟
- دانشجویان رشتههای IT، هوش مصنوعی و مهندسی نرمافزار
- توسعهدهندگانی که میخواهند سیستم صوتی هوش مصنوعی خود را بسازند.
- هر کسی که میخواهد درباره فناوریهای صوتی هوش مصنوعی بیاموزد.
تسلط به فناوریهای صوتی هوش مصنوعی
-
این دوره درباره چیست؟ 02:27
-
چگونه بیشترین بهره را از دوره ببرید؟ 03:32
-
چگونه از Google Colab استفاده کنیم؟ 03:17
-
چگونه از Visual Studio Code استفاده کنیم؟ 02:54
-
کار بهصورت آفلاین با pytts3 در Visual Studio Code 04:00
-
استفاده از gTTS در Visual Studio Code 04:39
-
استفاده از gTTS در Google Colab 02:58
-
11lab 07:19
-
Speechify 07:08
-
OpenAI 06:55
-
اجرای استنتاج با VITS 06:04
-
چرا VITS از سایر TTSها بهتر است؟ 02:04
-
Piper TTS چیست؟ 03:47
-
اجرای Piper TTS در Colab 03:42
-
اجرای Piper TTS در Ubuntu 06:44
-
شبیهسازی صدا با Piper (ویتنامی) 11:58
-
به چند epoch نیاز دارید؟ (ارزیابی کیفیت آموزش در epochهای مختلف) 03:53
-
ساختار مجموعه داده LJ Speech چیست؟ 04:36
-
ایجاد خودکار مجموعه داده LJS از یک فایل صوتی 08:11
-
شبیهسازی صدا در Piper (انگلیسی) 17:36
-
معرفی OpenVoice 01:44
-
گوش دادن به چند نمونه صدای شبیهسازی شده 02:15
-
شبیهسازی صدا برای انگلیسی 07:42
-
شبیهسازی صدا برای چند زبان و زبانهای متقاطع 14:17
-
معرفی TorToise TTS توسط جیمز بتکر 07:36
-
تنظیم دقیق TorToise TTS برای انگلیسی 26:46
-
تنظیم دقیق TorToise TTS برای ویتنامی 17:13
مشخصات آموزش
تسلط به فناوریهای صوتی هوش مصنوعی
- تاریخ به روز رسانی: 1404/12/10
- سطح دوره:متوسط
- تعداد درس:27
- مدت زمان :03:11:17
- حجم :2.45GB
- زبان:دوبله زبان فارسی
- دوره آموزشی:AI Academy