دوره آموزشی
دوبله زبان فارسی
یادگیری تقویتی از بازخورد انسانی (RLHF)
✅ سرفصل و جزئیات آموزش
در این دوره درباره یادگیری تقویتی از بازخورد انسانی، کارایی هوش مصنوعی مولد را با درک تخصص انسانی ترکیب کنید. مدرس به شما یاد میدهد چگونه مدلهای GenAI را طوری بسازید که واقعاً ارزشها و ترجیحات انسانی را منعکس کنند و همزمان تجربه عملی با مدلهای زبانی بزرگ کسب کنید.
همچنین پیچیدگیهای مدلهای پاداش را پیمایش خواهید کرد و میآموزید چگونه بر پایه مدلهای زبانی بزرگ، هوش مصنوعیای بسازید که نه تنها یاد میگیرد، بلکه با سناریوهای دنیای واقعی سازگار میشود.
یادگیری تقویتی از بازخورد انسانی (RLHF)
-
معرفی RLHF None
-
بررسی مدلهای زبانی بزرگ ازپیشآموخته None
-
آمادهسازی داده برای RLHF None
-
متدهای جمعآوری بازخورد باکیفیت None
-
اندازهگیری کیفیت و مرتبط بودن بازخورد None
-
یادگیری فعال None
-
بررسی مدلهای پاداش None
-
آموزش با PPO None
-
تیونینگ دقیق کارآمد در RLHF None
-
معیارهای مدل و تنظیمات None
-
ادغام منابع متنوع بازخورد None
-
ارزیابی مدلهای RLHF None
-
جمعبندی سفر RLHF شما None
مشخصات آموزش
یادگیری تقویتی از بازخورد انسانی (RLHF)
- تاریخ به روز رسانی: 1404/12/10
- سطح دوره:پیشرفته
- تعداد درس:13
- مدت زمان :4:00:00
- حجم :261.0MB
- زبان:دوبله زبان فارسی
- دوره آموزشی:AI Academy