کتاب A Practical Guide to Reinforcement Learning from Human Feedback اثر Sandip Kulkarni انتشارات آوای مؤلف
0%
(0 نفر) از خریداران، این کالا را پیشنهاد کرده اند
برند :
متفرقهویژگی ها
- زبان نوشتار : انگلیسی
- طراحی صفحات : متن و تصویر
- نوع جلد : شومیز
- نوع کاغذ : تحریر
- گروه سنی : همه سنین
مشخصات محصول
خلاصه کتاب
یادگیری تقویتی از بازخورد انسانی (RLHF) یک رویکرد قدرتمند برای همترازی هوش مصنوعی و یادگیری ماشین انسانمحور است. با ترکیب الگوریتمهای یادگیری تقویتی با سیگنالهای بازخورد انسانی، RLHF به یک روش کلیدی برای بهبود ایمنی، قابلیت اطمینان و همترازی مدلهای زبانی بزرگ (LLM) تبدیل شده است.
زبان نوشتار
انگلیسی
طراحی صفحات
متن و تصویر
چاپ صفحه
سیاه و سفید
نویسنده
Sandip Kulkarni
ناشر
آوای مؤلف
موضوع
کامپیوتر
قطع
وزیری
نوع جلد
شومیز
نوع کاغذ
تحریر
تعداد صفحه
402
گروه سنی
همه سنین















