کتاب A Practical Guide to Reinforcement Learning from Human Feedback اثر Sandip Kulkarni انتشارات آوای مؤلف
Zoomed Image

کتاب A Practical Guide to Reinforcement Learning from Human Feedback اثر Sandip Kulkarni انتشارات آوای مؤلف

0% (0 نفر) از خریداران، این کالا را پیشنهاد کرده اند

برند :

متفرقه

ویژگی ها

  • زبان نوشتار : انگلیسی
  • طراحی صفحات : متن و تصویر
  • نوع جلد : شومیز
  • نوع کاغذ : تحریر
  • گروه سنی : همه سنین

مشخصات محصول

خلاصه کتاب

یادگیری تقویتی از بازخورد انسانی (RLHF) یک رویکرد قدرتمند برای هم‌ترازی هوش مصنوعی و یادگیری ماشین انسان‌محور است. با ترکیب الگوریتم‌های یادگیری تقویتی با سیگنال‌های بازخورد انسانی، RLHF به یک روش کلیدی برای بهبود ایمنی، قابلیت اطمینان و هم‌ترازی مدل‌های زبانی بزرگ (LLM) تبدیل شده است.

زبان نوشتار

انگلیسی

طراحی صفحات

متن و تصویر

چاپ صفحه

سیاه و سفید

نویسنده

Sandip Kulkarni

ناشر

آوای مؤلف

موضوع

کامپیوتر

قطع

وزیری

نوع جلد

شومیز

نوع کاغذ

تحریر

تعداد صفحه

402

گروه سنی

همه سنین

جهت مشاهده قیمت و خرید کلیک کنید