A Practical Guide to Reinforcement Learning from Human Feedback

Foundations, aligning large language models, and the evolution of preference-based methods

Omschrijving

Er is geen omschrijving gevonden.

Gratis verzending vanaf
€ 19,95 binnen Nederland
Schrijver
Kulkarni, Sandip
Titel
A Practical Guide to Reinforcement Learning from Human Feedback
Uitgever
Packt Publishing
Jaar
2026
Taal
Engels
Pagina's
402
EAN
9781835880500
Bindwijze
Paperback

U ontvangt bij ons altijd de laatste druk!


Rubrieken

Boekstra