A Practical Guide to Reinforcement Learning from Human Feedback: Foundations, aligning large language models, and the evolution of preference-based me (Paperback or Softback)

Kulkarni, Sandip

ISBN 10: 1835880509 ISBN 13: 9781835880500
Editorial: Packt Publishing 3/27/2026, 2026
Idioma: Inglés
Condición: Nuevo Encuadernación de tapa blanda

Vendido por BargainBookStores, Grand Rapids, MI, Estados Unidos de America

Vendedor de AbeBooks desde 23 de enero de 2002

Calificación del vendedor: 5 de 5 estrellas Valoración 5 estrellas, Más información sobre las valoraciones de los vendedores

Ver los artículos de este vendedor


Nuevos - Encuadernación de tapa blanda

Condición: Nuevo

Precio:
EUR 76,32
Gastos de envío gratis
Se envía dentro de Estados Unidos de America

Cantidad disponible: 5 disponibles

Añadir al carrito