A Practical Guide to Reinforcement Learning from Human Feedback | Foundations, aligning large language models, and the evolution of preference-based methods

Sandip Kulkarni

ISBN 10: 1835880509 ISBN 13: 9781835880500
Editorial: Packt Publishing, 2026
Idioma: Inglés
Condición: Nuevo Encuadernación de tapa blanda

Vendido por preigu, Osnabrück, Alemania

Vendedor de AbeBooks desde 5 de agosto de 2024

Calificación del vendedor: 5 de 5 estrellas Valoración 5 estrellas, Más información sobre las valoraciones de los vendedores

Ver los artículos de este vendedor


Nuevos - Encuadernación de tapa blanda

Condición: Nuevo

Precio:
EUR 69,45
Envío por EUR 70,00
Se envía de Alemania a Estados Unidos de America

Cantidad disponible: 5 disponibles

Añadir al carrito