ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Precios a partir de
36,51

Destacado

COMPARAR TODAS LAS TIENDAS WEB (2)

Descripción

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Comparar tiendas web (2)

Shop
Precio
36,51 
36,51 
Descripción (0)

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models


Especificaciones del producto

Marca Independently Published
EAN
  • 9798193902928

Elección Destacada
36,51 
Ver oferta