top
new
show
ask
jobs
about

Reinforcement Learning from Human Feedback (RLHF) in Notebooks

69 points by ash_at_hny 12 hours ago

kcdom1000f 10 hours ago

Hl

careful_ai 7 hours ago

[dead]

bobvylan 6 hours ago

[dead]