HN
Hacker News
Top
New
Best
Ask
Show
Jobs
Comment by lazyasciiart | Hacker News Reader
Parent
Full thread
lazyasciiart
·
RL'd?
View on HN
Ancapistani
·
Reinforcement learning, I'd assume.
Presumably RLHF (Reinforcement Learning from Human Feedback).
Reply on news.ycombinator.com