HNHacker News
TopNewBestAskShowJobs

anakin87

-1 karma · joined April 4, 2023

submissionscomments

Show HN: Hands-on course for building RL environments for LLMs

github.com·1 pts·anakin87·
1

Environments Hub: Your Language Model needs better (open) environments to learn

huggingface.co·2 pts·anakin87·
1

GRPO experiment - I trained a Language Model to schedule events

github.com·1 pts·anakin87·
1

I trained a Language Model to schedule events with GRPO

huggingface.co·1 pts·anakin87·
1

Llama2 + Haystack on Colab

github.com·7 pts·anakin87·
1