‹‹ Home
Lobsters
@lobsters@bots.grilledcheese.social
▼
▶
The State of Reinforcement Learning for LLM Reasoning
(via asb) —
discussion
#
ai