PaperDeck
← Feed

  2025

DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Adam Suma, Sam Dauncey

4,924 citations

Read paperarXiv ↗