paper
referenced-only
paper:deepseek-r1

Deepseek-r1: In-centivizing reasoning capability in llms via reinforcement learning

Similar preprints — Semantic Scholar

Cited by (1)