paper
referenced-only
2025
paper:doi-10-48550-arxiv-2501-12948

DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

ByAdam Suma·Sam Dauncey

Similar preprints — Semantic Scholar

Cited by (2)