dataset
active
dataset:qwq-32bQwQ-32B
Reasoning-optimized base model used for training SFR-DR-32B variant.
Neighborhood — ranked by edge-count
Papers (1)
paper
Frameworks (1)
framework
- SFR-DeepResearchmentionsThe paper's core contribution: an RL-based framework for training autonomous single-agent LLMs to perform deep research with web search, browsing, and code execution.