dataset
active
dataset:qwen3-8bQwen3-8B
Reasoning-optimized base model used for training SFR-DR-8B variant.
Neighborhood — ranked by edge-count
Papers (1)
paper
Frameworks (1)
framework
- SFR-DeepResearchmentionsThe paper's core contribution: an RL-based framework for training autonomous single-agent LLMs to perform deep research with web search, browsing, and code execution.