dataset
active
dataset:qwen3-8b

Qwen3-8B

Reasoning-optimized base model used for training SFR-DR-8B variant.

Neighborhood — ranked by edge-count

Frameworks (1)

framework
  • The paper's core contribution: an RL-based framework for training autonomous single-agent LLMs to perform deep research with web search, browsing, and code execution.