StepFun 開源的 Step-DeepResearch
最近看到 StepFun 開源的 Step-DeepResearch,覺得蠻值得關注。 圖可以看到,在 ResearchRubrics 基準上它的分數已經逼近 OpenAI DeepResearch、Gemini DeepResearch 等商業系統,但推理成本卻壓到不到它們的十分之一,算是目前少數「效能接近頂規、但價格超便宜」的深度研究模型。 另外中期訓練過程中,隨著訓練 token 增加,模型在 SimpleQA、TriviaQA、FRAMES 等任務上的表現持續穩定提升,特別是對需要結構化推理的 FRAMES 進步幅度最大,這也是和一般只強化「搜尋能力」的模型很不一樣的地方 簡單來說,如果把 Gemini 或 OpenAI DeepResearch 看成是旗艦機,Step-DeepResearch 比較像是用 32B 這種中等尺寸,就把深度研究的整套流程做到位,而且在成本上很適合大規模、長時間跑研究任務的場景,期待之後落地應用的各種發展