阶跃星辰开源Step3-VL-10B多模态大模型,包含Base和Thinking两个版本。仅10B参数,在视觉理解、逻辑推理等多项基准测试中超越参数大20倍的同类产品,甚至媲美顶尖闭源模型。其视觉感知、逻辑推理和端侧交互能力突出,支持SeRe和PaCoRe推理模式,可部署于端侧设备。
先抛几个核心结论:阶跃星辰正式开源了他们的 Step3-VL-10B 多模态大模型,而且一口气放出了 Base 和 Thinking 两个版本。最让人惊讶的是,这个只有 10B 参数的小模型,在实际测试中,表现竟然超过了参数规模大它 20 倍的同类产品。
官方这次的表态很直接:这个模型在视觉理解、逻辑推理、数学竞赛解题、开放域对话这些主流基准测试里,全部拿下了同参数量级的最佳成绩。换句话说,就是打破了那种“小模型等于低智能”的刻板印象。
长期稳定更新的攒劲资源: >>>点此立即查看<<<
具体来看,在好几项核心评测任务中,Step3-VL-10B 不光追平了,甚至在某些场景下直接超越了参数多它 10 到 20 倍的开源旗舰模型——比如 GLM-4.6V 106B-A12B 和 Qwen3-VL-Thinking 235B-A22B。甚至能跟 Gemini 2.5 Pro、Seed-1.5-VL 这些顶尖闭源模型掰一掰手腕。
这件事的意义在于:原来那些需要靠云端服务器才能跑起来的高阶多模态推理能力,比如自动化操控手机界面、深度解析复杂文档、或者精确到毫米级的物体计数,现在都可以直接塞进智能手机、个人电脑,甚至是工业级的嵌入式设备里了。
那么,这个“小而强”的模型到底凭什么?从技术角度看,它有三大很明确的优势:
值得注意的是,Step3-VL-10B 同时支持两种推理模式:SeRe 和 PaCoRe。从实测数据来看,在 STEM 推理、通用识别、OCR 与文档处理、GUI 定位、空间关系解析、代码生成这些关键维度上,它的表现已经可以媲美千亿参数的大模型。而且,PaCoRe 模式综合得分还要更高一筹。




侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述