阶跃星辰 Step-2 API 测评 2026:多模态旗舰与定价
阶跃星辰(Stepfun)是一家上海 AI 实验室,其Step-2模型是 1.2 万亿参数的多模态旗舰,通过单一 OpenAI 兼容端点接受文本、图像、音频与视频输入。⚠️ 与多数按模态分别计费、需独立视觉 API 的中国 LLM 栈不同,Step-2 把所有输入都视为 content part — 视频理解调用与文本对话走同一条计费路径。本文完整评测模型、2026 年 8 月价格、API 接入、Step-R 推理、区域可用性、竞品对比与真实局限。
🧠 模型列表
| 模型 | 档位 | 上下文 | 适用场景 |
|---|---|---|---|
| Step-2 | 多模态旗舰 | 128K | 单一端点的文本+图像+音频+视频 |
| Step-2-mini | 快速多模态 | 32K | 低成本高吞吐多模态 Agent |
| Step-1 | 上代旗舰 | 32K | 稳定、文档完善的多模态对话 |
| Step-1.5V | 视觉调优 | 32K | 图像重 OCR、文档推理 |
| Step-R | 推理 | 64K | o1 / R1 同级,价格 1/5 |
| Step-CC | 代码补全 | 16K | IDE 补全、内联建议 |
| Step-Embed | 嵌入 | 8K | 1024 维文本嵌入,适用 RAG |
💰 定价(2026-08-05 验证)
词元价格单位为人民币每百万 token。30 天免费窗口结束后,阶跃星辰按预充值按量计费。
| 模型 | 输入(¥/M) | 输出(¥/M) | 美元等值 | 备注 |
|---|---|---|---|---|
| Step-2 | ¥6 | ¥18 | $0.83 / $2.50 | 万亿参数多模态旗舰 |
| Step-2-mini | ¥1 | ¥3 | $0.14 / $0.42 | Step-2 快速版,200B |
| Step-1 | ¥4 | ¥12 | $0.56 / $1.67 | 300B 多模态,上代 |
| Step-1.5V | ¥3 | ¥9 | $0.42 / $1.25 | 视觉调优 200B |
| Step-R | ¥8 | ¥24 | $1.11 / $3.33 | 推理,o1 / R1 同级 |
| Step-CC | ¥1 | ¥2 | $0.14 / $0.28 | 代码补全 |
🔌 OpenAI Python SDK 接入
from openai import OpenAI
client = OpenAI(
base_url="https://platform.stepfun.com/v1",
api_key="YOUR_STEPFUN_API_KEY"
)
response = client.chat.completions.create(
model="step-2",
messages=[
{"role": "user", "content": [
{"type": "text", "text": "总结这个视频片段。"},
{"type": "video_url", "video_url": {"url": "https://example.com/clip.mp4"}}
]}
]
)
print(response.choices[0].message.content)
同一 base_url 适用于任何 OpenAI 兼容框架适配器。阶跃星辰同时提供官方 Python SDK(含多模态辅助),仓库 github.com/stepfun-ai — 适合需要流式 token 用量统计、图像感知缓存、Step-CC completions 端点的调用方。
⚡ Step-R 推理:¥8/M 的 o1 替代
Step-R 是阶跃星辰对标 OpenAI o1 与 DeepSeek R1 的推理模型,链式思考通过标准流式接口暴露。关键数字:输入 ¥8 / 输出 ¥24 每百万 token。OpenAI o1 定价 $15 / $60,DeepSeek R1 是 ¥4 / ¥16 — Step-R 大约是 o1 的 1/5、R1 的 2 倍,但在与 Step-2 配对时具备显著更强的多模态上下文继承(Step-R 在 Step-2 的多模态输入上做推理时,图像/视频上下文不会丢失)。
生产数学 / 代码负载上,Step-R 在 MATH-500 与 HumanEval 上与 R1 持平,推理过程可在最终答案前被检查,便于调试或审计。代价:无原生 tool calling — Step-R 纯文本,工具型 agent 需把它包在规划模型(通常 Step-2)中做串联调用。
🆚 对比 DeepSeek V3.2 / Qwen3.5-Max / Kimi K3
| 厂商 | 旗舰 | 上下文 | 输入/输出(每 M) | 多模态 | 国内直连 |
|---|---|---|---|---|---|
| 阶跃星辰 | Step-2 | 128K | ¥6 / ¥18 | ✅ 单一端点 | ✅ |
| DeepSeek | V3.2 | 64K | ¥0.14 / ¥0.28 | ❌ 纯文本 | ✅ |
| 阿里 Qwen | Qwen3.5-Max | 1M | ¥4 / ¥12 | ✅ 独立 VL | ✅ |
| 月之暗面 Kimi | K3 | 1M | ¥2 / ¥20 | ✅ 原生 | ✅ |
| OpenAI | GPT-5 | 128K | $1.25 / $10 | ✅ 走 GPT-4o | ❌ 需代理 |
Step-2 的主要优势是单一端点多模态流水线 — 一次 chat-completions 调用即可处理任意组合的文本/图像/音频/视频。DeepSeek V3.2 在裸价上胜出(输入便宜 40 倍),但仅文本且需调用方额外集成视觉 API。Qwen3.5-Max 与 Kimi K3 在上下文窗口(1M token)上领先,更适合代码仓库或长文档 RAG。OpenAI GPT-5 仍主导生态成熟度与 tool calling,但中国大陆无法直接访问。
⚠️ 已知限制
- 128K 上下文落后于 Kimi K3 与 Qwen3.8-Max(均为 1M)。
- 国际端点仅香港,美/欧延迟高于国内。
- Function Calling 处于 Beta,生产调用方需在 Step-2 外面包一层规划器做工具路由。
- 官网无 SOC 2 / HIPAA 文档,部署医疗或金融负载前需在合同中确认企业合规条款。
- 模型发布节奏中等,部分新模型 Beta 周期长于竞品。
- 除标准预充值档位外,无批量或量级折扣。
🎯 选型建议
当你需要在中国大陆以单一 OpenAI 兼容端点获得一线多模态 LLM 接入,或以 o1 / R1 1/5 价格获得推理替代(Step-R)时,选阶跃星辰;长文档 RAG 场景,1M 上下文的 Kimi K3 与 Qwen3.8-Max 不可替代;纯文本 + 极致成本的场景,DeepSeek V3.2 是首选。国内多模态生产负载,Step-2 是当前开源权重阵营中接口最干净的方案。
FAQ
阶跃星辰兼容 OpenAI 吗?
兼容。把 OpenAI 客户端的 base URL 设为 https://platform.stepfun.com/v1 即可。
支持哪些输入?
Step-2 与 Step-2-mini 在单一 chat-completions 接口中接受文本、图像、音频、视频;老模型(Step-1、Step-1V)仅文本+图像。
有免费额度吗?
有 — 注册后 30 天内赠送 100 万 token,之后转为预充值按量计费。
Step-R 用来做什么?
推理(数学、代码审查、多步骤规划),价格为 OpenAI o1 的 1/5。
国内能直接用吗?
可以 — platform.stepfun.com 走国内 BGP 路由,典型 TTFT 200-400ms,无需代理或跨境路由。