阶跃星辰 Step-2 API 测评 2026:多模态旗舰与定价

阶跃星辰(Stepfun)是一家上海 AI 实验室,其Step-2模型是 1.2 万亿参数的多模态旗舰,通过单一 OpenAI 兼容端点接受文本、图像、音频与视频输入。⚠️ 与多数按模态分别计费、需独立视觉 API 的中国 LLM 栈不同,Step-2 把所有输入都视为 content part — 视频理解调用与文本对话走同一条计费路径。本文完整评测模型、2026 年 8 月价格、API 接入、Step-R 推理、区域可用性、竞品对比与真实局限。

🌍 简要结论:阶跃星辰是国内多模态生产负载下,最强的 OpenAI 兼容一线替代,比 Reka AI 更适合国内场景;Step-R 是 OpenAI o1 / DeepSeek R1 的 1/5 价格替代。128K 上下文窗口落后于 Kimi K3(1M)与 Qwen3.8-Max(1M)。

🧠 模型列表

模型档位上下文适用场景
Step-2多模态旗舰128K单一端点的文本+图像+音频+视频
Step-2-mini快速多模态32K低成本高吞吐多模态 Agent
Step-1上代旗舰32K稳定、文档完善的多模态对话
Step-1.5V视觉调优32K图像重 OCR、文档推理
Step-R推理64Ko1 / R1 同级,价格 1/5
Step-CC代码补全16KIDE 补全、内联建议
Step-Embed嵌入8K1024 维文本嵌入,适用 RAG

💰 定价(2026-08-05 验证)

词元价格单位为人民币每百万 token。30 天免费窗口结束后,阶跃星辰按预充值按量计费。

模型输入(¥/M)输出(¥/M)美元等值备注
Step-2¥6¥18$0.83 / $2.50万亿参数多模态旗舰
Step-2-mini¥1¥3$0.14 / $0.42Step-2 快速版,200B
Step-1¥4¥12$0.56 / $1.67300B 多模态,上代
Step-1.5V¥3¥9$0.42 / $1.25视觉调优 200B
Step-R¥8¥24$1.11 / $3.33推理,o1 / R1 同级
Step-CC¥1¥2$0.14 / $0.28代码补全

🔌 OpenAI Python SDK 接入

from openai import OpenAI
client = OpenAI(
    base_url="https://platform.stepfun.com/v1",
    api_key="YOUR_STEPFUN_API_KEY"
)
response = client.chat.completions.create(
    model="step-2",
    messages=[
        {"role": "user", "content": [
            {"type": "text", "text": "总结这个视频片段。"},
            {"type": "video_url", "video_url": {"url": "https://example.com/clip.mp4"}}
        ]}
    ]
)
print(response.choices[0].message.content)

同一 base_url 适用于任何 OpenAI 兼容框架适配器。阶跃星辰同时提供官方 Python SDK(含多模态辅助),仓库 github.com/stepfun-ai — 适合需要流式 token 用量统计、图像感知缓存、Step-CC completions 端点的调用方。

⚡ Step-R 推理:¥8/M 的 o1 替代

Step-R 是阶跃星辰对标 OpenAI o1 与 DeepSeek R1 的推理模型,链式思考通过标准流式接口暴露。关键数字:输入 ¥8 / 输出 ¥24 每百万 token。OpenAI o1 定价 $15 / $60,DeepSeek R1 是 ¥4 / ¥16 — Step-R 大约是 o1 的 1/5、R1 的 2 倍,但在与 Step-2 配对时具备显著更强的多模态上下文继承(Step-R 在 Step-2 的多模态输入上做推理时,图像/视频上下文不会丢失)。

生产数学 / 代码负载上,Step-R 在 MATH-500 与 HumanEval 上与 R1 持平,推理过程可在最终答案前被检查,便于调试或审计。代价:无原生 tool calling — Step-R 纯文本,工具型 agent 需把它包在规划模型(通常 Step-2)中做串联调用。

🆚 对比 DeepSeek V3.2 / Qwen3.5-Max / Kimi K3

厂商旗舰上下文输入/输出(每 M)多模态国内直连
阶跃星辰Step-2128K¥6 / ¥18✅ 单一端点
DeepSeekV3.264K¥0.14 / ¥0.28❌ 纯文本
阿里 QwenQwen3.5-Max1M¥4 / ¥12✅ 独立 VL
月之暗面 KimiK31M¥2 / ¥20✅ 原生
OpenAIGPT-5128K$1.25 / $10✅ 走 GPT-4o❌ 需代理

Step-2 的主要优势是单一端点多模态流水线 — 一次 chat-completions 调用即可处理任意组合的文本/图像/音频/视频。DeepSeek V3.2 在裸价上胜出(输入便宜 40 倍),但仅文本且需调用方额外集成视觉 API。Qwen3.5-Max 与 Kimi K3 在上下文窗口(1M token)上领先,更适合代码仓库或长文档 RAG。OpenAI GPT-5 仍主导生态成熟度与 tool calling,但中国大陆无法直接访问。

⚠️ 已知限制

  • 128K 上下文落后于 Kimi K3 与 Qwen3.8-Max(均为 1M)。
  • 国际端点仅香港,美/欧延迟高于国内。
  • Function Calling 处于 Beta,生产调用方需在 Step-2 外面包一层规划器做工具路由。
  • 官网无 SOC 2 / HIPAA 文档,部署医疗或金融负载前需在合同中确认企业合规条款。
  • 模型发布节奏中等,部分新模型 Beta 周期长于竞品。
  • 除标准预充值档位外,无批量或量级折扣。

🎯 选型建议

当你需要在中国大陆以单一 OpenAI 兼容端点获得一线多模态 LLM 接入,或以 o1 / R1 1/5 价格获得推理替代(Step-R)时,选阶跃星辰;长文档 RAG 场景,1M 上下文的 Kimi K3 与 Qwen3.8-Max 不可替代;纯文本 + 极致成本的场景,DeepSeek V3.2 是首选。国内多模态生产负载,Step-2 是当前开源权重阵营中接口最干净的方案。

FAQ

阶跃星辰兼容 OpenAI 吗?
兼容。把 OpenAI 客户端的 base URL 设为 https://platform.stepfun.com/v1 即可。

支持哪些输入?
Step-2 与 Step-2-mini 在单一 chat-completions 接口中接受文本、图像、音频、视频;老模型(Step-1、Step-1V)仅文本+图像。

有免费额度吗?
有 — 注册后 30 天内赠送 100 万 token,之后转为预充值按量计费。

Step-R 用来做什么?
推理(数学、代码审查、多步骤规划),价格为 OpenAI o1 的 1/5。

国内能直接用吗?
可以 — platform.stepfun.com 走国内 BGP 路由,典型 TTFT 200-400ms,无需代理或跨境路由。