智谱 AI GLM (Zhipu AI GLM)

收录于 https://open.bigmodel.cn

综合排名 #10 ⭐ 可考虑
✅ 国内直连 | 🇨🇳 国内可用

💰 Token 价格

类型 价格 备注
输入 (Input) GLM-5.3 (Workers AI): $1.40/M + $0.26/M cached; GLM-5.2: ¥8/M; GLM-5.3-Flash (Workers AI): $0.15/M; GLM-5: ¥4-6/M; GLM-4.7: ¥2-4/M; GLM-4.5-Air: ¥0.8/M; GLM-4.7-Flash: ¥0/M (free) 每百万 tokens
输出 (Output) GLM-5.3 (Workers AI): $4.40/M; GLM-5.2: ¥28/M; GLM-5.3-Flash (Workers AI): $0.50/M; GLM-5: ¥18-22/M; GLM-4.7: ¥8-16/M; GLM-4.5-Air: ¥2-8/M; GLM-4.7-Flash: ¥0/M (free) 每百万 tokens
💡 免费额度

GLM-4-Flash 完全免费;注册送 500万 tokens 体验包

🤖 支持模型(共 14 个)

GLM-5.3 GLM-5.3-Flash GLM-5.2 GLM-5.1 GLM-5 GLM-5-Turbo GLM-4.7 GLM-4.5-Air GLM-4.7-Flash GLM-4.7-FlashX GLM-4.6V GLM-Image GLM-4-Voice Embedding-3

✨ 优势

  • GLM-5.3 — strongest open-weights coding model (2026-08-28 on Cloudflare Workers AI, same price as GLM-5.2, 6.1x Terminal Bench 3.0)
  • GLM-4-Flash 完全免费,适合大量轻度调用
  • CogView-3 图像生成 + CogVideoX 视频生成
  • 模型种类多样(文本+图像+视频)
  • GLM-4-Plus 性能接近 GPT-4 级别
  • 国内直连,稳定可靠
  • 开源模型(ChatGLM)社区知名度高

⚠️ 不足

  • × GLM-4-Plus 价格极高(¥50/M tokens)
  • × GLM-4 系列的英文能力不如 DeepSeek/Qwen
  • × 多模态模型的 API 文档不够成熟
  • × Flash 免费模型有使用限制
  • × 平台国际知名度不高

🎯 适合场景

国内应用开发;GLM-4-Flash 免费模型适合低成本原型验证;多模态需求(文本+图像+视频全覆盖)

💰 价格与方案

模型上下文输入 (¥/百万)输出 (¥/百万)备注
GLM-5.2(新品)1M¥8(缓存命中 ¥2)¥28长任务旗舰,从需求到多端部署全链路
GLM-5.1最高 1M¥6–¥8¥24–¥28前沿推理,按 32K 输入长度分档
GLM-5-Turbo最高 1M¥5–¥7¥22–¥26生产环境速度/成本均衡
GLM-5最高 1M¥4–¥6¥18–¥22通用主力模型
GLM-4.7200K¥2–¥4¥8–¥16高性价比中端
GLM-4.5-Air128K¥0.8¥2–¥8廉价高频调用
GLM-4.7-FlashX200K¥0.5¥3超低价的 200K 上下文
GLM-4.7-Flash200K免费免费完全免费,额度充足
GLM-4.6V128K¥1–¥2¥3–¥6视觉理解(图像/视频)

🔧 API 与开发者体验

  • API 风格: open.bigmodel.cn 提供 OpenAI 兼容的 chat/completions REST 端点并支持 SSE 流式;大多数 OpenAI SDK 与封装层只需更换 base-url 和 key 即可接入。
  • SDK 与生态: 官方提供 Python、Node SDK 及 OpenAI 兼容客户端;智谱同时开源 ChatGLM/GLM 系列权重,自托管社区与工具生态庞大。
  • 工具调用与 Agent: GLM-5.x 系列原生支持函数/工具调用与结构化 JSON;GLM 是国内众多 Agent 框架默认的'工具调用'骨干模型。
  • AutoGLM(智能体): AutoGLM / GLM-Phone 是智谱的旗舰智能体,通过截图与点击直接操控手机/浏览器——这是纯文本 API 之外的真实世界任务自动化的显著差异化能力。
  • Prompt 缓存: GLM-5.x 与 GLM-4.7 系列自动进行前缀缓存——缓存命中价约为输入价的四分之一(如 GLM-5.2 命中 ¥2/百万 vs 未命中 ¥8/百万),大幅降低重复上下文成本。
  • 视觉与实时: GLM-4.6V / GLM-5V 支持图像与视频输入;GLM-4-Voice、CogTTS 与 GLM-ASR 覆盖实时语音——文本、视觉、音频、视频一平台打通。
  • 计费与区域: 以人民币计费、预充值;免费模型(GLM-4.7-Flash)与新手 token 代金券让原型开发近乎零成本。国内直连,无需代理。

🎯 智能体与长上下文(GLM-5.2 / AutoGLM)

智谱的核心优势在于建立在真正可用的 100 万 token 上下文之上的智能体与长程 AI 能力。当前旗舰 GLM-5.2 在单窗口内承载项目级工程上下文,可一次任务从需求出发直抵多端部署而无需重载——凭借自动前缀缓存(命中 ¥2/百万 vs 未命中 ¥8/百万)让仓库级推理在经济上可行。GLM-5.x 系列按输入长度分档计费(32K token 以内短输入更便宜),使交互式负载保持廉价,同时长上下文智能体支付合理溢价。智谱另一支柱是 AutoGLM(GLM-Phone),一个通过截图与点击操控手机/浏览器的自主智能体。叠加开源的 ChatGLM 血统与国内优先的产品定位,智谱是国内面向 Agent 流水线与整仓库编码最全面的选项之一。

🌐 中国访问与延迟

智谱 AI 总部位于北京,open.bigmodel.cn 的 API 原生面向中国大陆:无需代理直连、无 GFW 规避需求、无跨境出口费用。从中国大陆数据中心访问智谱国内端点,API 延迟通常为个位数到十几毫秒 RTT;以人民币计费,免去海外厂商带来的货币与开票摩擦。这使得智谱成为中国大陆团队最容易上手的国内选项之一:大陆手机号注册、人民币充值、直接调用国内端点。主要注意事项是常见的国内云问题——SLA 与冗余绑定于智谱的大陆基础设施,国际文档相对国内重心属于次要,GLM-5.x 前沿模型主要通过智谱自有平台提供,而非广泛的西方转售网络。