智谱 AI GLM (Zhipu AI GLM)
综合排名 #10 ⭐ 可考虑
✅ 国内直连 | 🇨🇳 国内可用
💰 Token 价格
| 类型 | 价格 | 备注 |
|---|---|---|
| 输入 (Input) | GLM-5.3 (Workers AI): $1.40/M + $0.26/M cached; GLM-5.2: ¥8/M; GLM-5.3-Flash (Workers AI): $0.15/M; GLM-5: ¥4-6/M; GLM-4.7: ¥2-4/M; GLM-4.5-Air: ¥0.8/M; GLM-4.7-Flash: ¥0/M (free) | 每百万 tokens |
| 输出 (Output) | GLM-5.3 (Workers AI): $4.40/M; GLM-5.2: ¥28/M; GLM-5.3-Flash (Workers AI): $0.50/M; GLM-5: ¥18-22/M; GLM-4.7: ¥8-16/M; GLM-4.5-Air: ¥2-8/M; GLM-4.7-Flash: ¥0/M (free) | 每百万 tokens |
💡 免费额度
GLM-4-Flash 完全免费;注册送 500万 tokens 体验包
🤖 支持模型(共 14 个)
GLM-5.3 GLM-5.3-Flash GLM-5.2 GLM-5.1 GLM-5 GLM-5-Turbo GLM-4.7 GLM-4.5-Air GLM-4.7-Flash GLM-4.7-FlashX GLM-4.6V GLM-Image GLM-4-Voice Embedding-3
✨ 优势
- ✓ GLM-5.3 — strongest open-weights coding model (2026-08-28 on Cloudflare Workers AI, same price as GLM-5.2, 6.1x Terminal Bench 3.0)
- ✓ GLM-4-Flash 完全免费,适合大量轻度调用
- ✓ CogView-3 图像生成 + CogVideoX 视频生成
- ✓ 模型种类多样(文本+图像+视频)
- ✓ GLM-4-Plus 性能接近 GPT-4 级别
- ✓ 国内直连,稳定可靠
- ✓ 开源模型(ChatGLM)社区知名度高
⚠️ 不足
- × GLM-4-Plus 价格极高(¥50/M tokens)
- × GLM-4 系列的英文能力不如 DeepSeek/Qwen
- × 多模态模型的 API 文档不够成熟
- × Flash 免费模型有使用限制
- × 平台国际知名度不高
🎯 适合场景
国内应用开发;GLM-4-Flash 免费模型适合低成本原型验证;多模态需求(文本+图像+视频全覆盖)
💰 价格与方案
| 模型 | 上下文 | 输入 (¥/百万) | 输出 (¥/百万) | 备注 |
|---|---|---|---|---|
| GLM-5.2(新品) | 1M | ¥8(缓存命中 ¥2) | ¥28 | 长任务旗舰,从需求到多端部署全链路 |
| GLM-5.1 | 最高 1M | ¥6–¥8 | ¥24–¥28 | 前沿推理,按 32K 输入长度分档 |
| GLM-5-Turbo | 最高 1M | ¥5–¥7 | ¥22–¥26 | 生产环境速度/成本均衡 |
| GLM-5 | 最高 1M | ¥4–¥6 | ¥18–¥22 | 通用主力模型 |
| GLM-4.7 | 200K | ¥2–¥4 | ¥8–¥16 | 高性价比中端 |
| GLM-4.5-Air | 128K | ¥0.8 | ¥2–¥8 | 廉价高频调用 |
| GLM-4.7-FlashX | 200K | ¥0.5 | ¥3 | 超低价的 200K 上下文 |
| GLM-4.7-Flash | 200K | 免费 | 免费 | 完全免费,额度充足 |
| GLM-4.6V | 128K | ¥1–¥2 | ¥3–¥6 | 视觉理解(图像/视频) |
🔧 API 与开发者体验
- •API 风格: open.bigmodel.cn 提供 OpenAI 兼容的 chat/completions REST 端点并支持 SSE 流式;大多数 OpenAI SDK 与封装层只需更换 base-url 和 key 即可接入。
- •SDK 与生态: 官方提供 Python、Node SDK 及 OpenAI 兼容客户端;智谱同时开源 ChatGLM/GLM 系列权重,自托管社区与工具生态庞大。
- •工具调用与 Agent: GLM-5.x 系列原生支持函数/工具调用与结构化 JSON;GLM 是国内众多 Agent 框架默认的'工具调用'骨干模型。
- •AutoGLM(智能体): AutoGLM / GLM-Phone 是智谱的旗舰智能体,通过截图与点击直接操控手机/浏览器——这是纯文本 API 之外的真实世界任务自动化的显著差异化能力。
- •Prompt 缓存: GLM-5.x 与 GLM-4.7 系列自动进行前缀缓存——缓存命中价约为输入价的四分之一(如 GLM-5.2 命中 ¥2/百万 vs 未命中 ¥8/百万),大幅降低重复上下文成本。
- •视觉与实时: GLM-4.6V / GLM-5V 支持图像与视频输入;GLM-4-Voice、CogTTS 与 GLM-ASR 覆盖实时语音——文本、视觉、音频、视频一平台打通。
- •计费与区域: 以人民币计费、预充值;免费模型(GLM-4.7-Flash)与新手 token 代金券让原型开发近乎零成本。国内直连,无需代理。
🎯 智能体与长上下文(GLM-5.2 / AutoGLM)
智谱的核心优势在于建立在真正可用的 100 万 token 上下文之上的智能体与长程 AI 能力。当前旗舰 GLM-5.2 在单窗口内承载项目级工程上下文,可一次任务从需求出发直抵多端部署而无需重载——凭借自动前缀缓存(命中 ¥2/百万 vs 未命中 ¥8/百万)让仓库级推理在经济上可行。GLM-5.x 系列按输入长度分档计费(32K token 以内短输入更便宜),使交互式负载保持廉价,同时长上下文智能体支付合理溢价。智谱另一支柱是 AutoGLM(GLM-Phone),一个通过截图与点击操控手机/浏览器的自主智能体。叠加开源的 ChatGLM 血统与国内优先的产品定位,智谱是国内面向 Agent 流水线与整仓库编码最全面的选项之一。
🌐 中国访问与延迟
智谱 AI 总部位于北京,open.bigmodel.cn 的 API 原生面向中国大陆:无需代理直连、无 GFW 规避需求、无跨境出口费用。从中国大陆数据中心访问智谱国内端点,API 延迟通常为个位数到十几毫秒 RTT;以人民币计费,免去海外厂商带来的货币与开票摩擦。这使得智谱成为中国大陆团队最容易上手的国内选项之一:大陆手机号注册、人民币充值、直接调用国内端点。主要注意事项是常见的国内云问题——SLA 与冗余绑定于智谱的大陆基础设施,国际文档相对国内重心属于次要,GLM-5.x 前沿模型主要通过智谱自有平台提供,而非广泛的西方转售网络。