
智谱 BigModel 是智谱 AI 推出的模型即服务平台,当前主力模型线为 GLM-5.2(最新旗舰)/ GLM-5.1 / GLM-5 / GLM-5-Turbo,以及免费档 GLM-4.7-Flash。支持 OpenAI 兼容接口、SDK、REST API。新用户注册即送 2000 万 Tokens,按 token 计费,国内直连,无需 VPN。
产品概述
智谱由清华大学技术成果转化而来,2025 年 2 月 12 日发布 GLM-5(7450 亿参数,性能媲美 Claude Opus 4.5),2026 年 4 月 8 日发布 GLM-5.1(在 SWE-bench Pro 基准测试中实现国产模型首次超越 Claude Opus 4.6,支持长达 8 小时的自主工作任务),2026 年 6 月 15 日发布 GLM-5.2——面向长任务时代的旗舰模型,支持真正可用的 1M 上下文,可承载项目级工程上下文,一次任务即可完成从需求到多端部署的完整开发链路,并将遵循 MIT 协议开源。GLM 系列完成从”会做题”到”会办事”的跨越,2026 年经历三次提价(GLM-5 首发涨 67%-100%、GLM-5-Turbo 涨 20%、GLM-5.1 涨 10%),标志国产模型进入”需求定价”时代。平台除文本模型外,还提供 GLM-5V-Turbo 多模态 Agent 基座模型、GLM-Image 文生图、GLM-OCR 文档解析、GLM-ASR/GLM-TTS 语音识别合成、GLM Slide/Poster Agent 等全栈能力。
核心能力
- 文本生成:GLM-5.2 / GLM-5.1 / GLM-5 全档通用对话、写作、代码、翻译
- 推理与智能体:GLM-5.1 在 SWE-bench Pro 上国产首次超越 Claude Opus 4.6;GLM-5-Turbo 专为 Agent 长链路工具调用优化
- 长上下文:GLM-5.2 支持 1M 上下文,可承载项目级工程上下文
- 多模态:GLM-5V-Turbo 支持图像/视频/文本/文件输入,GLM-4.6V 视觉理解,GLM-OCR 文档解析
- 语音:GLM-ASR 实时转写,GLM-TTS 语音合成
- 高级功能:Batch API 5 折、Prompt Caching(缓存命中低至 0.4 元/百万 Tokens)、Tool Use、JSON Output、Function Call、模型微调(LoRA/全参)、智能体平台、MCP 市场
优势亮点
- GLM-5.2 支持 1M 上下文,长程任务执行稳定,工程规范遵循可靠
- 新用户注册送 2000 万 Tokens,额度在国内 MaaS 中最大方
- GLM-4.7-Flash 永久免费(200K 上下文),GLM-4.5-Flash 也免费,开发测试零成本
- 清华系技术背书,GLM 系列开源(MIT 协议),可私有化部署
- 全栈能力:文本/视觉/语音/图像/OCR/Agent 一体化,不只是聊天 API
- Batch API 5 折,长 prompt 场景 Prompt Caching 命中价低至 0.4 元/百万 Tokens
- 国内直连,无需 VPN,支付宝/国内信用卡可直接付款
- Coding Plan 订阅套餐(Lite/Pro/Max)覆盖个人到团队
短板
- 2026 年三次提价,GLM-5 系列价格已逼近海外一线(GLM-5.1 缓存命中价 $0.26/百万 Tokens,接近 Claude Opus 4.5 的 $0.5)
- GLM-4.7-Flash 免费但有 QPS 限制,不适合高并发生产
- 海外版 GLM Coding Plan 涨价 80%-150%,国内外价格割裂
- 模型迭代极快(GLM-5 → 5.1 → 5.2),老代码迁移成本高
- 企业级 SLA 和 ToB 服务成熟度不及阿里百炼
适用人群
国内开发者、AI 编程(GLM-5.1 SWE-bench Pro SOTA)、长文档处理(1M 上下文)、预算有限的创业团队、需要清华系技术背书的政企项目、想从免费档(GLM-4.7-Flash)起步的初学者。
相关导航


DeepSeek API

Gemini API

火山方舟
硅基流动

百度千帆

OpenAI API

