智谱 BigModel

3天前更新 3 0 0

清华系国产 MaaS 头部,GLM-5.2 旗舰支持 1M 上下文,新用户赠送 2000 万 Tokens,国内直连,GLM-4.7-Flash 永久免费。

所在地:
中国
语言:
中文
收录时间:
2026-07-26
智谱 BigModel智谱 BigModel
开发商:智谱 AI(清华系)
核心模型:GLM-5.2(最新旗舰)/ GLM-5.1 / GLM-5 / GLM-5-Turbo / GLM-4.7-Flash(免费)
上下文:1M(GLM-5.2),200K(GLM-5.1/5/Turbo),最大输出依模型
多模态:文本、图像、视频、文件(GLM-5V-Turbo)、GLM-Image 文生图、GLM-ASR/TTS 语音
平台类型:官方
计价方式:GLM-5.2:输入 8 元/输出 28 元/百万 Tokens(缓存命中 2 元);GLM-5.1:输入 6-8 元/输出 24-28 元(依输入长度分段);GLM-5-Turbo:输入 5-7 元/输出 22-26 元;GLM-4.7-Flash:免费(单位:元/百万 Tokens,Batch 5 折)
免费额度:新用户注册 2000 万 Tokens;GLM-4.7-Flash / GLM-4.5-Flash 永久免费
接入方式:OpenAI 兼容(base_url: open.bigmodel.cn/api/paas/v4)/ SDK / REST API
适用场景:企业接入、AI 编程、智能体、长文档处理、长程任务、多模态应用
特色功能:Batch 5 折、Prompt Caching、Tool Use、Function Call、模型微调、智能体平台、MCP 市场、GLM-4.7-Flash 免费
可访问性:直连

智谱 BigModel 是智谱 AI 推出的模型即服务平台,当前主力模型线为 GLM-5.2(最新旗舰)/ GLM-5.1 / GLM-5 / GLM-5-Turbo,以及免费档 GLM-4.7-Flash。支持 OpenAI 兼容接口、SDK、REST API。新用户注册即送 2000 万 Tokens,按 token 计费,国内直连,无需 VPN。

 

产品概述

智谱由清华大学技术成果转化而来,2025 年 2 月 12 日发布 GLM-5(7450 亿参数,性能媲美 Claude Opus 4.5),2026 年 4 月 8 日发布 GLM-5.1(在 SWE-bench Pro 基准测试中实现国产模型首次超越 Claude Opus 4.6,支持长达 8 小时的自主工作任务),2026 年 6 月 15 日发布 GLM-5.2——面向长任务时代的旗舰模型,支持真正可用的 1M 上下文,可承载项目级工程上下文,一次任务即可完成从需求到多端部署的完整开发链路,并将遵循 MIT 协议开源。GLM 系列完成从”会做题”到”会办事”的跨越,2026 年经历三次提价(GLM-5 首发涨 67%-100%、GLM-5-Turbo 涨 20%、GLM-5.1 涨 10%),标志国产模型进入”需求定价”时代。平台除文本模型外,还提供 GLM-5V-Turbo 多模态 Agent 基座模型、GLM-Image 文生图、GLM-OCR 文档解析、GLM-ASR/GLM-TTS 语音识别合成、GLM Slide/Poster Agent 等全栈能力。

 

核心能力

  • 文本生成:GLM-5.2 / GLM-5.1 / GLM-5 全档通用对话、写作、代码、翻译
  • 推理与智能体:GLM-5.1 在 SWE-bench Pro 上国产首次超越 Claude Opus 4.6;GLM-5-Turbo 专为 Agent 长链路工具调用优化
  • 长上下文:GLM-5.2 支持 1M 上下文,可承载项目级工程上下文
  • 多模态:GLM-5V-Turbo 支持图像/视频/文本/文件输入,GLM-4.6V 视觉理解,GLM-OCR 文档解析
  • 语音:GLM-ASR 实时转写,GLM-TTS 语音合成
  • 高级功能:Batch API 5 折、Prompt Caching(缓存命中低至 0.4 元/百万 Tokens)、Tool Use、JSON Output、Function Call、模型微调(LoRA/全参)、智能体平台、MCP 市场

 

优势亮点

  • GLM-5.2 支持 1M 上下文,长程任务执行稳定,工程规范遵循可靠
  • 新用户注册送 2000 万 Tokens,额度在国内 MaaS 中最大方
  • GLM-4.7-Flash 永久免费(200K 上下文),GLM-4.5-Flash 也免费,开发测试零成本
  • 清华系技术背书,GLM 系列开源(MIT 协议),可私有化部署
  • 全栈能力:文本/视觉/语音/图像/OCR/Agent 一体化,不只是聊天 API
  • Batch API 5 折,长 prompt 场景 Prompt Caching 命中价低至 0.4 元/百万 Tokens
  • 国内直连,无需 VPN,支付宝/国内信用卡可直接付款
  • Coding Plan 订阅套餐(Lite/Pro/Max)覆盖个人到团队

 

短板

  • 2026 年三次提价,GLM-5 系列价格已逼近海外一线(GLM-5.1 缓存命中价 $0.26/百万 Tokens,接近 Claude Opus 4.5 的 $0.5)
  • GLM-4.7-Flash 免费但有 QPS 限制,不适合高并发生产
  • 海外版 GLM Coding Plan 涨价 80%-150%,国内外价格割裂
  • 模型迭代极快(GLM-5 → 5.1 → 5.2),老代码迁移成本高
  • 企业级 SLA 和 ToB 服务成熟度不及阿里百炼

 

适用人群

国内开发者、AI 编程(GLM-5.1 SWE-bench Pro SOTA)、长文档处理(1M 上下文)、预算有限的创业团队、需要清华系技术背书的政企项目、想从免费档(GLM-4.7-Flash)起步的初学者。

相关导航