智谱 AI 开放平台 — 免费体验 2000 万 Token,GLM 系列模型畅用
智谱 AI 开放平台 — 免费体验 2000 万 Token,GLM 系列模型畅用
一、概述
智谱 AI 开放平台(open.bigmodel.cn)是北京智谱华章科技股份有限公司推出的新一代国产通用 AI 大模型开放平台,提供 GLM(General Language Model)系列大语言模型、多模态模型、向量模型等全栈 AI 能力。
平台目前为新注册用户提供 2000 万 Token 的免费体验额度,覆盖 GLM 全系列模型,可充分满足开发、测试和中小规模生产使用需求。
📌 平台入口:https://open.bigmodel.cn 📌 控制台:https://bigmodel.cn/console/overview 📌 API Key 管理:https://bigmodel.cn/usercenter/proj-mgmt/apikeys 📌 开发文档:https://docs.bigmodel.cn 📌 定价页面:https://bigmodel.cn/pricing
二、免费额度说明
| 项目 | 说明 |
|---|---|
| 免费额度 | 注册即送 2000 万 Token |
| 适用模型 | GLM 全系列模型通用 |
| 有效期 | 额度发放后长期有效(以平台政策为准) |
| 注册方式 | 手机号 / 邮箱注册 |
2000 万 Token 约等于 3200 万汉字(GLM 系列模型 token 与字数换算比例约为 1:1.6),足够完成以下任务量:
- 约 1 万篇 3000 字的文章生成
- 约 2 万次多轮对话交互
- 大规模文档摘要与知识提取
- 代码生成与 Debug 辅助
三、模型一览
3.1 语言模型(GLM 系列)
GLM 是基于自回归填空的预训练语言模型,ChatGLM 系列支持复杂自然语言指令,能够解决困难的推理类问题。
| 模型 | 定位 | 上下文 | 最大输出 | 说明 |
|---|---|---|---|---|
| GLM-4-Plus | 旗舰 | 128K | 4K | 当前最强 GLM-4 模型,性能全面领先 |
| GLM-4-0520 | 高性能 | 128K | 4K | 即将弃用(2025.12.30),建议迁移至 Plus |
| GLM-4-Long | 长文本 | 1M | 4K | 支持百万级上下文,适合长文档处理 |
| GLM-4-Flash | 高性价比 | 128K | 4K | 高性价比模型,平衡速度与质量 |
| GLM-4-FlashX | 极速 | 128K | 4K | Flash 升级版,推理速度更快 |
| GLM-4-Flash-250414 | 最新 | 128K | 4K | 2025 年 4 月更新版本 |
| GLM-Z1-Flash | 推理 | 128K | 16K | 专注于推理能力(即将弃用 2025.11.15) |
| GLM-Z1-Air | 推理 | 128K | 16K | 推理模型,轻量级 |
| GLM-Z1-AirX | 推理 | 128K | 16K | 推理模型升级版 |
| GLM-Z1-Plus | 推理旗舰 | 128K | 16K | 推理旗舰模型,复杂推理能力最强 |
3.2 视觉模型(多模态)
| 模型 | 定位 | 上下文 | 最大输出 | 说明 |
|---|---|---|---|---|
| GLM-4V-Plus | 旗舰视觉 | 8K | 4K | 多模态旗舰,图像理解能力最强 |
| GLM-4V | 视觉 | 8K | 4K | 多模态模型,支持图文混合输入 |
3.3 向量模型
| 模型 | 定位 | 上下文 | 说明 |
|---|---|---|---|
| Embedding-3 | V3 | 8K | 最新向量模型 |
| Embedding-2 | V2 | 8K | 第二代向量模型 |
3.4 其他模型
| 模型 | 定位 | 上下文 | 最大输出 | 说明 |
|---|---|---|---|---|
| CharGLM-4 | 拟人模型 | 8K | 4K | 适用于情感陪伴和虚拟角色 |
| Emohaa | 心理模型 | 8K | 4K | 具备专业咨询能力 |
| CodeGeeX-4 | 代码模型 | 128K | 32K | 代码自动补全专用 |
| Rerank | 重排序模型 | 4K | - | 召回结果重排序 |
四、模型选型指南
4.1 按场景选择
| 使用场景 | 推荐模型 | 理由 |
|---|---|---|
| 通用对话 / 写作 | GLM-4-Plus | 综合能力最强 |
| 高频调用 / 成本敏感 | GLM-4-Flash / FlashX | 高性价比,速度快 |
| 长文档分析 / 论文阅读 | GLM-4-Long | 1M 上下文,海量文本一网打尽 |
| 数学 / 逻辑推理 | GLM-Z1-Plus | 推理能力最强 |
| 图片理解 / OCR | GLM-4V-Plus | 多模态旗舰 |
| 代码补全 / 开发辅助 | CodeGeeX-4 | 128K 上下文,代码专用 |
| RAG / 语义检索 | Embedding-3 + Rerank | 向量检索 + 重排序 |
| 情感陪伴 / 虚拟角色 | CharGLM-4 | 拟人化对话 |
4.2 按需求优先级
追求质量 → GLM-4-Plus
追求速度 → GLM-4-FlashX
追求省钱 → GLM-4-Flash
追求长文 → GLM-4-Long
追求推理 → GLM-Z1-Plus
五、快速上手
5.1 注册并获取 API Key
- 访问 智谱 AI 开放平台
- 使用手机号或邮箱注册账号
- 登录后进入 API Key 管理页面
- 创建新的 API Key 并妥善保存
5.2 API 调用示例
智谱 API 兼容 OpenAI 格式,可直接替换 base_url 和 api_key 使用:
from openai import OpenAI
client = OpenAI(
api_key="your-zhipu-api-key",
base_url="https://open.bigmodel.cn/api/paas/v4"
)
response = client.chat.completions.create(
model="glm-4-flash",
messages=[
{"role": "user", "content": "你好,请介绍一下智谱AI"}
],
stream=True
)
for chunk in response:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")
5.3 cURL 调用示例
curl -X POST https://open.bigmodel.cn/api/paas/v4/chat/completions \
-H "Authorization: Bearer your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-flash",
"messages": [
{"role": "user", "content": "用Python写一个快速排序算法"}
]
}'
六、特色能力
6.1 GLM-4-Long — 百万级上下文
GLM-4-Long 支持 1M(100 万 Token) 上下文窗口,相当于约 160 万汉字,是处理超长文档的理想选择:
- 完整法律文书分析
- 学术论文全文阅读与总结
- 大型代码仓库理解
- 长篇报告生成
6.2 GLM-Z1 系列 — 深度推理
GLM-Z1 系列是智谱推出的推理专用模型,在数学、逻辑推理、复杂任务规划方面表现突出:
- 数学竞赛级题目求解
- 多步骤逻辑推理
- 复杂任务分解与规划
6.3 多模态能力
GLM-4V 系列支持图文混合输入:
- 图片内容理解与描述
- 图表数据提取与分析
- 文档截图 OCR + 问答
- 视觉推理
6.4 生态工具链
| 工具 | 说明 |
|---|---|
| 知识库 | 支持文本 / 图片 / 音频 / 视频的跨模态智能检索 |
| 联网搜索 | Web Search API,专为 LLM 优化的搜索引擎 |
| 文件解析 | 支持多种格式文件的文本提取 |
| OCR 服务 | 图片文字识别 |
| 模型微调 | 支持用户自定义数据微调模型 |
| 模型部署 | 支持私有化部署 |
| GLM in Excel | Excel 中直接使用 GLM 能力(Beta) |
七、成本优化建议
- 开发测试阶段:使用
GLM-4-Flash,性价比最高 - 生产部署:根据场景选择
GLM-4-Plus(质量优先)或GLM-4-FlashX(速度优先) - 长文本处理:使用
GLM-4-Long,避免手动分片带来的质量损失 - RAG 场景:
Embedding-3+Rerank组合,减少 LLM 调用次数 - 设置 max_tokens:避免生成过长的回复浪费 Token
- 批量处理:使用 批量处理 API 降低成本
八、注意事项
- 免费额度:2000 万 Token 为注册赠送,用完后需充值继续使用
- 模型弃用:GLM-Z1 系列将于 2025.11.15 弃用,GLM-4-0520 将于 2025.12.30 弃用,请提前迁移
- API 兼容:智谱 API 兼容 OpenAI 格式,大多数 OpenAI SDK 可直接替换使用
- Token 换算:GLM 系列中 token 与字数比例约 1:1.6,实际以模型返回的
usage为准 - 上下文窗口:超出上下文窗口的部分会被自动截断,影响回答质量
九、与其他免费模型对比
| 平台 | 模型 | 免费额度 | 多模态 | OpenAI 兼容 |
|---|---|---|---|---|
| 智谱 AI | GLM 全系列 | 2000 万 Token | ✅ | ✅ |
| SenseNova | 6.7 Flash-Lite / U1 Fast | 1,500 次 / 5h | ✅ | ✅ |
| LongCat | 2.0-Preview | 内测独享额度 | ✅ | ✅ |
| DeepSeek | DeepSeek-V3 | 注册赠送额度 | ✅ | ✅ |
| Gemini 2.0 Flash | 免费额度 | ✅ | ✅ | |
| 阿里 | 通义千问 | 注册赠送额度 | ✅ | ✅ |
十、总结
智谱 AI 开放平台的 2000 万 Token 免费额度 是目前国内大模型平台中最为慷慨的免费体验之一。从通用对话的 GLM-4-Plus 到百万上下文的 GLM-4-Long,从推理专用的 GLM-Z1 到多模态的 GLM-4V,全系列模型通用,加上 OpenAI 兼容的 API 接口,让迁移成本几乎为零。
🔗 立即注册:https://open.bigmodel.cn 📖 开发文档:https://docs.bigmodel.cn