GLM-4.7-Flash 是 Z.ai 的 30B 级模型,在性能与效率之间取得平衡。它针对智能体编码场景进一步优化,强化了编码能力、长周期任务规划与工具协同,在多个公开评测榜单上取得了同尺寸开源模型中的领先表现。它支持函数调用(工具调用)、提示缓存和联网搜索。上下文窗口 200K tokens,输出 128K。该版本完全免费:输入与输出 tokens 均按 $0 计费。在 Ofox 上可通过 OpenAI 与 Anthropic 两种协议调用。
上下文窗口
200K
最大输出 Token
128K
发布日期
2026-01-19
能力
函数调用提示缓存网络搜索
可用供应商
Zhipu
支持的协议
openaianthropic
定价
| 类型 | 价格 |
|---|---|
| 输入 Token | $0/M |
| 输出 Token | $0/M |
| 网络搜索 | $0.01/R |
代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.7-flash:free",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
第三方评测
LMArena ↗评测条目:glm-4.7-flash
Z.ai: GLM-4.7-Flash (Free) 在 LMArena 文本榜单(风格控制) 综合类别中获得 1368 分,在 374 个模型中排名第 162,基于 11,720 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1368 | 1362–1374 | 第 162 / 374 名 | 11,720 |
| 困难任务 | 1387 | 1379–1394 | 第 159 / 374 名 | 6,515 |
| 编程 | 1423 | 1412–1435 | 第 154 / 369 名 | 2,686 |
| 数学 | 1366 | 1345–1387 | 第 162 / 362 名 | 715 |
| 创意写作 | 1313 | 1299–1327 | 第 183 / 372 名 | 1,809 |
| 指令遵循 | 1351 | 1341–1361 | 第 167 / 374 名 | 3,171 |
| 中文 | 1434 | 1406–1461 | 第 120 / 344 名 | 442 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
Z.ai: GLM-4.7-Flash (Free) 在 Ofox.ai 上的价格为输入 $0/百万 Token,输出 $0/百万 Token。按量计费,无月费。
Z.ai: GLM-4.7-Flash (Free) 支持 200K Token 的上下文窗口,最大输出 128K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.ai/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
Z.ai: GLM-4.7-Flash (Free) 支持以下能力:函数调用, 提示缓存, 网络搜索。通过 Ofox.ai 统一 API 访问所有功能。