ZA

GLM-4.5

Z.ai GLM 发布 2025年7月28日 TextImageVideoPDF glm-4-5

模型简介

GLM-4.5 是 Z.ai 推出的面向 Agent 的 MoE 模型,官方资料描述为 355B 总参数、32B 激活参数。文档强调推理、代码、工具调用和浏览器类 Agent 能力,并支持思考与非思考模式。它可以作为 GLM-5 之前一代重要的 Agent 基座模型来介绍。

规格与价格

上下文窗口
131.1K Token
最大输出
98.3K Token
输入价格
¥3/M
输出价格
¥14/M
发布日期
2025年7月28日
输入价格
¥3/M
输出价格
¥14/M

API 能力

推理
支持
工具调用
支持
Temperature 参数
支持
附件
不支持
知识库
2025-04-01
Endpoint 协议
Completions API

模型亮点

GLM-4.5 是融合推理、编程和智能体能力的开放权重文本模型,提供混合思考模式和 128K 上下文。

GLM-4.5 模型亮点
GLM-4.5 是融合推理、编程和智能体能力的开放权重文本模型,提供混合思考模式和 128K 上下文。
融合式智能体推理
在同一模型中融合推理、编程和智能体专项训练,用于多步骤问题求解与软件任务。
混合思考模式
为复杂推理提供思考模式,同时为简单工作负载提供直接响应模式,便于按任务调整推理投入。
开放权重 MoE
采用总计 3550 亿、每次前向激活 320 亿参数的专家混合架构,并以 MIT 许可证开放权重。

适用场景

GLM-4.5 适合软件工程智能体、复杂文本推理以及需要调整思考深度的自托管开发流程。

GLM-4.5 使用场景
GLM-4.5 适合软件工程智能体、复杂文本推理以及需要调整思考深度的自托管开发流程。
软件工程智能体
规划代码修改、检查项目文件,并在多轮开发任务中执行实现和调试步骤。
复杂文本推理
在思考模式下分析长篇技术需求或多步骤逻辑问题,并生成有依据的文本解决方案。
私有化模型部署
在受控基础设施中部署 MIT 许可的开放权重,用于内部编程、推理或智能体工作负载。

调用示例

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokiway.com/v1",
    api_key="YOUR_TOKIWAY_KEY",
)

resp = client.chat.completions.create(
    model="glm-4-5",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

更多说明

Z.ai

GLM-5.3-Flash

glm-5.3-flash
TextImageVideoPDF
Text

最大上下文

1M

最大输出

131.1K

发布日期

暂无

输入¥0.8 / 百万 Token
输出¥2.8 / 百万 Token

Z.ai GLM 的其他模型

ZA
GLM-5
Z.ai GLM
GLM-5 是 Z.ai 面向 Agentic Engineering、复杂系统工程和长程 Agent 任务的新一代基座模型。官方文档强调它面向生产级编程、规划、后端推理和迭代式自我纠错。描述时应突出复杂工程工作流,而不是只把它写成“中国大模型”。
204.8K Token 上下文 131.1K Token 输出 2026年2月11日
输入¥4/M
输出¥18/M
缓存¥0.8/M
ZA
GLM-5.1
Z.ai GLM
GLM-5.1 被描述为面向代码、长周期任务和 Agentic Engineering 的重要升级。相关资料强调它可以在更长时间跨度内规划、执行和改进任务,输出更完整的工程级结果。它更适合作为开发者与 Agent 模型来介绍,而不是普通问答模型。
200K Token 上下文 131.1K Token 输出 2026年3月27日
输入¥6/M
输出¥24/M
缓存¥1.2/M
ZA
GLM-5.2
Z.ai GLM
GLM-5.2 是智谱 AI(Z.ai)面向长程工程任务、Agent 工作流和复杂推理的旗舰基础模型。其可用的 1M token 上下文可承载项目级代码库、系统文档和多步骤持续执行。你可以通过 Tokiway 调用 GLM API / 智谱 API,查看当前价格、可用端点、上下文限制和基准测试结果,再评估其是否适合需求分析、仓库理解、实现、测试与部署等生产级开发流程。
1M Token 上下文 131.1K Token 输出 2026年6月13日
输入¥8/M
输出¥28/M
缓存¥2/M
ZA
GLM-5.3
Z.ai GLM
GLM-5.3 是 Z.ai 最新的旗舰模型,专为高级编码、软件工程和长周期智能体任务而构建。拥有 1M 令牌上下文窗口、最高 128K 输出令牌、强大的推理和工具使用能力,非常适合编码智能体、复杂开发工作流和多步骤自动化。
1M Token 上下文 128K Token 输出 2026年8月19日
输入¥8/M
输出¥28/M
缓存¥2/M
ZA
GLM-5.3-Flash
Z.ai GLM
GLM-5.3-Flash 是智谱 AI(Z.ai)GLM-5 系列首个原生多模态模型,面向快速编程、视觉理解和 Agent 工作流。它采用 320B 参数的 MoE 架构,每个 token 激活 18B 参数,并结合稀疏注意力与线性注意力,以提升长上下文任务的推理效率。你可以通过 Tokiway 调用 GLM API / 智谱 API,查看当前 GLM-5.3-Flash 的价格、模型 ID、支持输入、工具调用、上下文限制和端点,再评估是否用于生产级编程或多模态智能体任务。
1M Token 上下文 131.1K Token 输出 2026年8月26日
输入¥0.8/M
输出¥2.8/M
缓存¥0.23/M