Zhipu AI
Z.ai 的开发者平台,覆盖 GLM-5.3、开放多模态 GLM-5.3-Flash、GLM-5.2,以及文本、视觉、图像、视频、音频、向量、智能体和工具服务。
Z.ai 与 BigModel 分别是 Z.ai/智谱的国际与开发者入口。原始 GLM-5.3 旗舰通过 Coding Plan 面向复杂软件工程、长程 Agent 和网络安全分析,提供 100 万 Token 上下文、128K 最大输出,以及 low、high、max 三档推理强度。GLM-5.3-Flash 是独立的新训练变体,采用 320B 总参数、18B 激活参数、原生多模态、MIT 权重、一方 API、100 万上下文配置和稀疏-线性混合注意力。GLM-5.2 仍是成熟的已有定价 API 和开放权重路径。更广泛的平台还覆盖视觉、图像、视频、音频、向量、智能体和工具服务,并提供 HTTP、Python、Java、OpenAI SDK 兼容和 LangChain 集成路径。
专题指南基于来源梳理原始 GLM-5.3、开放多模态 GLM-5.3-Flash、GLM-5.2、BigModel API、Coding Plan、ZCode、消费者 Agent 和媒体产品。
编辑结论
适合对比中国多模态模型 API、智能体服务和 OpenAI 兼容迁移路径的开发者。
在目标地区测试账号注册、计费和支持前,不应把它视为完整国际化平台。
Z.ai 现在有英文产品界面,而 BigModel 仍是完整 GLM 产品线的 API 证据来源。
20 million free tokens are promoted; VentureBeat reports GLM-5.2 API pricing at $1.40/M input tokens and $4.40/M output tokens
Free trial tokens, Platform billing, Enterprise sales
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
可用于对比 GLM 文本、视觉、图像、视频、音频、向量和重排序 API。
官方文档包含工具调用、联网搜索、OCR、文件解析、批处理、微调和智能体 API。
文档提到 OpenAI SDK 兼容,但生产迁移仍需测试端点、计费和模型行为。
重视原始 GLM-5.3 的公开编程定位时通过 Coding Plan 使用;需要 API、原生多模态或 MIT 权重时看 GLM-5.3-Flash;需要成熟替代路径时看 GLM-5.2。
模型名称、额度、发布状态、区域接入和商用条款变化较快,采购或生产使用前请重新核验官方来源。
qwen
deepseek
minimax-api
官方 · EN · 核验于 2026-08-28
确认 MIT 权重、一方 API、原生多模态、320B/18B 激活架构、100 万上下文配置和混合注意力。
官方 · EN · 核验于 2026-08-14
确认模型发布、后训练扩展、编程与网络安全提升、强制思考模式、Coding Plan 上线,以及安全加固后再发布权重的计划。
文档 · EN · 核验于 2026-08-14
确认原始模型发布时的 100 万上下文、128K 输出、文本模态和 Coding Plan 可用性;GLM-5.3-Flash 另行跟踪。
官方 · EN · 核验于 2026-08-04
确认稳定 100 万 Token 上下文、High/Max 思考强度、MIT 许可、开放权重、本地推理框架、Coding Plan 上线和官方基准披露。
其他 · EN · 核验于 2026-06-21
报道模型参数量为 753B、API 输入 $1.40/百万 Token、输出 $4.40/百万 Token、缓存输入 $0.26/百万 Token,并将厂商自报基准和价格与闭源竞品比较。
其他 · EN · 核验于 2026-06-21
报道 GLM-5.2 在 Design Arena 中领先 Claude Fable 5 并位居第一;VentureBeat 另行报道其 ELO 为 1360。该结果应视为媒体报道的竞技场表现,而非本站独立复现的基准。
文档 · ZH · 核验于 2026-05-17
确认一站式 MaaS 定位、SDK、OpenAI SDK 兼容和 LangChain 集成。
最后核验: 2026-08-28
暂无已审核的评论。