Baseten · 官方

如何在任意框架中运行GLM-5.2

How to run GLM-5.2 in any harness

二〇二六年六月二十五日 · 英文原文

Baseten 发布了如何在 Claude Code、Codex 和 Deep Agents CLI (LangChain) 等三种流行 harness 中运行 GLM-5.2 的教程。GLM-5.2 在 Baseten 平台上以 280+ TPS 的速度运行,质量与闭源模型相当,速度比 Opus 4.8 快约 4.5 倍,成本便宜约 5 倍。用户只需在 Baseten 获取 API key 并配置环境变量或 profile 文件,即可在 5 分钟内完成集成。该教程由 Alex Ker 撰写,发布于 2026 年 6 月 24 日。

宣布我们的 F 轮融资。了解更多

登录开始使用

AI 工程

如何在任意 harness 中运行 GLM-5.2

了解如何在 Claude Code、Codex、Deep Agents CLI 或任意 harness 中以 280+ TPS 的速度使用 GLM-5.2。

作者

Image 1Image 2Image 3: Alex Ker

Alex Ker

最后更新

2026 年 6 月 24 日

目录

分享

Image 5: 在任意 harness 中运行 GLM-5.2

GLM-5.2 是今年的 DeepSeek 时刻。它已经在改变我们与智能交互和消费智能的方式。

随着我们和我们的 agent 继续 tokenmax,tokenonomics 和性能比以往任何时候都更加重要。GLM 5.2 是一个完美的前沿模型,在质量上与闭源模型相当,同时在速度和成本上以数倍的优势超越它们(例如,比 Opus 4.8 快约 4.5 倍,便宜约 5 倍,许多人认为它是即插即用的替代品)。

开源不再是妥协,而是在扩展个人和组织能力方面,各个维度上的逻辑赢家。以下是如何在不到 5 分钟的时间内,在当今 3 个流行的 harness 中使用 GLM-5.2 的具体方法,这些方法可以推广到任何其他 harness。

Claude Code

  1. 安装 Claude Code:npm install -g@anthropic-ai/claude-code

  2. baseten.co 创建一个账户,并从 app.baseten.co/settings/api_keys 获取 API key

  3. 编辑 ~/.claude/settings.json 并添加:

"env": {
    "ANTHROPIC_AUTH_TOKEN": "your_baseten_api_key",
    "ANTHROPIC_BASE_URL": "https://inference.baseten.co",
    "ANTHROPIC_DEFAULT_HAIKU_MODEL": "zai-org/GLM-5.2",
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "zai-org/GLM-5.2",
    "ANTHROPIC_DEFAULT_OPUS_MODEL": "zai-org/GLM-5.2"
}

运行 CC,GLM-5.2 将为每个 Claude Code 调用提供动力。

Codex

  1. 像上面一样获取一个 Baseten API key,并将其存储在 macOS Keychain 中:
security add-generic-password \
  -a "$USER" \
  -s codex-baseten-api-key \
  -w "YOUR_BASETEN_API_KEY_HERE" \
  -U
  1. 将 Baseten provider 添加到 ~/.codex/config.toml
[model_providers.baseten]
name = "Baseten"
base_url = "https://inference.baseten.co/v1"
wire_api = "responses"

[model_providers.baseten.auth]
command = "/usr/bin/security"
args = ["find-generic-password", "-a", "YOUR_MAC_USERNAME", "-s", "codex-baseten-api-key", "-w"]
timeout_ms = 5000
  1. ~/.codex/baseten-glm.config.toml 创建一个 profile:
model = "zai-org/GLM-5.2"
model_provider = "baseten"
model_reasoning_effort = "medium"

运行:codex --profile baseten-glm 以使用 GLM-5.2 启动 Codex,你所有的请求都将路由到此模型。

Deep Agents CLI (LangChain)

  1. 运行:
curl -LsSf https://langch.in/dcode
  1. 使用 dcode 启动,并在其中:

类似的工作流程也适用于 OpenCodeCline 和其他 harness,只需提供 API key 即可获得原生安装体验,因此我不再赘述设置过程。我很想听听来自 token 工厂的经验以及你构建的内容。

联系我们

与我们的产品专家联系,了解我们如何提供帮助。

与工程师交谈

相关文章

查看所有 AI 工程

AI 工程

滚动部署实现模型零停机更新

Image 6Image 7

Image 9Image 10

Image 12Image 13

Archit Mishra

另外 2 人

Image 15Image 16

AI 工程

使用 Qwen3-TTS 实现经济高效的高性能 TTS

Image 18Image 19

Image 21Image 22

Ian Carrasco

另外 1 人

Image 24Image 25

AI 工程

Harness 至关重要。以下是如何优化你的 harness。

Image 27Image 28

Image 30Image 31

Alex Ker

另外 1 人

Image 33Image 34

立即探索 Baseten

开始部署与工程师交谈

产品

Baseten 推理平台

部署选项

嵌入式工程

模态

行业

开发者

资源

热门模型

法律

所有系统正常

© 2026 Baseten

Image 36: SOC 2 Type II 认证Image 37: 符合 HIPAA 标准

产品

Baseten 推理平台

部署选项

嵌入式工程

模态

行业

开发者

资源

热门模型

法律

所有系统正常

© 2026 Baseten

Image 38: SOC 2 Type II 认证Image 39: 符合 HIPAA 标准

Image 40Image 41

译自 Baseten · 官方 · 录于 二〇二六年六月二十五日