truefoundry/trueforge
TrueForge 是 TrueFoundry 发布的开源 agent harness(运行时层),用于将 LLM 转化为可用 agent。它运行模型调用、MCP 工具、skills、沙箱、审批、上下文管理和会话状态,通过聊天 UI、HTTP API 和 TypeScript SDK 三种方式暴露。支持 OpenAI、Anthropic、Google Gemini 等模型提供商,提供本地模式(SQLite)和托管模式(Postgres + Redis,Docker Compose 或 Helm)。基准测试显示与 Claude Managed Agents 和 deepagents 在相同任务下准确率相同、成本更低。项目以 MIT 许可证发布,要求 Node.js >= 22.14。
TrueForge
TrueForge 为你运行 agent 执行循环——模型调用、MCP 工具、skills、沙箱、审批、上下文管理和会话状态——并以三种方式暴露:聊天 UI、带 TypeScript SDK 的 HTTP API,以及可嵌入的 UI SDK。
TrueForge Chat UI
为什么选择 TrueForge?
构建一个 agent 很容易。但把它运行好则不然——你需要流式传输、会话持久化、工具服务器、沙箱、审批和 UI。TrueForge 开箱即用地提供这些:
- 从目录进行初始设置——一次性配置模型、MCP 服务器、skills和沙箱;agent 从你连接的内容中选取。预设来自随附的 YAML 目录,你可以自定义。
- 任意模型提供商——OpenAI、Anthropic、Google Gemini 及其他目录提供商,或任何兼容 OpenAI 的端点。
- MCP 工具——支持 header 认证或 OAuth 的远程 MCP 服务器,包括聊天内授权。
- Skills——基于 git 的
SKILL.md指令包,按需在沙箱中加载。 - 沙箱即工具——隔离的代码/文件执行(目前为 Daytona;计划支持更多提供商),仅在需要时配置。密钥保留在 harness 中。
- 人工检查点——工具审批、向用户提问,以及聊天中的 Generative UI。
- 上下文工程——子 agent、延迟工具加载、Code Mode、大结果卸载和压缩。
- 聊天 UI + SDK——使用内置 UI,通过
@truefoundry/trueforge-sdk自动化,或嵌入@truefoundry/trueforge-ui。
它既可向下扩展也可向上扩展:本地模式(单进程、SQLite)或托管模式(Postgres + Redis、Docker Compose 或 Helm)。
快速开始
运行 TrueForge(本地、Docker Compose 或 Kubernetes),连接模型和工具,并在快速开始中构建你的第一个可复用 agent。
要从本仓库开发 TrueForge,请参阅 CONTRIBUTING.md。
架构
| 模式 | 适用场景 | 存储 | 额外基础设施 | 运行方式 |
|---|---|---|---|---|
| 本地 | 个人使用、试用 | SQLite | 无 | npx @truefoundry/trueforge |
| 托管 | 团队、多副本 | Postgres | Postgres + Redis | Docker Compose 或 Helm |
本地模式仅适用于你的机器。 它是试用 TrueForge 的便捷方式——不是生产或面向互联网的部署。默认没有登录,数据存储在本地 SQLite 文件中。请将其保留在 localhost 上。如果超出此范围使用本地模式,我们无法对数据丢失或未授权访问承担责任。对于共享或生产部署,请使用托管模式。
文档
| 章节 | 内容 |
|---|---|
| 简介 | 什么是 agent harness,TrueForge 如何组合在一起 |
| 快速开始 | 运行本地或托管模式,构建你的第一个 agent |
| 初始设置 | 模型、MCP、skills、沙箱——目录和覆盖 |
| 创建 Agent | 选择资源;工具审批、提问、Generative UI |
| Harness 能力 | 沙箱即工具、子 agent、延迟工具、Code Mode、压缩 |
| 设置登录 | 共享部署的可选 OIDC |
| 基准测试 | 与 Claude Managed Agents 和 deepagents 的成本/准确率对比 |
| SDK | TypeScript 客户端:会话、轮次、事件 |
| 聊天 UI | 内置 UI 和嵌入 @truefoundry/trueforge-ui |
| API 参考 | OpenAPI 路径和 schema |
基准测试
我们在相同的任务、工具和模型上对比 TrueForge 与 Claude Managed Agents 和 deepagents——准确率相同,成本更低。可从 benchmark/ 复现。详细说明:基准测试。
贡献
我们欢迎各种贡献——bug 报告、功能建议和文档修正。请参阅 CONTRIBUTING.md 和我们的行为准则。Fork PR 应仅修改源代码;维护者会在合并后重新生成 SDK。
如需报告安全漏洞,请遵循 SECURITY.md,不要公开提交 issue。
联系我们
许可证
TrueForge 以 MIT 许可证发布。